MiniMax H3 is available on EmpirioLabs. It is a multimodal video model that takes text, images, video, and audio in a single request and returns a 4 to 15 second clip at 24 fps in 768p or 2K, each with a native stereo audio track.
أربع طرق لتوصيلها
H3 هو نموذج واحد مع الوضع البارامترات التي يتم كشفها آلياً من أيّاً كان ما ترفقه، لذا فإن معظم الطلبات لا تحتاج إلى تحديدها على الإطلاق.
- تحويل النص إلى فيديو: بسرعة لوحدها
- الصورة إلى فيديو: صورة واحدة تصبح الإطار الافتتاحي
- الإطار الأول والأخير: Provide an opening and a closing image and the model transitions between them.
- إشارة إلى الفيديو: ما يصل إلى 9 صور، و 3 أشرطة فيديو، و 3 مقاطع صوتية، و 12 ملفا مرجعيا في المجموع، لحمل موضوع أو أسلوب عبر الطلقة.
ويمكن للمتفرجين أن يصلوا إلى 000 7 شخص ويمكنهم أن يصفوا الإجراءات، وأعمال الكاميرا، والحوار، والآثار السليمة، والنص قيد الفرز. يمكن تحديد نسبة المشتبه بهم بشكل صريح أو تركهم متكيفين حتى يتبعوا وسائل الإعلام
How to call MiniMax H3
الجيل الفيديوي مُدهش قدم المهمة، ثم اقتبسها:
"الـ "بـيـر
الإجابة تعيد job_id و poll_url. الاستطلاع rlm; حتى يحين الوضع اكتملوالمقطع النهائي يصل كتوصيل البيانات [0].url.
لتنشيط صورة قائمة، أضف صورة- الانتقال بين إطارين، إضافة آخر حاسوب كذلك لحمل موضوع عبر مشهد، إرسال عدة صور تحت الصور.
التسعير
H3 تُدوّن كل ثانية من الفيديو في القرار الذي تطلبه، مع سعر 2K فوق 768p. هناك تفاصيل تستحق المعرفة قبل أن تبني
- مرجع الفيديو تُدوّن لفترة خاصة بها بالإضافة إلى المقطع الذي تُولّدُه، لذا 5 إشارة ثانية إستعملتْ لإسْتِعْمال ستّة مقطعِ ثانيةِ
- المرجع الخامس الأول الصور وتدرج كل صورة مرجعية إضافية على حدة.
شاهدْ الحياةَ صفحة النماذج و صفحة الأسعار بالنسبة للأسعار الحالية.
ابدأ البناء
جرب مينيماكس H3 في الملعب، اقرأ توثيق واجهة برمجة التطبيقاتأو مقارنتها مع نماذج أخرى كتالوج النماذج.
إفصاح: كتب هذا المقال بمساعدة الذكاء الاصطناعي وتمت مراجعته من قبل EmpirioLabs AI.



