
يولد مقاطع تتراوح مدتها من 4 إلى 15 ثانية بدقة تصل إلى 2K مع صوت ستيريو الأصلي، متبعا الإشارات النصية والصورة والفيديو والصوت في طلب واحد.
يولد مقاطع تتراوح مدتها من 4 إلى 15 ثانية بدقة تصل إلى 2K مع صوت ستيريو الأصلي، متبعا الإشارات النصية والصورة والفيديو والصوت في طلب واحد.
minimax-h3/v1/videos/generationsminimax/minimax-h3hailuo-3minimax/hailuo-3أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.
يعمل MiniMax H3 عبر POST /v1/videos/generations. يعيد الطلب job_id فورًا؛ استعلم عن GET /v1/jobs/{job_id} حتى تكتمل المهمة ثم اقرأ روابط الإخراج من النتيجة. احصل على مفتاح API من لوحة تحكم EmpirioLabs.
curl https://api.empiriolabs.ai/v1/videos/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-h3",
"prompt": "Describe what you want MiniMax H3 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/videos/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "minimax-h3",
"prompt": "Describe what you want MiniMax H3 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)معلمات الطلب التي تدعمها واجهة MiniMax H3 API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.
| المعامل | النوع | الافتراضي | النطاق / القيم | الوصف |
|---|---|---|---|---|
| prompt | string | - | - | وصف المشهد، يصل إلى 7000 حرف. يمكنه وصف الحركة، وعمل الكاميرا، والحوار، والمؤثرات الصوتية، والنصوص على الشاشة. |
| mode | enum | auto | auto, t2v, i2v, flf, r2v, regenerate | تلقائي: اكتشاف من المدخلات. T2V: text-to-video. i2V: تحريك صورة واحدة كإطار افتتاحي. FFL: الانتقال من الإطار الأول إلى الإطار الأخير. R2V: reference-to-video من... |
| resolution | enum | 768p | 768p, 2k | دقة الإخراج. يتم إصدار 2K بمعدل أعلى في الثانية من 768p. |
| aspect_ratio | enum | adaptive | adaptive, 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 | نسبة العرض إلى الارتفاع المخرجة. يتبع التكيف وسائط الإدخال المرفقة. |
| duration | number | 6 | 4 إلى 15 | مدة المقطع بالثواني، الأرقام الصحيحة فقط. |
| image | string | - | - | رابط الصورة. إطار افتتاحي واحد ل image-to-video، أو حتى 9 صور مرجعية ل reference-to-video. |
| last_frame | string | - | - | إغلاق رابط صورة الإطار. عند تزويده يختار وضع الإطار الأول والأخير. |
| video | string | - | - | رابط الفيديو المرجعي، حتى 3 مقاطع مدة كل منها من 2 إلى 15 ثانية. يتم احتساب الفيديو المرجعي على مدته الخاصة بالإضافة إلى المقطع الذي تم إنشاؤه. |
| audio | string | - | - | رابط صوت مرجعي، حتى 3 مقاطع مدة كل منها من 2 إلى 15 ثانية. يتطلب صورة مرجعية أو فيديو مرفق. |
| base_video | string | - | - | مقطع بدقة 768p تم إنشاؤه سابقا بواسطة هذا النموذج، لإعادة العرض على 2K. عند تزويده يختار إعادة التوليد، والتي يتم تحصيلها بمعدل أقل في الثانية على المقطع المصدر... |
| watermark | boolean | false | - | أضف علامة المحتوى المائية التي يولدها الذكاء الاصطناعي إلى المخرج. |
| enhance_prompt | boolean | false | - | قم بتوسيع ملخصك إلى طلب كامل قبل التصيير، مع إضافة هيكل اللقطة، وعمل الكاميرا، ومشهد صوتي. أي وسائط مرجعية ترفقها تشرح التوسعة. تضيف تكلفة لكل رمز فوق تكلفة الفيديو... |
MiniMax H3 يولد مقاطع مدتها 4 إلى 15 ثانية بسرعة 24 إطارا في الثانية بدقة 768p أو 2K، كل منها يحتوي على مسار صوتي ستيريو أصلي. الأوضاع - تحويل النص إلى الفيديو: فقط التوجيه. - الصورة إلى فيديو: صورة واحدة تصبح الإطار الافتتاحي. - الإطار الأول والأخير: توفير صورة افتتاحية وخاتمة. - المرجع للفيديو: حتى 9 صور، 3 فيديوهات و3 مقاطع صوتية، 12 ملف مرجعي إجمالا. - إعادة التوليد: أعد عرض مقطع 768p الذي أنشأته سابقا بدقة 2K. أرسل المطلب الأصلي بالإضافة إلى المقطع المصدر base_video. توسيع الموجه تعيين enhance_prompt على true، ويعيد النموذج أولا كتابة ملخصك إلى موجه كامل، مضيفا shot-by-shot الهيكل، وحركات الكاميرا، والإضاءة ومشهد صوتي، ثم يتم التصيير من ذلك. أي وسائط مرجعية ترفقها تخبر التوسعة. تضيف تكلفة لكل رمز بالإضافة إلى تكلفة الفيديو في الثانية، ويتم تخطيها للتجديد لأن هذا المسار يعيد إنتاج الطلب الأصلي. وسائط مرجعية - الصور من 256 إلى 5760 بكسل لكل جانب، نسبة العرض إلى الارتفاع بين 0.4 و2.5، حتى 30 ميجابايت لكل منها. - فيديوهات من 2 إلى 15 ثانية، H.264 أو H.265، حتى 50 ميجابايت لكل منها. - الصوت من 2 إلى 15 ثانية، WAV أو MP3، حتى 15 ميجابايت لكل منها. الصوت المرجعي يتطلب صورة أو مرجع فيديو مرافقة. - الفيديو والصوت المرجعيان ينطبقان على reference-to-video فقط. - يمكن أن تصل الأوامر إلى 7000 حرف وقد تصف الحوار، والمؤثرات الصوتية، والنص على الشاشة، وعمل الكاميرا. الفوترة - يتم احتساب كل ثانية من المقطع المتولد بدقة الطلب التي تطلبها. - يتم احتساب الفيديو المرجعي على المدة الخاصة به بالإضافة إلى المقطع المولد، لذا فإن المرجع الذي مدته 5 ثوان يستخدم لجعل مقطع مدته 6 ثوان يخصم 11 ثانية. - يتم احتساب إعادة الإنتاج بمعدل أقل في الثانية الخاص به، على مدة المقطع المصدر بالإضافة إلى الناتج المعاد توليده. الصور المرجعية المنقولة من الطلب الأصلي لا تخصم مرة أخرى. - يتم تضمين أول 5 صور مرجعية. يتم فرض رسوم على كل صورة مرجعية إضافية بشكل منفصل. - يتم احتساب توسعة الطلب، عند تفعيلها، لكل رمز.
على EmpirioLabs، تتم فوترة MiniMax H3 حسب الاستخدام: 768 صفحة $0.18 في الثانية; 2K $0.26 في الثانية; تجديد 2K $0.10 في الثانية; إدخال صورة مرجعية $0.08 لكل صورة مدخلة بعد أول 5 صور; مدخل التوسع الفوري $1.80 لكل 1M رموز مطالبة; مخرج التوسع الفوري $7.20 لكل مليون رمز مولد. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.
يُقدَّم MiniMax H3 عبر POST /v1/videos/generations على api.empiriolabs.ai مع مصادقة Bearer القياسية.
نعم. يشغّل ملعب EmpirioLabs نموذج MiniMax H3 في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.
أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.
تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.