يحول صورة واحدة إلى فيديو أفاتار يتكلم، مدفوع بمسار صوتي مرفوع أو نص منطوق بصوت مدمج.
يحول صورة واحدة إلى فيديو أفاتار يتكلم، مدفوع بمسار صوتي مرفوع أو نص منطوق بصوت مدمج.
pixverse-avatar/v1/videos/generationspixverse/avatarأسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.
يعمل Pixverse Avatar عبر POST /v1/videos/generations. يعيد الطلب job_id فورًا؛ استعلم عن GET /v1/jobs/{job_id} حتى تكتمل المهمة ثم اقرأ روابط الإخراج من النتيجة. احصل على مفتاح API من لوحة تحكم EmpirioLabs.
curl https://api.empiriolabs.ai/v1/videos/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "pixverse-avatar",
"prompt": "Describe what you want Pixverse Avatar to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/videos/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "pixverse-avatar",
"prompt": "Describe what you want Pixverse Avatar to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)معلمات الطلب التي تدعمها واجهة Pixverse Avatar API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.
| المعامل | النوع | الافتراضي | النطاق / القيم | الوصف |
|---|---|---|---|---|
| lip_sync_tts_content | string | - | - | الجملة التي يجب أن يتكلم فيها الأفاتار. يستخدم عندما لا يكون هناك ملف صوتي مرفق. تم الإعلان عنه في كتل من 15 حرفا. |
| lip_sync_tts_speaker_id | enum | Auto | Auto, Emily, James, Isabella, Liam, Chloe, Adrian, Harper, Av... | الصوت المستخدم في السطر المنطوق. يختار أوتوماتيك واحدا ليناسب الصورة. يتم تجاهله عند إرفاق ملف صوتي. |
| resolution | enum | 720p | 360p, 540p, 720p, 1080p | دقة الإخراج. الفوترة ذات الدقة الأعلى تصدر فواترا بمعدل أعلى في الثانية. |
| prompt | string | - | - | توجيه اختياري للتسليم أو التأطير. |
| image | string | - | - | رابط صورة بورتريه. مطلوب. |
| audio | string | - | - | رابط صوتي ليؤديه الأفاتار. له الأولوية على النص المنطوق. |
يحول صورة بورتريه واحدة إلى فيديو أفاتار يتكلم، يعمل إما بملف صوتي تقدمه أو عبر نص منطوق بصوت مدمج. المدخلات - image: البورتريه الذي يجب تحريكه. استخدم موضوعا واضحا ومواجه للأمام. - audio: الخطاب الذي يجب أدائه، أو lip_sync_tts_content مع lip_sync_tts_speaker_id لجعل النموذج يتحدث نصك. أربعة عشر صوتا مسماة متاحة بالإضافة إلى Auto. - prompt اختياري ويمكن أن يصف التسليم أو التأطير. الإخراج - 360p، 540p، 720p و1080p. Billing - يتم احتساب السعر لكل ثانية من الكلام بمعدل دقة الإخراج. يتم قياس إدخال النص إلى كلام في كتل من 15 حرفا بنفس المعدل، لذا يتتبع الشحنة طول السكريبت. حدود الإدخال - الصورة: PNG، JPEG أو WebP، حتى 20 ميجابايت و10000 بكسل على الحافة الطويلة. - الصوت: MP3، WAV، M4A أو AAC.
على EmpirioLabs، تتم فوترة Pixverse Avatar حسب الاستخدام: 360p $0.025556 في الثانية; 540p $0.051111 في الثانية; 720p $0.076667 في الثانية; 1080p $0.102222 في الثانية. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.
يُقدَّم Pixverse Avatar عبر POST /v1/videos/generations على api.empiriolabs.ai مع مصادقة Bearer القياسية.
نعم. يشغّل ملعب EmpirioLabs نموذج Pixverse Avatar في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.
أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.
تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.