
يربط حركة الفم في فيديو موجود مع مسار صوتي مرفوع أو مع نص ينطق به أحد أربعة عشر صوتا مدمجا.
يربط حركة الفم في فيديو موجود مع مسار صوتي مرفوع أو مع نص ينطق به أحد أربعة عشر صوتا مدمجا.
pixverse-lipsync/v1/videos/generationspixverse/lipsyncأسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.
يعمل Pixverse Lip Sync عبر POST /v1/videos/generations. يعيد الطلب job_id فورًا؛ استعلم عن GET /v1/jobs/{job_id} حتى تكتمل المهمة ثم اقرأ روابط الإخراج من النتيجة. احصل على مفتاح API من لوحة تحكم EmpirioLabs.
curl https://api.empiriolabs.ai/v1/videos/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "pixverse-lipsync",
"prompt": "Describe what you want Pixverse Lip Sync to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/videos/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "pixverse-lipsync",
"prompt": "Describe what you want Pixverse Lip Sync to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)معلمات الطلب التي تدعمها واجهة Pixverse Lip Sync API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.
| المعامل | النوع | الافتراضي | النطاق / القيم | الوصف |
|---|---|---|---|---|
| lip_sync_tts_content | string | - | - | العبارة التي يجب أن تتكلم. يستخدم عندما لا يكون هناك ملف صوتي مرفق. تم الإعلان عنه في كتل من 15 حرفا. |
| lip_sync_tts_speaker_id | enum | Auto | Auto, Emily, James, Isabella, Liam, Chloe, Adrian, Harper, Av... | الصوت المستخدم في السطر المنطوق. يختار أوتو واحدا ليناسب المقطع. يتم تجاهله عند إرفاق ملف صوتي. |
| video | string | - | - | رابط الفيديو المصدر. مطلوب. |
| audio | string | - | - | رابط الصوت لمزامنة الشفاه. له الأولوية على النص المنطوق. |
يربط حركة الفم في فيديو موجود مع الكلام، إما من ملف صوتي تقدمه أو من نص يقال بصوت مدمج. الإدخالات - video: المقطع المصدر، حتى 300 ثانية و250 ميجابايت. - audio: الكلام المطابق، حتى 300 ثانية و250 ميجابايت. - أو lip_sync_tts_content مع lip_sync_tts_speaker_id لجعل النموذج يتحدث نصك. يتوفر أربعة عشر صوتا مسماة بالإضافة إلى Auto، الذي يختار صوتا مناسبا للمقطع. الفوتر - يتم احتساب كل ثانية من الكلام. يتم قياس إدخال النص إلى كلام في كتل من 15 حرفا بنفس المعدل، لذا يتتبع الشحن طول النص بدلا من طول الفيديو المصدر. حدود الإدخال - فيديو: MP4، MOV أو WebM، حتى 1920 بكسل على الحافة الطويلة. - الصوت: MP3، WAV، M4A أو AAC.
على EmpirioLabs، تتم فوترة Pixverse Lip Sync حسب الاستخدام: الخطاب $0.020444 في الثانية. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.
يُقدَّم Pixverse Lip Sync عبر POST /v1/videos/generations على api.empiriolabs.ai مع مصادقة Bearer القياسية.
نعم. يشغّل ملعب EmpirioLabs نموذج Pixverse Lip Sync في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.
أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.
تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.