
الموسيقى التصويرية المتزامنة مع الإطارات التي تولد مباشرة من الفيديو، أو الموسيقى من طلب نصي، مع توجيه لكل جزء وفصل بين الجذع.
الموسيقى التصويرية المتزامنة مع الإطارات التي تولد مباشرة من الفيديو، أو الموسيقى من طلب نصي، مع توجيه لكل جزء وفصل بين الجذع.
sonilo-v1-1/v1/audio/generationssonilo-v1.1sonilo/v1.1sonilo-musicsonilo/sonilo-v1-1أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.
يعمل Sonilo v1.1 عبر POST /v1/audio/generations. يعيد الطلب job_id فورًا؛ استعلم عن GET /v1/jobs/{job_id} حتى تكتمل المهمة ثم اقرأ روابط الإخراج من النتيجة. احصل على مفتاح API من لوحة تحكم EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "sonilo-v1-1",
"prompt": "Describe what you want Sonilo v1.1 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "sonilo-v1-1",
"prompt": "Describe what you want Sonilo v1.1 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)معلمات الطلب التي تدعمها واجهة Sonilo v1.1 API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.
| المعامل | النوع | الافتراضي | النطاق / القيم | الوصف |
|---|---|---|---|---|
| prompt | string | - | - | الأسلوب أو التوجيه الإبداعي للموسيقى. مطلوب عند التوليد من النص فقط. اختياري عند تأليف موسيقى الفيديو، حيث تقود اللقطات. |
| mode | enum | auto | auto, text, video | يقوم تلقائيا بتسجيل فيديو مرفق ثم يعود إلى النص إلى موسيقى عندما لا يكون هناك فيديو. اضبط نصا أو فيديو لتثبيت السلوك. |
| duration | number | - | 5 إلى 360 | طول المسار بالثواني. وضع النص فقط. في وضع الفيديو، يتبع المسار طول الفيديو المصدر. اترك المسار فارغا ليقرر المحفز. |
| output_format | enum | m4a | m4a, wav, mp3 | تم تسليم الصيغة الصوتية. m4a هو AAC، وwav هو PCM 16-بت، وMP3 هو 320 كيلوبت في الثانية. |
| variants_num | number | 1 | 1 إلى 10 | كم عدد الاتجاهات الموسيقية المميزة التي يجب توليدها في طلب واحد. يتم فوترة كل نسخة بشكل منفصل بمعدل كل ثانية، وينطبق الحد الأدنى البالغ 10 ثوان على كل واحدة. |
| stems | boolean | false | - | وأيضا أعد المسار المولد مقسما إلى درامز، باس، غناء وغيرها. لا تضيف أي شحن ويضيف بضع دقائق للانتظار. |
| ducking | boolean | false | - | وأيضا أعد نسخة مع الموسيقى تحت الخطاب في الفيديو الأصلي حتى يبقى الحوار واضحا. لا تضيف أي رسوم. |
| preserve_speech | boolean | false | - | احتفظ بالكلام من الفيديو الأصلي وأعد الصوت المعزول مع مسار مختلط مع الموسيقى. |
| prompt_influence | number | 0.5 | 0 إلى 1 | مدى قوة تتبع الموسيقى للطلب بدلا من اللقطات. الأسفل يسمح للفيديو بالقيادة، والأعلى يتبع التوجيه بشكل أكثر حرفية. لا تضيف أي تكلفة. |
| segments | string | - | - | مصفوفة JSON من محفزات المقاطع المؤقتة لمشهد باتجاه مشهد. كل إدخال يبدأ وينتهي وطلب في ثوان. |
| video_url | string | - | - | من المصدر فيديو إلى التسجيل، كرابط متاح للجمهور. حتى 300 ميجابايت و6 دقائق. رفع فيديو في playground يحدد لك هذا الموقع. |
الأوضاع - يقوم تلقائيا بتسجيل الفيديو المرفق، ويعود إلى النص إلى موسيقى عندما لا يكون هناك فيديو - وضع الفيديو يتبع القطع وإيقاع اللقطات المصدرية - وضع النص يولد من موجه فقط التحكم يدعم التوجيه، الوضع، الفيديو المصدر، مدة 5 إلى 360 ثانية في وضع النص، m4a، مخرج wav أو mp3، من 1 إلى 10 نسخ، فصل الجذع، الانحناء، حفظ الكلام، تأثير الطلب، وتعليمات مقاطع JSON. القيود - الفيديو المصدري حتى 300 ميجابايت و6 دقائق - المدة من 5 إلى 360 ثانية في وضع النص. وضع الفيديو يتبع طول المصدر - الانحناء، حفظ الكلام، وتأثير التوجيه ينطبق فقط على وضع الفيديو الفوترة - يتم تحصيل كل ثانية مولدة بمعدل الكتالوج، مع حد أدنى 10 ثوان لكل مسار. مسار 4 ثوان يفرض 10 ثوان. - يتم احتساب كل نسخة بشكل منفصل ويتم تطبيق الحد الأدنى لمدة 10 ثوان على كل واحد. - فصل الجذع، الانحناء والتأثير الفوري لا يضاف أي رسوم. - لا يتم رفض الطلب قبل التوليد ولا يتم رسمته.
على EmpirioLabs، تتم فوترة Sonilo v1.1 حسب الاستخدام: تحويل النص إلى موسيقى $0.0045 لكل ثانية مولدة; الفيديو إلى الموسيقى $0.018 لكل ثانية مولدة. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.
يُقدَّم Sonilo v1.1 عبر POST /v1/audio/generations على api.empiriolabs.ai مع مصادقة Bearer القياسية.
نعم. يشغّل ملعب EmpirioLabs نموذج Sonilo v1.1 في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.
أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.
تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.