
يولد صوتا يصل إلى 3 دقائق من التعليمات النصية، ويدعم text-to-audio وaudio-to-audio مع إمكانية تعديل المدة، والخطوات، ومقياس CFG.
يولد صوتا يصل إلى 3 دقائق من التعليمات النصية، ويدعم text-to-audio وaudio-to-audio مع إمكانية تعديل المدة، والخطوات، ومقياس CFG.
يعرف أيضا باسم Stable Audio, Stability AI Stable Audio 2.0, Stable-Audio-2.0, stable-audio-2-0
stable-audio-2-0/v1/audio/generationsstability-audio-2.0stability/audio-2.0أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.
يعمل Stable Audio 2.0 عبر POST /v1/audio/generations. يعيد الطلب job_id فورًا؛ استعلم عن GET /v1/jobs/{job_id} حتى تكتمل المهمة ثم اقرأ روابط الإخراج من النتيجة. احصل على مفتاح API من لوحة تحكم EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stable-audio-2-0",
"prompt": "Describe what you want Stable Audio 2.0 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "stable-audio-2-0",
"prompt": "Describe what you want Stable Audio 2.0 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)معلمات الطلب التي تدعمها واجهة Stable Audio 2.0 API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.
| المعامل | النوع | الافتراضي | النطاق / القيم | الوصف |
|---|---|---|---|---|
| prompt | string | - | - | ماذا يجب أن تولد. كن محددا بشأن النوع الموسيقي، الآلات، المزاج، والإيقاع. |
| mode | enum | text-to-audio | text-to-audio, audio-to-audio | text-to-audio: توليد فقط من الطلب. audio-to-audio: حالة على مقطع مرجعي. |
| output_format | enum | mp3 | mp3, wav | تنسيق ملف وسائط الإخراج (mp3، wav، mp4، png، jpg، إلخ، حسب نقطة النهاية). |
| duration | number | 190 | 1 إلى 190 | ثواني. يولد Stability Audio 2.0 حتى 3 دقائق و10 ثوان. |
| steps | number | 50 | 30 إلى 100 | خطوات الانتشار. أكثر = دقة أعلى، أبطأ (ويضيف اعتمادات لكل خطوة). |
| cfg_scale | number | 7 | 1 إلى 25 | إرشادات خالية من المصنفات. Higher = يتبع التعليمات بشكل أكثر صرامة. |
| strength | number | 1 | 0 إلى 1 | الصوت إلى الصوت فقط. 0 = تجاهل الإشارة، 1 = ابق قريبا من المرجع. |
| random_seed | boolean | true | - | إذا كان صحيحا، استخدم بذرة عشوائية في كل استدعاء. |
| seed | number | - | - | بذور قابلية التكرار. يستخدم فقط عندما random_seed=خاطئ. |
| audio_url | string | - | - | رابط الصوت المرجعي لوضع audio-to-audio. |
يولد ما يصل إلى 3 دقائق من الصوت من النص أو عبر تحويل audio-to-audio. وضع تحويل الصوت إلى الصوت - يتطلب كلا من التعليمات وملف صوتي مرفوع - مقياس CFG الموصى به: 7-15 - الخطوات الموصى بها: 6-8 - القوة النموذجية: 0.3-0.7
على EmpirioLabs، تتم فوترة Stable Audio 2.0 حسب الاستخدام: التكلفة الأساسية $0.58 لكل جيل; تكلفة كل خطوة $0.00 لكل خطوة. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.
يُقدَّم Stable Audio 2.0 عبر POST /v1/audio/generations على api.empiriolabs.ai مع مصادقة Bearer القياسية.
نعم. يشغّل ملعب EmpirioLabs نموذج Stable Audio 2.0 في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.
أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.
تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.