
الصوت to-3-minute النص مع text-to-audio وaudio-to-audio وطلاء صوتي لإنتاج الموسيقى، تصميم الصوت، وإعادة المزج.
الصوت to-3-minute النص مع text-to-audio وaudio-to-audio وطلاء صوتي لإنتاج الموسيقى، تصميم الصوت، وإعادة المزج.
يعرف أيضا باسم Stable Audio, Stability AI Stable Audio 2.5, Stable-Audio-2.5, stable-audio-2-5
stable-audio-2-5/v1/audio/generationsstability-audio-2.5stability/audio-2.5أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.
يعمل Stable Audio 2.5 عبر POST /v1/audio/generations. يعيد الطلب job_id فورًا؛ استعلم عن GET /v1/jobs/{job_id} حتى تكتمل المهمة ثم اقرأ روابط الإخراج من النتيجة. احصل على مفتاح API من لوحة تحكم EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stable-audio-2-5",
"prompt": "Describe what you want Stable Audio 2.5 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "stable-audio-2-5",
"prompt": "Describe what you want Stable Audio 2.5 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)معلمات الطلب التي تدعمها واجهة Stable Audio 2.5 API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.
| المعامل | النوع | الافتراضي | النطاق / القيم | الوصف |
|---|---|---|---|---|
| prompt | string | - | - | ماذا يجب أن تولد. |
| mode | enum | text-to-audio | text-to-audio, audio-to-audio, audio-inpaint | يقوم audio-inpaint بإعادة توليد نافذة [mask_start، mask_end] لمقطع موجود مع الاحتفاظ بالباقي. |
| output_format | enum | mp3 | mp3, wav | تنسيق ملف وسائط الإخراج (mp3، wav، mp4، png، jpg، إلخ، حسب نقطة النهاية). |
| duration | number | 190 | 1 إلى 190 | ثواني. حتى 3 دقائق و10 ثوان. |
| steps | number | 8 | 4 إلى 8 | خطوات الانتشار. طراز 2.5 تيربو مضبوط لعدد خطوات منخفض جدا. |
| cfg_scale | number | 1 | 1 إلى 25 | إرشادات خالية من المصنفات. يستخدم طراز التيربو محرك CFG صغير بشكل افتراضي. |
| strength | number | 0.5 | 0.01 إلى 1 | الصوت إلى الصوت فقط. 0.01 = تجاهل الإشارة، 1 = البقاء قريبا من المرجع. |
| mask_start | number | - | 0 إلى 190 | بدء نافذة Inpaint (ثواني). مطلوب لل audio-inpaint. |
| mask_end | number | - | 0 إلى 190 | نهاية نافذة الطلاء (ثواني). مطلوب لل audio-inpaint. |
| random_seed | boolean | true | - | إذا كان صحيحا، استخدم بذرة عشوائية في كل استدعاء. |
| seed | number | - | - | بذور قابلية التكرار. يستخدم فقط عندما random_seed=خاطئ. |
| audio_url | string | - | - | رابط الصوت المرجعي ل audio-to-audio / inpaint. |
يضيف وضع audio-inpaint (إعادة توليد نافذة زمنية) فوق Stable Audio 2.0. متطلبات الوضع - كل من الصوت إلى الصوت والصوت في الرسم كلاهما يتطلب كل من التوجيه وملف الصوت المرفوع - الصوت إلى الصوت يستخدم الصوت المرجعي ل style/conditioning، وليس لاستنساخ الصوت
على EmpirioLabs، تتم فوترة Stable Audio 2.5 حسب الاستخدام: الجيل $0.68 لكل جيل. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.
يُقدَّم Stable Audio 2.5 عبر POST /v1/audio/generations على api.empiriolabs.ai مع مصادقة Bearer القياسية.
نعم. يشغّل ملعب EmpirioLabs نموذج Stable Audio 2.5 في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.
أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.
تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.