
टेक्स्ट प्रॉम्प्ट से 3 मिनट तक ऑडियो उत्पन्न करता है, समायोज्य अवधि, चरणों और सीएफजी पैमाने के साथ text-to-audio और audio-to-audio का समर्थन करता है।
टेक्स्ट प्रॉम्प्ट से 3 मिनट तक ऑडियो उत्पन्न करता है, समायोज्य अवधि, चरणों और सीएफजी पैमाने के साथ text-to-audio और audio-to-audio का समर्थन करता है।
इस नाम से भी जाना जाता है Stable Audio, Stability AI Stable Audio 2.0
stable-audio-2-0/v1/audio/generationsstability-audio-2.0stability/audio-2.0EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।
Stable Audio 2.0 POST /v1/audio/generations से चलता है। request तुरंत job_id देती है; job पूरा होने तक GET /v1/jobs/{job_id} को poll करें और परिणाम से आउटपुट URLs पढ़ें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stable-audio-2-0",
"prompt": "Describe what you want Stable Audio 2.0 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "stable-audio-2-0",
"prompt": "Describe what you want Stable Audio 2.0 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs पर Stable Audio 2.0 API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।
| पैरामीटर | प्रकार | डिफॉल्ट | रेंज / मान | विवरण |
|---|---|---|---|---|
| prompt | string | - | - | क्या उत्पन्न करना है। शैली, वाद्ययंत्र, मनोदशा और गति के बारे में विशिष्ट रहें। |
| mode | enum | text-to-audio | text-to-audio, audio-to-audio | text-to-audio: केवल प्रॉम्प्ट से जनरेट करें। audio-to-audio: संदर्भ क्लिप पर स्थिति। |
| output_format | enum | mp3 | mp3, wav | आउटपुट मीडिया फ़ाइल स्वरूप (mp3, wav, mp4, png, jpg, आदि, समापन बिंदु के आधार पर)। |
| duration | number | 190 | 1 से 190 | सेकंड। स्थिरता ऑडियो 2.0 3 मिनट 10 सेकंड तक उत्पन्न करता है। |
| steps | number | 50 | 30 से 100 | प्रसार चरण। अधिक = उच्च निष्ठा, धीमी (और प्रति-चरण क्रेडिट जोड़ता है)। |
| cfg_scale | number | 7 | 1 से 25 | क्लासिफायर-मुक्त मार्गदर्शन। उच्च = संकेत का अधिक सख्ती से पालन करता है। |
| strength | number | 1 | 0 से 1 | केवल ऑडियो-टू-ऑडियो। 0 = संदर्भ पर ध्यान न दें, 1 = संदर्भ के करीब रहें। |
| random_seed | boolean | true | - | यदि सत्य है, तो प्रत्येक कॉल में एक यादृच्छिक बीज का उपयोग करें। |
| seed | number | - | - | प्रजनन क्षमता बीज। केवल तभी उपयोग किया जाता है जब random_seed=false। |
| audio_url | string | - | - | audio-to-audio मोड के लिए ऑडियो URL का संदर्भ लें. |
टेक्स्ट से या audio-to-audio परिवर्तन के माध्यम से 3 मिनट तक का ऑडियो उत्पन्न करता है। ऑडियो-टू-ऑडियो मोड - प्रॉम्प्ट और अपलोड की गई ऑडियो फ़ाइल दोनों की आवश्यकता होती है - अनुशंसित सीएफजी स्केल: 7-15 - अनुशंसित चरण: 6-8 - विशिष्ट ताकत: 0.3-0.7
EmpirioLabs पर Stable Audio 2.0 का बिल उपयोग के अनुसार बनता है: आधार लागत $0.58 प्रति पीढ़ी; प्रति कदम लागत $0.00 प्रति कदम। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।
Stable Audio 2.0 api.empiriolabs.ai पर POST /v1/audio/generations के ज़रिए मिलता है, मानक Bearer टोकन प्रमाणीकरण के साथ।
हां। EmpirioLabs playground ब्राउज़र में Stable Audio 2.0 को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।
EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।
हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।