Step TTS 2 एपीआई

StepFun आधिकारिक आवाज़, कस्टम क्लोन आवाज़ों और वॉयस टैग नियंत्रण के साथ text-to-speech मॉडल।

StepFunऑडियो जनरेशनInternationalस्वामित्व वाला एंडपॉइंटनया

Step TTS 2 के बारे में

StepFun आधिकारिक आवाज़, कस्टम क्लोन आवाज़ों और वॉयस टैग नियंत्रण के साथ text-to-speech मॉडल।

चरित्र की गिनती स्टेपफन मूल्य निर्धारण का अनुसरण करती है: एक चीनी वर्ण एक वर्ण के रूप में गिना जाता है, दो अंग्रेजी अक्षर एक वर्ण के रूप में गिने जाते हैं, और दो विराम चिह्न एक वर्ण के रूप में गिने जाते हैं।

इस नाम से भी जाना जाता है StepFun Step TTS 2, Step-TTS-2

text to speechvoice tagsmultilingual

Step TTS 2 की विशेषताएं

मॉडल ID
step-tts-2
प्रदाता
StepFun
श्रेणी
ऑडियो जनरेशन
रिलीज
-
इनपुट
टेक्स्ट
आउटपुट
ऑडियो
रीजन
International
एंडपॉइंट
POST/v1/audio/speech
वैकल्पिक मॉडल ID
stepfun/step-tts-2

Step TTS 2 API की कीमतें

EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।

प्रकार
स्पेक
दर
संश्लेषण
प्रति 10,000 वर्ण
$0.40
पूरे कीमत पेज पर तुलना करें

Step TTS 2 API को कैसे कॉल करें

Step TTS 2 POST /v1/audio/speech से आवाज़ बनाता है और चलाने योग्य ऑडियो देता है। बोला जाने वाला टेक्स्ट input के रूप में model id step-tts-2 के साथ भेजें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "step-tts-2",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "step-tts-2", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
Step TTS 2 API का पूरा संदर्भ

Step TTS 2 API के पैरामीटर

EmpirioLabs पर Step TTS 2 API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।

पैरामीटरप्रकारडिफॉल्टरेंज / मानविवरण
inputstring-अधिकतम 1000संश्लेषित करने के लिए पाठ। अधिकतम 1,000 वर्ण।
voiceenumlively-girllively-girl, vibrant-youth, soft-spoken-gentleman, magnetic-v...Official StepFun voice. Custom cloned voice IDs are also accepted via the API.
response_formatenummp3mp3, wav, flac, opus, pcmआउटपुट ऑडियो प्रारूप।
speednumber10.5 से 2भाषण की गति।
volumenumber10.1 से 2आउटपुट वॉल्यूम।
sample_rateenum240008000, 16000, 22050, 24000हर्ट्ज में आउटपुट नमूना दर।
voice_labelobject--step-tts-2 के लिए भावना और बोलने की शैली के टैग।
pronunciation_mapobject--वैकल्पिक उच्चारण मानचित्रण।
markdown_filterbooleanfalse-संश्लेषण से पहले मार्कडाउन सिंटैक्स फ़िल्टर करें।

जानने योग्य

अधिकतम इनपुट 1,000 वर्ण है। आधिकारिक वॉयस आईडी, कस्टम क्लोन की गई आवाज़, voice_label भावना टैग और voice_label स्टाइल टैग का समर्थन करता है। निर्देश पैरामीटर केवल stepaudio-2.5-tts के लिए है।

Step TTS 2 API: आम सवाल

Step TTS 2 API की कीमत कितनी है?

EmpirioLabs पर Step TTS 2 का बिल उपयोग के अनुसार बनता है: संश्लेषण $0.40 प्रति 10,000 वर्ण। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।

Step TTS 2 कौन सा endpoint उपयोग करता है?

Step TTS 2 api.empiriolabs.ai पर POST /v1/audio/speech के ज़रिए मिलता है, मानक Bearer टोकन प्रमाणीकरण के साथ।

क्या मैं इंटीग्रेट करने से पहले ब्राउज़र में Step TTS 2 आज़मा सकता हूं?

हां। EmpirioLabs playground ब्राउज़र में Step TTS 2 को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।

Step TTS 2 की API key कैसे मिलेगी?

EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।