
نموذج StepFun text-to-speech مع أصوات رسمية، أصوات مستنسخة مخصصة، وتحكم في علامات الصوت.
نموذج StepFun text-to-speech مع أصوات رسمية، أصوات مستنسخة مخصصة، وتحكم في علامات الصوت.
يتم عد الأحرف وفقا لتسعير StepFun: حرف صيني واحد يحسب كحرف واحد، وحرفين إنجليزيين كحرف واحد، وعلامتان علامات ترقيم تحتسب كحرف واحد.
يعرف أيضا باسم StepFun Step TTS 2, Step-TTS-2
step-tts-2/v1/audio/speechstepfun/step-tts-2أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.
يولّد Step TTS 2 الكلام عبر POST /v1/audio/speech ويعيد صوتًا قابلًا للتشغيل. أرسل النص المطلوب نطقه في input مع معرّف النموذج step-tts-2. احصل على مفتاح API من لوحة تحكم EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/speech \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "step-tts-2",
"input": "Welcome to EmpirioLabs. Your build just finished."
}' \
--output speech.mp3import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/speech",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={"model": "step-tts-2", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
f.write(response.content)معلمات الطلب التي تدعمها واجهة Step TTS 2 API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.
| المعامل | النوع | الافتراضي | النطاق / القيم | الوصف |
|---|---|---|---|---|
| input | string | - | الحد الأقصى 1000 | نص لتركيبه. الحد الأقصى 1000 حرف. |
| voice | enum | lively-girl | lively-girl, vibrant-youth, soft-spoken-gentleman, magnetic-v... | Official StepFun voice. Custom cloned voice IDs are also accepted via the API. |
| response_format | enum | mp3 | mp3, wav, flac, opus, pcm | صيغة الصوت المخرج. |
| speed | number | 1 | 0.5 إلى 2 | سرعة الكلام. |
| volume | number | 1 | 0.1 إلى 2 | حجم الإخراج. |
| sample_rate | enum | 24000 | 8000, 16000, 22050, 24000 | معدل العينة الناتج بالهرتز. |
| voice_label | object | - | - | وسوم بأسلوب العاطفة والحديث step-tts-2. |
| pronunciation_map | object | - | - | تعيين نطق اختياري. |
| markdown_filter | boolean | false | - | قم بتصفية بناء جملة التخفيض قبل التخليق. |
الحد الأقصى للمدخلات هو 1,000 حرف. يدعم معرفات الصوت الرسمية، والأصوات المستنسخة المخصصة، وعلامات المشاعر voice_label، وعلامات النمط voice_label. معامل التعليمات مخصص فقط ل stepaudio-2.5-tts.
على EmpirioLabs، تتم فوترة Step TTS 2 حسب الاستخدام: التركيب $0.40 لكل 10,000 حرف. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.
يُقدَّم Step TTS 2 عبر POST /v1/audio/speech على api.empiriolabs.ai مع مصادقة Bearer القياسية.
نعم. يشغّل ملعب EmpirioLabs نموذج Step TTS 2 في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.
أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.
تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.