TTS 1.5 Mini واجهة برمجة التطبيقات

توليف صوتي TTFB بسرعة أقل من 130 مللي ثانية مع 271+ صوتا عبر 15 لغة، وعرض تعبيري، وبث SSE في الوقت الحقيقي لوكلاء الصوت منخفضي التأخير.

Inworldتوليد الصوتتاريخ الإصدار 21 يناير 2026نقطة نهاية مملوكة

حول TTS 1.5 Mini

توليف صوتي TTFB بسرعة أقل من 130 مللي ثانية مع 271+ صوتا عبر 15 لغة، وعرض تعبيري، وبث SSE في الوقت الحقيقي لوكلاء الصوت منخفضي التأخير.

يعرف أيضا باسم TTS Mini, Inworld TTS 1.5 Mini, TTS-1.5-Mini, tts-1-5-mini

multi speakerreal timelow latencystreamingword timestampscharacter timestampsmultilingualexpressive prosody

مواصفات TTS 1.5 Mini

معرّف النموذج
tts-1-5-mini
المزود
Inworld
الفئة
توليد الصوت
تاريخ الإصدار
21 يناير 2026
الإدخال
نص
الإخراج
صوت
نقاط النهاية
POST/v1/audio/speechPOST/v1/audio/speech:streamGET/v1/voices
معرّفات نموذج بديلة
inworld-tts-1.5-minitts-1.5-mini

أسعار واجهة TTS 1.5 Mini APIوفّر حتى 30%

أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.

النوع
المواصفة
السعر
التركيب
لكل مليون شخصية
$25.00$17.50
قارن في صفحة الأسعار الكاملة

كيفية استدعاء واجهة TTS 1.5 Mini API

يولّد TTS 1.5 Mini الكلام عبر POST /v1/audio/speech ويعيد صوتًا قابلًا للتشغيل. أرسل النص المطلوب نطقه في input مع معرّف النموذج tts-1-5-mini. احصل على مفتاح API من لوحة تحكم EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "tts-1-5-mini",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "tts-1-5-mini", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
المرجع الكامل لواجهة TTS 1.5 Mini API

معلمات واجهة TTS 1.5 Mini API

معلمات الطلب التي تدعمها واجهة TTS 1.5 Mini API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.

المعاملالنوعالافتراضيالنطاق / القيمالوصف
inputstring-الحد الأقصى 2000نص لتركيبه. الحد الأقصى 2000 حرف لكل طلب؛ قم بكتابة نص أطول عند حدود الجمل على العميل.
voiceenumSarahSarah, Olivia, Elizabeth, Ashley, Wendy, Julia, Priya, Pixie,...ضبط الصوت مسبقا. 20 صوتا مختارا بعناية تغطي الإنجليزية + الإسبانية + البرتغالية + الهندية + لهجات متنوعة. للحصول على الكتالوج الكامل الذي يضم 271 صوتا (بما في ذلك...
voice_idstring--معرف الصوت الحر. يتجاوز الصوت عند تعيينه. استخدم هذا لمعالجة الأصوات خارج قائمة الإعداد ال20 المختارة. Inworld TTS 1.5 يصدر 271+ صوتا مسماة عبر 15 لغة (لهجات...
languageenumen-USen-US, en-GB, es-ES, es-MX, fr-FR, de-DE, it-IT, pt-BR, pt-PT...رمز لغة BCP-47. يغطي Inworld TTS 1.5 15 لغة.
output_formatenumWAVMP3, WAV, OGG, FLAC, PCM, ALAW, MULAWcontainer/codec صوتي. WAV = LINEAR16 داخل RIFF (منتشر في كل مكان). MP3 / OGG = مضغوط. PCM = خام بدون رؤوس، مفيد للتشغيل الفوري المجزأ. FLAC = بدون فقدان.
sample_rateenum240008000, 16000, 22050, 24000, 32000, 44100, 48000معدل العينة الناتج بتردد 24000 هو الافتراضي في Inworld وهو ما تتدرب عليه نماذج الصوت لديهم؛ رفعت إلى 48000 لجودة البث.
speednumber10.5 إلى 1.5مضاعف معدل التحدث (Speech rate) المضاعف. 0.5 = نصف سرعة، 1.5 = أسرع بنسبة 50٪.
temperaturenumber10.1 إلى 2تعبير الصوت / التنوع. أقل = أكثر اتساقا / "مسطحا"؛ أعلى = أكثر تعبيرا ولكن هناك تنوع أكبر بين التصاميم.
bit_ratenumber12800032000 إلى 320000معدل البت بوحدة bps ل MP3 / OGG_OPUS. تم تجاهلها في ترميزات أخرى.
apply_text_normalizationenumONON, OFFعند ON، توسع Inworld الأرقام / الاختصارات / التواريخ إلى شكل منطوق ("USD 5" → "خمسة دولارات أمريكية").
timestamp_typeenumNONENONE, WORD, CHARACTERإذا لم يكن هناك أي رسم، يتضمن الرد طوابع زمنية لكل كلمة أو لكل حرف في timestamp_info. مفيد للترجمة / واجهات الإضاءة (IL).

معلومات مفيدة

الحدود - أقصى إدخال: 2,000 حرف لكل طلب (نص أطول عند حدود الجمل) - WebSocket: 20 اتصالا متزامن، 5 contexts/connection - رسالة لكل WS: 1,000 حرف التأخير - p90 TTFB: أقل من 130 مللي ثانية (اختبار Inworld) الأصوات - 271+ إعدادات مسبقة مسماة عبر 15 لغة - 20 إعدادا مسبقا مختارة بعناية في القائمة المنسدلة؛ تمرير أي معرف صوتي آخر عبر voice_id

واجهة TTS 1.5 Mini API: أسئلة شائعة

كم تكلف واجهة TTS 1.5 Mini API؟

على EmpirioLabs، تتم فوترة TTS 1.5 Mini حسب الاستخدام. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.

أي نقطة نهاية يستخدم TTS 1.5 Mini؟

يُقدَّم TTS 1.5 Mini عبر POST /v1/audio/speech على api.empiriolabs.ai مع مصادقة Bearer القياسية.

هل يمكنني تجربة TTS 1.5 Mini في المتصفح قبل الدمج؟

نعم. يشغّل ملعب EmpirioLabs نموذج TTS 1.5 Mini في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.

كيف أحصل على مفتاح API لنموذج TTS 1.5 Mini؟

أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.

هل أنت مستعد لاستخدام نقاط نهاية أفضل؟

تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.