GLM TTS واجهة برمجة التطبيقات

text-to-speech مبنية على نماذج اللغة الكبيرة مع استنساخ صوتي بدون لقطة من 3 إلى 10 ثوان من الصوت وإخراج قابل للتحكم في التعبير عن المشاعر عبر التعلم المعزز متعدد المكافآت.

Z.aiتوليد الصوتتاريخ الإصدار 11 ديسمبر 2025استدلال أصلي

حول GLM TTS

text-to-speech مبنية على نماذج اللغة الكبيرة مع استنساخ صوتي بدون لقطة من 3 إلى 10 ثوان من الصوت وإخراج قابل للتحكم في التعبير عن المشاعر عبر التعلم المعزز متعدد المكافآت.

يعرف أيضا باسم Z.ai GLM TTS, GLM-TTS

voice cloningemotion control

مواصفات GLM TTS

معرّف النموذج
glm-tts
المزود
Z.ai
الفئة
توليد الصوت
تاريخ الإصدار
11 ديسمبر 2025
الإدخال
نصصوت
الإخراج
صوت
نقاط النهاية
POST/v1/audio/speech
معرّفات نموذج بديلة
zhipu/glm-tts

أسعار واجهة GLM TTS API

أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.

النوع
المواصفة
السعر
فاست (INT8)
لكل 1000 حرف
$0.20
الجودة (FP16)
لكل 1000 حرف
$0.21
قارن في صفحة الأسعار الكاملة

كيفية استدعاء واجهة GLM TTS API

يولّد GLM TTS الكلام عبر POST /v1/audio/speech ويعيد صوتًا قابلًا للتشغيل. أرسل النص المطلوب نطقه في input مع معرّف النموذج glm-tts. احصل على مفتاح API من لوحة تحكم EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-tts",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "glm-tts", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
المرجع الكامل لواجهة GLM TTS API

معلمات واجهة GLM TTS API

معلمات الطلب التي تدعمها واجهة GLM TTS API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.

المعاملالنوعالافتراضيالنطاق / القيمالوصف
inputstring--نص لتركيبه. لاستخدام علامات [S1] / [S2] أو أسطر 'مكبر الصوت N:'.
voiceenumemmaemma, james, arthur, xiaomei, zhigang, customإيما = أنثى إنجليزية، جيمس = ذكر أمريكي، آرثر = ذكر أمريكي بديل، شياومي = أنثى صينية، تشيغانغ = ذكر صيني، مخصص = رفع مرجع عبر voice_audio_url.
voice_audio_urlstring--مرجع عنوان الصوت لاستنساخ الصوت المخصص. يجب أن يحتوي التسجيل المرجعي على أن المتحدث يقرأ هذه العبارة بالضبط بصوت عال، بصوته الخاص: "أوافق على Empirio Labs استنساخ...
output_formatenummp3mp3, wavتنسيق ملف وسائط الإخراج (mp3، wav، mp4، png، jpg، إلخ، حسب نقطة النهاية).
speednumber10.5 إلى 2مضاعف معدل التحدث (Speech rate) المضاعف.
model_qualityenumqualityquality, fastالجودة=FP16 (أفضل)، سريع=INT8 (أسرع)
sample_rateenum2400024000, 16000معدل العينة الناتج بالهرتز.
volumenumber10.1 إلى 2مضاعف كسب الإخراج.
use_cachebooleantrue-يسرع الأجيال المتطابقة المتكررة.
optimize_inputbooleantrue-تصحيح النطق التلقائي للمصطلحات التقنية، والاختصارات، والأحرف الخاصة.
seednumber--بذور قابلية التكرار.

معلومات مفيدة

الحدود - الحد الأقصى للإدخال: 5,000 حرف - التوليد: 5-10 دقائق استنساخ الصوت - الصوت المرجعي: 3-10 ثوان - الصيغ المقبولة: WAV، MP3، OGG، FLAC، AAC، M4A، WebM الأصوات المسبقة - إيما (الإنجليزية F) - جيمس (US M) - آرثر (بريطاني M) - xiaomei (صينية F) - zhigang (صينية M)

واجهة GLM TTS API: أسئلة شائعة

كم تكلف واجهة GLM TTS API؟

على EmpirioLabs، تتم فوترة GLM TTS حسب الاستخدام: فاست (INT8) $0.20 لكل 1000 حرف; الجودة (FP16) $0.21 لكل 1000 حرف. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.

أي نقطة نهاية يستخدم GLM TTS؟

يُقدَّم GLM TTS عبر POST /v1/audio/speech على api.empiriolabs.ai مع مصادقة Bearer القياسية.

هل يمكنني تجربة GLM TTS في المتصفح قبل الدمج؟

نعم. يشغّل ملعب EmpirioLabs نموذج GLM TTS في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.

كيف أحصل على مفتاح API لنموذج GLM TTS؟

أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.

هل أنت مستعد لاستخدام نقاط نهاية أفضل؟

تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.