GLM TTS API

text-to-speech basées sur LLM avec clonage vocal zéro shot de 3 à 10 secondes d’audio et une sortie contrôlable et expressive émotionnelle via RL multi-récompenses.

Z.aiProduction audioPublié 11 déc. 2025Inférence native

À propos de GLM TTS

text-to-speech basées sur LLM avec clonage vocal zéro shot de 3 à 10 secondes d’audio et une sortie contrôlable et expressive émotionnelle via RL multi-récompenses.

Aussi connu sous le nom Z.ai GLM TTS, GLM-TTS

voice cloningemotion control

Caractéristiques de GLM TTS

ID du modèle
glm-tts
Fournisseur
Z.ai
Catégorie
Production audio
Publié
11 déc. 2025
Entrée
TexteAudio
Sortie
Audio
Endpoints
POST/v1/audio/speech
Identifiants de modèle alternatifs
zhipu/glm-tts

Tarifs de l'API GLM TTS

Tarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.

Type
Spéc.
Tarif
Rapide (INT8)
pour 1k caractères
$0.20
Qualité (FP16)
pour 1k caractères
$0.21
Comparer sur la page complète des tarifs

Comment appeler l'API GLM TTS

GLM TTS génère la voix via POST /v1/audio/speech et renvoie de l'audio lisible. Envoyez le texte à prononcer dans input avec l'id de modèle glm-tts. Obtenez une clé API depuis le tableau de bord EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-tts",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "glm-tts", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
Référence complète de l'API GLM TTS

Paramètres de l'API GLM TTS

Paramètres de requête pris en charge par l'API GLM TTS sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.

ParamètreTypePar défautPlage / valeursDescription
inputstring--Texte à synthèse. Pour les haut-parleurs multiples, utilisez les tags [S1] / [S2] ou les lignes « Speaker N:. »
voiceenumemmaemma, james, arthur, xiaomei, zhigang, customemma = Anglais féminin, james=US Masculin, arthur=US Masculin alt, xiaomei=Chinoise féminine, zhigang=Chinois Homme, custom=upload reference via voice_audio_url.
voice_audio_urlstring--Référence à l’URL audio pour le clonage vocal personnalisé. L’enregistrement de référence doit contenir le locuteur lisant exactement cette phrase de consentement à...
output_formatenummp3mp3, wavFormat de fichier média de sortie (mp3, wav, mp4, png, jpg, etc., selon le point d’arrivée).
speednumber10.5 à 2Multiplicateur de débit de parole.
model_qualityenumqualityquality, fastqualité = FP16 (mieux), rapide = INT8 (plus rapide)
sample_rateenum2400024000, 16000Taux d’échantillonnage de sortie en Hz.
volumenumber10.1 à 2Multiplicateur de gain de sortie.
use_cachebooleantrue-Cela accélère les générations identiques répétées.
optimize_inputbooleantrue-Prononciation auto-fixée des termes techniques, acronymes et caractères spéciaux.
seednumber--Graine de reproductibilité.

Bon à savoir

Limites - Entrée maximale: 5 000 caractères - Génération: 5-10 minutes Clonage vocal - Audio de référence: 3-10 secondes - Formats acceptés: WAV, MP3, OGG, FLAC, AAC, M4A, WebM Voix prédéfinies - emma (F anglais) - James (M américain) - Arthur (M britannique) - xiaomei (F chinois) - zhigang (M chinois)

API GLM TTS : questions fréquentes

Combien coûte l'API GLM TTS ?

Sur EmpirioLabs, GLM TTS est facturé à l'usage : Rapide (INT8) $0.20 pour 1k caractères; Qualité (FP16) $0.21 pour 1k caractères. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.

Quel endpoint GLM TTS utilise-t-il ?

GLM TTS est servi via POST /v1/audio/speech sur api.empiriolabs.ai avec une authentification standard par token Bearer.

Puis-je essayer GLM TTS dans le navigateur avant d'intégrer ?

Oui. Le playground EmpirioLabs exécute GLM TTS dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.

Comment obtenir une clé API GLM TTS ?

Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.

Prêt à utiliser de meilleurs points de terminaison ?

Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.