GLM TTS API

LLM-based text-to-speech com clonagem de voz zero de 3-10s de áudio e emoção-expressiva, saída controlável através de RL multi-recompensa.

Z.aiGeração de ÁudioLançado 11 de dez. de 2025Inferência nativa

Sobre GLM TTS

LLM-based text-to-speech com clonagem de voz zero de 3-10s de áudio e emoção-expressiva, saída controlável através de RL multi-recompensa.

Também conhecido como Z.ai GLM TTS, GLM-TTS

voice cloningemotion control

Especificações de GLM TTS

ID do modelo
glm-tts
Provedor
Z.ai
Categoria
Geração de Áudio
Lançado
11 de dez. de 2025
Entrada
TextoÁudio
Saída
Áudio
Endpoints
POST/v1/audio/speech
IDs de modelo alternativos
zhipu/glm-tts

Preços da API GLM TTS

Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.

Tipo
Especificação
Tarifa
Rápido (INT8)
por 1k caracteres
$0.20
Qualidade (FP16)
por 1k caracteres
$0.21
Comparar na página completa de preços

Como chamar a API GLM TTS

GLM TTS gera fala por POST /v1/audio/speech e retorna áudio reproduzível. Envie o texto a ser falado em input com o id de modelo glm-tts. Obtenha uma chave de API no painel EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-tts",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "glm-tts", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
Referência completa da API GLM TTS

Parâmetros da API GLM TTS

Parâmetros de requisição suportados pela API GLM TTS na EmpirioLabs. Os padrões valem quando um campo é omitido.

ParâmetroTipoPadrãoIntervalo / valoresDescrição
inputstring--Texto para sintetizar. Para múltiplos alto-falantes, use tags [S1] / [S2] ou linhas 'Alto-falante N:'.
voiceenumemmaemma, james, arthur, xiaomei, zhigang, customemma=Inglês feminino, james=US Male, arthur=US Male alt, xiaomei=Chinese Female, zhigang=Chinese Male, custom=upload reference via voice_audio_url.
voice_audio_urlstring--Consulte a URL de áudio para clonagem de voz personalizada. A gravação de referência deve conter o falante lendo exatamente essa frase de consentimento em voz alta,...
output_formatenummp3mp3, wavFormato de arquivo de mídia de saída (mp3, wav, mp4, png, jpg, etc., dependendo do endpoint).
speednumber10.5 a 2Multiplicador de taxa de fala.
model_qualityenumqualityquality, fastqualidade=FP16 (melhor), rápido=INT8 (mais rápido)
sample_rateenum2400024000, 16000Taxa de amostragem de saída em Hz.
volumenumber10.1 a 2Multiplicador de ganho de saída.
use_cachebooleantrue-Acelera gerações idênticas repetidas.
optimize_inputbooleantrue-Pronúncia auto-fixa de termos técnicos, siglas e caracteres especiais.
seednumber--Semente de reprodutibilidade.

Bom saber

Limites - Entrada máxima: 5.000 caracteres - Geração: 5-10 minutos Clonagem de voz - Áudio de referência: 3-10 segundos - Formatos aceitos: WAV, MP3, OGG, FLAC, AAC, M4A, WebM Vozes predefinidas - emma (inglês F) - james (US M) - arthur (UK M) -xiaomei (Chinês F) - zhigang (Chinês M)

API GLM TTS: perguntas frequentes

Quanto custa a API GLM TTS?

Na EmpirioLabs, GLM TTS é cobrado por uso: Rápido (INT8) $0.20 por 1k caracteres; Qualidade (FP16) $0.21 por 1k caracteres. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.

Qual endpoint GLM TTS usa?

GLM TTS é servido por POST /v1/audio/speech em api.empiriolabs.ai com autenticação padrão por token Bearer.

Posso testar GLM TTS no navegador antes de integrar?

Sim. O playground da EmpirioLabs executa GLM TTS no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.

Como consigo uma chave de API GLM TTS?

Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.