Gemini 2.5 TTS APIs

Compare 2 modelos de geração de áudio da família Gemini 2.5 TTS e chame o que melhor atende suas necessidades de latência, qualidade e preço.

GoogleGeração de Áudio2 modelos

Sobre as APIs Gemini 2.5 TTS

Gemini 2.5 TTS na EmpirioLabs reúne 2 APIs de modelos de geração de áudio da Google, incluindo Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS. Cada modelo mantém sua própria página com preços ao vivo, parâmetros, docs e acesso ao playground.

Use a mesma chave de API e o mesmo padrão de endpoint da EmpirioLabs em toda a família e mude o comportamento trocando o id model na sua requisição.

Modelos Gemini 2.5 TTS (2)

Preços da API Gemini 2.5 TTS

Compare a família de relance e depois abra uma página de modelo para a tabela de tarifas ao vivo completa e os parâmetros.

Endpoint
POST/v1/audio/speech
Preços
Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$1.50
Saída
por 1M de tokens gerados
$30.00
Ideal para
Baixa latência text-to-speech com vozes de um ou múltiplos alto-falantes e estilo, sotaque e tom expressivo controláveis para aplicativos de produção.
Endpoint
POST/v1/audio/speech
Preços
Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$3.00
Saída
por 1M de tokens gerados
$60.00
Ideal para
Prévia TTS de alta qualidade para podcasts, audiolivros e suporte ao cliente, com vozes expressivas em múltiplos alto-falantes em 23+ idiomas.
Compare todos os modelos na página de preços completa

Como chamar os modelos Gemini 2.5 TTS

Gemini 2.5 Flash TTS gera fala por POST /v1/audio/speech e retorna áudio reproduzível. Envie o texto a ser falado em input com o id de modelo gemini-2-5-flash-tts. Para esta família, troque o valor model por qualquer id suportado: gemini-2-5-flash-tts gemini-2-5-pro-tts. Obtenha uma chave de API no painel EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-2-5-flash-tts",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3

APIs Gemini 2.5 TTS: perguntas frequentes

O que é a API Gemini 2.5 TTS?

Gemini 2.5 TTS na EmpirioLabs é uma família de 2 APIs de modelos de Geração de Áudio da Google: Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS. Você usa uma chave de API EmpirioLabs e escolhe o id de modelo que combina com a requisição.

Qual modelo Gemini 2.5 TTS devo usar?

Comece pelo modelo cuja página combina com suas necessidades de velocidade, qualidade e preço, e teste no playground da EmpirioLabs. Os cards de comparação acima levam à tabela de tarifas ao vivo e ao quickstart de cada modelo.

Posso alternar entre modelos Gemini 2.5 TTS sem reconstruir minha integração?

Sim. A família segue o mesmo padrão de API da EmpirioLabs, então a maioria das integrações alterna só mudando o valor model. Confira a página do modelo antes de publicar se você depende de um parâmetro específico do modelo.

Como os preços de Gemini 2.5 TTS são mostrados?

A cobrança é por uso. Os cards desta página mostram um resumo curto do catálogo ao vivo, e cada página de modelo mostra a tabela de tarifas completa que corresponde à cobrança da API.

Posso testar Gemini 2.5 TTS no navegador?

Sim. Abra qualquer página de modelo desta família e use o link do playground para testar prompts e parâmetros no navegador antes de integrar a API.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.