Gemini 2.5 TTS APIs

Compara 2 modelos de generación de audio de la familia Gemini 2.5 TTS y llama al que mejor se ajuste a tus necesidades de latencia, calidad y precio.

GoogleGeneración de audio2 modelos

Acerca de las APIs de Gemini 2.5 TTS

Gemini 2.5 TTS en EmpirioLabs reúne 2 APIs de modelos de generación de audio de Google, incluyendo Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS. Cada modelo mantiene su propia página con precios en vivo, parámetros, documentación y acceso al playground.

Usa la misma clave de API y el mismo patrón de endpoint de EmpirioLabs en toda la familia, y cambia el comportamiento cambiando el id model en tu solicitud.

Modelos Gemini 2.5 TTS (2)

Precios de la API de Gemini 2.5 TTS

Compara la familia de un vistazo y luego abre una página de modelo para ver la tabla de tarifas en vivo completa y los parámetros.

Endpoint
POST/v1/audio/speech
Precios
Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.50
Producto
por 1M de tokens generados
$30.00
Ideal para
Baja latencia text-to-speech con voces de un y varios altavoces y estilo, acento y tono expresivo controlables para aplicaciones de producción.
Endpoint
POST/v1/audio/speech
Precios
Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$3.00
Producto
por 1M de tokens generados
$60.00
Ideal para
Vista previa TTS de alta calidad para podcasts, audiolibros y atención al cliente, con voces expresivas con múltiples altavoces en 23+ idiomas.
Compara todos los modelos en la página de precios completa

Cómo llamar a los modelos Gemini 2.5 TTS

Gemini 2.5 Flash TTS genera voz a través de POST /v1/audio/speech y devuelve audio reproducible. Envía el texto a pronunciar como input con el id de modelo gemini-2-5-flash-tts. Para esta familia, cambia el valor model por cualquier id compatible: gemini-2-5-flash-tts gemini-2-5-pro-tts. Consigue una clave de API en el panel de EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-2-5-flash-tts",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3

APIs de Gemini 2.5 TTS: preguntas frecuentes

¿Qué es la API de Gemini 2.5 TTS?

Gemini 2.5 TTS en EmpirioLabs es una familia de 2 APIs de modelos de Generación de audio de Google: Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS. Usas una clave de API de EmpirioLabs y eliges el id de modelo que mejor se ajusta a la solicitud.

¿Qué modelo de Gemini 2.5 TTS debería usar?

Empieza con el modelo cuya página coincida con tus necesidades de velocidad, calidad y precio, y pruébalo en el playground de EmpirioLabs. Las tarjetas de comparación de arriba enlazan a la tabla de tarifas en vivo y al quickstart de cada modelo.

¿Puedo cambiar entre modelos de Gemini 2.5 TTS sin reconstruir mi integración?

Sí. La familia sigue el mismo patrón de API de EmpirioLabs, así que la mayoría de las integraciones cambian modificando el valor model. Revisa la página del modelo antes de publicar si dependes de un parámetro específico del modelo.

¿Cómo se muestran los precios de Gemini 2.5 TTS?

Los precios son de pago por uso. Las tarjetas de esta página muestran un resumen corto del catálogo en vivo, y cada página de modelo muestra la tabla de tarifas completa que coincide con la facturación de la API.

¿Puedo probar Gemini 2.5 TTS en el navegador?

Sí. Abre cualquier página de modelo de esta familia y usa su enlace al playground para probar prompts y parámetros en el navegador antes de integrar la API.

¿Listo para usar mejores endpoints?

Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.