Gemini 2.5 TTS APIs

Comparez 2 modèles production audio de la famille Gemini 2.5 TTS, puis appelez celui qui correspond à vos besoins de latence, qualité et prix.

GoogleProduction audio2 modèles

À propos des APIs Gemini 2.5 TTS

Gemini 2.5 TTS sur EmpirioLabs réunit 2 APIs de modèles production audio de Google, dont Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS. Chaque modèle garde sa propre page avec tarifs en direct, paramètres, docs et accès au playground.

Utilisez la même clé API et le même schéma d'endpoint EmpirioLabs pour toute la famille, puis changez de comportement en changeant l'id model dans votre requête.

Modèles Gemini 2.5 TTS (2)

Tarifs de l'API Gemini 2.5 TTS

Comparez la famille d'un coup d'œil, puis ouvrez une page de modèle pour la grille tarifaire en direct complète et les paramètres.

Endpoint
POST/v1/audio/speech
Tarifs
Type
Spéc.
Tarif
Entrée
par 1M de jetons d’invite
$1.50
Produit
par 1M de jetons générés
$30.00
Idéal pour
Faible latence text-to-speech avec voix à un ou plusieurs haut-parleurs, ainsi qu’un style, un accent et un ton expressif contrôlables pour les applications de production.
Endpoint
POST/v1/audio/speech
Tarifs
Type
Spéc.
Tarif
Entrée
par 1M de jetons d’invite
$3.00
Produit
par 1M de jetons générés
$60.00
Idéal pour
Aperçu TTS de haute qualité pour podcasts, livres audio et support client, avec des voix expressives multi-haut-parleurs dans 23+ langues.
Comparer tous les modèles sur la page tarifs complète

Comment appeler les modèles Gemini 2.5 TTS

Gemini 2.5 Flash TTS génère la voix via POST /v1/audio/speech et renvoie de l'audio lisible. Envoyez le texte à prononcer dans input avec l'id de modèle gemini-2-5-flash-tts. Pour cette famille, remplacez la valeur model par n'importe quel id pris en charge : gemini-2-5-flash-tts gemini-2-5-pro-tts. Obtenez une clé API depuis le tableau de bord EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-2-5-flash-tts",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3

APIs Gemini 2.5 TTS : questions fréquentes

Qu'est-ce que l'API Gemini 2.5 TTS ?

Gemini 2.5 TTS sur EmpirioLabs est une famille de 2 APIs de modèles Production audio de Google : Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS. Vous utilisez une seule clé API EmpirioLabs et choisissez l'id de modèle adapté à la requête.

Quel modèle Gemini 2.5 TTS devrais-je utiliser ?

Commencez par le modèle dont la page correspond à vos besoins de vitesse, qualité et prix, puis testez-le dans le playground EmpirioLabs. Les cartes de comparaison ci-dessus mènent à la grille tarifaire en direct et au quickstart de chaque modèle.

Puis-je passer d'un modèle Gemini 2.5 TTS à l'autre sans reconstruire mon intégration ?

Oui. La famille suit le même schéma d'API EmpirioLabs : la plupart des intégrations changent simplement la valeur model. Vérifiez la page du modèle avant de déployer si vous dépendez d'un paramètre propre au modèle.

Comment les tarifs Gemini 2.5 TTS sont-ils affichés ?

La tarification est à l'usage. Les cartes de cette page montrent un court résumé du catalogue en direct, et chaque page de modèle montre la grille tarifaire complète qui correspond à la facturation de l'API.

Puis-je essayer Gemini 2.5 TTS dans le navigateur ?

Oui. Ouvrez n'importe quelle page de modèle de cette famille et utilisez son lien playground pour tester prompts et paramètres dans le navigateur avant d'intégrer l'API.

Prêt à utiliser de meilleurs points de terminaison ?

Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.