Gemini 2.5 TTS APIs

Vergleiche 2 audiogeneration Modelle der Gemini 2.5 TTS Familie und rufe dann das Modell auf, das zu deinen Anforderungen an Latenz, Qualität und Preis passt.

GoogleAudiogeneration2 Modelle

Über die Gemini 2.5 TTS APIs

Gemini 2.5 TTS auf EmpirioLabs vereint 2 audiogeneration Modell-APIs von Google, darunter Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS. Jedes Modell behält seine eigene Seite mit Live-Preisen, Parametern, Docs und Playground-Zugang.

Verwende denselben EmpirioLabs API-Schlüssel und dasselbe Endpoint-Muster für die ganze Familie und wechsle das Verhalten, indem du die model ID in deinem Request änderst.

Gemini 2.5 TTS Modelle (2)

Gemini 2.5 TTS API-Preise

Vergleiche die Familie auf einen Blick und öffne dann eine Modellseite für die vollständige Live-Preistabelle und Parameter.

Endpoint
POST/v1/audio/speech
Preise
Typ
Spezifikation
Preis
Eingabe
pro 1M Prompt-Token
$1.50
Ausgabe
pro 1 Million generierter Token
$30.00
Am besten für
Latenzarte text-to-speech mit Ein- und Mehrlautsprecherstimmen sowie steuerbarem Stil, Akzent und ausdrucksstarkem Klang für Produktions-Apps.
Endpoint
POST/v1/audio/speech
Preise
Typ
Spezifikation
Preis
Eingabe
pro 1M Prompt-Token
$3.00
Ausgabe
pro 1 Million generierter Token
$60.00
Am besten für
Hochwertige TTS-Vorschau für Podcasts, Hörbücher und Kundensupport mit ausdrucksstarken Mehrsprecherstimmen in 23+ Sprachen.
Alle Modelle auf der vollständigen Preisseite vergleichen

So rufst du Gemini 2.5 TTS Modelle auf

Gemini 2.5 Flash TTS erzeugt Sprache über POST /v1/audio/speech und liefert abspielbares Audio. Sende den zu sprechenden Text als input mit der Modell-ID gemini-2-5-flash-tts. Tausche für diese Familie den model Wert gegen eine beliebige unterstützte ID: gemini-2-5-flash-tts gemini-2-5-pro-tts. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-2-5-flash-tts",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3

Gemini 2.5 TTS APIs: häufige Fragen

Was ist die Gemini 2.5 TTS API?

Gemini 2.5 TTS auf EmpirioLabs ist eine Familie von 2 Audiogeneration Modell-APIs von Google: Gemini 2.5 Flash TTS, Gemini 2.5 Pro TTS. Du nutzt einen EmpirioLabs API-Schlüssel und wählst die Modell-ID, die zum Request passt.

Welches Gemini 2.5 TTS Modell sollte ich verwenden?

Beginne mit dem Modell, dessen Seite zu deinen Anforderungen an Geschwindigkeit, Qualität und Preis passt, und teste es dann im EmpirioLabs Playground. Die Vergleichskarten oben verlinken die Live-Preistabelle und den Quickstart jedes Modells.

Kann ich zwischen Gemini 2.5 TTS Modellen wechseln, ohne meine Integration umzubauen?

Ja. Die Familie folgt demselben EmpirioLabs API-Muster, sodass die meisten Integrationen nur den model Wert ändern. Prüfe vor dem Release die Modellseite, wenn du dich auf einen modellspezifischen Parameter verlässt.

Wie werden die Gemini 2.5 TTS Preise angezeigt?

Die Abrechnung erfolgt nach Verbrauch. Die Karten auf dieser Seite zeigen eine kurze Zusammenfassung aus dem Live-Katalog, und jede Modellseite zeigt die vollständige Preistabelle, die der API-Abrechnung entspricht.

Kann ich Gemini 2.5 TTS im Browser testen?

Ja. Öffne eine beliebige Modellseite dieser Familie und nutze ihren Playground-Link, um Prompts und Parameter im Browser zu testen, bevor du die API integrierst.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.