
Kontrollierte Whisper Large v3 Turbo-Transkription mit mehrsprachigem ASR, Übersetzung, VAD, Zeitstempeln, Untertiteln, Hotwords und Decoder-Steuerungen.
Kontrollierte Whisper Large v3 Turbo-Transkription mit mehrsprachigem ASR, Übersetzung, VAD, Zeitstempeln, Untertiteln, Hotwords und Decoder-Steuerungen.
Auch bekannt als Whisper Large Turbo, OpenAI Whisper Large v3 Turbo, Whisper-Large-v3-Turbo
whisper-large-v3-turbo/v1/audio/transcriptionsopenai/whisper-large-v3-turboLive Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Whisper Large v3 Turbo läuft über POST /v1/audio/transcriptions. Der Request liefert sofort eine job_id; frage GET /v1/jobs/{job_id} ab, bis der Job abgeschlossen ist, und lies die Ausgabe-URLs aus dem Ergebnis. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "whisper-large-v3-turbo",
"audio_url": "https://example.com/meeting-recording.mp3"
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "whisper-large-v3-turbo",
"audio_url": "https://example.com/meeting-recording.mp3",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Request-Parameter, die die Whisper Large v3 Turbo API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| audio_url | string | - | - | URL der zu transkribierenden Audiodatei. Gegenseitig ausschließend mit audio_base64. |
| audio_base64 | string | - | - | Base64-codierte Audiobytes. Gegenseitig ausschließend mit audio_url. |
| audio_suffix | string | .audio | - | Dateiendungshinweis (mp3, wav, m4a usw.), wenn die Audioquelle keine erkennbare Endung hat. |
| language | string | - | - | ISO 639-1 Sprachcode (en, es, fr, usw.). Lassen Sie es für die automatische Erkennung leer. |
| task | enum | transcribe | transcribe, translate | transkribieren = gleiche Sprache, übersetzen = ins Englische übersetzen. |
| beam_size | integer | 5 | 1 bis 32 | Strahlsuchbreite. Höher = genauer, aber langsamer. |
| best_of | integer | 5 | 1 bis 32 | Anzahl der Kandidaten mit Temperatur > 0. |
| patience | number | 1 | 0 bis 10 | Beam-Search-Geduldsfaktor. Höher = mehr Kandidaten entdecken. |
| length_penalty | number | 1 | -10 bis 10 | Für längere Zeugnisse gibt es eine Strafe. Negativ fördert kürzere Produktionen. |
| repetition_penalty | number | 1 | 0.1 bis 5 | Strafe für das Wiederholen von Token. >1 reduziert die Wiederholung. |
| no_repeat_ngram_size | integer | 0 | 0 bis 20 | Blockieren Sie jedes N-Gramm dieser Größe daran, sich im Ausgang zu wiederholen. |
| temperature | string | 0,0.2,0.4,0.6,0.8,1 | - | Temperatur wird geprochen. 0 = deterministisch, höher = mehr Variation. |
| compression_ratio_threshold | number | 2.4 | - | Behandle den Ausgang mit einem Kompressionsverhältnis darüber als fehlgeschlagen und versuche es erneut. |
| log_prob_threshold | number | -1 | - | Behandeln Sie Segmente mit durchschnittlicher logaritmischer Wahrscheinlichkeit darunter als gescheitert und versuchen Sie es erneut. |
Unterstützt URL/base64 Audio, language/task, Beam- und Temperaturfallback-Steuerungen, VAD/chunking, Hotwords, Prompts, Word Timestamps, Interpunktionssteuerungen, Token-Debug-Ausgabe und JSON/text / SRT/VTT Formate.
Auf EmpirioLabs wird Whisper Large v3 Turbo nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Whisper Large v3 Turbo wird über POST /v1/audio/transcriptions auf api.empiriolabs.ai mit normaler Bearer-Token-Authentifizierung bereitgestellt.
Ja. Der EmpirioLabs Playground führt Whisper Large v3 Turbo im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.