Whisper Large v3 Turbo API

Kontrollierte Whisper Large v3 Turbo-Transkription mit mehrsprachigem ASR, Übersetzung, VAD, Zeitstempeln, Untertiteln, Hotwords und Decoder-Steuerungen.

OpenAITranskriptionVeröffentlicht 1. Okt. 2024Native Inferenz

Über Whisper Large v3 Turbo

Kontrollierte Whisper Large v3 Turbo-Transkription mit mehrsprachigem ASR, Übersetzung, VAD, Zeitstempeln, Untertiteln, Hotwords und Decoder-Steuerungen.

Auch bekannt als Whisper Large Turbo, OpenAI Whisper Large v3 Turbo, Whisper-Large-v3-Turbo

transcriptiontranslationmultilingualword timestampshotwordssrt vtt

Whisper Large v3 Turbo Spezifikationen

Modell-ID
whisper-large-v3-turbo
Anbieter
OpenAI
Kategorie
Transkription
Veröffentlicht
1. Okt. 2024
Eingabe
Audio
Ausgabe
Text
Endpoints
POST/v1/audio/transcriptions
Alternative Modell-IDs
openai/whisper-large-v3-turbo

Whisper Large v3 Turbo API-PreiseSpare bis zu 17%

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Kontrollierte Transkription
pro Minute Audio
$0.006$0.005
Auf der vollständigen Preisseite vergleichen

So rufst du die Whisper Large v3 Turbo API auf

Whisper Large v3 Turbo läuft über POST /v1/audio/transcriptions. Der Request liefert sofort eine job_id; frage GET /v1/jobs/{job_id} ab, bis der Job abgeschlossen ist, und lies die Ausgabe-URLs aus dem Ergebnis. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL: Job senden
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "whisper-large-v3-turbo",
    "audio_url": "https://example.com/meeting-recording.mp3"
  }'
cURL: Ergebnis abfragen
curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY"
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/transcriptions",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={
        "model": "whisper-large-v3-turbo",
        "audio_url": "https://example.com/meeting-recording.mp3",
    },
)
job = response.json()

# Generation runs as an async job. Poll until it completes.
import time
while True:
    status = requests.get(
        f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
        headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    ).json()
    if status.get("status") in ("completed", "failed"):
        print(status)
        break
    time.sleep(5)
Vollständige Whisper Large v3 Turbo API-Referenz

Whisper Large v3 Turbo API-Parameter

Request-Parameter, die die Whisper Large v3 Turbo API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
audio_urlstring--URL der zu transkribierenden Audiodatei. Gegenseitig ausschließend mit audio_base64.
audio_base64string--Base64-codierte Audiobytes. Gegenseitig ausschließend mit audio_url.
audio_suffixstring.audio-Dateiendungshinweis (mp3, wav, m4a usw.), wenn die Audioquelle keine erkennbare Endung hat.
languagestring--ISO 639-1 Sprachcode (en, es, fr, usw.). Lassen Sie es für die automatische Erkennung leer.
taskenumtranscribetranscribe, translatetranskribieren = gleiche Sprache, übersetzen = ins Englische übersetzen.
beam_sizeinteger51 bis 32Strahlsuchbreite. Höher = genauer, aber langsamer.
best_ofinteger51 bis 32Anzahl der Kandidaten mit Temperatur > 0.
patiencenumber10 bis 10Beam-Search-Geduldsfaktor. Höher = mehr Kandidaten entdecken.
length_penaltynumber1-10 bis 10Für längere Zeugnisse gibt es eine Strafe. Negativ fördert kürzere Produktionen.
repetition_penaltynumber10.1 bis 5Strafe für das Wiederholen von Token. >1 reduziert die Wiederholung.
no_repeat_ngram_sizeinteger00 bis 20Blockieren Sie jedes N-Gramm dieser Größe daran, sich im Ausgang zu wiederholen.
temperaturestring0,0.2,0.4,0.6,0.8,1-Temperatur wird geprochen. 0 = deterministisch, höher = mehr Variation.
compression_ratio_thresholdnumber2.4-Behandle den Ausgang mit einem Kompressionsverhältnis darüber als fehlgeschlagen und versuche es erneut.
log_prob_thresholdnumber-1-Behandeln Sie Segmente mit durchschnittlicher logaritmischer Wahrscheinlichkeit darunter als gescheitert und versuchen Sie es erneut.
24 weitere Parameter in den Docs

Gut zu wissen

Unterstützt URL/base64 Audio, language/task, Beam- und Temperaturfallback-Steuerungen, VAD/chunking, Hotwords, Prompts, Word Timestamps, Interpunktionssteuerungen, Token-Debug-Ausgabe und JSON/text / SRT/VTT Formate.

Whisper Large v3 Turbo API: häufige Fragen

Wie viel kostet die Whisper Large v3 Turbo API?

Auf EmpirioLabs wird Whisper Large v3 Turbo nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Welchen Endpoint verwendet Whisper Large v3 Turbo?

Whisper Large v3 Turbo wird über POST /v1/audio/transcriptions auf api.empiriolabs.ai mit normaler Bearer-Token-Authentifizierung bereitgestellt.

Kann ich Whisper Large v3 Turbo im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt Whisper Large v3 Turbo im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen Whisper Large v3 Turbo API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.