Sprach-zu-Text-Modelle für schnelle, genaue Transkription.
Transkriptionsmodelle auf EmpirioLabs Audio (und bei manchen Video) in Text umwandeln, mit Funktionen wie Wortzeitstempeln, Spracherkennung oder Übersetzung, je nach Modell. Zeigen Sie auf eine Datei oder URL und lesen Sie das Transkript vor, berechnet pro Minute Audio.
Whisper Large v3 Turbo läuft über POST /v1/audio/transcriptions. Der Request liefert sofort eine job_id; frage GET /v1/jobs/{job_id} ab, bis der Job abgeschlossen ist, und lies die Ausgabe-URLs aus dem Ergebnis. Tausche die model ID gegen ein beliebiges Modell oben. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "whisper-large-v3-turbo",
"audio_url": "https://example.com/meeting-recording.mp3"
}'EmpirioLabs listet 4 Transkription Modell-APIs, darunter Whisper Large v3 Turbo, Deepgram Nova 3, OpenAI Whisper 1. Jedes Modell hat eine eigene API-Seite mit Live-Preisen, Parametern und einem Quickstart.
Jedes Transkription Modell wird nach Verbrauch abgerechnet, ohne monatliches Minimum. Die genaue Preistabelle steht auf der jeweiligen Modellseite und entspricht immer dem, was die API berechnet.
Nein. Jedes Modell hier läuft im EmpirioLabs Playground, einer freundlichen Browser-Oberfläche, in der du Optionen einstellst und Ergebnisse siehst, ohne Code zu schreiben. Wenn du automatisieren willst, ist dasselbe Modell über die API verfügbar.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.