
Whisper-1 speech-to-text Transkription mit einem Upload-Limit von 25 MB pro Datei.
Whisper-1 speech-to-text Transkription mit einem Upload-Limit von 25 MB pro Datei.
Auch bekannt als OpenAI-Whisper-1
openai-whisper-1/v1/audio/transcriptionsopenai-whisperwhisper-1Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
OpenAI Whisper 1 läuft über POST /v1/audio/transcriptions. Der Request liefert sofort eine job_id; frage GET /v1/jobs/{job_id} ab, bis der Job abgeschlossen ist, und lies die Ausgabe-URLs aus dem Ergebnis. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai-whisper-1",
"audio_url": "https://example.com/meeting-recording.mp3"
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "openai-whisper-1",
"audio_url": "https://example.com/meeting-recording.mp3",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Request-Parameter, die die OpenAI Whisper 1 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| file | string | - | - | Audiodatei (mehrteiliger Upload) ODER file_url für den JSON-Pfad verwenden. |
| file_url | string | - | - | Öffentliche URL zum Abrufen von Audio (alternativ zum Dateihochladen). |
| translate | boolean | false | - | Wenn zutreffend, routen Sie zu /audio/translations und übersetzen Sie ins Englische, anstatt in der Quellsprache zu transkribieren. |
| timestamps | boolean | false | - | Convenience-Schalter. Wenn zutreffend, setzt response_format=verbose_json und schließt Wortebene timestamp_granularities ein. |
| language | string | - | - | Optionaler ISO-639-1-Sprachcode. Automatisch erkannt, wenn es weggelassen wird. Ignoriert, wenn übersetzen=wahr ist. |
| prompt | string | - | - | Glossar oder vorheriger Kontext, um das Modell zu verzerren. |
| response_format | enum | json | json, text, srt, verbose_json, vtt | Überschrieben auf verbose_json, wenn Zeitstempel=wahr. |
| temperature | number | 0 | 0 bis 1 | Temperatur wird geprochen. |
| timestamp_granularities | string | - | - | Komma-getrennte Liste: Wort, Segment. Verwendet, wenn response_format=verbose_json. |
Auf EmpirioLabs wird OpenAI Whisper 1 nach Verbrauch abgerechnet: Pro Minute Audio $0.030 pro Minute. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
OpenAI Whisper 1 wird über POST /v1/audio/transcriptions auf api.empiriolabs.ai mit normaler Bearer-Token-Authentifizierung bereitgestellt.
Ja. Der EmpirioLabs Playground führt OpenAI Whisper 1 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.