
Kontextbewusste Transkription von Eigennamen, Fachbegriffen, Dialekten und schwierigen Tonarten einschließlich Flüstern, schneller Sprache und Gesang.
Kontextbewusste Transkription von Eigennamen, Fachbegriffen, Dialekten und schwierigen Tonarten einschließlich Flüstern, schneller Sprache und Gesang.
EmpirioLabs gibt das Standard-/v1/audio/transcriptions-Endpunkt frei und liefert das endgültige Transkript im normalen Transkriptionsantwortformat.
Auch bekannt als StepFun StepAudio 3 ASR Max
stepaudio-3-asr-max/v1/audio/transcriptionsstepfun/stepaudio-3-asr-maxLive Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
StepAudio 3 ASR Max läuft über POST /v1/audio/transcriptions. Der Request liefert sofort eine job_id; frage GET /v1/jobs/{job_id} ab, bis der Job abgeschlossen ist, und lies die Ausgabe-URLs aus dem Ergebnis. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stepaudio-3-asr-max",
"audio_url": "https://example.com/meeting-recording.mp3"
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "stepaudio-3-asr-max",
"audio_url": "https://example.com/meeting-recording.mp3",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Request-Parameter, die die StepAudio 3 ASR Max API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| file | string | - | - | Audiodatei-Upload zur Transkription. |
| file_url | string | - | - | Öffentliche URL zu einer Audiodatei. |
| audio_base64 | string | - | - | Base64-Audionutzlast für JSON-Anfragen. |
| enable_itn | boolean | true | - | Aktivieren Sie die umgedrehte Textnormalisierung, die Zahlen, Daten und Währung in ihrer schriftlichen Form schreibt. |
| format | enum | wav | wav, mp3, ogg, m4a, pcm | Audio-Container-Format. |
| codec | string | - | - | PCM-Codec wie pcm_s16le. |
| rate | number | - | - | PCM-Abtastrate in Hz. |
| bits | number | - | - | PCM-Bittiefe. |
| channel | number | - | - | PCM-Kanalanzahl. |
Unterstützt WAV, mp3, ogg, m4a und PCM-Eingaben. PCM-Anfragen sollten Codec, Abtastrate, Bittiefe und Kanalanzahl enthalten. Die Sprache wird automatisch erkannt und kann nicht eingestellt werden; Chinesisch, Englisch, Japanisch, Koreanisch, Französisch und Spanisch werden erkannt, mit anderen Sprachen als Chinesisch und Englisch in der Vorschau. Die inverse Textnormalisierung ist standardmäßig aktiviert und kann mit enable_itn deaktiviert werden. Hotwords und Wortzeitstempel sind bei diesem Modell nicht verfügbar. Audio wird nach seiner gemessenen Dauer berechnet, mit einer Mindeststunde von einer Sekunde.
Auf EmpirioLabs wird StepAudio 3 ASR Max nach Verbrauch abgerechnet: Transkription $0.24 pro Stunde Audio. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
StepAudio 3 ASR Max wird über POST /v1/audio/transcriptions auf api.empiriolabs.ai mit normaler Bearer-Token-Authentifizierung bereitgestellt.
Ja. Der EmpirioLabs Playground führt StepAudio 3 ASR Max im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.