StepAudio 2.5 ASR API

Modèle de reconnaissance vocale en streaming StepFun pour la transcription audio chinoise et anglaise.

StepFunTranscriptionPublié 24 avr. 2026InternationalEndpoint propriétaireNouveau

À propos de StepAudio 2.5 ASR

Modèle de reconnaissance vocale en streaming StepFun pour la transcription audio chinoise et anglaise.

EmpirioLabs expose le point de /v1/audio/transcriptions standard et retourne la transcription finale dans le format de réponse de transcription normal.

Aussi connu sous le nom StepAudio ASR, StepFun StepAudio 2.5 ASR, StepAudio-2.5-ASR, stepaudio-2-5-asr

transcriptionspeech to textstreaming asrtimestamps

Caractéristiques de StepAudio 2.5 ASR

ID du modèle
stepaudio-2-5-asr
Fournisseur
StepFun
Catégorie
Transcription
Publié
24 avr. 2026
Entrée
Audio
Sortie
Texte
Région
International
Endpoints
POST/v1/audio/transcriptions
Identifiants de modèle alternatifs
stepaudio-2.5-asrstepfun/stepaudio-2-5-asrstepfun/stepaudio-2.5-asr

Tarifs de l'API StepAudio 2.5 ASR

Tarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.

Type
Spéc.
Tarif
Transcription
par heure d’audio
$0.022
Comparer sur la page complète des tarifs

Comment appeler l'API StepAudio 2.5 ASR

StepAudio 2.5 ASR fonctionne via POST /v1/audio/transcriptions. La requête renvoie immédiatement un job_id ; interrogez GET /v1/jobs/{job_id} jusqu'à la fin du job et lisez les URLs de sortie dans le résultat. Obtenez une clé API depuis le tableau de bord EmpirioLabs.

cURL : envoyer le job
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "stepaudio-2-5-asr",
    "audio_url": "https://example.com/meeting-recording.mp3"
  }'
cURL : interroger le résultat
curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY"
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/transcriptions",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={
        "model": "stepaudio-2-5-asr",
        "audio_url": "https://example.com/meeting-recording.mp3",
    },
)
job = response.json()

# Generation runs as an async job. Poll until it completes.
import time
while True:
    status = requests.get(
        f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
        headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    ).json()
    if status.get("status") in ("completed", "failed"):
        print(status)
        break
    time.sleep(5)
Référence complète de l'API StepAudio 2.5 ASR

Paramètres de l'API StepAudio 2.5 ASR

Paramètres de requête pris en charge par l'API StepAudio 2.5 ASR sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.

ParamètreTypePar défautPlage / valeursDescription
fileaudio--Téléchargement de fichier audio pour transcription.
file_urlstring--URL publique d’un fichier audio.
audio_base64string--Charge utile audio Base64 pour les requêtes JSON.
languageenumenen, zhLangage de reconnaissance.
hotwordsarray--Liste optionnelle de mots hotword.
enable_itnbooleantrue-Activez la normalisation inverse du texte.
enable_timestampbooleanfalse-Retournez les champs d’horodatage des événements StepFun SSE lorsque disponibles.
formatenumwavwav, mp3, ogg, pcmFormat conteneur audio.
codecstring--Codec PCM comme pcm_s16le.
rateinteger160008000 à 48000Taux d’échantillonnage PCM en Hz.
bitsinteger168 à 32Profondeur de bits PCM.
channelinteger11 à 8Nombre de canaux PCM.

Bon à savoir

Prend en charge, les entrées wav, mp3, ogg et pcm. Les requêtes PCM doivent inclure le codec, la fréquence d’échantillonnage, la profondeur de bits et le nombre de canaux. Le langage de reconnaissance prend en charge le chinois et l’anglais. La sortie horodatage est disponible via enable_timestamp.

API StepAudio 2.5 ASR : questions fréquentes

Combien coûte l'API StepAudio 2.5 ASR ?

Sur EmpirioLabs, StepAudio 2.5 ASR est facturé à l'usage : Transcription $0.022 par heure d’audio. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.

Quel endpoint StepAudio 2.5 ASR utilise-t-il ?

StepAudio 2.5 ASR est servi via POST /v1/audio/transcriptions sur api.empiriolabs.ai avec une authentification standard par token Bearer.

Puis-je essayer StepAudio 2.5 ASR dans le navigateur avant d'intégrer ?

Oui. Le playground EmpirioLabs exécute StepAudio 2.5 ASR dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.

Comment obtenir une clé API StepAudio 2.5 ASR ?

Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.

Prêt à utiliser de meilleurs points de terminaison ?

Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.