
Reconnaissance vocale pour de courts extraits et enregistrements longs, avec segments de phrases, horodatages de mots, reconnaissance multilingue ainsi que des dialectes chinois.
Reconnaissance vocale pour de courts extraits et enregistrements longs, avec segments de phrases, horodatages de mots, reconnaissance multilingue ainsi que des dialectes chinois.
Téléchargez un fichier ou passez une URL audio. La langue est détectée automatiquement.
Aussi connu sous le nom Qwen Audio ASR, Alibaba Cloud Qwen Audio 3.1 ASR
qwen-audio-3-1-asr/v1/audio/transcriptionsqwen-audio-3.1-asralibaba/qwen-audio-3-1-asrTarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.
Qwen Audio 3.1 ASR fonctionne via POST /v1/audio/transcriptions. La requête renvoie immédiatement un job_id ; interrogez GET /v1/jobs/{job_id} jusqu'à la fin du job et lisez les URLs de sortie dans le résultat. Obtenez une clé API depuis le tableau de bord EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen-audio-3-1-asr",
"audio_url": "https://example.com/meeting-recording.mp3"
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "qwen-audio-3-1-asr",
"audio_url": "https://example.com/meeting-recording.mp3",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Envoi audio Envoyez un fichier en file multiparties, ou en JSON avec audio_url ou audio_base64, dans des formats audio courants. Les courts extraits et les longs enregistrements sont tous deux acceptés. Obtention du résultat La requête renvoie immédiatement un job_id et un poll_url. Interrogez GET /v1/jobs/<job-id> jusqu’à ce que status soit completed. Les courts extraits se terminent en quelques secondes; les enregistrements longs prennent plus de temps. Ce qui revient Le result du travail terminé contient la transcription complète en text, les segments de phrase avec les heures de début et de fin, ainsi que les horodatages des mots. La langue est détectée automatiquement, y compris les dialectes chinois. Facturation Les jetons d’entrée et de sortie sont tarifés par 1M, et chaque requête est facturée selon l’utilisation rapportée par le modèle.
Sur EmpirioLabs, Qwen Audio 3.1 ASR est facturé à l'usage : Entrée $0.30 par 1M de jetons d’entrée audio; Produit $0.94 par 1M de jetons générés. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.
Qwen Audio 3.1 ASR est servi via POST /v1/audio/transcriptions sur api.empiriolabs.ai avec une authentification standard par token Bearer.
Oui. Le playground EmpirioLabs exécute Qwen Audio 3.1 ASR dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.
Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.
Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.