Modèles de reconnaissance vocale pour une transcription rapide et précise.
Les modèles de transcription sur EmpirioLabs transforment l’audio (et, pour certains, la vidéo) en texte, avec des fonctionnalités telles que l’horodatage des mots, la détection de langue ou la traduction selon le modèle. Indiquez-les vers un fichier ou une URL et relisez la transcription, facturée à la minute d’audio.
Whisper Large v3 Turbo fonctionne via POST /v1/audio/transcriptions. La requête renvoie immédiatement un job_id ; interrogez GET /v1/jobs/{job_id} jusqu'à la fin du job et lisez les URLs de sortie dans le résultat. Remplacez l'id model par n'importe quel modèle ci-dessus. Obtenez une clé API depuis le tableau de bord EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "whisper-large-v3-turbo",
"audio_url": "https://example.com/meeting-recording.mp3"
}'EmpirioLabs liste 4 APIs de modèles Transcription, dont Whisper Large v3 Turbo, Deepgram Nova 3, OpenAI Whisper 1. Chaque modèle a sa propre page API avec tarifs en direct, paramètres et un quickstart.
Chaque modèle Transcription est facturé à l'usage, sans minimum mensuel. La grille tarifaire exacte se trouve sur la page de chaque modèle et correspond toujours à ce que l'API facture.
Non. Chaque modèle ici fonctionne dans le playground EmpirioLabs, une interface conviviale dans le navigateur où vous réglez les options et voyez les résultats sans écrire de code. Quand vous voulez automatiser, le même modèle est disponible via l'API.
Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.