
La transcription vocale en texte utilisant le modèle Nova-3 avec prise en charge multilingue et réglages avancés personnalisables pour les charges de production.
La transcription vocale en texte utilisant le modèle Nova-3 avec prise en charge multilingue et réglages avancés personnalisables pour les charges de production.
Aussi connu sous le nom Deepgram-Nova-3
deepgram-nova-3/v1/audio/transcriptionsdeepgram/nova-3nova-3Tarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.
Deepgram Nova 3 fonctionne via POST /v1/audio/transcriptions. La requête renvoie immédiatement un job_id ; interrogez GET /v1/jobs/{job_id} jusqu'à la fin du job et lisez les URLs de sortie dans le résultat. Obtenez une clé API depuis le tableau de bord EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepgram-nova-3",
"audio_url": "https://example.com/meeting-recording.mp3"
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "deepgram-nova-3",
"audio_url": "https://example.com/meeting-recording.mp3",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Paramètres de requête pris en charge par l'API Deepgram Nova 3 sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.
| Paramètre | Type | Par défaut | Plage / valeurs | Description |
|---|---|---|---|---|
| file | string | - | - | Fichier audio (mp3, wav, m4a, ogg, etc.) téléchargé en tant que multipart/form-data. |
| file_url | string | - | - | URL de l’audio à transcrire. Incompatibles avec file. |
| smart_format | boolean | true | - | Appliquez une mise en forme intelligente (mettez en majuscules, ponctuez, formatez numbers/dates). |
| profanity_filter | boolean | false | - | Masquez les mots grossiers dans la transcription avec ****. |
| numerals | boolean | false | - | Convertir les numéros parlés en chiffres (par exemple « cinq » → « 5 »). |
| measurements | boolean | false | - | Convertir les mots de mesure en abréviations (par exemple « kilogrammes » → « kg »). |
| language | enum | auto | auto, en, es, fr, de, it, pt, ja, zh, hi, ru, nl | Code linguistique ISO 639-1. Détecte automatiquement si tu n’as pas été utilisé. |
| redact_pii | boolean | false | - | Masquez les informations personnelles identifiables dans la transcription. |
| redact_pci | boolean | false | - | Masquez les numéros de carte de paiement dans la transcription. |
| keyterm | string | - | - | Des termes clés séparés par des virgules pour améliorer la précision de la reconnaissance (jargon, noms). |
| diarize | boolean | false | - | Identifiez les différents locuteurs et étiquetez chaque énoncé avec une étiquette de haut-parleur. |
| paragraphs | boolean | true | - | Regroupez la sortie en paragraphes selon les pauses et les tours de l’orateur. |
| dictation | boolean | false | - | Interprétez des commandes comme « point », « virgule », « nouvelle ligne » comme punctuation/formatting. |
| punctuate | boolean | true | - | Ajoutez la ponctuation à la transcription. |
Langues auto-détectées Anglais, espagnol, français, allemand, italien, portugais, japonais, chinois, hindi, russe, néerlandais. Termes clés personnalisés - Anglais uniquement, ≤500 jetons au total - Améliore la reconnaissance du vocabulaire spécifique au domaine Interactions de fonctionnalités - La diarisation active automatiquement les énoncés - Formatage intelligent et les paragraphes activent automatiquement la ponctuation - PCI/PII filtre de redaction et de vulgarisation sont désactivés par défaut
Sur EmpirioLabs, Deepgram Nova 3 est facturé à l'usage : Transcription $0.014 par minute d'audio. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.
Deepgram Nova 3 est servi via POST /v1/audio/transcriptions sur api.empiriolabs.ai avec une authentification standard par token Bearer.
Oui. Le playground EmpirioLabs exécute Deepgram Nova 3 dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.
Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.
Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.