Whisper Large v3 Turbo API

Transcription contrôlée Whisper Large v3 Turbo avec ASR multilingue, traduction, VAD, horodatages, sous-titres, hotwords et contrôles décodeurs.

OpenAITranscriptionPublié 1 oct. 2024Inférence native

À propos de Whisper Large v3 Turbo

Transcription contrôlée Whisper Large v3 Turbo avec ASR multilingue, traduction, VAD, horodatages, sous-titres, hotwords et contrôles décodeurs.

Aussi connu sous le nom Whisper Large Turbo, OpenAI Whisper Large v3 Turbo, Whisper-Large-v3-Turbo

transcriptiontranslationmultilingualword timestampshotwordssrt vtt

Caractéristiques de Whisper Large v3 Turbo

ID du modèle
whisper-large-v3-turbo
Fournisseur
OpenAI
Catégorie
Transcription
Publié
1 oct. 2024
Entrée
Audio
Sortie
Texte
Endpoints
POST/v1/audio/transcriptions
Identifiants de modèle alternatifs
openai/whisper-large-v3-turbo

Tarifs de l'API Whisper Large v3 TurboÉconomisez jusqu'à 17%

Tarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.

Type
Spéc.
Tarif
Transcription contrôlée
par minute d'audio
$0.006$0.005
Comparer sur la page complète des tarifs

Comment appeler l'API Whisper Large v3 Turbo

Whisper Large v3 Turbo fonctionne via POST /v1/audio/transcriptions. La requête renvoie immédiatement un job_id ; interrogez GET /v1/jobs/{job_id} jusqu'à la fin du job et lisez les URLs de sortie dans le résultat. Obtenez une clé API depuis le tableau de bord EmpirioLabs.

cURL : envoyer le job
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "whisper-large-v3-turbo",
    "audio_url": "https://example.com/meeting-recording.mp3"
  }'
cURL : interroger le résultat
curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY"
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/transcriptions",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={
        "model": "whisper-large-v3-turbo",
        "audio_url": "https://example.com/meeting-recording.mp3",
    },
)
job = response.json()

# Generation runs as an async job. Poll until it completes.
import time
while True:
    status = requests.get(
        f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
        headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    ).json()
    if status.get("status") in ("completed", "failed"):
        print(status)
        break
    time.sleep(5)
Référence complète de l'API Whisper Large v3 Turbo

Paramètres de l'API Whisper Large v3 Turbo

Paramètres de requête pris en charge par l'API Whisper Large v3 Turbo sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.

ParamètreTypePar défautPlage / valeursDescription
audio_urlstring--URL du fichier audio à transcrire. Mutuellement exclusif avec audio_base64.
audio_base64string--Octets audio codés en base64. Incompatibles avec audio_url.
audio_suffixstring.audio-Indice d’extension de fichier (mp3, wav, m4a, etc.) lorsque la source audio n’a pas d’extension reconnaissable.
languagestring--Code linguistique ISO 639-1 (en, es, fr, etc.). Laissez le bouton vide pour l’auto-détection.
taskenumtranscribetranscribe, translatetranscrire = même langue, traduire = traduire en anglais.
beam_sizeinteger51 à 32Largeur de recherche du faisceau. Plus haut = plus précis mais plus lent.
best_ofinteger51 à 32Nombre de candidats à échantillonner avec une température > 0.
patiencenumber10 à 10Faisceau de recherche: patience. Plus haut = explorer plus de candidats.
length_penaltynumber1-10 à 10Pénalité appliquée aux relevés de notes plus longs. Le négatif encourage une production plus courte.
repetition_penaltynumber10.1 à 5Pénalité pour répétition des jetons. >1 réduit la répétition.
no_repeat_ngram_sizeinteger00 à 20Bloquez tout n-gramme de cette taille pour qu’il ne se répète pas dans la sortie.
temperaturestring0,0.2,0.4,0.6,0.8,1-Température d’échantillonnage. 0 = déterministe, plus élevé = plus grande variation.
compression_ratio_thresholdnumber2.4-Considérez la sortie avec un taux de compression supérieur à celui-ci comme un échec et réessayez.
log_prob_thresholdnumber-1-Considérez les segments avec une probabilité logaritmique moyenne inférieure à ce taux comme échoués et réessayez.
24 paramètres de plus dans la doc

Bon à savoir

Prend en charge URL/base64 audio, language/task, les commandes de recul du faisceau et de la température, VAD/chunking, les mots chauds, les invites, les horodatages de mots, les commandes de ponctuation, la sortie de débogage token et les formats JSON/text / SRT/VTT.

API Whisper Large v3 Turbo : questions fréquentes

Combien coûte l'API Whisper Large v3 Turbo ?

Sur EmpirioLabs, Whisper Large v3 Turbo est facturé à l'usage. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.

Quel endpoint Whisper Large v3 Turbo utilise-t-il ?

Whisper Large v3 Turbo est servi via POST /v1/audio/transcriptions sur api.empiriolabs.ai avec une authentification standard par token Bearer.

Puis-je essayer Whisper Large v3 Turbo dans le navigateur avant d'intégrer ?

Oui. Le playground EmpirioLabs exécute Whisper Large v3 Turbo dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.

Comment obtenir une clé API Whisper Large v3 Turbo ?

Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.

Prêt à utiliser de meilleurs points de terminaison ?

Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.