Whisper Large v3 Turbo API

Transcripción controlada Whisper Large v3 Turbo con ASR multilingüe, traducción, VAD, marcas de tiempo, subtítulos, palabras calientes y controles de decodificador.

OpenAITranscripciónLanzado 1 oct 2024Inferencia nativa

Acerca de Whisper Large v3 Turbo

Transcripción controlada Whisper Large v3 Turbo con ASR multilingüe, traducción, VAD, marcas de tiempo, subtítulos, palabras calientes y controles de decodificador.

También conocido como Whisper Large Turbo, OpenAI Whisper Large v3 Turbo, Whisper-Large-v3-Turbo

transcriptiontranslationmultilingualword timestampshotwordssrt vtt

Especificaciones de Whisper Large v3 Turbo

ID del modelo
whisper-large-v3-turbo
Proveedor
OpenAI
Categoría
Transcripción
Lanzado
1 oct 2024
Entrada
Audio
Salida
Texto
Endpoints
POST/v1/audio/transcriptions
IDs de modelo alternativos
openai/whisper-large-v3-turbo

Precios de la API de Whisper Large v3 TurboAhorra hasta 17%

Tarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.

Tipo
Especificación
Tarifa
Transcripción controlada
por minuto de audio
$0.006$0.005
Comparar en la página completa de precios

Cómo llamar a la API de Whisper Large v3 Turbo

Whisper Large v3 Turbo funciona a través de POST /v1/audio/transcriptions. La solicitud devuelve un job_id de inmediato; consulta GET /v1/jobs/{job_id} hasta que el trabajo termine y lee las URLs de salida del resultado. Consigue una clave de API en el panel de EmpirioLabs.

cURL: enviar el trabajo
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "whisper-large-v3-turbo",
    "audio_url": "https://example.com/meeting-recording.mp3"
  }'
cURL: consultar el resultado
curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY"
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/transcriptions",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={
        "model": "whisper-large-v3-turbo",
        "audio_url": "https://example.com/meeting-recording.mp3",
    },
)
job = response.json()

# Generation runs as an async job. Poll until it completes.
import time
while True:
    status = requests.get(
        f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
        headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    ).json()
    if status.get("status") in ("completed", "failed"):
        print(status)
        break
    time.sleep(5)
Referencia completa de la API de Whisper Large v3 Turbo

Parámetros de la API de Whisper Large v3 Turbo

Parámetros de solicitud compatibles con la API de Whisper Large v3 Turbo en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.

ParámetroTipoPredeterminadoRango / valoresDescripción
audio_urlstring--URL del archivo de audio para transcribir. Excluyentes con audio_base64.
audio_base64string--Bytes de audio codificados en base64. Excluyentes con audio_url.
audio_suffixstring.audio-Hint de extensión de archivo (mp3, wav, m4a, etc.) cuando la fuente de audio no tiene extensión reconocible.
languagestring--Código de idioma ISO 639-1 (en, es, fr, etc.). Deja en blanco para la detección automática.
taskenumtranscribetranscribe, translatetranscribe = mismo idioma, translate = translate al inglés.
beam_sizeinteger51 a 32Ancho de búsqueda del haz. Más alto = más preciso pero más lento.
best_ofinteger51 a 32Número de candidatos a muestrear con temperatura > 0.
patiencenumber10 a 10Haz de búsqueda y paciencia. Más alto = explorar más candidatos.
length_penaltynumber1-10 a 10Se aplica penalización a expedientes más largos. El negativo fomenta una producción más corta.
repetition_penaltynumber10.1 a 5Penalización por repetir fichas. >1 reduce la repetición.
no_repeat_ngram_sizeinteger00 a 20Bloquea cualquier n-gramo de este tamaño para que no se repita en la salida.
temperaturestring0,0.2,0.4,0.6,0.8,1-Temperatura de muestreo. 0 = determinista, mayor = más variación.
compression_ratio_thresholdnumber2.4-Trata la salida con una relación de compresión superior a esta como fallida y vuelve a intentarlo.
log_prob_thresholdnumber-1-Trata los segmentos con probabilidad logarítmica media inferior a esto como fallidos y vuelve a intentarlo.
24 parámetros más en la documentación

Información útil

Soporta controles de audio URL/base64, language/task, haz y de temperatura, VAD/chunking, hotwords, prompts, marcas de tiempo de palabras, controles de puntuación, salida de depuración de tokens y formatos JSON/text/SRT/VTT.

API de Whisper Large v3 Turbo: preguntas frecuentes

¿Cuánto cuesta la API de Whisper Large v3 Turbo?

En EmpirioLabs, Whisper Large v3 Turbo se factura por uso. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.

¿Qué endpoint usa Whisper Large v3 Turbo?

Whisper Large v3 Turbo se sirve a través de POST /v1/audio/transcriptions en api.empiriolabs.ai con autenticación estándar de token Bearer.

¿Puedo probar Whisper Large v3 Turbo en el navegador antes de integrar?

Sí. El playground de EmpirioLabs ejecuta Whisper Large v3 Turbo en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.

¿Cómo consigo una clave de API de Whisper Large v3 Turbo?

Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.

¿Listo para usar mejores endpoints?

Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.