Modelos de reconocimiento de voz para transcripciones rápidas y precisas.
Los modelos de transcripción EmpirioLabs convertir audio (y, en algunos casos, vídeo) en texto, con capacidades como marcas de tiempo de palabras, detección de idiomas o traducción, dependiendo del modelo. Apunta a un archivo o URL y lee la transcripción, facturada por minuto de audio.
Whisper Large v3 Turbo funciona a través de POST /v1/audio/transcriptions. La solicitud devuelve un job_id de inmediato; consulta GET /v1/jobs/{job_id} hasta que el trabajo termine y lee las URLs de salida del resultado. Cambia el id model por cualquier modelo de arriba. Consigue una clave de API en el panel de EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "whisper-large-v3-turbo",
"audio_url": "https://example.com/meeting-recording.mp3"
}'EmpirioLabs lista 11 APIs de modelos de Transcripción, incluyendo Whisper Large v3 Turbo, Deepgram Nova 3, OpenAI Whisper 1. Cada modelo tiene su propia página de API con precios en vivo, parámetros y un quickstart.
Cada modelo de Transcripción se factura por uso, sin mínimo mensual. La tabla de tarifas exacta está en la página de cada modelo y siempre coincide con lo que cobra la API.
No. Cada modelo aquí funciona en el playground de EmpirioLabs, una interfaz amigable en el navegador donde ajustas las opciones y ves resultados sin escribir código. Cuando quieras automatizar, el mismo modelo está disponible a través de la API.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.