EmpirioLabs上的转录模型将音频(部分视频)转换为文本,具备文字时间戳、语言检测或翻译等功能,具体取决于模型。指向一个文件或网址,然后按音频分钟计费的文字稿。
Whisper Large v3 Turbo 通过 POST /v1/audio/transcriptions 运行。请求会立即返回 job_id;轮询 GET /v1/jobs/{job_id} 直到任务完成,再从结果中读取输出 URL。 可以把 model ID 换成上面的任意模型。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "whisper-large-v3-turbo",
"audio_url": "https://example.com/meeting-recording.mp3"
}'EmpirioLabs 列出了4 译名模型 API(包括 Whisper Large v3 Turbo, Deepgram Nova 3, OpenAI Whisper 1)。每个模型都有自己的 API 页面,包含实时价格、参数和快速上手。
每个译名模型都按量计费,没有月度最低消费。准确的价格表在各模型页面上,并且始终与 API 的实际计费一致。
不需要。这里的每个模型都能在EmpirioLabs Playground中运行,那是一个友好的浏览器界面,不写代码就能设置选项并查看结果。需要自动化时,同一个模型也可以通过 API 使用。