语音转文字,适用于短片段和长录音,包含句段、单词时间戳,以及多语言和中文方言识别。
上传文件或传递音频URL。语言会自动检测。
也称为 Qwen Audio ASR, Alibaba Cloud Qwen Audio 3.1 ASR
qwen-audio-3-1-asr/v1/audio/transcriptionsqwen-audio-3.1-asralibaba/qwen-audio-3-1-asr来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
Qwen Audio 3.1 ASR 通过 POST /v1/audio/transcriptions 运行。请求会立即返回 job_id;轮询 GET /v1/jobs/{job_id} 直到任务完成,再从结果中读取输出 URL。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen-audio-3-1-asr",
"audio_url": "https://example.com/meeting-recording.mp3"
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "qwen-audio-3-1-asr",
"audio_url": "https://example.com/meeting-recording.mp3",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)发送音频 以多部分file或带有audio_url或audio_base64的JSON格式发送文件,采用常见音频格式。短片段和长录音均可接受。获取结果请求会立即返回job_id和poll_url。轮询GET /v1/jobs/<job-id>直到statuscompleted。短片段几秒钟内结束;长录音则耗时更长。回应内容完成工作的result包含完整的文字稿,包括完整的text、句子段及开始和结束时间,以及单词时间戳。语言自动检测,包括中文方言。计费 输入和输出令牌按1M计价,每个请求按模型报告的使用量计费。
在 EmpirioLabs,Qwen Audio 3.1 ASR 按量计费:输入 $0.30 每 1M 音频输入令牌; 产出 $0.94 每100万个生成代币。本页的实时价格表始终与 API 的实际计费一致。
Qwen Audio 3.1 ASR 通过 api.empiriolabs.ai 上的 POST /v1/audio/transcriptions 提供,使用标准的 Bearer 令牌认证。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 Qwen Audio 3.1 ASR,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。