使用Nova-3模式进行语音对文字的转录,提供多种语言支持和先进的定制的制作工作量设置。
也称为 Deepgram-Nova-3
deepgram-nova-3/v1/audio/transcriptionsdeepgram/nova-3nova-3来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
Deepgram Nova 3 通过 POST /v1/audio/transcriptions 运行。请求会立即返回 job_id;轮询 GET /v1/jobs/{job_id} 直到任务完成,再从结果中读取输出 URL。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepgram-nova-3",
"audio_url": "https://example.com/meeting-recording.mp3"
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "deepgram-nova-3",
"audio_url": "https://example.com/meeting-recording.mp3",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs 上 Deepgram Nova 3 API 支持的请求参数。省略字段时使用默认值。
| 参数 | 类型 | 默认值 | 范围 / 值 | 描述 |
|---|---|---|---|---|
| file | string | - | - | 音频文件(mp3、wav、m4a、ogg等)以multipart/form-data形式上传。 |
| file_url | string | - | - | 音频的网址以便转录。与file互斥。 |
| smart_format | boolean | true | - | 应用智能格式化(大写、标点、格式numbers/dates)。 |
| profanity_filter | boolean | false | - | 在记录中用****遮盖脏话。 |
| numerals | boolean | false | - | 将口语数字转换为数字(例如“五”→“5”)。 |
| measurements | boolean | false | - | 将测量词转换为缩写(例如“kilograms”→“kg”)。 |
| language | enum | auto | auto, en, es, fr, de, it, pt, ja, zh, hi, ru, nl | ISO 639-1语言代码。如果省略了,则自动检测。 |
| redact_pii | boolean | false | - | 在笔录中掩盖个人身份信息。 |
| redact_pci | boolean | false | - | 成绩单上要写口罩支付卡号。 |
| keyterm | string | - | - | 用逗号分隔的关键词来提高识别准确率(术语、名称)。 |
| diarize | boolean | false | - | 识别不同的发言者,并为每个发言人标签。 |
| paragraphs | boolean | true | - | 根据停顿和发言人转向,将输出分成段落。 |
| dictation | boolean | false | - | 把“句号”、“逗号”、“换行”等命令理解为punctuation/formatting。 |
| punctuate | boolean | true | - | 在文字记录中添加标点符号。 |
自动识别语言 英语,西班牙语,法语,德语,意大利语,葡萄牙语,日语,汉语,印地语,俄语,荷兰语. Custom Key terms - 仅英文,% 500 令牌总数 - 提高域内特定词汇的识别 Feature interviews - Diarization auto-enables speakings - Smart格式和段落 auto-enable punctuation PCI/PII 编辑和亵渎过滤器默认关闭
在 EmpirioLabs,Deepgram Nova 3 按量计费:译名 $0.014 每分钟音频。本页的实时价格表始终与 API 的实际计费一致。
Deepgram Nova 3 通过 api.empiriolabs.ai 上的 POST /v1/audio/transcriptions 提供,使用标准的 Bearer 令牌认证。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 Deepgram Nova 3,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。