TTS 1.5 Mini API

sub-130ms TTFB语音合成,配有271+语音,跨越15种语言,表现性prosody,以及用于低纬度语音代理的实时SSE流.

Inworld音频生成发布日期 2026年1月21日专有端点

关于 TTS 1.5 Mini

sub-130ms TTFB语音合成,配有271+语音,跨越15种语言,表现性prosody,以及用于低纬度语音代理的实时SSE流.

也称为 TTS Mini, Inworld TTS 1.5 Mini, TTS-1.5-Mini, tts-1-5-mini

multi speakerreal timelow latencystreamingword timestampscharacter timestampsmultilingualexpressive prosody

TTS 1.5 Mini 规格

模型 ID
tts-1-5-mini
提供方
Inworld
类别
音频生成
发布日期
2026年1月21日
输入
文本
输出
音频
端点
POST/v1/audio/speechPOST/v1/audio/speech:streamGET/v1/voices
备用模型 ID
inworld-tts-1.5-minitts-1.5-mini

TTS 1.5 Mini API 价格最高省 30%

来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。

类型
规格
价格
综述
每1M个字符
$25.00$17.50
在完整价格页比较

如何调用 TTS 1.5 Mini API

TTS 1.5 Mini 通过 POST /v1/audio/speech 生成语音并返回可播放的音频。把要朗读的文本作为 input,连同模型 ID tts-1-5-mini 一起发送。 在EmpirioLabs 控制台获取 API 密钥。

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "tts-1-5-mini",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "tts-1-5-mini", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
TTS 1.5 Mini API 完整参考

TTS 1.5 Mini API 参数

EmpirioLabs 上 TTS 1.5 Mini API 支持的请求参数。省略字段时使用默认值。

参数类型默认值范围 / 值描述
inputstring-最大 2000文本要综合。每个请求最多2000字符;在客户端的句子边界处,分块更长的副本。
voiceenumSarahSarah, Olivia, Elizabeth, Ashley, Wendy, Julia, Priya, Pixie,...语音预设。20位精心挑选的声音,涵盖英语+西班牙语+葡萄牙语+印地语+多种口音。对于完整的271声部目录(包括克隆声),请使用voice_id。
voice_idstring--自由形式的语音ID。设置时覆盖语音。用这个词来处理精选20个预设列表之外的声音。Inworld TTS 1.5 支持271+个名字配音,涵盖15种语言(地区口音、性别变体)。举例:Maitê、Olivia,或GET /v1/voices.中的任何声音名字
languageenumen-USen-US, en-GB, es-ES, es-MX, fr-FR, de-DE, it-IT, pt-BR, pt-PT...BCP-47语言代码。Inworld TTS 1.5 涵盖了 15 种语言。
output_formatenumWAVMP3, WAV, OGG, FLAC, PCM, ALAW, MULAW音频container/codec。WAV = LINEAR16 RIFF(无处不在)。MP3 / OGG = 压缩。PCM = 无标题原始,适合分块实时播放。FLAC = 无损。
sample_rateenum240008000, 16000, 22050, 24000, 32000, 44100, 48000输出采样率以Hz为单位。24000是Inworld的默认采样率,也是其语音模型训练的标准;广播质量提升到48000。
speednumber10.5 到 1.5说话率乘数。0.5 = 半速,1.5 = 快50%。
temperaturenumber10.1 到 2声音的表现力/变化性。Lower = 更稳定/“平坦”;更高=表现力更强,但渲染间差异更大。
bit_ratenumber12800032000 到 320000MP3 / OGG_OPUS 的比特率以 BPPS 表示。其他编码则被忽略。
apply_text_normalizationenumONON, OFF开启后,Inworld 会将数字/缩写/日期扩展为口头形式(“5美元”→“5美元”)。
timestamp_typeenumNONENONE, WORD, CHARACTER如果不是 NONE,响应会包含每个词或每个字符的时间戳,timestamp_info。对标题/高亮界面很有用。

须知

Limits - 最大输入:每个请求2,000个字符(句号边界处的较长文本) - WebSocket:20个并行连接,5 contexts/connection Per-WS消息:1000个字符Latency - p90 TTFB:低于130 ms(世界基准)Voices - 271+ 命名预设,跨越15种语言 - 20个手选预置在滴下;通过 voice_id 通过其他语音ID

TTS 1.5 Mini API:常见问题

TTS 1.5 Mini API 收费多少?

在 EmpirioLabs,TTS 1.5 Mini 按量计费。本页的实时价格表始终与 API 的实际计费一致。

TTS 1.5 Mini 使用哪个端点?

TTS 1.5 Mini 通过 api.empiriolabs.ai 上的 POST /v1/audio/speech 提供,使用标准的 Bearer 令牌认证。

集成之前可以在浏览器里试用 TTS 1.5 Mini 吗?

可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 TTS 1.5 Mini,你可以在写代码之前先测试提示词。

如何获取 TTS 1.5 Mini API 密钥?

创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。

准备好使用更好的终端了吗?

查看我们的定价,或者如果你想将自己的模型部署到我们的堆栈中,请联系我们。