StepAudio 2.5 TTS API

情境式 StepFun text-to-speech具有自然语言语音指导和富有表现力的模型。

StepFun音频生成发布日期 2026年4月21日International专有端点

关于 StepAudio 2.5 TTS

情境式 StepFun text-to-speech具有自然语言语音指导和富有表现力的模型。

字符计数遵循StepFun定价:一个汉字算一个字符,两个英文字母算一个字符,两个标点符号算一个字符。

也称为 StepAudio TTS, StepFun StepAudio 2.5 TTS, StepAudio-2.5-TTS, stepaudio-2-5-tts

text to speechcontextual ttsvoice controlmultilingual

StepAudio 2.5 TTS 规格

模型 ID
stepaudio-2-5-tts
提供方
StepFun
类别
音频生成
发布日期
2026年4月21日
输入
文本
输出
音频
区域
International
端点
POST/v1/audio/speech
备用模型 ID
stepaudio-2.5-ttsstepfun/stepaudio-2-5-ttsstepfun/stepaudio-2.5-tts

StepAudio 2.5 TTS API 价格

来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。

类型
规格
价格
综述
每10,000字符
$0.85
在完整价格页比较

如何调用 StepAudio 2.5 TTS API

StepAudio 2.5 TTS 通过 POST /v1/audio/speech 生成语音并返回可播放的音频。把要朗读的文本作为 input,连同模型 ID stepaudio-2-5-tts 一起发送。 在EmpirioLabs 控制台获取 API 密钥。

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "stepaudio-2-5-tts",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "stepaudio-2-5-tts", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
StepAudio 2.5 TTS API 完整参考

StepAudio 2.5 TTS API 参数

EmpirioLabs 上 StepAudio 2.5 TTS API 支持的请求参数。省略字段时使用默认值。

参数类型默认值范围 / 值描述
inputstring-最大 1000文本要综合。最多1000字符。
voiceenumlively-girllively-girl, vibrant-youth, soft-spoken-gentleman, magnetic-v...Official StepFun voice. Custom cloned voice IDs are also accepted via the API.
response_formatenummp3mp3, wav, flac, opus, pcm输出音频格式。
speednumber10.5 到 2说话速度。
volumenumber10.1 到 2输出音量。
sample_rateenum240008000, 16000, 22050, 24000输出采样率以Hz为单位。
instructionstring-最大 200全局情感或风格指导。仅支持 StepAudio 2.5 TTS。
pronunciation_mapobject--可选发音映射。
markdown_filterbooleanfalse-在合成前过滤标记语法。

须知

最大输入是1000个字符。括号内的内容被视为指示,不被说出来。使用教学来指导整体情感或风格。StepAudio 2.5 TTS 不支持 voice_label。

StepAudio 2.5 TTS API:常见问题

StepAudio 2.5 TTS API 收费多少?

在 EmpirioLabs,StepAudio 2.5 TTS 按量计费:综述 $0.85 每10,000字符。本页的实时价格表始终与 API 的实际计费一致。

StepAudio 2.5 TTS 使用哪个端点?

StepAudio 2.5 TTS 通过 api.empiriolabs.ai 上的 POST /v1/audio/speech 提供,使用标准的 Bearer 令牌认证。

集成之前可以在浏览器里试用 StepAudio 2.5 TTS 吗?

可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 StepAudio 2.5 TTS,你可以在写代码之前先测试提示词。

如何获取 StepAudio 2.5 TTS API 密钥?

创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。

准备好使用更好的终端了吗?

查看我们的定价,或者如果你想将自己的模型部署到我们的堆栈中,请联系我们。