SoulX Podcast API

开源语音模型,用于长形,多语种播客对话,配有准语言控制(笑声,叹息)和零镜头语音克隆.

Soul AI Lab音频生成发布日期 2025年10月29日原生推理

关于 SoulX Podcast

开源语音模型,用于长形,多语种播客对话,配有准语言控制(笑声,叹息)和零镜头语音克隆.

也称为 Soul AI Lab SoulX Podcast

voice cloningmulti speakerdialectpodcast

SoulX Podcast 规格

模型 ID
soulx-podcast
提供方
Soul AI Lab
类别
音频生成
发布日期
2025年10月29日
输入
文本音频
输出
音频
端点
POST/v1/audio/speech
备用模型 ID
soul-ai-lab/soulx-podcast

SoulX Podcast API 价格

来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。

类型
规格
价格
基础
每1k个字符
$0.015
对话框
每1k个字符
$0.015
在完整价格页比较

如何调用 SoulX Podcast API

SoulX Podcast 通过 POST /v1/audio/speech 生成语音并返回可播放的音频。把要朗读的文本作为 input,连同模型 ID soulx-podcast 一起发送。 在EmpirioLabs 控制台获取 API 密钥。

cURL
curl https://api.empiriolabs.ai/v1/audio/speech \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "soulx-podcast",
    "input": "Welcome to EmpirioLabs. Your build just finished."
  }' \
  --output speech.mp3
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/speech",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={"model": "soulx-podcast", "input": "Welcome to EmpirioLabs."},
)
with open("speech.mp3", "wb") as f:
    f.write(response.content)
SoulX Podcast API 完整参考

SoulX Podcast API 参数

EmpirioLabs 上 SoulX Podcast API 支持的请求参数。省略字段时使用默认值。

参数类型默认值范围 / 值描述
inputstring--播客剧本。多扬声器使用[S1] / [S2] / [S3] / [S4] 标签或“Speaker N:”行。支持副语言标签:<|笑声|>,<|叹息|>,呼吸|<|>,<|咳嗽|>。
voice_modelenumbasebase, dialect基础:英语 + 普通话。方言:新增四川语、河南语和粤语。
voice_s1enumarthurarthur, james, lj, xiaomei, zhigang, custom_s1为[第一季]配音。lj = 艾玛。custom_s1需要voice_s1_audio_url。
voice_s2enumljarthur, james, lj, xiaomei, zhigang, custom_s2为[第二季]配音。lj = 艾玛。
voice_s3enumjamesarthur, james, lj, xiaomei, zhigang, custom_s3为[第三季]配音。
voice_s4enumxiaomeiarthur, james, lj, xiaomei, zhigang, custom_s4为[第四季]配音。
voice_s1_audio_urlstring--[S1] 自定义声音克隆的参考音频链接。发言人必须大声说出同意短语。
voice_s2_audio_urlstring--[S2] 自定义语音克隆的参考音频链接。
voice_s3_audio_urlstring--参考[S3]自定义声音克隆音频链接。
voice_s4_audio_urlstring--[S4] 自定义语音克隆的参考音频链接。
temperaturenumber0.60.1 到 2采样温度。
top_knumber1001 到 500顶K采样上限。
top_pnumber0.90.1 到 1核采样。
repetition_penaltynumber1.251 到 2高数值则避免重复表达。
文档中还有 3 个参数

须知

开源语音模型,用于长形,多语种播客对话,配有准语言控制和零镜头语音克隆.

SoulX Podcast API:常见问题

SoulX Podcast API 收费多少?

在 EmpirioLabs,SoulX Podcast 按量计费:基础 $0.015 每1k个字符; 对话框 $0.015 每1k个字符。本页的实时价格表始终与 API 的实际计费一致。

SoulX Podcast 使用哪个端点?

SoulX Podcast 通过 api.empiriolabs.ai 上的 POST /v1/audio/speech 提供,使用标准的 Bearer 令牌认证。

集成之前可以在浏览器里试用 SoulX Podcast 吗?

可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 SoulX Podcast,你可以在写代码之前先测试提示词。

如何获取 SoulX Podcast API 密钥?

创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。

准备好使用更好的终端了吗?

查看我们的定价,或者如果你想将自己的模型部署到我们的堆栈中,请联系我们。