
上 to-3-minute 音频从文本中带 text-to-audio, audio-to-audio,以及用于音乐制作,音效设计,和重混的音频涂装.
上 to-3-minute 音频从文本中带 text-to-audio, audio-to-audio,以及用于音乐制作,音效设计,和重混的音频涂装.
也称为 Stable Audio, Stability AI Stable Audio 2.5, Stable-Audio-2.5, stable-audio-2-5
stable-audio-2-5/v1/audio/generationsstability-audio-2.5stability/audio-2.5来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
Stable Audio 2.5 通过 POST /v1/audio/generations 运行。请求会立即返回 job_id;轮询 GET /v1/jobs/{job_id} 直到任务完成,再从结果中读取输出 URL。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stable-audio-2-5",
"prompt": "Describe what you want Stable Audio 2.5 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "stable-audio-2-5",
"prompt": "Describe what you want Stable Audio 2.5 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs 上 Stable Audio 2.5 API 支持的请求参数。省略字段时使用默认值。
| 参数 | 类型 | 默认值 | 范围 / 值 | 描述 |
|---|---|---|---|---|
| prompt | string | - | - | 生成什么。 |
| mode | enum | text-to-audio | text-to-audio, audio-to-audio, audio-inpaint | Audio-inpaint 会重新生成一个 [mask_start, mask_end] 的现有片段窗口,同时保留其余部分。 |
| output_format | enum | mp3 | mp3, wav | 输出媒体文件格式(mp3、wav、mp4、png、jpg 等,取决于终端)。 |
| duration | number | 190 | 1 到 190 | 秒钟。最长3分10秒。 |
| steps | number | 8 | 4 到 8 | 扩散步骤。2.5升涡轮增压车型调校为非常低的步数。 |
| cfg_scale | number | 1 | 1 到 25 | 无分类器指导。涡轮车型默认使用小型CFG。 |
| strength | number | 0.5 | 0.01 到 1 | 只能音频对音频。0.01 = 忽略参考,1 = 保持靠近参考。 |
| mask_start | number | - | 0 到 190 | 涂漆窗口开始(秒数)。音频画版必备。 |
| mask_end | number | - | 0 到 190 | 涂漆窗口结束(秒数)。音频画版必备。 |
| random_seed | boolean | true | - | 如果是真的,每次调用都用随机种子。 |
| seed | number | - | - | 可重复性种子。仅在 random_seed=false 时使用。 |
| audio_url | string | - | - | 请参考audio-to-audio / inpaint 音频链接。 |
在 Stable Audio 2.0 上方添加 adio-inpaint 模式(重新生成一个时间窗口). 模式要求 - 音频对音频和音频对音频对音频都要求两个都有一个即时和上传音频文件 - 音频对音频对音频使用参考音频为 style/conditioning,不用于语音克隆
在 EmpirioLabs,Stable Audio 2.5 按量计费:生成 $0.68 每代人数。本页的实时价格表始终与 API 的实际计费一致。
Stable Audio 2.5 通过 api.empiriolabs.ai 上的 POST /v1/audio/generations 提供,使用标准的 Bearer 令牌认证。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 Stable Audio 2.5,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。