根据风格描述创作完整歌曲,包括人声、编曲和混音,或器乐曲和翻唱。
生成是异步的,通常需要几十秒到几分钟不等。
也称为 StepFun StepAudio 3 Music
stepaudio-3-music/v1/audio/generationsstepaudio-3-music-previewstepfun/stepaudio-3-music来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
StepAudio 3 Music 通过 POST /v1/audio/generations 运行。请求会立即返回 job_id;轮询 GET /v1/jobs/{job_id} 直到任务完成,再从结果中读取输出 URL。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stepaudio-3-music",
"prompt": "Describe what you want StepAudio 3 Music to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "stepaudio-3-music",
"prompt": "Describe what you want StepAudio 3 Music to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs 上 StepAudio 3 Music API 支持的请求参数。省略字段时使用默认值。
| 参数 | 类型 | 默认值 | 范围 / 值 | 描述 |
|---|---|---|---|---|
| prompt | string | - | - | 风格描述:曲风、主唱、氛围、乐器和调性。 |
| lyrics | string | - | - | 可选歌词。像[Verse]、[Chorus]和[Outro]这样的段落标签塑造了结构。空白时,模特会写下这些标签。翻唱或人声编排必备。 |
| task | enum | text_to_music | text_to_music, music_cover, vocal_to_music | 写一首新歌,翻唱一首参考歌曲,或者围绕干嗓音构建编曲。 |
| instrumental | boolean | false | - | 生成一首没有人声的曲目。不能与歌词组合。 |
| song_audio | string | - | - | Base64参考歌曲。翻唱必备曲目。 |
| vocal_audio | string | - | - | Base64干声,无伴奏。人声编排必备。 |
| response_format | enum | mp3 | mp3, wav, flac, opus, pcm | 输出音频格式。 |
| temperature | number | 0.85 | 0.01 到 2 | 采样温度。温度越高,变化越大。 |
| top_p | number | 0.92 | 0 到 1 | 核抽样概率质量。 |
| lyrics_rewrite | boolean | false | - | 让模特重新写你提供的歌词。 |
描述风格,模特负责创作并演唱完整歌曲。提供歌词或让模特写歌词,为无人声的曲目设置器乐曲,或附加参考歌曲作为翻唱或干唱,以构建编曲。段落标签如[主歌]、[副歌]和[尾声]塑造结构。输出长度由模型决定,通常为一到三分钟,因此不由参数决定,且同一提示的两次播放可能不同。计费遵循生成长度。器乐和歌词不可组合。该模型处于预览阶段,其功能可能会有所变化。
在 EmpirioLabs,StepAudio 3 Music 按量计费:音乐生成 $0.0018 每生成秒。本页的实时价格表始终与 API 的实际计费一致。
StepAudio 3 Music 通过 api.empiriolabs.ai 上的 POST /v1/audio/generations 提供,使用标准的 Bearer 令牌认证。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 StepAudio 3 Music,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。