帧同步的音轨直接从视频生成,或音乐由文本提示生成,具有每段方向和主干分隔。
sonilo-v1-1/v1/audio/generationssonilo-v1.1sonilo/v1.1sonilo-musicsonilo/sonilo-v1-1来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
Sonilo v1.1 通过 POST /v1/audio/generations 运行。请求会立即返回 job_id;轮询 GET /v1/jobs/{job_id} 直到任务完成,再从结果中读取输出 URL。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "sonilo-v1-1",
"prompt": "Describe what you want Sonilo v1.1 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "sonilo-v1-1",
"prompt": "Describe what you want Sonilo v1.1 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs 上 Sonilo v1.1 API 支持的请求参数。省略字段时使用默认值。
| 参数 | 类型 | 默认值 | 范围 / 值 | 描述 |
|---|---|---|---|---|
| prompt | string | - | - | 音乐的风格或创意方向。仅由文本生成时必修。视频配乐时可选,视频引导。 |
| mode | enum | auto | auto, text, video | 自动给附加视频评分,没有视频时则切换回文字与音乐。设置文本或视频来固定行为。 |
| duration | number | - | 5 到 360 | 轨道长度以秒为单位。仅限文本模式。视频模式下,轨道长度与源视频相同。保持空格,让提示词自行决定。 |
| output_format | enum | m4a | m4a, wav, mp3 | 已交付的音频格式。m4a是AAC,wav是16位PCM,mp3是320 kbps。 |
| variants_num | number | 1 | 1 到 10 | 一个请求需要生成多少不同的音乐方向。每个变体按每秒速率单独计费,且每个变体都适用10秒的最低限度。 |
| stems | boolean | false | - | 还要返回生成的轨道,分为鼓、贝斯、人声和其他部分。这样不加费用,还能多花几分钟等待时间。 |
| ducking | boolean | false | - | 还要回放一段带音乐的录音,音乐浸在原视频的语音下,这样对话就更清晰。这样不会额外收费。 |
| preserve_speech | boolean | false | - | 保留源视频的语音,并返回单独的声音和混音轨和音乐。 |
| prompt_influence | number | 0.5 | 0 到 1 | 音乐对提示的遵循程度,而不是跟随画面。低是视频引导,高是更字面地跟随提示。不加任何费用。 |
| segments | string | - | - | JSON数组的计时片段提示,针对每个场景方向。每个条目开始、结束和提示只需几秒钟。 |
| video_url | string | - | - | 视频来源以评分,作为公开可访问的URL。最大300MB,时长6分钟。上传视频后playground会帮你设置好这个。 |
模式 - 自动评分附加视频,无视频时回归文本转音乐 - 视频模式遵循源素材的剪辑和节奏 - 文本模式仅由提示生成 控制 支持提示、模式、源视频,文本模式时长5至360秒,m4a、wav或mp3输出、1至10种变体,干分隔、低头、语音保留、提示影响和JSON片段提示。限制 - 源视频最大300MB且时长6分钟 - 文本模式下时长5至360秒。视频模式按源长度调整 - 低头、语音保留和提示影响仅适用于视频模式 计费 - 按目录费率按生成秒计费,每轨最低计费10秒。4秒轨道计费10秒。- 每个变体单独计费,且每个变体适用10秒的最低计费时间。- 茎分开、蹲下和及时影响不计费。- 发电前拒绝的请求不计费。
在 EmpirioLabs,Sonilo v1.1 按量计费:文本与音乐 $0.0045 每生成秒; 视频与音乐 $0.018 每生成秒。本页的实时价格表始终与 API 的实际计费一致。
Sonilo v1.1 通过 api.empiriolabs.ai 上的 POST /v1/audio/generations 提供,使用标准的 Bearer 令牌认证。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 Sonilo v1.1,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。