Stable Audio 2.0 API

从文本提示生成最多3分钟的音频,支持 text-to-audio 和 audio-to-audio,具有可调整的持续时间,步骤,和CFG比例.

Stability AI音频生成发布日期 2024年4月3日专有端点

关于 Stable Audio 2.0

从文本提示生成最多3分钟的音频,支持 text-to-audio 和 audio-to-audio,具有可调整的持续时间,步骤,和CFG比例.

也称为 Stable Audio, Stability AI Stable Audio 2.0, Stable-Audio-2.0, stable-audio-2-0

music generationtext to audiosound effects

Stable Audio 2.0 规格

模型 ID
stable-audio-2-0
提供方
Stability AI
类别
音频生成
发布日期
2024年4月3日
输入
文本
输出
音频
端点
POST/v1/audio/generations
备用模型 ID
stability-audio-2.0stability/audio-2.0

Stable Audio 2.0 API 价格

来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。

类型
规格
价格
基本费用
每代人数
$0.58
每步成本
每个步骤
$0.00
在完整价格页比较

如何调用 Stable Audio 2.0 API

Stable Audio 2.0 通过 POST /v1/audio/generations 运行。请求会立即返回 job_id;轮询 GET /v1/jobs/{job_id} 直到任务完成,再从结果中读取输出 URL。 在EmpirioLabs 控制台获取 API 密钥。

cURL:提交任务
curl https://api.empiriolabs.ai/v1/audio/generations \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "stable-audio-2-0",
    "prompt": "Describe what you want Stable Audio 2.0 to generate."
  }'
cURL:轮询结果
curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY"
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/generations",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={
        "model": "stable-audio-2-0",
        "prompt": "Describe what you want Stable Audio 2.0 to generate.",
    },
)
job = response.json()

# Generation runs as an async job. Poll until it completes.
import time
while True:
    status = requests.get(
        f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
        headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    ).json()
    if status.get("status") in ("completed", "failed"):
        print(status)
        break
    time.sleep(5)
Stable Audio 2.0 API 完整参考

Stable Audio 2.0 API 参数

EmpirioLabs 上 Stable Audio 2.0 API 支持的请求参数。省略字段时使用默认值。

参数类型默认值范围 / 值描述
promptstring--生成什么。具体说明曲风、乐器、氛围和速度。
modeenumtext-to-audiotext-to-audio, audio-to-audiotext-to-audio:仅凭提示生成。audio-to-audio:对参考片段进行条件。
output_formatenummp3mp3, wav输出媒体文件格式(mp3、wav、mp4、png、jpg 等,取决于终端)。
durationnumber1901 到 190秒钟。Stability Audio 2.0 可生成最长 3 分 10 秒的时长。
stepsnumber5030 到 100扩散步骤。More = 更高的保真度,速度较慢(并增加每步信用额度)。
cfg_scalenumber71 到 25无分类器指导。更高 = 更严格地跟随提示。
strengthnumber10 到 1只能音频对音频。0 = 忽略参考,1 = 保持靠近参考。
random_seedbooleantrue-如果是真的,每次调用都用随机种子。
seednumber--可重复性种子。仅在 random_seed=false 时使用。
audio_urlstring--请参考 audio-to-audio 模式的音频链接。

须知

从文本或通过 audio-to-audio 转换生成最多3分钟的音频. Audio-to-Audio模式 - 要求两个音频文件及时上传 - 建议的CFG比例:7-15 - 建议的步骤:6-8 - 典型强度:0.3-0.7

Stable Audio 2.0 API:常见问题

Stable Audio 2.0 API 收费多少?

在 EmpirioLabs,Stable Audio 2.0 按量计费:基本费用 $0.58 每代人数; 每步成本 $0.00 每个步骤。本页的实时价格表始终与 API 的实际计费一致。

Stable Audio 2.0 使用哪个端点?

Stable Audio 2.0 通过 api.empiriolabs.ai 上的 POST /v1/audio/generations 提供,使用标准的 Bearer 令牌认证。

集成之前可以在浏览器里试用 Stable Audio 2.0 吗?

可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 Stable Audio 2.0,你可以在写代码之前先测试提示词。

如何获取 Stable Audio 2.0 API 密钥?

创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。

准备好使用更好的终端了吗?

查看我们的定价,或者如果你想将自己的模型部署到我们的堆栈中,请联系我们。