
text-to-audio 、 audio-to-audio 、音楽制作、サウンドデザイン、リミックスのためのオーディオインペレーション
text-to-audio 、 audio-to-audio 、音楽制作、サウンドデザイン、リミックスのためのオーディオインペレーション
別名 Stable Audio, Stability AI Stable Audio 2.5, Stable-Audio-2.5, stable-audio-2-5
stable-audio-2-5/v1/audio/generationsstability-audio-2.5stability/audio-2.5EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。
Stable Audio 2.5 は POST /v1/audio/generations で動作します。リクエストはすぐに job_id を返すので、ジョブが完了するまで GET /v1/jobs/{job_id} をポーリングし、結果から出力 URL を読み取ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stable-audio-2-5",
"prompt": "Describe what you want Stable Audio 2.5 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "stable-audio-2-5",
"prompt": "Describe what you want Stable Audio 2.5 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs 上の Stable Audio 2.5 API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。
| パラメータ | タイプ | デフォルト | 範囲 / 値 | 説明 |
|---|---|---|---|---|
| prompt | string | - | - | 何を生成するか。 |
| mode | enum | text-to-audio | text-to-audio, audio-to-audio, audio-inpaint | Audio-Inpaintは既存のクリップの[mask_start、mask_end]ウィンドウを再生し、残りは保持します。 |
| output_format | enum | mp3 | mp3, wav | 出力メディアファイル形式(mp3、wav、mp4、png、jpgなど、エンドポイントによって異なります)。 |
| duration | number | 190 | 1 から 190 | 秒単位。最大で3分10秒。 |
| steps | number | 8 | 4 から 8 | 拡散ステップ。2.5リッターターボモデルは非常に低ステップ数にチューニングされています。 |
| cfg_scale | number | 1 | 1 から 25 | 分類器不要のガイダンス。ターボモデルはデフォルトで小型CFGを使用しています。 |
| strength | number | 0.5 | 0.01 から 1 | 音声間のみ。0.01 = 参照を無視、1 = 参照に近づく。 |
| mask_start | number | - | 0 から 190 | インペイントウィンドウスタート(数秒)。オーディオインペイントには必須です。 |
| mask_end | number | - | 0 から 190 | インペイントウィンドウの終わり(秒数間)。オーディオインペイントには必須です。 |
| random_seed | boolean | true | - | もしそうなら、毎回ランダムなシードを使ってください。 |
| seed | number | - | - | 再現性シード。random_seed=falseの場合にのみ使用されます。 |
| audio_url | string | - | - | audio-to-audio/インペイントの音声URLを参照してください。 |
audio-inpaint モード (タイムウィンドウを生成) を安定したオーディオ 2.0 の上に追加します。 モードの要件 - オーディオツーオーディオとオーディオインペイントの両方は、BOTHをプロンプトとアップロードされたオーディオファイルが必要です - オーディオツーオーディオは、 style/conditioning 、音声クローニングには使用していません
EmpirioLabs では Stable Audio 2.5 は従量課金です: ジェネレーション $0.68 世代別。このページのライブ料金表は常に API の請求額と一致します。
Stable Audio 2.5 は api.empiriolabs.ai 上の POST /v1/audio/generations で提供され、標準的な Bearer トークン認証を使用します。
はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで Stable Audio 2.5 をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。
EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。