Stable Audio 2.0 API

テキストプロンプトから最大3分の音声を生成し、 text-to-audio と audio-to-audio をサポートし、調整可能な時間、ステップ、および CFG スケールを伴います。

Stability AIオーディオ生成リリース 2024年4月3日独自エンドポイント

Stable Audio 2.0 について

テキストプロンプトから最大3分の音声を生成し、 text-to-audio と audio-to-audio をサポートし、調整可能な時間、ステップ、および CFG スケールを伴います。

別名 Stable Audio, Stability AI Stable Audio 2.0, Stable-Audio-2.0, stable-audio-2-0

music generationtext to audiosound effects

Stable Audio 2.0 の仕様

モデルID
stable-audio-2-0
プロバイダー
Stability AI
カテゴリ
オーディオ生成
リリース
2024年4月3日
入力
テキスト
出力
音声
エンドポイント
POST/v1/audio/generations
代替モデルID
stability-audio-2.0stability/audio-2.0

Stable Audio 2.0 API の料金

EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。

タイプ
仕様
料金
基礎コスト
世代別
$0.58
工程ごとの費用
1ステップ
$0.00
料金ページ全体で比較

Stable Audio 2.0 API の呼び出し方

Stable Audio 2.0 は POST /v1/audio/generations で動作します。リクエストはすぐに job_id を返すので、ジョブが完了するまで GET /v1/jobs/{job_id} をポーリングし、結果から出力 URL を読み取ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。

cURL: ジョブを送信
curl https://api.empiriolabs.ai/v1/audio/generations \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "stable-audio-2-0",
    "prompt": "Describe what you want Stable Audio 2.0 to generate."
  }'
cURL: 結果をポーリング
curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY"
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/generations",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={
        "model": "stable-audio-2-0",
        "prompt": "Describe what you want Stable Audio 2.0 to generate.",
    },
)
job = response.json()

# Generation runs as an async job. Poll until it completes.
import time
while True:
    status = requests.get(
        f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
        headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    ).json()
    if status.get("status") in ("completed", "failed"):
        print(status)
        break
    time.sleep(5)
Stable Audio 2.0 API の完全リファレンス

Stable Audio 2.0 API のパラメーター

EmpirioLabs 上の Stable Audio 2.0 API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。

パラメータタイプデフォルト範囲 / 値説明
promptstring--何を生成するか。ジャンル、楽器、ムード、テンポについて具体的に伝えましょう。
modeenumtext-to-audiotext-to-audio, audio-to-audiotext-to-audio:プロンプトのみで生成。audio-to-audio:参照クリップの条件付き。
output_formatenummp3mp3, wav出力メディアファイル形式(mp3、wav、mp4、png、jpgなど、エンドポイントによって異なります)。
durationnumber1901 から 190秒単位。Stability Audio 2.0は最大3分10秒の音程を生成します。
stepsnumber5030 から 100拡散ステップ。More = 高い忠実度、遅く(および1ステップあたりのクレジットが加算)。
cfg_scalenumber71 から 25分類器不要のガイダンス。Higher = より厳密にプロンプトに従う。
strengthnumber10 から 1音声間のみ。0 = 参照を無視、1 = 参照に近づく。
random_seedbooleantrue-もしそうなら、毎回ランダムなシードを使ってください。
seednumber--再現性シード。random_seed=falseの場合にのみ使用されます。
audio_urlstring--audio-to-audioモードの音声URLを参照してください。

知っておくと便利

テキストから、または audio-to-audio 変換を介して最大3分のオーディオを生成します。 オーディオツーオーディオモード - BOTHをプロンプトとアップロードされたオーディオファイル - 推奨CFGスケール:7-15 - 推奨ステップ:6-8 - 典型的な強度:0.3-0.7

Stable Audio 2.0 API: よくある質問

Stable Audio 2.0 API の料金はいくらですか?

EmpirioLabs では Stable Audio 2.0 は従量課金です: 基礎コスト $0.58 世代別; 工程ごとの費用 $0.00 1ステップ。このページのライブ料金表は常に API の請求額と一致します。

Stable Audio 2.0 はどのエンドポイントを使いますか?

Stable Audio 2.0 は api.empiriolabs.ai 上の POST /v1/audio/generations で提供され、標準的な Bearer トークン認証を使用します。

統合する前にブラウザで Stable Audio 2.0 を試せますか?

はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで Stable Audio 2.0 をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。

Stable Audio 2.0 の API キーはどうやって取得しますか?

EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。

より良いエンドポイントを使う準備はできていますか?

ご自身のモデルを当社のスタックに展開したい方は、ぜひご価格をご覧ください。