
text-to-song および lyric-guided オーディオ用のオープンソースの音楽生成モデル、制御可能な曲反復のための高速な 8 ステップ XL ターボ推論。
text-to-song および lyric-guided オーディオ用のオープンソースの音楽生成モデル、制御可能な曲反復のための高速な 8 ステップ XL ターボ推論。
別名 ACE-Step-1.5-XL, ace-step-1-5-xl
ace-step-1-5-xl/v1/audio/generationsace-step-1.5-xlace-step/acestep-v15-xl-turboEmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。
ACE-Step 1.5 XL は POST /v1/audio/generations で動作します。リクエストはすぐに job_id を返すので、ジョブが完了するまで GET /v1/jobs/{job_id} をポーリングし、結果から出力 URL を読み取ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "ace-step-1-5-xl",
"prompt": "Describe what you want ACE-Step 1.5 XL to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "ace-step-1-5-xl",
"prompt": "Describe what you want ACE-Step 1.5 XL to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)EmpirioLabs 上の ACE-Step 1.5 XL API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。
| パラメータ | タイプ | デフォルト | 範囲 / 値 | 説明 |
|---|---|---|---|---|
| prompt | string | - | - | ジャンル、ムード、楽器編成、BPMが作曲すべき音楽のヒントを示唆しています。カンマ区切られたタグはよく機能します。 |
| lyrics | string | - | - | この曲のボーカルリリック。セクションは[ヴァース]/[コーラス]/[ブリッジ]タグで区切り、インストゥルメンタルブレイクは空欄で示します。純粋なインストゥルメンタルトラックは空欄にしてください。 |
| audio_duration | number | 30 | 10 から 240 | 生成されたトラックの長さを秒単位で計算します。このモデルは最大4~分までが最も信頼性が高いです。長時間は拡散時OOM/qualityドロップのリスクがあります。 |
| num_inference_steps | integer | 8 | 1 から 20 | 拡散ステップ数。ターボ仕様の推奨は8回転です。より磨き上げるなら上げ、低くして安価なドラフト世代を選びましょう。 |
| guidance_scale | number | 1 | 0 から 20 | 分類器なしのガイダンススケール。1.0はモデルの自然分布に従います。高い数値は、多様性を犠牲にしてプロンプトに近づきます。 |
| shift | number | - | - | 拡散タイムステップシフト。デフォルトではスケジュールは変更されず、shorter/punchierでは1.0+に、slower/dreamier結果は1.0以下に調整してください。 |
| negative_prompt | string | - | - | ネガティブプロンプト, アンチタグ、アンチスタイル、排除すべきツール。プロンプトと同じカンマ区切りのスタイルです。 |
| seed | integer | - | - | 再現性のためのランダムシード。同じシード+同一のパラメータでも同じトラックが生成されます。 |
| format | enum | flac | flac, wav, ogg, mp3 | 応答用の音声コンテナ形式。FLAC = ロスレス、WAV = 非圧縮、MP3 = 小さなファイルサイズ。 |
| response_format | enum | url | url, b64_json | 作業員がどのように音声を返すか。「url」はレンダリングされたファイルに対して署名付きURLを返します。「base64」は応答のバイトをインライン化します。 |
| return_base64 | boolean | false | - | もし真である場合、応答はレンダリングされた音声をURLに加えて(またはresponse_formatによっては代替)として含みます。 |
デフォルト - 8推論ステップ - ガイダンススケール1.0 - ロスレスFLAC出力コントロール ピン留めされたパイプライン、URL または base64 出力モードでサポートされている場合、 歌詞、 prompt/description 、10-600s の長さ、シード、シフト、オプションのマイナスプロンプトをサポートします。
EmpirioLabs では ACE-Step 1.5 XL は従量課金です。このページのライブ料金表は常に API の請求額と一致します。
ACE-Step 1.5 XL は api.empiriolabs.ai 上の POST /v1/audio/generations で提供され、標準的な Bearer トークン認証を使用します。
はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで ACE-Step 1.5 XL をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。
EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。