
Modelo de geração de música de código aberto para text-to-song e áudio guiado por letras, com rápida inferência XL Turbo de 8 passos para iterações de músicas controláveis.
Modelo de geração de música de código aberto para text-to-song e áudio guiado por letras, com rápida inferência XL Turbo de 8 passos para iterações de músicas controláveis.
Também conhecido como ACE-Step-1.5-XL, ace-step-1-5-xl
ace-step-1-5-xl/v1/audio/generationsace-step-1.5-xlace-step/acestep-v15-xl-turboTarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
ACE-Step 1.5 XL roda por POST /v1/audio/generations. A requisição retorna um job_id na hora; consulte GET /v1/jobs/{job_id} até o job terminar e leia as URLs de saída do resultado. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "ace-step-1-5-xl",
"prompt": "Describe what you want ACE-Step 1.5 XL to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "ace-step-1-5-xl",
"prompt": "Describe what you want ACE-Step 1.5 XL to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Parâmetros de requisição suportados pela API ACE-Step 1.5 XL na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| prompt | string | - | - | Gênero, clima, instrumentação e pistas BPM descrevendo a música a ser compor. Etiquetas separadas por vírgulas funcionam bem. |
| lyrics | string | - | - | Letras vocais da faixa. Use tags [verso] / [refrão] / [ponte] para marcar seções, linha em branco para a pausa instrumental. Deixe em branco para faixas puramente... |
| audio_duration | number | 30 | 10 a 240 | Comprimento da trilha gerada em segundos. O modelo é mais confiável até ~4 minutos; durações mais longas correm OOM/quality quedas durante a difusão. |
| num_inference_steps | integer | 8 | 1 a 20 | Número de etapas de difusão. 8 é o ponto ideal recomendado para a variante Turbo; Aumente para mais polimento, mais baixo para gerações de tiragem mais baratas. |
| guidance_scale | number | 1 | 0 a 20 | Escala de orientação sem classificador. 1.0 segue a distribuição natural do modelo; valores mais altos se aproximam do prompt, mas isso custa variedade. |
| shift | number | - | - | Mudança do intervalo de tempo de difusão. O padrão mantém a programação inalterada; Avance para 1,0+ para shorter/punchier ou abaixo de 1,0 para slower/dreamier... |
| negative_prompt | string | - | - | Prompt negativo, anti-tags, anti-styles, instrumentos para excluir. Mesmo estilo separado por vírgulas do prompt. |
| seed | integer | - | - | Semente aleatória para reprodutibilidade. A mesma seed + parâmetros idênticos produz a mesma trilha. |
| format | enum | flac | flac, wav, ogg, mp3 | Formato de contêiner de áudio para a resposta. FLAC = sem perdas, WAV = não comprimido, MP3 = tamanho pequeno do arquivo. |
| response_format | enum | url | url, b64_json | Como o funcionário retorna o áudio. 'url' retorna uma URL assinada para o arquivo renderizado; 'base64' faz linha nos bytes da resposta. |
| return_base64 | boolean | false | - | Quando verdade, a resposta inclui o áudio renderizado como base64 além de (ou em vez de, dependendo do response_format) da URL. |
Padrões - 8 passos de inferência - Escala de orientação 1.0 - Saída FLAC sem perdas Controles Suporta letras, prompt/description, duração de 10-600s, semente, mudança, prompt negativo opcional quando suportado pelo pipeline fixado, e URL ou modo de saída base64.
Na EmpirioLabs, ACE-Step 1.5 XL é cobrado por uso. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
ACE-Step 1.5 XL é servido por POST /v1/audio/generations em api.empiriolabs.ai com autenticação padrão por token Bearer.
Sim. O playground da EmpirioLabs executa ACE-Step 1.5 XL no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.