
Modelo de generación musical de código abierto para audio guiado por text-to-song y letras, con inferencia XL Turbo rápida de 8 pasos para iteraciones controlables de canciones.
Modelo de generación musical de código abierto para audio guiado por text-to-song y letras, con inferencia XL Turbo rápida de 8 pasos para iteraciones controlables de canciones.
También conocido como ACE-Step-1.5-XL, ace-step-1-5-xl
ace-step-1-5-xl/v1/audio/generationsace-step-1.5-xlace-step/acestep-v15-xl-turboTarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.
ACE-Step 1.5 XL funciona a través de POST /v1/audio/generations. La solicitud devuelve un job_id de inmediato; consulta GET /v1/jobs/{job_id} hasta que el trabajo termine y lee las URLs de salida del resultado. Consigue una clave de API en el panel de EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "ace-step-1-5-xl",
"prompt": "Describe what you want ACE-Step 1.5 XL to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "ace-step-1-5-xl",
"prompt": "Describe what you want ACE-Step 1.5 XL to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Parámetros de solicitud compatibles con la API de ACE-Step 1.5 XL en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.
| Parámetro | Tipo | Predeterminado | Rango / valores | Descripción |
|---|---|---|---|---|
| prompt | string | - | - | Género, ambiente, instrumentación y pistas BPM que describen la música a componer. Las etiquetas separadas por comas funcionan bien. |
| lyrics | string | - | - | Letras vocales para la canción. Usa etiquetas [verso] / [estribillo] / [puente] para marcar secciones, línea en blanco para el interrupción instrumental. Deja... |
| audio_duration | number | 30 | 10 a 240 | Longitud de la pista generada en segundos. El modelo es más fiable hasta ~4 minutos; Las duraciones más largas corren el riesgo de caídas OOM/quality durante la difusión. |
| num_inference_steps | integer | 8 | 1 a 20 | Número de pasos de difusión. 8 es el punto ideal recomendado para la variante Turbo; Sube para más pulido, baja para generaciones de tiro más baratas. |
| guidance_scale | number | 1 | 0 a 20 | Escala de guía sin clasificador. 1.0 sigue la distribución natural del modelo; los valores más altos se acercan más al prompt a costa de la variedad. |
| shift | number | - | - | Desplazamiento de paso temporal de difusión. Por defecto, el horario no cambia; Empuja a 1.0+ para shorter/punchier o por debajo de 1.0 para slower/dreamier resultados. |
| negative_prompt | string | - | - | Prompt negativo, anti-etiquetas, anti-estilos, instrumentos para excluir. Mismo estilo con comas separadas que el prompt. |
| seed | integer | - | - | Semilla aleatoria para la reproducibilidad. La misma semilla + parámetros idénticos produce la misma pista. |
| format | enum | flac | flac, wav, ogg, mp3 | Formato contenedor de audio para la respuesta. FLAC = sin pérdidas, WAV = sin comprimir, MP3 = tamaño de archivo pequeño. |
| response_format | enum | url | url, b64_json | Cómo el trabajador devuelve el audio. 'url' devuelve una URL firmada al archivo renderizado; 'base64' alinea los bytes en la respuesta. |
| return_base64 | boolean | false | - | Cuando es cierto, la respuesta incluye el audio renderizado como base64 además de (o en lugar de, dependiendo de response_format) la URL. |
Defaults - 8 pasos de inferencia - Escala de guía 1.0 - Salida FLAC sin pérdidas Controles Soporta letras, prompt/description, duración de 10-600s, semilla, desplazamiento, prompt negativo opcional cuando soportado por la tubería fijada, y modo URL o salida base64.
En EmpirioLabs, ACE-Step 1.5 XL se factura por uso. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.
ACE-Step 1.5 XL se sirve a través de POST /v1/audio/generations en api.empiriolabs.ai con autenticación estándar de token Bearer.
Sí. El playground de EmpirioLabs ejecuta ACE-Step 1.5 XL en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.
Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.