
Modèle de génération musicale open source pour l’audio guidé par text-to-song et paroles, avec une inférence XL Turbo rapide en 8 étapes pour une itération contrôlable des chansons.
Modèle de génération musicale open source pour l’audio guidé par text-to-song et paroles, avec une inférence XL Turbo rapide en 8 étapes pour une itération contrôlable des chansons.
Aussi connu sous le nom ACE-Step-1.5-XL, ace-step-1-5-xl
ace-step-1-5-xl/v1/audio/generationsace-step-1.5-xlace-step/acestep-v15-xl-turboTarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.
ACE-Step 1.5 XL fonctionne via POST /v1/audio/generations. La requête renvoie immédiatement un job_id ; interrogez GET /v1/jobs/{job_id} jusqu'à la fin du job et lisez les URLs de sortie dans le résultat. Obtenez une clé API depuis le tableau de bord EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "ace-step-1-5-xl",
"prompt": "Describe what you want ACE-Step 1.5 XL to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "ace-step-1-5-xl",
"prompt": "Describe what you want ACE-Step 1.5 XL to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Paramètres de requête pris en charge par l'API ACE-Step 1.5 XL sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.
| Paramètre | Type | Par défaut | Plage / valeurs | Description |
|---|---|---|---|---|
| prompt | string | - | - | Le genre, l’ambiance, l’instrumentation et les indices BPM décrivent la musique à composer. Les balises séparées par virgules fonctionnent bien. |
| lyrics | string | - | - | Paroles vocales du morceau. Utilisez les tags [couplet] / [refrain] / [pont] pour marquer les sections, ligne blanche pour la pause instrumentale. Laissez vide pour... |
| audio_duration | number | 30 | 10 à 240 | Longueur de la piste générée en secondes. Le modèle est le plus fiable jusqu’à ~4 minutes; les durées plus longues risquent OOM/quality des chutes lors de la diffusion. |
| num_inference_steps | integer | 8 | 1 à 20 | Nombre d’étapes de diffusion. 8 est le point idéal recommandé pour la version Turbo; Augmentez pour plus de polissage, plus bas pour des générations de tirage moins... |
| guidance_scale | number | 1 | 0 à 20 | Échelle de guidage sans classificateurs. 1.0 suit la distribution naturelle du modèle; des valeurs plus élevées se rapprochent de la consigne au détriment de la variété. |
| shift | number | - | - | Décalage du pas de temps de diffusion. Par défaut, le planning reste inchangé; Poussez à 1,0+ pour shorter/punchier ou en dessous de 1,0 pour slower/dreamier résultats. |
| negative_prompt | string | - | - | Prompt négatif, anti-tags, anti-styles, instruments à exclure. Même style de type séparé par virgules que le prompt. |
| seed | integer | - | - | Graines aléatoires pour la reproductibilité. Même seed + params identiques produisent la même piste. |
| format | enum | flac | flac, wav, ogg, mp3 | Format conteneur audio pour la réponse. FLAC = sans perte, WAV = non compressé, MP3 = petite taille de fichier. |
| response_format | enum | url | url, b64_json | Comment l’ouvrier rend l’audio. « url » renvoie une URL signée au fichier rendu; 'base64' inligne les octets dans la réponse. |
| return_base64 | boolean | false | - | Lorsque c’est vrai, la réponse inclut l’audio rendu en base64 en plus (ou à la place, selon response_format) de l’URL. |
Paramètres par défaut - 8 étapes d’inférence - Échelle de guidage 1.0 - Sortie FLAC sans perte Contrôles Prend en charge les paroles, prompt/description, la durée de 10-600 secondes, la graine, le décalage, l’invite négative optionnelle lorsque prise en charge par le pipeline épinglé, ainsi que le mode URL ou sortie base64.
Sur EmpirioLabs, ACE-Step 1.5 XL est facturé à l'usage. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.
ACE-Step 1.5 XL est servi via POST /v1/audio/generations sur api.empiriolabs.ai avec une authentification standard par token Bearer.
Oui. Le playground EmpirioLabs exécute ACE-Step 1.5 XL dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.
Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.
Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.