
Compone canciones completas a partir de una descripción de estilo, con voces, arreglos y mezclas, o instrumentales y versiones.
Compone canciones completas a partir de una descripción de estilo, con voces, arreglos y mezclas, o instrumentales y versiones.
La generación es asíncrona y suele durar desde decenas de segundos hasta unos pocos minutos.
También conocido como StepFun StepAudio 3 Music
stepaudio-3-music/v1/audio/generationsstepaudio-3-music-previewstepfun/stepaudio-3-musicTarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.
StepAudio 3 Music funciona a través de POST /v1/audio/generations. La solicitud devuelve un job_id de inmediato; consulta GET /v1/jobs/{job_id} hasta que el trabajo termine y lee las URLs de salida del resultado. Consigue una clave de API en el panel de EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stepaudio-3-music",
"prompt": "Describe what you want StepAudio 3 Music to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "stepaudio-3-music",
"prompt": "Describe what you want StepAudio 3 Music to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Parámetros de solicitud compatibles con la API de StepAudio 3 Music en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.
| Parámetro | Tipo | Predeterminado | Rango / valores | Descripción |
|---|---|---|---|---|
| prompt | string | - | - | Descripción del estilo: género, voz, ambiente, instrumentos y tonalidad. |
| lyrics | string | - | - | Letra opcional. Etiquetas de sección como [Verso], [Coro] y [Outro] moldean la estructura. Si quedan vacíos, el modelo las escribe. Requeridas para una versión o un... |
| task | enum | text_to_music | text_to_music, music_cover, vocal_to_music | Escribe una canción nueva, versiona una canción de referencia o construye un arreglo alrededor de una voz seca. |
| instrumental | boolean | false | - | Genera una pista sin voces. No se puede combinar con letras. |
| song_audio | string | - | - | Canción de referencia Base64. Requerida para una versión. |
| vocal_audio | string | - | - | Voz seca en Base64 sin acompañamiento. Necesario para un arreglo vocal. |
| response_format | enum | mp3 | mp3, wav, flac, opus, pcm | Formato de audio de salida. |
| temperature | number | 0.85 | 0.01 a 2 | Temperatura de muestreo. Cuanto más alta, más variado. |
| top_p | number | 0.92 | 0 a 1 | Masa de probabilidad de muestreo del núcleo. |
| lyrics_rewrite | boolean | false | - | Deja que el modelo reescriba las letras que has proporcionado. |
Describe el estilo y el modelo escribe y interpreta una canción completa. Proporciona la letra o deja que el modelo la escriba, pon instrumental para una pista sin voces, o adjunta una canción de referencia para una versión o una voz seca para construir un arreglo alrededor. Etiquetas de sección como [Verso], [Coro] y [Outro] moldean la estructura. La duración de salida la elige el modelo y normalmente es de uno a tres minutos, por lo que no está establecida por un parámetro y dos ejecuciones del mismo prompt pueden variar. La facturación sigue la duración generada. Instrumental y letra no pueden combinarse. Este modelo está en vista previa y sus capacidades pueden cambiar.
En EmpirioLabs, StepAudio 3 Music se factura por uso: Generación musical $0.0018 por segundo generado. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.
StepAudio 3 Music se sirve a través de POST /v1/audio/generations en api.empiriolabs.ai con autenticación estándar de token Bearer.
Sí. El playground de EmpirioLabs ejecuta StepAudio 3 Music en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.
Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.