StepAudio 3 Music API

Compone canciones completas a partir de una descripción de estilo, con voces, arreglos y mezclas, o instrumentales y versiones.

StepFunGeneración de audioLanzado 8 sept 2026InternationalEndpoint propietarioNuevo

Acerca de StepAudio 3 Music

Compone canciones completas a partir de una descripción de estilo, con voces, arreglos y mezclas, o instrumentales y versiones.

La generación es asíncrona y suele durar desde decenas de segundos hasta unos pocos minutos.

También conocido como StepFun StepAudio 3 Music

music generationaudio generationaudio inmultilingual

Especificaciones de StepAudio 3 Music

ID del modelo
stepaudio-3-music
Autor
StepFun
Categoría
Generación de audio
Lanzado
8 sept 2026
Entrada
TextoAudio
Salida
Audio
Región
International
Endpoints
POST/v1/audio/generations
IDs de modelo alternativos
stepaudio-3-music-previewstepfun/stepaudio-3-music

Precios de la API de StepAudio 3 Music

Tarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.

Tipo
Especificación
Tarifa
Generación musical
por segundo generado
$0.0018
Comparar en la página completa de precios

Cómo llamar a la API de StepAudio 3 Music

StepAudio 3 Music funciona a través de POST /v1/audio/generations. La solicitud devuelve un job_id de inmediato; consulta GET /v1/jobs/{job_id} hasta que el trabajo termine y lee las URLs de salida del resultado. Consigue una clave de API en el panel de EmpirioLabs.

cURL: enviar el trabajo
curl https://api.empiriolabs.ai/v1/audio/generations \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "stepaudio-3-music",
    "prompt": "Describe what you want StepAudio 3 Music to generate."
  }'
cURL: consultar el resultado
curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY"
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/audio/generations",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={
        "model": "stepaudio-3-music",
        "prompt": "Describe what you want StepAudio 3 Music to generate.",
    },
)
job = response.json()

# Generation runs as an async job. Poll until it completes.
import time
while True:
    status = requests.get(
        f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
        headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    ).json()
    if status.get("status") in ("completed", "failed"):
        print(status)
        break
    time.sleep(5)
Referencia completa de la API de StepAudio 3 Music

Parámetros de la API de StepAudio 3 Music

Parámetros de solicitud compatibles con la API de StepAudio 3 Music en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.

ParámetroTipoPredeterminadoRango / valoresDescripción
promptstring--Descripción del estilo: género, voz, ambiente, instrumentos y tonalidad.
lyricsstring--Letra opcional. Etiquetas de sección como [Verso], [Coro] y [Outro] moldean la estructura. Si quedan vacíos, el modelo las escribe. Requeridas para una versión o un...
taskenumtext_to_musictext_to_music, music_cover, vocal_to_musicEscribe una canción nueva, versiona una canción de referencia o construye un arreglo alrededor de una voz seca.
instrumentalbooleanfalse-Genera una pista sin voces. No se puede combinar con letras.
song_audiostring--Canción de referencia Base64. Requerida para una versión.
vocal_audiostring--Voz seca en Base64 sin acompañamiento. Necesario para un arreglo vocal.
response_formatenummp3mp3, wav, flac, opus, pcmFormato de audio de salida.
temperaturenumber0.850.01 a 2Temperatura de muestreo. Cuanto más alta, más variado.
top_pnumber0.920 a 1Masa de probabilidad de muestreo del núcleo.
lyrics_rewritebooleanfalse-Deja que el modelo reescriba las letras que has proporcionado.

Información útil

Describe el estilo y el modelo escribe y interpreta una canción completa. Proporciona la letra o deja que el modelo la escriba, pon instrumental para una pista sin voces, o adjunta una canción de referencia para una versión o una voz seca para construir un arreglo alrededor. Etiquetas de sección como [Verso], [Coro] y [Outro] moldean la estructura. La duración de salida la elige el modelo y normalmente es de uno a tres minutos, por lo que no está establecida por un parámetro y dos ejecuciones del mismo prompt pueden variar. La facturación sigue la duración generada. Instrumental y letra no pueden combinarse. Este modelo está en vista previa y sus capacidades pueden cambiar.

API de StepAudio 3 Music: preguntas frecuentes

¿Cuánto cuesta la API de StepAudio 3 Music?

En EmpirioLabs, StepAudio 3 Music se factura por uso: Generación musical $0.0018 por segundo generado. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.

¿Qué endpoint usa StepAudio 3 Music?

StepAudio 3 Music se sirve a través de POST /v1/audio/generations en api.empiriolabs.ai con autenticación estándar de token Bearer.

¿Puedo probar StepAudio 3 Music en el navegador antes de integrar?

Sí. El playground de EmpirioLabs ejecuta StepAudio 3 Music en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.

¿Cómo consigo una clave de API de StepAudio 3 Music?

Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.

¿Listo para usar mejores endpoints?

Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.