
Genera audio de hasta 3 minutos a partir de indicaciones de texto, soportando text-to-audio y audio-to-audio con duración, pasos y escala CFG ajustables.
Genera audio de hasta 3 minutos a partir de indicaciones de texto, soportando text-to-audio y audio-to-audio con duración, pasos y escala CFG ajustables.
También conocido como Stable Audio, Stability AI Stable Audio 2.0, Stable-Audio-2.0, stable-audio-2-0
stable-audio-2-0/v1/audio/generationsstability-audio-2.0stability/audio-2.0Tarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.
Stable Audio 2.0 funciona a través de POST /v1/audio/generations. La solicitud devuelve un job_id de inmediato; consulta GET /v1/jobs/{job_id} hasta que el trabajo termine y lee las URLs de salida del resultado. Consigue una clave de API en el panel de EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "stable-audio-2-0",
"prompt": "Describe what you want Stable Audio 2.0 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "stable-audio-2-0",
"prompt": "Describe what you want Stable Audio 2.0 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Parámetros de solicitud compatibles con la API de Stable Audio 2.0 en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.
| Parámetro | Tipo | Predeterminado | Rango / valores | Descripción |
|---|---|---|---|---|
| prompt | string | - | - | Qué generar. Sé específico sobre el género, los instrumentos, el estado de ánimo y el tempo. |
| mode | enum | text-to-audio | text-to-audio, audio-to-audio | text-to-audio: generar solo desde el prompt. audio-to-audio: condición en un clip de referencia. |
| output_format | enum | mp3 | mp3, wav | Formato de archivo multimedia de salida (mp3, wav, mp4, png, jpg, etc., dependiendo del punto final). |
| duration | number | 190 | 1 a 190 | Segundos. Stability Audio 2.0 genera hasta 3 minutos y 10 segundos. |
| steps | number | 50 | 30 a 100 | Pasos de difusión. Más = mayor fidelidad, más lento (y añade créditos por paso). |
| cfg_scale | number | 7 | 1 a 25 | Guía sin clasificador. Más alto = sigue el prompt de forma más estricta. |
| strength | number | 1 | 0 a 1 | Solo audio a audio. 0 = ignorar referencia, 1 = permanecer cerca de la referencia. |
| random_seed | boolean | true | - | Si es cierto, usa una semilla aleatoria en cada llamada. |
| seed | number | - | - | Semilla de reproducibilidad. Solo se usa cuando random_seed=falso. |
| audio_url | string | - | - | Consulta la URL de audio para el modo audio-to-audio. |
Genera hasta 3 minutos de audio a partir de texto o mediante transformación audio-to-audio. Modo de audio a audio - Requiere TANTO un prompt como un archivo de audio subido - Escala CFG recomendada: 7-15 - Pasos recomendados: 6-8 - Potencia típica: 0,3-0,7
En EmpirioLabs, Stable Audio 2.0 se factura por uso: Coste base $0.58 por generación; Coste por paso $0.00 por paso. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.
Stable Audio 2.0 se sirve a través de POST /v1/audio/generations en api.empiriolabs.ai con autenticación estándar de token Bearer.
Sí. El playground de EmpirioLabs ejecuta Stable Audio 2.0 en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.
Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.