
Bandas sonoras sincronizadas por fotogramas generadas directamente a partir de vídeo, o música de un prompt de texto, con dirección por segmento y separación de tallos.
Bandas sonoras sincronizadas por fotogramas generadas directamente a partir de vídeo, o música de un prompt de texto, con dirección por segmento y separación de tallos.
sonilo-v1-1/v1/audio/generationssonilo-v1.1sonilo/v1.1sonilo-musicsonilo/sonilo-v1-1Tarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.
Sonilo v1.1 funciona a través de POST /v1/audio/generations. La solicitud devuelve un job_id de inmediato; consulta GET /v1/jobs/{job_id} hasta que el trabajo termine y lee las URLs de salida del resultado. Consigue una clave de API en el panel de EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "sonilo-v1-1",
"prompt": "Describe what you want Sonilo v1.1 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "sonilo-v1-1",
"prompt": "Describe what you want Sonilo v1.1 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Parámetros de solicitud compatibles con la API de Sonilo v1.1 en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.
| Parámetro | Tipo | Predeterminado | Rango / valores | Descripción |
|---|---|---|---|---|
| prompt | string | - | - | Estilo o dirección creativa para la música. Obligatorio al generar solo a partir de texto. Opcional al componer un vídeo, hacia dónde conduce el metraje. |
| mode | enum | auto | auto, text, video | Automáticamente graba un vídeo adjunto y vuelve a la música de texto cuando no hay vídeo. Configura texto o vídeo para fijar el comportamiento. |
| duration | number | - | 5 a 360 | Duración de la pista en segundos. Solo modo texto. En modo vídeo, la pista sigue la duración del vídeo original. Déjala vacía para que el prompt decida. |
| output_format | enum | m4a | m4a, wav, mp3 | Formato de audio entregado. M4A es AAC, WAV es PCM de 16 bits, mp3 es 320 kbps. |
| variants_num | number | 1 | 1 a 10 | ¿Cuántas direcciones musicales distintas generar en una sola petición? Cada variante se factura por separado a la tarifa por segundo, y el mínimo de 10 segundos se... |
| stems | boolean | false | - | También devuelvo la pista generada dividida en batería, bajo, voces y otros. No añade carga y añade unos minutos a la espera. |
| ducking | boolean | false | - | También devuelvo una toma con la música sumergida bajo el discurso del vídeo original para que el diálogo siga siendo inteligible. No añade carga. |
| preserve_speech | boolean | false | - | Mantén el habla del vídeo original y devuelvo la voz aislada más una pista mixta junto a la música. |
| prompt_influence | number | 0.5 | 0 a 1 | Qué intensidad sigue la música al prompt en lugar del metraje. Cuanto más abajo deja que el vídeo lidere, más arriba sigue el prompt más literalmente. No añade carga. |
| segments | string | - | - | Una serie JSON de indicaciones de segmento cronometrado para la dirección escena por escena. Cada entrada toma inicio, fin y prompt en segundos. |
| video_url | string | - | - | Vídeo de origen para puntuar, como una URL públicamente accesible. Hasta 300MB y 6 minutos. Subir un vídeo en la playground te lo determina. |
Modos - puntuación automática del vídeo adjunto y vuelve a texto a música cuando no hay vídeo - El modo vídeo sigue los cortes y ritmo del metraje original - El modo texto se genera solo con un prompt Controles Soporta prompt, modo, vídeo fuente, duración de 5 a 360 segundos en modo texto, salida m4a, wav o mp3, de 1 a 10 variantes, separación de tallos, ducking, preservación de voz, influencia de prompt y prompts de segmentos JSON. Limits - Vídeo fuente hasta 300MB y 6 minutos - Duración de 5 a 360 segundos en modo texto. El modo vídeo sigue la duración de la fuente - Ducking, preservación de voz e influencia de prompt se aplican solo al modo vídeo Facturación - Cobrado por segundo generado a la velocidad de catálogo, con un mínimo de 10 segundos por pista. Una pista de 4 segundos factura 10 segundos. - Cada variante se factura por separado y el mínimo de 10 segundos se aplica a cada una. - La separación del tallo, el ducking y la influencia rápida no añaden coste. - Una solicitud rechazada antes de la generación no se factura.
En EmpirioLabs, Sonilo v1.1 se factura por uso: De texto a música $0.0045 por segundo generado; De vídeo a música $0.018 por segundo generado. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.
Sonilo v1.1 se sirve a través de POST /v1/audio/generations en api.empiriolabs.ai con autenticación estándar de token Bearer.
Sí. El playground de EmpirioLabs ejecuta Sonilo v1.1 en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.
Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.