
Alinea el movimiento de la boca en un vídeo existente con una pista de audio subida o con texto pronunciado por una de las catorce voces integradas.
Alinea el movimiento de la boca en un vídeo existente con una pista de audio subida o con texto pronunciado por una de las catorce voces integradas.
pixverse-lipsync/v1/videos/generationspixverse/lipsyncTarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.
Pixverse Lip Sync funciona a través de POST /v1/videos/generations. La solicitud devuelve un job_id de inmediato; consulta GET /v1/jobs/{job_id} hasta que el trabajo termine y lee las URLs de salida del resultado. Consigue una clave de API en el panel de EmpirioLabs.
curl https://api.empiriolabs.ai/v1/videos/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "pixverse-lipsync",
"prompt": "Describe what you want Pixverse Lip Sync to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/videos/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "pixverse-lipsync",
"prompt": "Describe what you want Pixverse Lip Sync to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Parámetros de solicitud compatibles con la API de Pixverse Lip Sync en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.
| Parámetro | Tipo | Predeterminado | Rango / valores | Descripción |
|---|---|---|---|---|
| lip_sync_tts_content | string | - | - | La frase para hablar. Se usa cuando no se adjunta ningún archivo de audio. Anunciado en bloques de 15 caracteres. |
| lip_sync_tts_speaker_id | enum | Auto | Auto, Emily, James, Isabella, Liam, Chloe, Adrian, Harper, Av... | Voz usada para la línea hablada. Automáticamente elige uno que se adapte al clip. Se ignora cuando se adjunta un archivo de audio. |
| video | string | - | - | URL del vídeo de origen. Obligatorio. |
| audio | string | - | - | URL de audio para hacer playback. Tiene prioridad sobre el texto hablado. |
Alinea el movimiento de la boca en un vídeo existente con el habla, ya sea desde un archivo de audio que proporcionas o desde el texto hablado por una voz incorporada. Entradas - video: el clip fuente, hasta 300 segundos y 250MB. - audio: la voz correspondiente, hasta 300 segundos y 250MB. - O lip_sync_tts_content con lip_sync_tts_speaker_id que el modelo reciba tu texto. Hay catorce voces con nombre disponibles más Auto, que elige una que se adapte al clip. Facturación - Facturado por segundo de habla. La entrada de texto a voz se mide en bloques de 15 caracteres a la misma velocidad, por lo que la carga sigue la duración del guion en lugar de la duración del vídeo original. Límites de entrada - Vídeo: MP4, MOV o WebM, hasta 1920px en el borde largo. - Audio: MP3, WAV, M4A o AAC.
En EmpirioLabs, Pixverse Lip Sync se factura por uso: Discurso $0.020444 por segundo. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.
Pixverse Lip Sync se sirve a través de POST /v1/videos/generations en api.empiriolabs.ai con autenticación estándar de token Bearer.
Sí. El playground de EmpirioLabs ejecuta Pixverse Lip Sync en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.
Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.