
Generación de texto a vídeo, image-to-video y reference-to-video con hasta siete imágenes de referencia para caracteres consistentes, hasta 15 segundos a 1080p.
Generación de texto a vídeo, image-to-video y reference-to-video con hasta siete imágenes de referencia para caracteres consistentes, hasta 15 segundos a 1080p.
También conocido como Grok Imagine Video, xAI Grok Imagine Video 1.5
grok-imagine-video-1-5/v1/videos/generationsgrok-imagine-video-1.5xai/grok-imagine-video-1-5xai/grok-imagine-video-1.5Tarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.
Grok Imagine Video 1.5 funciona a través de POST /v1/videos/generations. La solicitud devuelve un job_id de inmediato; consulta GET /v1/jobs/{job_id} hasta que el trabajo termine y lee las URLs de salida del resultado. Consigue una clave de API en el panel de EmpirioLabs.
curl https://api.empiriolabs.ai/v1/videos/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-imagine-video-1-5",
"prompt": "Describe what you want Grok Imagine Video 1.5 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/videos/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "grok-imagine-video-1-5",
"prompt": "Describe what you want Grok Imagine Video 1.5 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Parámetros de solicitud compatibles con la API de Grok Imagine Video 1.5 en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.
| Parámetro | Tipo | Predeterminado | Rango / valores | Descripción |
|---|---|---|---|---|
| prompt | string | - | - | Describe la escena, el movimiento y la acción que debes generar. |
| mode | enum | auto | auto, t2v, i2v, r2v | Detecta automáticamente de los archivos adjuntos. T2V: text-to-video. i2v: Anima una imagen. R2V: reference-to-video de hasta 7 imágenes. |
| image | string | - | - | URL de la imagen o subir. Opcional: una imagen para image-to-video, hasta 7 para reference-to-video. Déjalo vacío para text-to-video. |
| duration | number | 10 | 1 a 15 | Duración del vídeo generado en segundos. |
| resolution | enum | 720p | 480p, 720p, 1080p | Resolución de salida. 480p se renderiza más rápido, 1080p es la definición más alta. La referencia a vídeo soporta hasta 720p. |
| aspect_ratio | enum | - | 1:1, 16:9, 9:16, 4:3, 3:4, 3:2, 2:3 | Relación de aspecto de salida. Por defecto se ajusta a la relación de aspecto de la imagen original para image-to-video, de lo contrario 16:9. |
| reference_images | string | - | - | URLs de imagen separadas por comas para reference-to-video (hasta 7). Alternativa a subir imágenes. |
Genera vídeo a partir de un prompt de texto por sí solo, a partir de una imagen fuente o a partir de hasta siete imágenes de referencia que mantienen caracteres y objetos consistentes a lo largo de la toma. Modos - Texto a vídeo: envía un prompt sin imagen. - Imagen a vídeo: añade una imagen y se convierte en el fotograma inicial. - Referencia al vídeo: añadir dos o más imágenes (hasta siete) para llevar a sus sujetos a una nueva escena. Etiquétalos en el prompt <IMAGE_1>como, <IMAGE_2>, y así sucesivamente. Ejemplo reference-to-video prompt '' <IMAGE_1> and <IMAGE_2> walking together through a neon-lit street at night. '' El modo se detecta por lo que envías y puede configurarse explícitamente con el parámetro de modo. Valores predeterminados - Duración de 10 segundos (1 a 15 segundos soportados) - Salida 720p (480p, 720p o 1080p) - La relación de aspecto sigue la imagen fuente para image-to-video, de lo contrario, 16:9 Resolución 1080p está disponible para text-to-video y image-to-video. La referencia a vídeo soporta hasta 720p. Controls Soporta prompt, modo, imagen fuente o imágenes de referencia (URL o subida), duración, resolución y relación de aspecto. Facturación - Se cobra por segundo de vídeo generado a la resolución seleccionada (las resoluciones más altas cuestan más por segundo), más una tarifa por imagen por cada imagen que proporciones. El texto a vídeo no tiene cuota por imagen. - No se factura una solicitud que falla en la validación o que se emita errores antes de que se produzca cualquier vídeo. - Un vídeo que se produce pero luego es bloqueado por la política de contenido sigue siendo facturado. Esto sigue la política de uso de xAI, que cobra por la generación incluso cuando la salida está bloqueada por la comprobación de seguridad de contenido. Mantén los prompts y las imágenes de las fuentes dentro de la política de uso para evitar esto.
En EmpirioLabs, Grok Imagine Video 1.5 se factura por uso: 480p $0.096 por segundo; 720p $0.168 por segundo; 1080p $0.300 por segundo. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.
Grok Imagine Video 1.5 se sirve a través de POST /v1/videos/generations en api.empiriolabs.ai con autenticación estándar de token Bearer.
Sí. El playground de EmpirioLabs ejecuta Grok Imagine Video 1.5 en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.
Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.