
Génération texte en vidéo, image-to-video et reference-to-video avec jusqu’à sept images de référence pour des caractères cohérents, jusqu’à 15 secondes en 1080p.
Génération texte en vidéo, image-to-video et reference-to-video avec jusqu’à sept images de référence pour des caractères cohérents, jusqu’à 15 secondes en 1080p.
Aussi connu sous le nom Grok Imagine Video, xAI Grok Imagine Video 1.5
grok-imagine-video-1-5/v1/videos/generationsgrok-imagine-video-1.5xai/grok-imagine-video-1-5xai/grok-imagine-video-1.5Tarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.
Grok Imagine Video 1.5 fonctionne via POST /v1/videos/generations. La requête renvoie immédiatement un job_id ; interrogez GET /v1/jobs/{job_id} jusqu'à la fin du job et lisez les URLs de sortie dans le résultat. Obtenez une clé API depuis le tableau de bord EmpirioLabs.
curl https://api.empiriolabs.ai/v1/videos/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-imagine-video-1-5",
"prompt": "Describe what you want Grok Imagine Video 1.5 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/videos/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "grok-imagine-video-1-5",
"prompt": "Describe what you want Grok Imagine Video 1.5 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Paramètres de requête pris en charge par l'API Grok Imagine Video 1.5 sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.
| Paramètre | Type | Par défaut | Plage / valeurs | Description |
|---|---|---|---|---|
| prompt | string | - | - | Décrivez la scène, le mouvement et l’action à générer. |
| mode | enum | auto | auto, t2v, i2v, r2v | Détecte automatiquement les pièces jointes. T2V: text-to-video. i2v: Animer une image. R2V: reference-to-video jusqu’à 7 images. |
| image | string | - | - | URL de l’image ou téléchargement. Optionnel: une image pour image-to-video, jusqu’à 7 pour reference-to-video. Laisse vide pour text-to-video. |
| duration | number | 10 | 1 à 15 | La durée de la vidéo générée en quelques secondes. |
| resolution | enum | 720p | 480p, 720p, 1080p | Résolution de sortie. Le 480p affiche le plus rapidement, le 1080p est la définition la plus élevée. La référence à la vidéo supporte jusqu’à 720p. |
| aspect_ratio | enum | - | 1:1, 16:9, 9:16, 4:3, 3:4, 3:2, 2:3 | Rapport d’aspect de sortie. Par défaut, le format d’image source est image-to-video, sinon 16:9. |
| reference_images | string | - | - | URL d’images séparées par virgules pour reference-to-video (jusqu’à 7). Alternative au téléchargement d’images. |
Génère une vidéo à partir d’une invite textuelle seule, d’une image source, ou jusqu’à sept images de référence qui maintiennent la cohérence des personnages et objets tout au long du plan. Modes - Texte en vidéo: envoyer une invite sans image. - Image à vidéo: ajoutez une image et elle devient l’image de départ. - Référence à la vidéo: ajouter deux images ou plus (jusqu’à sept) pour transporter leurs sujets dans une nouvelle scène. Identifiez-les dans l’invite <IMAGE_1>comme, <IMAGE_2>, et ainsi de suite. Exemple reference-to-video invite '' <IMAGE_1> and <IMAGE_2> walking together through a neon-lit street at night. '' Le mode est détecté à partir de ce que vous envoyez, et peut être défini explicitement avec le paramètre de mode. Par défaut - Durée de 10 secondes (1 à 15 secondes supportées) - Sortie 720p (480p, 720p ou 1080p) - Le format d’image suit l’image source pour image-to-video, sinon, une résolution 16:9 Résolution 1080p est disponible pour text-to-video et image-to-video. La référence à la vidéo supporte jusqu’à 720p. Contrôles Prend en charge l’invite, le mode, une image source ou des images de référence (URL ou téléversement), la durée, la résolution et le format d’aspect. Facturation - Facturée à la seconde de vidéo générée à la résolution sélectionnée (les résolutions plus élevées coûtent plus cher par seconde), plus un tarif par image pour chaque image fournie. Le texte en vidéo n’a pas de frais d’image. - Une requête qui échoue à la validation ou qui génère des erreurs avant la production d’une vidéo n’est pas facturée. - Une vidéo produite mais ensuite bloquée par la politique de contenu est toujours facturée. Cela suit la politique d’utilisation de xAI, qui facture la génération même lorsque la sortie est bloquée par le contrôle de sécurité du contenu. Gardez les invites et les images sources dans la politique d’utilisation pour éviter cela.
Sur EmpirioLabs, Grok Imagine Video 1.5 est facturé à l'usage : 480p $0.096 par seconde; 720p $0.168 par seconde; 1080p $0.300 par seconde. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.
Grok Imagine Video 1.5 est servi via POST /v1/videos/generations sur api.empiriolabs.ai avec une authentification standard par token Bearer.
Oui. Le playground EmpirioLabs exécute Grok Imagine Video 1.5 dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.
Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.
Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.