
Text-zu-Video, image-to-video und reference-to-video Generation mit bis zu sieben Referenzbildern für konsistente Zeichen, bis zu 15 Sekunden bei 1080p.
Text-zu-Video, image-to-video und reference-to-video Generation mit bis zu sieben Referenzbildern für konsistente Zeichen, bis zu 15 Sekunden bei 1080p.
Auch bekannt als Grok Imagine Video, xAI Grok Imagine Video 1.5
grok-imagine-video-1-5/v1/videos/generationsgrok-imagine-video-1.5xai/grok-imagine-video-1-5xai/grok-imagine-video-1.5Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Grok Imagine Video 1.5 läuft über POST /v1/videos/generations. Der Request liefert sofort eine job_id; frage GET /v1/jobs/{job_id} ab, bis der Job abgeschlossen ist, und lies die Ausgabe-URLs aus dem Ergebnis. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/videos/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-imagine-video-1-5",
"prompt": "Describe what you want Grok Imagine Video 1.5 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/videos/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "grok-imagine-video-1-5",
"prompt": "Describe what you want Grok Imagine Video 1.5 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Request-Parameter, die die Grok Imagine Video 1.5 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| prompt | string | - | - | Beschreiben Sie die Szene, Bewegung und Aktion, die erzeugt werden sollen. |
| mode | enum | auto | auto, t2v, i2v, r2v | Automatisch erkennt man Anhänge. T2V: text-to-video. i2v: Animiere ein Bild. R2V: reference-to-video von bis zu 7 Bildern. |
| image | string | - | - | Bild-URL oder Upload. Optional: ein Bild für image-to-video, bis zu 7 für reference-to-video. Lass sie für text-to-video leer. |
| duration | number | 10 | 1 bis 15 | Länge des generierten Videos in Sekunden. |
| resolution | enum | 720p | 480p, 720p, 1080p | Ausgangsauflösung. 480p rendert am schnellsten, 1080p ist die höchste Auflösung. Referenz-zu-Video unterstützt bis zu 720p. |
| aspect_ratio | enum | - | 1:1, 16:9, 9:16, 4:3, 3:4, 3:2, 2:3 | Ausgabe-Seitenverhältnis. Standardmäßig ist das Bildformat für image-to-video Standard, ansonsten 16:9. |
| reference_images | string | - | - | Komma-getrennte Bild-URLs für reference-to-video (bis zu 7). Alternative zum Hochladen von Bildern. |
Erzeugt Video aus einem Textprompt einzeln, aus einem Quellbild oder aus bis zu sieben Referenzbildern, die Charaktere und Objekte über die gesamte Aufnahme hinweg konsistent halten. Modi - Text-zu-Video: Senden Sie einen Prompt ohne Bild. - Bild-zu-Video: Ein Bild hinzufügt und es wird zum Startbild. - Referenz-zu-Video: Fügen Sie zwei oder mehr Bilder (bis zu sieben) hinzu, um ihre Motive in eine neue Szene zu bringen. Markiere sie im Prompt als <IMAGE_1>, <IMAGE_2>, und so weiter. Beispiel reference-to-video Prompt '' <IMAGE_1> and <IMAGE_2> walking together through a neon-lit street at night. '' Der Modus wird von dem, was du sendest, erkannt und kann explizit mit dem Modusparameter eingestellt werden. Standardwert - 10 Sekunden Dauer (1 bis 15 Sekunden unterstützt) - 720p-Ausgabe (480p, 720p oder 1080p) - Das Seitenverhältnis folgt dem Quellbild für image-to-video, ansonsten ist 16:9 Auflösung 1080p für text-to-video und image-to-video verfügbar. Referenz-zu-Video unterstützt bis zu 720p. Steuerung Unterstützt Prompt, Modus, Quellbild oder Referenzbilder (URL oder Upload), Dauer, Auflösung und Seitenverhältnis. Abrechnung – Berechnet pro Sekunde erzeugtes Video in der gewählten Auflösung (höhere Auflösungen kosten mehr pro Sekunde), zuzüglich einer Bildgebühr für jedes von Ihnen bereitgestellte Bild. Text-zu-Video hat keine Bildgebühr. - Eine Anfrage, die die Validierung nicht besteht, oder Fehler vor der Produktion eines Videos nicht abgerechnet werden. - Ein Video, das produziert, aber dann durch Inhaltsrichtlinien blockiert wird, wird weiterhin abgerechnet. Dies folgt der xAI-Nutzungspolitik, die für die Erzeugung Gebühren berechnet, selbst wenn das Ergebnis durch die Inhaltssicherheitsprüfung blockiert wird. Speichern Sie Prompts und Quellbilder innerhalb der Nutzungsrichtlinien, um dies zu vermeiden.
Auf EmpirioLabs wird Grok Imagine Video 1.5 nach Verbrauch abgerechnet: 480p $0.096 pro Sekunde; 720p $0.168 pro Sekunde; 1080p $0.300 pro Sekunde. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Grok Imagine Video 1.5 wird über POST /v1/videos/generations auf api.empiriolabs.ai mit normaler Bearer-Token-Authentifizierung bereitgestellt.
Ja. Der EmpirioLabs Playground führt Grok Imagine Video 1.5 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.