Grok Imagine Image 2.0 ist auf EmpirioLabs verfügbar. Das neueste Grok Imagine-Bildmodell von xAI generiert aus einem Textprompt und bearbeitet bis zu drei Quellbilder aus einer Klarsprache-Anweisung. Qualität und Auflösung sind beide wählbar, die Ausgabe läuft bis 2K, und es erreicht die gleichen OpenAI-kompatiblen Endpunkte, die du bereits für jedes andere Modell auf der Plattform nutzt.
Sehen Sie sich den Startfilm an
Jeder Frame ist eine echte Grok Imagine Image 2.0-Ausgabe. Der Score wurde von ACE-Step auf EmpirioLabs erstellt.
Was es unterstützt
Grok Imagine Image 2.0 nimmt Text und Bilder auf und schreibt Bilder aus. Es übernimmt drei Jobs aus einem Modell:
- Text-zu-Bild. Senden Sie einen Prompt ohne Bild.
- Bildbearbeitung. Füge ein Bild hinzu und beschreibe die gewünschte Veränderung.
- Multi-Bildbearbeitung. Fügen Sie zwei oder drei Bilder an, um Themen zu kombinieren, einen Stil zu übertragen oder eine Szene zu komponieren, und adressieren Sie sie im Prompt als <IMAGE_0>, <IMAGE_1>, und so weiter.
Die Typografie hält gut stand, was der Teil ist, den die meisten Bildmodelle immer noch falsch machen. Schilder, Poster und Produktetiketten zeigen die Worte, die Sie tatsächlich gebeten haben, statt eines plausibel aussehenden Kritzeleis.
Erzeugen Sie ein Bild
curl https://api.empiriolabs.ai/v1/images/generations \ -H "Autorisierung: Träger $EMPIRIOLABS_API_KEY" \ -H "Inhaltstyp: application/json" \ -d '{ "model": "grok-imagine-image-2-0", "prompt": "Ein Messingteleskop auf einem Holztisch neben einer gefalteten Sternenkarte, warmes Lampenlicht", "Qualität": "mittler", "Auflösung": "2k", "aspect_ratio": "16:9" }'
Der gleiche Aufruf vom OpenAI Python SDK verwies auf EmpirioLabs:
vom OpenAI-Import OpenAI-Client = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) Ergebnis = client.images.generate(model="grok-imagine-image-2-0", prompt="Ein Messingteleskop auf einem Holztisch neben einer gefalteten Sternkarte, warmes Lampenlicht", n=2,) für das Bild im Ergebnis. Daten: print(image.url)
Bearbeiten Sie ein Bild
Punkt /v1/images/edits auf einer öffentlichen URL, einer Daten-URI oder einem hochgeladenen Bild und beschreiben Sie die Änderung.
curl https://api.empiriolabs.ai/v1/images/edits \ -H "Autorisierung: Träger $EMPIRIOLABS_API_KEY" \ -H "Inhaltstyp: application/json" \ -d '{ "model": "grok-imagine-image-2-0", "prompt": "Rendere dies als detaillierte Bleistiftskizze mit Kreuzschraffur-Schattierung", "Bild": { "URL": "https://example.com/photo.jpg" } }'
Für ein Zusammenbild senden Sie den Plural Bilder Array und referenziere jede einzelne nach Index:
{ "model": "grok-imagine-image-2-0", "prompt": "Platziere das Produkt von <IMAGE_0> auf die Marmoroberfläche <IMAGE_1>in ", "images": [ { "url": "https://example.com/product.png" }, { "url": "https://example.com/counter.jpg" } ] }
Qualität und Auflösung
Zwei unabhängige Steuerungen prägen den Ausgang. Qualität ist Niedrig oder Medium, und auflösung ist 1k oder 2.000. Sie kombinieren sich zu vier Betriebspunkten, sodass du den auswählen kannst, der zum Job passt, anstatt Flaggschiff-Tarife für ein Thumbnail zu zahlen.
aspect_ratio umfasst vierzehn Verhältnisse aus 1:1 durch 20:9, plus Auto, wodurch das Modell die Form wählen kann, die zum Prompt passt. Bei einer Bearbeitung, Auto folgt dem ersten Quellbild.
Drei Dinge, die es wert sind, zu wissen
- Qualität ist eine Latenzkontrolle, nicht nur eine Qualitätskontrolle. Die schlechte Qualität kommt in wenigen Sekunden zurück. Mittel dauert deutlich länger, besonders bei 2K. Wenn du innerhalb einer benutzerorientierten Schleife generierst, ist Low oft der richtige Standard und Medium das bewusste Upgrade.
- Eine Bearbeitung stellt ihre Quellbilder in Rechnung. Jedes Bild, das Sie anhängen, trägt eine Gebühr pro Bild über dem Ausgabebild, zum gleichen Satz wie jedes xAI-Modell auf EmpirioLabs Quellbild, sodass ein Dreibild-Composite deutlich mehr kostet als eine einfache Generation. Text-zu-Bild hat überhaupt keine Quell-Bild-Ladung.
- Deine Bildlinks laufen nicht im Zeitplan einer anderen Person ab. Die eigenen Ausgabe-URLs des Anbieters sind nur von kurzer Dauer. EmpirioLabs hostet jedes generierte Bild auf eigenen signierten Medien-URLs, bevor es zurücksendet, sodass man einen Link zurückbekommt, den man speichern und bereitstellen kann.
Grenzen
- Bis zu 3 Quellbilder pro Bearbeitung
- Bis zu 10 Ausgabebilder pro Anfrage
- Eingabeaufforderungen bis zu 8.000 Zeichen
- Generierte Bilder bestehen vor der Rückgabe einer automatisierten Inhaltssicherheitsprüfung
- Ein Bild, das erstellt und dann durch die Inhaltsrichtlinie blockiert wird, wird weiterhin abgerechnet, weil xAI für die Erzeugung berechnet, selbst wenn die eigene Sicherheitsprüfung die Ausgabe blockiert
Preisgestaltung
Grok Imagine Image 2.0 ist Pay-as-you-go, berechnet pro Ausgabebild in der gewählten Qualität und Auflösung, plus eine Bildgebühr pro Bild für jedes Quellbild in einem Schnitt. Es gibt kein Abonnement und kein Mindestmaß. Die Live-Tarifkarte ist auf der modellblatt und weiter Preisgestaltung, die stets die aktuellen Zinssätze widerspiegeln.
Beginnen Sie mit dem Bau
Probieren Sie es in der Spielplatz, lesen Sie die vollständige Parameterreferenz in der API-Doku, oder stöbern Sie im restlichen Katalog auf dem Modellseite. Ein API-Schlüssel deckt jedes Modell auf EmpirioLabs ab.



