Grok Imagine Image 2.0 está disponible en EmpirioLabs. El último modelo de imágenes Grok Imagine de xAI genera a partir de un prompt de texto y edita hasta tres imágenes fuente a partir de una instrucción en lenguaje sencillo. La calidad y la resolución son seleccionables, la salida se extiende a 2K y llega a los mismos endpoints compatibles con OpenAI que ya usas para todos los demás modelos de la plataforma.
Mira el vídeo de lanzamiento
Cada fotograma es una salida real de Grok Imagine Image 2.0. La banda sonora fue generada por ACE-Step en EmpirioLabs.
Lo que soporta
Grok Imagine Image 2.0 toma texto e imágenes y escribe imágenes. Gestiona tres trabajos de un mismo modelo:
- De texto a imagen. Envía un prompt sin imagen.
- Edición de imágenes. Adjunta una imagen y describe el cambio que quieres.
- Edición multiimagen. Adjunta dos o tres imágenes para combinar sujetos, transferir un estilo o componer una escena, y diríjalas en el prompt como <IMAGE_0>, <IMAGE_1>, y así sucesivamente.
La tipografía se mantiene bien, que es la parte que la mayoría de los modelos de imagen aún fallan. La señalización, carteles y etiquetas de productos vuelven con las palabras que realmente pediste en lugar de un garabato que parezca plausible.
Generar una imagen
curl https://api.empiriolabs.ai/v1/images/generations \ -H "Autorización: Portador $EMPIRIOLABS_API_KEY" \ -H "Tipo-Contenido: application/json" \ -d '{ "modelo": "grok-imagine-image-2-0", "prompt": "Un telescopio de latón sobre un escritorio de madera junto a una carta estelar doblada, luz cálida de la lámpara", "calidad": "media", "resolución": "2k", "aspect_ratio": "16:9" }'
La misma llamada del SDK de OpenAI para Python, apuntando a EmpirioLabs:
desde openai importar cliente OpenAI = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) resultado = client.images.generate(model="grok-imagine-image-2-0", prompt="Un telescopio de latón sobre un escritorio de madera junto a un mapa estelar plegado, cálida luz de lámpara", n=2,) para la imagen en result.data: print(image.url)
Editar una imagen
Point /v1/images/edits en una URL pública, un URI de datos o una imagen que subiste, y describa el cambio.
curl https://api.empiriolabs.ai/v1/images/edits \ -H "Autorización: Portador $EMPIRIOLABS_API_KEY" \ -H "Tipo-Contenido: application/json" \ -d '{ "modelo": "grok-imagine-image-2-0", "prompt": "Renderizar esto como un boceto detallado a lápiz con sombreado cruzado", "imagen": { "url": "https://example.com/photo.jpg" } }'
Para un compuesto, envía el plural Imágenes Array y referencia a cada uno por índice:
{ "model": "grok-imagine-image-2-0", "prompt": "Coloca el producto <IMAGE_0> de sobre la superficie de mármol en <IMAGE_1>", "imágenes": [ { "url": "https://example.com/product.png" }, { "url": "https://example.com/counter.jpg" } ] }
Calidad y resolución
Dos controles independientes moldean la salida. Calidad es Grave o Medio, y resolución es 1k o 2.000. Se combinan en cuatro puntos operativos, así que puedes elegir el que se adapte al trabajo en lugar de pagar tarifas emblemáticas por una miniatura.
aspect_ratio cubre catorce proporciones de 1:1 a través de 20:9, más Auto, que permite al modelo elegir la forma que se adapta al prompt. En una edición, Auto sigue la primera imagen fuente.
Tres cosas que merece la pena saber
- La calidad es un control de latencia, no solo un control de calidad. La baja calidad vuelve en cuestión de segundos. La media tarda mucho más, especialmente a 2K. Si generas dentro de un bucle orientado al usuario, bajo suele ser el valor predeterminado correcto y medio es la mejora deliberada.
- Una edición factura sus imágenes fuente. Cada imagen que adjuntas conlleva un cargo por imagen encima de la imagen de salida, al mismo ritmo que cada modelo xAI en EmpirioLabs cobra por una imagen fuente, así que un compuesto de tres imágenes cuesta significativamente más que una generación simple. El texto a imagen no tiene carga de imagen fuente en absoluto.
- Tus enlaces a las imágenes no caducan según el calendario de otra persona. Las propias URLs de salida del proveedor son de corta duración. EmpirioLabs vuelve a alojar cada imagen generada en sus propias URLs de medios firmadas antes de devolverlas, así que lo que recibes es un enlace que puedes almacenar y servir.
Límites
- Hasta 3 imágenes fuente por edición
- Hasta 10 imágenes de salida por solicitud
- Prompts de hasta 8.000 caracteres
- Las imágenes generadas pasan una comprobación automática de seguridad de contenido antes de ser devueltas
- Una imagen que se produce y luego bloquea por la política de contenido sigue siendo facturada, porque xAI cobra por la generación incluso cuando su propia comprobación de seguridad bloquea la salida
Precios
Grok Imagine Image 2.0 es de pago por uso, facturado por imagen de salida en la calidad y resolución que seleccionaste, más un cargo por imagen por imagen original en una edición. No hay suscripción ni mínimo. La tarjeta de tarifas en vivo está en el página modelo y así sucesivamente Precios, que siempre reflejan las tarifas actuales.
Empieza a construir
Pruébalo en el Playground, lee la referencia completa del parámetro en el API docs, o explorar el resto del catálogo en la Página de modelos. Una clave API cubre todos los modelos en EmpirioLabs.



