
Desarrollado por xAI, Grok Imagine Image 2.0 combina una generación de texto a imagen refinada con edición en lenguaje natural para flujos de trabajo basados en referencias. Genera resultados en 1K o 2K, pasa de un prompt a una imagen terminada y perfecciona imágenes existentes mediante instrucciones directas. Atlas Cloud reúne todos los endpoints compatibles bajo una única clave de API compatible con OpenAI, con precios transparentes de pago por uso e integración sencilla. Empieza a desarrollar hoy mismo.
Grok Imagine Image 2.0 ha sido desarrollado por xAI. Atlas Cloud (operado por Atlas Cloud AI LLC) proporciona acceso al modelo, pero no es su propietario. Todas las marcas comerciales pertenecen a sus respectivos titulares.
Elige entre la generación basada en prompts y la edición guiada por referencias en endpoints estándar y para desarrolladores.
| Modalidad | Descripción |
|---|---|
| Grok Imagine Image 2.0 Developer Edit API (Image Editing) | Transforma hasta tres imágenes de referencia mediante instrucciones de edición en lenguaje natural. Selecciona una resolución de 1K o 2K y una calidad baja o media para perfeccionar productos, crear variaciones y realizar actualizaciones visuales iterativas. |
| Grok Imagine Image 2.0 Developer Text-to-Image API | Convierte prompts en lenguaje natural en imágenes pulidas con una resolución de 1K o 2K. Sus catorce relaciones de aspecto y niveles de calidad bajos o medios admiten gráficos de marketing, arte conceptual, contenido para redes sociales y otros recursos adaptados a formatos específicos. |
| Grok Imagine Image 2.0 Text-to-Image API | Crea recursos visuales pulidos directamente a partir de prompts en lenguaje natural, con resultados disponibles en 1K o 2K. Sus 14 relaciones de aspecto y niveles de calidad bajos o medios seleccionables se adaptan a campañas, exploración de diseños, ilustraciones e imágenes listas para distintas plataformas. |
| Grok Imagine Image 2.0 Edit API (Image Editing) | Carga hasta tres imágenes de referencia, describe los cambios deseados en lenguaje natural y recibe una imagen editada. Las opciones de resolución de 1K y 2K, junto con los niveles de calidad bajos o medios, son adecuadas para revisar recursos, adaptar elementos visuales e iterar contenido. |
Grok Imagine Image 2.0 convierte prompts detallados y hasta tres imágenes de referencia en visuales pulidos de 1K o 2K, con encuadre flexible, niveles de calidad seleccionables y una única API de Atlas Cloud para generación y edición.

Grok Imagine Image 2.0 convierte prompts en lenguaje natural en visuales pulidos con resolución de 1K o 2K. Las instrucciones detalladas pueden coordinar sujetos, entornos, composición, estilo y tipografía en una sola solicitud. Elige entre 14 opciones de relación de aspecto para encuadrar desde diseños de producto cuadrados hasta campañas ultrapanorámicas. Este nivel de control es ideal para desarrolladores que crean herramientas de diseño, flujos de contenido y productos creativos basados en prompts.

La tipografía se planifica como parte de la composición, lo que ayuda a mantener la coherencia en visuales densos y de varias partes, además de conservar la nitidez del texto pequeño. Indica el texto, la jerarquía, las imágenes y la distribución mediante un único prompt. En 2K, los textos pequeños y las texturas de los materiales tienen más espacio para definirse. Úsalo para gráficos de campañas panorámicas, conceptos de packaging de productos, diseños editoriales y recursos con estilo de infografía.

Edita hasta tres imágenes de referencia con instrucciones en lenguaje natural dentro de una sola solicitud. Identifica cada fuente como <IMAGE_0>, <IMAGE_1> o <IMAGE_2> y describe los elementos que quieres combinar o modificar. Los resultados pueden generarse en 1K o 2K con calidad baja o media. Este flujo es adecuado para variaciones de producto, dirección artística y conceptos compuestos que necesitan conservar material reconocible de las fuentes.

Selecciona una calidad baja para explorar más rápido o una calidad media para obtener el mejor resultado del modelo; después, elige una resolución de 1K o 2K para cada solicitud. Tanto la generación como la edición ofrecen los mismos controles de calidad y resolución. Genera hasta cuatro resultados cuando un prompt necesite alternativas. Esta flexibilidad permite pasar de los borradores al resultado final sin cambiar de modelo ni reconstruir la integración.

Atlas Cloud centraliza la generación de texto y la edición de imágenes mediante un único endpoint de generación de imágenes y una API key. El precio estándar de pago por uso comienza en $0.04 por imagen generada, mientras que cada imagen de origen se factura a $0.01. Devuelve URLs de imágenes o solicita resultados en Base64 para gestionarlos directamente desde la aplicación. Es una base práctica para flujos de producción que necesitan costes claros y menos integraciones.
Descubre cómo Grok Imagine Image 2.0 y dos alternativas de Atlas Cloud interpretan las mismas indicaciones en fotografía editorial y naturalezas muertas con texturas enriquecidas.
Una joven modelo de moda con un traje sastre azul cobalto avanza con paso decidido por una estación de tren mediterránea bañada por el sol, mientras un tren que parte hace girar a su alrededor talones de billete sueltos; capturada en el instante decisivo en que se vuelve hacia la cámara con el cabello agitado por el viento. Un atrevido contraluz lateral de hora dorada crea un halo luminoso en el contorno de su cabello y sombras diagonales marcadas sobre el andén. Usa arcos repetidos como marco dentro del marco, con equipaje en primer plano suavemente desenfocado y líneas de fuga pronunciadas que retroceden hacia el tren. Paleta contenida de azules y ámbar, textura natural de la piel, tejido de lana nítido, piedra desgastada, grano de película sutil, fotografía editorial de moda, objetivo de 85 mm, ligero desenfoque de movimiento en el papel que vuela, relación de aspecto panorámica 16:9, a sangre

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud
Una fotografía documental espontánea de un conjunto juvenil de viento de secundaria ensayando en la azotea de un campus por la tarde, capturada en el preciso momento cómico en que una ráfaga repentina y potente arranca al aire una pila entera de partituras; decenas de páginas blancas arrugadas atraviesan el encuadre como pájaros sobresaltados, mientras una adolescente se eleva sobre las puntas de los pies y se estira desesperadamente para atrapar una hoja; su falda de uniforme y su cabello se agitan con el viento. A su lado, un chico sigue tocando con las mejillas infladas y una concentración sincera, y la campana curva y pulida de su instrumento de metal refleja claramente a los demás estudiantes, que se apresuran tras las partituras fugitivas. Varios jóvenes músicos reaccionan de forma natural con sorpresa, risas y gestos torpes a mitad de movimiento; sus instrumentos conservan una complejidad mecánica creíble, con posiciones de los dedos, válvulas, tubos y relaciones espaciales realistas. Fotografía analógica japonesa sobreexpuesta en película, narración espontánea del instante decisivo, toma horizontal espontánea desde un ángulo ligeramente bajo; la barandilla de la azotea y las cuerdas de tender tensas forman dos marcadas líneas de fuga convergentes, mientras grandes partituras desenfocadas que cruzan el primer plano cercano crean profundidad por capas y oclusión parcial. La intensa luz solar direccional del mediodía proyecta sombras nítidas y gráficas sobre el hormigón, con un cielo pálido muy sobreexpuesto y altas luces brillantes. Paleta estricta de tres colores: azul claro del cielo, blanco del uniforme escolar y dorado cálido del latón. Conserva diminutas gotas de sudor, textura realista de la piel, uniformes de algodón arrugados, fibras y marcas de doblez del papel, hormigón desgastado de la azotea, grano de película sutil, leve resplandor del objetivo y desenfoque de movimiento moderado en las páginas, el cabello y las manos que intentan alcanzarlas. Enérgica, caótica, divertida, juvenil, observadora y completamente espontánea; piel natural, separación limpia de colores, sin renderizado excesivamente brillante, sin HDR, sin piel de plástico, sin colores turbios, sin resplandor artificial ni efectos cinematográficos épicos. Cámara de película de 35 mm, objetivo gran angular de 28 mm, obturador rápido para una toma espontánea con desenfoque de movimiento selectivo, exposición de clave alta, composición horizontal panorámica, relación de aspecto panorámica 16:9, a sangre.

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud
Desde conceptos de campañas y variantes de productos hasta arte editorial y recursos multiformato, Grok Imagine Image 2.0 convierte prompts en lenguaje natural y hasta tres imágenes de referencia en recursos visuales pulidos de 1K o 2K con 14 relaciones de aspecto.
Genera recursos visuales de campaña pulidos a partir de prompts en lenguaje natural con una resolución de 1K o 2K. Elige entre 14 relaciones de aspecto para preparar banners, imágenes para páginas de destino y creatividades para redes sociales en distintas ubicaciones.
Edita imágenes de productos con instrucciones en lenguaje natural y hasta tres imágenes de referencia. Crea variaciones de color, ambientaciones estacionales o composiciones listas para marketplaces destinadas a equipos de comercio electrónico y flujos de trabajo automatizados para catálogos.
Elige entre 14 relaciones de aspecto al generar recursos visuales para distintas formas de pantalla. Produce borradores de 1K o entregables de 2K para feeds sociales, diseños móviles, ubicaciones publicitarias y flujos de publicación editorial.
Convierte conceptos escritos en imágenes pulidas de 1K o 2K mediante el endpoint text to image. Esto permite crear ilustraciones editoriales, recursos visuales para presentaciones, moodboards y exploraciones creativas iniciales en equipos de producto.
Proporciona hasta tres imágenes de referencia y describe la edición necesaria en lenguaje natural. Los desarrolladores pueden crear herramientas de transformación guiada para creadores, equipos de merchandising, revisiones de diseño y flujos de contenido reutilizables.
Alterna entre niveles de calidad baja y media a medida que cada imagen avanza desde la exploración hasta la entrega. Combina cualquiera de los dos niveles con una salida de 1K o 2K para prototipos, ciclos de revisión y recursos listos para producción.
Compara Grok Imagine Image 2.0 con tres alternativas de Atlas Cloud según el proveedor, la resolución máxima, los controles de encuadre y el precio estándar por imagen.
| Modelo | Proveedor | Resolución máxima | Control de relación de aspecto | Precio estándar |
|---|---|---|---|---|
| Grok Imagine Image 2.0 Developer Text-to-Image | xAI | 2K | 14 ajustes preestablecidos | $0.04 por imagen |
| Qwen Image 2.0 Text-to-image | Qwen | 2048 × 2048 | 7 ajustes preestablecidos más dimensiones personalizadas | $0.035 por imagen |
| Nano Banana 2 Lite Text-to-image | 1K | 14 ajustes preestablecidos | $0.04 por imagen | |
| MAI-Image-2.5-Flash Text-to-image | Microsoft | Hasta 1360 px por lado | Dimensiones personalizadas | $0.03 por imagen |
Empieza en minutos — sigue estos sencillos pasos para integrar y desplegar modelos a través de la plataforma de Atlas Cloud.
Regístrate en atlascloud.ai y completa la verificación. Los nuevos usuarios reciben créditos gratuitos para explorar la plataforma y probar modelos.
Combina modelos avanzados de Grok Imagine Image 2.0 con la plataforma acelerada por GPU de Atlas Cloud, proporcionando rendimiento, escalabilidad y experiencia de desarrollo incomparables.
Baja Latencia:
Inferencia optimizada por GPU para respuestas en tiempo real.
API Unificada:
Una sola integración para acceder a Grok Imagine Image 2.0, GPT, Gemini y DeepSeek.
Precios Transparentes:
Facturación por Token, soporta modo Serverless.
Experiencia del Desarrollador:
SDK, análisis de datos, herramientas de ajuste fino y plantillas todo en uno.
Confiabilidad:
99.99% de disponibilidad, control de permisos RBAC, registros de cumplimiento.
Seguridad y Cumplimiento:
Certificación SOC 2 Type II, cumplimiento HIPAA, soberanía de datos en EE.UU.
Grok Imagine Image 2.0 es un modelo de imágenes de xAI para generar y editar elementos visuales mediante lenguaje natural. Atlas Cloud ofrece endpoints independientes de texto a imagen y de edición, con salidas en 1K o 2K y calidad baja o media seleccionable.
Crea elementos visuales pulidos a partir de indicaciones escritas o modifica imágenes existentes mediante instrucciones en lenguaje natural. La generación de texto a imagen ofrece 14 relaciones de aspecto, mientras que el flujo de edición puede utilizar hasta tres imágenes de referencia.
Elige el endpoint de texto a imagen para crear un elemento visual nuevo o el endpoint de edición cuando trabajes con imágenes de referencia. Envía tu indicación con los ajustes de resolución, calidad y relación de aspecto requeridos, definidos en el esquema correspondiente de Atlas Cloud.
Ambos flujos admiten resolución 1K y 2K, con niveles de calidad baja o media. El endpoint de texto a imagen incluye 14 relaciones de aspecto, lo que permite a los desarrolladores producir diseños cuadrados, verticales, panorámicos y de otros formatos.
El endpoint de edición acepta hasta tres imágenes de referencia en una sola solicitud. Describe la función prevista de cada referencia e indica qué elementos visuales deben cambiar o mantenerse coherentes.
Atlas Cloud indica un precio base estándar de $0.04 por imagen para los endpoints de generación y edición disponibles. El uso se factura mediante un modelo de pago por uso, por lo que los costes aumentan según el número de solicitudes.
Usa un endpoint de texto a imagen cuando el resultado deba crearse completamente a partir de una indicación. Selecciona un endpoint de edición cuando necesites transformar, combinar o perfeccionar imágenes de referencia proporcionadas.
No, los endpoints incluidos en esta página de la familia producen imágenes. La generación de vídeo requiere un modelo de vídeo Grok Imagine independiente, en lugar de estas rutas de imagen.
Indica por separado y de forma explícita el cambio solicitado y los elementos que deben permanecer intactos. En ediciones con varias imágenes, explica qué aporta cada referencia y prueba primero un cambio importante antes de combinar varias transformaciones.
Guías, tutoriales y novedades de producto para aprovechar al máximo Atlas Cloud.