Seedance 2.0 Mini & Fast API a los precios más bajos del mundo: hasta un 68 % de descuento sobre el precio oficial
Grok Imagine Image 2.0 Natural Language Image Editing

Grok Imagine Image 2.0 Natural Language Image Editing

Desarrollado por xAI, Grok Imagine Image 2.0 combina una generación de texto a imagen refinada con edición en lenguaje natural para flujos de trabajo basados en referencias. Genera resultados en 1K o 2K, pasa de un prompt a una imagen terminada y perfecciona imágenes existentes mediante instrucciones directas. Atlas Cloud reúne todos los endpoints compatibles bajo una única clave de API compatible con OpenAI, con precios transparentes de pago por uso e integración sencilla. Empieza a desarrollar hoy mismo.

Grok Imagine Image 2.0 ha sido desarrollado por xAI. Atlas Cloud (operado por Atlas Cloud AI LLC) proporciona acceso al modelo, pero no es su propietario. Todas las marcas comerciales pertenecen a sus respectivos titulares.

Comparación de endpoints de Grok Imagine Image 2.0

Elige entre la generación basada en prompts y la edición guiada por referencias en endpoints estándar y para desarrolladores.

ModalidadDescripción
Grok Imagine Image 2.0 Developer Edit API (Image Editing)Transforma hasta tres imágenes de referencia mediante instrucciones de edición en lenguaje natural. Selecciona una resolución de 1K o 2K y una calidad baja o media para perfeccionar productos, crear variaciones y realizar actualizaciones visuales iterativas.
Grok Imagine Image 2.0 Developer Text-to-Image APIConvierte prompts en lenguaje natural en imágenes pulidas con una resolución de 1K o 2K. Sus catorce relaciones de aspecto y niveles de calidad bajos o medios admiten gráficos de marketing, arte conceptual, contenido para redes sociales y otros recursos adaptados a formatos específicos.
Grok Imagine Image 2.0 Text-to-Image APICrea recursos visuales pulidos directamente a partir de prompts en lenguaje natural, con resultados disponibles en 1K o 2K. Sus 14 relaciones de aspecto y niveles de calidad bajos o medios seleccionables se adaptan a campañas, exploración de diseños, ilustraciones e imágenes listas para distintas plataformas.
Grok Imagine Image 2.0 Edit API (Image Editing)Carga hasta tres imágenes de referencia, describe los cambios deseados en lenguaje natural y recibe una imagen editada. Las opciones de resolución de 1K y 2K, junto con los niveles de calidad bajos o medios, son adecuadas para revisar recursos, adaptar elementos visuales e iterar contenido.

Cómo Grok Imagine Image 2.0 da forma a cada fotograma

Grok Imagine Image 2.0 convierte prompts detallados y hasta tres imágenes de referencia en visuales pulidos de 1K o 2K, con encuadre flexible, niveles de calidad seleccionables y una única API de Atlas Cloud para generación y edición.

Control de prompts de Grok Imagine Image 2.0

Control de prompts de Grok Imagine Image 2.0

Grok Imagine Image 2.0 convierte prompts en lenguaje natural en visuales pulidos con resolución de 1K o 2K. Las instrucciones detalladas pueden coordinar sujetos, entornos, composición, estilo y tipografía en una sola solicitud. Elige entre 14 opciones de relación de aspecto para encuadrar desde diseños de producto cuadrados hasta campañas ultrapanorámicas. Este nivel de control es ideal para desarrolladores que crean herramientas de diseño, flujos de contenido y productos creativos basados en prompts.

Tipografía integrada en la imagen

Tipografía integrada en la imagen

La tipografía se planifica como parte de la composición, lo que ayuda a mantener la coherencia en visuales densos y de varias partes, además de conservar la nitidez del texto pequeño. Indica el texto, la jerarquía, las imágenes y la distribución mediante un único prompt. En 2K, los textos pequeños y las texturas de los materiales tienen más espacio para definirse. Úsalo para gráficos de campañas panorámicas, conceptos de packaging de productos, diseños editoriales y recursos con estilo de infografía.

Edición con tres imágenes de referencia

Edición con tres imágenes de referencia

Edita hasta tres imágenes de referencia con instrucciones en lenguaje natural dentro de una sola solicitud. Identifica cada fuente como <IMAGE_0>, <IMAGE_1> o <IMAGE_2> y describe los elementos que quieres combinar o modificar. Los resultados pueden generarse en 1K o 2K con calidad baja o media. Este flujo es adecuado para variaciones de producto, dirección artística y conceptos compuestos que necesitan conservar material reconocible de las fuentes.

Controles de calidad de Grok Imagine Image 2.0

Controles de calidad de Grok Imagine Image 2.0

Selecciona una calidad baja para explorar más rápido o una calidad media para obtener el mejor resultado del modelo; después, elige una resolución de 1K o 2K para cada solicitud. Tanto la generación como la edición ofrecen los mismos controles de calidad y resolución. Genera hasta cuatro resultados cuando un prompt necesite alternativas. Esta flexibilidad permite pasar de los borradores al resultado final sin cambiar de modelo ni reconstruir la integración.

Una única API de imágenes de Atlas Cloud

Una única API de imágenes de Atlas Cloud

Atlas Cloud centraliza la generación de texto y la edición de imágenes mediante un único endpoint de generación de imágenes y una API key. El precio estándar de pago por uso comienza en $0.04 por imagen generada, mientras que cada imagen de origen se factura a $0.01. Devuelve URLs de imágenes o solicita resultados en Base64 para gestionarlos directamente desde la aplicación. Es una base práctica para flujos de producción que necesitan costes claros y menos integraciones.

Grok Imagine Image 2.0: Una indicación, tres visiones

Descubre cómo Grok Imagine Image 2.0 y dos alternativas de Atlas Cloud interpretan las mismas indicaciones en fotografía editorial y naturalezas muertas con texturas enriquecidas.

Prompt

Una joven modelo de moda con un traje sastre azul cobalto avanza con paso decidido por una estación de tren mediterránea bañada por el sol, mientras un tren que parte hace girar a su alrededor talones de billete sueltos; capturada en el instante decisivo en que se vuelve hacia la cámara con el cabello agitado por el viento. Un atrevido contraluz lateral de hora dorada crea un halo luminoso en el contorno de su cabello y sombras diagonales marcadas sobre el andén. Usa arcos repetidos como marco dentro del marco, con equipaje en primer plano suavemente desenfocado y líneas de fuga pronunciadas que retroceden hacia el tren. Paleta contenida de azules y ámbar, textura natural de la piel, tejido de lana nítido, piedra desgastada, grano de película sutil, fotografía editorial de moda, objetivo de 85 mm, ligero desenfoque de movimiento en el papel que vuela, relación de aspecto panorámica 16:9, a sangre

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud

Prompt

Una fotografía documental espontánea de un conjunto juvenil de viento de secundaria ensayando en la azotea de un campus por la tarde, capturada en el preciso momento cómico en que una ráfaga repentina y potente arranca al aire una pila entera de partituras; decenas de páginas blancas arrugadas atraviesan el encuadre como pájaros sobresaltados, mientras una adolescente se eleva sobre las puntas de los pies y se estira desesperadamente para atrapar una hoja; su falda de uniforme y su cabello se agitan con el viento. A su lado, un chico sigue tocando con las mejillas infladas y una concentración sincera, y la campana curva y pulida de su instrumento de metal refleja claramente a los demás estudiantes, que se apresuran tras las partituras fugitivas. Varios jóvenes músicos reaccionan de forma natural con sorpresa, risas y gestos torpes a mitad de movimiento; sus instrumentos conservan una complejidad mecánica creíble, con posiciones de los dedos, válvulas, tubos y relaciones espaciales realistas. Fotografía analógica japonesa sobreexpuesta en película, narración espontánea del instante decisivo, toma horizontal espontánea desde un ángulo ligeramente bajo; la barandilla de la azotea y las cuerdas de tender tensas forman dos marcadas líneas de fuga convergentes, mientras grandes partituras desenfocadas que cruzan el primer plano cercano crean profundidad por capas y oclusión parcial. La intensa luz solar direccional del mediodía proyecta sombras nítidas y gráficas sobre el hormigón, con un cielo pálido muy sobreexpuesto y altas luces brillantes. Paleta estricta de tres colores: azul claro del cielo, blanco del uniforme escolar y dorado cálido del latón. Conserva diminutas gotas de sudor, textura realista de la piel, uniformes de algodón arrugados, fibras y marcas de doblez del papel, hormigón desgastado de la azotea, grano de película sutil, leve resplandor del objetivo y desenfoque de movimiento moderado en las páginas, el cabello y las manos que intentan alcanzarlas. Enérgica, caótica, divertida, juvenil, observadora y completamente espontánea; piel natural, separación limpia de colores, sin renderizado excesivamente brillante, sin HDR, sin piel de plástico, sin colores turbios, sin resplandor artificial ni efectos cinematográficos épicos. Cámara de película de 35 mm, objetivo gran angular de 28 mm, obturador rápido para una toma espontánea con desenfoque de movimiento selectivo, exposición de clave alta, composición horizontal panorámica, relación de aspecto panorámica 16:9, a sangre.

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud

Grok Imagine Image 2.0 en distintos flujos de trabajo creativos

Desde conceptos de campañas y variantes de productos hasta arte editorial y recursos multiformato, Grok Imagine Image 2.0 convierte prompts en lenguaje natural y hasta tres imágenes de referencia en recursos visuales pulidos de 1K o 2K con 14 relaciones de aspecto.

Recursos visuales de campaña con Grok Imagine Image 2.0

Genera recursos visuales de campaña pulidos a partir de prompts en lenguaje natural con una resolución de 1K o 2K. Elige entre 14 relaciones de aspecto para preparar banners, imágenes para páginas de destino y creatividades para redes sociales en distintas ubicaciones.

Variantes para catálogos de productos

Edita imágenes de productos con instrucciones en lenguaje natural y hasta tres imágenes de referencia. Crea variaciones de color, ambientaciones estacionales o composiciones listas para marketplaces destinadas a equipos de comercio electrónico y flujos de trabajo automatizados para catálogos.

Recursos para redes sociales en Grok Imagine Image 2.0

Elige entre 14 relaciones de aspecto al generar recursos visuales para distintas formas de pantalla. Produce borradores de 1K o entregables de 2K para feeds sociales, diseños móviles, ubicaciones publicitarias y flujos de publicación editorial.

Arte conceptual editorial

Convierte conceptos escritos en imágenes pulidas de 1K o 2K mediante el endpoint text to image. Esto permite crear ilustraciones editoriales, recursos visuales para presentaciones, moodboards y exploraciones creativas iniciales en equipos de producto.

Ediciones con varias referencias en Grok Imagine Image 2.0

Proporciona hasta tres imágenes de referencia y describe la edición necesaria en lenguaje natural. Los desarrolladores pueden crear herramientas de transformación guiada para creadores, equipos de merchandising, revisiones de diseño y flujos de contenido reutilizables.

Flujos de trabajo del borrador a la entrega

Alterna entre niveles de calidad baja y media a medida que cada imagen avanza desde la exploración hasta la entrega. Combina cualquiera de los dos niveles con una salida de 1K o 2K para prototipos, ciclos de revisión y recursos listos para producción.

Grok Imagine Image 2.0 en las API de imagen actuales

Compara Grok Imagine Image 2.0 con tres alternativas de Atlas Cloud según el proveedor, la resolución máxima, los controles de encuadre y el precio estándar por imagen.

ModeloProveedorResolución máximaControl de relación de aspectoPrecio estándar
Grok Imagine Image 2.0 Developer Text-to-ImagexAI2K14 ajustes preestablecidos$0.04 por imagen
Qwen Image 2.0 Text-to-imageQwen2048 × 20487 ajustes preestablecidos más dimensiones personalizadas$0.035 por imagen
Nano Banana 2 Lite Text-to-imageGoogle1K14 ajustes preestablecidos$0.04 por imagen
MAI-Image-2.5-Flash Text-to-imageMicrosoftHasta 1360 px por ladoDimensiones personalizadas$0.03 por imagen

Cómo usar Grok Imagine Image 2.0 en Atlas Cloud

Empieza en minutos — sigue estos sencillos pasos para integrar y desplegar modelos a través de la plataforma de Atlas Cloud.

Crea una cuenta en Atlas Cloud

Regístrate en atlascloud.ai y completa la verificación. Los nuevos usuarios reciben créditos gratuitos para explorar la plataforma y probar modelos.

Por Qué Usar Grok Imagine Image 2.0 en Atlas Cloud

Combina modelos avanzados de Grok Imagine Image 2.0 con la plataforma acelerada por GPU de Atlas Cloud, proporcionando rendimiento, escalabilidad y experiencia de desarrollo incomparables.

Rendimiento y Flexibilidad

Baja Latencia:
Inferencia optimizada por GPU para respuestas en tiempo real.

API Unificada:
Una sola integración para acceder a Grok Imagine Image 2.0, GPT, Gemini y DeepSeek.

Precios Transparentes:
Facturación por Token, soporta modo Serverless.

Empresa y Escala

Experiencia del Desarrollador:
SDK, análisis de datos, herramientas de ajuste fino y plantillas todo en uno.

Confiabilidad:
99.99% de disponibilidad, control de permisos RBAC, registros de cumplimiento.

Seguridad y Cumplimiento:
Certificación SOC 2 Type II, cumplimiento HIPAA, soberanía de datos en EE.UU.

Preguntas y respuestas sobre la API de imágenes Grok Imagine Image 2.0

Grok Imagine Image 2.0 es un modelo de imágenes de xAI para generar y editar elementos visuales mediante lenguaje natural. Atlas Cloud ofrece endpoints independientes de texto a imagen y de edición, con salidas en 1K o 2K y calidad baja o media seleccionable.

Crea elementos visuales pulidos a partir de indicaciones escritas o modifica imágenes existentes mediante instrucciones en lenguaje natural. La generación de texto a imagen ofrece 14 relaciones de aspecto, mientras que el flujo de edición puede utilizar hasta tres imágenes de referencia.

Elige el endpoint de texto a imagen para crear un elemento visual nuevo o el endpoint de edición cuando trabajes con imágenes de referencia. Envía tu indicación con los ajustes de resolución, calidad y relación de aspecto requeridos, definidos en el esquema correspondiente de Atlas Cloud.

Ambos flujos admiten resolución 1K y 2K, con niveles de calidad baja o media. El endpoint de texto a imagen incluye 14 relaciones de aspecto, lo que permite a los desarrolladores producir diseños cuadrados, verticales, panorámicos y de otros formatos.

El endpoint de edición acepta hasta tres imágenes de referencia en una sola solicitud. Describe la función prevista de cada referencia e indica qué elementos visuales deben cambiar o mantenerse coherentes.

Atlas Cloud indica un precio base estándar de $0.04 por imagen para los endpoints de generación y edición disponibles. El uso se factura mediante un modelo de pago por uso, por lo que los costes aumentan según el número de solicitudes.

Usa un endpoint de texto a imagen cuando el resultado deba crearse completamente a partir de una indicación. Selecciona un endpoint de edición cuando necesites transformar, combinar o perfeccionar imágenes de referencia proporcionadas.

No, los endpoints incluidos en esta página de la familia producen imágenes. La generación de vídeo requiere un modelo de vídeo Grok Imagine independiente, en lugar de estas rutas de imagen.

Indica por separado y de forma explícita el cambio solicitado y los elementos que deben permanecer intactos. En ediciones con varias imágenes, explica qué aporta cada referencia y prueba primero un cambio importante antes de combinar varias transformaciones.

Explorar Más Series

Seedance 2.5

¡La API de Seedance 2.5 ya está disponible en Atlas Cloud! Ofrece a los desarrolladores el modelo de video más reciente de ByteDance. Genera hasta 30 segundos de video nativo en una sola pasada a partir de texto, una sola imagen o hasta 50 referencias multimodales, con audio sincronizado y texto multilingüe en el encuadre. En Atlas Cloud puede acceder a él mediante una única clave, con consistencia del sujeto y físicas mejoradas que mantienen la coherencia en las tomas largas.

Ver Serie

Wan 3.0

La API Wan 3.0 es la próxima generación de la familia de videos Wan de Alibaba, diseñada para llevar la generación de formato largo, el control de múltiples referencias y la calidad audiovisual a nuevas alturas. Atlas Cloud ya aloja Wan 2.7, 2.6 y 2.5, y Wan 3.0 se ejecuta con la misma clave unificada sin necesidad de configuración adicional. Empieza a construir hoy mismo. Desplázate hacia abajo hasta la galería para ver lo que Wan 3.0 puede crear.

Ver Serie

MiniMax H3

MiniMax H3 es la familia de vídeo multimodal de MiniMax para la creación guiada por texto, imagen y referencias. En las rutas compatibles, conserva los sujetos del material de referencia, ofrece relaciones de aspecto flexibles y combina el sonido generado con los elementos visuales mediante H3 Developer, con perfiles de salida seleccionados según el endpoint. Atlas Cloud reúne toda la familia bajo una única clave compatible con OpenAI, con precios transparentes de pago por uso a partir de la tarifa estándar de $0.038 por segundo. Empieza a crear hoy mismo.

Ver Serie

Seedream 5.0 Pro

La API de Seedream 5.0 Pro ofrece a los desarrolladores el modelo de edición de imágenes controlable de ByteDance en Atlas Cloud. Sitúa las ediciones con precisión mediante anclajes y coordenadas, separa las imágenes en capas editables, fusiona múltiples referencias y empareja colores y materiales exactos, con texto multilingüe a 2K y 3K. ¡En Atlas Cloud puede acceder a él mediante una sola clave!

Ver Serie

Seedance 2.0

Seedance 2.0 es el modelo de vídeo para producción de ByteDance, diseñado para crear planos con precisión. Convierte prompts en vídeo, anima una imagen del primer fotograma con orientación opcional del último fotograma o da forma a los resultados mediante medios de referencia y búsqueda web opcional. Atlas Cloud reúne estos flujos de trabajo en una única API unificada, con precios transparentes de pago por uso y una sola clave compatible con OpenAI. Empieza a crear hoy mismo.

Ver Serie

GPT Image 2.5

La familia gpt-image-2.5 de OpenAI ofrece a los desarrolladores la posibilidad de elegir entre Flare y Sunburst para flujos de trabajo de producción de imágenes. Renderiza con resoluciones arbitrarias de hasta 3840x2160 y elige entre cinco niveles de calidad, incluidos xhigh y max, para adaptarte a requisitos de salida específicos. Atlas Cloud proporciona inferencia REST lista para usar, sin arranques en frío y con precios estándar desde $0.004 por generación. Empieza a crear hoy mismo.

Ver Serie

GPT Image 2

La API de GPT Image 2 ofrece a los desarrolladores acceso al último modelo de imágenes de OpenAI, el sucesor de GPT Image 1.5. Genera y edita imágenes con una representación de texto precisa en caracteres latinos y CJK, además de una sólida composición para carteles, maquetas e infografías. En Atlas Cloud, puede acceder a ella a través de una API unificada junto con más de 300 modelos, con créditos gratuitos, un tiempo de actividad del 99,99% y sin necesidad de verificación de organización de OpenAI.

Ver Serie

Gemini Omni Flash

La API de gemini omni pone a disposición de los desarrolladores la familia Gemini Omni Flash nativamente multimodal de Google DeepMind, incluido Gemini Omni 1.1 Flash. Crea vídeos cinematográficos con audio nativo sincronizado, anima imágenes estáticas con un control preciso de los fotogramas inicial y final, o revisa metraje existente mediante ediciones guiadas por texto que conservan el contenido no modificado. Atlas Cloud proporciona una única clave compatible con OpenAI, acceso unificado y precios transparentes de pago por uso. Empieza a desarrollar hoy mismo.

Ver Serie

Grok Imagine

La API Grok Imagine cubre los modelos de imagen, video y voz de xAI, desde Image 2.0 hasta Video 1.5 y xAI TTS v1. Genera imágenes de 1K o 2K en 14 relaciones de aspecto, expande una escena a 15 segundos de movimiento en 1080p, controla tomas con hasta 7 imágenes de referencia, o nárralas en 20 idiomas. Atlas Cloud ejecuta todos los modos en un endpoint, con precios de pago por uso desde $0.02 por imagen y $0.05 por segundo. Empieza a construir hoy.

Ver Serie

Google

Los modelos creativos más potentes de Google están todos disponibles en Atlas Cloud. Veo 3.1 ofrece generación de video cinematográfico, Nano Banana 2 impulsa la creación de imágenes de alta fidelidad y Gemini aporta inteligencia multimodal a cada flujo de trabajo. Acceda a la suite completa de modelos de Google a través de una sola API key con disponibilidad Day-0 y precios de pago por uso (pay-as-you-go).

Ver Serie

Seedance 2.0 Mini

Seedance 2.0 Mini lleva la generación de video multimodal de ByteDance a los flujos de trabajo donde la velocidad y el costo son más importantes. Ofrece las capacidades principales de Seedance 2.0 con un menor consumo de recursos: generación más rápida, menor costo por video y la misma integración de API que ya utiliza. Para los equipos que ejecutan pipelines de alto volumen o crean prototipos a escala, Mini es la opción predeterminada práctica.

Ver Serie

ByteDance

Desde la generación de video cinematográfico hasta la creación de imágenes de alta fidelidad, los modelos más potentes de ByteDance están disponibles en Atlas Cloud. Ejecute Seedance y Seedream a gran escala con los precios de inferencia más bajos y cero gastos generales de infraestructura.

Ver Serie

Una sola API para toda la IA multimedia.

Explorar Todos los Modelos