
Desenvolvido pela xAI, o Grok Imagine Image 2.0 combina geração refinada de texto para imagem com edição em linguagem natural para fluxos de trabalho baseados em referências. Produza imagens em 1K ou 2K, passe de um prompt a um visual finalizado e refine imagens existentes com instruções diretas. A Atlas Cloud reúne todos os endpoints compatíveis em uma única chave de API compatível com OpenAI, com preços transparentes conforme o uso e integração simples. Comece a desenvolver hoje.
Grok Imagine Image 2.0 foi desenvolvido pela xAI. A Atlas Cloud (operada pela Atlas Cloud AI LLC) fornece acesso ao modelo, mas não é sua proprietária. Todas as marcas registradas pertencem aos seus respectivos titulares.
Escolha entre geração baseada em prompts e edição orientada por referências nos endpoints padrão e para desenvolvedores.
| Modalidade | Descrição |
|---|---|
| Grok Imagine Image 2.0 Developer Edit API (Image Editing) | Transforme até três imagens de referência com instruções de edição em linguagem natural. Selecione resolução de 1K ou 2K e qualidade baixa ou média para aprimoramentos de produtos, variações criativas e atualizações visuais iterativas. |
| Grok Imagine Image 2.0 Developer Text-to-Image API | Os prompts em linguagem natural se transformam em imagens refinadas em resolução de 1K ou 2K. Quatorze proporções e níveis de qualidade baixa ou média atendem a gráficos de marketing, arte conceitual, conteúdo para redes sociais e outros assets específicos de cada formato. |
| Grok Imagine Image 2.0 Text-to-Image API | Crie visuais refinados diretamente a partir de prompts em linguagem natural, com saída disponível em 1K ou 2K. Suas 14 proporções e níveis de qualidade selecionáveis, baixa ou média, atendem a campanhas, exploração de design, ilustrações e imagens prontas para plataformas. |
| Grok Imagine Image 2.0 Edit API (Image Editing) | Carregue até três imagens de referência, descreva as alterações desejadas em linguagem natural e receba a imagem editada como resultado. As opções de resolução 1K e 2K, com qualidade baixa ou média, são adequadas para revisões de assets, adaptações visuais e iteração de conteúdo. |
O Grok Imagine Image 2.0 transforma prompts detalhados e até três imagens de referência em visuais refinados em 1K ou 2K, com enquadramento flexível, níveis de qualidade selecionáveis e uma única API da Atlas Cloud para geração e edição.

O Grok Imagine Image 2.0 transforma prompts em linguagem natural em visuais refinados com resolução 1K ou 2K. Instruções detalhadas podem coordenar temas, ambientes, composição, estilo e tipografia em uma única solicitação. Escolha entre 14 opções de proporção para enquadrar desde artes quadradas de produtos até campanhas ultrawide. Esse controle é ideal para desenvolvedores que criam ferramentas de design, pipelines de conteúdo e produtos criativos orientados por prompts.

A tipografia é planejada como parte da composição, ajudando visuais densos e com várias partes a permanecerem coerentes e mantendo textos pequenos nítidos. Oriente o texto, a hierarquia, as imagens e o layout por meio de um único prompt. Em 2K, textos pequenos e texturas de materiais têm mais espaço para ganhar definição. Use esse recurso em gráficos amplos para campanhas, conceitos de embalagens de produtos, layouts editoriais e assets no estilo de infográficos.

Edite até três imagens de referência com instruções em linguagem natural em uma única solicitação. Identifique cada fonte como <IMAGE_0>, <IMAGE_1> ou <IMAGE_2> e descreva os elementos a combinar ou alterar. Os resultados podem ser renderizados em 1K ou 2K com qualidade baixa ou média. Esse fluxo é adequado para variações de produtos, direção de arte e conceitos compostos que precisam preservar material de origem reconhecível.

Selecione a qualidade baixa para explorar mais rapidamente ou a qualidade média para obter o melhor resultado do modelo; depois, escolha a resolução 1K ou 2K para cada solicitação. Tanto a geração quanto a edição oferecem os mesmos controles de qualidade e resolução. Gere até quatro resultados quando um prompt precisar de alternativas. Essa flexibilidade dá suporte a fluxos que vão do rascunho ao resultado final sem trocar de modelo nem reconstruir a integração.

A Atlas Cloud reúne a geração de texto e a edição de imagens por trás de um único endpoint de geração de imagens e uma única chave de API. A cobrança conforme o uso começa em $0.04 por imagem gerada, enquanto cada imagem de origem é cobrada a $0.01. Retorne URLs de imagens ou solicite a saída em Base64 para processamento direto pela aplicação. É uma base prática para pipelines de produção que precisam de custos claros e menos integrações.
Veja como o Grok Imagine Image 2.0 e duas alternativas do Atlas Cloud interpretam os mesmos prompts em fotografia editorial e natureza-morta com texturas ricas.
Uma jovem modelo de moda usando um elegante terno azul-cobalto caminha com passos firmes por uma estação ferroviária mediterrânea banhada pelo sol, enquanto um trem partindo faz bilhetes soltos rodopiarem ao redor dela, capturada no instante decisivo em que se vira para a câmera, com os cabelos agitados pelo vento. Um forte contraluz lateral do golden hour cria uma borda luminosa ao longo dos cabelos e sombras diagonais marcadas sobre a plataforma. Use arcos repetidos como uma moldura dentro de uma moldura, com malas em primeiro plano suavemente desfocadas e fortes linhas de condução recuando em direção ao trem. Paleta contida de azul e âmbar, textura natural da pele, tecido de lã nítido, pedra desgastada, granulação sutil de filme, fotografia de moda editorial, lente de 85 mm, leve desfoque de movimento no papel voando, proporção de 16:9, sangrada até a borda

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud
Uma fotografia documental espontânea de jovens mostrando uma banda de sopros de ensino médio ensaiando no terraço de um campus à tarde, capturada no exato momento cômico em que uma rajada repentina e poderosa rasga uma pilha inteira de partituras e as lança ao ar; dezenas de páginas brancas amassadas atravessam o enquadramento como pássaros assustados, enquanto uma adolescente fica na ponta dos pés e se estica desesperadamente para pegar uma página, com a saia do uniforme e os cabelos chicoteando ao vento; ao lado dela, um garoto continua tocando com as bochechas infladas, concentrado com seriedade, e o sino curvo e polido de seu instrumento de metal reflete claramente os outros estudantes correndo atrás das partituras fugitivas. Vários jovens músicos reagem naturalmente com surpresa, risos e gestos desajeitados no meio do movimento, enquanto seus instrumentos mantêm uma complexidade mecânica convincente, incluindo posições dos dedos, válvulas, tubos e relações espaciais. Fotografia analógica japonesa superexposta, narrativa espontânea de um instante decisivo, captura horizontal ligeiramente em ângulo baixo; a grade do terraço e cordas de roupa esticadas formam duas fortes linhas de condução convergentes, enquanto grandes partituras desfocadas atravessando o primeiro plano criam profundidade em camadas e oclusão parcial. A luz solar dura e direcional do meio-dia projeta sombras nítidas e gráficas sobre o concreto, com um céu pálido fortemente superexposto e realces intensos. Paleta rigorosa de três cores: azul-claro do céu, branco do uniforme escolar e dourado quente do metal. Preserve pequenas gotas de suor, textura realista da pele, uniformes de algodão amarrotados, fibras e marcas de dobra do papel, concreto desgastado do terraço, granulação sutil de filme, leve brilho da lente e desfoque de movimento contido nas páginas voando, nos cabelos e nas mãos estendidas. Energética, caótica, engraçada, jovem, atenta e completamente espontânea; pele natural, separação limpa de cores, sem renderização excessivamente oleosa, sem HDR, sem pele plástica, sem cores turvas, sem brilho artificial, sem efeitos cinematográficos épicos. Câmera de filme de 35 mm, lente grande-angular de 28 mm, obturador rápido para captura espontânea com desfoque de movimento seletivo, exposição clara, composição horizontal ampla, proporção de 16:9, sangrada até a borda.

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud
De conceitos de campanha e variantes de produtos a arte editorial e ativos em vários formatos, o Grok Imagine Image 2.0 transforma prompts em linguagem natural e até três imagens de referência em visuais refinados de 1K ou 2K, disponíveis em 14 proporções.
Gere visuais de campanha refinados a partir de prompts em linguagem natural, com resolução de 1K ou 2K. Escolha entre 14 proporções para preparar banners, artes para landing pages e peças para redes sociais em diferentes posicionamentos.
Edite imagens de produtos com instruções em linguagem natural e até três imagens de referência. Crie variações de cor, cenários sazonais ou composições prontas para marketplaces para equipes de comércio eletrônico e fluxos automatizados de catálogos.
Selecione entre 14 proporções ao gerar ativos visuais para diferentes formatos de tela. Produza rascunhos em 1K ou entregáveis em 2K para feeds de redes sociais, layouts para dispositivos móveis, posicionamentos de display e fluxos de publicação editorial.
Transforme conceitos escritos em imagens refinadas de 1K ou 2K por meio do endpoint text to image. Isso dá suporte a ilustrações editoriais, visuais para apresentações, mood boards e explorações criativas iniciais em equipes de produto.
Forneça até três imagens de referência e descreva a edição necessária em linguagem natural. Os desenvolvedores podem criar ferramentas de transformação guiada para criadores, equipes de merchandising, revisões de design e fluxos reutilizáveis de produção de conteúdo.
Alterne entre níveis de qualidade baixo e médio à medida que cada imagem avança da exploração à entrega. Combine qualquer um dos níveis com uma saída em 1K ou 2K para prototipagem, ciclos de revisão e ativos prontos para produção.
Compare o Grok Imagine Image 2.0 com três alternativas da Atlas Cloud por provedor, resolução máxima, controles de enquadramento e preço padrão por imagem.
| Modelo | Provedor | Resolução máxima | Controle da proporção | Preço padrão |
|---|---|---|---|---|
| Grok Imagine Image 2.0 Developer Text-to-Image | xAI | 2K | 14 predefinições | $0.04 por imagem |
| Qwen Image 2.0 Text-to-image | Qwen | 2048 × 2048 | 7 predefinições mais dimensões personalizadas | $0.035 por imagem |
| Nano Banana 2 Lite Text-to-image | 1K | 14 predefinições | $0.04 por imagem | |
| MAI-Image-2.5-Flash Text-to-image | Microsoft | Até 1360 px por lado | Dimensões personalizadas | $0.03 por imagem |
Comece em minutos — siga estes passos simples para integrar e implantar modelos pela plataforma da Atlas Cloud.
Cadastre-se em atlascloud.ai e conclua a verificação. Novos usuários recebem créditos gratuitos para explorar a plataforma e testar modelos.
Combine modelos avançados de Grok Imagine Image 2.0 com a plataforma acelerada por GPU do Atlas Cloud, fornecendo desempenho, escalabilidade e experiência de desenvolvimento incomparáveis.
Baixa Latência:
Inferência otimizada por GPU para respostas em tempo real.
API Unificada:
Uma única integração para acessar Grok Imagine Image 2.0, GPT, Gemini e DeepSeek.
Preços Transparentes:
Faturamento por Token, suporta modo Serverless.
Experiência do Desenvolvedor:
SDK, análise de dados, ferramentas de ajuste fino e modelos tudo em um.
Confiabilidade:
99.99% de disponibilidade, controle de permissões RBAC, logs de conformidade.
Segurança e Conformidade:
Certificação SOC 2 Type II, conformidade HIPAA, soberania de dados nos EUA.
O Grok Imagine Image 2.0 é um modelo de imagem da xAI para gerar e editar elementos visuais usando linguagem natural. A Atlas Cloud oferece endpoints separados de text to image e edição, com saída em 1K ou 2K e qualidade baixa ou média selecionável.
Crie elementos visuais refinados a partir de prompts escritos ou modifique imagens existentes por meio de instruções em linguagem natural. A geração text to image oferece 14 proporções de aspecto, enquanto o fluxo de edição pode usar até três imagens de referência.
Escolha o endpoint de text to image para criar um novo elemento visual ou o edit endpoint ao trabalhar com imagens de referência. Envie seu prompt com as configurações obrigatórias de resolução, qualidade e proporção de aspecto definidas no schema correspondente da Atlas Cloud.
Ambos os fluxos são compatíveis com resolução 1K e 2K, com níveis de qualidade baixa ou média. O endpoint de text to image inclui 14 proporções de aspecto, permitindo que desenvolvedores produzam layouts quadrados, verticais, horizontais e outros.
O edit endpoint aceita até três imagens de referência em uma única solicitação. Descreva a função pretendida de cada referência e informe quais elementos visuais devem mudar ou permanecer consistentes.
A Atlas Cloud informa um preço-base padrão de $0.04 por imagem para os endpoints de geração e edição disponíveis. O uso segue um modelo de pagamento conforme o uso, portanto os custos aumentam de acordo com o número de solicitações.
Use um endpoint de text to image quando a saída deve ser criada inteiramente a partir de um prompt. Selecione um edit endpoint quando precisar transformar, combinar ou refinar imagens de referência fornecidas.
Não, os endpoints abordados nesta página da família produzem imagens. A geração de vídeo requer um modelo de vídeo Grok Imagine separado, e não essas rotas de imagem.
Descreva a alteração solicitada e os elementos que devem permanecer intocados como instruções explícitas e separadas. Em edições com várias imagens, explique o que cada referência contribui e teste uma alteração principal antes de combinar várias transformações.
Guias, tutoriais e novidades de produto para você aproveitar ao máximo a Atlas Cloud.