Seedance 2.0 Mini & Fast API com os preços mais baixos do mundo — até 68% de desconto no preço oficial
Grok Imagine Image 2.0 Natural Language Image Editing

Grok Imagine Image 2.0 Natural Language Image Editing

Desenvolvido pela xAI, o Grok Imagine Image 2.0 combina geração refinada de texto para imagem com edição em linguagem natural para fluxos de trabalho baseados em referências. Produza imagens em 1K ou 2K, passe de um prompt a um visual finalizado e refine imagens existentes com instruções diretas. A Atlas Cloud reúne todos os endpoints compatíveis em uma única chave de API compatível com OpenAI, com preços transparentes conforme o uso e integração simples. Comece a desenvolver hoje.

Grok Imagine Image 2.0 foi desenvolvido pela xAI. A Atlas Cloud (operada pela Atlas Cloud AI LLC) fornece acesso ao modelo, mas não é sua proprietária. Todas as marcas registradas pertencem aos seus respectivos titulares.

Comparar endpoints do Grok Imagine Image 2.0

Escolha entre geração baseada em prompts e edição orientada por referências nos endpoints padrão e para desenvolvedores.

ModalidadeDescrição
Grok Imagine Image 2.0 Developer Edit API (Image Editing)Transforme até três imagens de referência com instruções de edição em linguagem natural. Selecione resolução de 1K ou 2K e qualidade baixa ou média para aprimoramentos de produtos, variações criativas e atualizações visuais iterativas.
Grok Imagine Image 2.0 Developer Text-to-Image APIOs prompts em linguagem natural se transformam em imagens refinadas em resolução de 1K ou 2K. Quatorze proporções e níveis de qualidade baixa ou média atendem a gráficos de marketing, arte conceitual, conteúdo para redes sociais e outros assets específicos de cada formato.
Grok Imagine Image 2.0 Text-to-Image APICrie visuais refinados diretamente a partir de prompts em linguagem natural, com saída disponível em 1K ou 2K. Suas 14 proporções e níveis de qualidade selecionáveis, baixa ou média, atendem a campanhas, exploração de design, ilustrações e imagens prontas para plataformas.
Grok Imagine Image 2.0 Edit API (Image Editing)Carregue até três imagens de referência, descreva as alterações desejadas em linguagem natural e receba a imagem editada como resultado. As opções de resolução 1K e 2K, com qualidade baixa ou média, são adequadas para revisões de assets, adaptações visuais e iteração de conteúdo.

Como o Grok Imagine Image 2.0 molda cada frame

O Grok Imagine Image 2.0 transforma prompts detalhados e até três imagens de referência em visuais refinados em 1K ou 2K, com enquadramento flexível, níveis de qualidade selecionáveis e uma única API da Atlas Cloud para geração e edição.

Controle de prompts do Grok Imagine Image 2.0

Controle de prompts do Grok Imagine Image 2.0

O Grok Imagine Image 2.0 transforma prompts em linguagem natural em visuais refinados com resolução 1K ou 2K. Instruções detalhadas podem coordenar temas, ambientes, composição, estilo e tipografia em uma única solicitação. Escolha entre 14 opções de proporção para enquadrar desde artes quadradas de produtos até campanhas ultrawide. Esse controle é ideal para desenvolvedores que criam ferramentas de design, pipelines de conteúdo e produtos criativos orientados por prompts.

Tipografia integrada à imagem

Tipografia integrada à imagem

A tipografia é planejada como parte da composição, ajudando visuais densos e com várias partes a permanecerem coerentes e mantendo textos pequenos nítidos. Oriente o texto, a hierarquia, as imagens e o layout por meio de um único prompt. Em 2K, textos pequenos e texturas de materiais têm mais espaço para ganhar definição. Use esse recurso em gráficos amplos para campanhas, conceitos de embalagens de produtos, layouts editoriais e assets no estilo de infográficos.

Edição com três imagens de referência

Edição com três imagens de referência

Edite até três imagens de referência com instruções em linguagem natural em uma única solicitação. Identifique cada fonte como <IMAGE_0>, <IMAGE_1> ou <IMAGE_2> e descreva os elementos a combinar ou alterar. Os resultados podem ser renderizados em 1K ou 2K com qualidade baixa ou média. Esse fluxo é adequado para variações de produtos, direção de arte e conceitos compostos que precisam preservar material de origem reconhecível.

Controles de qualidade do Grok Imagine Image 2.0

Controles de qualidade do Grok Imagine Image 2.0

Selecione a qualidade baixa para explorar mais rapidamente ou a qualidade média para obter o melhor resultado do modelo; depois, escolha a resolução 1K ou 2K para cada solicitação. Tanto a geração quanto a edição oferecem os mesmos controles de qualidade e resolução. Gere até quatro resultados quando um prompt precisar de alternativas. Essa flexibilidade dá suporte a fluxos que vão do rascunho ao resultado final sem trocar de modelo nem reconstruir a integração.

Uma única API de imagens da Atlas Cloud

Uma única API de imagens da Atlas Cloud

A Atlas Cloud reúne a geração de texto e a edição de imagens por trás de um único endpoint de geração de imagens e uma única chave de API. A cobrança conforme o uso começa em $0.04 por imagem gerada, enquanto cada imagem de origem é cobrada a $0.01. Retorne URLs de imagens ou solicite a saída em Base64 para processamento direto pela aplicação. É uma base prática para pipelines de produção que precisam de custos claros e menos integrações.

Grok Imagine Image 2.0: Um prompt, três visões

Veja como o Grok Imagine Image 2.0 e duas alternativas do Atlas Cloud interpretam os mesmos prompts em fotografia editorial e natureza-morta com texturas ricas.

Prompt

Uma jovem modelo de moda usando um elegante terno azul-cobalto caminha com passos firmes por uma estação ferroviária mediterrânea banhada pelo sol, enquanto um trem partindo faz bilhetes soltos rodopiarem ao redor dela, capturada no instante decisivo em que se vira para a câmera, com os cabelos agitados pelo vento. Um forte contraluz lateral do golden hour cria uma borda luminosa ao longo dos cabelos e sombras diagonais marcadas sobre a plataforma. Use arcos repetidos como uma moldura dentro de uma moldura, com malas em primeiro plano suavemente desfocadas e fortes linhas de condução recuando em direção ao trem. Paleta contida de azul e âmbar, textura natural da pele, tecido de lã nítido, pedra desgastada, granulação sutil de filme, fotografia de moda editorial, lente de 85 mm, leve desfoque de movimento no papel voando, proporção de 16:9, sangrada até a borda

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud

Prompt

Uma fotografia documental espontânea de jovens mostrando uma banda de sopros de ensino médio ensaiando no terraço de um campus à tarde, capturada no exato momento cômico em que uma rajada repentina e poderosa rasga uma pilha inteira de partituras e as lança ao ar; dezenas de páginas brancas amassadas atravessam o enquadramento como pássaros assustados, enquanto uma adolescente fica na ponta dos pés e se estica desesperadamente para pegar uma página, com a saia do uniforme e os cabelos chicoteando ao vento; ao lado dela, um garoto continua tocando com as bochechas infladas, concentrado com seriedade, e o sino curvo e polido de seu instrumento de metal reflete claramente os outros estudantes correndo atrás das partituras fugitivas. Vários jovens músicos reagem naturalmente com surpresa, risos e gestos desajeitados no meio do movimento, enquanto seus instrumentos mantêm uma complexidade mecânica convincente, incluindo posições dos dedos, válvulas, tubos e relações espaciais. Fotografia analógica japonesa superexposta, narrativa espontânea de um instante decisivo, captura horizontal ligeiramente em ângulo baixo; a grade do terraço e cordas de roupa esticadas formam duas fortes linhas de condução convergentes, enquanto grandes partituras desfocadas atravessando o primeiro plano criam profundidade em camadas e oclusão parcial. A luz solar dura e direcional do meio-dia projeta sombras nítidas e gráficas sobre o concreto, com um céu pálido fortemente superexposto e realces intensos. Paleta rigorosa de três cores: azul-claro do céu, branco do uniforme escolar e dourado quente do metal. Preserve pequenas gotas de suor, textura realista da pele, uniformes de algodão amarrotados, fibras e marcas de dobra do papel, concreto desgastado do terraço, granulação sutil de filme, leve brilho da lente e desfoque de movimento contido nas páginas voando, nos cabelos e nas mãos estendidas. Energética, caótica, engraçada, jovem, atenta e completamente espontânea; pele natural, separação limpa de cores, sem renderização excessivamente oleosa, sem HDR, sem pele plástica, sem cores turvas, sem brilho artificial, sem efeitos cinematográficos épicos. Câmera de filme de 35 mm, lente grande-angular de 28 mm, obturador rápido para captura espontânea com desfoque de movimento seletivo, exposição clara, composição horizontal ampla, proporção de 16:9, sangrada até a borda.

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud

Grok Imagine Image 2.0 em diferentes fluxos de trabalho criativos

De conceitos de campanha e variantes de produtos a arte editorial e ativos em vários formatos, o Grok Imagine Image 2.0 transforma prompts em linguagem natural e até três imagens de referência em visuais refinados de 1K ou 2K, disponíveis em 14 proporções.

Visuais de campanha com o Grok Imagine Image 2.0

Gere visuais de campanha refinados a partir de prompts em linguagem natural, com resolução de 1K ou 2K. Escolha entre 14 proporções para preparar banners, artes para landing pages e peças para redes sociais em diferentes posicionamentos.

Variantes para catálogos de produtos

Edite imagens de produtos com instruções em linguagem natural e até três imagens de referência. Crie variações de cor, cenários sazonais ou composições prontas para marketplaces para equipes de comércio eletrônico e fluxos automatizados de catálogos.

Ativos para redes sociais no Grok Imagine Image 2.0

Selecione entre 14 proporções ao gerar ativos visuais para diferentes formatos de tela. Produza rascunhos em 1K ou entregáveis em 2K para feeds de redes sociais, layouts para dispositivos móveis, posicionamentos de display e fluxos de publicação editorial.

Arte conceitual editorial

Transforme conceitos escritos em imagens refinadas de 1K ou 2K por meio do endpoint text to image. Isso dá suporte a ilustrações editoriais, visuais para apresentações, mood boards e explorações criativas iniciais em equipes de produto.

Edições com várias referências no Grok Imagine Image 2.0

Forneça até três imagens de referência e descreva a edição necessária em linguagem natural. Os desenvolvedores podem criar ferramentas de transformação guiada para criadores, equipes de merchandising, revisões de design e fluxos reutilizáveis de produção de conteúdo.

Fluxos de trabalho do rascunho à entrega

Alterne entre níveis de qualidade baixo e médio à medida que cada imagem avança da exploração à entrega. Combine qualquer um dos níveis com uma saída em 1K ou 2K para prototipagem, ciclos de revisão e ativos prontos para produção.

Grok Imagine Image 2.0 nas APIs de imagem disponíveis hoje

Compare o Grok Imagine Image 2.0 com três alternativas da Atlas Cloud por provedor, resolução máxima, controles de enquadramento e preço padrão por imagem.

ModeloProvedorResolução máximaControle da proporçãoPreço padrão
Grok Imagine Image 2.0 Developer Text-to-ImagexAI2K14 predefinições$0.04 por imagem
Qwen Image 2.0 Text-to-imageQwen2048 × 20487 predefinições mais dimensões personalizadas$0.035 por imagem
Nano Banana 2 Lite Text-to-imageGoogle1K14 predefinições$0.04 por imagem
MAI-Image-2.5-Flash Text-to-imageMicrosoftAté 1360 px por ladoDimensões personalizadas$0.03 por imagem

Como Usar Grok Imagine Image 2.0 no Atlas Cloud

Comece em minutos — siga estes passos simples para integrar e implantar modelos pela plataforma da Atlas Cloud.

Crie uma Conta no Atlas Cloud

Cadastre-se em atlascloud.ai e conclua a verificação. Novos usuários recebem créditos gratuitos para explorar a plataforma e testar modelos.

Por Que Usar Grok Imagine Image 2.0 no Atlas Cloud

Combine modelos avançados de Grok Imagine Image 2.0 com a plataforma acelerada por GPU do Atlas Cloud, fornecendo desempenho, escalabilidade e experiência de desenvolvimento incomparáveis.

Desempenho e Flexibilidade

Baixa Latência:
Inferência otimizada por GPU para respostas em tempo real.

API Unificada:
Uma única integração para acessar Grok Imagine Image 2.0, GPT, Gemini e DeepSeek.

Preços Transparentes:
Faturamento por Token, suporta modo Serverless.

Empresa e Escala

Experiência do Desenvolvedor:
SDK, análise de dados, ferramentas de ajuste fino e modelos tudo em um.

Confiabilidade:
99.99% de disponibilidade, controle de permissões RBAC, logs de conformidade.

Segurança e Conformidade:
Certificação SOC 2 Type II, conformidade HIPAA, soberania de dados nos EUA.

Perguntas e respostas sobre a API Grok Imagine Image 2.0

O Grok Imagine Image 2.0 é um modelo de imagem da xAI para gerar e editar elementos visuais usando linguagem natural. A Atlas Cloud oferece endpoints separados de text to image e edição, com saída em 1K ou 2K e qualidade baixa ou média selecionável.

Crie elementos visuais refinados a partir de prompts escritos ou modifique imagens existentes por meio de instruções em linguagem natural. A geração text to image oferece 14 proporções de aspecto, enquanto o fluxo de edição pode usar até três imagens de referência.

Escolha o endpoint de text to image para criar um novo elemento visual ou o edit endpoint ao trabalhar com imagens de referência. Envie seu prompt com as configurações obrigatórias de resolução, qualidade e proporção de aspecto definidas no schema correspondente da Atlas Cloud.

Ambos os fluxos são compatíveis com resolução 1K e 2K, com níveis de qualidade baixa ou média. O endpoint de text to image inclui 14 proporções de aspecto, permitindo que desenvolvedores produzam layouts quadrados, verticais, horizontais e outros.

O edit endpoint aceita até três imagens de referência em uma única solicitação. Descreva a função pretendida de cada referência e informe quais elementos visuais devem mudar ou permanecer consistentes.

A Atlas Cloud informa um preço-base padrão de $0.04 por imagem para os endpoints de geração e edição disponíveis. O uso segue um modelo de pagamento conforme o uso, portanto os custos aumentam de acordo com o número de solicitações.

Use um endpoint de text to image quando a saída deve ser criada inteiramente a partir de um prompt. Selecione um edit endpoint quando precisar transformar, combinar ou refinar imagens de referência fornecidas.

Não, os endpoints abordados nesta página da família produzem imagens. A geração de vídeo requer um modelo de vídeo Grok Imagine separado, e não essas rotas de imagem.

Descreva a alteração solicitada e os elementos que devem permanecer intocados como instruções explícitas e separadas. Em edições com várias imagens, explique o que cada referência contribui e teste uma alteração principal antes de combinar várias transformações.

Explorar Mais Séries

Seedance 2.5

A API do Seedance 2.5 já está disponível no Atlas Cloud! Ela oferece aos desenvolvedores o mais novo modelo de vídeo da ByteDance. Ele gera até 30 segundos de vídeo nativo em uma única passagem a partir de texto, uma única imagem ou até 50 referências multimodais, com áudio sincronizado e texto multilíngue no quadro. No Atlas Cloud, você o acessa por meio de uma única chave, com consistência de sujeito e física aprimorada mantendo a coerência em tomadas longas.

Ver Série

Wan 3.0

A API Wan 3.0 é a próxima geração da família de vídeos Wan da Alibaba, desenvolvida para elevar a geração de formato longo, o controle de múltiplas referências e a qualidade audiovisual a novos patamares. O Atlas Cloud já hospeda o Wan 2.7, 2.6 e 2.5, e o Wan 3.0 funciona com a mesma chave unificada, sem necessidade de configuração separada. Comece a construir hoje mesmo. Role a tela para baixo até a vitrine para ver o que o Wan 3.0 pode criar.

Ver Série

MiniMax H3

MiniMax H3 é a família de vídeo multimodal da MiniMax para criação guiada por texto, imagem e referências. Nas rotas compatíveis, preserva os elementos das mídias de referência, oferece proporções flexíveis e combina som gerado com elementos visuais por meio do H3 Developer, com perfis de saída selecionados por endpoint. O Atlas Cloud unifica a família com uma única chave compatível com a OpenAI e preços transparentes de pagamento conforme o uso, a partir da tarifa padrão de $0.038 por segundo. Comece a criar hoje.

Ver Série

Seedream 5.0 Pro

A API do Seedream 5.0 Pro fornece aos desenvolvedores o modelo de edição de imagens controlável da ByteDance no Atlas Cloud. Ela posiciona as edições com precisão usando âncoras e coordenadas, separa as imagens em camadas editáveis, funde múltiplas referências e combina cores e materiais exatos, com texto multilíngue em 2K e 3K. No Atlas Cloud, você pode acessá-lo por meio de uma única chave!

Ver Série

Seedance 2.0

Seedance 2.0 é o modelo de vídeo para produção da ByteDance, desenvolvido para a criação precisa de planos. Transforme prompts em vídeo, anime uma imagem do primeiro quadro com orientação opcional do último quadro ou defina os resultados com mídia de referência e pesquisa opcional na web. O Atlas Cloud reúne esses fluxos de trabalho em uma única API, com preços transparentes conforme o uso e uma única chave compatível com OpenAI. Comece a desenvolver hoje.

Ver Série

GPT Image 2.5

A família gpt-image-2.5 da OpenAI oferece aos desenvolvedores a opção entre Flare e Sunburst para fluxos de trabalho de imagens em produção. Renderize em resoluções arbitrárias de até 3840x2160 e escolha entre cinco níveis de qualidade, incluindo xhigh e max, para atender a requisitos específicos de saída. A Atlas Cloud oferece inferência REST pronta para uso, sem cold starts, com preços padrão a partir de US$ 0,004 por geração. Comece a criar hoje.

Ver Série

GPT Image 2

A API do GPT Image 2 dá aos desenvolvedores acesso ao mais recente modelo de imagem da OpenAI, o sucessor do GPT Image 1.5. Ele gera e edita imagens com renderização de texto precisa em caracteres latinos e CJK, além de uma forte composição para pôsteres, mockups e infográficos. Na Atlas Cloud, você o acessa através de uma API unificada junto a mais de 300 modelos, com créditos gratuitos, 99,99% de tempo de atividade e sem a necessidade de verificação de organização da OpenAI.

Ver Série

Gemini Omni Flash

A API gemini omni oferece aos desenvolvedores a família Gemini Omni Flash nativamente multimodal do Google DeepMind, incluindo o Gemini Omni 1.1 Flash. Crie vídeos cinematográficos com áudio nativo sincronizado, anime imagens estáticas com controle preciso dos frames inicial e final ou edite vídeos existentes por meio de edições guiadas por texto que preservam o conteúdo não alterado. A Atlas Cloud fornece uma única chave compatível com OpenAI, acesso unificado e preços transparentes conforme o uso. Comece a desenvolver hoje.

Ver Série

Grok Imagine

A API Grok Imagine cobre os modelos de imagem, vídeo e fala da xAI, desde Image 2.0 até Video 1.5 e xAI TTS v1. Renderize imagens estáticas em 1K ou 2K em 14 proporções de aspecto, estenda uma cena para 15 segundos de movimento em 1080p, controle os planos com até 7 imagens de referência ou narre-os em 20 idiomas. O Atlas Cloud executa todos os modos em um único endpoint, com preço por uso a partir de $0.02 por imagem e $0.05 por segundo. Comece a construir hoje.

Ver Série

Google

Os modelos criativos mais poderosos do Google estão todos disponíveis na Atlas Cloud. O Veo 3.1 oferece geração de vídeo cinematográfico, o Nano Banana 2 impulsiona a criação de imagens de alta fidelidade e o Gemini traz inteligência multimodal para cada fluxo de trabalho. Acesse o pacote completo de modelos do Google por meio de uma única API key com disponibilidade Day-0 e preços de pagamento conforme o uso (pay-as-you-go).

Ver Série

Seedance 2.0 Mini

O Seedance 2.0 Mini leva a geração de vídeo multimodal da ByteDance para fluxos de trabalho onde a velocidade e o custo são essenciais. Ele oferece os principais recursos do Seedance 2.0 com menor impacto — geração mais rápida, menor custo por vídeo e a mesma integração de API que você já usa. Para equipes que executam pipelines de alto volume ou prototipagem em escala, o Mini é a opção padrão prática.

Ver Série

ByteDance

Da geração de vídeo cinematográfico à criação de imagens de alta fidelidade, os modelos mais poderosos da ByteDance estão disponíveis no Atlas Cloud. Execute o Seedance e o Seedream em grande escala com os preços de inferência mais baixos e zero custos indiretos de infraestrutura.

Ver Série

Uma API para toda a IA de mídia.

Explorar Todos os Modelos