


Nano Banana 2.1 é a família de modelos de imagem do Google baseada no Gemini 3.6 Flash. Oferece geração e edição de nível Pro com a velocidade do Flash, permite edições em linguagem natural e combinações entre 1 e 14 imagens de entrada, além de manter a consistência de até 4 personagens e 10 objetos. Por meio do Atlas Cloud, os desenvolvedores podem acessar a família com uma única chave compatível com OpenAI, disponibilidade confiável e disponibilidade desde o Dia 0. Comece a criar hoje.
Nano Banana 2.1 foi desenvolvido pela Google. A Atlas Cloud (operada pela Atlas Cloud AI LLC) fornece acesso ao modelo, mas não é sua proprietária. Todas as marcas registradas pertencem aos seus respectivos titulares.
O Atlas Cloud oferece os modelos criativos mais avançados e inovadores do setor.
Veja como o Nano Banana 2.1 lida com geração de texto, edição de várias imagens e criação de imagens estáticas guiada por vídeo em seis endpoints.
| Modalidade | Descrição |
|---|---|
| Nano Banana 2.1 Developer Reference-to-Image API | Envie um clipe de vídeo de origem, imagens de referência opcionais e um prompt para este endpoint criar uma nova imagem estática. Sua qualidade de nível Pro com velocidade de nível Flash é ideal para miniaturas, pôsteres e infográficos resumidos. |
| Nano Banana 2.1 Developer Edit API | Instruções em linguagem natural permitem que este endpoint edite, reformule o estilo ou combine de 1 a 14 imagens de entrada em uma imagem revisada. Edições regionais baseadas em máscaras e consistência para até 4 personagens e 10 objetos viabilizam variações de campanha, cenas com personagens e composições com vários objetos. |
| Nano Banana 2.1 Developer Text-to-Image API | A partir de um prompt de texto, este endpoint cria imagens bem compostas de 1K a 4K. A renderização precisa de texto multilíngue, o raciocínio ajustável e o grounding opcional com o Google Search tornam-no prático para pôsteres, imagens de produtos e gráficos ricos em informações. |
| Nano Banana 2.1 Reference-to-Image API | Quando um vídeo contém o momento de que você precisa, este endpoint combina um clipe de origem, imagens de referência opcionais e um prompt para criar uma imagem estática. Use sua qualidade de nível Pro e velocidade de nível Flash para miniaturas, pôsteres ou resumos visuais. |
| Nano Banana 2.1 Edit API | Para composições complexas, este endpoint segue uma instrução em linguagem natural para editar, reformular o estilo ou combinar de 1 a 14 imagens de origem. Ele é compatível com alterações regionais baseadas em máscaras, mantendo a consistência de até 4 personagens e 10 objetos, o que o torna adequado para ativos de marca, revisões de cenas e ilustrações com vários elementos. |
| Nano Banana 2.1 Text-to-Image API | Precisa de uma arte refinada criada apenas a partir de texto? Este endpoint gera imagens bem compostas de 1K a 4K com renderização precisa de texto multilíngue. O raciocínio ajustável e o grounding opcional com o Google Search são ideais para anúncios localizados, designs com forte presença tipográfica e conteúdo visual fundamentado. |
Nano Banana 2.1 combina geração de nível Pro de 1K a 4K, edição baseada em máscara, fusão de até 14 imagens de referência, texto multilíngue, nível de raciocínio ajustável, grounding com Google Search e criação de imagens estáticas guiada por vídeo em uma única Atlas Cloud API.
Baseado no Gemini 3.6 Flash, o Nano Banana 2.1 produz visuais de nível Pro na velocidade do Flash em 1K, 2K ou 4K. A maior aderência aos prompts ajuda composições complexas a permanecerem alinhadas ao briefing em formatos visuais exigentes. Escolha a resolução adequada para iterações rápidas ou entregas detalhadas de produção. É ideal para artes de campanhas, imagens de produtos e trabalhos editoriais refinados.
Combine de 1 a 14 imagens de entrada pelo fluxo de edição e, em seguida, oriente a composição com uma instrução em linguagem natural. O Nano Banana 2.1 pode preservar a consistência de até 4 personagens e 10 objetos ao mesclar pessoas, produtos, elementos de cena e estilos. Isso oferece a equipes de storytelling e ferramentas de comércio eletrônico um caminho prático para criar cenas coerentes com múltiplos elementos.
Precisa alterar uma área sem redesenhar todo o quadro? A edição de regiões baseada em máscara permite que o Nano Banana 2.1 direcione uma área selecionada por meio de uma instrução em linguagem natural. O mesmo endpoint de edição pode alterar o estilo ou mesclar imagens de origem, preservando a consistência de personagens e objetos. Use-o para retoques de produtos, mudanças de vestuário ou variações controladas de campanhas em velocidade de produção.
A renderização precisa de texto multilíngue transforma as palavras em elementos confiáveis da composição, em vez de ruído decorativo. O Nano Banana 2.1 pode inserir textos legíveis em imagens de 1K a 4K, com suporte a layouts estruturados de infográficos. Combine instruções claras de texto com um briefing visual consistente para criar banners, placas, menus e gráficos informativos para revisão em diferentes mercados e localidades.
Transforme um clipe de vídeo de origem, imagens de referência opcionais e um prompt em uma nova imagem estática. O fluxo de referência para imagem condensa o contexto visual em uma miniatura, um pôster ou um infográfico de resumo, mantendo a qualidade de nível Pro na velocidade do Flash. É especialmente útil quando uma equipe precisa de um visual principal pronto para publicação a partir de uma filmagem existente.
Quando um briefing depende de um raciocínio mais aprofundado ou de contexto atual, ajuste o nível de raciocínio e, opcionalmente, habilite o grounding com Google Search. O Nano Banana 2.1 mantém esses controles junto à geração de texto, à edição e à criação de imagens estáticas guiada por vídeo. A Atlas Cloud reúne a família por meio de uma única key compatível com OpenAI, com preços transparentes no modelo pay-as-you-go à tarifa padrão verificada de $0.05 por chamada.
Veja como o Nano Banana 2.1 e duas alternativas do Atlas Cloud interpretam os mesmos prompts em tipografia, composição, iluminação, movimento e textura realista.
Uma fotografia documental do instante decisivo dentro do escritório de achados e perdidos de uma estação ferroviária dos anos 1990: uma jovem funcionária acaba de pressionar um carimbo de data com cabo de madeira sobre um formulário de reivindicação, deixando uma nítida impressão de data em vermelhão, quando um velho ventilador de teto subitamente lança dezenas de etiquetas de objetos perdidos pelo ar; cada etiqueta traz um número único claramente legível, o nome de um lugar e uma breve descrição manuscrita do item perdido. No mesmo instante, um furão agitado emerge de uma mala de couro arranhada e entreaberta e dispara com uma chave de latão riscada presa entre os dentes, enquanto a funcionária assustada se estende sobre o longo balcão de atendimento para interceptá-lo, com uma expressão genuinamente chocada e mãos anatomicamente corretas, naturais e capturadas no meio do movimento. O balcão cria uma forte linha diagonal de condução em direção ao furão; compartimentos quadrados de armazenamento densamente preenchidos com malas e pacotes variados formam molduras em camadas dentro da cena atrás dela; várias etiquetas voadoras passam muito perto da lente como uma oclusão suave e desfocada em primeiro plano, criando profundidade e caos controlado. O flash direto de câmera, disparado a curta distância, congela a funcionária, o furão, a chave e as etiquetas mais próximas com detalhes táteis nítidos, enquanto estreitas lâminas de luz solar fria da manhã entram pelas persianas venezianas à direita, atravessando a sala e captando a poeira suspensa, as bordas do papel e os pelos; um desfoque de movimento seletivo deixa rastros no ventilador giratório e nas etiquetas mais distantes. Paleta estritamente limitada de verde-menta envelhecido, marrom-tabaco e vermelhão do carimbo, com separação tonal limpa e sem cores turvas. Enfatize o papel fibroso, os cantos curvados das etiquetas, a pressão da tinta, o couro desgastado, a madeira pintada descascada, os pelos do furão, o metal riscado e um sutil grão de filme analógico. Fotojornalismo autêntico dos anos 1990, interação humana espontânea, relações espaciais imperfeitas porém críveis entre mãos, animal, chave, mala, balcão e papéis suspensos no ar; câmera de filme 35mm, lente grande-angular de 28mm, ponto de vista próximo, f/5.6, contraste contido, textura de pele realista, leve queda de intensidade do flash, sem renderização excessivamente oleosa, sem HDR, sem pele plástica, sem microdetalhes excessivos, sem brilho universal, sem efeitos cinematográficos “épicos”, sem atmosfera fantástica, composição horizontal ampla, proporção 16:9, sangria total.
Generated with Nano Banana 2.1 Text-to-Image on Atlas Cloud
Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud
Generated with Nano Banana 2 Text-to-Image on Atlas Cloud
Fotografia publicitária retro-surrealista dentro de um saguão iluminado de retirada de bagagens de um aeroporto ao meio-dia, capturando o instante decisivo em que uma de exatamente vinte malas rígidas idênticas, vermelhas como tomate, subitamente se abre na curva da esteira; um bando de aves migratórias feitas de papel dobrado irrompe para fora com um sutil desfoque de movimento, enquanto uma faixa em tamanho real de grama verde viva, com raízes, migalhas de terra e lâminas curvadas pelo vento, jorra de modo impossível da mala. Ao lado, uma jovem viajante elegante, com cabelo curto grisalho-prateado, estende a mão anatomicamente correta para apanhar um passaporte no meio do voo, com os olhos arregalados de surpresa e os lábios contendo o riso, textura de pele natural e linguagem corporal espontânea. Fotografe de um ângulo extremamente baixo, quase tocando a esteira em movimento; use a forte linha de condução elíptica da esteira, a repetição rítmica das vinte malas e os reflexos em camadas no vidro do terminal para criar uma perspectiva espacial profunda e precisa. A luz solar forte e direcional do meio-dia, vinda das claraboias, projeta sombras alongadas e nítidas sobre o metal escovado e o piso polido. Paleta estritamente limitada de vermelho-tomate, azul-acinzentado de aeroporto e verde vívido da grama; nenhuma outra cor dominante. Preserve riscos autênticos no metal, desgaste da correia de borracha, bordas dobradas dos adesivos, texturas em relevo das malas, grão sutil de filme e desfoque de movimento contido. Cada mala traz uma etiqueta branca de bagagem fisicamente presa, corretamente orientada e legível, com tipografia limpa e consistente, incluindo o texto claramente legível “FLIGHT 208 • GATE C12 • BAG 019”, sem texto sem sentido nem etiquetas flutuantes. Escala surrealista renderizada com realismo fotográfico, sofisticada sensibilidade de publicidade de viagens dos anos 1970–1980, humor visual seco, realces controlados, reflexos realistas, mãos, objetos repetidos, sombras e perspectiva coerentes; sem renderização excessivamente oleosa, sem aparência de HDR, sem microdetalhes excessivos, sem pele plástica, sem cores turvas, sem brilho onipresente, sem atmosfera épica barata, sem imagens escuras subaquáticas ou de ruínas espaciais. Lente grande-angular cinematográfica de 28mm, câmera em baixa altura, plano focal nítido ao redor da mão da viajante e da mala aberta, leve grão analógico, separação cromática editorial premium, proporção horizontal ampla 16:9, composição de sangria total de ponta a ponta.
Generated with Nano Banana 2.1 Text-to-Image on Atlas Cloud
Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud
Generated with Nano Banana 2 Text-to-Image on Atlas Cloud
Em pipelines de produto, mídia e editorial, o Nano Banana 2.1 transforma prompts, imagens ou um vídeo de origem em imagens estáticas refinadas, oferece suporte a tipografia multilíngue e edições controladas, e mantém a consistência de elementos recorrentes.
O Nano Banana 2.1 renderiza textos multilíngues precisos em visuais de campanha refinados a partir de prompts em linguagem natural. Crie pôsteres localizados, peças de lançamento e anúncios para redes sociais voltados a públicos globais sem precisar reconstruir manualmente cada composição.
Combine até 14 imagens de referência mantendo a consistência de até quatro personagens e dez objetos. Equipes de produto podem montar cenas de catálogo, variações sazonais e composições de marca a partir de ativos visuais existentes.
Mantenha até quatro personagens reconhecíveis enquanto altera roupas, cenários ou estilos por meio de edições guiadas. Aplicativos de storytelling, equipes de jogos e campanhas seriadas obtêm elencos visuais coerentes em vários ativos relacionados.
Marque uma região e descreva a alteração para realizar edições focadas que preservam o conteúdo ao redor. Retoque fotos de produtos, substitua objetos isolados ou adapte ativos criativos sem reconstruir a imagem inteira do zero.
Transforme um clipe de vídeo de origem, imagens de referência opcionais e um prompt em uma nova imagem estática. Produza miniaturas, pôsteres promocionais ou infográficos resumidos para criadores, publishers e ferramentas de automação de mídia em escala.
Use o grounding opcional do Google Search com renderização precisa de texto para criar visuais oportunos informados por informações atuais. Desenvolvedores podem criar gráficos editoriais, explicações de eventos e infográficos sobre temas atuais para redações, educadores ou plataformas de conteúdo.
Compare o Nano Banana 2.1 com outros modelos de edição de imagens por resolução de saída, capacidade de imagens de referência e preço padrão por imagem.
| Modelo | Resolução máxima de saída | Máximo de imagens de referência | Preço base padrão |
|---|---|---|---|
| Nano Banana 2.1 Edit | 4K | 14 | A partir de $0.05/imagem |
| Qwen Image 3.0 Edit | 2K | 3 | A partir de $0.03/imagem |
| Grok Imagine Image 2.0 Edit | 2K | 3 | A partir de $0.04/imagem |
Comece em minutos — siga estes passos simples para integrar e implantar modelos pela plataforma da Atlas Cloud.
Cadastre-se em atlascloud.ai e conclua a verificação. Novos usuários recebem créditos gratuitos para explorar a plataforma e testar modelos.
Combine modelos avançados de Nano Banana 2.1 com a plataforma acelerada por GPU do Atlas Cloud, fornecendo desempenho, escalabilidade e experiência de desenvolvimento incomparáveis.
Baixa Latência:
Inferência otimizada por GPU para respostas em tempo real.
API Unificada:
Uma única integração para acessar Nano Banana 2.1, GPT, Gemini e DeepSeek.
Preços Transparentes:
Faturamento por Token, suporta modo Serverless.
Experiência do Desenvolvedor:
SDK, análise de dados, ferramentas de ajuste fino e modelos tudo em um.
Confiabilidade:
99.99% de disponibilidade, controle de permissões RBAC, logs de conformidade.
Segurança e Conformidade:
Certificação SOC 2 Type II, conformidade HIPAA, soberania de dados nos EUA.
O Nano Banana 2.1 é o modelo de geração de imagens e edição conversacional do Google, desenvolvido com base no Gemini 3.6 Flash. O Atlas Cloud oferece seis endpoints que abrangem fluxos de trabalho de texto para imagem, edição de imagens e referência para imagem.
Crie imagens compostas em resoluções de 1K a 4K a partir de prompts de texto, incluindo designs que exigem texto multilíngue. Imagens existentes podem ser editadas, reestilizadas ou combinadas, preservando até quatro personagens e dez objetos. Um fluxo de trabalho separado converte um clipe de vídeo de origem, referências opcionais e um prompt em uma imagem estática.
Escolha o endpoint correspondente ao seu fluxo de trabalho de texto para imagem, edição ou referência para imagem. Envie o prompt e as entradas de mídia obrigatórios usando o ID do modelo indicado pela API compatível com OpenAI do Atlas Cloud. Consulte o esquema do endpoint antes de adicionar controles opcionais.
Use texto para imagem quando começar com um prompt escrito e edição ao transformar, reestilizar ou combinar imagens existentes. Selecione referência para imagem quando um clipe de vídeo deve orientar a composição de uma nova imagem estática. Cada fluxo de trabalho tem variantes de endpoint Developer e padrão.
Para solicitações de texto para imagem, o modelo é compatível com saídas de 1K a 4K, nível de raciocínio ajustável, renderização de texto multilíngue e grounding opcional com o Google Search. A edição aceita entre 1 e 14 imagens e permite alterações regionais baseadas em máscara. A referência para imagem começa com um clipe de vídeo de origem e também pode usar imagens de referência.
O Atlas Cloud lista um preço-base padrão de US$ 0,05 por chamada para cada um dos seis endpoints disponíveis. Isso se aplica aos fluxos de trabalho de texto para imagem, edição e referência para imagem em ambas as variantes listadas.
Em comparação com o Nano Banana 2, o Google relata melhorias na qualidade visual, na aderência ao prompt, na renderização de texto multilíngue e na consistência entre edições repetidas. O Nano Banana 2.1 é apresentado como a alternativa eficiente ao Nano Banana Pro, combinando recursos de imagem no nível do Pro com a velocidade do Flash. Teste prompts representativos de produção antes de substituir um fluxo de trabalho já estabelecido.
Se uma instrução for ignorada, coloque o requisito crítico primeiro, use aspas para qualquer texto exato e indique quais elementos devem permanecer inalterados. Para edição, isole uma alteração importante por vez e identifique claramente a região-alvo. Revise o texto, as identidades e as áreas que não deveriam ter sido alteradas antes de publicar o resultado.
Não, os endpoints disponíveis retornam imagens estáticas, não vídeos. O fluxo de trabalho de referência para imagem usa um clipe de vídeo de origem como contexto para criar uma miniatura, um pôster, um infográfico-resumo ou outra composição estática.
Guias, tutoriais e novidades de produto para você aproveitar ao máximo a Atlas Cloud.