


Nano Banana 2.1 är Googles bildmodellfamilj byggd på Gemini 3.6 Flash. Den erbjuder generering och redigering på Pro-nivå med Flash-hastighet, stöder redigeringar och sammanslagningar på naturligt språk över 1 till 14 indatabilder och bibehåller konsekvens för upp till 4 figurer och 10 objekt. Via Atlas Cloud får utvecklare tillgång till modellfamiljen med en OpenAI-kompatibel nyckel, stabil drifttid och tillgänglighet från dag 0. Börja bygga idag.
Nano Banana 2.1 är utvecklad av Google. Atlas Cloud (som drivs av Atlas Cloud AI LLC) tillhandahåller åtkomst till modellen men äger den inte. Alla varumärken tillhör sina respektive ägare.
Atlas Cloud förser dig med de senaste branschledande kreativa modellerna.
Se hur Nano Banana 2.1 hanterar textgenerering, redigering av flera bilder och skapande av stillbilder med videovägledning i sex endpoints.
| Modalitet | Beskrivning |
|---|---|
| Nano Banana 2.1 Developer Reference-to-Image API | Skicka in ett källvideoklipp, valfria referensbilder och en prompt till denna endpoint för att skapa en ny stillbild. Kvalitet på Pro-nivå i Flash-hastighet passar för miniatyrbilder, affischer och sammanfattande infografik. |
| Nano Banana 2.1 Developer Edit API | Med instruktioner på naturligt språk kan denna endpoint redigera, ändra stil på eller slå samman 1 till 14 indata-bilder till en reviderad bild. Maskbaserad regionredigering och konsekvent återgivning av upp till 4 karaktärer och 10 objekt stöder kampanjvariationer, karaktärsscener och kompositioner med flera objekt. |
| Nano Banana 2.1 Developer Text-to-Image API | Med utgångspunkt i en textprompt skapar denna endpoint välkomponerade bilder från 1K till 4K. Exakt flerspråkig textrendering, justerbart tänkande och valfri förankring i Google Search gör den praktisk för affischer, produktbilder och informationsrika illustrationer. |
| Nano Banana 2.1 Reference-to-Image API | När en video innehåller det ögonblick du behöver kombinerar denna endpoint ett källvideoklipp, valfria referensbilder och en prompt för att skapa en stillbild. Använd kvaliteten på Pro-nivå och hastigheten på Flash-nivå för miniatyrbilder, affischer eller visuella sammanfattningar. |
| Nano Banana 2.1 Edit API | För komplexa kompositioner följer denna endpoint en instruktion på naturligt språk för att redigera, ändra stil på eller slå samman 1 till 14 källbilder. Den stöder maskbaserade regionala ändringar och bibehåller samtidigt konsekvent återgivning av upp till 4 karaktärer och 10 objekt, vilket passar varumärkesmaterial, scenrevisioner och ensemblebilder. |
| Nano Banana 2.1 Text-to-Image API | Behöver du välpolerad grafik från enbart text? Denna endpoint genererar välkomponerade bilder från 1K till 4K med exakt flerspråkig textrendering. Justerbart tänkande och valfri förankring i Google Search passar lokaliserade annonser, typografitunga designer och faktabaserat visuellt innehåll. |
Nano Banana 2.1 kombinerar Pro-generering från 1K till 4K, maskbaserad redigering, fusion av upp till 14 referensbilder, flerspråkig text, justerbar tankenivå, förankring med Google Search och videosstyrt skapande av stillbilder i ett enda Atlas Cloud API.
Nano Banana 2.1 bygger på Gemini 3.6 Flash och skapar bilder på Pro-nivå i Flash-hastighet i 1K, 2K eller 4K. Starkare följsamhet mot instruktioner hjälper komplexa kompositioner att hålla sig i linje med briefen även i krävande visuella format. Välj den upplösning som passar snabb iteration eller detaljerad produktionsleverans. Det passar kampanjmaterial, produktbilder och bearbetat redaktionellt innehåll.
Kombinera 1 till 14 inmatade bilder genom redigeringsflödet och styr sedan kompositionen med en instruktion på naturligt språk. Nano Banana 2.1 kan bevara konsekvensen för upp till 4 karaktärer och 10 objekt samtidigt som personer, produkter, rekvisita och stilar sammanförs. Det ger storyteam och handelsverktyg en praktisk väg till sammanhängande scener med flera motiv.
Behöver du ändra ett område utan att göra om hela bilden? Med maskbaserad regionredigering kan Nano Banana 2.1 rikta in sig på en vald detalj med hjälp av en instruktion på naturligt språk. Samma redigerings-endpoint kan ändra stil på eller slå samman källbilder samtidigt som konsekvensen för karaktärer och objekt skyddas. Använd det för produktretuschering, klädbyten eller kontrollerade kampanjvarianter i produktionstempo.
Precisionssäker flerspråkig textrendering gör ord till pålitliga delar av kompositionen, inte dekorativt brus. Nano Banana 2.1 kan placera läsbar text i bilder från 1K till 4K och samtidigt stödja strukturerade infografiklayouter. Kombinera tydliga textanvisningar med en stark visuell brief för att skapa banderoller, skyltar, menyer och informationsgrafik för granskning på olika marknader och i olika lokaliseringar.
Förvandla ett källvideoklipp, valfria referensbilder och en prompt till en ny stillbild. Arbetsflödet från referens till bild kondenserar visuellt sammanhang till en miniatyrbild, affisch eller sammanfattande infografik och bevarar samtidigt Pro-kvalitet i Flash-hastighet. Det är särskilt användbart när ett team behöver en publicerbar nyckelbild från befintligt videomaterial.
När en brief kräver mer omfattande resonemang eller aktuell kontext kan du justera tankenivån och vid behov aktivera förankring med Google Search. Nano Banana 2.1 samlar dessa kontroller tillsammans med textgenerering, redigering och videosstyrt skapande av stillbilder. Atlas Cloud samlar hela familjen via en enda OpenAI-kompatibel nyckel, med transparent förbrukningsbaserad prissättning enligt det verifierade standardpriset på $0.05 per anrop.
Se hur Nano Banana 2.1 och två Atlas Cloud-alternativ tolkar samma promptar inom typografi, komposition, ljussättning, rörelse och realistisk textur.
Ett dokumentärfotografi av ett avgörande ögonblick inne på ett hittegodskontor i en järnvägsterminal från 1990-talet: en ung kvinnlig tjänsteman har precis tryckt en trästämplad datumstämpel mot en hittegodslapp och lämnat ett skarpt vermiljonrött datumavtryck, när en gammal takfläkt plötsligt blåser upp dussintals papperslappar för hittegods i luften; varje lapp har ett tydligt läsbart unikt nummer, ett ortsnamn och en kort handskriven beskrivning av det borttappade föremålet. I samma ögonblick kommer en livlig iller ut ur en halvt öppen, repad läderresväska och rusar iväg med en repad mässingsnyckel hårt hållen i munnen, medan den skrämda tjänstemannen sträcker sig över den långa servicedisken för att stoppa den, med ett genuint chockerat uttryck och anatomiskt korrekta, naturliga händer fångade mitt i rörelsen. Disken skapar en stark diagonal ledlinje mot illern; tätt packade fyrkantiga förvaringsfack fyllda med varierande bagage och paket bildar lager av ramar i bilden bakom henne; flera flygande lappar passerar mycket nära linsen som en mjuk, oskarp förgrundsövertäckning och skapar djup och kontrollerat kaos. Direkt blixt på kameran på nära håll fryser tjänstemannen, illern, nyckeln och de närmaste lapparna med skarpa taktila detaljer, medan smala strimmor av kallt morgonljus tränger in genom persiennerna till höger, skär genom rummet och fångar luftburet damm, papperskanter och päls; selektiv rörelseoskärpa följer den snurrande fläkten och de mer avlägsna lapparna. Strikt begränsad palett av åldrat mintgrönt, tobaksbrunt och stämpelvermiljon, med ren tonal separation och inga grumliga färger. Framhäv fiberrikt papper, böjda hörn på lapparna, tryck från bläcket, sliten läderstruktur, avskavt målat trä, illerpäls, repad metall och subtilt analogt filmkorn. Autentiskt fotojournalistiskt bildspråk från 1990-talet, spontant mänskligt samspel, ofullkomliga men trovärdiga rumsliga relationer mellan händer, djur, nyckel, resväska, disk och luftburna papper; 35mm filmkamera, 28mm vidvinkelobjektiv, nära bildvinkel, f/5.6, återhållsam kontrast, realistisk hudtextur, lätt avtagande blixtljus, ingen överdrivet glansig rendering, inget HDR, ingen plasthud, inga överdrivna mikrodetaIjer, inget genomgående sken, inga filmiska ”episkt”-effekter, ingen fantasyatmosfär, bred horisontell komposition, bildförhållande 16:9, kant-till-kant.
Generated with Nano Banana 2.1 Text-to-Image on Atlas Cloud
Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud
Generated with Nano Banana 2 Text-to-Image on Atlas Cloud
Retro-surrealistisk reklamfotografi inne i en ljus bagageutlämningshall på en flygplats vid lunchtid, som fångar det avgörande ögonblicket när en av exakt tjugo identiska tomatröda hårdskalade resväskor plötsligt öppnas vid transportbandets kurva; en flock vikta pappersflyttfåglar bryter sig ut med subtil rörelseoskärpa, medan en fullskalig remsa av äkta böljande grönt gräs, rötter, jordsmulor och vindböjda strån omöjligt väller ut ur väskan. Bredvid den sträcker en stilfull ung resenär med kort silvergrått hår ut en anatomiskt korrekt hand för att fånga ett pass i luften, med uppspärrade ögon av förvåning och läppar som håller tillbaka ett skratt, naturlig hudtextur och spontant kroppsspråk. Fotografera från en extremt låg vinkel, nästan i kontakt med det rörliga bandet; använd transportbandets starka elliptiska ledlinje, den rytmiska upprepningen av de tjugo väskorna och lager på lager av speglingar i terminalens glas för att skapa ett djupt och precist rumsperspektiv. Skarpt riktat hårt middagsljus från takfönstren kastar rena, utdragna skuggor över borstad metall och polerade golv. Strikt begränsad palett av tomatrött, flygplatsblågrått och livfullt gräsgrönt; inga andra dominerande färger. Bevara autentiska repor i metallen, slitage på gummibandet, vikta klistermärkens kanter, präglade resväsktexturer, subtilt filmkorn och återhållsam rörelseoskärpa. Varje resväska har en fysiskt fastsatt, korrekt orienterad och läsbar vit bagagetagg med konsekvent ren typografi, inklusive den tydligt läsbara texten ”FLYGNING 208 • GATE C12 • VÄSKA 019”, utan nonsens eller svävande etiketter. Surrealistisk skala återgiven med fotografisk realism, sofistikerad reseannonseringskänsla från 1970- och 1980-talen, torr visuell humor, kontrollerade högdagrar, realistiska reflektioner samt sammanhängande händer, upprepade objekt, skuggor och perspektiv; ingen överdrivet glansig rendering, inget HDR-utseende, inga överdrivna mikrodetaIjer, ingen plasthud, inga grumliga färger, inget allestädes närvarande sken, ingen billig episk stämning, inga mörka undervattens- eller rymdruinsbilder. Filmisk 28mm vidvinkeloptik, låg kamerahöjd, skarpt fokusplan kring resenärens hand och den öppna resväskan, lätt analogt korn, förstklassig redaktionell färgseparation, bred horisontell komposition med bildförhållande 16:9, kant-till-kant-komposition.
Generated with Nano Banana 2.1 Text-to-Image on Atlas Cloud
Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud
Generated with Nano Banana 2 Text-to-Image on Atlas Cloud
I produkt-, medie- och redaktionella arbetsflöden omvandlar Nano Banana 2.1 prompter, bilder eller en källvideo till färdiga stillbilder, stöder flerspråkig typografi och kontrollerade redigeringar samt håller återkommande motiv konsekventa.
Nano Banana 2.1 återger exakt flerspråkig text i färdiga kampanjbilder utifrån prompter på naturligt språk. Skapa lokaliserade affischer, lanseringsgrafik och sociala annonser för globala målgrupper utan att manuellt bygga om varje komposition.
Kombinera upp till 14 referensbilder samtidigt som enhetligheten bevaras för upp till fyra karaktärer och tio objekt. Produktteam kan skapa katalogscener, säsongsvarianter och varumärkesanpassade kompositioner från befintliga visuella resurser.
Håll upp till fyra karaktärer igenkännbara samtidigt som du ändrar kläder, miljöer eller stilar genom vägledda redigeringar. Storytelling-appar, spelteam och seriebaserade kampanjer får en sammanhängande visuell ensemble i många relaterade resurser.
Markera ett område och beskriv ändringen för fokuserade redigeringar som bevarar det omgivande innehållet. Retuschera produktbilder, ersätt enskilda objekt eller anpassa kreativt material utan att återskapa hela bilden från grunden.
Förvandla ett videoklipp, valfria referensbilder och en prompt till en ny stillbild. Skapa miniatyrbilder, reklamaffischer eller sammanfattande infografik för kreatörer, utgivare och verktyg för medieautomatisering i stor skala.
Använd valfri förankring via Google Search tillsammans med exakt textrendering för att skapa aktuella bilder baserade på aktuell information. Utvecklare kan bygga redaktionell grafik, förklaringar av evenemang och ämnesbaserad infografik för redaktioner, utbildare eller innehållsplattformar.
Jämför Nano Banana 2.1 med andra modeller för bildredigering utifrån utdataupplösning, antal referensbilder och standardpris per bild.
| Modell | Maximal utdataupplösning | Maximalt antal referensbilder | Standardbaspris |
|---|---|---|---|
| Nano Banana 2.1 Edit | 4K | 14 | Från $0.05/bild |
| Qwen Image 3.0 Edit | 2K | 3 | Från $0.03/bild |
| Grok Imagine Image 2.0 Edit | 2K | 3 | Från $0.04/bild |
Get started in minutes — follow these simple steps to integrate and deploy models through Atlas Cloud’s platform.
Registrera dig på atlascloud.ai och slutför verifieringen. Nya användare får gratis krediter för att utforska plattformen och testa modeller.
Att kombinera de avancerade Nano Banana 2.1-modellerna med Atlas Clouds GPU-accelererade plattform ger oöverträffad prestanda, skalbarhet och utvecklarupplevelse.
Låg Latens:
GPU-optimerad inferens för realtidsresonemang.
Enhetligt API:
Kör Nano Banana 2.1, GPT, Gemini och DeepSeek med en integration.
Transparent Prissättning:
Förutsägbar fakturering per token med serverlösa alternativ.
Utvecklarupplevelse:
SDK:er, analys, finjusteringsverktyg och mallar.
Tillförlitlighet:
99.99% drifttid, RBAC och efterlevnadsredo loggning.
Säkerhet & Efterlevnad:
SOC 2 Type II, HIPAA-anpassning, datasuveränitet i USA.
Nano Banana 2.1 är Googles modell för bildgenerering och konversationsbaserad redigering, byggd på Gemini 3.6 Flash. Atlas Cloud tillhandahåller sex endpoints för arbetsflöden med text-till-bild, bildredigering och referens-till-bild.
Skapa komponerade bilder i upplösningar från 1K till 4K utifrån textpromptar, inklusive designer som kräver flerspråkig text. Befintliga bilder kan redigeras, omstajlas eller slås samman samtidigt som upp till fyra karaktärer och tio objekt bevaras. Ett separat arbetsflöde omvandlar ett källvideoklipp, valfria referenser och en prompt till en stillbild.
Välj den endpoint som motsvarar ditt arbetsflöde för text-till-bild, redigering eller referens-till-bild. Skicka de obligatoriska prompt- och medieindata med det angivna modell-ID:t via Atlas Clouds OpenAI-kompatibla API. Granska endpoint-schemat innan du lägger till valfria inställningar.
Använd text-to-image när du börjar med en skriven prompt och edit när du omvandlar, omstajlar eller kombinerar befintliga bilder. Välj reference-to-image när ett videoklipp ska styra kompositionen för en ny stillbild. Varje arbetsflöde har både Developer- och standardvarianter av endpointen.
För text-to-image-förfrågningar stöder modellen utdata från 1K till 4K, justerbart tänkande, rendering av flerspråkig text och valfri Google Search-grounding. Redigering accepterar mellan 1 och 14 bilder och stöder regionala ändringar baserade på masker. Reference-to-image börjar med ett källvideoklipp och kan även använda referensbilder.
Atlas Cloud anger ett standardiserat grundpris på $0.05 per anrop för vart och ett av de sex tillgängliga endpointsen. Detta gäller arbetsflödena text-till-bild, edit och reference-to-image i båda de angivna varianterna.
Jämfört med Nano Banana 2 rapporterar Google förbättringar av visuell kvalitet, följsamhet till promptar, rendering av flerspråkig text och konsekvens vid upprepade redigeringar. Nano Banana 2.1 positioneras som det effektiva alternativet till Nano Banana Pro och kombinerar bildergenskaper på Pro-nivå med hastighet på Flash-nivå. Testa representativa produktionspromptar innan du ersätter ett etablerat arbetsflöde.
Om en instruktion förbises bör du placera det kritiska kravet först, omge exakt text med citattecken och ange vilka element som måste förbli oförändrade. Vid redigering bör du begränsa dig till en större ändring åt gången och tydligt identifiera målområdet. Granska text, identiteter och orörda områden innan du publicerar resultatet.
Nej, de tillgängliga endpointsen returnerar stillbilder i stället för videor. Arbetsflödet reference-to-image använder ett källvideoklipp som kontext för att skapa en miniatyr, affisch, sammanfattande infografik eller annan stillbildskomposition.
Guider, handledningar och produktnyheter som hjälper dig att få ut mesta möjliga av Atlas Cloud.