Hero background 1Hero background 2Hero background 3

Nano Banana 2.1 Pro Quality at Flash Speed

Nano Banana 2.1 是 Google 基於 Gemini 3.6 Flash 打造的影像模型系列。它以 Flash 等級的速度提供 Pro 等級的生成與編輯功能,支援以自然語言對 1 至 14 張輸入影像進行編輯與合併,並可維持最多 4 個角色與 10 個物件的一致性。透過 Atlas Cloud,開發者只需一組 OpenAI 相容金鑰,即可使用此系列模型,享有可靠的服務可用性與 Day-0 上線支援。立即開始打造。

Nano Banana 2.1 由 Google 開發。Atlas Cloud(由 Atlas Cloud AI LLC 營運)僅提供接取服務,並不擁有該模型。所有商標均歸其各自所有者所有。

探索領先模型

Atlas Cloud 為您提供最新的行業領先創意模型。

比較六個 Nano Banana 2.1 圖像端點

了解 Nano Banana 2.1 如何在六個端點中處理文字生成、多圖像編輯,以及影片引導的靜態圖像建立。

模態說明
Nano Banana 2.1 Developer Reference-to-Image API將一段來源影片片段、可選的參考圖像和提示詞輸入此端點,即可產生新的靜態圖像。其 Pro 級畫質搭配 Flash 級速度,適合用於縮圖、海報和摘要資訊圖表。
Nano Banana 2.1 Developer Edit API透過自然語言指令,此端點可將 1 至 14 張輸入圖像編輯、重新設計風格或合併成修訂後的圖像。支援以遮罩為基礎的區域編輯,並可讓最多 4 個角色和 10 個物件維持一致性,適用於行銷活動變體、角色場景和多物件構圖。
Nano Banana 2.1 Developer Text-to-Image API從文字提示詞開始,此端點可建立 1K 至 4K 的良好構圖圖像。精準的多語言文字渲染、可調整的思考程度,以及可選的 Google Search grounding,讓它適合用於海報、產品視覺和資訊豐富的圖形。
Nano Banana 2.1 Reference-to-Image API當影片中包含所需的畫面時,此端點會結合一段來源片段、可選的參考圖像和提示詞,建立靜態圖像。其 Pro 級畫質與 Flash 級速度適合用於縮圖、海報或視覺摘要。
Nano Banana 2.1 Edit API針對複雜合成,此端點會依照自然語言指令編輯、重新設計風格或合併 1 至 14 張來源圖像。它支援以遮罩為基礎的區域變更,同時維持最多 4 個角色和 10 個物件的一致性,適合品牌素材、場景修訂和群像作品。
Nano Banana 2.1 Text-to-Image API只靠文字也需要精緻的作品嗎?此端點可生成構圖完善的 1K 至 4K 圖像,並提供精準的多語言文字渲染。可調整的思考程度與可選的 Google Search grounding,適合在地化廣告、以排版為主的設計,以及具備資訊根據的視覺內容。

Nano Banana 2.1:Pro 品質,Flash 速度

Nano Banana 2.1 將 Pro 級 1K 至 4K 生成、基於遮罩的編輯、最多 14 張參考圖片的融合、多語言文字、可調整的思考程度、Google Search grounding,以及影片引導的靜態圖像生成,整合於單一 Atlas Cloud API 中。

Nano Banana 2.1,支援 4K

Nano Banana 2.1 建立於 Gemini 3.6 Flash 之上,能以 Flash 級速度產出 Pro 級視覺內容,支援 1K、2K 或 4K。更強的提示詞遵循能力,讓複雜構圖在各種高要求的視覺格式中,都能維持與需求說明一致。選擇適合快速迭代或細緻製作交付的解析度。適用於行銷活動主視覺、產品影像與精緻的編輯設計。

14 張參考圖,融合為單一場景

透過編輯工作流程合併 1 至 14 張輸入圖片,再以自然語言指令引導構圖。Nano Banana 2.1 能在融合人物、產品、道具與風格的同時,維持最多 4 個角色與 10 個物件的一致性。這為故事團隊與電商工具提供了實用的方法,打造協調一致的多主體場景。

Nano Banana 2.1 遮罩編輯

需要修改某個區域,又不想重新設計整個畫面嗎?基於遮罩的區域編輯功能,讓 Nano Banana 2.1 透過自然語言指令鎖定選定的細節。同一個編輯 endpoint 也能在維持角色與物件一致性的同時,重新設計風格或融合來源圖片。可用於產品修圖、服裝變更,或以製作速度產出受控的行銷活動版本。

精準的多語言排版

精準的多語言文字渲染,讓文字成為構圖中可靠的一部分,而非裝飾性雜訊。Nano Banana 2.1 能在 1K 至 4K 圖像中放置清晰可讀的文字,並支援結構化資訊圖表版面。將明確的文案指示與完整的視覺需求結合,即可製作橫幅、招牌、選單與資訊圖形,供不同市場與地區進行審閱。

從影片片段生成靜態圖像

將一段來源影片、可選的參考圖片與提示詞,轉換為全新的靜態圖像。參考圖轉圖像工作流程會將視覺脈絡濃縮為縮圖、海報或摘要資訊圖表,同時以 Flash 級速度保有 Pro 級品質。當團隊需要從現有素材中產出可發布的主視覺時,這項功能尤其實用。

具備思考與搜尋功能的 Nano Banana 2.1

當需求仰賴更深入的推理或最新資訊時,可調整思考層級,並選擇啟用 Google Search grounding。Nano Banana 2.1 將這些控制項與文字生成、編輯及影片引導的靜態圖像生成整合在一起。Atlas Cloud 透過單一 OpenAI-compatible 金鑰整合整個模型系列,並以每次呼叫 $0.05 的經驗證標準費率,提供透明的隨用隨付定價。

Nano Banana 2.1 正面對決:一個提示詞,三個模型

看看 Nano Banana 2.1 與兩個 Atlas Cloud 替代方案,如何在字體、構圖、光線、動態與寫實質感方面詮釋相同的提示詞。

提示詞

一張捕捉決定性瞬間的紀實照片,場景位於一間荒置於 1990 年代鐵路車站內的遺失物招領辦公室:年輕女職員剛將木柄日期印章壓在申領表上,留下清晰的朱紅色日期印記;此時老舊吊扇突然將數十張紙製認領標籤吹向空中。每張標籤上都有清楚可辨識的獨特編號、地名,以及簡短的手寫遺失物描述。就在同一瞬間,一隻活潑的雪貂從半開且磨損的皮革行李箱中竄出,嘴裡咬著一把刮花的黃銅鑰匙疾奔而去;受驚的職員伸手越過長形服務櫃檯試圖攔住牠,表情真實震驚,雙手符合解剖結構、自然且捕捉於動作之中。櫃檯形成一條強烈的對角線引導視線通往雪貂;她身後密集排列的方形儲物格,裝滿各式行李與包裹,構成層層相套的框中框;數張飛舞的標籤非常靠近鏡頭掠過,形成柔和失焦的前景遮擋,營造景深與受控的混亂感。近距離直接機頂閃光燈以清晰的觸覺細節凝結職員、雪貂、鑰匙與最近的標籤;同時,右側百葉窗透入狹窄的冷色晨光光束,橫切整個房間,照亮空氣中的塵埃、紙張邊緣與毛皮;選擇性動態模糊讓旋轉中的吊扇及較遠的標籤留下拖影。嚴格限制色盤為陳舊薄荷綠、菸草棕與印章朱紅,色調分離乾淨,避免混濁色彩。強調紙張纖維、捲曲的標籤邊角、墨水壓痕、磨損的皮革紋理、剝落漆面的木頭、雪貂毛皮、刮痕金屬與細微的類比底片顆粒。真實的 1990 年代新聞攝影風格、自然的人類互動,以及手部、動物、鑰匙、行李箱、櫃檯與空中紙張之間不完美卻可信的空間關係;35mm 底片相機、28mm 廣角鏡頭、近距離視角、f/5.6、克制的對比度、寫實肌理的皮膚、輕微閃光衰減;不要油膩的過度渲染、不要 HDR、不要塑膠感皮膚、不要過度微細節、不要無所不在的光暈、不要電影式的「史詩」效果、不要奇幻氛圍;寬幅橫向構圖、16:9 長寬比、滿版出血。

Generated with Nano Banana 2.1 Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Nano Banana 2 Text-to-Image on Atlas Cloud

提示詞

復古超現實主義廣告攝影,場景位於正午時分明亮的機場行李提領大廳,捕捉一個決定性瞬間:傳送帶彎道處,二十個完全相同的番茄紅硬殼行李箱中,恰有一個突然彈開;一群折疊紙製候鳥向外爆發,帶有細微動態模糊;一整片真實比例的滾動綠草,包括根部、泥土碎屑與被風吹彎的草葉,不可能地從箱內傾瀉而出。旁邊,一位留著銀灰色短髮、穿著時髦的年輕旅客伸出符合解剖結構的手,接住飛行中的護照;她雙眼因驚訝而睜大,嘴唇抑制著笑意,具備自然的皮膚質感與率真的肢體語言。從極低角度拍攝,鏡頭幾乎貼近移動中的傳送帶;運用傳送帶強烈的橢圓形引導線、二十個箱子的節奏性重複,以及航廈玻璃中的層疊倒影,營造深邃而精準的空間透視。正午天窗上方射下清晰的定向硬光,在拉絲金屬與拋光地板上投射出乾淨而修長的陰影。嚴格限制色盤為番茄紅、機場藍灰與鮮豔草綠;不要其他主導色。保留真實的金屬刮痕、橡膠傳送帶磨損、折疊貼紙邊緣、壓花行李箱紋理、細微底片顆粒與克制的動態模糊。每個行李箱都貼有實體連接、方向正確且清晰可讀的白色行李標籤,字體一致且乾淨,包含清楚可讀的文字「航班 208 • 登機門 C12 • 行李 019」,不要亂碼或漂浮標籤。以攝影寫實風格呈現超現實比例,具備成熟的 1970 年代至 1980 年代旅遊廣告美學、乾冷的視覺幽默、受控高光、寫實倒影,以及連貫可信的手部、重複物件、陰影與透視;不要油膩的過度渲染、不要 HDR 外觀、不要過度微細節、不要塑膠感皮膚、不要混濁色彩、不要無所不在的光暈、不要廉價的史詩氛圍、不要黑暗的水下或太空遺跡意象。電影感 28mm 廣角鏡頭、低機位、旅客手部與打開的行李箱周圍保持銳利焦平面、輕微類比顆粒、高級編輯風格的色彩分離、寬幅橫向 16:9 長寬比、邊到邊滿版構圖。

Generated with Nano Banana 2.1 Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Nano Banana 2 Text-to-Image on Atlas Cloud

Nano Banana 2.1 應用於各類生產工作流程

在產品、媒體與編輯流程中,Nano Banana 2.1 能將提示詞、圖片或來源影片轉化為精緻的靜態影像,支援多語言文字排版與可控編輯,並維持重複出現主體的一致性。

Nano Banana 2.1 應用於在地化行銷活動

Nano Banana 2.1 能根據自然語言提示詞,在精緻的行銷視覺中呈現精準的多語言文字。無需手動重建每個版面,即可為全球受眾製作在地化海報、上市宣傳圖像與社群廣告。

多重參考產品場景

最多可結合 14 張參考圖片,同時維持最多 4 個角色與 10 個物件的一致性。產品團隊可以運用現有視覺素材,組合目錄場景、季節性變體與品牌化構圖。

Nano Banana 2.1 角色世界

透過引導式編輯,在變更服裝、場景或風格的同時,維持最多 4 個角色的辨識度。說故事應用程式、遊戲團隊與系列化行銷活動,都能在大量相關素材中維持一致的視覺角色陣容。

用於生產流程的精準編輯

標記特定區域並描述變更內容,即可進行局部編輯,同時保留周圍內容。無需從頭重建整張圖片,即可修飾產品照片、替換獨立物件,或調整創意素材。

將影片畫格轉化為行銷素材

只需一段來源影片、可選的參考圖片與提示詞,即可產生新的靜態影像。創作者、出版商與媒體自動化工具能大規模製作縮圖、宣傳海報或摘要資訊圖表。

具備資訊依據的編輯圖像

搭配精準文字渲染與可選的 Google Search grounding,根據最新資訊建立即時且有依據的視覺內容。開發者可以為新聞編輯室、教育工作者或內容平台打造編輯圖像、活動解說圖與熱門議題資訊圖表。

Nano Banana 2.1 圖像編輯比較

依據輸出解析度、參考圖像數量上限與標準單張定價,比較 Nano Banana 2.1 與其他圖像編輯模型。

模型最高輸出解析度參考圖像數量上限標準基本價格
Nano Banana 2.1 Edit4K14每張 $0.05 起
Qwen Image 3.0 Edit2K3每張 $0.03 起
Grok Imagine Image 2.0 Edit2K3每張 $0.04 起

如何在 Atlas Cloud 上使用 Nano Banana 2.1

幾分鐘即可上手 — 按照以下簡單步驟,透過 Atlas Cloud 平台整合和部署模型。

建立 Atlas Cloud 帳戶

在 atlascloud.ai 註冊並完成驗證。新用戶可獲得免費額度,用於探索平台和測試模型。

為何在 Atlas Cloud 使用 Nano Banana 2.1

將先進的 Nano Banana 2.1 模型與 Atlas Cloud 的 GPU 加速平台相結合,提供無與倫比的效能、可擴展性和開發體驗。

效能與靈活性

低延遲:
GPU 最佳化推理,實現即時回應。

統一 API:
一次整合,暢用 Nano Banana 2.1、GPT、Gemini 和 DeepSeek。

透明定價:
按 Token 計費,支援 Serverless 模式。

企業與規模

開發者體驗:
SDK、資料分析、微調工具和模板一應俱全。

可靠性:
99.99% 可用性、RBAC 權限控制、合規日誌。

安全與合規:
SOC 2 Type II 認證、HIPAA 合規、美國資料主權。

Nano Banana 2.1 API 常見問題

Nano Banana 2.1 是 Google 建立於 Gemini 3.6 Flash 之上的影像生成與對話式編輯模型。Atlas Cloud 提供六個 endpoint,涵蓋文字轉影像、影像編輯及參考轉影像工作流程。

可根據文字提示建立 1K 到 4K 解析度的合成影像,包括需要多語言文字的設計。既有影像可在保留最多 four 個角色與 ten 個物件的情況下進行編輯、重新設計風格或合併。另一個工作流程則會將來源影片片段、可選的參考素材及提示轉換為靜態影像。

請選擇符合文字轉影像、編輯或參考轉影像工作流程的 endpoint。透過 Atlas Cloud 的 OpenAI-compatible API,使用指定的 model ID 傳送必要的提示與媒體輸入。加入可選控制項前,請先檢閱 endpoint schema。

如果是從文字提示開始,請使用文字轉影像;若要轉換、重新設計風格或合併既有影像,請使用編輯功能。如果要讓影片片段引導新靜態影像的構圖,請選擇參考轉影像。每個工作流程都提供 Developer 和標準 endpoint 版本。

文字轉影像請求支援 1K 到 4K 輸出、可調整的思考程度、多語言文字渲染,以及可選的 Google Search grounding。編輯功能接受 1 到 14 張影像,並支援以遮罩為基礎的區域變更。參考轉影像工作流程以一個來源影片片段開始,也可以搭配參考影像。

Atlas Cloud 列出的六個可用 endpoint,其標準基本價格皆為每次呼叫 $0.05。此價格適用於兩種列出的版本,以及文字轉影像、編輯和參考轉影像工作流程。

Google 表示,相較於 Nano Banana 2,Nano Banana 2.1 在視覺品質、提示遵循度、多語言文字渲染,以及多次編輯的一致性方面都有改善。Nano Banana 2.1 被定位為 Nano Banana Pro 的高效率版本,結合 Pro 等級的影像能力與 Flash 等級的速度。在取代既有工作流程前,請先使用具代表性的 production prompts 進行測試。

如果某項指示未被遵循,請將關鍵要求放在最前面,對任何必須完全相同的文字加上引號,並明確說明哪些元素必須保持不變。進行編輯時,一次處理一項主要變更,並清楚標示目標區域。發布結果前,請檢查文字、人物身分及未修改區域。

不可以,目前可用的 endpoint 會回傳靜態影像,而非影片。參考轉影像工作流程會使用一個來源影片片段作為上下文,用於建立縮圖、海報、摘要資訊圖或其他靜態構圖。

探索更多系列

Seedance 2.5

Seedance 2.5 API 現已在 Atlas Cloud 上線!它為開發者提供了 ByteDance 最新的影片模型。該模型可透過文本、單張影像或多達 50 個多模態參考,一次性生成長達 30 秒的原生影片,並包含同步音訊和畫面內的多語言文本。在 Atlas Cloud 上,您可以透過單個金鑰存取它,其主體一致性和改進的物理特性可保持長鏡頭的連貫性。

檢視系列

Wan 3.0

Wan 3.0 API 是阿里巴巴 Wan 影片系列的下一代產品,旨在將長影片生成、多參考控制和影音品質推向新的高度。Atlas Cloud 已經代管了 Wan 2.7、2.6 和 2.5,而 Wan 3.0 透過相同的統一金鑰運行,無需額外設定。立即開始建置吧。向下捲動至展示區,查看 Wan 3.0 的創作能力。

檢視系列

MiniMax H3

MiniMax H3 是 MiniMax 的多模態影片系列,支援文字、影像與參考素材引導創作。在支援的路由中,它能保留參考媒體中的主體、提供彈性的長寬比,並透過 H3 Developer 將生成的聲音與畫面配對;輸出設定檔則依端點選定。Atlas Cloud 以一組 OpenAI-compatible 金鑰統一整個系列,並提供透明的隨用隨付定價,標準費率為每秒 $0.038。立即開始打造。

檢視系列

Seedream 5.0 Pro

Seedream 5.0 Pro API 為開發者在 Atlas Cloud 上提供了字節跳動的可控圖像編輯模型。它透過錨點和座標精確定位編輯,將圖像分離為可編輯圖層,融合多個參考,並精準匹配顏色和材質,支援 2K 和 3K 解析度的多語言文本。在 Atlas Cloud 上,您只需一個金鑰即可存取!

檢視系列

Seedance 2.0

Seedance 2.0 是 ByteDance 為精準鏡頭創作打造的生產級影片模型。將提示詞轉換為影片、使用可選的末幀引導讓首幀圖片動起來,或搭配參考媒體與可選的網路搜尋塑造成果。Atlas Cloud 將這些工作流程整合至統一的 API,提供透明的按用量計費方案,以及一組相容於 OpenAI 的金鑰。立即開始打造。

檢視系列

GPT Image 2.5

OpenAI 的 gpt-image-2.5 系列讓開發者可在正式環境的影像工作流程中選擇 Flare 與 Sunburst。支援最高 3840x2160 的任意解析度渲染,並提供五個品質等級(包括 xhigh 與 max),滿足特定的輸出需求。Atlas Cloud 提供可立即使用的 REST 推論服務,無冷啟動問題,標準價格每次生成最低 $0.004。立即開始建構。

檢視系列

GPT Image 2

GPT Image 2 API 為開發者提供了訪問 OpenAI 最新圖像模型的途徑,它是 GPT Image 1.5 的繼任者。該模型可生成和編輯圖像,能夠在拉丁和 CJK 文字上實現準確的文本渲染,並在海報、樣機和資訊圖表方面具備強大的排版能力。在 Atlas Cloud 上,您可以透過一個統一的 API 與 300 多個模型一起訪問它,並享受免費額度、99.99% 的正常運行時間,且無需 OpenAI 組織驗證。

檢視系列

Gemini Omni Flash

gemini omni API 將 Google DeepMind 原生多模態的 Gemini Omni Flash 系列(包括 Gemini Omni 1.1 Flash)帶給開發者。您可以建立具同步原生音訊的電影級影片、以精確的起始與結束影格控制讓靜態圖片動起來,或透過文字引導的編輯修改現有影片,同時保留未修改的內容。Atlas Cloud 提供單一 OpenAI 相容金鑰、統一存取,以及透明的隨用隨付定價。立即開始建置。

檢視系列

Grok Imagine

Grok Imagine API 涵蓋 xAI 的圖像、影片和語音模型,從 Image 2.0 到 Video 1.5 和 xAI TTS v1。在 14 種寬高比下生成 1K 或 2K 靜止畫面,將場景擴展為 15 秒的 1080p 動態影像,使用高達 7 張參考圖像操控鏡頭,或用 20 種語言配音。Atlas Cloud 在單一端點運行所有模式,按使用量付費定價,從每張圖像 $0.02 和每秒 $0.05 起。立即開始建置。

檢視系列

Google

Google最強大的創意模型現已在Atlas Cloud上全面可用。Veo 3.1提供電影等級的影片生成,Nano Banana 2支援高保真圖像建立,而Gemini為每個工作流程帶來多模態智慧。透過單一API key即可存取完整的Google模型套件,提供Day-0可用性和隨用隨付(pay-as-you-go)定價。

檢視系列

Seedance 2.0 Mini

Seedance 2.0 Mini 將 ByteDance 的多模態影片生成技術引入到對速度和成本要求極高的工作流程中。它以更輕量的佔用空間提供 Seedance 2.0 的核心能力——更快的生成速度、更低的單支影片成本,並且使用您現有的同款 API 整合。對於運行高吞吐量流水線或進行大規模原型設計的團隊來說,Mini 是最實用的預設選擇。

檢視系列

ByteDance

從電影級影片生成到高保真影像建立,ByteDance 最強大的模型現已在 Atlas Cloud 上線。以最低的推論定價和零基礎設施開銷,大規模執行 Seedance 和 Seedream。

檢視系列

一個 API,暢享全模態 AI。

探索全部模型