Hero background 1Hero background 2Hero background 3

Nano Banana 2.1 Pro Quality at Flash Speed

Nano Banana 2.1 คือกลุ่มโมเดลภาพของ Google ที่สร้างขึ้นบน Gemini 3.6 Flash ให้ความสามารถในการสร้างและแก้ไขภาพระดับ Pro ด้วยความเร็วระดับ Flash รองรับการแก้ไขและผสานภาพด้วยภาษาธรรมชาติจากภาพอินพุต 1 ถึง 14 ภาพ พร้อมรักษาความสอดคล้องของตัวละครสูงสุด 4 ตัวและวัตถุ 10 รายการ ผ่าน Atlas Cloud นักพัฒนาสามารถเข้าถึงกลุ่มโมเดลนี้ด้วยคีย์เดียวที่รองรับ OpenAI พร้อมความเสถียรในการให้บริการและพร้อมใช้งานตั้งแต่ Day-0 เริ่มสร้างสรรค์ได้ตั้งแต่วันนี้

Nano Banana 2.1 พัฒนาโดย Google โดย Atlas Cloud (ดำเนินการโดย Atlas Cloud AI LLC) เป็นผู้ให้บริการเข้าถึงโมเดลนี้ แต่ไม่ได้เป็นเจ้าของโมเดล เครื่องหมายการค้าทั้งหมดเป็นของเจ้าของที่เกี่ยวข้อง

สำรวจโมเดลชั้นนำ

Atlas Cloud มอบโมเดลสร้างสรรค์ล่าสุดที่นำหน้าในอุตสาหกรรมให้กับคุณ

เปรียบเทียบ Image Endpoint ทั้งหกของ Nano Banana 2.1

ดูว่า Nano Banana 2.1 รองรับการสร้างข้อความ การแก้ไขหลายภาพ และการสร้างภาพนิ่งโดยใช้วิดีโอเป็นแนวทางได้อย่างไรผ่านทั้งหก endpoint

รูปแบบการทำงานคำอธิบาย
Nano Banana 2.1 Developer Reference-to-Image APIป้อนคลิปวิดีโอต้นฉบับหนึ่งคลิป รูปภาพอ้างอิงเพิ่มเติมได้ และพรอมต์ไปยังเอนด์พอยต์นี้เพื่อสร้างภาพนิ่งใหม่ คุณภาพระดับ Pro ด้วยความเร็วระดับ Flash เหมาะสำหรับภาพขนาดย่อ โปสเตอร์ และอินโฟกราฟิกสรุป
Nano Banana 2.1 Developer Edit APIคำสั่งภาษาธรรมชาติช่วยให้เอนด์พอยต์นี้แก้ไข ปรับสไตล์ใหม่ หรือรวมภาพอินพุต 1 ถึง 14 ภาพเป็นภาพฉบับปรับปรุง รองรับการแก้ไขเฉพาะพื้นที่ด้วยมาสก์ และรักษาความสอดคล้องของตัวละครได้สูงสุด 4 ตัวและวัตถุ 10 ชิ้น จึงเหมาะสำหรับรูปแบบต่าง ๆ ของแคมเปญ ฉากตัวละคร และองค์ประกอบภาพที่มีหลายวัตถุ
Nano Banana 2.1 Developer Text-to-Image APIเริ่มจากพรอมต์ข้อความ เอนด์พอยต์นี้สร้างภาพที่จัดองค์ประกอบได้ดีตั้งแต่ 1K ถึง 4K พร้อมการเรนเดอร์ข้อความหลายภาษาอย่างแม่นยำ การปรับระดับการคิดได้ และการยึดโยงข้อมูลด้วย Google Search ที่เลือกเปิดใช้ได้ จึงเหมาะสำหรับโปสเตอร์ ภาพผลิตภัณฑ์ และกราฟิกที่มีข้อมูลจำนวนมาก
Nano Banana 2.1 Reference-to-Image APIเมื่อวิดีโอมีช่วงเวลาที่คุณต้องการ เอนด์พอยต์นี้จะผสานคลิปต้นฉบับหนึ่งคลิป รูปภาพอ้างอิงเพิ่มเติมได้ และพรอมต์เพื่อสร้างภาพนิ่ง ใช้คุณภาพระดับ Pro และความเร็วระดับ Flash สำหรับภาพขนาดย่อ โปสเตอร์ หรือสรุปข้อมูลด้วยภาพ
Nano Banana 2.1 Edit APIสำหรับงานประกอบภาพที่ซับซ้อน เอนด์พอยต์นี้ทำตามคำสั่งภาษาธรรมชาติเพื่อแก้ไข ปรับสไตล์ใหม่ หรือรวมภาพต้นฉบับ 1 ถึง 14 ภาพ รองรับการเปลี่ยนแปลงเฉพาะพื้นที่ด้วยมาสก์ พร้อมรักษาความสอดคล้องของตัวละครได้สูงสุด 4 ตัวและวัตถุ 10 ชิ้น เหมาะสำหรับแอสเซ็ตแบรนด์ การปรับแก้ฉาก และงานภาพที่มีหลายองค์ประกอบ
Nano Banana 2.1 Text-to-Image APIต้องการงานภาพที่เรียบร้อยจากข้อความเพียงอย่างเดียวใช่ไหม เอนด์พอยต์นี้สร้างภาพที่จัดองค์ประกอบได้ดีตั้งแต่ 1K ถึง 4K พร้อมการเรนเดอร์ข้อความหลายภาษาอย่างแม่นยำ การปรับระดับการคิดได้ และการยึดโยงข้อมูลด้วย Google Search ที่เลือกเปิดใช้ได้ เหมาะสำหรับโฆษณาที่ปรับให้เหมาะกับท้องถิ่น งานออกแบบที่เน้นตัวอักษร และคอนเทนต์ภาพที่อ้างอิงข้อมูลจริง

Nano Banana 2.1: คุณภาพระดับ Pro ด้วยความเร็วระดับ Flash

Nano Banana 2.1 ผสานการสร้างภาพระดับ Pro ตั้งแต่ 1K ถึง 4K การแก้ไขด้วยมาสก์ การหลอมรวมภาพอ้างอิงสูงสุด 14 ภาพ ข้อความหลายภาษา การปรับระดับการคิด การใช้ Google Search เป็นแหล่งอ้างอิง และการสร้างภาพนิ่งโดยมีวิดีโอเป็นแนวทางไว้ใน Atlas Cloud API เดียว

Nano Banana 2.1 ในความละเอียด 4K

Nano Banana 2.1 สร้างภาพคุณภาพระดับ Pro ด้วยความเร็วระดับ Flash บน Gemini 3.6 Flash รองรับความละเอียด 1K, 2K หรือ 4K การทำตามพรอมต์ที่แม่นยำยิ่งขึ้นช่วยให้การจัดองค์ประกอบที่ซับซ้อนยังคงสอดคล้องกับบรีฟในรูปแบบภาพที่หลากหลาย เลือกความละเอียดให้เหมาะกับการปรับแก้อย่างรวดเร็วหรือการส่งมอบงานโปรดักชันที่ต้องการรายละเอียดสูง เหมาะสำหรับงานศิลป์แคมเปญ ภาพสินค้า และงานบรรณาธิการที่ผ่านการขัดเกลาแล้ว

ภาพอ้างอิง 14 ภาพ ฉากเดียว

รวมภาพอินพุตตั้งแต่ 1 ถึง 14 ภาพผ่านเวิร์กโฟลว์การแก้ไข แล้วกำหนดองค์ประกอบด้วยคำสั่งภาษาธรรมชาติ Nano Banana 2.1 รักษาความสอดคล้องของตัวละครได้สูงสุด 4 ตัวและวัตถุ 10 ชิ้น พร้อมผสานผู้คน สินค้า พร็อพ และสไตล์เข้าด้วยกัน ช่วยให้ทีมเล่าเรื่องและเครื่องมือด้านคอมเมิร์ซสร้างฉากที่มีหลายองค์ประกอบได้อย่างกลมกลืนในทางปฏิบัติ

การแก้ไขด้วยมาสก์ของ Nano Banana 2.1

ต้องการเปลี่ยนเฉพาะบางพื้นที่โดยไม่ต้องออกแบบทั้งเฟรมใหม่ใช่ไหม การแก้ไขพื้นที่ด้วยมาสก์ช่วยให้ Nano Banana 2.1 ปรับรายละเอียดที่เลือกไว้ผ่านคำสั่งภาษาธรรมชาติได้ เอนด์พอยต์การแก้ไขเดียวกันยังสามารถเปลี่ยนสไตล์หรือผสานภาพต้นฉบับ โดยรักษาความสอดคล้องของตัวละครและวัตถุไว้ ใช้สำหรับรีทัชสินค้า เปลี่ยนเสื้อผ้า หรือสร้างรูปแบบแคมเปญที่ควบคุมได้ด้วยความเร็วระดับโปรดักชัน

ตัวอักษรหลายภาษาที่แม่นยำ

การเรนเดอร์ข้อความหลายภาษาที่แม่นยำทำให้คำต่าง ๆ กลายเป็นส่วนประกอบที่เชื่อถือได้ขององค์ประกอบภาพ ไม่ใช่เพียงสิ่งตกแต่งที่อ่านไม่ออก Nano Banana 2.1 สามารถวางตัวอักษรที่อ่านได้ภายในภาพความละเอียด 1K ถึง 4K พร้อมรองรับเลย์เอาต์อินโฟกราฟิกที่มีโครงสร้าง จับคู่คำสั่งด้านข้อความที่ชัดเจนกับบรีฟภาพที่แข็งแรง เพื่อสร้างแบนเนอร์ ป้าย เมนู และกราฟิกข้อมูลสำหรับการตรวจสอบในหลากหลายตลาดและโลเคล

จากคลิปวิดีโอสู่ภาพนิ่ง

เปลี่ยนคลิปวิดีโอต้นฉบับหนึ่งคลิป ภาพอ้างอิงเสริม (ถ้ามี) และพรอมต์ ให้กลายเป็นภาพนิ่งใหม่ เวิร์กโฟลว์จากภาพอ้างอิงสู่ภาพช่วยย่อบริบททางภาพให้เป็นภาพขนาดย่อ โปสเตอร์ หรืออินโฟกราฟิกสรุป โดยยังคงคุณภาพระดับ Pro ด้วยความเร็วระดับ Flash เหมาะอย่างยิ่งเมื่อทีมต้องการคีย์วิชวลพร้อมเผยแพร่จากฟุตเทจที่มีอยู่แล้ว

Nano Banana 2.1 พร้อมการคิดและ Search

เมื่อบรีฟต้องอาศัยการให้เหตุผลที่ลึกขึ้นหรือบริบทปัจจุบัน ให้ปรับระดับการคิดและเปิดใช้ Google Search grounding ได้ตามต้องการ Nano Banana 2.1 รวมการควบคุมเหล่านี้ไว้กับการสร้างข้อความ การแก้ไข และการสร้างภาพนิ่งโดยมีวิดีโอเป็นแนวทาง Atlas Cloud รวมความสามารถทั้งหมดไว้ผ่านคีย์เดียวที่รองรับ OpenAI พร้อมการคิดค่าบริการตามการใช้งานอย่างโปร่งใสในอัตรามาตรฐานที่ตรวจสอบแล้วคือ $0.05 ต่อการเรียกใช้

Nano Banana 2.1 ประชันแบบตัวต่อตัว: หนึ่งพรอมต์ สามโมเดล

ดูว่า Nano Banana 2.1 และทางเลือกอีกสองแบบจาก Atlas Cloud ตีความพรอมต์เดียวกันอย่างไรในด้านตัวอักษร องค์ประกอบ แสง การเคลื่อนไหว และพื้นผิวสมจริง

พรอมต์

ภาพถ่ายสารคดีในจังหวะชี้ขาดภายในสำนักงานของหายและของเก่าที่สถานีรถไฟยุค 1990s: พนักงานหญิงสาวเพิ่งกดตราประทับวันที่ด้ามไม้ลงบนแบบฟอร์มแจ้งของหาย ทิ้งรอยประทับวันที่สีแดงชาดคมชัดไว้ ในจังหวะเดียวกับที่พัดลมเพดานเก่าพ่นป้ายกระดาษแจ้งของหายหลายสิบใบขึ้นสู่อากาศอย่างกะทันหัน โดยแต่ละป้ายมีหมายเลขเฉพาะ ชื่อสถานที่ และคำบรรยายสิ่งของที่หายเขียนด้วยลายมือสั้น ๆ ซึ่งอ่านได้ชัดเจน ในเสี้ยววินาทีเดียวกัน เฟอร์เร็ตแสนซนตัวหนึ่งโผล่ออกจากกระเป๋าเดินทางหนังเก่าที่เปิดแง้มและมีรอยถลอก ก่อนพุ่งหนีไปพร้อมกุญแจทองเหลืองมีรอยขีดข่วนคาบอยู่ในปาก ขณะที่พนักงานสาวผู้ตกใจจริง ๆ เอื้อมข้ามเคาน์เตอร์บริการยาวเพื่อสกัดมันไว้ สีหน้าของเธอช็อกอย่างเป็นธรรมชาติ และมือมีสัดส่วนทางกายวิภาคที่ถูกต้อง เคลื่อนไหวอย่างสมจริงและถูกจับภาพไว้กลางจังหวะ เคาน์เตอร์สร้างเส้นนำสายตาแนวทแยงที่เด่นชัดพุ่งไปยังเฟอร์เร็ต ช่องเก็บของทรงสี่เหลี่ยมจำนวนมากซึ่งอัดแน่นไปด้วยสัมภาระและพัสดุหลากหลายชนิดก่อให้เกิดกรอบซ้อนกรอบเป็นชั้น ๆ อยู่ด้านหลังเธอ ป้ายหลายใบลอยผ่านใกล้เลนส์มากในลักษณะวัตถุบังฉากหน้าแบบนุ่มและหลุดโฟกัส สร้างมิติความลึกและความโกลาหลที่ควบคุมได้ แฟลชจากกล้องระยะใกล้โดยตรงหยุดภาพพนักงานสาว เฟอร์เร็ต กุญแจ และป้ายที่อยู่ใกล้ที่สุดด้วยรายละเอียดสัมผัสที่คมชัด ขณะที่ลำแสงอาทิตย์ยามเช้าเย็น ๆ แคบเป็นเส้นลอดผ่านมู่ลี่เวเนเชียนทางด้านขวา ตัดผ่านห้องและจับฝุ่นละออง ขอบกระดาษ และขนสัตว์ที่ลอยอยู่ในอากาศ เบลอจากการเคลื่อนไหวแบบเลือกเฉพาะจุดลากเป็นทางตามพัดลมที่กำลังหมุนและป้ายที่อยู่ไกลออกไป ใช้โทนสีจำกัดอย่างเคร่งครัด ได้แก่ เขียวมิ้นต์เก่า น้ำตาลยาสูบ และแดงชาดจากตราประทับ แยกโทนอย่างสะอาด ไม่มีสีหม่นโคลน เน้นเนื้อกระดาษเป็นเส้นใย มุมป้ายที่ม้วนงอ แรงกดของหมึก ลายหนังที่สึกหรอ ไม้ทาสีที่กะเทาะ ขนเฟอร์เร็ต โลหะที่มีรอยขีดข่วน และเกรนฟิล์มแอนะล็อกละเอียดอ่อน สไตล์ภาพข่าวยุค 1990s ที่สมจริง ปฏิสัมพันธ์ของมนุษย์แบบเผลอเป็นธรรมชาติ ความสัมพันธ์เชิงพื้นที่ระหว่างมือ สัตว์ กุญแจ กระเป๋าเดินทาง เคาน์เตอร์ และกระดาษที่ลอยอยู่ต้องไม่สมบูรณ์แบบแต่เชื่อถือได้ กล้องฟิล์ม 35mm เลนส์มุมกว้าง 28mm จุดมองระยะใกล้ f/5.6 คอนทราสต์พอดี ผิวมนุษย์สมจริง แสงแฟลชลดลงเล็กน้อยตามระยะ หลีกเลี่ยงการเรนเดอร์มันเงาเกินจริง ไม่มี HDR ไม่มีผิวพลาสติก ไม่มีรายละเอียดจุลภาคมากเกินไป ไม่มีแสงเรืองทั่วทั้งภาพ ไม่มีเอฟเฟกต์ “มหากาพย์” แบบภาพยนตร์ ไม่มีบรรยากาศแฟนตาซี องค์ประกอบแนวนอนกว้าง อัตราส่วน 16:9 เต็มพื้นที่ภาพ

Generated with Nano Banana 2.1 Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Nano Banana 2 Text-to-Image on Atlas Cloud

พรอมต์

ภาพถ่ายโฆษณาแนวเรโทรเซอร์เรียลลิสต์ภายในโถงรับกระเป๋าสนามบินที่สว่างจ้าในเวลาเที่ยงวัน บันทึกจังหวะชี้ขาดเมื่อกระเป๋าเดินทางเปลือกแข็งสีแดงมะเขือเทศหนึ่งใบจากทั้งหมดยี่สิบใบที่เหมือนกันทุกประการเปิดออกอย่างกะทันหันตรงส่วนโค้งของสายพานลำเลียง ฝูงนกอพยพที่พับจากกระดาษพุ่งทะยานออกมาพร้อมเบลอจากการเคลื่อนไหวเล็กน้อย ขณะที่ผืนหญ้าสีเขียวจริงขนาดเต็มสเกล ทั้งราก เศษดิน และใบหญ้าที่เอนตามลม ไหลทะลักออกจากกระเป๋าอย่างเป็นไปไม่ได้ ข้างกันนั้น นักเดินทางสาวมีสไตล์ผมสั้นสีเงินเทาเอื้อมมือที่มีสัดส่วนทางกายวิภาคถูกต้องไปรับหนังสือเดินทางกลางอากาศ ดวงตาเบิกกว้างด้วยความประหลาดใจและริมฝีปากกลั้นหัวเราะไว้ ผิวมีพื้นผิวสมจริงและภาษากายเป็นธรรมชาติแบบภาพแคนดิด ถ่ายจากมุมต่ำมากจนเกือบสัมผัสสายพานที่กำลังเคลื่อนที่ ใช้เส้นนำสายตารูปวงรีอันทรงพลังของสายพาน การเรียงซ้ำอย่างมีจังหวะของกระเป๋าทั้งยี่สิบใบ และเงาสะท้อนซ้อนชั้นบนกระจกอาคารผู้โดยสาร เพื่อสร้างมุมมองเชิงพื้นที่ที่ลึกและแม่นยำ แสงอาทิตย์แข็งทิศทางชัดเจนในเวลาเที่ยงวันจากช่องแสงบนเพดานทอดเงายาวสะอาดตัดผ่านโลหะขัดด้านและพื้นขัดเงา ใช้โทนสีจำกัดอย่างเคร่งครัด ได้แก่ แดงมะเขือเทศ น้ำเงินเทาแบบสนามบิน และเขียวสดของหญ้า ห้ามมีสีอื่นเป็นสีเด่น รักษารอยขีดข่วนบนโลหะที่สมจริง ร่องรอยการสึกของสายพานยาง ขอบสติกเกอร์ที่พับ งวดลายปั๊มนูนบนกระเป๋า เกรนฟิล์มละเอียดอ่อน และเบลอจากการเคลื่อนไหวที่พอดี กระเป๋าแต่ละใบต้องมีป้ายสัมภาระสีขาวติดอยู่จริงในตำแหน่งและทิศทางที่ถูกต้อง อ่านได้ชัด ด้วยตัวอักษรสะอาดสม่ำเสมอ รวมถึงข้อความที่อ่านได้ชัดเจนว่า “FLIGHT 208 • GATE C12 • BAG 019” ห้ามมีตัวอักษรมั่วหรือป้ายลอยอยู่กลางอากาศ ถ่ายทอดสเกลเหนือจริงด้วยความสมจริงแบบภาพถ่าย กลิ่นอายโฆษณาการเดินทางอันประณีตแบบยุค 1970s–1980s อารมณ์ขันแห้ง ๆ ไฮไลต์ที่ควบคุมได้ เงาสะท้อนสมจริง มือ วัตถุซ้ำ เงา และมุมมองต้องสอดคล้องกัน หลีกเลี่ยงการเรนเดอร์มันเงาเกินจริง ไม่มีลุค HDR ไม่มีรายละเอียดจุลภาคมากเกินไป ไม่มีผิวพลาสติก ไม่มีสีหม่นโคลน ไม่มีแสงเรืองทั่วทั้งภาพ ไม่มีบรรยากาศมหากาพย์ราคาถูก ไม่มีภาพใต้น้ำมืดหรือซากปรักหักพังในอวกาศ เลนส์มุมกว้าง 28mm แบบภาพยนตร์ ความสูงกล้องต่ำ ระนาบโฟกัสคมชัดบริเวณมือของนักเดินทางและกระเป๋าที่เปิดอยู่ เกรนแอนะล็อกเล็กน้อย การแยกสีระดับบทบรรณาธิการพรีเมียม องค์ประกอบแนวนอนกว้างอัตราส่วน 16:9 เต็มพื้นที่จากขอบจรดขอบ

Generated with Nano Banana 2.1 Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Nano Banana 2 Text-to-Image on Atlas Cloud

Nano Banana 2.1 ในเวิร์กโฟลว์การผลิตที่หลากหลาย

ครอบคลุมไปป์ไลน์ด้านผลิตภัณฑ์ สื่อ และบรรณาธิการ Nano Banana 2.1 เปลี่ยนพรอมต์ รูปภาพ หรือวิดีโอต้นฉบับให้เป็นภาพนิ่งคุณภาพสูง รองรับตัวอักษรหลายภาษาและการแก้ไขแบบควบคุมได้ พร้อมรักษาความสม่ำเสมอของตัวแบบที่ปรากฏซ้ำ

Nano Banana 2.1 สำหรับแคมเปญหลายภาษา

Nano Banana 2.1 สร้างข้อความหลายภาษาที่แม่นยำภายในภาพแคมเปญที่มีคุณภาพสูงจากพรอมต์ภาษาธรรมชาติ สร้างโปสเตอร์ ภาพเปิดตัว และโฆษณาโซเชียลสำหรับผู้ชมทั่วโลกได้โดยไม่ต้องจัดองค์ประกอบใหม่ด้วยตนเองทุกครั้ง

ฉากผลิตภัณฑ์จากภาพอ้างอิงหลายภาพ

ผสานภาพอ้างอิงได้สูงสุด 14 ภาพ พร้อมรักษาความสม่ำเสมอของตัวละครได้สูงสุด 4 ตัวและวัตถุ 10 ชิ้น ทีมผลิตภัณฑ์สามารถประกอบฉากแคตตาล็อก รูปแบบตามฤดูกาล และองค์ประกอบตามแบรนด์จากสินทรัพย์ภาพที่มีอยู่แล้ว

โลกของตัวละครด้วย Nano Banana 2.1

รักษาเอกลักษณ์ของตัวละครได้สูงสุด 4 ตัว พร้อมเปลี่ยนเครื่องแต่งกาย ฉาก หรือสไตล์ผ่านการแก้ไขแบบมีคำแนะนำ แอปด้านการเล่าเรื่อง ทีมเกม และแคมเปญแบบต่อเนื่องจะได้กลุ่มตัวละครที่มีภาพลักษณ์สอดคล้องกันในสินทรัพย์ที่เกี่ยวข้องจำนวนมาก

การแก้ไขอย่างแม่นยำสำหรับการผลิต

ระบุพื้นที่และอธิบายการเปลี่ยนแปลงเพื่อแก้ไขเฉพาะจุด โดยยังคงรักษาเนื้อหาโดยรอบไว้ รีทัชภาพผลิตภัณฑ์ เปลี่ยนวัตถุเฉพาะจุด หรือปรับสินทรัพย์สร้างสรรค์ได้โดยไม่ต้องสร้างภาพทั้งหมดขึ้นใหม่ตั้งแต่ต้น

เปลี่ยนเฟรมวิดีโอเป็นสินทรัพย์แคมเปญ

เปลี่ยนคลิปวิดีโอต้นฉบับหนึ่งคลิป พร้อมภาพอ้างอิงและพรอมต์ (ถ้ามี) ให้เป็นภาพนิ่งใหม่ สร้างภาพขนาดย่อ โปสเตอร์ประชาสัมพันธ์ หรืออินโฟกราฟิกสรุปสำหรับครีเอเตอร์ สำนักพิมพ์ และเครื่องมืออัตโนมัติด้านสื่อได้ในปริมาณมาก

กราฟิกบรรณาธิการที่อ้างอิงข้อมูลจริง

ใช้ Google Search grounding ร่วมกับการเรนเดอร์ข้อความที่แม่นยำ เพื่อสร้างภาพที่ทันเหตุการณ์และอ้างอิงข้อมูลปัจจุบัน นักพัฒนาสามารถสร้างกราฟิกบรรณาธิการ ภาพอธิบายกิจกรรม และอินโฟกราฟิกประเด็นร้อนสำหรับห้องข่าว นักการศึกษา หรือแพลตฟอร์มเนื้อหา

การเปรียบเทียบการแก้ไขภาพด้วย Nano Banana 2.1

เปรียบเทียบ Nano Banana 2.1 กับโมเดลแก้ไขภาพอื่น ๆ ในด้านความละเอียดเอาต์พุต จำนวนภาพอ้างอิงที่รองรับ และราคา Standard ต่อภาพ

โมเดลความละเอียดเอาต์พุตสูงสุดจำนวนภาพอ้างอิงสูงสุดราคาเริ่มต้น Standard
Nano Banana 2.1 Edit4K14เริ่มต้นที่ $0.05/ภาพ
Qwen Image 3.0 Edit2K3เริ่มต้นที่ $0.03/ภาพ
Grok Imagine Image 2.0 Edit2K3เริ่มต้นที่ $0.04/ภาพ

วิธีใช้ Nano Banana 2.1 บน Atlas Cloud

เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud

สร้างบัญชี Atlas Cloud

สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล

ทำไมต้องใช้ Nano Banana 2.1 บน Atlas Cloud

การรวมโมเดล Nano Banana 2.1 ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้

ประสิทธิภาพและความยืดหยุ่น

เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์

API แบบรวมศูนย์:
รัน Nano Banana 2.1, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว

ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless

องค์กรและขนาด

ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต

ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม

ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา

คำถามที่พบบ่อยเกี่ยวกับ API ของ Nano Banana 2.1

Nano Banana 2.1 คือโมเดลสร้างภาพและแก้ไขภาพแบบสนทนาของ Google ที่พัฒนาบน Gemini 3.6 Flash โดย Atlas Cloud มี endpoint 6 รายการ ครอบคลุมเวิร์กโฟลว์ text-to-image, การแก้ไขภาพ และ reference-to-image

สร้างภาพที่จัดองค์ประกอบแล้วด้วยความละเอียดตั้งแต่ 1K ถึง 4K จาก text prompt รวมถึงงานออกแบบที่ต้องใช้ข้อความหลายภาษา แก้ไข ปรับสไตล์ หรือรวมภาพที่มีอยู่เดิมได้ โดยยังคงตัวละครได้สูงสุด 4 ตัวและวัตถุ 10 รายการ อีกหนึ่งเวิร์กโฟลว์สามารถแปลงคลิปวิดีโอต้นฉบับ พร้อม reference ที่เลือกใช้ได้และ prompt ให้เป็นภาพนิ่ง

เลือก endpoint ที่ตรงกับเวิร์กโฟลว์ text-to-image, การแก้ไขภาพ หรือ reference-to-image ของคุณ ส่ง prompt และอินพุตสื่อที่จำเป็นโดยใช้ model ID ที่ระบุไว้ผ่าน OpenAI-compatible API ของ Atlas Cloud ตรวจสอบ endpoint schema ก่อนเพิ่มตัวเลือกเสริม

ใช้ text-to-image เมื่อต้องการเริ่มจาก prompt ที่เป็นข้อความ และใช้ edit เมื่อต้องการแปลง ปรับสไตล์ หรือรวมภาพที่มีอยู่เดิม เลือก reference-to-image เมื่อคลิปวิดีโอควรใช้เป็นแนวทางในการจัดองค์ประกอบภาพนิ่งใหม่ แต่ละเวิร์กโฟลว์มี endpoint ทั้งแบบ Developer และแบบมาตรฐาน

คำขอ text-to-image รองรับเอาต์พุตตั้งแต่ 1K ถึง 4K การปรับระดับ thinking การเรนเดอร์ข้อความหลายภาษา และการใช้ Google Search grounding ซึ่งเป็นตัวเลือกเสริม การแก้ไขภาพรองรับภาพตั้งแต่ 1 ถึง 14 ภาพ และรองรับการเปลี่ยนแปลงเฉพาะพื้นที่โดยใช้ mask ส่วน reference-to-image เริ่มต้นด้วยคลิปวิดีโอต้นฉบับ 1 คลิป และอาจใช้ภาพ reference เพิ่มเติมได้

Atlas Cloud ระบุราคาพื้นฐานมาตรฐานที่ $0.05 ต่อการเรียกใช้ สำหรับ endpoint ที่มีให้บริการทั้ง 6 รายการ ราคานี้ใช้กับเวิร์กโฟลว์ text-to-image, edit และ reference-to-image ในทั้งสองรูปแบบที่ระบุไว้

เมื่อเทียบกับ Nano Banana 2 แล้ว Google รายงานว่า Nano Banana 2.1 มีคุณภาพภาพ การทำตาม prompt การเรนเดอร์ข้อความหลายภาษา และความสม่ำเสมอในการแก้ไขซ้ำที่ดีขึ้น Nano Banana 2.1 วางตำแหน่งเป็นตัวเลือกที่มีประสิทธิภาพสำหรับ Nano Banana Pro โดยผสานความสามารถด้านภาพระดับ Pro เข้ากับความเร็วระดับ Flash ควรทดสอบ prompt ที่ใช้จริงในงานผลิตก่อนแทนที่เวิร์กโฟลว์เดิม

หากคำสั่งบางข้อถูกมองข้าม ให้ระบุข้อกำหนดสำคัญไว้ก่อน ใส่เครื่องหมายอัญประกาศครอบข้อความที่ต้องการให้ตรงตามต้นฉบับ และระบุองค์ประกอบที่ต้องคงไว้โดยไม่เปลี่ยนแปลง สำหรับการแก้ไขภาพ ให้แยกแก้ทีละการเปลี่ยนแปลงหลักและระบุพื้นที่เป้าหมายให้ชัดเจน ตรวจสอบข้อความ ตัวตนของบุคคล และพื้นที่ที่ไม่ได้แก้ไขก่อนเผยแพร่ผลลัพธ์

ไม่ได้ endpoint ที่มีให้บริการจะส่งคืนภาพนิ่ง ไม่ใช่วิดีโอ เวิร์กโฟลว์ reference-to-image ใช้คลิปวิดีโอต้นฉบับ 1 คลิปเป็นบริบทสำหรับสร้างภาพขนาดย่อ โปสเตอร์ อินโฟกราฟิกสรุป หรือภาพนิ่งรูปแบบอื่น

สำรวจกลุ่มเพิ่มเติม

Seedance 2.5

Seedance 2.5 API พร้อมใช้งานแล้วบน Atlas Cloud! มอบโมเดลวิดีโอใหม่ล่าสุดของ ByteDance ให้กับนักพัฒนา สร้างวิดีโอเนทีฟได้นานถึง 30 วินาทีในการประมวลผลเพียงครั้งเดียวจากข้อความ รูปภาพเดียว หรือการอ้างอิงหลายรูปแบบสูงสุด 50 รายการ พร้อมเสียงที่ซิงโครไนซ์และข้อความหลายภาษาในเฟรม บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว โดยมีความสอดคล้องของวัตถุและระบบฟิสิกส์ที่ได้รับการปรับปรุงซึ่งช่วยให้ภาพระยะยาวมีความต่อเนื่อง

ดูกลุ่ม

Wan 3.0

Wan 3.0 API คือเจเนอเรชันถัดไปของตระกูลวิดีโอ Wan จาก Alibaba ซึ่งสร้างขึ้นเพื่อยกระดับการสร้างวิดีโอแบบยาว การควบคุมแบบหลายข้อมูลอ้างอิง และคุณภาพของภาพและเสียงให้ก้าวไปอีกขั้น Atlas Cloud ได้โฮสต์ Wan 2.7, 2.6 และ 2.5 ไว้แล้ว และ Wan 3.0 สามารถทำงานบนคีย์แบบรวมเดียวกันโดยไม่ต้องตั้งค่าแยกต่างหาก เริ่มต้นสร้างสรรค์ได้ตั้งแต่วันนี้ เลื่อนลงไปที่ส่วนจัดแสดงเพื่อดูว่า Wan 3.0 สามารถสร้างอะไรได้บ้าง

ดูกลุ่ม

MiniMax H3

MiniMax H3 คือผลิตภัณฑ์วิดีโอแบบมัลติโมดัลของ MiniMax สำหรับการสร้างสรรค์โดยใช้ข้อความ รูปภาพ และข้อมูลอ้างอิง ในเส้นทาง API ที่รองรับ ระบบจะคงลักษณะของวัตถุจากสื่ออ้างอิงไว้ มีอัตราส่วนภาพที่ยืดหยุ่น และจับคู่เสียงที่สร้างขึ้นกับภาพผ่าน H3 Developer โดยโปรไฟล์เอาต์พุตจะถูกเลือกตาม endpoint Atlas Cloud รวมผลิตภัณฑ์ในตระกูลนี้ไว้เบื้องหลังคีย์เดียวที่รองรับ OpenAI พร้อมการคิดค่าบริการตามการใช้งานอย่างโปร่งใส เริ่มต้นที่อัตรามาตรฐาน $0.038 ต่อวินาที เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

Seedream 5.0 Pro

Seedream 5.0 Pro API มอบโมเดลการแก้ไขภาพที่ควบคุมได้ของ ByteDance บน Atlas Cloud ให้กับนักพัฒนา โดยจะวางการแก้ไขอย่างแม่นยำด้วยจุดยึดและพิกัด แยกภาพออกเป็นเลเยอร์ที่แก้ไขได้ ผสานข้อมูลอ้างอิงหลายรายการ และจับคู่สีและวัสดุที่แน่นอน พร้อมข้อความหลายภาษาที่ความละเอียด 2K และ 3K บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว!

ดูกลุ่ม

Seedance 2.0

Seedance 2.0 คือโมเดลวิดีโอสำหรับการใช้งานจริงของ ByteDance ที่ออกแบบมาเพื่อสร้างช็อตได้อย่างแม่นยำ เปลี่ยนพรอมป์ต์เป็นวิดีโอ ทำให้ภาพเฟรมแรกเคลื่อนไหวโดยมีตัวเลือกให้ใช้คำแนะนำจากเฟรมสุดท้าย หรือปรับแต่งผลลัพธ์ด้วยสื่ออ้างอิงและการค้นหาเว็บแบบเลือกใช้ได้ Atlas Cloud รวมเวิร์กโฟลว์เหล่านี้ไว้ใน API เดียว พร้อมการคิดค่าบริการตามการใช้งานจริงอย่างโปร่งใสและคีย์เดียวที่เข้ากันได้กับ OpenAI เริ่มสร้างสรรค์ได้วันนี้

ดูกลุ่ม

GPT Image 2.5

ตระกูล gpt-image-2.5 จาก OpenAI มอบทางเลือก Flare และ Sunburst ให้แก่นักพัฒนาสำหรับกระบวนการทำงานด้านการสร้างภาพเพื่อใช้งานจริง เรนเดอร์ด้วยความละเอียดตามต้องการสูงสุด 3840x2160 และเลือกได้จากระดับคุณภาพ 5 ระดับ รวมถึง xhigh และ max เพื่อให้ตรงตามข้อกำหนดของเอาต์พุตแต่ละแบบ Atlas Cloud ให้บริการอนุมานผ่าน REST ที่พร้อมใช้งาน โดยไม่มี cold start และคิดค่าบริการตามมาตรฐานเริ่มต้นที่ $0.004 ต่อการสร้างภาพ เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

GPT Image 2

GPT Image 2 API ช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลรูปภาพล่าสุดของ OpenAI ซึ่งเป็นรุ่นสืบทอดจาก GPT Image 1.5 โดยสามารถสร้างและแก้ไขรูปภาพพร้อมกับการเรนเดอร์ข้อความที่แม่นยำทั้งในอักษรละตินและ CJK รวมถึงการจัดวางองค์ประกอบที่ยอดเยี่ยมสำหรับโปสเตอร์ ม็อกอัป และอินโฟกราฟิก บน Atlas Cloud คุณสามารถเข้าถึงโมเดลนี้ผ่าน API ที่เป็นหนึ่งเดียวร่วมกับโมเดลอื่นๆ อีกกว่า 300 รุ่น พร้อมเครดิตฟรี เวลาทำงาน 99.99% และไม่จำเป็นต้องมีการตรวจสอบยืนยันองค์กรจาก OpenAI

ดูกลุ่ม

Gemini Omni Flash

API ของ gemini omni นำตระกูล Gemini Omni Flash แบบมัลติโมดัลโดยกำเนิดจาก Google DeepMind ซึ่งรวมถึง Gemini Omni 1.1 Flash มาสู่นักพัฒนา สร้างวิดีโอสไตล์ภาพยนตร์พร้อมเสียงเนทีฟที่ซิงโครไนซ์กัน ทำให้ภาพนิ่งเคลื่อนไหวได้ด้วยการควบคุมเฟรมเริ่มต้นและเฟรมสิ้นสุดอย่างแม่นยำ หรือปรับแก้ฟุตเทจที่มีอยู่ผ่านการแก้ไขด้วยคำสั่งข้อความ โดยยังคงรักษาเนื้อหาที่ไม่ได้แก้ไขไว้ Atlas Cloud มอบคีย์เดียวที่เข้ากันได้กับ OpenAI การเข้าถึงแบบรวมศูนย์ และราคาที่โปร่งใสโดยคิดค่าบริการตามการใช้งาน เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

Grok Imagine

Grok Imagine API ครอบคลุมโมเดลรูปภาพ วิดีโอ และพูดของ xAI ตั้งแต่ Image 2.0 ถึง Video 1.5 และ xAI TTS v1 สร้างรูปภาพนิ่ง 1K หรือ 2K ในอัตราส่วน 14 แบบ ขยายฉากไปยัง 15 วินาทีของวิดีโอ 1080p ควบคุมภาพด้วยรูปภาพอ้างอิงได้ถึง 7 รูป หรือเพิ่มบรรยายเสียงในภาษา 20 ภาษา Atlas Cloud รันทุกโหมดบนเอนด์พอยต์เดียว มีราคาแบบจ่ายตามการใช้งาน ตั้งแต่ $0.02 ต่อรูปภาพและ $0.05 ต่อวินาที เริ่มสร้างวันนี้

ดูกลุ่ม

Google

โมเดลเชิงสร้างสรรค์ที่ทรงพลังที่สุดของ Google พร้อมใช้งานแล้วบน Atlas Cloud โดย Veo 3.1 นำเสนอการสร้างวิดีโอระดับภาพยนตร์ Nano Banana 2 ขับเคลื่อนการสร้างภาพที่มีความเที่ยงตรงสูง และ Gemini นำความชาญฉลาดแบบมัลติโมดัลมาสู่ทุกเวิร์กโฟลว์ เข้าถึงชุดโมเดลของ Google เต็มรูปแบบผ่าน API key เดียวพร้อมความพร้อมใช้งานระดับ Day-0 และการกำหนดราคาแบบจ่ายตามการใช้งาน (pay-as-you-go)

ดูกลุ่ม

Seedance 2.0 Mini

Seedance 2.0 Mini นำเสนอการสร้างวิดีโอแบบมัลติโมดัลของ ByteDance สู่เวิร์กโฟลว์ที่ความเร็วและต้นทุนมีความสำคัญสูงสุด โดยมอบความสามารถหลักของ Seedance 2.0 ในรูปแบบที่ใช้ทรัพยากรน้อยลง — สร้างได้เร็วกว่า ต้นทุนต่อวิดีโอต่ำกว่า และใช้การผสานรวม API เดิมที่คุณใช้อยู่แล้ว สำหรับทีมที่จัดการไปป์ไลน์ปริมาณมากหรือสร้างต้นแบบในสเกลขนาดใหญ่ Mini คือตัวเลือกเริ่มต้นที่ใช้งานได้จริง

ดูกลุ่ม

ByteDance

ตั้งแต่การสร้างวิดีโอระดับภาพยนตร์ไปจนถึงการสร้างภาพที่มีความละเอียดสูง โมเดลที่ทรงพลังที่สุดของ ByteDance พร้อมใช้งานแล้วบน Atlas Cloud รัน Seedance และ Seedream ในสเกลขนาดใหญ่ด้วยราคาการอนุมานที่ต่ำที่สุด และไม่มีค่าใช้จ่ายแฝงด้านโครงสร้างพื้นฐาน

ดูกลุ่ม

API เดียวสำหรับ AI สื่อทุกประเภท

สำรวจโมเดลทั้งหมด