


Qwen Image 2.0 คือโมเดลสร้างภาพเจเนอเรชันถัดไปจากทีม Qwen ของ Alibaba Cloud ออกแบบมาสำหรับอินพุตทั้งข้อความและรูปภาพ พร้อมให้เอาต์พุตความละเอียดระดับ 2K การยึดโยงกับความหมายที่แม่นยำยิ่งขึ้น รายละเอียดสมจริง และการทำตามคำสั่งอย่างแม่นยำ ครอบคลุมเวิร์กโฟลว์ทั้งการสร้างและการแก้ไข Atlas Cloud มี REST endpoints ที่พร้อมใช้งานสำหรับทั้งสองโหมด โดยไม่มี cold starts และคิดค่าบริการมาตรฐาน $0.035 ต่อรูปภาพ เริ่มพัฒนาได้เลยวันนี้
Qwen Image 2.0 พัฒนาโดย Alibaba โดย Atlas Cloud (ดำเนินการโดย Atlas Cloud AI LLC) เป็นผู้ให้บริการเข้าถึงโมเดลนี้ แต่ไม่ได้เป็นเจ้าของโมเดล เครื่องหมายการค้าทั้งหมดเป็นของเจ้าของที่เกี่ยวข้อง
Atlas Cloud มอบโมเดลสร้างสรรค์ล่าสุดที่นำหน้าในอุตสาหกรรมให้กับคุณ
เปรียบเทียบ 2 endpoints ของ Qwen Image 2.0 สำหรับสร้างและปรับแต่งภาพที่ความละเอียดสูงสุด 2K
| รูปแบบข้อมูล | คำอธิบาย |
|---|---|
| Qwen Image 2.0 Text to Image API | แปลงข้อความพรอมต์เป็นภาพที่ความละเอียดสูงสุด 2K พร้อมความเข้าใจพรอมต์และคุณภาพของภาพที่ดียิ่งขึ้น ใช้ endpoint นี้สำหรับคอนเซปต์อาร์ต ภาพสินค้า สื่อการตลาด และเวิร์กโฟลว์ด้านภาพอื่น ๆ ที่ขับเคลื่อนด้วยพรอมต์ |
| Qwen Image 2.0 Edit API | ออกแบบมาสำหรับการแก้ไขภาพ โดย endpoint นี้จะใช้คำสั่งที่เขียนขึ้นกับภาพที่มีอยู่ และสร้างผลลัพธ์ที่ความละเอียดสูงสุด 2K เหมาะสำหรับการปรับแต่งแอสเซ็ต การสร้างรูปแบบสร้างสรรค์ที่หลากหลาย การเปลี่ยนแปลงภาพแบบเจาะจง และเวิร์กโฟลว์การผลิตแบบปรับปรุงซ้ำ |
Qwen Image 2.0 รองรับเอาต์พุตสูงสุด 2K เข้าใจพรอมป์ตได้ดียิ่งขึ้น แสดงผลข้อความสองภาษา แก้ไขภาพโดยอ้างอิงภาพต้นแบบ ใช้ seed ซ้ำเพื่อสร้างผลลัพธ์ที่ทำซ้ำได้ และเข้าถึงผ่าน Atlas Cloud REST พร้อมราคาแบบจ่ายตามการใช้งานที่โปร่งใส

Qwen Image 2.0 สร้างภาพได้ที่ขนาดตั้งแต่ 512 ถึง 2048 พิกเซลต่อด้าน โดยรองรับเอาต์พุตสูงสุด 2K คุณภาพภาพที่ได้รับการปรับปรุงช่วยรักษารายละเอียดของพื้นผิวเล็ก ๆ ฉากที่มีหลายชั้น และองค์ประกอบภาพขนาดเล็กทั่วทั้งเฟรม เลือกขนาดให้เหมาะกับรูปแบบการส่งมอบของคุณ โมเดลนี้จึงเหมาะอย่างยิ่งสำหรับภาพสินค้า ภาพถ่ายเชิงบรรณาธิการ และคอนเซ็ปต์อาร์ตที่มีรายละเอียดสูง

จัดการบรีฟที่มีโครงสร้างได้ง่ายด้วยพรอมป์ตความยาวสูงสุด 800 ตัวอักษรในภาษาอังกฤษหรือภาษาจีน ระบุวัตถุ แสง องค์ประกอบ วัสดุ และการเคลื่อนไหวไว้ในคำสั่งเดียว จากนั้นใช้ seed แบบคงที่เมื่อต้องการสร้างผลลัพธ์ซ้ำที่เปรียบเทียบกันได้ ความเข้าใจพรอมป์ตที่ดีขึ้นช่วยรักษาความสัมพันธ์ระหว่างองค์ประกอบหลายรายการที่ร้องขอ แนวคิดซับซ้อนจึงคาดเดาผลลัพธ์ได้มากขึ้นสำหรับแคมเปญ ฉากสถาปัตยกรรม และเวิร์กโฟลว์สร้างสรรค์ที่ต้องการการกำกับ

ข้อความภาษาอังกฤษและภาษาจีนที่อ่านง่ายสามารถปรากฏอยู่ภายในภาพที่หนาแน่นและจัดองค์ประกอบอย่างพิถีพิถัน โมเดลผสานการเรนเดอร์หลายภาษากับการจัดองค์ประกอบที่เชื่อถือได้ ช่วยให้ป้ายกำกับ ป้ายประกาศ พาดหัว และกราฟิกประกอบยังคงสอดคล้องกับฉากโดยรอบ การกำกับสองภาษาจึงอยู่ภายในภาพได้โดยไม่ต้องเพิ่มเป็นโอเวอร์เลย์แยกต่างหาก ใช้ฟีเจอร์นี้กับกราฟิกโปรโมตขนาดกว้าง ภาพประกอบงานนำเสนอ เมนู และอาร์ตเวิร์กที่มีข้อมูลจำนวนมาก ซึ่งหากทำด้วยวิธีเดิมอาจต้องเก็บรายละเอียดด้วยตนเองอย่างมาก

เริ่มต้นด้วยภาพอ้างอิงหนึ่งถึงสามภาพ แล้วอธิบายการแก้ไขที่ต้องการด้วยภาษาธรรมชาติ edit endpoint รองรับคำสั่งความยาวสูงสุด 800 ตัวอักษร และส่งคืนภาพได้สูงสุด 2K พร้อมใช้ seed เพื่อให้การรันซ้ำได้ผลลัพธ์ที่สม่ำเสมอ เวิร์กโฟลว์ที่ควบคุมได้นี้เหมาะสำหรับการปรับแก้ภาพสินค้า การปรับสไตล์ภาพ และการพัฒนางานสร้างสรรค์แบบวนซ้ำ โดยไม่ต้องสร้างองค์ประกอบต้นฉบับขึ้นใหม่ทั้งหมด

ขนาดเอาต์พุตกำหนดได้ตั้งแต่ 512 ถึง 2048 พิกเซลต่อด้าน และ seed รองรับค่าตั้งแต่ 0 ถึง 2147483647 โดยยังสามารถใช้ seed แบบสุ่มด้วยค่าเริ่มต้นเป็น -1 ได้ เลือกแคนวาสให้เหมาะกับงานสี่เหลี่ยมจัตุรัส แนวนอน หรือแนวตั้ง พร้อมรักษาจุดเริ่มต้นที่ทำซ้ำได้ การควบคุมเหล่านี้ช่วยให้การทดสอบอย่างเป็นระบบและการผลิตแอสเซ็ตที่สม่ำเสมอในหลายตำแหน่งใช้งานทำได้ง่ายขึ้น

Atlas Cloud ให้บริการสร้างภาพจากข้อความและแก้ไขภาพผ่าน REST endpoints ในราคามาตรฐาน $0.035 ต่อภาพ ระบบ inference พร้อมใช้งาน ไม่มี cold start และรองรับ Day 0 access ช่วยลดภาระการโฮสต์โมเดล ขณะที่ unified API ช่วยให้การผสานรวมระหว่างโมเดลในตระกูลเดียวกันมีรูปแบบสอดคล้องกัน การตั้งค่านี้รองรับทั้งต้นแบบ เครื่องมือสำหรับใช้งานจริง และไปป์ไลน์ประมวลผลภาพที่ขยายขนาดได้ พร้อมการเรียกเก็บเงินแบบจ่ายตามการใช้งานที่โปร่งใส
ดูว่า Qwen Image 2.0 และโมเดลภาพอีกสองรุ่นที่เทียบเคียงกันตีความพรอมต์เดียวกันอย่างไร ทั้งในงานออกแบบกราฟิกที่ต้องการความแม่นยำและภาพถ่ายสารคดีที่เคลื่อนไหวรวดเร็ว
ภาพเบื้องหลังภาพยนตร์ภัยพิบัติบนโต๊ะถ่ายทำ ณ จังหวะชี้ขาด: มือสมจริงของนักทำโมเดลหนุ่มเอื้อมเข้ามาในเฟรมเพื่อประคองประภาคารจำลองที่ถูกคลื่นสูงตระหง่านซึ่งพุ่งออกมาจากถ้วยชาสีขาวครีมซัดจนเอียง ขณะที่ทีมงานตัวจิ๋วหลายคนวิ่งหนีอย่างตื่นตระหนก โดยถือกล้องสีน้ำเงินกรมท่า ขาตั้งกล้อง สายเคเบิล และอุปกรณ์จัดแสง หนึ่งในกระดานคัทจำลองต้องอ่านได้อย่างคมชัดว่า “ถ้วยชาสุดท้าย” และ “เทค 07” ด้วยตัวอักษรสะอาดและสะกดถูกต้อง ผสานสัมผัสแบบแอนิเมชันสต็อปโมชันทำมือเข้ากับการถ่ายภาพมาโครเสมือนจริง เน้นความขบขันจากการปะทะกันของสเกลมนุษย์และสเกลจิ๋ว ตำแหน่งกล้องต่ำเฉียดไปตามพื้นโต๊ะ สายไฟพันกันและรอยทางน้ำเป็นประกายสร้างเส้นนำสายตาที่พุ่งไปยังประภาคารเอียงและถ้วยชา สกรูโลหะนอกโฟกัสบดบังพื้นที่เบื้องหน้าสุดบางส่วน เพื่อสร้างมิติซ้อนชั้นและความสับสนของสเกล แสงแดดเที่ยงวันจากทิศทางเดียวส่องผ่านมู่ลี่หน้าต่าง ทอดเงาลายเส้นคมชัดไปทั่วฉาก พร้อมหยดน้ำลอยตัวเป็นประกายและโมชั่นเบลอเล็กน้อยบนทีมงานที่กำลังหลบหนี จำกัดจานสีอย่างเคร่งครัดให้มีเพียงขาวครีม น้ำเงินกรมท่า และส้มเตือนภัย ลายไม้เก่า เนื้อกระดาษที่เปียกน้ำและพองย่น สีบนโมเดลที่กะเทาะ โลหะที่มีรอยขีดข่วน ผ้าเปียกชื้น และน้ำใสต้องดูน่าเชื่อถืออย่างยิ่ง โดยมีการหักเห แรงตึงผิว การกระเซ็น และความสัมพันธ์เชิงพื้นที่ที่ถูกต้องตามหลักฟิสิกส์ การเคลื่อนไหวหนาแน่นรอบหายนะใจกลางภาพสมดุลกับพื้นที่ว่างที่สงบกว่าใกล้ขอบเฟรม มีความไม่สมบูรณ์แบบงานทำมือ เกรนฟิล์มละเอียดแบบพอเหมาะ ระยะชัดตื้น เลนส์มาโคร โฟกัสระยะใกล้ การลดทอนแสงตามหลักออปติกอย่างสมจริง การถ่ายภาพเอฟเฟกต์จริงระดับพรีเมียม หลีกเลี่ยงการเรนเดอร์มันเงาจนเกินจริง ไม่มีรายละเอียดแน่นเต็มผนังแบบ HDR ไม่มีผิวที่ดูเป็นพลาสติก ไม่มีโทนสีขุ่นหรือสกปรก ไม่มีแสงเรืองทั่วภาพ ไม่มีแสงแบบแฟนตาซีมหากาพย์ราคาถูก ไม่มีบรรยากาศมืดแบบใต้น้ำหรือซากปรักหักพังในอวกาศ อัตราส่วนภาพแนวนอนกว้าง 16:9 เต็มพื้นที่ขอบจรดขอบ

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud
การแหกคุกจำลองกำลังเกิดขึ้นบนโต๊ะทำงานของช่างทำฟิกเกอร์ ณ จังหวะชี้ขาดที่ผู้สร้างเพิ่งเดินออกไป: ทีมฟิกเกอร์ดินเหนียวสีขาวที่ยังไม่ได้ลงสีตัวจิ๋วพับป้ายตรวจสอบกระดาษซึ่งมีคำว่า “ตรวจสอบขั้นสุดท้าย” ตัวเล็ก คมชัด และอ่านได้สมบูรณ์ ให้กลายเป็นบอลลูนลมร้อนแบบชั่วคราวได้อย่างชาญฉลาด หนึ่งในฟิกเกอร์เพิ่งตัดเชือกเส้นสุดท้าย บอลลูนกระดาษกระตุกลอยขึ้นพร้อมโมชั่นเบลอเล็กน้อย ขณะที่พวกพ้องถอยกรูด ส่งเสียงเฮ และจ้องมองขึ้นไปด้วยความตื่นตะลึง ขวดสีที่ล้มคว่ำปล่อยสายน้ำสีครามอุลตรามารีนคดเคี้ยวไหลผ่านฉาก ขอบน้ำมีรอยเท้าสีแดงชาดเล็ก ๆ และสะพานที่สร้างขึ้นอย่างด้นสด เรื่องราวเชิงพื้นที่ของโลกจิ๋วต้องแม่นยำ โดยตัวละครทุกตัวกำลังทำสิ่งที่แตกต่างกัน ชั้นวางเครื่องมือไม้สร้างกรอบซ้อนกรอบที่โดดเด่น แหนบ เหล็กแหลมสำหรับปั้น และมีดงานประดิษฐ์สร้างเส้นนำสายตาเป็นแนวรัศมีไปยังบอลลูนที่กำลังลอยขึ้น รักษาพื้นที่ว่างสะอาดและไม่รกบริเวณมุมขวาบน แสงจากหน้าต่างส่องเข้ามาเฉียงจากด้านซ้าย ทำให้เกิดเงาทอดยาวขอบนุ่ม และเผยให้เห็นรอยนิ้วมือที่กดลงบนดินดิบ ลายไม้ที่สึกกร่อน เส้นใยกระดาษที่พับ เครื่องมือโลหะมีรอยขีดข่วน และผิวเหนียวของสีที่แห้งไปครึ่งหนึ่ง ใช้จานสีเพียงสามสีอย่างเคร่งครัด ได้แก่ ขาวดินเหนียว น้ำเงินอุลตรามารีน และแดงชาด พร้อมความหลากหลายของโทนสีตามธรรมชาติอย่างพอเหมาะ ห้ามมีสีเน้นอื่น ผสานแอนิเมชันสต็อปโมชันอันประณีตเข้ากับการถ่ายภาพภาพยนตร์มาโครเสมือนจริง มีความไม่สมบูรณ์แบบแบบงานทำมือ ระยะชัดตื้นเฉพาะจุด เครื่องมือเบื้องหน้าที่เบลอนุ่ม การกระทำตรงกลางภาพที่คมชัด เกรนฟิล์มแอนะล็อกละเอียด เลนส์มาโคร 100mm ให้ความรู้สึกแบบภาพยนตร์แต่ยังใกล้ชิด สมจริงในด้านเอฟเฟกต์จริงอย่างมีรสนิยม ไม่มีพื้นผิวพลาสติกมันวาว ไม่มีการเรนเดอร์มันเยิ้มเกินจริง ไม่มี HDR ไม่มีสีขุ่น ไม่มีแสงเรืองทั่วภาพ ไม่มีสไตล์แฟนตาซีมหากาพย์ราคาถูก ไม่มีบรรยากาศมืดแบบใต้น้ำหรือซากปรักหักพังในอวกาศ องค์ประกอบภาพแนวนอนกว้าง 16:9 เต็มเฟรมขอบจรดขอบ

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud
Qwen Image 2.0 เปลี่ยนพรอมต์โดยละเอียดและภาพที่มีอยู่ให้เป็นกราฟิกสำหรับการนำเสนอ แอสเซ็ตแคมเปญ ฉากผลิตภัณฑ์ สตอรีบอร์ด ภาพที่ปรับให้เหมาะกับท้องถิ่น และการแก้ไขอย่างแม่นยำที่ความละเอียดสูงสุด 2K
เปลี่ยนพรอมต์โดยละเอียดให้เป็นภาพประกอบงานนำเสนอที่ผ่านการขัดเกลา พร้อมเลย์เอาต์ที่มีโครงสร้างและข้อความในภาพที่อ่านง่าย ทีมผลิตภัณฑ์สามารถสร้างสไลด์แนวคิด สื่ออธิบาย และแอสเซ็ตสำหรับการนำเสนอภายในที่ความละเอียดสูงสุด 2K
การเรนเดอร์ตัวอักษรอย่างมืออาชีพช่วยเพิ่มความชัดเจนให้โปสเตอร์ กราฟิกโซเชียล และแนวคิดแคมเปญที่สร้างจากพรอมต์โดยละเอียด ทีมการตลาดจะได้แนวทางภาพที่ปรับใช้ได้สำหรับการเปิดตัว โปรโมชั่น และการสื่อสารภายใต้แบรนด์ โดยไม่ต้องสร้างองค์ประกอบทั้งหมดใหม่ด้วยตนเอง
เมื่อฉากผลิตภัณฑ์ต้องการรายละเอียด ให้สร้างฉากจากพรอมต์เชิงบรรยายที่ความละเอียดสูงสุด 2K ผู้ค้าปลีกและสตูดิโอครีเอทีฟสามารถปรับแต่งพื้นหลัง วัตถุโดยรอบ หรือบริบทของแคมเปญผ่านคำสั่งแก้ไขที่ชัดเจน เพื่อรองรับการจัดวางที่หลากหลาย
ต้องการเปลี่ยนแปลงภาพที่มีอยู่โดยไม่ต้องเริ่มใหม่ใช่ไหม ให้คำสั่งที่ชัดเจนแก่เอนด์พอยต์สำหรับการแก้ไข เพื่ออัปเดตข้อความ วัตถุ ท่าทาง หรือสไตล์ รองรับความคิดเห็นจากลูกค้าและเวิร์กโฟลว์การผลิตแบบปรับแก้ซ้ำในปริมาณมาก
โปสเตอร์และคู่มือที่มีข้อความจำนวนมากสามารถผสานการเล่าเรื่องด้วยภาพเข้ากับตัวอักษรหลายภาษา ทีมคอนเทนต์ระดับโลกสามารถสร้างสื่อการท่องเที่ยวที่ปรับให้เหมาะกับท้องถิ่น กราฟิกอีเวนต์ และแนวคิดแคมเปญระดับภูมิภาคไว้ในภาพเดียวที่จัดองค์ประกอบเสร็จสมบูรณ์
พรอมต์โดยละเอียดสามารถถ่ายทอดเรื่องราวเป็นการ์ตูน ปฏิทิน หรือช่องสตอรีบอร์ดที่มีองค์ประกอบภาพเป็นระบบ ครีเอเตอร์สามารถสำรวจลำดับเหตุการณ์ สื่ออธิบายเชิงการศึกษา และแนวคิดแคมเปญ ก่อนทุ่มทรัพยากรให้กับการผลิตเต็มรูปแบบ
เปรียบเทียบ endpoints ของ Qwen Image 2.0 กับตัวเลือกจาก Microsoft ตามประเภทงาน ความละเอียดเอาต์พุตสูงสุด และราคามาตรฐานต่อภาพ
| โมเดล | ประเภทงาน | ความละเอียดสูงสุด | ราคามาตรฐาน |
|---|---|---|---|
| Qwen Image 2.0 Text-to-image | การสร้างภาพจากข้อความ | 2048 × 2048 | $0.035/image |
| Qwen Image 2.0 Edit | การแก้ไขภาพ | 2048 × 2048 | $0.035/image |
| MAI-Image-2.6-Flash Text-to-image | การสร้างภาพจากข้อความ | สูงสุด 2.36 MP เทียบเท่า 1536 × 1536 | $0.044/image |
| MAI-Image-2.6-Flash Edit | การแก้ไขภาพ | สูงสุด 2.36 MP เทียบเท่า 1536 × 1536 | $0.047/image |
เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud
สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล
การรวมโมเดล Qwen Image 2.0 ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้
เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์
API แบบรวมศูนย์:
รัน Qwen Image 2.0, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว
ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless
ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต
ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม
ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา
Qwen Image 2.0 เป็นโมเดลสร้างภาพจากทีม Qwen ของ Alibaba สำหรับสร้างภาพจากข้อความและแก้ไขภาพที่มีอยู่ด้วยคำสั่ง โดย Atlas Cloud มี REST API endpoint เฉพาะสำหรับทั้งสองงาน พร้อมรองรับความละเอียดเอาต์พุตสูงสุด 2K
ใช้โมเดลนี้สร้างภาพจากคำอธิบายโดยละเอียด หรือปรับเปลี่ยนภาพที่มีอยู่ด้วยคำสั่งภาษาธรรมชาติ ความเข้าใจ prompt ที่ได้รับการปรับปรุงช่วยรองรับเวิร์กโฟลว์ต่าง ๆ เช่น กราฟิกการตลาด คอนเซปต์อาร์ต ภาพสินค้า อินโฟกราฟิก และงานออกแบบภาพ
เหมาะสม Atlas Cloud ระบุว่าโมเดลรองรับข้อความในภาพที่อ่านได้ชัดเจนและ prompt ที่ซับซ้อน จึงเหมาะสำหรับอินโฟกราฟิก โปสเตอร์ สื่อการตลาด และเลย์เอาต์ที่มีโครงสร้างอื่น ๆ ควรระบุข้อความและคำสั่งด้านเลย์เอาต์อย่างชัดเจนภายในขีดจำกัด prompt 800 ตัวอักษรของ API
สร้าง API key ในแดชบอร์ด Atlas Cloud เลือก model ID สำหรับการสร้างหรือแก้ไขภาพ แล้วส่ง REST request ระบบ inference ที่โฮสต์ไว้ทำให้ไม่จำเป็นต้องตั้งค่า GPU ภายในเครื่องหรือ deploy model weights เอง
ส่ง authenticated POST request ไปยัง https://api.atlascloud.ai/api/v1/model/generateImage โดยระบุ model ID และอินพุตใน JSON body request แบบอะซิงโครนัสจะส่งคืน prediction ID ซึ่งสามารถใช้ polling ผ่าน prediction endpoint จนกว่าการประมวลผลจะเสร็จสิ้น
เลือก qwen/qwen-image-2.0/text-to-image เมื่อต้องการสร้างภาพใหม่จาก prompt หากต้องการแก้ไขภาพอ้างอิงด้วยคำสั่ง ให้เลือก qwen/qwen-image-2.0/edit
การสร้างภาพจากข้อความต้องระบุ prompt และรองรับค่า size กับ seed ซึ่งเป็นตัวเลือกเสริม ส่วนการแก้ไขภาพต้องระบุอาร์เรย์ images โดย size และ seed ยังคงเป็นตัวเลือกเสริม ทั้งสอง endpoint รองรับ prompt ภาษาจีนและภาษาอังกฤษความยาวสูงสุด 800 ตัวอักษร
editing endpoint รองรับ URL ของภาพอ้างอิงตั้งแต่ 1 ถึง 3 รายการ โดยภาพแต่ละภาพต้องมีขนาดระหว่าง 384 ถึง 3072 พิกเซลในแต่ละมิติ ขนาดเอาต์พุตสามารถอยู่ระหว่าง 512 ถึง 2048 พิกเซล และข้อมูลโมเดลระบุว่ารองรับความละเอียดสูงสุด 2K
Atlas Cloud ระบุราคาพื้นฐานมาตรฐานที่ $0.035 ต่อ request สำหรับทั้ง endpoint การสร้างภาพจากข้อความและ endpoint การแก้ไขภาพ ราคานี้เป็นราคาแบบ pay-as-you-go ดั้งเดิมและไม่รวมส่วนลดชั่วคราว
กำหนดค่า seed เป็นจำนวนเต็มตั้งแต่ 0 ถึง 2147483647 เมื่อต้องการทดสอบที่ให้ผลลัพธ์ทำซ้ำได้ โดยค่าเริ่มต้น -1 จะเลือก seed แบบสุ่ม ควรใช้ model ID, prompt และ size เดิมเมื่อเปรียบเทียบเอาต์พุตหรือแยกสาเหตุของความแตกต่างที่ไม่คาดคิด
คู่มือ บทแนะนำ และอัปเดตผลิตภัณฑ์ ที่ช่วยให้คุณใช้ Atlas Cloud ได้อย่างเต็มประสิทธิภาพ