Seedance 2.0 Mini & Fast API ในราคาถูกที่สุดในโลก — ลดสูงสุดถึง 68% จากราคาทางการ
Hero background 1Hero background 2Hero background 3

Qwen Image 2.0 Native 2K

Qwen Image 2.0 คือโมเดลสร้างภาพเจเนอเรชันถัดไปจากทีม Qwen ของ Alibaba Cloud ออกแบบมาสำหรับอินพุตทั้งข้อความและรูปภาพ พร้อมให้เอาต์พุตความละเอียดระดับ 2K การยึดโยงกับความหมายที่แม่นยำยิ่งขึ้น รายละเอียดสมจริง และการทำตามคำสั่งอย่างแม่นยำ ครอบคลุมเวิร์กโฟลว์ทั้งการสร้างและการแก้ไข Atlas Cloud มี REST endpoints ที่พร้อมใช้งานสำหรับทั้งสองโหมด โดยไม่มี cold starts และคิดค่าบริการมาตรฐาน $0.035 ต่อรูปภาพ เริ่มพัฒนาได้เลยวันนี้

Qwen Image 2.0 พัฒนาโดย Alibaba โดย Atlas Cloud (ดำเนินการโดย Atlas Cloud AI LLC) เป็นผู้ให้บริการเข้าถึงโมเดลนี้ แต่ไม่ได้เป็นเจ้าของโมเดล เครื่องหมายการค้าทั้งหมดเป็นของเจ้าของที่เกี่ยวข้อง

สำรวจโมเดลชั้นนำ

Atlas Cloud มอบโมเดลสร้างสรรค์ล่าสุดที่นำหน้าในอุตสาหกรรมให้กับคุณ

โหมดการสร้างและแก้ไขของ Qwen Image 2.0

เปรียบเทียบ 2 endpoints ของ Qwen Image 2.0 สำหรับสร้างและปรับแต่งภาพที่ความละเอียดสูงสุด 2K

รูปแบบข้อมูลคำอธิบาย
Qwen Image 2.0 Text to Image APIแปลงข้อความพรอมต์เป็นภาพที่ความละเอียดสูงสุด 2K พร้อมความเข้าใจพรอมต์และคุณภาพของภาพที่ดียิ่งขึ้น ใช้ endpoint นี้สำหรับคอนเซปต์อาร์ต ภาพสินค้า สื่อการตลาด และเวิร์กโฟลว์ด้านภาพอื่น ๆ ที่ขับเคลื่อนด้วยพรอมต์
Qwen Image 2.0 Edit APIออกแบบมาสำหรับการแก้ไขภาพ โดย endpoint นี้จะใช้คำสั่งที่เขียนขึ้นกับภาพที่มีอยู่ และสร้างผลลัพธ์ที่ความละเอียดสูงสุด 2K เหมาะสำหรับการปรับแต่งแอสเซ็ต การสร้างรูปแบบสร้างสรรค์ที่หลากหลาย การเปลี่ยนแปลงภาพแบบเจาะจง และเวิร์กโฟลว์การผลิตแบบปรับปรุงซ้ำ

Qwen Image 2.0: จากพรอมป์ตสู่ผลงานที่แม่นยำ

Qwen Image 2.0 รองรับเอาต์พุตสูงสุด 2K เข้าใจพรอมป์ตได้ดียิ่งขึ้น แสดงผลข้อความสองภาษา แก้ไขภาพโดยอ้างอิงภาพต้นแบบ ใช้ seed ซ้ำเพื่อสร้างผลลัพธ์ที่ทำซ้ำได้ และเข้าถึงผ่าน Atlas Cloud REST พร้อมราคาแบบจ่ายตามการใช้งานที่โปร่งใส

รายละเอียดระดับ 2K ของ Qwen Image 2.0

รายละเอียดระดับ 2K ของ Qwen Image 2.0

Qwen Image 2.0 สร้างภาพได้ที่ขนาดตั้งแต่ 512 ถึง 2048 พิกเซลต่อด้าน โดยรองรับเอาต์พุตสูงสุด 2K คุณภาพภาพที่ได้รับการปรับปรุงช่วยรักษารายละเอียดของพื้นผิวเล็ก ๆ ฉากที่มีหลายชั้น และองค์ประกอบภาพขนาดเล็กทั่วทั้งเฟรม เลือกขนาดให้เหมาะกับรูปแบบการส่งมอบของคุณ โมเดลนี้จึงเหมาะอย่างยิ่งสำหรับภาพสินค้า ภาพถ่ายเชิงบรรณาธิการ และคอนเซ็ปต์อาร์ตที่มีรายละเอียดสูง

การควบคุมพรอมป์ตด้วย Qwen Image 2.0

การควบคุมพรอมป์ตด้วย Qwen Image 2.0

จัดการบรีฟที่มีโครงสร้างได้ง่ายด้วยพรอมป์ตความยาวสูงสุด 800 ตัวอักษรในภาษาอังกฤษหรือภาษาจีน ระบุวัตถุ แสง องค์ประกอบ วัสดุ และการเคลื่อนไหวไว้ในคำสั่งเดียว จากนั้นใช้ seed แบบคงที่เมื่อต้องการสร้างผลลัพธ์ซ้ำที่เปรียบเทียบกันได้ ความเข้าใจพรอมป์ตที่ดีขึ้นช่วยรักษาความสัมพันธ์ระหว่างองค์ประกอบหลายรายการที่ร้องขอ แนวคิดซับซ้อนจึงคาดเดาผลลัพธ์ได้มากขึ้นสำหรับแคมเปญ ฉากสถาปัตยกรรม และเวิร์กโฟลว์สร้างสรรค์ที่ต้องการการกำกับ

ตัวอักษรสองภาษา

ตัวอักษรสองภาษา

ข้อความภาษาอังกฤษและภาษาจีนที่อ่านง่ายสามารถปรากฏอยู่ภายในภาพที่หนาแน่นและจัดองค์ประกอบอย่างพิถีพิถัน โมเดลผสานการเรนเดอร์หลายภาษากับการจัดองค์ประกอบที่เชื่อถือได้ ช่วยให้ป้ายกำกับ ป้ายประกาศ พาดหัว และกราฟิกประกอบยังคงสอดคล้องกับฉากโดยรอบ การกำกับสองภาษาจึงอยู่ภายในภาพได้โดยไม่ต้องเพิ่มเป็นโอเวอร์เลย์แยกต่างหาก ใช้ฟีเจอร์นี้กับกราฟิกโปรโมตขนาดกว้าง ภาพประกอบงานนำเสนอ เมนู และอาร์ตเวิร์กที่มีข้อมูลจำนวนมาก ซึ่งหากทำด้วยวิธีเดิมอาจต้องเก็บรายละเอียดด้วยตนเองอย่างมาก

การแก้ไขโดยมีภาพอ้างอิงนำทาง

การแก้ไขโดยมีภาพอ้างอิงนำทาง

เริ่มต้นด้วยภาพอ้างอิงหนึ่งถึงสามภาพ แล้วอธิบายการแก้ไขที่ต้องการด้วยภาษาธรรมชาติ edit endpoint รองรับคำสั่งความยาวสูงสุด 800 ตัวอักษร และส่งคืนภาพได้สูงสุด 2K พร้อมใช้ seed เพื่อให้การรันซ้ำได้ผลลัพธ์ที่สม่ำเสมอ เวิร์กโฟลว์ที่ควบคุมได้นี้เหมาะสำหรับการปรับแก้ภาพสินค้า การปรับสไตล์ภาพ และการพัฒนางานสร้างสรรค์แบบวนซ้ำ โดยไม่ต้องสร้างองค์ประกอบต้นฉบับขึ้นใหม่ทั้งหมด

การควบคุมแคนวาสที่ทำซ้ำได้

การควบคุมแคนวาสที่ทำซ้ำได้

ขนาดเอาต์พุตกำหนดได้ตั้งแต่ 512 ถึง 2048 พิกเซลต่อด้าน และ seed รองรับค่าตั้งแต่ 0 ถึง 2147483647 โดยยังสามารถใช้ seed แบบสุ่มด้วยค่าเริ่มต้นเป็น -1 ได้ เลือกแคนวาสให้เหมาะกับงานสี่เหลี่ยมจัตุรัส แนวนอน หรือแนวตั้ง พร้อมรักษาจุดเริ่มต้นที่ทำซ้ำได้ การควบคุมเหล่านี้ช่วยให้การทดสอบอย่างเป็นระบบและการผลิตแอสเซ็ตที่สม่ำเสมอในหลายตำแหน่งใช้งานทำได้ง่ายขึ้น

การเข้าถึง Qwen Image 2.0 ผ่าน REST

การเข้าถึง Qwen Image 2.0 ผ่าน REST

Atlas Cloud ให้บริการสร้างภาพจากข้อความและแก้ไขภาพผ่าน REST endpoints ในราคามาตรฐาน $0.035 ต่อภาพ ระบบ inference พร้อมใช้งาน ไม่มี cold start และรองรับ Day 0 access ช่วยลดภาระการโฮสต์โมเดล ขณะที่ unified API ช่วยให้การผสานรวมระหว่างโมเดลในตระกูลเดียวกันมีรูปแบบสอดคล้องกัน การตั้งค่านี้รองรับทั้งต้นแบบ เครื่องมือสำหรับใช้งานจริง และไปป์ไลน์ประมวลผลภาพที่ขยายขนาดได้ พร้อมการเรียกเก็บเงินแบบจ่ายตามการใช้งานที่โปร่งใส

Qwen Image 2.0: หนึ่งพรอมต์สำหรับโมเดลภาพสามรุ่น

ดูว่า Qwen Image 2.0 และโมเดลภาพอีกสองรุ่นที่เทียบเคียงกันตีความพรอมต์เดียวกันอย่างไร ทั้งในงานออกแบบกราฟิกที่ต้องการความแม่นยำและภาพถ่ายสารคดีที่เคลื่อนไหวรวดเร็ว

พรอมต์

ภาพเบื้องหลังภาพยนตร์ภัยพิบัติบนโต๊ะถ่ายทำ ณ จังหวะชี้ขาด: มือสมจริงของนักทำโมเดลหนุ่มเอื้อมเข้ามาในเฟรมเพื่อประคองประภาคารจำลองที่ถูกคลื่นสูงตระหง่านซึ่งพุ่งออกมาจากถ้วยชาสีขาวครีมซัดจนเอียง ขณะที่ทีมงานตัวจิ๋วหลายคนวิ่งหนีอย่างตื่นตระหนก โดยถือกล้องสีน้ำเงินกรมท่า ขาตั้งกล้อง สายเคเบิล และอุปกรณ์จัดแสง หนึ่งในกระดานคัทจำลองต้องอ่านได้อย่างคมชัดว่า “ถ้วยชาสุดท้าย” และ “เทค 07” ด้วยตัวอักษรสะอาดและสะกดถูกต้อง ผสานสัมผัสแบบแอนิเมชันสต็อปโมชันทำมือเข้ากับการถ่ายภาพมาโครเสมือนจริง เน้นความขบขันจากการปะทะกันของสเกลมนุษย์และสเกลจิ๋ว ตำแหน่งกล้องต่ำเฉียดไปตามพื้นโต๊ะ สายไฟพันกันและรอยทางน้ำเป็นประกายสร้างเส้นนำสายตาที่พุ่งไปยังประภาคารเอียงและถ้วยชา สกรูโลหะนอกโฟกัสบดบังพื้นที่เบื้องหน้าสุดบางส่วน เพื่อสร้างมิติซ้อนชั้นและความสับสนของสเกล แสงแดดเที่ยงวันจากทิศทางเดียวส่องผ่านมู่ลี่หน้าต่าง ทอดเงาลายเส้นคมชัดไปทั่วฉาก พร้อมหยดน้ำลอยตัวเป็นประกายและโมชั่นเบลอเล็กน้อยบนทีมงานที่กำลังหลบหนี จำกัดจานสีอย่างเคร่งครัดให้มีเพียงขาวครีม น้ำเงินกรมท่า และส้มเตือนภัย ลายไม้เก่า เนื้อกระดาษที่เปียกน้ำและพองย่น สีบนโมเดลที่กะเทาะ โลหะที่มีรอยขีดข่วน ผ้าเปียกชื้น และน้ำใสต้องดูน่าเชื่อถืออย่างยิ่ง โดยมีการหักเห แรงตึงผิว การกระเซ็น และความสัมพันธ์เชิงพื้นที่ที่ถูกต้องตามหลักฟิสิกส์ การเคลื่อนไหวหนาแน่นรอบหายนะใจกลางภาพสมดุลกับพื้นที่ว่างที่สงบกว่าใกล้ขอบเฟรม มีความไม่สมบูรณ์แบบงานทำมือ เกรนฟิล์มละเอียดแบบพอเหมาะ ระยะชัดตื้น เลนส์มาโคร โฟกัสระยะใกล้ การลดทอนแสงตามหลักออปติกอย่างสมจริง การถ่ายภาพเอฟเฟกต์จริงระดับพรีเมียม หลีกเลี่ยงการเรนเดอร์มันเงาจนเกินจริง ไม่มีรายละเอียดแน่นเต็มผนังแบบ HDR ไม่มีผิวที่ดูเป็นพลาสติก ไม่มีโทนสีขุ่นหรือสกปรก ไม่มีแสงเรืองทั่วภาพ ไม่มีแสงแบบแฟนตาซีมหากาพย์ราคาถูก ไม่มีบรรยากาศมืดแบบใต้น้ำหรือซากปรักหักพังในอวกาศ อัตราส่วนภาพแนวนอนกว้าง 16:9 เต็มพื้นที่ขอบจรดขอบ

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud

พรอมต์

การแหกคุกจำลองกำลังเกิดขึ้นบนโต๊ะทำงานของช่างทำฟิกเกอร์ ณ จังหวะชี้ขาดที่ผู้สร้างเพิ่งเดินออกไป: ทีมฟิกเกอร์ดินเหนียวสีขาวที่ยังไม่ได้ลงสีตัวจิ๋วพับป้ายตรวจสอบกระดาษซึ่งมีคำว่า “ตรวจสอบขั้นสุดท้าย” ตัวเล็ก คมชัด และอ่านได้สมบูรณ์ ให้กลายเป็นบอลลูนลมร้อนแบบชั่วคราวได้อย่างชาญฉลาด หนึ่งในฟิกเกอร์เพิ่งตัดเชือกเส้นสุดท้าย บอลลูนกระดาษกระตุกลอยขึ้นพร้อมโมชั่นเบลอเล็กน้อย ขณะที่พวกพ้องถอยกรูด ส่งเสียงเฮ และจ้องมองขึ้นไปด้วยความตื่นตะลึง ขวดสีที่ล้มคว่ำปล่อยสายน้ำสีครามอุลตรามารีนคดเคี้ยวไหลผ่านฉาก ขอบน้ำมีรอยเท้าสีแดงชาดเล็ก ๆ และสะพานที่สร้างขึ้นอย่างด้นสด เรื่องราวเชิงพื้นที่ของโลกจิ๋วต้องแม่นยำ โดยตัวละครทุกตัวกำลังทำสิ่งที่แตกต่างกัน ชั้นวางเครื่องมือไม้สร้างกรอบซ้อนกรอบที่โดดเด่น แหนบ เหล็กแหลมสำหรับปั้น และมีดงานประดิษฐ์สร้างเส้นนำสายตาเป็นแนวรัศมีไปยังบอลลูนที่กำลังลอยขึ้น รักษาพื้นที่ว่างสะอาดและไม่รกบริเวณมุมขวาบน แสงจากหน้าต่างส่องเข้ามาเฉียงจากด้านซ้าย ทำให้เกิดเงาทอดยาวขอบนุ่ม และเผยให้เห็นรอยนิ้วมือที่กดลงบนดินดิบ ลายไม้ที่สึกกร่อน เส้นใยกระดาษที่พับ เครื่องมือโลหะมีรอยขีดข่วน และผิวเหนียวของสีที่แห้งไปครึ่งหนึ่ง ใช้จานสีเพียงสามสีอย่างเคร่งครัด ได้แก่ ขาวดินเหนียว น้ำเงินอุลตรามารีน และแดงชาด พร้อมความหลากหลายของโทนสีตามธรรมชาติอย่างพอเหมาะ ห้ามมีสีเน้นอื่น ผสานแอนิเมชันสต็อปโมชันอันประณีตเข้ากับการถ่ายภาพภาพยนตร์มาโครเสมือนจริง มีความไม่สมบูรณ์แบบแบบงานทำมือ ระยะชัดตื้นเฉพาะจุด เครื่องมือเบื้องหน้าที่เบลอนุ่ม การกระทำตรงกลางภาพที่คมชัด เกรนฟิล์มแอนะล็อกละเอียด เลนส์มาโคร 100mm ให้ความรู้สึกแบบภาพยนตร์แต่ยังใกล้ชิด สมจริงในด้านเอฟเฟกต์จริงอย่างมีรสนิยม ไม่มีพื้นผิวพลาสติกมันวาว ไม่มีการเรนเดอร์มันเยิ้มเกินจริง ไม่มี HDR ไม่มีสีขุ่น ไม่มีแสงเรืองทั่วภาพ ไม่มีสไตล์แฟนตาซีมหากาพย์ราคาถูก ไม่มีบรรยากาศมืดแบบใต้น้ำหรือซากปรักหักพังในอวกาศ องค์ประกอบภาพแนวนอนกว้าง 16:9 เต็มเฟรมขอบจรดขอบ

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud

จากบรีฟสู่ภาพสำเร็จด้วย Qwen Image 2.0

Qwen Image 2.0 เปลี่ยนพรอมต์โดยละเอียดและภาพที่มีอยู่ให้เป็นกราฟิกสำหรับการนำเสนอ แอสเซ็ตแคมเปญ ฉากผลิตภัณฑ์ สตอรีบอร์ด ภาพที่ปรับให้เหมาะกับท้องถิ่น และการแก้ไขอย่างแม่นยำที่ความละเอียดสูงสุด 2K

การออกแบบงานนำเสนอด้วย Qwen Image 2.0

เปลี่ยนพรอมต์โดยละเอียดให้เป็นภาพประกอบงานนำเสนอที่ผ่านการขัดเกลา พร้อมเลย์เอาต์ที่มีโครงสร้างและข้อความในภาพที่อ่านง่าย ทีมผลิตภัณฑ์สามารถสร้างสไลด์แนวคิด สื่ออธิบาย และแอสเซ็ตสำหรับการนำเสนอภายในที่ความละเอียดสูงสุด 2K

ตัวอักษรสำหรับแอสเซ็ตแคมเปญ

การเรนเดอร์ตัวอักษรอย่างมืออาชีพช่วยเพิ่มความชัดเจนให้โปสเตอร์ กราฟิกโซเชียล และแนวคิดแคมเปญที่สร้างจากพรอมต์โดยละเอียด ทีมการตลาดจะได้แนวทางภาพที่ปรับใช้ได้สำหรับการเปิดตัว โปรโมชั่น และการสื่อสารภายใต้แบรนด์ โดยไม่ต้องสร้างองค์ประกอบทั้งหมดใหม่ด้วยตนเอง

ฉากผลิตภัณฑ์ด้วย Qwen Image 2.0

เมื่อฉากผลิตภัณฑ์ต้องการรายละเอียด ให้สร้างฉากจากพรอมต์เชิงบรรยายที่ความละเอียดสูงสุด 2K ผู้ค้าปลีกและสตูดิโอครีเอทีฟสามารถปรับแต่งพื้นหลัง วัตถุโดยรอบ หรือบริบทของแคมเปญผ่านคำสั่งแก้ไขที่ชัดเจน เพื่อรองรับการจัดวางที่หลากหลาย

การแก้ไขภาพอย่างแม่นยำ

ต้องการเปลี่ยนแปลงภาพที่มีอยู่โดยไม่ต้องเริ่มใหม่ใช่ไหม ให้คำสั่งที่ชัดเจนแก่เอนด์พอยต์สำหรับการแก้ไข เพื่ออัปเดตข้อความ วัตถุ ท่าทาง หรือสไตล์ รองรับความคิดเห็นจากลูกค้าและเวิร์กโฟลว์การผลิตแบบปรับแก้ซ้ำในปริมาณมาก

โปสเตอร์และคู่มือที่ปรับให้เหมาะกับท้องถิ่น

โปสเตอร์และคู่มือที่มีข้อความจำนวนมากสามารถผสานการเล่าเรื่องด้วยภาพเข้ากับตัวอักษรหลายภาษา ทีมคอนเทนต์ระดับโลกสามารถสร้างสื่อการท่องเที่ยวที่ปรับให้เหมาะกับท้องถิ่น กราฟิกอีเวนต์ และแนวคิดแคมเปญระดับภูมิภาคไว้ในภาพเดียวที่จัดองค์ประกอบเสร็จสมบูรณ์

สตอรีบอร์ดด้วย Qwen Image 2.0

พรอมต์โดยละเอียดสามารถถ่ายทอดเรื่องราวเป็นการ์ตูน ปฏิทิน หรือช่องสตอรีบอร์ดที่มีองค์ประกอบภาพเป็นระบบ ครีเอเตอร์สามารถสำรวจลำดับเหตุการณ์ สื่ออธิบายเชิงการศึกษา และแนวคิดแคมเปญ ก่อนทุ่มทรัพยากรให้กับการผลิตเต็มรูปแบบ

Qwen Image 2.0 เมื่อเทียบกับ Image APIs ที่ใกล้เคียง

เปรียบเทียบ endpoints ของ Qwen Image 2.0 กับตัวเลือกจาก Microsoft ตามประเภทงาน ความละเอียดเอาต์พุตสูงสุด และราคามาตรฐานต่อภาพ

โมเดลประเภทงานความละเอียดสูงสุดราคามาตรฐาน
Qwen Image 2.0 Text-to-imageการสร้างภาพจากข้อความ2048 × 2048$0.035/image
Qwen Image 2.0 Editการแก้ไขภาพ2048 × 2048$0.035/image
MAI-Image-2.6-Flash Text-to-imageการสร้างภาพจากข้อความสูงสุด 2.36 MP เทียบเท่า 1536 × 1536$0.044/image
MAI-Image-2.6-Flash Editการแก้ไขภาพสูงสุด 2.36 MP เทียบเท่า 1536 × 1536$0.047/image

วิธีใช้ Qwen Image 2.0 บน Atlas Cloud

เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud

สร้างบัญชี Atlas Cloud

สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล

ทำไมต้องใช้ Qwen Image 2.0 บน Atlas Cloud

การรวมโมเดล Qwen Image 2.0 ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้

ประสิทธิภาพและความยืดหยุ่น

เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์

API แบบรวมศูนย์:
รัน Qwen Image 2.0, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว

ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless

องค์กรและขนาด

ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต

ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม

ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา

คำถามที่พบบ่อยเกี่ยวกับ Qwen Image 2.0 API

Qwen Image 2.0 เป็นโมเดลสร้างภาพจากทีม Qwen ของ Alibaba สำหรับสร้างภาพจากข้อความและแก้ไขภาพที่มีอยู่ด้วยคำสั่ง โดย Atlas Cloud มี REST API endpoint เฉพาะสำหรับทั้งสองงาน พร้อมรองรับความละเอียดเอาต์พุตสูงสุด 2K

ใช้โมเดลนี้สร้างภาพจากคำอธิบายโดยละเอียด หรือปรับเปลี่ยนภาพที่มีอยู่ด้วยคำสั่งภาษาธรรมชาติ ความเข้าใจ prompt ที่ได้รับการปรับปรุงช่วยรองรับเวิร์กโฟลว์ต่าง ๆ เช่น กราฟิกการตลาด คอนเซปต์อาร์ต ภาพสินค้า อินโฟกราฟิก และงานออกแบบภาพ

เหมาะสม Atlas Cloud ระบุว่าโมเดลรองรับข้อความในภาพที่อ่านได้ชัดเจนและ prompt ที่ซับซ้อน จึงเหมาะสำหรับอินโฟกราฟิก โปสเตอร์ สื่อการตลาด และเลย์เอาต์ที่มีโครงสร้างอื่น ๆ ควรระบุข้อความและคำสั่งด้านเลย์เอาต์อย่างชัดเจนภายในขีดจำกัด prompt 800 ตัวอักษรของ API

สร้าง API key ในแดชบอร์ด Atlas Cloud เลือก model ID สำหรับการสร้างหรือแก้ไขภาพ แล้วส่ง REST request ระบบ inference ที่โฮสต์ไว้ทำให้ไม่จำเป็นต้องตั้งค่า GPU ภายในเครื่องหรือ deploy model weights เอง

ส่ง authenticated POST request ไปยัง https://api.atlascloud.ai/api/v1/model/generateImage โดยระบุ model ID และอินพุตใน JSON body request แบบอะซิงโครนัสจะส่งคืน prediction ID ซึ่งสามารถใช้ polling ผ่าน prediction endpoint จนกว่าการประมวลผลจะเสร็จสิ้น

เลือก qwen/qwen-image-2.0/text-to-image เมื่อต้องการสร้างภาพใหม่จาก prompt หากต้องการแก้ไขภาพอ้างอิงด้วยคำสั่ง ให้เลือก qwen/qwen-image-2.0/edit

การสร้างภาพจากข้อความต้องระบุ prompt และรองรับค่า size กับ seed ซึ่งเป็นตัวเลือกเสริม ส่วนการแก้ไขภาพต้องระบุอาร์เรย์ images โดย size และ seed ยังคงเป็นตัวเลือกเสริม ทั้งสอง endpoint รองรับ prompt ภาษาจีนและภาษาอังกฤษความยาวสูงสุด 800 ตัวอักษร

editing endpoint รองรับ URL ของภาพอ้างอิงตั้งแต่ 1 ถึง 3 รายการ โดยภาพแต่ละภาพต้องมีขนาดระหว่าง 384 ถึง 3072 พิกเซลในแต่ละมิติ ขนาดเอาต์พุตสามารถอยู่ระหว่าง 512 ถึง 2048 พิกเซล และข้อมูลโมเดลระบุว่ารองรับความละเอียดสูงสุด 2K

Atlas Cloud ระบุราคาพื้นฐานมาตรฐานที่ $0.035 ต่อ request สำหรับทั้ง endpoint การสร้างภาพจากข้อความและ endpoint การแก้ไขภาพ ราคานี้เป็นราคาแบบ pay-as-you-go ดั้งเดิมและไม่รวมส่วนลดชั่วคราว

กำหนดค่า seed เป็นจำนวนเต็มตั้งแต่ 0 ถึง 2147483647 เมื่อต้องการทดสอบที่ให้ผลลัพธ์ทำซ้ำได้ โดยค่าเริ่มต้น -1 จะเลือก seed แบบสุ่ม ควรใช้ model ID, prompt และ size เดิมเมื่อเปรียบเทียบเอาต์พุตหรือแยกสาเหตุของความแตกต่างที่ไม่คาดคิด

สำรวจกลุ่มเพิ่มเติม

Seedance 2.5

Seedance 2.5 API พร้อมใช้งานแล้วบน Atlas Cloud! มอบโมเดลวิดีโอใหม่ล่าสุดของ ByteDance ให้กับนักพัฒนา สร้างวิดีโอเนทีฟได้นานถึง 30 วินาทีในการประมวลผลเพียงครั้งเดียวจากข้อความ รูปภาพเดียว หรือการอ้างอิงหลายรูปแบบสูงสุด 50 รายการ พร้อมเสียงที่ซิงโครไนซ์และข้อความหลายภาษาในเฟรม บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว โดยมีความสอดคล้องของวัตถุและระบบฟิสิกส์ที่ได้รับการปรับปรุงซึ่งช่วยให้ภาพระยะยาวมีความต่อเนื่อง

ดูกลุ่ม

Wan 3.0

Wan 3.0 API คือเจเนอเรชันถัดไปของตระกูลวิดีโอ Wan จาก Alibaba ซึ่งสร้างขึ้นเพื่อยกระดับการสร้างวิดีโอแบบยาว การควบคุมแบบหลายข้อมูลอ้างอิง และคุณภาพของภาพและเสียงให้ก้าวไปอีกขั้น Atlas Cloud ได้โฮสต์ Wan 2.7, 2.6 และ 2.5 ไว้แล้ว และ Wan 3.0 สามารถทำงานบนคีย์แบบรวมเดียวกันโดยไม่ต้องตั้งค่าแยกต่างหาก เริ่มต้นสร้างสรรค์ได้ตั้งแต่วันนี้ เลื่อนลงไปที่ส่วนจัดแสดงเพื่อดูว่า Wan 3.0 สามารถสร้างอะไรได้บ้าง

ดูกลุ่ม

MiniMax H3

MiniMax H3 คือผลิตภัณฑ์วิดีโอแบบมัลติโมดัลของ MiniMax สำหรับการสร้างสรรค์โดยใช้ข้อความ รูปภาพ และข้อมูลอ้างอิง ในเส้นทาง API ที่รองรับ ระบบจะคงลักษณะของวัตถุจากสื่ออ้างอิงไว้ มีอัตราส่วนภาพที่ยืดหยุ่น และจับคู่เสียงที่สร้างขึ้นกับภาพผ่าน H3 Developer โดยโปรไฟล์เอาต์พุตจะถูกเลือกตาม endpoint Atlas Cloud รวมผลิตภัณฑ์ในตระกูลนี้ไว้เบื้องหลังคีย์เดียวที่รองรับ OpenAI พร้อมการคิดค่าบริการตามการใช้งานอย่างโปร่งใส เริ่มต้นที่อัตรามาตรฐาน $0.038 ต่อวินาที เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

Seedream 5.0 Pro

Seedream 5.0 Pro API มอบโมเดลการแก้ไขภาพที่ควบคุมได้ของ ByteDance บน Atlas Cloud ให้กับนักพัฒนา โดยจะวางการแก้ไขอย่างแม่นยำด้วยจุดยึดและพิกัด แยกภาพออกเป็นเลเยอร์ที่แก้ไขได้ ผสานข้อมูลอ้างอิงหลายรายการ และจับคู่สีและวัสดุที่แน่นอน พร้อมข้อความหลายภาษาที่ความละเอียด 2K และ 3K บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว!

ดูกลุ่ม

Seedance 2.0

Seedance 2.0 คือโมเดลวิดีโอสำหรับการใช้งานจริงของ ByteDance ที่ออกแบบมาเพื่อสร้างช็อตได้อย่างแม่นยำ เปลี่ยนพรอมป์ต์เป็นวิดีโอ ทำให้ภาพเฟรมแรกเคลื่อนไหวโดยมีตัวเลือกให้ใช้คำแนะนำจากเฟรมสุดท้าย หรือปรับแต่งผลลัพธ์ด้วยสื่ออ้างอิงและการค้นหาเว็บแบบเลือกใช้ได้ Atlas Cloud รวมเวิร์กโฟลว์เหล่านี้ไว้ใน API เดียว พร้อมการคิดค่าบริการตามการใช้งานจริงอย่างโปร่งใสและคีย์เดียวที่เข้ากันได้กับ OpenAI เริ่มสร้างสรรค์ได้วันนี้

ดูกลุ่ม

GPT Image 2.5

ตระกูล gpt-image-2.5 จาก OpenAI มอบทางเลือก Flare และ Sunburst ให้แก่นักพัฒนาสำหรับกระบวนการทำงานด้านการสร้างภาพเพื่อใช้งานจริง เรนเดอร์ด้วยความละเอียดตามต้องการสูงสุด 3840x2160 และเลือกได้จากระดับคุณภาพ 5 ระดับ รวมถึง xhigh และ max เพื่อให้ตรงตามข้อกำหนดของเอาต์พุตแต่ละแบบ Atlas Cloud ให้บริการอนุมานผ่าน REST ที่พร้อมใช้งาน โดยไม่มี cold start และคิดค่าบริการตามมาตรฐานเริ่มต้นที่ $0.004 ต่อการสร้างภาพ เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

GPT Image 2

GPT Image 2 API ช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลรูปภาพล่าสุดของ OpenAI ซึ่งเป็นรุ่นสืบทอดจาก GPT Image 1.5 โดยสามารถสร้างและแก้ไขรูปภาพพร้อมกับการเรนเดอร์ข้อความที่แม่นยำทั้งในอักษรละตินและ CJK รวมถึงการจัดวางองค์ประกอบที่ยอดเยี่ยมสำหรับโปสเตอร์ ม็อกอัป และอินโฟกราฟิก บน Atlas Cloud คุณสามารถเข้าถึงโมเดลนี้ผ่าน API ที่เป็นหนึ่งเดียวร่วมกับโมเดลอื่นๆ อีกกว่า 300 รุ่น พร้อมเครดิตฟรี เวลาทำงาน 99.99% และไม่จำเป็นต้องมีการตรวจสอบยืนยันองค์กรจาก OpenAI

ดูกลุ่ม

Gemini Omni Flash

API ของ gemini omni นำตระกูล Gemini Omni Flash แบบมัลติโมดัลโดยกำเนิดจาก Google DeepMind ซึ่งรวมถึง Gemini Omni 1.1 Flash มาสู่นักพัฒนา สร้างวิดีโอสไตล์ภาพยนตร์พร้อมเสียงเนทีฟที่ซิงโครไนซ์กัน ทำให้ภาพนิ่งเคลื่อนไหวได้ด้วยการควบคุมเฟรมเริ่มต้นและเฟรมสิ้นสุดอย่างแม่นยำ หรือปรับแก้ฟุตเทจที่มีอยู่ผ่านการแก้ไขด้วยคำสั่งข้อความ โดยยังคงรักษาเนื้อหาที่ไม่ได้แก้ไขไว้ Atlas Cloud มอบคีย์เดียวที่เข้ากันได้กับ OpenAI การเข้าถึงแบบรวมศูนย์ และราคาที่โปร่งใสโดยคิดค่าบริการตามการใช้งาน เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

Grok Imagine

Grok Imagine API ครอบคลุมโมเดลรูปภาพ วิดีโอ และพูดของ xAI ตั้งแต่ Image 2.0 ถึง Video 1.5 และ xAI TTS v1 สร้างรูปภาพนิ่ง 1K หรือ 2K ในอัตราส่วน 14 แบบ ขยายฉากไปยัง 15 วินาทีของวิดีโอ 1080p ควบคุมภาพด้วยรูปภาพอ้างอิงได้ถึง 7 รูป หรือเพิ่มบรรยายเสียงในภาษา 20 ภาษา Atlas Cloud รันทุกโหมดบนเอนด์พอยต์เดียว มีราคาแบบจ่ายตามการใช้งาน ตั้งแต่ $0.02 ต่อรูปภาพและ $0.05 ต่อวินาที เริ่มสร้างวันนี้

ดูกลุ่ม

Google

โมเดลเชิงสร้างสรรค์ที่ทรงพลังที่สุดของ Google พร้อมใช้งานแล้วบน Atlas Cloud โดย Veo 3.1 นำเสนอการสร้างวิดีโอระดับภาพยนตร์ Nano Banana 2 ขับเคลื่อนการสร้างภาพที่มีความเที่ยงตรงสูง และ Gemini นำความชาญฉลาดแบบมัลติโมดัลมาสู่ทุกเวิร์กโฟลว์ เข้าถึงชุดโมเดลของ Google เต็มรูปแบบผ่าน API key เดียวพร้อมความพร้อมใช้งานระดับ Day-0 และการกำหนดราคาแบบจ่ายตามการใช้งาน (pay-as-you-go)

ดูกลุ่ม

Seedance 2.0 Mini

Seedance 2.0 Mini นำเสนอการสร้างวิดีโอแบบมัลติโมดัลของ ByteDance สู่เวิร์กโฟลว์ที่ความเร็วและต้นทุนมีความสำคัญสูงสุด โดยมอบความสามารถหลักของ Seedance 2.0 ในรูปแบบที่ใช้ทรัพยากรน้อยลง — สร้างได้เร็วกว่า ต้นทุนต่อวิดีโอต่ำกว่า และใช้การผสานรวม API เดิมที่คุณใช้อยู่แล้ว สำหรับทีมที่จัดการไปป์ไลน์ปริมาณมากหรือสร้างต้นแบบในสเกลขนาดใหญ่ Mini คือตัวเลือกเริ่มต้นที่ใช้งานได้จริง

ดูกลุ่ม

ByteDance

ตั้งแต่การสร้างวิดีโอระดับภาพยนตร์ไปจนถึงการสร้างภาพที่มีความละเอียดสูง โมเดลที่ทรงพลังที่สุดของ ByteDance พร้อมใช้งานแล้วบน Atlas Cloud รัน Seedance และ Seedream ในสเกลขนาดใหญ่ด้วยราคาการอนุมานที่ต่ำที่สุด และไม่มีค่าใช้จ่ายแฝงด้านโครงสร้างพื้นฐาน

ดูกลุ่ม

API เดียวสำหรับ AI สื่อทุกประเภท

สำรวจโมเดลทั้งหมด