


MAI Image 2.5 API นำเสนอชุดโมเดลการสร้างและแก้ไขภาพแบบสมจริงของ Microsoft ผ่าน endpoint เดียว ครอบคลุม text-to-image และการแก้ไขในเวอร์ชันมาตรฐานและ Flash นอกจากข้อความภายในภาพที่เชื่อถือได้แล้ว ยังสร้างภาพพอร์ตเทรตที่เป็นธรรมชาติ และใช้การให้เหตุผลเชิงภาพเพื่อให้องค์ประกอบของฉากสอดคล้องกัน Atlas Cloud มีราคาแบบจ่ายตามการใช้งานเริ่มต้นที่ $0.03 ต่อภาพ, การเข้าถึงแบบ Day-0 และคีย์เดียวที่เข้ากันได้กับ OpenAI
Atlas Cloud มอบโมเดลสร้างสรรค์ล่าสุดที่นำหน้าในอุตสาหกรรมให้กับคุณ
Endpoint 4 รายการครอบคลุมการสร้างภาพจากข้อความและการแก้ไขภาพ โดยแต่ละรายการมีทั้งระดับมาตรฐานและระดับ Flash พร้อมราคาต่อการเรียกใช้งานที่โปร่งใส
| รูปแบบการใช้งาน | คำอธิบาย |
|---|---|
| MAI Image 2.5 API (ข้อความเป็นภาพ) | เปลี่ยนพรอมป์ภาษาธรรมชาติให้เป็นภาพคุณภาพสูงที่มีรายละเอียดทางภาพโดดเด่นด้วยโมเดล text-to-image เรือธงของ Microsoft เหมาะสำหรับภาพงานการตลาด ภาพถ่ายสินค้าอีคอมเมิร์ซ และงานออกแบบเชิงพาณิชย์ที่ต้องการผลลัพธ์พร้อมใช้งานจริง ราคา $0.05 ต่อภาพ |
| MAI Image 2.5 Flash (ข้อความเป็นภาพ) | เมื่อทั้งอัตราการประมวลผลและงบประมาณสำคัญพอ ๆ กับความคมชัดสมจริง รุ่น Flash จะสร้างภาพบนสถาปัตยกรรม diffusion-based เดียวกันในต้นทุนที่ต่ำกว่า คือ $0.03 ต่อภาพ เหมาะกับไปป์ไลน์การสร้างภาพปริมาณมากและการทำต้นแบบอย่างรวดเร็วที่ต้องการคุณภาพสม่ำเสมอโดยไม่ทำให้ค่าใช้จ่ายบานปลาย |
| MAI Image 2.5 Edit API (การแก้ไขภาพ) | ส่งภาพที่มีอยู่พร้อมคำสั่งภาษาธรรมชาติเข้าไปเพื่อแก้ไขอย่างแม่นยำและควบคุมได้ แทนการสร้างใหม่ตั้งแต่ต้น Endpoint นี้รองรับการลบวัตถุ การแทนที่องค์ประกอบ และการปรับแก้เฉพาะพื้นที่ โดยยังคงองค์ประกอบรอบข้างไว้ตามเดิม คิดราคา $0.058 ต่อการแก้ไข |
| MAI Image 2.5 Flash Edit (การแก้ไขภาพ) | ทีมที่ใช้งานไปป์ไลน์การปรับแต่งปริมาณมากจะได้ความสามารถในการแก้ไขตามคำสั่งแบบเดียวกับโมเดล Edit มาตรฐาน ในต้นทุนที่ลดลงเหลือ $0.038 ต่อการแก้ไข ทำให้การทำความสะอาดแคตตาล็อกจำนวนมากและการอัปเดตแอสเซตเป็นล็อตใหญ่ทำได้จริง พร้อมคุมค่าใช้จ่ายต่อการดำเนินการให้อยู่ในระดับต่ำ |
การผสมผสานโมเดลขั้นสูงกับแพลตฟอร์มเร่งความเร็ว GPU ของ Atlas Cloud มอบความเร็ว ความสามารถในการปรับขนาด และการควบคุมเชิงสร้างสรรค์ที่ไม่มีใครเทียบได้สำหรับการสร้างภาพและวิดีโอ

MAI-Image-2.5 สร้างภาพถ่ายบุคคลที่สื่ออารมณ์และดูเป็นธรรมชาติ พร้อมโครงสร้างใบหน้า การจัดแสง และพื้นผิวที่แม่นยำจากพรอมต์ข้อความ โมเดลนี้เรนเดอร์ความสวยงามระดับภาพยนตร์พร้อมการจัดแสงที่สอดคล้องกับฉากที่บรรยายไว้ ได้รับการออกแบบมาสำหรับงานบรรณาธิการ การสร้างแบรนด์ และแคมเปญเชิงพาณิชย์ที่รูปภาพซึ่งเน้นมนุษย์เป็นศูนย์กลางจำเป็นต้องดูสมบูรณ์แบบโดยไม่ต้องผ่านกระบวนการโพสต์โปรเซสซิง

MAI-Image-2.5 นำเสนอความน่าเชื่อถือที่เพิ่มขึ้นสำหรับการสร้างข้อความภายในรูปภาพ โดยจัดการกับฉลากผลิตภัณฑ์ ป้าย พาดหัวข่าว และข้อความโฆษณาของแบรนด์ด้วยระยะห่างและการอ่านออกได้ที่ถูกต้อง สิ่งนี้ช่วยแก้ปัญหาจุดอ่อนที่มักพบในโมเดลการสร้างรูปภาพส่วนใหญ่ และทำให้ใช้งานได้จริงสำหรับม็อคอัพบรรจุภัณฑ์และเนื้อหาโฆษณาที่ต้องการข้อความที่อ่านได้ในผลลัพธ์ มันเป็นตัวเลือกที่เหมาะสมสำหรับเวิร์กโฟลว์การออกแบบที่ความแม่นยำของข้อความในภาพเป็นสิ่งที่ต่อรองไม่ได้

เอนด์พอยต์ MAI-Image-2.5 Edit ดำเนินการปรับเปลี่ยนแบบกำหนดเป้าหมายไปยังพื้นที่รูปภาพเฉพาะ: การลบองค์ประกอบที่ไม่ต้องการ การแทนที่หรือการเปลี่ยนสีวัตถุ การอัปเดตข้อความในป้ายที่มีอยู่ การเติมพื้นที่ที่ขาดหายไป และการทำความสะอาดข้อบกพร่องทางภาพ เช่น ความเบลอและจุดรบกวน การแก้ไขยังคงรักษาความสอดคล้องและองค์ประกอบไว้ตลอด ทำให้พื้นที่ที่ไม่ถูกสัมผัสยังคงสมบูรณ์ทางสายตา เป็นเครื่องมือที่ยอดเยี่ยมสำหรับการปรับปรุงผลิตภัณฑ์ การล้างข้อมูลแค็ตตาล็อก และการอัปเดตสินทรัพย์ทางการตลาด

MAI-Image-2.5 สร้างขึ้นโดยเฉพาะสำหรับแอปพลิเคชันการออกแบบเชิงพาณิชย์และระดับมืออาชีพ รองรับการสร้างแบรนด์ ม็อกอัปผลิตภัณฑ์ และเนื้อหาที่พร้อมสำหรับแคมเปญจากพรอมต์ข้อความ โมเดลจะรักษาความสมบูรณ์ของเลย์เอาต์และองค์ประกอบทั้งในระหว่างการสร้างและแก้ไข เพื่อผลิตสินทรัพย์ที่พร้อมใช้งานในการโฆษณาและแคมเปญผลิตภัณฑ์ นี่คือโซลูชันมาตรฐานสำหรับทีมออกแบบที่ผลิตภาพเชิงพาณิชย์ในขนาดใหญ่

MAI-Image-2.5 ใช้การให้เหตุผลเชิงวิสัยทัศน์เพื่อทำความเข้าใจความสัมพันธ์เชิงพื้นที่ การจัดวางวัตถุ และความสอดคล้องของแสงทั่วทั้งภาพ สิ่งนี้ทำให้เชื่อถือได้สำหรับการสร้างฉากที่องค์ประกอบหลายอย่างจำเป็นต้องอยู่ร่วมกันอย่างเป็นธรรมชาติ และสำหรับงานแก้ไขที่การปรับเปลี่ยนจำเป็นต้องเคารพบริบทโดยรอบ เหมาะสำหรับการแสดงภาพผลิตภัณฑ์ในฉากและขั้นตอนการทำงานใดๆ ที่ความแม่นยำของบริบทในผลลัพธ์มีความสำคัญ
พรอมต์เดียวกัน สร้างโดย Mai Image 2.5 และโมเดลภาพชั้นนำอื่น ๆ: โฆษณาสินค้าและไลฟ์สไตล์แบบภาพยนตร์
ภาพถ่ายมาโครหุ่นนิ่งเชิงบรรณาธิการ: แถวขวดแก้วสีทำมือแบบโบราณสำหรับร้านขายยาและน้ำหอม สูงต่ำไม่เท่ากัน — ทรงเตี้ย ทรงสูง ทรงป่อง — ตั้งอยู่บนขอบหน้าต่างปูนฉาบปูนขาวที่ผุกร่อน ผิวแก้วฝ้ามีริ้วและฟองอากาศเล็ก ๆ ที่ถูกกักอยู่ภายใน ช่วงขณะชี้ขาด: มือเปล่าของมนุษย์เอียงขวดสีอำพันใบหนึ่ง และเส้นของเหลวใสสะอาดบาง ๆ ห้อยค้างอยู่กลางอากาศ ถูกจับภาพและรับแสงในจังหวะที่กำลังร่วงลงมา แรงตึงผิวและขอบหยดคมกริบราวใบมีด ด้านหลัง ขวดอื่น ๆ หักเหแสงอาทิตย์ต่ำยาม golden hour ให้กระจายเป็น caustics สีอัญมณีซ้อนทับกัน — อำพัน เขียวขวดเข้ม ชมพูกุหลาบ — ค่อย ๆ คลานไปบนผิวปูนสีเทาหยาบที่มีคราบหินปูน แสงด้านข้างย้อนกลับมุมต่ำในช่วง golden hour กวาดผ่านเนื้อแก้ว สร้าง caustics ที่มีทิศทางและโฟกัสชัด พร้อม rim-light เรืองตามเส้นเงาของขวดแต่ละใบ องค์ประกอบภาพสร้างจากการทำซ้ำเชิงกราฟิกของแนวขวด วางตัดกับพื้นที่ผนังสีเทากลางกว้าง ๆ ในฐานะ negative space ระยะชัดตื้นบีบแนวขวดให้แน่น โดยมีมือที่กำลังรินและเส้นน้ำสะท้อนแสงเป็นจุดโฟกัสที่คมชัด พาเลตสีโทนอัญมณีจำกัดแค่อำพัน เขียวเข้ม และชมพูกุหลาบ ตัดกับผนังสีเทาหม่น — สุขุม ไม่ฉูดฉาด รายละเอียดมาโครสมจริงสูง: เกรนของแก้วฝ้า ฟองอากาศ พื้นผิวผนังชอล์ก ผิวของเหลวที่ตึงแน่น ละอองฝุ่นจาง ๆ ลอยในลำแสง เงียบงัน พร้อมร่องรอยของความมหัศจรรย์ ถ่ายด้วยเลนส์มาโคร 100mm แสงธรรมชาติจากหน้าต่าง งานจบแบบภาพถ่ายสินค้าเชิงบรรณาธิการ อัตราส่วนภาพ 16:9

Mai Image 2.5

Flux.2

Qwen Image 2.0
ร้านก๋วยเตี๋ยวริมถนนยามดึก ในเสี้ยววินาทีชี้ขาดที่ปรมาจารย์ lamian ดึงก้อนแป้งก้อนเดียวให้กลายเป็นพัดของเส้นก๋วยเตี๋ยวบางเท่าเส้นผมหลายสิบเส้นที่ขนานกันอย่างสมบูรณ์แบบและค้างอยู่กลางอากาศ เส้นแผ่ออกเหมือนพัดมือถือที่กำลังกางออก ขณะเดียวกันแป้งที่ฟุ้งกระจายและไอน้ำที่ลอยขึ้นระเบิดออกพร้อมกัน — นี่คือแอ็กชันที่ถูกจับไว้ระหว่างการเคลื่อนไหว ไม่ใช่การจัดท่า ใบหน้าของเขาจดจ่อสุดขีด กล้ามเนื้อตึงด้วยแรงที่ควบคุมไว้ คิ้วขมวด มีเหงื่อเม็ดหนึ่งที่ขมับ ด้านหลัง ผู้ชมที่เบลอหลุดโฟกัสกลั้นหายใจด้วยความคาดหวัง ภาพถ่ายสารคดีริมถนนที่สมจริง ใช้ภาษาภาพของเลนส์เทเลโฟโต้ ให้แสงด้วยหลอดทังสเตนอุ่นเพียงดวงเดียวของร้าน เป็นแสงด้านข้างย้อนกลับที่แข็ง คาดขอบเส้นก๋วยเตี๋ยวโปร่งแสงทุกเส้นให้เรืองสว่าง จับฝุ่นแป้งในอากาศให้เหมือนประกายไฟลอย และทำให้ไอน้ำสีขาวที่พวยพุ่งเปล่งแสง ส่วนแสงนีออนสีน้ำเงินเย็นของถนนยามค่ำด้านหลังละลายเป็นวงโบเก้นุ่ม ๆ การบีบระยะหลายชั้นของเทเลโฟโต้ทำให้มือของปรมาจารย์ ใบหน้าที่จดจ่อ และสายเส้นก๋วยเตี๋ยวดูแบนรวมอยู่ในระนาบเดียว เส้นขนานแน่น ๆ ทำหน้าที่ทั้งเป็นองค์ประกอบกราฟิกซ้ำ ๆ และเป็นเส้นนำสายตาตามธรรมชาติที่พาดสายตาข้ามเฟรม สมดุลสีเย็น-อุ่น — แสงทังสเตนสีอำพันด้านหน้า ตัดกับสีน้ำเงินเย็นลึกของยามค่ำ — สุขุมและไม่ฉูดฉาด พื้นผิวสัมผัสเข้มข้น: อนุภาคแป้งหยาบ ๆ เงาจาง ๆ ของกลูเตน เขียงไม้เก่าชุ่มน้ำมัน เหงื่อบนผิว และ motion blur ละเอียดบนเส้นที่ปลิวและผงแป้งที่ล่องลอย เกรนฟิล์มละเอียด ระยะชัดตื้น ไม่มีการเรนเดอร์เกินจริง ไม่มีผิวพลาสติก โทนสีธรรมชาติซื่อตรง ถ่ายด้วยเทเลโฟโต้ 135mm รูรับแสงกว้าง ให้ความรู้สึกภาพข่าวสารคดีแบบแคนดิด อัตราส่วนภาพ 16:9

Mai Image 2.5

Flux.2

Qwen Image 2.0
ตั้งแต่แคตตาล็อกอีคอมเมิร์ซและครีเอทีฟโฆษณา ไปจนถึงบรรจุภัณฑ์ ภาพโฆษกแบรนด์ และการแสดงภาพสินค้าในฉากจริง MAI Image 2.5 API รองรับงานออกแบบเชิงพาณิชย์ที่ทีมต้องส่งมอบในทุกวัน
สร้างภาพสินค้าบนพื้นหลังหลากหลายจากภาพอ้างอิงเพียงภาพเดียว จากนั้นเปลี่ยนสีและแก้ไขตำหนิให้ครบทั้งช่วง SKU ผ่าน Edit endpoint ชุดภาพตัวแปรที่ครบถ้วนมีต้นทุนน้อยกว่าการกลับไปถ่ายใหม่ในสตูดิโอเพียงครั้งเดียว
นักการตลาดสาย Performance สามารถผลิตเวอร์ชันต่าง ๆ สำหรับแบนเนอร์ โซเชียล และดิสเพลย์ พร้อมข้อความซ้อนทับที่แม่นยำและเลย์เอาต์ที่สอดคล้องกับแบรนด์ เนื่องจากรุ่น Flash มีค่าใช้จ่ายเพียง $0.03 ต่อภาพ การทดสอบคอนเซปต์หลายสิบแบบก่อนขยายผลจากแบบที่ชนะจึงยังประหยัด
ม็อกอัปบรรจุภัณฑ์มีตัวอักษรที่อ่านง่ายฝังอยู่ในอาร์ตเวิร์กของกล่อง ขวด และป้ายบนชั้นวางโดยตรง แทนที่จะต้องจัดวางด้วยมือ เมื่อถ้อยคำเปลี่ยน Edit endpoint จะช่วยแก้ชื่อ ราคา หรือข้อความตามฤดูกาลได้โดยไม่ต้องสร้างเลย์เอาต์ใหม่
ใบหน้าที่จดจำได้ เครื่องแต่งกาย และอัตลักษณ์โดยรวมยังคงเสถียรข้ามท่าทางและเลย์เอาต์ต่าง ๆ ผ่านการแก้ไขต่อเนื่อง วิธีนี้ช่วยให้ตัวละครประจำแคมเปญและซีรีส์โซเชียลต่อเนื่องดูเป็นเอกภาพไม่ว่าจะปรากฏที่ใด
เงาสะท้อน วัตถุแปลกปลอม และภาพเบลอจากการเคลื่อนไหวถูกลบออกได้อย่างสะอาด ขณะที่ inpainting เติมเต็มบริเวณที่ขาดหายและยังคงองค์ประกอบโดยรอบไว้เหมือนเดิม ด้วยค่าใช้จ่าย $0.058 ต่อการแก้ไข การทำความสะอาดภาพถ่ายเก่าหลายพันภาพจึงกลายเป็นงานแบตช์ตามปกติ
โมเดลสามารถให้เหตุผลเกี่ยวกับแสง สเกล และความสัมพันธ์เชิงพื้นที่ เพื่อวางสินค้าในฉากไลฟ์สไตล์พร้อมเงาและมุมมองที่สมจริง ทีมคอนเซปต์และต้นแบบสามารถพรีวิวไอเดียการจัดฉากได้ตั้งแต่ก่อนจองการถ่ายทำจริง
เปรียบเทียบ MAI Image 2.5 API แบบตัวต่อตัวกับโมเดล text-to-image ชั้นนำจาก Google, ByteDance และ Alibaba ในด้านผู้ให้บริการ ราคา ความละเอียด และการเรนเดอร์ข้อความในภาพ
| โมเดล | ผู้ให้บริการ | ราคาเริ่มต้น (ต่อภาพ) | ความละเอียดสูงสุด | การเรนเดอร์ข้อความในภาพ | เทียร์แบบเร็วที่ปรับต้นทุนให้คุ้มค่า |
|---|---|---|---|---|---|
| MAI-Image-2.5 (ข้อความเป็นรูปภาพ) | Microsoft | $0.05 | สูงสุด ~1 MP (สูงสุด 1360 px ต่อด้าน) | √ | √ |
| MAI-Image-2.5 Flash (ข้อความเป็นรูปภาพ) | Microsoft | $0.03 | สูงสุด ~1 MP (สูงสุด 1360 px ต่อด้าน) | √ | √ |
| Nano Banana 2 (ข้อความเป็นรูปภาพ) | $0.08 | สูงสุด 4K | √ | √ | |
| Seedream v4.5 | ByteDance | $0.04 | สูงสุด 2048×2048 | √ | - |
| Qwen Image 2.0 (ข้อความเป็นรูปภาพ) | Alibaba | $0.035 | สูงสุด 2048×2048 | √ | - |
เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud
สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล
การรวมโมเดล MAI Image 2.5 ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้
เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์
API แบบรวมศูนย์:
รัน MAI Image 2.5, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว
ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless
ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต
ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม
ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา
MAI Image 2.5 API ช่วยให้นักพัฒนาเข้าถึง MAI-Image-2.5 ของ Microsoft ผ่านโปรแกรมได้ ซึ่งเป็นโมเดลสร้างและแก้ไขภาพแบบ photorealistic ที่ออกแบบมาสำหรับงานออกแบบเชิงพาณิชย์ รองรับทั้งการสร้างภาพแบบ text-to-image และการแก้ไขภาพตามคำสั่ง โดยแต่ละแบบมีทั้งรุ่นมาตรฐานและรุ่น Flash บน Atlas Cloud คุณสามารถเรียกใช้ endpoints ทั้ง 4 แบบได้ผ่านคีย์เดียวที่ compatible กับ OpenAI พร้อมราคาแบบ pay-as-you-go เริ่มต้นที่ $0.03 ต่อภาพ
ทั้งสองรุ่นใช้สถาปัตยกรรม diffusion เดียวกัน มีความสมจริงแบบ photorealism และคุณภาพการเรนเดอร์ข้อความในระดับเดียวกัน Flash เป็นตัวเลือกที่ปรับต้นทุนให้คุ้มกว่า โดยมีราคา $0.03 ต่อภาพสำหรับการสร้างภาพ และ $0.038 ต่อการแก้ไขหนึ่งครั้ง ส่วนโมเดลมาตรฐานมีราคา $0.05 ต่อภาพ และ $0.058 ต่อการแก้ไขหนึ่งครั้ง เลือกใช้ Flash สำหรับงานสร้างภาพปริมาณมากและการทำ prototype อย่างรวดเร็ว และใช้โมเดลมาตรฐานกับงานที่ต้องการความเที่ยงตรงสูงสุด
ราคาบน Atlas Cloud เป็นแบบ pay-as-you-go โดยไม่มีค่าสมัครสมาชิก การสร้างภาพจากข้อความด้วยรุ่นมาตรฐานมีราคา $0.05 ต่อภาพ และการแก้ไขมาตรฐานมีราคา $0.058 ต่อการแก้ไขหนึ่งครั้ง ส่วนรุ่น Flash ลดเหลือ $0.03 ต่อภาพ และ $0.038 ต่อการแก้ไขหนึ่งครั้ง ระบบจะคิดเงินต่อการเรียกใช้งานที่สำเร็จ ดังนั้น batch ของภาพหลายแบบจะมีค่าใช้จ่ายเท่ากับค่าคงที่ต่อภาพคูณด้วยจำนวนผลลัพธ์เท่านั้น
สมัครใช้งานบน Atlas Cloud สร้าง API key หนึ่งชุด แล้วชี้ client เดิมที่ compatible กับ OpenAI ไปยัง endpoint ของ MAI-Image-2.5 ส่ง text prompt สำหรับการสร้างภาพ หรือส่งภาพพร้อมคำสั่งสำหรับการแก้ไข จากนั้น response จะส่งคืน URLs ของภาพที่เสร็จแล้ว การเข้าถึงแบบ Day-0 หมายความว่าโมเดลพร้อมใช้งานทันทีที่เปิดตัว โดยไม่ต้องเข้าคิวรอ เริ่มสร้างได้วันนี้
คุณกำหนดขนาดผลลัพธ์ได้ด้วยพารามิเตอร์ size ในรูปแบบ width by height โดยค่าเริ่มต้นคือ 1024 by 1024 แต่ละด้านกำหนดได้ตั้งแต่ 768 ถึง 1360 pixels ภายใต้เพดานรวมประมาณหนึ่ง megapixel ซึ่งครอบคลุมการจัดเฟรมแบบ square, portrait และ landscape รุ่นมาตรฐานและรุ่น Flash สำหรับการสร้างภาพมีข้อจำกัดด้านความละเอียดเหมือนกัน
Edit endpoint รับภาพต้นฉบับหนึ่งภาพ ซึ่งส่งได้เป็น URL หรือ base64 ในรูปแบบ JPEG หรือ PNG พร้อมคำสั่งภาษาธรรมชาติ จากนั้นจะทำการเปลี่ยนแปลงเฉพาะจุด เช่น ลบวัตถุ แทนที่องค์ประกอบ เปลี่ยนสี อัปเดตข้อความบนป้าย และล้างข้อบกพร่อง โดยยังคงพื้นที่ที่ไม่ได้แตะต้องไว้เหมือนเดิม เนื่องจากโมเดลสามารถให้เหตุผลเกี่ยวกับโครงสร้างฉากและแสงได้ การแก้ไขจึงยังสอดคล้องกับองค์ประกอบโดยรอบ
การเรนเดอร์ข้อความเป็นหนึ่งในจุดที่โมเดลพัฒนาได้มากที่สุด และ Microsoft รายงานว่าหมวดนี้มีการยกระดับคุณภาพมากที่สุดเมื่อเทียบกับรุ่นก่อนหน้า โมเดลสามารถสร้างฉลากสินค้า ป้าย หัวข้อ และข้อความแบรนด์ได้อย่างน่าเชื่อถือ โดยมีระยะห่างถูกต้องและอ่านได้ชัดเจน ความน่าเชื่อถือนี้ทำให้เหมาะกับ mockup บรรจุภัณฑ์และชิ้นงานโฆษณาที่ข้อความในภาพต้องอ่านได้จริง
บน Arena leaderboards สาธารณะ MAI-Image-2.5 เปิดตัวที่อันดับ No. 2 สำหรับการแก้ไขภาพ และ No. 3 สำหรับการสร้างภาพแบบ text-to-image จุดแข็งอยู่ที่ภาพ portrait แบบ photorealistic การเรนเดอร์ข้อความระดับใช้งานเชิงพาณิชย์ และการแก้ไขที่รักษาอัตลักษณ์ให้สอดคล้องกัน มากกว่างานเอาต์พุตแบบ stylized หรือเชิงศิลปะ สำหรับทีมที่ผลิตภาพพร้อมใช้กับแบรนด์ ตำแหน่งนี้ทำให้เป็นทางเลือกที่แข็งแกร่งเมื่อเทียบกับ generator อเนกประสงค์
Microsoft สร้างและปรับแต่ง MAI-Image-2.5 มาโดยเฉพาะสำหรับงานออกแบบเชิงพาณิชย์และงานมืออาชีพ รวมถึงบรรจุภัณฑ์ mockup สินค้า ป้าย และภาพที่เน้นแบรนด์ โมเดลนี้ตั้งใจให้ใช้ในงาน production ครอบคลุม pipeline ด้านโฆษณา e-commerce และการตลาด สำหรับสิทธิ์การใช้งานที่แน่นอนซึ่งมีผลกับบัญชีของคุณ โปรดตรวจสอบเงื่อนไข Atlas Cloud ฉบับปัจจุบันก่อนเผยแพร่ asset ที่สร้างขึ้น
คู่มือ บทแนะนำ และอัปเดตผลิตภัณฑ์ ที่ช่วยให้คุณใช้ Atlas Cloud ได้อย่างเต็มประสิทธิภาพ