Seedance 2.0 Mini & Fast API ในราคาถูกที่สุดในโลก — ลดสูงสุดถึง 68% จากราคาทางการ
Hero background 1Hero background 2

MiniMax H3 Multimodal Video API

MiniMax H3 คือกลุ่มโมเดลวิดีโอของ MiniMax สำหรับการสร้างวิดีโอจากข้อความ รูปภาพ และข้อมูลอ้างอิง สร้างคลิปความยาว 5 ถึง 15 วินาที กำหนดการเคลื่อนไหวด้วยเฟรมสุดท้ายที่เลือกใช้ได้ รักษาองค์ประกอบของวัตถุจากรูปภาพอ้างอิง หรือเลือก H3 Developer เมื่อเสียงที่สร้างขึ้นเหมาะกับเวิร์กโฟลว์ของคุณ Atlas Cloud รวม H3, H3 Fast, H3 Max และ H3 Developer ไว้ในเวิร์กโฟลว์ API เดียว พร้อมราคาแบบมาตรฐานเริ่มต้นที่ $0.038 ต่อวินาที เริ่มพัฒนาได้แล้ววันนี้

MiniMax H3 พัฒนาโดย MiniMax โดย Atlas Cloud (ดำเนินการโดย Atlas Cloud AI LLC) เป็นผู้ให้บริการเข้าถึงโมเดลนี้ แต่ไม่ได้เป็นเจ้าของโมเดล เครื่องหมายการค้าทั้งหมดเป็นของเจ้าของที่เกี่ยวข้อง

สำรวจโมเดลชั้นนำ

Atlas Cloud มอบโมเดลสร้างสรรค์ล่าสุดที่นำหน้าในอุตสาหกรรมให้กับคุณ

เปรียบเทียบเอนด์พอยต์การสร้างวิดีโอ MiniMax H3

จับคู่เอนด์พอยต์ MiniMax H3, H3 Fast, H3 Max และ H3 Developer กับอินพุตแบบข้อความ รูปภาพ หรือข้อมูลอ้างอิง โดยพิจารณาจากความละเอียด ระยะเวลา ความสามารถด้านเสียง อัตราส่วนภาพ และราคามาตรฐาน

รูปแบบอินพุตคำอธิบาย
MiniMax H3 Max T2V API (Text to Video)ป้อนพรอมต์ข้อความเพื่อสร้างวิดีโอสไตล์ภาพยนตร์ที่ความละเอียด 480P หรือ 768P โดยกำหนดระยะเวลาได้ตั้งแต่ 5 ถึง 15 วินาที เลือกการจัดเฟรมแบบ 16:9, 9:16, 1:1 หรือ adaptive สำหรับโฆษณา ตัวอย่างภาพยนตร์ และคอนเทนต์โซเชียลได้ ในราคามาตรฐาน $0.05 ต่อวินาที
MiniMax H3 Max I2V API (Image to Video)เริ่มจากเฟรมแรกและกำหนดทิศทางการเคลื่อนไหวด้วยพรอมต์ข้อความ พร้อมตัวเลือกเพิ่มเฟรมสุดท้ายเพื่อควบคุมองค์ประกอบภาพตอนจบ เอาต์พุตที่ความละเอียด 480P หรือ 768P และมีระยะเวลา 5 ถึง 15 วินาที เหมาะสำหรับการทำให้สินค้าเคลื่อนไหว การทำแอนิเมชันให้คีย์อาร์ต และการเปลี่ยนฉากตามสตอรีบอร์ด ในราคา $0.05 ต่อวินาที
MiniMax H3 Fast T2V API (Text to Video)สำหรับการผลิตวิดีโอ 480P จากข้อความ MiniMax H3 Fast สามารถสร้างคลิปสไตล์ภาพยนตร์ที่มีระยะเวลาตั้งแต่ 5 ถึง 15 วินาที ตัวเลือก 16:9, 9:16, 1:1 และ adaptive รองรับวิดีโอคอนเซปต์ที่สร้างได้อย่างรวดเร็วและคอนเทนต์เฉพาะแพลตฟอร์ม ในราคามาตรฐาน $0.046 ต่อวินาที
MiniMax H3 Fast I2V API (Image to Video)ทำให้เฟรมแรกที่ส่งเข้ามาเคลื่อนไหวด้วยการควบคุมผ่านพรอมต์ และเพิ่มเฟรมสุดท้ายได้เมื่อจำเป็นต้องกำหนดทิศทางภาพตอนจบ เอาต์พุตความละเอียด 480P ที่มีระยะเวลา 5 ถึง 15 วินาที เหมาะสำหรับการสาธิตสินค้า งานศิลป์แบบแอนิเมชัน และชิ้นงานสั้นสำหรับโซเชียล ในราคา $0.046 ต่อวินาที
MiniMax H3 Fast Reference to Video APIคงรูปลักษณ์ของวัตถุจากภาพอ้างอิงไว้ ขณะที่พรอมต์ข้อความกำหนดวิดีโอ 480P ที่สร้างขึ้น เอนด์พอยต์นี้รองรับวิดีโอความยาว 5 ถึง 15 วินาที เหมาะสำหรับตัวละครที่ปรากฏซ้ำ สินค้าที่ต้องจดจำได้ และภาพแคมเปญที่มีความสอดคล้องกัน ในราคามาตรฐาน $0.046 ต่อวินาที
MiniMax H3 Developer T2V API (Text to Video)เปลี่ยนพรอมต์ที่เขียนขึ้นให้เป็นวิดีโอพร้อมเสียงที่สร้างโดยระบบ ผ่านเอนด์พอยต์ MiniMax H3 Developer ที่โฮสต์ด้วยตนเอง เลือกเอาต์พุตความละเอียด 480P, 768P หรือ 2K ในอัตราส่วน 16:9, 9:16 หรือ 1:1 สำหรับคอนเซปต์เชิงเรื่องราว ตัวอย่างแคมเปญ และการผลิตคอนเทนต์โซเชียล ในราคา $0.05 ต่อวินาที
MiniMax H3 Developer I2V API (Image to Video)ส่งภาพเปิดเรื่อง เฟรมสุดท้ายที่เป็นตัวเลือก และพรอมต์ข้อความเพื่อสร้างการเคลื่อนไหวพร้อมเสียงที่สร้างโดยระบบ ตัวเลือกเอาต์พุตความละเอียด 480P, 768P และ 2K ทำให้เอนด์พอยต์ที่โฮสต์ด้วยตนเองนี้เหมาะสำหรับการทำให้คีย์อาร์ตเคลื่อนไหว ฉากสินค้า และลำดับภาพตามสตอรีบอร์ด ในราคา $0.05 ต่อวินาที
MiniMax H3 Developer Reference to Video APIเมื่อความต่อเนื่องของเนื้อหาขึ้นอยู่กับสื่อที่มีอยู่ สามารถใช้ภาพหรือวิดีโออ้างอิงอย่างน้อยหนึ่งรายการเพื่อคงรูปลักษณ์ของวัตถุไว้ในวิดีโอใหม่ที่สร้างตามพรอมต์ พร้อมเสียงที่สร้างโดยระบบ ใช้เอาต์พุตความละเอียด 480P, 768P หรือ 2K สำหรับตัวละครที่ปรากฏซ้ำและลำดับภาพแบรนด์ที่เชื่อมโยงกัน ในราคามาตรฐาน $0.05 ต่อวินาที
MiniMax H3 T2V API (Text to Video)พรอมต์ข้อความจะกลายเป็นวิดีโอ 2K สไตล์ภาพยนตร์ โดยเลือกระยะเวลาได้ตั้งแต่ 5 ถึง 15 วินาที จัดเฟรมผลลัพธ์แต่ละรายการในอัตราส่วน 16:9, 9:16, 1:1 หรืออัตราส่วนภาพแบบ adaptive สำหรับตัวอย่างภาพยนตร์แนวพรีเมียม เรื่องราวแนวตั้ง และชิ้นงานแคมเปญ ในราคา $0.038 ต่อวินาที
MiniMax H3 I2V API (Image to Video)ทำให้เฟรมแรกมีชีวิตที่ความละเอียด 2K ด้วยการผสานภาพเข้ากับพรอมต์ข้อความ และเพิ่มเฟรมสุดท้ายได้เมื่อจำเป็น ช่วงระยะเวลาเอาต์พุต 5 ถึง 15 วินาทีรองรับการเปิดตัวสินค้า การทำแอนิเมชันตัวละคร และการเปลี่ยนภาพตามแผน ในราคามาตรฐาน $0.038 ต่อวินาที
MiniMax H3 Reference to Video APIการสร้างวิดีโอโดยอ้างอิงจะคงรูปลักษณ์ของวัตถุจากภาพอินพุตไว้ ขณะที่พรอมต์กำหนดทิศทางของวิดีโอ 2K ที่ได้ คลิปที่มีระยะเวลา 5 ถึง 15 วินาทีเหมาะสำหรับฉากที่เน้นตัวละครและภาพสินค้าที่มีความสอดคล้องกัน ในราคา $0.038 ต่อวินาที

ภาพ เสียง และการตัดต่อในคำขอ MiniMax H3 API เดียว

ทุกคลิปที่ MiniMax H3 API ส่งกลับมามีความยาวสูงสุด 15 วินาทีที่ 1440p พร้อมเสียงสเตอริโอแบบเนทีฟ สร้างได้จากการผสมผสานข้อมูลอ้างอิงทั้งข้อความ ภาพ วิดีโอ และเสียง และคำขอเดียวกันยังสามารถแก้ไขตัวละคร ฉาก และบทสนทนาภายในฟุตเทจที่คุณมีอยู่แล้วได้

ไฟล์อ้างอิง 12 ไฟล์ในคำขอ MiniMax H3 API เดียว

คำขอ MiniMax H3 API หนึ่งครั้งรองรับภาพอ้างอิงสูงสุด 9 ภาพ คลิปวิดีโอ 3 คลิป และแทร็กเสียง 3 แทร็ก รวมแล้วไม่เกิน 12 ไฟล์ แทนที่จะมองข้อมูลเหล่านี้เป็นช่องแยกกัน โมเดลจะประมวลผลข้อความ ภาพ และเสียงเป็นบริบทเดียว ดึงตัวละครจากภาพถ่าย การเคลื่อนกล้องจากคลิป และอารมณ์จากแทร็กเสียงมารวมไว้ในฉากเดียวกัน ทีมที่มีสื่อเดิมอยู่แล้วจึงสามารถต่อยอดไปสู่ช็อตที่เสร็จสมบูรณ์ได้โดยตรง

เสียงสเตอริโอแบบเนทีฟในทุกคลิป

ทุกผลลัพธ์มาพร้อมเสียง ทั้งบทสนทนา บรรยากาศ และดนตรีถูกสร้างเป็นเสียงสเตอริโอแบบเนทีฟในขั้นตอนเดียวกับการเรนเดอร์ภาพที่ 24 เฟรมต่อวินาที จึงไม่ต้องใส่ดนตรีประกอบหรือพากย์เสียงเพิ่มเติมภายหลัง เพราะจังหวะเวลาถูกกำหนดตั้งแต่ตอนสร้างช็อต เสียงฝีเท้า คำพูด และจังหวะตัดจึงสอดคล้องกับการเคลื่อนไหวเสมอ โฆษณาสั้นและคอนเทนต์สำหรับโซเชียลมีเดียจึงพร้อมเผยแพร่ได้ทันที

แก้ไขระดับพรอมป์ผ่าน MiniMax H3 API

ต้องการเปลี่ยนแมวเป็นสุนัข แทนที่ฉากกรีนสกรีน หรือเขียนบทสนทนาหนึ่งประโยคใหม่ใช่ไหม MiniMax H3 API สามารถใช้คำสั่งลักษณะนี้แก้ไขวิดีโอที่คุณส่งให้ได้ ครอบคลุมตัวละคร วัตถุ พื้นหลัง แสง และเอฟเฟกต์ ขณะที่ส่วนที่คุณไม่ได้ระบุจะยังคงใกล้เคียงกับต้นฉบับ พรอมป์รองรับความยาวสูงสุด 7000 อักขระ จึงสามารถรวมการเปลี่ยนแปลงเป็นโหลไว้ในการประมวลผลครั้งเดียว ทำให้การปรับแก้คัตที่ผ่านการอนุมัติแล้วเป็นเรื่องที่ทำได้จริง

ถ่ายโอนโทนเสียงและสลับบทสนทนา

ส่งตัวอย่างเสียงมาพร้อมกับภาพหรือฟุตเทจของคุณ แล้วตัวละครที่สร้างขึ้นจะพูดด้วยโทนเสียงนั้น คำขอแต่ละครั้งรองรับข้อมูลอ้างอิงเสียงสูงสุด 3 รายการ โดยแต่ละรายการมีความยาวระหว่าง 2 ถึง 15 วินาที และเสียงจะต้องมาพร้อมอินพุตภาพเสมอ ไม่สามารถส่งมาเพียงอย่างเดียวได้ นอกจากนี้ยังสามารถแทนที่บทสนทนาเดิมและปรับการแสดงให้สอดคล้องกันได้ งานซีรีส์จึงคงเสียงที่ผู้ชมจดจำได้ในทุกตอน

1440p และอัตราส่วนภาพ 6 แบบใน MiniMax H3 API

คลิปมีความยาวตั้งแต่ 5 ถึง 15 วินาที และโหมด 1440p จะกำหนดให้ด้านสั้นมีความยาว 1440 พิกเซล ตั้งแต่ 16:9 ถึง 9:16 หรือมีขนาดประมาณ 3.7 ล้านพิกเซลในอัตราส่วนกว้าง เช่น 2976 x 1248 สำหรับ 21:9 คุณเลือกอัตราส่วนภาพได้ 6 แบบ ตั้งแต่ 21:9 แบบภาพยนตร์ไปจนถึง 9:16 แนวตั้ง และยังให้ MiniMax H3 API เลือกให้ได้ ช่วงตัวเลือกนี้รองรับทั้งตัวอย่างภาพยนตร์ ลูปสินค้า และละครแนวตั้งโดยไม่ต้องสลับโมเดล

รองรับฟอร์แมตงานโปรดักชันโดยไม่ต้องแปลงไฟล์

หากไฟล์ต้นฉบับของคุณมาจากกล้องหรือไทม์ไลน์ตัดต่อโดยตรง ก็สามารถส่งเข้าไปได้ทันที ได้แก่ วิดีโอ H.264 และ H.265 ภาพนิ่ง JPG, PNG, WEBP, HEIC และ HEIF รวมถึงเสียง WAV และ MP3 ขนาดสูงสุดต่อไฟล์คือ 50MB สำหรับวิดีโอ 30MB สำหรับภาพ และ 15MB สำหรับเสียง ขณะที่การส่งแอสเซ็ตผ่าน URL ช่วยให้คำขออยู่ภายในขีดจำกัดบอดีที่ 64MB บน Atlas Cloud ชุดไฟล์ทั้งหมดจะทำงานผ่านคีย์เดียวที่เข้ากันได้กับ OpenAI พร้อมการเรียกเก็บค่าบริการตามการใช้งาน

พรอมต์เดียวกัน สามเอนจิน: เปรียบเทียบ MiniMax H3 API แบบตัวต่อตัว

ทุกคลิปในชุดนี้มาจากพรอมต์เดียวกันทุกคำที่ส่งไปยัง MiniMax H3 API และโมเดลวิดีโออีกสองตัวที่โฮสต์บน Atlas Cloud เพื่อให้เปรียบเทียบการเคลื่อนไหว เสียง และความแม่นยำในการทำตามคำสั่งได้โดยไม่เปลี่ยนแม้แต่คำเดียว

พรอมต์

วิดีโอสั้น 15 วินาที อัตราส่วน 16:9 แนวนอน ฟุตเทจไลฟ์แอ็กชันของร้านซักผ้าหยอดเหรียญแบบบริการตนเองยามดึก ผสานกับแอนิเมชันเรืองแสงแบบวาดมือจนกลายเป็นภาพสื่อผสม ร้านซักผ้าหยอดเหรียญขนาดเล็ก แสงไฟฟลูออเรสเซนต์กะพริบแผ่ว ๆ ภายในมีเครื่องซักผ้าที่กำลังทำงาน ตะกร้าผ้าพลาสติก และม้านั่งเก่า ๆ พร้อมถุงเท้าข้างหนึ่งวางอยู่บนพื้น ทั้งพื้นที่เงียบสงบ แฝงอารมณ์โหยหาอดีตจาง ๆ มีพื้นผิวแบบฟุตเทจมือถือที่ถือถ่ายด้วยมือข้างเดียว กล้องสั่นอย่างเห็นได้ชัด แสงฟลูออเรสเซนต์สีขาวทำให้ค่าแสงแกว่งไปมาระหว่างสว่างกับมืด พื้นผิวกระจกมีเงาสะท้อนจากสภาพแวดล้อม และมีอาการโฟกัสหน่วงเมื่อเลนส์เคลื่อนเข้าใกล้วัตถุ ภาพไม่ควรเนี้ยบและเป็นระเบียบเหมือนโฆษณาเชิงพาณิชย์ — โดยรวมควรให้ความรู้สึกเหมือนภาพบันทึกสารคดีจริง ๆ ราวกับคุณบังเอิญเดินเข้ามาตอนดึกแล้วรีบคว้าช็อตนี้ไว้ขณะไล่ตามนิมิตประหลาดคล้ายความฝัน

Generated with MiniMax H3 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Generated with Wan-2.7 on Atlas Cloud

พรอมต์

มุมมองบุคคลที่หนึ่ง · ระดับสายตา · กล้องเกมแบบถือด้วยมือ ฉาก: ช็อตนี้จำลองผู้เล่นที่กำลังควบคุมเกม FPS สงครามยุคใหม่ มือทั้งสองข้างถือปืนไรเฟิลจู่โจม พร้อมค่อย ๆ รุกไปตามแนวรอบนอกของฐานทัพ ผู้เล่นเคลื่อนไปข้างหน้าตามถนนข้างที่กำบัง เป้าเล็งกวาดสำรวจทางเดินด้านหน้า หลังหยุดชั่วครู่ก็ยิงไปยังเป้าหมายระยะไกลสองสามนัด แล้วเดินหน้าบุกต่อ — เหมือนฟุตเทจเกมเพลย์สดของผู้เล่นทั่วไป แสง: แสงธรรมชาติโทนเย็นของฐานทัพสมัยใหม่สอดประสานกับควันและแสงไฟจากปากกระบอกปืน ภาพสมจริงและคมชัด โดยอาวุธโลหะ รวมถึงฝุ่นและหมอกควันในสนามรบ ให้คุณภาพระดับ AAA-game งานกล้อง: กล้องมีอาการโยกไหวเล็กน้อยแบบถือด้วยมือขณะผู้เล่นเคลื่อนที่ — เริ่มจากค่อย ๆ เดินหน้า จากนั้นกวาดซ้ายขวาเล็กน้อยเพื่อสังเกตการณ์ มีแรงสั่นสะเทือนจากการถอยของปืนอย่างละเอียดตอนยิง ก่อนจะเดินหน้ารุกต่อไปอย่างมั่นคงในท้ายที่สุด

Generated with MiniMax H3 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Generated with Wan-2.7 on Atlas Cloud

จับคู่บรีฟวิดีโอแต่ละแบบกับเส้นทาง MiniMax H3 ที่เหมาะสม

เริ่มจากร่างวิดีโอ 480P ด้วย MiniMax H3 Fast ไปจนถึงช็อตแคมเปญ 2K และคอนเซ็ปต์ที่รองรับเสียงด้วย H3 Developer โดยตระกูล MiniMax H3 ครอบคลุมทั้งโมชั่นสินค้า เวอร์ชันสำหรับโซเชียล ตัวละครที่ปรากฏซ้ำ และพรีวิวสตอรีบอร์ดจากข้อความ รูปภาพ หรือภาพอ้างอิง

ร่างคอนเทนต์โซเชียลด้วย MiniMax H3 Fast

MiniMax H3 Fast เปลี่ยนพรอมป์ข้อความให้เป็นคลิปความละเอียด 480P ความยาว 5–15 วินาที ทีมโซเชียลจึงทดสอบจุดดึงดูดของแคมเปญ จังหวะการเล่าเรื่อง และสัดส่วนภาพได้ก่อนตัดสินใจผลิตด้วยความละเอียดสูงขึ้น

สร้างโมชั่นสินค้าจากภาพนิ่งที่อนุมัติแล้ว

ทำให้เฟรมแรกเคลื่อนไหว และกำหนดตอนจบด้วยเฟรมสุดท้ายเพิ่มเติมได้ผ่านเส้นทางรูปภาพ ทีมสินค้าและการตลาดจึงสร้างช็อตเปิดตัวสินค้า โมชั่นสำหรับแค็ตตาล็อก และแอสเซ็ตสำหรับเปิดตัวจากภาพนิ่งที่อนุมัติแล้ว

ช็อตแคมเปญ 2K ด้วย MiniMax H3

เลือกเส้นทาง MiniMax H3 แบบ 2K เมื่อแคมเปญต้องการเอาต์พุตความละเอียดสูง เอเจนซีสามารถสร้างช็อตฮีโร่ที่ผ่านการขัดเกลา โมเมนต์สินค้าสไตล์ภาพยนตร์ และแอสเซ็ตโซเชียลความละเอียดสูงจากข้อความหรือรูปภาพ

สร้างตัวละครที่ปรากฏซ้ำจากภาพอ้างอิง

ส่งภาพอ้างอิงเพื่อให้จดจำตัวแบบได้อย่างสม่ำเสมอ ขณะที่พรอมป์กำหนดทิศทางของคลิปใหม่ สตูดิโอจึงสร้างวิดีโอสั้นที่มีตัวละครปรากฏซ้ำ โปรโมชันที่เชื่อมโยงกัน และฉากสินค้าที่มีแบรนด์ พร้อมความต่อเนื่องทางภาพที่ชัดเจนยิ่งขึ้น

พรีวิวสตอรีบอร์ดหลายรูปแบบ

ต้องการพรีวิวแนวนอน สี่เหลี่ยมจัตุรัส และแนวตั้งจากบรีฟเดียวใช่ไหม การสร้างจากข้อความรองรับ 16:9, 1:1, 9:16 หรือการจัดเฟรมแบบปรับตามเนื้อหา ช่วยให้ทีมครีเอทีฟเตรียมตัวเลือกสตอรีบอร์ดสำหรับหลายตำแหน่ง размещโดยไม่ต้องเปลี่ยนตระกูลโมเดล

คอนเซ็ปต์เสียงด้วย MiniMax H3 Developer

ใช้ MiniMax H3 Developer เพื่อสร้างวิดีโอพร้อมเสียงจากพรอมป์ข้อความหรือรูปภาพต้นฉบับ ทีมครีเอทีฟสามารถกำหนดลำดับภาพสำหรับการนำเสนอ โมเมนต์ของตัวละคร และคอนเซ็ปต์แคมเปญที่ผสานภาพกับเสียงไว้ในเวิร์กโฟลว์เดียวกัน

MiniMax H3 เปรียบเทียบในด้านพื้นฐานของ Video API

เปรียบเทียบรุ่น text-to-video ของ MiniMax H3 กับโมเดลอื่นจาก Atlas Cloud ในด้านความละเอียดสูงสุด ความยาวคลิป อัตราส่วนภาพ และราคามาตรฐานที่ระบุ

โมเดลความละเอียดสูงสุดความยาวคลิปอัตราส่วนภาพราคาพื้นฐานที่ระบุ
MiniMax H3 Text-to-Video2K5 ถึง 15 วินาที16:9, 9:16, 1:1, ปรับตามอัตโนมัติ$0.038 ต่อวินาที
MiniMax H3 Fast Text-to-Video480P5 ถึง 15 วินาที16:9, 9:16, 1:1, ปรับตามอัตโนมัติ$0.046 ต่อวินาที
MiniMax H3 Max Text-to-Video768P5 ถึง 15 วินาที16:9, 9:16, 1:1, ปรับตามอัตโนมัติ$0.05 ต่อวินาที
MiniMax H3-Developer Text-to-Video2K-16:9, 9:16, 1:1$0.05 ต่อวินาที
Kling V3.0 Turbo Text-to-Video1080p3 ถึง 15 วินาที16:9, 9:16, 1:1$0.112
Veo 3.1 Lite Text-to-video1080p4, 6 หรือ 8 วินาที16:9, 9:16$0.05

วิธีใช้ MiniMax H3 บน Atlas Cloud

เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud

สร้างบัญชี Atlas Cloud

สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล

ทำไมต้องใช้ MiniMax H3 บน Atlas Cloud

การรวมโมเดล MiniMax H3 ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้

ประสิทธิภาพและความยืดหยุ่น

เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์

API แบบรวมศูนย์:
รัน MiniMax H3, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว

ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless

องค์กรและขนาด

ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต

ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม

ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา

โมเดล MiniMax H3, ราคา และการตั้งค่า API

MiniMax H3 คือกลุ่มโมเดลวิดีโอของ MiniMax สำหรับสร้างคลิปจากข้อความ รูปภาพ และสื่ออ้างอิง บน Atlas Cloud กลุ่มโมเดลนี้ประกอบด้วย H3 มาตรฐาน, H3 Fast, H3 Max และ H3 Developer รองรับเส้นทาง text to video, image to video และ reference to video บางรายการ โปรไฟล์เอาต์พุตที่รองรับมีตั้งแต่ 480P ถึง 2K โดยขึ้นอยู่กับโมเดลที่เลือก

เริ่มต้นด้วยพรอมป์ต์ข้อความ สร้างภาพเคลื่อนไหวจากเฟรมแรกโดยกำหนดเฟรมสุดท้ายเพิ่มเติมได้ หรือคงลักษณะของวัตถุหรือบุคคลไว้ผ่านเส้นทาง reference to video ที่รองรับ นอกจากนี้ H3 Developer ยังสามารถสร้างเสียงไปพร้อมกับวิดีโอได้ โดยแต่ละรุ่นมีเส้นทาง ความละเอียด และข้อจำกัดด้านพารามิเตอร์แตกต่างกัน

สร้างบัญชีและ API key ของ Atlas Cloud จากนั้นเลือก model ID ที่ต้องการใช้อย่างถูกต้อง และตรวจสอบ schema ของพารามิเตอร์ปัจจุบันสำหรับโมเดลนั้น ส่งคำขอผ่าน API ที่เข้ากันได้กับ OpenAI ของ Atlas Cloud แล้วประมวลผลวิดีโอที่ได้รับในแอปพลิเคชันของคุณ เริ่มพัฒนาได้เลยวันนี้

MiniMax H3 Fast รองรับเส้นทาง text to video, image to video และ reference to video ที่ความละเอียด 480P สำหรับคลิปความยาว 5 ถึง 15 วินาที ราคามาตรฐานอยู่ที่ $0.046 ต่อวินาทีที่สร้าง และเส้นทาง image รองรับเฟรมแรกพร้อมเฟรมสุดท้ายเพิ่มเติมได้ เลือกใช้รุ่นนี้เมื่อเอาต์พุต 480P และการเข้าถึงเวิร์กโฟลว์อินพุตทั้งสามรูปแบบตรงกับความต้องการของโปรเจกต์

เลือก H3 มาตรฐานเมื่อเวิร์กโฟลว์ต้องการเอาต์พุต 2K เลือก H3 Fast สำหรับอินพุตข้อความ รูปภาพ หรือข้อมูลอ้างอิงที่ความละเอียด 480P, เลือก H3 Max สำหรับการสร้างจากข้อความและรูปภาพที่ความละเอียด 480P หรือ 768P หรือเลือก H3 Developer สำหรับเวิร์กโฟลว์ที่ความละเอียด 480P, 768P หรือ 2K และต้องการสร้างเสียงไปพร้อมกัน

เส้นทาง image to video รองรับเฟรมแรก และสามารถใช้เฟรมสุดท้ายเพิ่มเติมเพื่อกำกับช่วงจบของคลิปได้ เส้นทาง reference to video รองรับใน H3 มาตรฐาน, H3 Fast และ H3 Developer โดยประเภทอินพุตอ้างอิงที่รองรับจะแตกต่างกันไปตาม endpoint ขณะนี้ H3 Max บน Atlas Cloud มีเส้นทาง text และ image

H3 มาตรฐานสร้างคลิป 2K ความยาว 5 ถึง 15 วินาที ขณะที่ H3 Fast รองรับ 480P ในช่วงระยะเวลาเดียวกัน และ H3 Max รองรับ 480P หรือ 768P สำหรับคลิปความยาว 5 ถึง 15 วินาที สำหรับ text to video โมเดลทั้งสามรุ่นนี้รองรับอัตราส่วนภาพ 16:9, 9:16, 1:1 และการจัดเฟรมแบบปรับตามเนื้อหา ส่วน H3 Developer รองรับ 16:9, 9:16 และ 1:1 ควรตรวจสอบ schema ของ endpoint ที่เลือก เนื่องจากเส้นทาง image และ reference อาจมีตัวควบคุมที่แตกต่างกัน

คิดค่าบริการตามจำนวนวินาทีของวิดีโอที่สร้าง ราคามาตรฐานคือ $0.038 ต่อวินาทีสำหรับ H3, $0.046 ต่อวินาทีสำหรับ H3 Fast และ $0.05 ต่อวินาทีสำหรับ H3 Max หรือ H3 Developer ประเมินค่าใช้จ่ายของคำขอโดยนำอัตรามาตรฐานของเส้นทางนั้นคูณด้วยระยะเวลาเอาต์พุตที่เลือก

ไม่ โปรไฟล์ของ Atlas Cloud ที่ตรวจสอบแล้วระบุอย่างชัดเจนว่า H3 Developer รองรับการสร้างเสียงในเส้นทาง text, image และ reference แต่ไม่ได้ระบุว่า H3 มาตรฐาน, H3 Fast หรือ H3 Max รองรับเสียง เลือก H3 Developer เมื่อเสียงจำเป็นต้องเป็นส่วนหนึ่งของเอาต์พุตที่มีการระบุรองรับไว้ในเอกสาร

ขั้นแรก ตรวจสอบว่า model ID ตรงกับเส้นทาง text, image หรือ reference ที่ต้องการใช้ ตรวจสอบฟิลด์ที่จำเป็นทั้งหมดเทียบกับ schema ปัจจุบันของ endpoint นั้น โดยเฉพาะพรอมป์ต์ อินพุตสื่อ ความละเอียด ระยะเวลา และอัตราส่วนภาพ หากคำขอยังคงล้มเหลว ให้ตรวจสอบข้อผิดพลาดที่ส่งกลับมาก่อนลองใหม่ แทนการส่ง payload ที่ไม่ถูกต้องเดิมซ้ำ

สำรวจกลุ่มเพิ่มเติม

Seedance 2.5

Seedance 2.5 API พร้อมใช้งานแล้วบน Atlas Cloud! มอบโมเดลวิดีโอใหม่ล่าสุดของ ByteDance ให้กับนักพัฒนา สร้างวิดีโอเนทีฟได้นานถึง 30 วินาทีในการประมวลผลเพียงครั้งเดียวจากข้อความ รูปภาพเดียว หรือการอ้างอิงหลายรูปแบบสูงสุด 50 รายการ พร้อมเสียงที่ซิงโครไนซ์และข้อความหลายภาษาในเฟรม บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว โดยมีความสอดคล้องของวัตถุและระบบฟิสิกส์ที่ได้รับการปรับปรุงซึ่งช่วยให้ภาพระยะยาวมีความต่อเนื่อง

ดูกลุ่ม

Wan 3.0

Wan 3.0 API คือเจเนอเรชันถัดไปของตระกูลวิดีโอ Wan จาก Alibaba ซึ่งสร้างขึ้นเพื่อยกระดับการสร้างวิดีโอแบบยาว การควบคุมแบบหลายข้อมูลอ้างอิง และคุณภาพของภาพและเสียงให้ก้าวไปอีกขั้น Atlas Cloud ได้โฮสต์ Wan 2.7, 2.6 และ 2.5 ไว้แล้ว และ Wan 3.0 สามารถทำงานบนคีย์แบบรวมเดียวกันโดยไม่ต้องตั้งค่าแยกต่างหาก เริ่มต้นสร้างสรรค์ได้ตั้งแต่วันนี้ เลื่อนลงไปที่ส่วนจัดแสดงเพื่อดูว่า Wan 3.0 สามารถสร้างอะไรได้บ้าง

ดูกลุ่ม

MiniMax H3

MiniMax H3 คือกลุ่มโมเดลวิดีโอของ MiniMax สำหรับการสร้างวิดีโอจากข้อความ รูปภาพ และข้อมูลอ้างอิง สร้างคลิปความยาว 5 ถึง 15 วินาที กำหนดการเคลื่อนไหวด้วยเฟรมสุดท้ายที่เลือกใช้ได้ รักษาองค์ประกอบของวัตถุจากรูปภาพอ้างอิง หรือเลือก H3 Developer เมื่อเสียงที่สร้างขึ้นเหมาะกับเวิร์กโฟลว์ของคุณ Atlas Cloud รวม H3, H3 Fast, H3 Max และ H3 Developer ไว้ในเวิร์กโฟลว์ API เดียว พร้อมราคาแบบมาตรฐานเริ่มต้นที่ $0.038 ต่อวินาที เริ่มพัฒนาได้แล้ววันนี้

ดูกลุ่ม

Seedream 5.0 Pro

Seedream 5.0 Pro API มอบโมเดลการแก้ไขภาพที่ควบคุมได้ของ ByteDance บน Atlas Cloud ให้กับนักพัฒนา โดยจะวางการแก้ไขอย่างแม่นยำด้วยจุดยึดและพิกัด แยกภาพออกเป็นเลเยอร์ที่แก้ไขได้ ผสานข้อมูลอ้างอิงหลายรายการ และจับคู่สีและวัสดุที่แน่นอน พร้อมข้อความหลายภาษาที่ความละเอียด 2K และ 3K บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว!

ดูกลุ่ม

Seedance 2.0

Seedance 2.0 API ให้คุณเข้าถึงระดับโปรดักชันของโมเดลวิดีโอแบบมัลติโมดัลจาก ByteDance — รองรับอินพุต 4 รูปแบบ (ข้อความ, รูปภาพ, วิดีโอ, เสียง) และระบบ "Universal Reference" ชั้นนำของอุตสาหกรรมที่ล็อกองค์ประกอบภาพ การเคลื่อนไหวของกล้อง และการกระทำของตัวละครในทุกช็อต ผสานรวมการควบคุมระดับผู้กำกับด้วยการเรียกใช้ API เพียงครั้งเดียว ในราคาคงที่ $0.09/วินาที รับคีย์ได้ทันที และไม่มีคิวรอ — พร้อมการรับประกันเวลาพร้อมใช้งานและการปฏิบัติตามข้อกำหนดระดับองค์กร Seedance 2.0 Native 4K เปิดใช้งานแล้ววันนี้!

ดูกลุ่ม

GPT Image 2.5

ตระกูล GPT Image 2.5 จาก OpenAI ให้ทางเลือกแก่นักพัฒนาในการใช้ Flare และ Sunburst สำหรับเวิร์กโฟลว์รูปภาพในระดับโปรดักชัน เรนเดอร์ที่ความละเอียดใดก็ได้สูงสุด 3840x2160 และเลือกจากระดับคุณภาพห้าระดับ รวมถึง xhigh และ max เพื่อให้ตรงตามความต้องการผลลัพธ์ที่เฉพาะเจาะจง Atlas Cloud ให้บริการการอนุมาน REST ที่พร้อมใช้งานโดยไม่มีการเริ่มต้นแบบเย็นและราคามาตรฐานเริ่มต้นที่ 0.004 ดอลลาร์ต่อการสร้าง เริ่มต้นสร้างได้แล้ววันนี้

ดูกลุ่ม

GPT Image 2

GPT Image 2 API ช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลรูปภาพล่าสุดของ OpenAI ซึ่งเป็นรุ่นสืบทอดจาก GPT Image 1.5 โดยสามารถสร้างและแก้ไขรูปภาพพร้อมกับการเรนเดอร์ข้อความที่แม่นยำทั้งในอักษรละตินและ CJK รวมถึงการจัดวางองค์ประกอบที่ยอดเยี่ยมสำหรับโปสเตอร์ ม็อกอัป และอินโฟกราฟิก บน Atlas Cloud คุณสามารถเข้าถึงโมเดลนี้ผ่าน API ที่เป็นหนึ่งเดียวร่วมกับโมเดลอื่นๆ อีกกว่า 300 รุ่น พร้อมเครดิตฟรี เวลาทำงาน 99.99% และไม่จำเป็นต้องมีการตรวจสอบยืนยันองค์กรจาก OpenAI

ดูกลุ่ม

Gemini Omni Flash

API ของ gemini omni นำตระกูล Gemini Omni Flash แบบมัลติโมดัลโดยกำเนิดจาก Google DeepMind ซึ่งรวมถึง Gemini Omni 1.1 Flash มาสู่นักพัฒนา สร้างวิดีโอสไตล์ภาพยนตร์พร้อมเสียงเนทีฟที่ซิงโครไนซ์กัน ทำให้ภาพนิ่งเคลื่อนไหวได้ด้วยการควบคุมเฟรมเริ่มต้นและเฟรมสิ้นสุดอย่างแม่นยำ หรือปรับแก้ฟุตเทจที่มีอยู่ผ่านการแก้ไขด้วยคำสั่งข้อความ โดยยังคงรักษาเนื้อหาที่ไม่ได้แก้ไขไว้ Atlas Cloud มอบคีย์เดียวที่เข้ากันได้กับ OpenAI การเข้าถึงแบบรวมศูนย์ และราคาที่โปร่งใสโดยคิดค่าบริการตามการใช้งาน เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

Grok Imagine

Grok Imagine API ครอบคลุมโมเดลรูปภาพ วิดีโอ และพูดของ xAI ตั้งแต่ Image 2.0 ถึง Video 1.5 และ xAI TTS v1 สร้างรูปภาพนิ่ง 1K หรือ 2K ในอัตราส่วน 14 แบบ ขยายฉากไปยัง 15 วินาทีของวิดีโอ 1080p ควบคุมภาพด้วยรูปภาพอ้างอิงได้ถึง 7 รูป หรือเพิ่มบรรยายเสียงในภาษา 20 ภาษา Atlas Cloud รันทุกโหมดบนเอนด์พอยต์เดียว มีราคาแบบจ่ายตามการใช้งาน ตั้งแต่ $0.02 ต่อรูปภาพและ $0.05 ต่อวินาที เริ่มสร้างวันนี้

ดูกลุ่ม

Google

โมเดลเชิงสร้างสรรค์ที่ทรงพลังที่สุดของ Google พร้อมใช้งานแล้วบน Atlas Cloud โดย Veo 3.1 นำเสนอการสร้างวิดีโอระดับภาพยนตร์ Nano Banana 2 ขับเคลื่อนการสร้างภาพที่มีความเที่ยงตรงสูง และ Gemini นำความชาญฉลาดแบบมัลติโมดัลมาสู่ทุกเวิร์กโฟลว์ เข้าถึงชุดโมเดลของ Google เต็มรูปแบบผ่าน API key เดียวพร้อมความพร้อมใช้งานระดับ Day-0 และการกำหนดราคาแบบจ่ายตามการใช้งาน (pay-as-you-go)

ดูกลุ่ม

Seedance 2.0 Mini

Seedance 2.0 Mini นำเสนอการสร้างวิดีโอแบบมัลติโมดัลของ ByteDance สู่เวิร์กโฟลว์ที่ความเร็วและต้นทุนมีความสำคัญสูงสุด โดยมอบความสามารถหลักของ Seedance 2.0 ในรูปแบบที่ใช้ทรัพยากรน้อยลง — สร้างได้เร็วกว่า ต้นทุนต่อวิดีโอต่ำกว่า และใช้การผสานรวม API เดิมที่คุณใช้อยู่แล้ว สำหรับทีมที่จัดการไปป์ไลน์ปริมาณมากหรือสร้างต้นแบบในสเกลขนาดใหญ่ Mini คือตัวเลือกเริ่มต้นที่ใช้งานได้จริง

ดูกลุ่ม

ByteDance

ตั้งแต่การสร้างวิดีโอระดับภาพยนตร์ไปจนถึงการสร้างภาพที่มีความละเอียดสูง โมเดลที่ทรงพลังที่สุดของ ByteDance พร้อมใช้งานแล้วบน Atlas Cloud รัน Seedance และ Seedream ในสเกลขนาดใหญ่ด้วยราคาการอนุมานที่ต่ำที่สุด และไม่มีค่าใช้จ่ายแฝงด้านโครงสร้างพื้นฐาน

ดูกลุ่ม

API เดียวสำหรับ AI สื่อทุกประเภท

สำรวจโมเดลทั้งหมด