Seedance 2.0 Mini & Fast API ในราคาถูกที่สุดในโลก — ลดสูงสุดถึง 68% จากราคาทางการ
Grok Imagine Video with Reference Guidance

Grok Imagine Video with Reference Guidance

Grok Imagine Video เปิดให้นักพัฒนาเข้าถึงตระกูลวิดีโอของ xAI เพื่อสร้าง ทำให้เคลื่อนไหว ขยาย และตัดต่อคลิป สร้างวิดีโอความยาว 1 ถึง 15 วินาทีจากพรอมต์ กำกับบุคคล วัตถุ หรือสไตล์ด้วยภาพอ้างอิงได้สูงสุดเจ็ดภาพ และทำงานที่ความละเอียด 480p หรือ 720p Atlas Cloud รวมความสามารถเหล่านี้ไว้ผ่าน endpoint ที่เข้ากันได้กับ OpenAI พร้อมการคิดค่าบริการแบบจ่ายตามการใช้งานอย่างโปร่งใส เริ่มสร้างสรรค์ได้วันนี้

Grok Imagine Video พัฒนาโดย xAI โดย Atlas Cloud (ดำเนินการโดย Atlas Cloud AI LLC) เป็นผู้ให้บริการเข้าถึงโมเดลนี้ แต่ไม่ได้เป็นเจ้าของโมเดล เครื่องหมายการค้าทั้งหมดเป็นของเจ้าของที่เกี่ยวข้อง

เปรียบเทียบโหมดและเวิร์กโฟลว์ของ Grok Imagine Video

เลือก endpoint ของ Grok Imagine Video ที่ตรงกับแอสเซ็ตต้นทาง การแปลงที่ต้องการ และเวิร์กโฟลว์การผลิตของคุณ

รูปแบบอินพุตคำอธิบาย
Grok Imagine Video T2V API (Text To Video)เปลี่ยนพรอมต์ภาษาธรรมชาติให้เป็นวิดีโอความยาว 1 ถึง 15 วินาทีที่ความละเอียด 480p หรือ 720p endpoint นี้เหมาะสำหรับการสร้างภาพแนวคิด คลิปสำหรับโซเชียล และฉากที่สร้างขึ้นโดยไม่มีสื่อต้นทาง
Grok Imagine Video I2V API (Image To Video)เริ่มต้นจากภาพที่ป้อนเข้ามา endpoint นี้ใช้พรอมต์การเคลื่อนไหวภาษาธรรมชาติเพื่อสร้างวิดีโอที่ความละเอียด 480p หรือ 720p เหมาะสำหรับทำให้งานศิลป์ ภาพสินค้า เฟรมตัวละคร หรือภาพแคมเปญมีการเคลื่อนไหว
Grok Imagine Video R2V API (Reference To Video)กำกับการสร้างวิดีโอด้วยภาพอ้างอิง 1 ถึง 7 ภาพ ซึ่งแสดงถึงบุคคล วัตถุ หรือสไตล์ภาพ วิดีโอเอาต์พุตมีความยาวได้สูงสุด 10 วินาทีที่ความละเอียด 480p หรือ 720p รองรับการผลิตครีเอทีฟโดยอิงจากภาพอ้างอิง
Grok Imagine Video Extend API (Video Extension)ต่อยอดไฟล์ MP4 เดิมที่มีความยาว 2 ถึง 15 วินาทีด้วยพรอมต์ โดยสร้างส่วนต่อขยายความยาว 2 ถึง 10 วินาที เอาต์พุตจะใช้รูปแบบเดียวกับอินพุตและจำกัดความละเอียดไว้ที่ 720p ทำให้ endpoint นี้เหมาะสำหรับการเพิ่มความยาวให้ช็อตที่มีอยู่แล้ว
Grok Imagine Video Edit API (Video Editing)ป้อนไฟล์ MP4 พร้อมคำสั่งภาษาธรรมชาติเพื่อปรับแก้เนื้อหาภาพ โดยคงระยะเวลาของต้นฉบับไว้ เอาต์พุตจำกัดความยาวไม่เกิน 8.7 วินาที เหมาะสำหรับการแก้ไขเฉพาะจุดและการแปลงฟุตเทจสั้นด้วยพรอมต์

Grok Imagine Video สำหรับเวิร์กโฟลว์สร้างสรรค์ห้ารูปแบบ

Grok Imagine Video เปลี่ยนข้อความ เฟรมเริ่มต้น และภาพอ้างอิงสูงสุดเจ็ดภาพให้เป็นคลิปสั้น จากนั้นต่อเติมหรือแก้ไขฟุตเทจ MP4 ที่มีอยู่ผ่าน API แบบรวมศูนย์ของ Atlas Cloud โดยคิดค่าบริการตามการใช้งาน

Grok Imagine Video จากข้อความ

เขียนพรอมต์ภาษาธรรมชาติ แล้วสร้างคลิปความยาว 1 ถึง 15 วินาทีที่ 480p หรือ 720p อัตราส่วนภาพเจ็ดรูปแบบ รวมถึง 16:9, 1:1 และ 9:16 ช่วยให้แต่ละช็อตพอดีกับพื้นที่แสดงผลที่ต้องการ ควบคุมตัวแบบ การกระทำ การเคลื่อนกล้อง และบรรยากาศได้โดยตรงผ่านพรอมต์ เหมาะเป็นจุดเริ่มต้นที่ยืดหยุ่นสำหรับจังหวะสำคัญของเรื่อง แนวคิดแคมเปญ และวิดีโอโซเชียล

สร้างภาพเคลื่อนไหวจากเฟรมเริ่มต้น

เปลี่ยนภาพเฟรมเริ่มต้นที่ป้อนให้เป็นวิดีโอความยาว 1 ถึง 15 วินาทีที่ 480p หรือ 720p ภาพจะกำหนดองค์ประกอบของฉากเปิด ขณะที่พรอมต์การเคลื่อนไหวด้วยภาษาธรรมชาติจะกำกับการเคลื่อนไหวและการพัฒนาของฉาก เลือกอัตราส่วนภาพได้จากเจ็ดรูปแบบเมื่อจำเป็นต้องใช้รูปทรงเอาต์พุตที่แตกต่าง เวิร์กโฟลว์นี้เหมาะกับภาพสินค้าฉากแบบภาพประกอบ และแนวคิดที่กำกับทิศทางศิลป์ ซึ่งต้องการเพิ่มการเคลื่อนไหวโดยไม่ต้องสร้างเฟรมเปิดใหม่

ควบคุมการอ้างอิงด้วย Grok Imagine Video

กำกับวิดีโอด้วยภาพอ้างอิง 1 ถึง 7 ภาพที่สื่อถึงบุคคล วัตถุ หรือสไตล์ภาพ ระบุอินพุตแต่ละรายการในพรอมต์ จากนั้นสร้างวิดีโอความยาวสูงสุด 10 วินาทีที่ 480p หรือ 720p ครอบคลุมอัตราส่วนภาพที่รองรับทั้งเจ็ดแบบ เนื่องจากภาพอ้างอิงช่วยกำหนดฉากโดยไม่ได้ทำหน้าที่เป็นเพียงเฟรมเริ่มต้น ผู้สร้างจึงควบคุมองค์ประกอบภาพที่ต้องปรากฏซ้ำได้มากขึ้น ใช้กับฉากที่ขับเคลื่อนด้วยตัวละคร การเล่าเรื่องผ่านสินค้า หรือแคมเปญที่คำนึงถึงสไตล์ภาพ

ต่อเติมเนื้อเรื่อง

ต่อคลิป MP4 เดิมที่มีความยาว 2 ถึง 15 วินาทีด้วยส่วนขยายที่ขับเคลื่อนด้วยพรอมต์ โดยมีความยาว 2 ถึง 10 วินาที Grok Imagine Video จะต่อเนื่องจากเฟรมสุดท้ายและส่งคืนคลิปต้นฉบับพร้อมเซกเมนต์ใหม่ โดยรักษาความละเอียดของอินพุตไว้ที่สูงสุด 720p อธิบายการกระทำถัดไป การเปิดเผยสิ่งสำคัญ หรือการเคลื่อนกล้องด้วยภาษาทั่วไป ช่วยเปลี่ยนตอนจบที่ขาดช่วงให้กลายเป็นจังหวะการเล่าเรื่องที่สมบูรณ์ได้ง่ายขึ้น

แก้ไขคลิปด้วย Grok Imagine Video

ส่ง MP4 และคำสั่งภาษาธรรมชาติให้ Grok Imagine Video เพื่อปรับเปลี่ยนฟุตเทจโดยคงระยะเวลาเดิมของต้นฉบับ อินพุตมีความยาวได้สูงสุด 8.7 วินาที และการคิดค่าบริการจะอิงตามความยาวของวิดีโออินพุต ขอให้เปลี่ยนภาพ ปรับบรรยากาศ หรือแก้ไขระดับฉากได้โดยไม่ต้องสร้างคลิปใหม่ตั้งแต่ต้น เหมาะสำหรับสร้างรูปแบบสร้างสรรค์ระยะสั้นและปรับแต่งหลังการสร้างอย่างควบคุมได้

ห้าเวิร์กโฟลว์ใน API เดียว

สลับใช้งาน text-to-video, image-to-video, การสร้างวิดีโอที่กำกับด้วยภาพอ้างอิง การต่อเติม และการแก้ไขผ่าน API แบบรวมศูนย์เดียว เลือก endpoint ให้ตรงกับสื่ออินพุตที่มี แล้วส่งงานแต่ละรายการผ่านโฟลว์ prediction แบบอะซิงโครนัส ใช้รูปแบบการยืนยันตัวตนและการผสานระบบให้สอดคล้องกันตลอดเวิร์กโฟลว์ การเข้าถึงแบบคิดค่าบริการตามการใช้งานรองรับทั้งการทดลองและไปป์ไลน์การผลิตที่ทำซ้ำได้ นักพัฒนาสามารถสร้างเครื่องมือวิดีโอที่ครอบคลุมยิ่งขึ้นโดยมีภาระงานด้านการผสานระบบน้อยลง

หนึ่งพรอมต์ สามวิสัยทัศน์: เปรียบเทียบวิดีโอจาก Grok Imagine Video

ดูว่า Grok Imagine Video และทางเลือกชั้นนำอีกสองรายการตีความพรอมต์เดียวกันอย่างไร ผ่านการเคลื่อนไหว ความต่อเนื่อง การควบคุมกล้อง แสง และการเล่าเรื่องด้วยภาพ

พรอมต์

ภาพยนตร์ผจญภัยกลางแจ้งความยาว 8–10 วินาทีที่สมจริงเหนือจริง ตั้งอยู่ในหุบเขาหินสีมรกตทันทีหลังพายุฝนกระหน่ำ นักพายคายัคสวมชุดกันน้ำสีน้ำเงินโคบอลต์และเสื้อชูชีพสีส้มแดง พุ่งฝ่ากระแสน้ำเชี่ยวกรากตั้งแต่เฟรมแรกจนถึงเฟรมสุดท้าย เปิดฉากด้วยภาพติดตามแนวผิวน้ำจากระดับต่ำมาก เคลื่อนที่แข่งไปข้างคายัค ขณะที่ใบพายฟาดลงในกระแสน้ำและสาดละอองคมชัดผ่านเลนส์ คายัคพุ่งขึ้นสันคลื่นสูงชันและถูกส่งลอยขึ้นสู่อากาศ แพนกล้องอย่างรวดเร็วเข้าสู่มุมมองบุคคลที่หนึ่งของนักพาย ขณะที่เรือเอียงตะแคงลอดใต้ต้นไม้ล้ม ทะลุม่านน้ำโปร่งแสง และเฉียดผ่านโขดหินเปียกแหลมคม โดยมือ ใบพาย และหัวเรือสีน้ำเงินโคบอลต์ยังคงมีรูปลักษณ์และตำแหน่งสอดคล้องกันทางกายภาพตลอดการสาดกระเซ็นและการถูกบดบังชั่วขณะ นักพายกดใบพายต้านกระแสน้ำ หักเรือสะท้อนออกจากผนังหุบเขาในโค้งกลับตัวแน่น แล้วทิ้งตัวกลับลงสู่กระแสน้ำเชี่ยว ที่จุดไคลแมกซ์ เปลี่ยนเป็นภาพโดรนดิ่งลงจากยอดหน้าผา ลดระดับลงอย่างรวดเร็วและโคจรรอบนักพายขณะลงสู่พื้น หัวเรือพุ่งชนลังไม้ลอยน้ำอย่างสมจริงจนลังแตกออก และในจังหวะเฉลยขี้เล่นแบบฉับพลัน สายโคมกระดาษหลากสีที่เชื่อมต่อกันและยังสมบูรณ์ทุกดวงก็พุ่งออกมา คลี่ตัว และลอยกระเพื่อมอย่างอบอุ่นเหนือสายน้ำเย็นที่ไหลเชี่ยว ขณะที่คายัคยังคงพุ่งต่อไป การเคลื่อนไหวต่อเนื่องที่ถูกต้องตามหลักกายวิภาค ความเฉื่อยของคายัคที่สมจริง แรงต้านของใบพาย การชน พลศาสตร์ของของไหลปั่นป่วน การเคลื่อนไหวของเนื้อผ้า หยดน้ำ ละอองน้ำบนเลนส์ และตัวตนของตัวแบบที่คงเดิมอย่างไม่เปลี่ยนแปลงหลังผ่านสิ่งบดบังทุกครั้ง ห้ามใช้ภาพสโลว์โมชัน ห้ามมีภาพเปิดฉากว่างเปล่า ห้ามตัดไปยังหน้าจอ อินเทอร์เฟซ แดชบอร์ด แถบความคืบหน้า กราฟ คำบรรยาย โลโก้ หรือข้อความอธิบาย แสงกลางวันสีไซแอนเย็นจากท้องฟ้าครึ้ม ผนังหินสีมรกตเข้มจากฝน เสื้อชูชีพสีส้มแดงสด แสงโคมหลากสีอบอุ่น องค์ประกอบภาพไวด์สกรีนแบบทแยงเชิงภาพยนตร์ที่เน้นความเร็ว คอนทราสต์สูง โมชันเบลออย่างเป็นธรรมชาติ และภาพยนตร์กีฬาแอ็กชันแบบโฟโตเรียลลิสติกที่ชวนดื่มด่ำ เสียงซิงโครไนซ์: เสียงน้ำเชี่ยวคำราม เสียงใบพายกระแทกคมชัด เสียงไม้แตก เสียงหายใจหอบ เสียงน้ำกระแทกตัวเรือ และเสียงดนตรีจังหวะเพอร์คัสชันสดใสในจังหวะที่โคมไฟพุ่งออกมา อัตราส่วนภาพ 16:9

Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud

Generated with Seedance 2.5 Text-to-Video on Atlas Cloud

Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud

พรอมต์

ลำดับภาพยนตร์แอ็กชันต่อเนื่องความยาว 8–10 วินาทีในตลาดกลางคืนแบบเปิดโล่ง ก่อนฝนเทกระหน่ำเพียงชั่วครู่: พ่อครัวราเม็งผู้ปิดตาวิ่งอย่างมั่นใจผ่านเขาวงกงร้านอาหารที่แออัด พร้อมยืดเส้นบะหมี่สีเงินขาวระหว่างมือทั้งสองอย่างต่อเนื่อง เริ่มด้วยภาพมุมสูงจากด้านบนแบบตั้งฉากอย่างสมบูรณ์ จากนั้นดิ่งลงอย่างรวดเร็วจากด้านบนเข้าสู่เขาวงกตตลาดที่ส่องสว่างด้วยแสงนีออน ขณะที่เม็ดฝนแรกกระแทกกันสาดและพื้นถนนเปียก ล็อกกล้องไปที่เส้นบะหมี่ที่ลอยพุ่ง และเคลื่อนที่แข่งไปข้าง ๆ ในระยะห่างเพียงไม่กี่นิ้ว ขณะที่มันสะบัดข้ามเตาถ่านเรืองแสง ลูกค้าที่ตกใจ เตาย่างเสียงฉ่า และร่มที่กางผึงขึ้นตามแรงลม รักษาการเคลื่อนไหวของมนุษย์ให้ต่อเนื่องไร้รอยต่อ ฟิสิกส์ความยืดหยุ่นของเส้นบะหมี่ที่น่าเชื่อถือ การถูกบดบังในฉากหน้าอย่างซับซ้อน ฝนที่สาดกระเซ็น ประกายไฟ และไอน้ำหนาแน่น แพนกล้องอย่างรวดเร็วไปยังพ่อครัวที่กระโดดข้ามลังเตี้ยโดยไม่หยุดฝีเท้า จากนั้นโคจรรอบตัวเขาอย่างรวดเร็ว 360-degree ขณะที่เขาบิดตัวและปล่อยเส้นบะหมี่ไปด้านหลังด้วยโมเมนตัมที่แม่นยำ เส้นบะหมี่โค้งลอยอย่างสวยงามลงในหม้อทองแดงที่เดือดพล่านด้านหลังเขา และในจังหวะแห่งชัยชนะพอดี แมวลายส้มจอมเจ้าเล่ห์ก็กระโจนออกมาจากใต้แผงร้าน คาบเส้นบะหมี่ที่ห้อยอยู่ครึ่งหนึ่งแล้ววิ่งหนีไป กลายเป็นมุกตลกทางภาพที่ชัดเจน ขณะที่พ่อครัวยังคงวิ่งต่อไปโดยไม่รู้ตัว โฟโตเรียลลิสม์แนวนีออนนัวร์ เงาสะท้อนสีไซแอนเขียวและแมเจนตาบนพื้นเปียกลื่นจากฝน ไฟสีส้มร้อนจากเตาเป็นจังหวะเน้นทางภาพ ไอน้ำและฝนที่ให้สัมผัสจับต้องได้ การจัดท่าทางที่มั่นคง รายละเอียดภาพยนตร์คมชัด จังหวะเรียลไทม์ที่มีพลัง ห้ามใช้ภาพสโลว์โมชัน ห้ามมีการตัดภาพที่ทำลายความต่อเนื่องของพื้นที่หรือตัวละคร เสียง: ฟ้าร้องที่ค่อย ๆ ดังขึ้น เสียงพูดคุยในตลาด เสียงฝีเท้ากระแทกพื้น เสียงร่มกางผึง เสียงถ่านย่างดังฉ่า เสียงน้ำเดือด เสียงเส้นบะหมี่หวือที่ซิงโครไนซ์กับการเคลื่อนกล้อง และจบด้วยเสียงแมวร้องเหมียวแบบตลกสดใสพร้อมเสียงน้ำกระเซ็นจากหม้อทองแดง ห้ามมีหน้าจอ อินเทอร์เฟซผู้ใช้ แดชบอร์ด แถบความคืบหน้า กราฟ คำบรรยาย ซับไตเติล โลโก้ ลายน้ำ หรือข้อความอธิบาย อัตราส่วนภาพ 16:9

Generated with Grok Imagine Video v1.5 Text-to-Video on Atlas Cloud

Generated with Seedance 2.5 Text-to-Video on Atlas Cloud

Generated with Grok Imagine Video v1.5 Developer Text-to-Video on Atlas Cloud

Grok Imagine Video ในทุกขั้นตอนของงานสร้างสรรค์

Grok Imagine Video เปลี่ยนพรอมต์ ภาพนิ่ง ภาพอ้างอิง และไฟล์ MP4 ที่มีอยู่ให้เป็นแนวทางใช้งานจริงสำหรับคลิปโซเชียล ภาพนำเสนอสินค้า เรื่องราวแบรนด์ ลำดับภาพที่ยาวขึ้น การตัดต่อแบบเจาะจง และเครื่องมือสำหรับครีเอเตอร์

คลิปโซเชียลด้วย Grok Imagine Video

Grok Imagine Video แปลงพรอมต์ภาษาธรรมชาติเป็นคลิปสั้นความละเอียด 480p หรือ 720p ใช้สร้างทีเซอร์สำหรับโซเชียล แนวคิดแคมเปญ และร่างภาพอย่างรวดเร็วได้โดยไม่ต้องเตรียมฟุตเทจต้นฉบับล่วงหน้า

ทำให้ภาพนิ่งสินค้าเคลื่อนไหว

เริ่มจากภาพสินค้า image to video endpoint จะเพิ่มการเคลื่อนไหวตามพรอมต์ที่กำหนด ที่ความละเอียด 480p หรือ 720p แบรนด์ต่าง ๆ สามารถเปลี่ยนภาพนิ่งจากแคตตาล็อกให้เป็นภาพเปิดตัวสินค้า สื่อสำหรับการเปิดตัว และภาพสำหรับมาร์เก็ตเพลส

สร้างเรื่องราวแบรนด์ด้วยภาพอ้างอิง

ใช้ภาพ 1 ถึง 7 ภาพ reference to video จะนำบุคคล วัตถุ หรือสไตล์ไปสร้างเป็นคลิปใหม่ ทีมครีเอทีฟสามารถพัฒนาเรื่องราวแบรนด์ แนวคิดตัวละคร และฉากสินค้าโดยอ้างอิงจากภาพที่จัดเตรียมไว้

ต่อยอดเรื่องราวด้วย Grok Imagine Video

ต่อเนื้อหาจากไฟล์ MP4 ที่มีอยู่ด้วยส่วนขยายความยาว 2 ถึง 10 วินาทีที่ขับเคลื่อนด้วยพรอมต์ โดยคงความละเอียดของอินพุตไว้ได้สูงสุด 720p ฟีเจอร์นี้รองรับจังหวะสำคัญในสตอรีบอร์ดที่ยาวขึ้น การเปลี่ยนผ่านแบบเป็นตอน และลำดับภาพต่อเนื่องจากฟุตเทจที่ผ่านการอนุมัติแล้ว

ตัดต่อวิดีโอด้วยภาษาธรรมชาติ

ตัดต่อไฟล์ MP4 ด้วยคำสั่งภาษาธรรมชาติ โดยคงระยะเวลาต้นฉบับไว้ และจำกัดความยาวเอาต์พุตที่ 8.7 วินาที ทีมงานสามารถสร้างรูปลักษณ์ทางเลือก เวอร์ชันแคมเปญที่ปรับให้เหมาะกับแต่ละท้องถิ่น หรือรูปแบบภาพใหม่ที่แก้ไขแล้ว

สร้างด้วย Grok Imagine Video

สร้างเครื่องมือวิดีโอที่ขับเคลื่อนด้วยพรอมต์โดยใช้โหมด Grok Imagine Video ทั้ง 5 โหมดสำหรับการสร้าง แอนิเมชัน ภาพอ้างอิง การต่อขยาย และการตัดต่อ นักพัฒนาสามารถรองรับเวิร์กโฟลว์ของครีเอเตอร์จากตระกูลเดียวกัน พร้อมเลือกเอาต์พุตความละเอียด 480p หรือ 720p

Grok Imagine Video อยู่ในตำแหน่งใดเมื่อเทียบกับโมเดลวิดีโออื่น

เปรียบเทียบเวิร์กโฟลว์ของ Grok Imagine Video กับทางเลือกจาก Atlas Cloud ที่คัดสรรแล้วในด้านวิธีการป้อนข้อมูล ความยาวคลิป ความละเอียดสูงสุด และราคามาตรฐาน

โมเดลเวิร์กโฟลว์อินพุตความยาวคลิปหรือเซกเมนต์ความละเอียดสูงสุดราคามาตรฐาน
Grok Imagine Video Text-to-Videoพรอมต์ข้อความ1–15s720p$0.05/sec
Grok Imagine Video Image-to-Videoรูปภาพเริ่มต้น + พรอมต์ข้อความ1–15s720p$0.05/sec
Grok Imagine Video Reference-to-Videoรูปภาพอ้างอิง 1–7 รูป + พรอมต์ข้อความ1–10s720p$0.05/sec
Grok Imagine Video ExtendMP4 ความยาว 2–15s + พรอมต์ข้อความการต่อขยาย 2–10sตรงกับอินพุต สูงสุด 720p$0.07/sec
Grok Imagine Video EditMP4 + คำสั่งข้อความตรงกับอินพุต สูงสุด 8.7s-$0.07/วินาทีอินพุต
MiniMax H3 Text-to-Videoพรอมต์ข้อความ4–15s2K$0.038/sec
Seedance 2.0 Image-to-Videoรูปภาพเริ่มต้น + ข้อความ พร้อมเฟรมสุดท้ายเสริมได้4–15s4K โดยกำเนิด$0.112/sec
Vidu Q3-Mix Reference to Videoรูปภาพอ้างอิง 1–4 รูป + พรอมต์ข้อความ1–16sSR 1440p, สูงสุด 1080p แบบเนทีฟ$0.125/run
Wan-2.7 Video-editวิดีโอต้นทาง + ข้อความ พร้อมรูปภาพหรือเสียงเสริมได้-1080p$0.10/run

วิธีใช้ Grok Imagine Video บน Atlas Cloud

เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud

สร้างบัญชี Atlas Cloud

สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล

ทำไมต้องใช้ Grok Imagine Video บน Atlas Cloud

การรวมโมเดล Grok Imagine Video ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้

ประสิทธิภาพและความยืดหยุ่น

เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์

API แบบรวมศูนย์:
รัน Grok Imagine Video, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว

ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless

องค์กรและขนาด

ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต

ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม

ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา

คำถามเกี่ยวกับ Grok Imagine Video API พร้อมคำตอบ

Grok Imagine Video คือกลุ่มโมเดลสร้างวิดีโอของ xAI สำหรับสร้าง ทำให้ภาพเคลื่อนไหว ขยาย และแก้ไขคลิปสั้น Atlas Cloud มี API endpoint แยกสำหรับเวิร์กโฟลว์ text, image, reference, extension และ editing

Grok Imagine Video สามารถสร้างคลิปจากข้อความ ทำให้ภาพเริ่มต้นเคลื่อนไหว หรือใช้ภาพอ้างอิงสูงสุด 7 ภาพเพื่อกำหนดแนวทางของบุคคล วัตถุ และสไตล์ได้ นอกจากนี้ยังมี endpoint แยกสำหรับต่อคลิปเดิมหรือแก้ไขไฟล์ MP4 ด้วยคำสั่งภาษาธรรมชาติ

สร้าง Atlas Cloud API key แล้วส่งคำขอ POST ที่ผ่านการยืนยันตัวตนไปยัง /api/v1/model/generateVideo ระบุ model ID, prompt และข้อมูลรูปภาพหรือวิดีโอที่ route นั้นต้องการให้ครบถ้วน ผลลัพธ์จะมี request ID, สถานะ และฟิลด์เอาต์พุต

เลือก text-to-video เมื่อฉากเริ่มต้นจาก prompt หรือเลือก image-to-video เมื่อรูปภาพที่ส่งเข้ามาต้องใช้เป็นเฟรมเริ่มต้น Reference-to-video ให้คำแนะนำที่ครอบคลุมมากขึ้นจากหลายภาพ ส่วน extend-video และ edit-video ใช้งานกับไฟล์ MP4 ที่มีอยู่แล้ว

Text-to-video และ image-to-video รองรับคลิปความยาวตั้งแต่ 1 ถึง 15 วินาทีที่ความละเอียด 480p หรือ 720p Reference-to-video รองรับความยาว 1 ถึง 10 วินาทีที่ความละเอียดเดียวกัน ส่วนสัดส่วนภาพที่ใช้กันทั่วไป ได้แก่ 16:9, 9:16, 1:1, 4:3, 3:4, 3:2 และ 2:3 โดย route สำหรับการต่อและแก้ไขจะมีข้อจำกัดด้านอินพุตของตนเอง

ใช่ xAI ระบุว่าการสร้างเสียงในตัวเป็นส่วนหนึ่งของเวิร์กโฟลว์วิดีโอ Grok Imagine ทำให้สามารถสร้างเสียงและภาพไปพร้อมกันได้ อย่างไรก็ตาม schema ที่ Atlas Cloud เผยแพร่สำหรับ route เหล่านี้ไม่มีตัวเลือกเปิดหรือปิดเสียงแยกต่างหาก

ส่ง URL รูปภาพ HTTPS สาธารณะจำนวน 1 ถึง 7 รายการ หรือ data URI แบบ base64 ผ่าน endpoint reference-to-video แท็ก เช่น <IMAGE_0> สามารถใช้เชื่อมภาพอ้างอิงแต่ละภาพกับบุคคล วัตถุ หรือสไตล์ที่อธิบายไว้ใน prompt ได้ route นี้ส่งคืนคลิปความยาวสูงสุด 10 วินาทีที่ความละเอียด 480p หรือ 720p

ใช้ extend-video กับไฟล์ MP4 ความยาว 2 ถึง 15 วินาที และขอให้เพิ่มการดำเนินเรื่องตาม prompt อีก 2 ถึง 10 วินาที สำหรับการเปลี่ยนแปลงเฉพาะจุด edit-video รองรับไฟล์ MP4 ที่มีความยาวไม่เกิน 8.7 วินาที และจะคงระยะเวลาเดิมไว้ ทั้งสอง route จำกัดความละเอียดเอาต์พุตไว้ที่ 720p

ราคามาตรฐานของ Atlas Cloud คือ $0.05 ต่อวินาทีสำหรับ text-to-video, image-to-video และ reference-to-video ส่วน extend-video และ edit-video คิดในอัตรามาตรฐาน $0.07 ต่อวินาที การแก้ไขจะคิดค่าบริการตามระยะเวลาของวิดีโออินพุต เนื่องจากเอาต์พุตมีระยะเวลาเท่ากัน

ขั้นแรกตรวจสอบว่า endpoint ที่เลือกตรงกับประเภทอินพุต และมี prompt, URL รูปภาพ หรือ URL วิดีโอที่จำเป็นครบถ้วน ตรวจสอบข้อจำกัดเฉพาะ route ด้านระยะเวลา ความละเอียด สัดส่วนภาพ จำนวนภาพอ้างอิง และไฟล์ MP4 ก่อนส่งคำขออีกครั้ง หากคำขอสำเร็จแต่ฉากไม่ถูกต้อง ให้เขียน prompt ใหม่โดยระบุการเคลื่อนไหวของตัวแบบ การเคลื่อนกล้อง จังหวะ และรายละเอียดภาพอย่างชัดเจน

สำรวจกลุ่มเพิ่มเติม

Seedance 2.5

Seedance 2.5 API พร้อมใช้งานแล้วบน Atlas Cloud! มอบโมเดลวิดีโอใหม่ล่าสุดของ ByteDance ให้กับนักพัฒนา สร้างวิดีโอเนทีฟได้นานถึง 30 วินาทีในการประมวลผลเพียงครั้งเดียวจากข้อความ รูปภาพเดียว หรือการอ้างอิงหลายรูปแบบสูงสุด 50 รายการ พร้อมเสียงที่ซิงโครไนซ์และข้อความหลายภาษาในเฟรม บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว โดยมีความสอดคล้องของวัตถุและระบบฟิสิกส์ที่ได้รับการปรับปรุงซึ่งช่วยให้ภาพระยะยาวมีความต่อเนื่อง

ดูกลุ่ม

Wan 3.0

Wan 3.0 API คือเจเนอเรชันถัดไปของตระกูลวิดีโอ Wan จาก Alibaba ซึ่งสร้างขึ้นเพื่อยกระดับการสร้างวิดีโอแบบยาว การควบคุมแบบหลายข้อมูลอ้างอิง และคุณภาพของภาพและเสียงให้ก้าวไปอีกขั้น Atlas Cloud ได้โฮสต์ Wan 2.7, 2.6 และ 2.5 ไว้แล้ว และ Wan 3.0 สามารถทำงานบนคีย์แบบรวมเดียวกันโดยไม่ต้องตั้งค่าแยกต่างหาก เริ่มต้นสร้างสรรค์ได้ตั้งแต่วันนี้ เลื่อนลงไปที่ส่วนจัดแสดงเพื่อดูว่า Wan 3.0 สามารถสร้างอะไรได้บ้าง

ดูกลุ่ม

MiniMax H3

MiniMax H3 คือผลิตภัณฑ์วิดีโอแบบมัลติโมดัลของ MiniMax สำหรับการสร้างสรรค์โดยใช้ข้อความ รูปภาพ และข้อมูลอ้างอิง ในเส้นทาง API ที่รองรับ ระบบจะคงลักษณะของวัตถุจากสื่ออ้างอิงไว้ มีอัตราส่วนภาพที่ยืดหยุ่น และจับคู่เสียงที่สร้างขึ้นกับภาพผ่าน H3 Developer โดยโปรไฟล์เอาต์พุตจะถูกเลือกตาม endpoint Atlas Cloud รวมผลิตภัณฑ์ในตระกูลนี้ไว้เบื้องหลังคีย์เดียวที่รองรับ OpenAI พร้อมการคิดค่าบริการตามการใช้งานอย่างโปร่งใส เริ่มต้นที่อัตรามาตรฐาน $0.038 ต่อวินาที เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

Seedream 5.0 Pro

Seedream 5.0 Pro API มอบโมเดลการแก้ไขภาพที่ควบคุมได้ของ ByteDance บน Atlas Cloud ให้กับนักพัฒนา โดยจะวางการแก้ไขอย่างแม่นยำด้วยจุดยึดและพิกัด แยกภาพออกเป็นเลเยอร์ที่แก้ไขได้ ผสานข้อมูลอ้างอิงหลายรายการ และจับคู่สีและวัสดุที่แน่นอน พร้อมข้อความหลายภาษาที่ความละเอียด 2K และ 3K บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว!

ดูกลุ่ม

Seedance 2.0

Seedance 2.0 คือโมเดลวิดีโอสำหรับการใช้งานจริงของ ByteDance ที่ออกแบบมาเพื่อสร้างช็อตได้อย่างแม่นยำ เปลี่ยนพรอมป์ต์เป็นวิดีโอ ทำให้ภาพเฟรมแรกเคลื่อนไหวโดยมีตัวเลือกให้ใช้คำแนะนำจากเฟรมสุดท้าย หรือปรับแต่งผลลัพธ์ด้วยสื่ออ้างอิงและการค้นหาเว็บแบบเลือกใช้ได้ Atlas Cloud รวมเวิร์กโฟลว์เหล่านี้ไว้ใน API เดียว พร้อมการคิดค่าบริการตามการใช้งานจริงอย่างโปร่งใสและคีย์เดียวที่เข้ากันได้กับ OpenAI เริ่มสร้างสรรค์ได้วันนี้

ดูกลุ่ม

GPT Image 2.5

ตระกูล gpt-image-2.5 จาก OpenAI มอบทางเลือก Flare และ Sunburst ให้แก่นักพัฒนาสำหรับกระบวนการทำงานด้านการสร้างภาพเพื่อใช้งานจริง เรนเดอร์ด้วยความละเอียดตามต้องการสูงสุด 3840x2160 และเลือกได้จากระดับคุณภาพ 5 ระดับ รวมถึง xhigh และ max เพื่อให้ตรงตามข้อกำหนดของเอาต์พุตแต่ละแบบ Atlas Cloud ให้บริการอนุมานผ่าน REST ที่พร้อมใช้งาน โดยไม่มี cold start และคิดค่าบริการตามมาตรฐานเริ่มต้นที่ $0.004 ต่อการสร้างภาพ เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

GPT Image 2

GPT Image 2 API ช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลรูปภาพล่าสุดของ OpenAI ซึ่งเป็นรุ่นสืบทอดจาก GPT Image 1.5 โดยสามารถสร้างและแก้ไขรูปภาพพร้อมกับการเรนเดอร์ข้อความที่แม่นยำทั้งในอักษรละตินและ CJK รวมถึงการจัดวางองค์ประกอบที่ยอดเยี่ยมสำหรับโปสเตอร์ ม็อกอัป และอินโฟกราฟิก บน Atlas Cloud คุณสามารถเข้าถึงโมเดลนี้ผ่าน API ที่เป็นหนึ่งเดียวร่วมกับโมเดลอื่นๆ อีกกว่า 300 รุ่น พร้อมเครดิตฟรี เวลาทำงาน 99.99% และไม่จำเป็นต้องมีการตรวจสอบยืนยันองค์กรจาก OpenAI

ดูกลุ่ม

Gemini Omni Flash

API ของ gemini omni นำตระกูล Gemini Omni Flash แบบมัลติโมดัลโดยกำเนิดจาก Google DeepMind ซึ่งรวมถึง Gemini Omni 1.1 Flash มาสู่นักพัฒนา สร้างวิดีโอสไตล์ภาพยนตร์พร้อมเสียงเนทีฟที่ซิงโครไนซ์กัน ทำให้ภาพนิ่งเคลื่อนไหวได้ด้วยการควบคุมเฟรมเริ่มต้นและเฟรมสิ้นสุดอย่างแม่นยำ หรือปรับแก้ฟุตเทจที่มีอยู่ผ่านการแก้ไขด้วยคำสั่งข้อความ โดยยังคงรักษาเนื้อหาที่ไม่ได้แก้ไขไว้ Atlas Cloud มอบคีย์เดียวที่เข้ากันได้กับ OpenAI การเข้าถึงแบบรวมศูนย์ และราคาที่โปร่งใสโดยคิดค่าบริการตามการใช้งาน เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

Grok Imagine

Grok Imagine API ครอบคลุมโมเดลรูปภาพ วิดีโอ และพูดของ xAI ตั้งแต่ Image 2.0 ถึง Video 1.5 และ xAI TTS v1 สร้างรูปภาพนิ่ง 1K หรือ 2K ในอัตราส่วน 14 แบบ ขยายฉากไปยัง 15 วินาทีของวิดีโอ 1080p ควบคุมภาพด้วยรูปภาพอ้างอิงได้ถึง 7 รูป หรือเพิ่มบรรยายเสียงในภาษา 20 ภาษา Atlas Cloud รันทุกโหมดบนเอนด์พอยต์เดียว มีราคาแบบจ่ายตามการใช้งาน ตั้งแต่ $0.02 ต่อรูปภาพและ $0.05 ต่อวินาที เริ่มสร้างวันนี้

ดูกลุ่ม

Google

โมเดลเชิงสร้างสรรค์ที่ทรงพลังที่สุดของ Google พร้อมใช้งานแล้วบน Atlas Cloud โดย Veo 3.1 นำเสนอการสร้างวิดีโอระดับภาพยนตร์ Nano Banana 2 ขับเคลื่อนการสร้างภาพที่มีความเที่ยงตรงสูง และ Gemini นำความชาญฉลาดแบบมัลติโมดัลมาสู่ทุกเวิร์กโฟลว์ เข้าถึงชุดโมเดลของ Google เต็มรูปแบบผ่าน API key เดียวพร้อมความพร้อมใช้งานระดับ Day-0 และการกำหนดราคาแบบจ่ายตามการใช้งาน (pay-as-you-go)

ดูกลุ่ม

Seedance 2.0 Mini

Seedance 2.0 Mini นำเสนอการสร้างวิดีโอแบบมัลติโมดัลของ ByteDance สู่เวิร์กโฟลว์ที่ความเร็วและต้นทุนมีความสำคัญสูงสุด โดยมอบความสามารถหลักของ Seedance 2.0 ในรูปแบบที่ใช้ทรัพยากรน้อยลง — สร้างได้เร็วกว่า ต้นทุนต่อวิดีโอต่ำกว่า และใช้การผสานรวม API เดิมที่คุณใช้อยู่แล้ว สำหรับทีมที่จัดการไปป์ไลน์ปริมาณมากหรือสร้างต้นแบบในสเกลขนาดใหญ่ Mini คือตัวเลือกเริ่มต้นที่ใช้งานได้จริง

ดูกลุ่ม

ByteDance

ตั้งแต่การสร้างวิดีโอระดับภาพยนตร์ไปจนถึงการสร้างภาพที่มีความละเอียดสูง โมเดลที่ทรงพลังที่สุดของ ByteDance พร้อมใช้งานแล้วบน Atlas Cloud รัน Seedance และ Seedream ในสเกลขนาดใหญ่ด้วยราคาการอนุมานที่ต่ำที่สุด และไม่มีค่าใช้จ่ายแฝงด้านโครงสร้างพื้นฐาน

ดูกลุ่ม

API เดียวสำหรับ AI สื่อทุกประเภท

สำรวจโมเดลทั้งหมด