
Kling v2.6 คือกลุ่มโมเดลวิดีโอของ Kuaishou สำหรับการสร้างวิดีโอจากข้อความและจากภาพในสไตล์ภาพยนตร์ อวตาร AI และการถ่ายโอนการเคลื่อนไหวโดยอ้างอิงภาพ รองรับอัตราส่วนภาพที่ยืดหยุ่น ไดนามิกที่ดียิ่งขึ้น อัตลักษณ์ที่คงที่ และความสอดคล้องด้านเวลาสำหรับเวิร์กโฟลว์เฉพาะทาง Atlas Cloud มีตัวเลือก Pro และ Standard ผ่าน endpoint ที่สอดคล้องกัน พร้อมการคิดราคาแบบจ่ายตามการใช้งานที่โปร่งใส เริ่มสร้างสรรค์ได้วันนี้
Kling 2.6 พัฒนาโดย Kuaishou โดย Atlas Cloud (ดำเนินการโดย Atlas Cloud AI LLC) เป็นผู้ให้บริการเข้าถึงโมเดลนี้ แต่ไม่ได้เป็นเจ้าของโมเดล เครื่องหมายการค้าทั้งหมดเป็นของเจ้าของที่เกี่ยวข้อง
จับคู่แต่ละ Endpoint ของ Kling v2.6 กับเวิร์กโฟลว์อินพุตที่รองรับ จุดเด่นสำหรับการผลิต และกรณีการใช้งานวิดีโอที่เหมาะสม
| รูปแบบสื่อ | คำอธิบาย |
|---|---|
| Kling v2.6 Pro Avatar API (Avatar To Video) | ออกแบบมาสำหรับการสร้างอวตารระดับพรีเมียม Endpoint นี้สร้างวิดีโอคุณภาพสูงที่มีรายละเอียดคมชัด การเคลื่อนไหวมั่นคง และความสอดคล้องของอัตลักษณ์ที่ดี เหมาะสำหรับวิดีโอโปรไฟล์ที่ดูเป็นมืออาชีพ วิดีโอแนะนำตัว และคอนเทนต์โซเชียล |
| Kling v2.6 Std Avatar API (Avatar To Video) | เลือก Standard Avatar Endpoint เพื่อสร้างวิดีโออวตาร AI ที่มีรายละเอียดคมชัด การเคลื่อนไหวแบบภาพยนตร์ และการทำตามพรอมป์ต์ที่เชื่อถือได้ ความสามารถนี้เหมาะสำหรับโปรไฟล์ วิดีโอแนะนำตัวสั้น ๆ และการผลิตคอนเทนต์โซเชียลมีเดียเป็นประจำ |
| Kling v2.6 Pro Motion Control API (Reference Motion To Video) | คลิปการเคลื่อนไหวอ้างอิงสามารถถ่ายโอนท่าเต้น แอ็กชัน หรือท่าทางไปยังภาพตัวละครหรือวิดีโอต้นฉบับ โดยยังคงรักษาอัตลักษณ์และความสอดคล้องของเวลาไว้ ใช้สำหรับสร้างแอนิเมชันตัวละครที่ลื่นไหลและทำตามการเคลื่อนไหวที่บันทึกไว้อย่างเฉพาะเจาะจง |
| Kling v2.6 Std Motion Control API (Image And Motion To Video) | ทำให้ภาพตัวละครนิ่งเคลื่อนไหวได้ด้วยการป้อนคลิปการเคลื่อนไหวที่มีท่าเต้น แอ็กชัน หรือท่าทาง Endpoint จะดึงการเคลื่อนไหวนั้นออกมาและสร้างวิดีโอที่ลื่นไหลสมจริง เหมาะสำหรับเวิร์กโฟลว์ถ่ายโอนการเคลื่อนไหวที่ใช้งานได้ง่าย |
| Kling v2.6 Pro API (Text To Video) | พรอมป์ต์ข้อความจะถูกแปลงเป็นวิดีโอสไตล์ภาพยนตร์พร้อมเสียงที่สร้างโดย AI และอัตราส่วนภาพที่ยืดหยุ่นผ่านโมเดลของ Kuaishou รองรับการพัฒนาแนวคิด ฉากเชิงเรื่องราว โฆษณา และโปรเจกต์วิดีโออื่น ๆ ที่ขับเคลื่อนด้วยพรอมป์ต์ |
| Kling v2.6 Pro API (Image To Video) | เริ่มต้นจากภาพ Endpoint นี้จะสร้างวิดีโอสไตล์ภาพยนตร์พร้อมการสร้างเสียงและไดนามิกที่โดดเด่นยิ่งขึ้น ช่วยทำให้ภาพผลิตภัณฑ์ ภาพประกอบ หรือภาพนิ่งเชิงสร้างสรรค์มีชีวิตขึ้นมา เหมาะเมื่อจำเป็นต้องควบคุมความต่อเนื่องของภาพอย่างแม่นยำ |
Kling v2.6 ผสานการสร้างภาพและเสียงในตัว เวิร์กโฟลว์จากข้อความและภาพ การควบคุมการเคลื่อนไหวด้วยข้อมูลอ้างอิง อวตารที่ขับเคลื่อนด้วยเสียง พารามิเตอร์ที่ยืดหยุ่น และการใช้งานแบบจ่ายตามการใช้งานจริงผ่านเอนด์พอยต์ Standard และ Pro
Kling v2.6 Pro สามารถสร้างวิดีโอและเสียงได้พร้อมกันจากพรอมต์ข้อความหรือภาพต้นฉบับ สวิตช์เสียงเปิดใช้งานเป็นค่าเริ่มต้นบนเอนด์พอยต์ Text to Video และ Image to Video ของ Atlas Cloud ดังนั้นบทสนทนา เอฟเฟกต์ และบรรยากาศจึงดำเนินไปพร้อมกับฉากได้อย่างสอดคล้องกัน เหมาะอย่างยิ่งสำหรับคลิปเล่าเรื่องสั้นที่ต้องการผลลัพธ์ด้านภาพและเสียงที่เป็นหนึ่งเดียวโดยไม่ต้องทำเสียงแยกภายหลัง
เริ่มจากฉากที่เขียนขึ้นหรือทำให้ภาพนิ่งเคลื่อนไหวด้วยเอนด์พอยต์การสร้างของ Pro พรอมต์ข้อความรองรับเอาต์พุตอัตราส่วน 1:1, 9:16 และ 16:9 ขณะที่ทั้งสองเส้นทางรองรับระยะเวลา 5 หรือ 10 วินาที สวิตช์เสียง negative prompts และการควบคุม CFG ตั้งแต่ 0 ถึง 1 อินพุตภาพรองรับไฟล์ JPG, JPEG หรือ PNG ขนาดไม่เกิน 10 MB ช่วยให้นักพัฒนาควบคุมสินทรัพย์สำหรับโซเชียลมีเดีย ผลิตภัณฑ์ และงานภาพยนตร์ได้อย่างเหมาะสม
ป้อนภาพตัวละครและคลิปการเคลื่อนไหวอ้างอิงให้กับ Kling v2.6 Motion Control เพื่อถ่ายโอนลำดับการเต้น การแสดง หรือท่าทางแบบเต็มตัว พร้อมรักษาอัตลักษณ์และความต่อเนื่องตามเวลา วิดีโออ้างอิงมีความยาวได้ตั้งแต่ 3 ถึง 30 วินาที เลือกได้ว่าจะให้องค์ประกอบภาพยึดตามภาพนิ่งหรือวิดีโอการเคลื่อนไหว และกำหนดว่าจะเก็บเสียงต้นฉบับไว้หรือไม่ ผลลัพธ์เหมาะสำหรับการแสดงต่อเนื่อง แอนิเมชันตัวละคร และแคมเปญที่ขับเคลื่อนด้วยแอ็กชัน
เอนด์พอยต์ Standard Avatar และ Pro Avatar ต้องใช้อินพุตเป็นภาพและแทร็กเสียง พร้อมรองรับพรอมต์เสริมเพื่อกำกับผลลัพธ์ Pro ให้ความสำคัญกับรายละเอียดที่คมชัด การเคลื่อนไหวที่มั่นคง และความสอดคล้องของอัตลักษณ์ในระดับสูง ขณะที่ Standard ผสานการเคลื่อนไหวแบบภาพยนตร์เข้ากับการทำตามพรอมต์ได้อย่างน่าเชื่อถือ ใช้เส้นทางนี้เมื่อบุคคลหรือคาแรกเตอร์ที่จดจำได้ต้องถ่ายทอดเสียงที่เตรียมไว้ในวิดีโอโปรไฟล์ อินโทรแบรนด์ หรือคอนเทนต์โซเชียลที่เผยแพร่เป็นประจำ
เลือกเอนด์พอยต์ Standard หรือ Pro ตามลักษณะงาน แล้วจ่ายเฉพาะการเรียกใช้งานผ่าน Atlas Cloud ที่คุณส่งเท่านั้น Standard Avatar เริ่มต้นที่ $0.056 ต่อการเรียกใช้, Standard Motion Control ที่ $0.07, Pro Text to Video และ Image to Video ที่ $0.07 และ Pro Avatar หรือ Motion Control ที่ $0.112 บัญชีเดียวรองรับทั้ง 6 เอนด์พอยต์ ช่วยให้นักพัฒนาสมดุลระหว่างคุณภาพภาพ ความต้องการด้านการเคลื่อนไหว และต้นทุนการผลิตได้โดยไม่ต้องผูกมัดกับการสมัครสมาชิก
ดูว่า Kling v2.6 และทางเลือกอีกสองแบบจาก Atlas Cloud ตีความพรอมต์เดียวกันอย่างไร ทั้งในฉากแอ็กชันสมจริงและการเล่าเรื่องเชิงสไตล์
ภาพยนตร์โฆษณาแฟชั่นไฮเปอร์เรียลความยาว 8–10 วินาที ถ่ายทำตอนเที่ยงบนทะเลสาบเกลือสีขาวกว้างสุดลูกหูลูกตา: นักสเก็ตความเร็วสูง 6 คนสวมผ้าคลุมสะท้อนแสงสีรุ้ง จัดขบวนเรขาคณิตอย่างแม่นยำเป็น “ทีมเก็บเกี่ยวเกลือรูปว่าว” โดยแต่ละคนดึงเส้นสีโคบอลต์บลูและสีส้มฟลูออเรสเซนต์ที่ขึงตึง เชื่อมต่อกับว่าวรูปกระเบนราหูขนาดมหึมา เปิดฉากด้วยภาพโดรนมุมสูงจากด้านบนในแนวดิ่ง ขณะที่ขบวนที่เคลื่อนไหวสอดประสานกันกรีดลวดลายคมกริบบนผิวเปลือกเกลือ; จากนั้นโดรนดิ่งลงอย่างฉับพลันและบินราบห่างจากพื้นเพียงไม่กี่นิ้ว เร่งตามผู้นำขณะที่ทีมสลาลอมผ่านซุ้มธงที่ปลิวสะบัด ผ้าคลุมสะบัดดังฉับและเชือกโค้งรับแรงตึงอย่างสมจริง แพนกล้องอย่างรวดเร็วเข้าสู่การโคจร 360 องศา เมื่อปีศาจฝุ่นก่อตัวขึ้นข้างทีมอย่างฉับพลัน หมุนผลึกเกลือที่หลุดลอยขึ้นสู่อากาศ; นักขี่ทั้ง 6 คนตอบสนองพร้อมเพรียงกัน ดึงเส้นกลับอย่างเฉียบคม และว่าวรูปกระเบนราหูพับตัวเข้าสู่การดิ่งลงอย่างทรงพลัง พุ่งทะลวงกระแสวนผลึกและโปรยเกลือระยิบระยับราวหิมะพร่างพรายเหนือทีมที่กำลังพุ่งไปข้างหน้า แอ็กชันที่ประสานกันต่อเนื่องตั้งแต่ต้นจนจบ ตัวตนและรูปขบวนคงเส้นคงวาในทุกช็อต แรงส่งของการสเก็ตที่น่าเชื่อถือ แรงตึงของเชือกที่ถูกต้องตามหลักฟิสิกส์ การเคลื่อนไหวของผ้าที่สอดคล้องกับอากาศพลศาสตร์ อนุภาคเกลือแบบละเอียด ความปั่นป่วนของลม และเงาที่ทอดลงบนพื้นอย่างสมจริง แสงแดดจากด้านบนที่รุนแรง แสงด้านบนคมชัดและคอนทราสต์สูง ภาพสะท้อนสีรุ้งแบบปริซึมบนผ้าคลุมสะท้อนแสงและพื้นผิวเกลือ องค์ประกอบสีขาวดุจหิมะ สีโคบอลต์บลู และสีส้มฟลูออเรสเซนต์แบบมีหลายชั้น สุนทรียะแฟชั่นโฆษณาระดับพรีเมียมที่เหนือจริง รายละเอียดภาพยนตร์คมกริบ จังหวะเพอร์คัสชันอันเร้าใจที่ซิงก์กับทุกการกรีดเส้นและการเปลี่ยนผ่านของกล้อง เสียงลมพุ่ง เสียงใบมีดครูดพื้น เสียงผ้าสะบัด เสียงเชือกรัดตึง ตามด้วยเสียงฟู่ใสกระจ่างราวผลึกในตอนจบ ห้ามใช้สโลว์โมชัน ห้ามมีช็อตนิ่งที่เป็นเพียงภาพคั่น ห้ามตัดภาพจนทำลายความต่อเนื่องของพื้นที่ ห้ามมีร่างกายผิดรูป ห้ามมีบุคคลซ้ำซ้อน ห้ามมีเชือกพันกันหรือขาดการเชื่อมต่อ ห้ามเครื่องแต่งกายไม่สอดคล้องกัน ห้ามวัตถุลอย ห้ามมีหน้าจอ ห้ามมีอินเทอร์เฟซซอฟต์แวร์ ห้ามมีแดชบอร์ด ห้ามมีแถบความคืบหน้า ห้ามมีกราฟ ห้ามมีคำบรรยาย ห้ามมีโลโก้ ห้ามมีลายน้ำ ห้ามมีข้อความที่อ่านได้ อัตราส่วนภาพ 16:9
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
ฉากไล่ล่าใต้ทะเลลึกแบบภาพยนตร์ต่อเนื่องความยาว 8–10 วินาที ภายในห้องบอลรูมที่เอียงลาดชันของซากเรืออับปางที่กำลังผุพัง: เริ่มด้วยภาพมาโครระยะใกล้สุดของหนวดปลาหมึกเลียนแบบกึ่งโปร่งแสงที่ส่องประกายผ่านผลึกโคมระย้าที่แตกร้าว ขณะมันฉวย “ไข่มุก” ที่เรืองแสง; ดอลลี่ซูมถอยหลังอย่างรวดเร็วเพื่อเผยให้เห็นปลาหมึกที่เหวี่ยงตัวจากราวบันไดขึ้นสนิมเหนือโต๊ะอาหารที่คว่ำอยู่ ขณะที่ปลาไหลมอเรย์เลื้อยผ่านเก้าอี้และไล่ตามมัน เครื่องเงิน เศษแก้ว ตะกอน และสายโซ่ฟองอากาศลอยขึ้นและชนกันตามหลักฟิสิกส์ใต้น้ำที่น่าเชื่อถือ เปลี่ยนเข้าสู่ช็อตไล่ล่าที่กล้องโคจรรอบตัวแบบแน่น 360 องศา ขณะที่ปลาหมึกเปลี่ยนพื้นผิวและความโปร่งแสงของผิวอย่างต่อเนื่องให้เข้ากับม่านกำมะหยี่ ทองเหลืองหมอง และไม้ที่มีเพรียงเกาะ จากนั้นพ่นหมึกหนาทึบออกมา ซึ่งม้วนตัวเป็นตัวล่อรูปร่างเหมือนปลาหมึกอย่างน่าเชื่อ ปลาไหลพุ่งโจมตีเงาร่างปลอม ขณะที่ปลาหมึกตัวจริงลื่นผ่านพวกมันไป แพนกล้องอย่างรวดเร็วพร้อมหมุนกล้องเข้าสู่มุมมองจากด้านบนที่เอียงลาดอย่างดรามาติก: “ไข่มุก” ที่ถูกขโมยไปจู่ ๆ ก็เปิดดวงตาเล็ก ๆ ออก แสงสีอำพันของมันสว่างขึ้น และใบหน้าขนาดมหึมาที่พรางตัวของปลาแองเกลอร์ฟิชโผล่ขึ้นใต้โต๊ะเลี้ยง—ไข่มุกคือเหยื่อล่อของมัน; ปลาหมึกชะงักค้างเป็นจังหวะขบขันหนึ่งจังหวะ ขณะที่ปลาแองเกลอร์ฟิชพุ่งเข้าใส่กล้อง ความสมจริงแบบภาพยนตร์ใต้ทะเลลึกที่เหมือนภาพถ่าย แสงแวดล้อมสีไซแอนเย็นตัดกับแสงเรืองชีวภาพสีอำพันอุ่น น้ำแบบมีปริมาตร อนุภาคที่ลอยตัว การเคลื่อนไหวของหนวดแบบซอฟต์บอดีที่มีรายละเอียดหนาแน่น การจำลองของไหล การชนกันของวัตถุลอย ความต่อเนื่องของตัวแบบแบบไร้รอยต่อ แรงส่งที่น่าเชื่อถือตามหลักฟิสิกส์ แอ็กชันคมชัดเข้าใจง่าย ห้ามใช้สโลว์โมชัน เสียงประกอบสมจริงที่ซิงก์กัน: เสียงโครงเรือครางอู้อี้ เสียงผลึกกระทบกัน เสียงฟองอากาศพุ่ง เสียงปลาไหลงับ จังหวะเพอร์คัสชันไล่ล่าที่เต้นเป็นจังหวะ เสียงหมึกพุ่งเปียกชื้น จากนั้นเสียงเบสกระแทกฉับพลันเมื่อเปิดเผยความจริง ห้ามมีหน้าจอ อินเทอร์เฟซ แดชบอร์ด แถบความคืบหน้า กราฟ คำบรรยาย ซับไตเติล โลโก้ ลายน้ำ หรือข้อความอธิบาย อัตราส่วนภาพ 16:9
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
ตั้งแต่พรอมต์สไตล์ภาพยนตร์และภาพนิ่งสำหรับแคมเปญแอนิเมชัน ไปจนถึงอวตารที่คงความสม่ำเสมอและการแสดงที่มีการเคลื่อนไหวตามแนวทาง Kling v2.6 รองรับนักพัฒนาที่สร้างภาพยนตร์ โฆษณา คอนเทนต์โซเชียล และตัวละครแบรนด์
เปลี่ยนคอนเซ็ปต์ที่เขียนไว้ให้เป็นวิดีโอสไตล์ภาพยนตร์ด้วย Kling v2.6 Pro Text to Video พร้อมอัตราส่วนภาพที่ยืดหยุ่นและเสียงที่สร้างขึ้นอัตโนมัติ ผู้สร้างภาพยนตร์สามารถทำต้นแบบตัวอย่างภาพยนตร์ จังหวะอารมณ์ดราม่า และพรีเซนเทชันภาพจากพรอมต์เดียว
ทำให้ภาพผลิตภัณฑ์หรือภาพนิ่งของแคมเปญมีชีวิตชีวาด้วยไดนามิกที่ดียิ่งขึ้น คุณภาพระดับภาพยนตร์ และเสียงที่สร้างขึ้นอัตโนมัติ ทีมการตลาดสามารถสร้างทีเซอร์เปิดตัว การสาธิตด้วยภาพ และโปรโมชันบนโซเชียลจากอาร์ตเวิร์กที่มีอยู่
สร้างวิดีโออวตารที่ดูเป็นมืออาชีพ พร้อมรายละเอียดคมชัด การเคลื่อนไหวที่เสถียร และอัตลักษณ์ที่คงความสม่ำเสมอด้วยโมเดล Pro Avatar ใช้สำหรับการแนะนำโปรไฟล์ ช่วงการนำเสนอ และบุคลิกแบรนด์บนโซเชียลที่ปรากฏซ้ำเป็นประจำ
ถ่ายโอนฟุตเทจการเต้น แอ็กชัน หรือท่าทางไปยังภาพตัวละคร โดยยังคงอัตลักษณ์และความสม่ำเสมอตามเวลาไว้ ผู้สร้างสามารถผลิตการทดสอบท่าเต้น มาสคอตแอนิเมชัน และคลิปการแสดงบนโซเชียลจากการเคลื่อนไหวที่บันทึกไว้
มอบการเคลื่อนไหวจากคลิปอ้างอิงให้กับภาพตัวละครหรือวิดีโอต้นฉบับผ่าน Pro Motion Control ทีมโปรดักชันสามารถสำรวจนักแสดงทางเลือก ฉากแอ็กชันสไตล์เฉพาะ และแอนิเมชันตัวละครที่คงความสม่ำเสมอ
เริ่มจากพรอมต์ข้อความและสร้างวิดีโอสไตล์ภาพยนตร์พร้อมเสียงในอัตราส่วนภาพที่ยืดหยุ่น นักพัฒนาสามารถทำให้การสร้างคอนเซ็ปต์แคมเปญสั้น ๆ คอนเทนต์ครีเอเตอร์ และภาพเฉพาะแพลตฟอร์มเป็นแบบอัตโนมัติ โดยไม่ต้องใส่ภาพเริ่มต้น
เปรียบเทียบ Kling v2.6 กับโมเดล text-to-video ชั้นนำ โดยพิจารณาจากผู้ให้บริการ ระยะเวลาคลิป เสียงในตัว และราคาพื้นฐานมาตรฐาน
| โมเดล | ผู้ให้บริการ | ระยะเวลาผลลัพธ์ | เสียงในตัว | ราคาพื้นฐานมาตรฐาน |
|---|---|---|---|---|
| Kling v2.6 Pro Text-to-Video | Kuaishou | 5 หรือ 10 วินาที | √ | $0.07/วินาที |
| Seedance 2.0 Text-to-Video | ByteDance | 4 ถึง 15 วินาที | √ | $0.112/วินาที |
| Wan-2.7 Text-to-video | Qwen | 2 ถึง 15 วินาที | √ | $0.10/วินาที |
| Veo 3.1 Lite Text-to-video | 4, 6 หรือ 8 วินาที | √ | $0.05/วินาที |
เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud
สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล
การรวมโมเดล Kling 2.6 ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้
เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์
API แบบรวมศูนย์:
รัน Kling 2.6, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว
ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless
ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต
ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม
ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา
Kling v2.6 คือกลุ่มโมเดลวิดีโอ AI ของ Kuaishou ที่ให้บริการผ่าน Atlas Cloud ประกอบด้วยการสร้างวิดีโอจากข้อความและจากภาพในรุ่น Pro รวมถึง endpoint รุ่น Standard และ Pro สำหรับอวตารและการควบคุมการเคลื่อนไหว
สร้างวิดีโอจากพรอมต์ ทำให้ภาพต้นฉบับเคลื่อนไหว สร้างวิดีโออวตารจากภาพและเสียง หรือถ่ายโอนลำดับการเต้น การเคลื่อนไหว และท่าทางจากคลิปอ้างอิงได้ endpoint Pro Text-to-Video และ Pro Image-to-Video สามารถสร้างเสียงไปพร้อมกับภาพได้
เลือก Text-to-Video เมื่อเริ่มต้นจากพรอมต์ และเลือก Image-to-Video เมื่อต้องการทำให้ภาพนิ่งเคลื่อนไหว endpoint Avatar จะจับคู่ภาพกับเสียงที่ระบุ ส่วน Motion Control จะนำการเคลื่อนไหวจากวิดีโออ้างอิงไปใช้กับตัวละคร
ส่งคำขอ POST ไปยัง `/api/v1/model/generateVideo` พร้อม Atlas Cloud API key, model ID ที่ถูกต้อง และอินพุตเฉพาะของ endpoint การตอบกลับแบบอะซิงโครนัสจะแสดง prediction ID ซึ่งคุณสามารถตรวจสอบผ่าน `/api/v1/model/prediction/{id}` จนกว่างานจะเสร็จสมบูรณ์
การควบคุมจะแตกต่างกันไปตาม endpoint Text-to-Video รองรับพรอมต์ พรอมต์เชิงลบ อัตราส่วนภาพ 1:1, 9:16 และ 16:9 ระยะเวลา 5 หรือ 10 วินาที เสียง และ guidance scale ส่วนเวิร์กโฟลว์อื่น ๆ จะเพิ่มอินพุตสำหรับภาพ เสียง วิดีโอการเคลื่อนไหว การวางแนว หรือการคงเสียงไว้ตามความเหมาะสม
สำหรับ Pro Text-to-Video และ Pro Image-to-Video พารามิเตอร์ `sound` ใช้ควบคุมการสร้างเสียงพร้อมกัน ส่วนโมเดล Avatar จะต้องใช้อินพุตเสียงร่วมกับภาพตัวละคร ขณะที่ Motion Control สามารถคงเสียงต้นฉบับของวิดีโออ้างอิงไว้ได้
Atlas Cloud ระบุอัตรามาตรฐานไว้ที่ $0.07 ต่อวินาทีสำหรับ Pro Text-to-Video, Pro Image-to-Video และ Standard Motion Control ส่วน Standard Avatar อยู่ที่ $0.056 ต่อวินาที ขณะที่ Pro Avatar และ Pro Motion Control อยู่ที่ $0.112 ต่อวินาที โดยใช้อัตราปกติแทนราคาโปรโมชั่น
เตรียมภาพตัวละครรูปแบบ JPG, JPEG หรือ PNG และวิดีโอการเคลื่อนไหวรูปแบบ MP4 หรือ MOV ไฟล์แต่ละไฟล์ต้องมีขนาดไม่เกิน 10 MB มีขนาดอย่างน้อย 300 pixels ทั้งสองด้าน และใช้อัตราส่วนภาพระหว่าง 1:2.5 ถึง 2.5:1
ขั้นแรก ให้ตรวจสอบ model ID, การยืนยันตัวตนแบบ Bearer, ฟิลด์ที่จำเป็น และข้อจำกัดด้านมีเดียเฉพาะของ endpoint หากงานได้รับการยอมรับแล้ว ให้ตรวจสอบ prediction ID จนกว่างานจะเสร็จสมบูรณ์หรือล้มเหลว และตรวจสอบข้อผิดพลาดที่ส่งกลับมา หากภาพมีความไม่สอดคล้องกัน ให้ลดความซับซ้อนของฉากและใช้มีเดียต้นฉบับที่ชัดเจน โดยเฉพาะเมื่อถ่ายโอนการเคลื่อนไหวของใบหน้าหรือการโต้ตอบกับวัตถุที่ซับซ้อน
คู่มือ บทแนะนำ และอัปเดตผลิตภัณฑ์ ที่ช่วยให้คุณใช้ Atlas Cloud ได้อย่างเต็มประสิทธิภาพ