Kling 1.6 Multi-Image Subject Consistency

Kling 1.6 Multi-Image Subject Consistency

Kling 1.6 คือโมเดลสร้างวิดีโอของ Kuaishou ที่พัฒนาขึ้นเพื่อเปลี่ยนพรอมต์และภาพอ้างอิงให้เป็นวิดีโอสั้นที่มีความต่อเนื่องสอดคล้องกัน โมเดลนี้ตอบสนองต่อการเคลื่อนไหว แอ็กชันตามเวลา และการเคลื่อนกล้องได้ดียิ่งขึ้น พร้อมยกระดับความสม่ำเสมอของตัวแบบ ความแม่นยำของสี ไดนามิกของแสง และการเรนเดอร์รายละเอียด เข้าถึงโมเดลในตระกูลนี้ผ่าน Atlas Cloud ด้วยคีย์เดียวที่รองรับ OpenAI และการคิดค่าบริการตามการใช้งานอย่างโปร่งใส เริ่มสร้างสรรค์ได้วันนี้

Kling 1.6 พัฒนาโดย Kuaishou โดย Atlas Cloud (ดำเนินการโดย Atlas Cloud AI LLC) เป็นผู้ให้บริการเข้าถึงโมเดลนี้ แต่ไม่ได้เป็นเจ้าของโมเดล เครื่องหมายการค้าทั้งหมดเป็นของเจ้าของที่เกี่ยวข้อง

เปรียบเทียบเอนด์พอยต์ของ Kling 1.6 ตามรูปแบบวิดีโอ

ดูว่าเอนด์พอยต์ Kling 1.6 แต่ละรายการรองรับอินพุตข้อความหรือรูปภาพอย่างไร และจุดเด่นที่ผ่านการตรวจสอบแล้วด้านการเคลื่อนไหว ความสอดคล้อง รายละเอียด และประสิทธิภาพ เหมาะกับการใช้งานแบบใด

รูปแบบอินพุตคำอธิบาย
Kling 1.6 Multi I2V Pro API (Multi Image To Video)แปลงรูปภาพเป็นวิดีโอที่มีหลายวัตถุ พร้อมความสอดคล้องที่ดีขึ้นและความแม่นยำในการติดตามการเคลื่อนไหวขั้นสูง เอนด์พอยต์ Pro นี้เหมาะกับฉากที่ซับซ้อน ซึ่งการเคลื่อนไหวของวัตถุที่ประสานกันและความสม่ำเสมอของภาพมีความสำคัญ
Kling 1.6 Multi I2V Standard API (Multi Image To Video)สำหรับการสร้างวิดีโอที่มีหลายวัตถุโดยคำนึงถึงต้นทุน เอนด์พอยต์นี้จะแปลงรูปภาพเป็นวิดีโอ โดยรักษาสมดุลระหว่างความเร็วและรายละเอียด เหมาะกับการทำแอนิเมชันฉากพื้นฐานและการผลิตคอนเทนต์ทั่วไปที่มีหลายวัตถุ
Kling 1.6 T2V Standard API (Text To Video)พรอมต์ข้อความจะถูกแปลงเป็นวิดีโอสั้นที่มีการเคลื่อนไหวคงที่และสอดคล้องกับพรอมต์ได้อย่างน่าเชื่อถือ ใช้เอนด์พอยต์ระดับเริ่มต้นนี้สำหรับการสร้างภาพแนวคิด คอนเทนต์โซเชียล และลำดับฉากที่ขับเคลื่อนด้วยพรอมต์แบบตรงไปตรงมา
Kling 1.6 I2V Pro API (Image To Video)เริ่มต้นจากภาพนิ่ง เอนด์พอยต์ Pro จะสร้างวิดีโอที่มีการผสานการเคลื่อนไหวราบรื่นยิ่งขึ้นและพื้นผิวสมจริงกว่าเดิม เหมาะกับภาพผลิตภัณฑ์คุณภาพสูง ภาพตัวละคร และการทำแอนิเมชันภาพในสไตล์ภาพยนตร์
Kling 1.6 I2V Standard API (Image To Video)เลือกเอนด์พอยต์น้ำหนักเบานี้เพื่อเปลี่ยนรูปภาพเป็นวิดีโอผ่านเวิร์กโฟลว์การสร้างพื้นฐาน ด้วยต้นทุนที่ต่ำ จึงเหมาะกับแอนิเมชันเรียบง่าย การทดสอบงานสร้างสรรค์ในระยะแรก และการผลิตคอนเทนต์ปริมาณมาก

Kling 1.6 โดยตรงจากพรอมต์สู่การเคลื่อนไหว

Kling 1.6 รองรับเวิร์กโฟลว์จากข้อความ จากภาพเดี่ยว และจากภาพอ้างอิงสูงสุด 4 ภาพ พร้อมเอาต์พุตความยาว 5 หรือ 10 วินาที การควบคุมความสอดคล้องกับพรอมต์ พรอมต์เชิงลบที่เลือกใช้ได้ อัตราส่วนภาพที่กำหนดได้ และการเข้าถึงระดับ Standard หรือ Pro ผ่าน Atlas Cloud API เดียว

Kling 1.6 จากข้อความหรือภาพ

Kling 1.6 รองรับการสร้างวิดีโอจากข้อความและจากภาพผ่านรุ่นเฉพาะ เริ่มจากฉากที่เขียนเป็นข้อความหรือทำให้ภาพต้นฉบับเคลื่อนไหว จากนั้นกำกับการเคลื่อนไหวด้วยพรอมต์ยาวสูงสุด 2,500 อักขระ โมเดล Standard เน้นประสิทธิภาพด้านต้นทุน ขณะที่รุ่นภาพ Pro ให้ความสำคัญกับการผสานการเคลื่อนไหวที่ลื่นไหลและพื้นผิวที่สมจริงยิ่งขึ้น ความหลากหลายนี้เหมาะสำหรับการทดสอบแนวคิด คลิปสำหรับโซเชียล และลำดับภาพที่ผ่านการขัดเกลาแล้ว

ภาพอ้างอิง 4 ภาพ

อัปโหลดภาพอ้างอิงได้ตั้งแต่ 1 ถึง 4 ภาพด้วยรุ่น Multi I2V Standard หรือ Pro โมเดลจะใช้ภาพเหล่านี้เป็นข้อมูลอ้างอิงด้านภาพ ขณะที่พรอมต์กำหนดตัวแบบ การเคลื่อนไหว และการพัฒนาของฉาก รุ่น Pro ปรับแต่งมาเพื่อให้ตัวแบบหลายตัวมีความสอดคล้องกันมากขึ้นและติดตามการเคลื่อนไหวได้แม่นยำยิ่งขึ้น เหมาะสำหรับปฏิสัมพันธ์ระหว่างตัวละคร การรวมผลิตภัณฑ์หลายรายการ และฉากที่นำองค์ประกอบภาพหลายส่วนมารวมกัน

ควบคุมเฟรมแรกและเฟรมสุดท้าย

กำหนดทั้งภาพเริ่มต้นและภาพสิ้นสุดที่เลือกเพิ่มได้ด้วยรุ่น I2V Pro เพื่อกำหนดจุดเริ่มต้นและจุดสิ้นสุดของคลิป แต่ละภาพใช้ไฟล์ JPG, JPEG หรือ PNG ได้ ขนาดไม่เกิน 10 MB และความละเอียดอย่างน้อย 300 x 300 พิกเซล เพิ่มคำสั่งการเคลื่อนไหวระหว่างจุดยึดด้านภาพทั้งสอง จุดควบคุมนี้มีประโยชน์อย่างยิ่งสำหรับทรานซิชันที่วางแผนไว้ การเปลี่ยนท่าโพส และการเปิดเผยผลิตภัณฑ์

การเคลื่อนไหวของ Kling 1.6 พร้อมการกำกับทิศทาง

การเคลื่อนไหวที่ลื่นไหลเป็นจุดเน้นสำคัญของรุ่นภาพ Pro โดยโปรไฟล์ Atlas Cloud ระบุถึงการผสานภาพที่ได้รับการยกระดับและความสมจริงของพื้นผิวที่ดีขึ้น ค่า guidance scale ตั้งแต่ 0 ถึง 1 ใช้ปรับระดับความสอดคล้องกับพรอมต์ ขณะที่พรอมต์เชิงลบช่วยหลีกเลี่ยงองค์ประกอบที่ไม่ต้องการ ใช้การควบคุมเหล่านี้เพื่อสร้างสมดุลระหว่างการเคลื่อนไหวที่เป็นธรรมชาติกับแอ็กชันที่กำกับอย่างละเอียด การผสมผสานนี้เหมาะสำหรับการเคลื่อนไหวของตัวละคร เนื้อผ้า และกล้องที่ต้องการความแม่นยำสูง

ระยะเวลาและรูปแบบที่เหมาะกับงาน

เลือกเอาต์พุตความยาว 5 หรือ 10 วินาทีได้ในตระกูล Kling 1.6 รุ่นข้อความและรุ่นหลายภาพยังรองรับอัตราส่วนภาพ 16:9, 9:16 และ 1:1 ทำให้เวิร์กโฟลว์เดียวรองรับการใช้งานแบบจอกว้าง แนวตั้ง หรือสี่เหลี่ยม พรอมต์ที่รองรับสูงสุด 2,500 อักขระเปิดพื้นที่ให้ระบุตัวแบบ แอ็กชัน แสง และทิศทางกล้องได้อย่างละเอียด ตัวเลือกเหล่านี้ช่วยให้ทีมวางแผนแอสเซ็ตเฉพาะแพลตฟอร์มได้โดยไม่ต้องเปลี่ยนตระกูลโมเดล

ระดับของ Kling 1.6 ผ่าน API เดียว

เรียกใช้รุ่น Kling 1.6 ที่ระบุไว้ทั้งหมดผ่าน Atlas Cloud video generation API เดียว พร้อมการเรียกเก็บเงินแบบจ่ายตามการใช้งาน รุ่น Standard ใช้ราคาพื้นฐานเดิมที่ตรวจสอบแล้ว $0.056 ต่อการรัน ขณะที่รุ่น Pro ใช้ราคา $0.098 ต่อการรัน เลือกระดับที่สอดคล้องกับสมดุลระหว่างต้นทุน รายละเอียด และคุณภาพการเคลื่อนไหวที่ต้องการ การตั้งค่านี้รองรับทั้งการทดลองอย่างรวดเร็วและไปป์ไลน์การผลิต โดยไม่ต้องผสานรวมผู้ให้บริการแยกกัน

Kling 1.6 ภายใต้พรอมต์เดียว: เปรียบเทียบโมเดลวิดีโอสามแบบ

ดูว่า Kling 1.6 และโมเดลวิดีโอทางเลือกอีกสองแบบตีความพรอมต์เดียวกันอย่างไร ทั้งในฉากแอ็กชันสมจริงและการเล่าเรื่องเชิงสไตล์

พรอมต์

ฉากภาพยนตร์ไลฟ์แอ็กชันแบบย่อส่วนความยาว 8–10 วินาทีภายในเวิร์กช็อปเป่าแก้วยามเที่ยงคืน: ช่างฝีมือหนุ่มหมุนท่อเป่าอย่างต่อเนื่อง ขณะที่ฟองแก้วร้อนขาวขยายตัวอย่างรวดเร็ว โดยรูปทรงกลมสมบูรณ์ของมันเป็นจุดยึดองค์ประกอบภาพ เริ่มด้วยช็อตมาโครระยะใกล้สุดแบบโคจรรอบแก้วหลอมเหลวที่กำลังหมุน เก็บรายละเอียดเส้นใยสีอำพันโปร่งใสที่ยืดออก แรงตึงผิวหนืด ภาพสั่นไหวจากความร้อน ประกายไฟเล็กจิ๋ว และการหักเหของแสงภายในอย่างสมจริง ฟองแก้วที่พองตัวพลันหลุดจากท่อ กระแทกโต๊ะโลหะสีเงินเทา แล้วกลิ้งไปอย่างรวดเร็ว ลดระดับลงสู่ช็อตติดตามความเร็วสูงระดับโต๊ะที่เคลื่อนไปข้าง ๆ มัน ขณะฟองแก้วโคลงเคลง เปลี่ยนรูป สลัดเส้นแก้วเรืองแสง และสะท้อนแสงจันทร์สีน้ำเงินโคบอลต์ตัดกับแสงสีส้มจากเตาหลอม แพนอย่างรวดเร็วไปยังช่างฝีมือที่ตกใจและพุ่งข้ามโต๊ะ ก่อนใช้พายไม้เปียกตะครุบแก้วที่กำลังหลบหนีได้ในเสี้ยววินาทีสุดท้าย—เสียงฉ่าดังกึกก้องส่งไอน้ำที่มีพฤติกรรมทางฟิสิกส์แม่นยำหมุนวนไปทั่วเฟรม เมื่อไอน้ำจางลง เผยให้เห็นแก้วที่เปลี่ยนเป็นปลาปักเป้าตัวจิ๋วโปร่งใสอย่างน่าอัศจรรย์ มีครีบแก้วอันประณีตและฟองอากาศภายในที่สม่ำเสมอ มันพองแก้มเบา ๆ หนึ่งครั้ง เป็นจังหวะปิดท้ายอันขี้เล่น การเคลื่อนไหวต่อเนื่องไร้รอยต่อ การเปลี่ยนรูปของวัตถุที่สอดคล้องกัน ความหนืดของแก้ว การชนกัน แสงเรืองจากความร้อน ประกายไฟ การหักเห คาอุสติกส์ การบิดเบือนจากความร้อน และฟิสิกส์ของไอน้ำที่สมจริง; จานสีอำพัน น้ำเงินโคบอลต์ และเงินเทาแบบมีหลายชั้น; แสงหลักสีส้มจากเตาหลอม แสงขอบสีน้ำเงินเย็นจากดวงจันทร์ ระยะชัดตื้น งานภาพยนตร์จิ๋วเชิงปฏิบัติระดับพรีเมียมที่สัมผัสได้ พื้นผิวแบบภาพยนตร์สมจริง ไม่ใช้สโลว์โมชัน ไม่มีภาพนิ่งคั่น ไม่มีหน้าจอ อินเทอร์เฟซซอฟต์แวร์ แดชบอร์ด แถบความคืบหน้า กราฟ คำบรรยาย ข้อความ โลโก้ หรือลายน้ำ เสียงซิงโครไนซ์: เสียงเตาหลอมคำราม เสียงท่อเป่าครูด เสียงโลหะกระทบกันแหลมคม เสียงแก้วกลิ้งกระทบ เสียงฝีเท้าเร่งรีบ เสียงฉ่าเปียกดังสนั่น จากนั้นเป็นเสียงพองใสเล็ก ๆ ดนตรีจังหวะเพอร์คัสชันตึงเครียดที่จบลงด้วยเสียงกระดิ่งแก้วแสนขี้เล่น อัตราส่วนภาพ 16:9

Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud

Generated with Seedance 2.0 Image-to-Video on Atlas Cloud

Generated with Kling v1.6 i2v Standard on Atlas Cloud

พรอมต์

เรื่องสั้นขนาดจิ๋วความยาว 9 วินาทีอันตึงเครียดในครัวด้านหลังอันคับแคบของร้านบะหมี่ฮ่องกงยามดึก: เชฟหนุ่มเร่งช่วยออร์เดอร์ราเมง โดยเคลื่อนไหวอย่างต่อเนื่องด้วยท่วงท่ามือที่แม่นยำและน่าเชื่อถือ เริ่มด้วยช็อตติดตามด้านข้างจากมุมต่ำสุดที่เลียบไปตามเขียงซึ่งมีแป้งโรยอยู่ ขณะที่เขาสะบัดข้อมือและเหวี่ยงเส้นบะหมี่มัดยาวขึ้นสูงกลางอากาศ ไล่ตามเส้นที่บิดตัวผ่านไอน้ำหนาทึบ โดยเส้นบะหมี่แต่ละเส้นโค้งงอ ยืดออก และบดบังมือกับเครื่องครัวที่แขวนอยู่อย่างเป็นธรรมชาติ แพนอย่างรวดเร็วไปยังมุมชิดข้างเตา ขณะที่มัดเส้นบะหมี่เกือบร่วงลงสู่เปลวไฟแก๊สที่กำลังเลียขึ้นมา ในวินาทีสุดท้ายเขาพุ่งตัวไปข้างหน้าและรับมันได้อย่างหมดจดด้วยกระชอนลวด ตาข่ายกระชอนโค้งงอตามน้ำหนัก จากนั้นหมุนตัวในจังหวะลื่นไหลครั้งเดียวแล้วจุ่มเส้นลงในน้ำซุปที่เดือดพล่าน ส่งหยดน้ำ ฟอง และระลอกน้ำมันสมจริงกระจายไปทั่วหม้อ ตัดฉับไปยังช็อตมุมสูงจากด้านบน ขณะที่เส้นบะหมี่คลี่ออกเป็นเกลียวบานเรียบร้อยในน้ำซุป ผ่านช่องส่งอาหาร เหล่านักชิมที่รออยู่โน้มตัวเข้ามาและปรบมือด้วยความยินดี ขณะที่เชฟส่งยิ้มเหนื่อยหอบ รักษาความต่อเนื่องอย่างแม่นยำของเชฟคนเดิม เสื้อผ้า อุปกรณ์ มัดเส้นบะหมี่ ตำแหน่งพื้นที่ในครัว และการเคลื่อนไหวตลอดทุกคัต การจัดฉากเชิงลึกที่แน่นกระชับประสานเชฟ เส้นบะหมี่ เปลวไฟ หม้อ และอุปกรณ์ด้านหน้าอยู่ตลอดเวลา พร้อมชั้นพื้นผิวที่สัมผัสได้ของแป้งลอยในอากาศ เงาสะท้อนบนกระเบื้องเปียก น้ำมันมันวาว ไอน้ำเกาะ และไอน้ำที่หมุนวน สุนทรียะภาพยนตร์ฮ่องกงแบบภาพถ่ายสมจริง พลังงานการเคลื่อนไหวแบบถือกล้อง ภาพเบลอจากการเคลื่อนไหวตามธรรมชาติที่คมชัด แสงไฟใช้งานจริงสีส้มวอร์มจากทังสเตนตัดกับกระเบื้องเซรามิกสีไซแอนเย็น คอนทราสต์เข้ม เม็ดฟิล์ม 35mm อ่อน ๆ พื้นผิวผิวหนังและอาหารสมจริง เสียงซิงโครไนซ์: เสียงมีดกระทบเขียง เสียงเปลวไฟแก๊สคำราม เสียงไอน้ำพุ่ง เสียงกระชอนกระทบ เสียงน้ำซุปเดือดกระเซ็น จากนั้นเป็นเสียงปรบมือดังฉับพลัน จังหวะเพอร์คัสชันในครัวที่รวดเร็ว ไม่มีบทสนทนา ไม่ใช้สโลว์โมชัน ท่าทางหยุดนิ่ง ช็อตเปิดสถานที่ว่างเปล่า ช่องว่างจากการตัดต่อแบบมอนทาจ ความต่อเนื่องกระตุก นิ้วเกิน มือผิดรูป แขนขาซ้ำ อุปกรณ์แตกหัก การตัดทะลุ เส้นบะหมี่เทเลพอร์ต การเคลื่อนไหวเหมือนยาง พฤติกรรมของของไหลที่เป็นไปไม่ได้ วัตถุลอย UI หน้าจอ แดชบอร์ด แถบความคืบหน้า กราฟ คำบรรยาย ซับไตเติล โลโก้ หรือข้อความที่มองเห็นได้ อัตราส่วนภาพ 16:9

Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud

Generated with Seedance 2.0 Image-to-Video on Atlas Cloud

Generated with Kling v1.6 i2v Standard on Atlas Cloud

Kling 1.6 เปลี่ยนไอเดียให้กลายเป็นภาพเคลื่อนไหว

Kling 1.6 เปลี่ยนพรอมป์และภาพต้นฉบับให้เป็นคอนเซ็ปต์วิดีโอสั้นสำหรับสตอรีบอร์ด แคมเปญผลิตภัณฑ์ ฉากที่มีหลายตัวละคร งานศิลป์แอนิเมชัน เวอร์ชันสำหรับโซเชียล และเรื่องราวของตัวละคร

ต้นแบบสตอรีบอร์ดด้วย Kling 1.6

เปลี่ยนแนวคิดที่เขียนไว้ให้เป็นร่างวิดีโอสั้นที่มีการเคลื่อนไหวคงที่และสอดคล้องกับพรอมป์ได้อย่างน่าเชื่อถือ ผู้กำกับ เอเจนซี และทีมผลิตภัณฑ์สามารถดูจังหวะ การเคลื่อนไหว และทิศทางภาพได้ก่อนตัดสินใจเข้าสู่การผลิตเต็มรูปแบบ

สร้างการเคลื่อนไหวให้ผลิตภัณฑ์ด้วย Kling 1.6

ทำให้ภาพนิ่งของผลิตภัณฑ์มีชีวิตด้วยการผสานการเคลื่อนไหวที่ลื่นไหลขึ้นและพื้นผิวที่สมจริงยิ่งกว่าเดิม ทีมการตลาดสามารถเปลี่ยนภาพจากแค็ตตาล็อกให้เป็นคลิปเปิดตัว วิดีโอเผยฟีเจอร์ และสื่อสำหรับแคมเปญที่ผ่านการขัดเกลา โดยไม่ต้องจัดถ่ายใหม่

เรื่องราวแบรนด์ที่มีหลายตัวละคร

รวมตัวละครจากภาพแยกกัน พร้อมรักษาความต่อเนื่องของฉากให้ดีขึ้นและติดตามการเคลื่อนไหวได้อย่างแม่นยำ สร้างปฏิสัมพันธ์ระหว่างตัวละคร ช่วงเวลาที่มีหลายตัวละคร หรือเรื่องราวไลฟ์สไตล์สำหรับคอนเทนต์แบรนด์และแคมเปญโซเชียลได้ในวงกว้าง

แอนิเมชันภาพประกอบ

ทำให้งานศิลป์แบบคงที่เคลื่อนไหวได้ด้วยการผสานการเคลื่อนไหวที่ลื่นไหลขึ้นและความสมจริงของพื้นผิวที่พัฒนาดีขึ้นจาก Pro image-to-video variant ศิลปินและทีมเกมสามารถสร้างคอนเซ็ปต์แอนิเมชัน จังหวะของตัวละคร หรือการศึกษาบรรยากาศของฉากจากภาพที่มีอยู่ได้

เวอร์ชันวิดีโอสำหรับโซเชียลด้วย Kling 1.6

เริ่มจากพรอมป์หรือภาพต้นฉบับเพื่อสร้างคอนเซ็ปต์วิดีโอสั้นที่มีการเคลื่อนไหวคงที่หรือผสานการเคลื่อนไหวได้อย่างลื่นไหล ครีเอเตอร์สามารถพัฒนาฮุกหลายรูปแบบ แนวทางการนำเสนอภาพ และทิศทางแคมเปญสำหรับช่องทางโซเชียล

คลิปปฏิสัมพันธ์ระหว่างตัวละคร

เมื่อมีตัวละครหลายตัวที่ต้องอยู่ร่วมกันในฉากเดียว Multi variants จะให้ความสำคัญกับความต่อเนื่องของฉากและการติดตามการเคลื่อนไหวขั้นสูง ใช้สร้างคู่ตัวละคร ปฏิสัมพันธ์กับสัตว์เลี้ยง ช่วงเวลาของกลุ่มตัวละคร หรือการทดสอบเนื้อเรื่องจากภาพได้

การเปรียบเทียบโมเดล Kling 1.6 กับโมเดลคู่แข่ง

เปรียบเทียบรุ่นต่าง ๆ ของ Kling 1.6 กับโมเดลวิดีโออื่น ๆ ที่มีให้บริการบน Atlas Cloud ในด้านเวิร์กโฟลว์อินพุต ระยะเวลาคลิป เสียงในตัว และราคามาตรฐาน

โมเดลเวิร์กโฟลว์อินพุตระยะเวลาเอาต์พุตเสียงในตัวราคามาตรฐาน
Kling v1.6 Multi i2v Proพรอมต์ + 1 ถึง 4 รูปภาพ5 หรือ 10 วินาที-$0.098/run
Kling v1.6 Multi i2v Standardพรอมต์ + 1 ถึง 4 รูปภาพ5 หรือ 10 วินาที-$0.056/run
Kling v1.6 t2v Standardพรอมต์ข้อความ5 หรือ 10 วินาที-$0.056/run
Kling v1.6 i2v Proพรอมต์ + เฟรมเริ่มต้น + เฟรมสิ้นสุด (ไม่บังคับ)5 หรือ 10 วินาที-$0.098/run
Kling v1.6 i2v Standardพรอมต์ + เฟรมเริ่มต้น5 หรือ 10 วินาที-$0.056/run
Wan-3.0 Image-to-videoพรอมต์ + เฟรมเริ่มต้น + เฟรมสิ้นสุด (ไม่บังคับ)2 ถึง 30 วินาที√$0.05/second
MiniMax H3 Image-to-Videoพรอมต์ + เฟรมเริ่มต้น + เฟรมสิ้นสุด (ไม่บังคับ)4 ถึง 15 วินาที√$0.038/second

วิธีใช้ Kling 1.6 บน Atlas Cloud

เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud

สร้างบัญชี Atlas Cloud

สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล

ทำไมต้องใช้ Kling 1.6 บน Atlas Cloud

การรวมโมเดล Kling 1.6 ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้

ประสิทธิภาพและความยืดหยุ่น

เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์

API แบบรวมศูนย์:
รัน Kling 1.6, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว

ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless

องค์กรและขนาด

ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต

ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม

ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา

คำถามเกี่ยวกับ Kling 1.6 API สำหรับนักพัฒนา

Kling 1.6 คือชุดโมเดลสร้างวิดีโอที่พัฒนาโดย Kuaishou บน Atlas Cloud รองรับการสร้างวิดีโอจากข้อความ จากภาพเดียว และจากหลายภาพ ผ่าน endpoint ระดับ Standard และ Pro ทั้งหมดห้าแบบ แต่ละรุ่นมีจุดเด่นด้านการเคลื่อนไหวที่เสถียร การทำความเข้าใจพรอมต์ การผสานการเคลื่อนไหวที่ลื่นไหลยิ่งขึ้น ความสมจริงของพื้นผิว และความสอดคล้องของหลายวัตถุในฉาก

เปลี่ยนพรอมต์ข้อความให้เป็นฉากวิดีโอต้นฉบับ ทำให้ภาพเริ่มต้นภาพเดียวเคลื่อนไหว หรือรวมภาพอ้างอิงหลายภาพเข้ากับองค์ประกอบที่มีหลายวัตถุ ทั้งนี้ขึ้นอยู่กับ endpoint ที่ใช้ คุณสามารถสร้างคลิปความยาว 5 หรือ 10 วินาทีได้

เลือก T2V Standard สำหรับการสร้างวิดีโอจากข้อความ และ I2V Standard สำหรับการทำภาพเดียวให้เคลื่อนไหวโดยคุ้มค่าใช้จ่าย I2V Pro ให้ความสำคัญกับการผสานการเคลื่อนไหวที่ลื่นไหลยิ่งขึ้นและพื้นผิวที่สมจริงกว่า หากมีหลายวัตถุหรือภาพอ้างอิงหลายภาพ ให้เลือก Multi I2V Standard หรือ Multi I2V Pro ตามข้อกำหนดด้านค่าใช้จ่ายและความสอดคล้องของคุณ

สร้าง API key ในแดชบอร์ด Atlas Cloud จากนั้นส่งคำขอ JSON ไปยัง POST /api/v1/model/generateVideo พร้อม Bearer token ของคุณ ระบุรหัสโมเดลที่ถูกต้อง พรอมต์ และภาพที่จำเป็นสำหรับ endpoint ที่ใช้ภาพเป็นอินพุต บันทึก prediction ID ที่ได้รับกลับมา แล้วใช้ ID ดังกล่าวเพื่อดึงผลลัพธ์แบบอะซิงโครนัส

ทุก endpoint ต้องระบุรหัสโมเดลและพรอมต์ที่มีความยาวไม่เกิน 2,500 อักขระ การสร้างวิดีโอจากข้อความรองรับอัตราส่วนภาพ ระยะเวลา guidance scale และ negative prompt ส่วน endpoint ที่ใช้ภาพเดียวต้องมีภาพเริ่มต้นรูปแบบ JPG, JPEG หรือ PNG endpoint ที่ใช้หลายภาพรองรับภาพอ้างอิง 1 ถึง 4 ภาพ และมีตัวควบคุมระยะเวลา อัตราส่วนภาพ และ negative prompt เช่นกัน

Endpoint ทั้งห้าของ Atlas Cloud รองรับการสร้างวิดีโอความยาว 5 หรือ 10 วินาที โดยมีค่าเริ่มต้นตามเอกสารคือ 5 วินาที endpoint สำหรับสร้างวิดีโอจากข้อความและหลายภาพรองรับ 16:9, 9:16 หรือ 1:1 ส่วนเวิร์กโฟลว์ที่ใช้ภาพเดียวจะกำหนดกรอบภาพจากภาพต้นฉบับที่ส่งมา แทนที่จะเปิดให้ระบุพารามิเตอร์อัตราส่วนภาพแบบเดียวกัน

ตามราคามาตรฐาน T2V Standard, I2V Standard และ Multi I2V Standard มีค่าใช้จ่าย $0.056 ต่อวินาทีของวิดีโอที่สร้าง ส่วน I2V Pro และ Multi I2V Pro มีค่าใช้จ่าย $0.098 ต่อวินาทีของวิดีโอที่สร้าง โดยคิดค่าบริการตามการใช้งานจริง

เริ่มจากตรวจสอบ Bearer token, รหัสโมเดลที่ถูกต้อง พรอมต์ที่จำเป็น และฟิลด์ภาพที่จำเป็น ตรวจสอบความยาวพรอมต์ รูปแบบภาพ ขนาดไฟล์ ความละเอียด ระยะเวลา และช่วงค่าพารามิเตอร์ตามเอกสารก่อนส่งคำขอที่ไม่ถูกต้องอีกครั้ง เนื่องจากการสร้างวิดีโอเป็นกระบวนการแบบอะซิงโครนัส ให้เก็บ prediction ID ไว้และเรียก endpoint ผลลัพธ์ต่อไปตราบใดที่สถานะยังเป็น processing

สำรวจกลุ่มเพิ่มเติม

Seedance 2.5

Seedance 2.5 API พร้อมใช้งานแล้วบน Atlas Cloud! มอบโมเดลวิดีโอใหม่ล่าสุดของ ByteDance ให้กับนักพัฒนา สร้างวิดีโอเนทีฟได้นานถึง 30 วินาทีในการประมวลผลเพียงครั้งเดียวจากข้อความ รูปภาพเดียว หรือการอ้างอิงหลายรูปแบบสูงสุด 50 รายการ พร้อมเสียงที่ซิงโครไนซ์และข้อความหลายภาษาในเฟรม บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว โดยมีความสอดคล้องของวัตถุและระบบฟิสิกส์ที่ได้รับการปรับปรุงซึ่งช่วยให้ภาพระยะยาวมีความต่อเนื่อง

ดูกลุ่ม

Wan 3.0

Wan 3.0 API คือเจเนอเรชันถัดไปของตระกูลวิดีโอ Wan จาก Alibaba ซึ่งสร้างขึ้นเพื่อยกระดับการสร้างวิดีโอแบบยาว การควบคุมแบบหลายข้อมูลอ้างอิง และคุณภาพของภาพและเสียงให้ก้าวไปอีกขั้น Atlas Cloud ได้โฮสต์ Wan 2.7, 2.6 และ 2.5 ไว้แล้ว และ Wan 3.0 สามารถทำงานบนคีย์แบบรวมเดียวกันโดยไม่ต้องตั้งค่าแยกต่างหาก เริ่มต้นสร้างสรรค์ได้ตั้งแต่วันนี้ เลื่อนลงไปที่ส่วนจัดแสดงเพื่อดูว่า Wan 3.0 สามารถสร้างอะไรได้บ้าง

ดูกลุ่ม

MiniMax H3

MiniMax H3 คือผลิตภัณฑ์วิดีโอแบบมัลติโมดัลของ MiniMax สำหรับการสร้างสรรค์โดยใช้ข้อความ รูปภาพ และข้อมูลอ้างอิง ในเส้นทาง API ที่รองรับ ระบบจะคงลักษณะของวัตถุจากสื่ออ้างอิงไว้ มีอัตราส่วนภาพที่ยืดหยุ่น และจับคู่เสียงที่สร้างขึ้นกับภาพผ่าน H3 Developer โดยโปรไฟล์เอาต์พุตจะถูกเลือกตาม endpoint Atlas Cloud รวมผลิตภัณฑ์ในตระกูลนี้ไว้เบื้องหลังคีย์เดียวที่รองรับ OpenAI พร้อมการคิดค่าบริการตามการใช้งานอย่างโปร่งใส เริ่มต้นที่อัตรามาตรฐาน $0.038 ต่อวินาที เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

Seedream 5.0 Pro

Seedream 5.0 Pro API มอบโมเดลการแก้ไขภาพที่ควบคุมได้ของ ByteDance บน Atlas Cloud ให้กับนักพัฒนา โดยจะวางการแก้ไขอย่างแม่นยำด้วยจุดยึดและพิกัด แยกภาพออกเป็นเลเยอร์ที่แก้ไขได้ ผสานข้อมูลอ้างอิงหลายรายการ และจับคู่สีและวัสดุที่แน่นอน พร้อมข้อความหลายภาษาที่ความละเอียด 2K และ 3K บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว!

ดูกลุ่ม

Seedance 2.0

Seedance 2.0 คือโมเดลวิดีโอสำหรับการใช้งานจริงของ ByteDance ที่ออกแบบมาเพื่อสร้างช็อตได้อย่างแม่นยำ เปลี่ยนพรอมป์ต์เป็นวิดีโอ ทำให้ภาพเฟรมแรกเคลื่อนไหวโดยมีตัวเลือกให้ใช้คำแนะนำจากเฟรมสุดท้าย หรือปรับแต่งผลลัพธ์ด้วยสื่ออ้างอิงและการค้นหาเว็บแบบเลือกใช้ได้ Atlas Cloud รวมเวิร์กโฟลว์เหล่านี้ไว้ใน API เดียว พร้อมการคิดค่าบริการตามการใช้งานจริงอย่างโปร่งใสและคีย์เดียวที่เข้ากันได้กับ OpenAI เริ่มสร้างสรรค์ได้วันนี้

ดูกลุ่ม

GPT Image 2.5

ตระกูล gpt-image-2.5 จาก OpenAI มอบทางเลือก Flare และ Sunburst ให้แก่นักพัฒนาสำหรับกระบวนการทำงานด้านการสร้างภาพเพื่อใช้งานจริง เรนเดอร์ด้วยความละเอียดตามต้องการสูงสุด 3840x2160 และเลือกได้จากระดับคุณภาพ 5 ระดับ รวมถึง xhigh และ max เพื่อให้ตรงตามข้อกำหนดของเอาต์พุตแต่ละแบบ Atlas Cloud ให้บริการอนุมานผ่าน REST ที่พร้อมใช้งาน โดยไม่มี cold start และคิดค่าบริการตามมาตรฐานเริ่มต้นที่ $0.004 ต่อการสร้างภาพ เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

GPT Image 2

GPT Image 2 API ช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลรูปภาพล่าสุดของ OpenAI ซึ่งเป็นรุ่นสืบทอดจาก GPT Image 1.5 โดยสามารถสร้างและแก้ไขรูปภาพพร้อมกับการเรนเดอร์ข้อความที่แม่นยำทั้งในอักษรละตินและ CJK รวมถึงการจัดวางองค์ประกอบที่ยอดเยี่ยมสำหรับโปสเตอร์ ม็อกอัป และอินโฟกราฟิก บน Atlas Cloud คุณสามารถเข้าถึงโมเดลนี้ผ่าน API ที่เป็นหนึ่งเดียวร่วมกับโมเดลอื่นๆ อีกกว่า 300 รุ่น พร้อมเครดิตฟรี เวลาทำงาน 99.99% และไม่จำเป็นต้องมีการตรวจสอบยืนยันองค์กรจาก OpenAI

ดูกลุ่ม

Gemini Omni Flash

API ของ gemini omni นำตระกูล Gemini Omni Flash แบบมัลติโมดัลโดยกำเนิดจาก Google DeepMind ซึ่งรวมถึง Gemini Omni 1.1 Flash มาสู่นักพัฒนา สร้างวิดีโอสไตล์ภาพยนตร์พร้อมเสียงเนทีฟที่ซิงโครไนซ์กัน ทำให้ภาพนิ่งเคลื่อนไหวได้ด้วยการควบคุมเฟรมเริ่มต้นและเฟรมสิ้นสุดอย่างแม่นยำ หรือปรับแก้ฟุตเทจที่มีอยู่ผ่านการแก้ไขด้วยคำสั่งข้อความ โดยยังคงรักษาเนื้อหาที่ไม่ได้แก้ไขไว้ Atlas Cloud มอบคีย์เดียวที่เข้ากันได้กับ OpenAI การเข้าถึงแบบรวมศูนย์ และราคาที่โปร่งใสโดยคิดค่าบริการตามการใช้งาน เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

Grok Imagine

Grok Imagine API ครอบคลุมโมเดลรูปภาพ วิดีโอ และพูดของ xAI ตั้งแต่ Image 2.0 ถึง Video 1.5 และ xAI TTS v1 สร้างรูปภาพนิ่ง 1K หรือ 2K ในอัตราส่วน 14 แบบ ขยายฉากไปยัง 15 วินาทีของวิดีโอ 1080p ควบคุมภาพด้วยรูปภาพอ้างอิงได้ถึง 7 รูป หรือเพิ่มบรรยายเสียงในภาษา 20 ภาษา Atlas Cloud รันทุกโหมดบนเอนด์พอยต์เดียว มีราคาแบบจ่ายตามการใช้งาน ตั้งแต่ $0.02 ต่อรูปภาพและ $0.05 ต่อวินาที เริ่มสร้างวันนี้

ดูกลุ่ม

Google

โมเดลเชิงสร้างสรรค์ที่ทรงพลังที่สุดของ Google พร้อมใช้งานแล้วบน Atlas Cloud โดย Veo 3.1 นำเสนอการสร้างวิดีโอระดับภาพยนตร์ Nano Banana 2 ขับเคลื่อนการสร้างภาพที่มีความเที่ยงตรงสูง และ Gemini นำความชาญฉลาดแบบมัลติโมดัลมาสู่ทุกเวิร์กโฟลว์ เข้าถึงชุดโมเดลของ Google เต็มรูปแบบผ่าน API key เดียวพร้อมความพร้อมใช้งานระดับ Day-0 และการกำหนดราคาแบบจ่ายตามการใช้งาน (pay-as-you-go)

ดูกลุ่ม

Seedance 2.0 Mini

Seedance 2.0 Mini นำเสนอการสร้างวิดีโอแบบมัลติโมดัลของ ByteDance สู่เวิร์กโฟลว์ที่ความเร็วและต้นทุนมีความสำคัญสูงสุด โดยมอบความสามารถหลักของ Seedance 2.0 ในรูปแบบที่ใช้ทรัพยากรน้อยลง — สร้างได้เร็วกว่า ต้นทุนต่อวิดีโอต่ำกว่า และใช้การผสานรวม API เดิมที่คุณใช้อยู่แล้ว สำหรับทีมที่จัดการไปป์ไลน์ปริมาณมากหรือสร้างต้นแบบในสเกลขนาดใหญ่ Mini คือตัวเลือกเริ่มต้นที่ใช้งานได้จริง

ดูกลุ่ม

ByteDance

ตั้งแต่การสร้างวิดีโอระดับภาพยนตร์ไปจนถึงการสร้างภาพที่มีความละเอียดสูง โมเดลที่ทรงพลังที่สุดของ ByteDance พร้อมใช้งานแล้วบน Atlas Cloud รัน Seedance และ Seedream ในสเกลขนาดใหญ่ด้วยราคาการอนุมานที่ต่ำที่สุด และไม่มีค่าใช้จ่ายแฝงด้านโครงสร้างพื้นฐาน

ดูกลุ่ม

API เดียวสำหรับ AI สื่อทุกประเภท

สำรวจโมเดลทั้งหมด