


HappyHorse 1.1 คือกลุ่มโมเดลสร้างวิดีโอของ Alibaba สำหรับนักพัฒนาที่ทำงานจากข้อความ เฟรมต้นทาง หรือภาพอ้างอิง โดยเปลี่ยนพรอมป์ตให้เป็นคลิปวิดีโอ ทำให้เฟรมแรกที่เลือกเคลื่อนไหวได้พร้อมคำแนะนำเสริม และรองรับภาพอ้างอิงตั้งแต่หนึ่งถึงเก้าภาพเพื่อกำหนดทิศทางภาพได้อย่างแม่นยำ Atlas Cloud รวมเวิร์กโฟลว์เหล่านี้ไว้ในการผสานระบบเดียว พร้อมราคาแบบจ่ายตามการใช้งานที่โปร่งใส เริ่มสร้างสรรค์ได้วันนี้
Happyhorse 1.1 พัฒนาโดย Alibaba โดย Atlas Cloud (ดำเนินการโดย Atlas Cloud AI LLC) เป็นผู้ให้บริการเข้าถึงโมเดลนี้ แต่ไม่ได้เป็นเจ้าของโมเดล เครื่องหมายการค้าทั้งหมดเป็นของเจ้าของที่เกี่ยวข้อง
Atlas Cloud มอบโมเดลสร้างสรรค์ล่าสุดที่นำหน้าในอุตสาหกรรมให้กับคุณ
เลือกอินพุตแบบข้อความ รูปภาพ หรือภาพอ้างอิงตามวิธีที่คุณต้องการกำหนดทิศทางของวิดีโอแต่ละรายการ
| รูปแบบอินพุต | คำอธิบาย |
|---|---|
| HappyHorse 1.1 T2V API (ข้อความเป็นวิดีโอ) | แปลงพรอมต์ข้อความเป็นวิดีโอที่ความละเอียด 480P, 720P หรือ 1080P พร้อมอัตราส่วนภาพที่ยืดหยุ่นและระยะเวลาตั้งแต่ 3 ถึง 15 วินาที ใช้ endpoint นี้สำหรับสร้างภาพแนวคิด คอนเทนต์โซเชียล และการผลิตวิดีโอโดยไม่ต้องมีภาพต้นฉบับ |
| HappyHorse 1.1 I2V API (รูปภาพเป็นวิดีโอ) | เริ่มต้นด้วยภาพเฟรมแรก แล้ว endpoint นี้จะสร้างวิดีโอความยาว 3 ถึง 15 วินาที พร้อมรองรับคำแนะนำจากพรอมต์และเอาต์พุตที่ความละเอียด 480P, 720P หรือ 1080P เหมาะสำหรับการทำภาพสินค้าให้เคลื่อนไหว การเคลื่อนไหวของตัวละคร และการเล่าเรื่องด้วยภาพที่สร้างจากองค์ประกอบภาพเดิม |
| HappyHorse 1.1 R2V API (ภาพอ้างอิงเป็นวิดีโอ) | กำหนดทิศทางการสร้างวิดีโอด้วยภาพอ้างอิง 1 ถึง 9 ภาพร่วมกับพรอมต์ข้อความ โดยเลือกเอาต์พุตที่ความละเอียด 480P, 720P หรือ 1080P อัตราส่วนภาพที่ยืดหยุ่น และระยะเวลา 3 ถึง 15 วินาที เลือกใช้เมื่อสร้างฉากที่ยึดตามภาพอ้างอิง คลิปที่เน้นตัวละคร หรือโปรเจกต์ที่ต้องการการกำกับด้านภาพอย่างชัดเจนยิ่งขึ้น |
HappyHorse 1.1 แปลงพรอมต์ เฟรมแรก หรือภาพอ้างอิงสูงสุดเก้าภาพเป็นวิดีโอความยาว 3 ถึง 15 วินาที พร้อมเอาต์พุต 480P, 720P และ 1080P อัตราส่วนภาพเก้าแบบสำหรับโหมดข้อความและภาพอ้างอิง การควบคุม seed และการใช้งานแบบจ่ายตามจริงผ่าน Atlas Cloud
เริ่มต้นด้วยพรอมต์ข้อความความยาวสูงสุด 2,500 อักขระเพื่อสร้างคลิปสมบูรณ์โดยไม่ต้องใช้อินพุตภาพ HappyHorse 1.1 รองรับเอาต์พุต 480P, 720P หรือ 1080P และกำหนดระยะเวลาได้ตั้งแต่ 3 ถึง 15 วินาที เลือกอัตราส่วนภาพได้เก้าแบบสำหรับการนำเสนอแบบจอกว้าง แนวตั้ง สี่เหลี่ยมจัตุรัส แนวตั้งแบบพอร์ตเทรต หรืออัลตราไวด์ เวิร์กโฟลว์นี้เหมาะสำหรับการสร้างภาพแนวคิด โฆษณา และฉากเล่าเรื่องสั้น ๆ
เปลี่ยนภาพเฟรมแรกหนึ่งภาพให้กลายเป็นภาพเคลื่อนไหว พร้อมพรอมต์เสริมที่ช่วยกำกับการเคลื่อนไหว สไตล์ หรือรายละเอียดของฉาก image-to-video endpoint รองรับไฟล์ JPEG, JPG, PNG หรือ WEBP ขนาดสูงสุด 20 MB โดยทั้งสองมิติต้องมีอย่างน้อย 300 พิกเซล เลือก 480P, 720P หรือ 1080P และระยะเวลา 3 ถึง 15 วินาที เหมาะสำหรับภาพสินค้า ภาพพอร์ตเทรต และคีย์เฟรมจากสตอรีบอร์ด
กำกับวิดีโอใหม่ด้วยภาพอ้างอิงตั้งแต่หนึ่งถึงเก้าภาพ พร้อมพรอมต์ข้อความที่จำเป็น ภาพอ้างอิง JPEG, JPG, PNG หรือ WEBP แต่ละภาพมีขนาดได้สูงสุด 20 MB และด้านที่สั้นกว่าต้องมีความยาวอย่างน้อย 400 พิกเซล กำหนดความละเอียด ระยะเวลา อัตราส่วนภาพ และ seed สำหรับเอาต์พุตได้ โหมดนี้ช่วยให้เวิร์กโฟลว์ด้านตัวละคร สินค้า และการกำกับศิลป์มีแหล่งข้อมูลสำหรับทำงานมากขึ้น
กำหนดเฟรมให้เหมาะกับปลายทางของการสร้างวิดีโอจากข้อความหรือภาพอ้างอิงด้วยอัตราส่วนเก้าแบบ ได้แก่ 16:9, 9:16, 1:1, 4:3, 3:4, 4:5, 5:4, 9:21 และ 21:9 ความละเอียดครอบคลุม 480P, 720P และ 1080P ขณะที่ระยะเวลาอยู่ในช่วง 3 ถึง 15 วินาที ผสานการควบคุมเหล่านี้เพื่อสร้างคลิปสำหรับฟีดบนมือถือ เครื่องเล่นบนเว็บ พื้นที่จัดวางแบบสี่เหลี่ยมจัตุรัส ภาพพอร์ตเทรต หรือองค์ประกอบแบบอัลตราไวด์ได้โดยไม่ต้องเปลี่ยน endpoint
ใช้พารามิเตอร์ seed ร่วมกับการตั้งค่าพรอมต์ ความละเอียด อัตราส่วน และระยะเวลาเมื่อต้องการควบคุมอินพุตของการสร้างให้แม่นยำยิ่งขึ้น HappyHorse 1.1 รองรับค่า seed ตั้งแต่ -1 ถึง 2,147,483,647 โดย -1 จะขอให้สุ่ม seed รักษาการตั้งค่าอื่นให้ระบุไว้อย่างชัดเจนขณะทำซ้ำและปรับปรุง เวิร์กโฟลว์แบบกำหนดพารามิเตอร์นี้ช่วยให้นักพัฒนาจัดระเบียบการทดสอบเชิงสร้างสรรค์และเปรียบเทียบรูปแบบต่าง ๆ ด้วยโครงสร้างคำขอที่สอดคล้องกัน
เข้าถึงเวิร์กโฟลว์ HappyHorse 1.1 ทั้งสามรูปแบบผ่าน Atlas Cloud ด้วยคีย์ที่เข้ากันได้กับ OpenAI เพียงหนึ่งคีย์และการเรียกเก็บเงินแบบจ่ายตามจริง ราคาเริ่มต้นมาตรฐานอยู่ที่ $0.07 ต่อวินาที และค่าใช้จ่ายจะเพิ่มตามการใช้งานแทนการสมัครสมาชิก สลับระหว่างเส้นทางโมเดล text-to-video, image-to-video และ reference-to-video ได้โดยใช้รูปแบบการผสานรวมเดิม การตั้งค่านี้เหมาะสำหรับนักพัฒนาที่สร้างผลิตภัณฑ์วิดีโอหลายโหมดโดยไม่ต้องมีบัญชีผู้ให้บริการแยกกัน
ดูว่า HappyHorse 1.1 และโมเดลวิดีโออีกสองโมเดลที่เทียบเคียงกันตีความพรอมต์เดียวกันอย่างไร ทั้งในฉากแอ็กชันสไตล์ภาพยนตร์และการเล่าเรื่องแฟนตาซีเชิงศิลป์
ซีเควนซ์ภาพยนตร์อาหารแบบต่อเนื่อง ความยาว 8–10 วินาที สมจริงราวภาพถ่าย ขณะอยู่บนตู้เสบียงที่กำลังแล่นฝ่าพายุหิมะรุนแรงบนเทือกเขาแอลป์ เชฟรถไฟผู้ชำนาญโอนเอนไปตามแรงเหวี่ยงซ้ายขวาอย่างเป็นธรรมชาติระหว่างทำอาหารเช้า เขาพลิกเครปบางสีทองขึ้นสูงด้วยมือข้างหนึ่ง จากนั้นไถลไปตามทางเดินแคบเพื่อคว้าส้มที่กำลังกลิ้งด้วยมืออีกข้าง แล้วใช้ขอบกระทะตีเครปที่กำลังร่วงลงมา ส่งให้ลอยเป็นวิถีโค้งสะอาดตาและสมจริงตามหลักฟิสิกส์ผ่านประตูเชื่อมระหว่างตู้รถไฟ เริ่มด้วยภาพโคลสอัปสุดขั้วที่ติดตามด้านข้างเตาไฟซึ่งกำลังลุกคำราม แป้งกำลังฉ่า และหยดเนยร้อนกระเซ็นบนเหล็กขัดเงา จากนั้นกวาดกล้องเข้าสู่การโคจรรอบตัวเชฟครึ่งวงอย่างรวดเร็ว ขณะที่เขาถ่ายน้ำหนักต้านแรงกระแทกทุกครั้ง เสื้อโค้ตและผ้ากันเปื้อนตอบสนองอย่างสมจริง แล้วพุ่งผ่านประตูด้วยภาพติดตามที่แม่นยำและล็อกอยู่กับเครปกลางอากาศ ขณะมันข้ามข้อต่อที่กำลังยืดหดเข้าสู่ตู้อาหารถัดไป เฉียดผ่านบริกรไปอย่างหวุดหวิด ก่อนตกลงบนจานอาหารเช้าของผู้โดยสารที่กำลังประหลาดใจได้พอดี ในจังหวะที่เครปลงจานพอดิบพอดี หิมะถล่มขนาดมหึมาพุ่งผ่านหน้าต่างด้านนอก ขณะที่รถไฟกำลังหนีออกมา สร้างจุดไคลแมกซ์ทางภาพที่คมชัด โคมไฟทังสเตนอุ่นและแสงไฟสีส้มปะทะกับแสงรุ่งสีน้ำเงินเย็นยะเยือกที่ส่องผ่านหน้าต่างซึ่งมีหิมะเกาะเป็นทาง โทนอาหารสีส้มทองหลายชั้น โลหะสีเงินเทา และผืนป่าสีน้ำเงินเย็น มุมมองตรงกลางที่ลึกและแคบ กรอบประตูซ้อนกรอบประตูซ้ำต่อเนื่อง พารัลแลกซ์เด่นชัด การสั่นไหวแบบถือกล้องเล็กน้อย ความคมชัดของการเคลื่อนไหวสูง ความต่อเนื่องของวัตถุและความสอดคล้องของพื้นที่อย่างไร้รอยต่อระหว่างตู้รถไฟทั้งสอง การทรงตัวที่สมจริง การกระเซ็นที่ลื่นไหล ความเฉื่อยของเนื้อผ้า การชน และฟิสิกส์ของวัตถุที่ถูกขว้าง ออกแบบเสียงให้ซิงก์กัน: เสียงล้อรถไฟกระทบรางและเสียงตู้รถไฟครางสร้างจังหวะหลัก เสียงกระทะฉ่าและเสียงเนยแตกเร่งจังหวะ ส้มกลิ้งสอดคล้องกับเสียงโลหะกระทบกัน การฟาดกระทะลงตรงกับจังหวะเพอร์คัสชันที่สดใส ตามด้วยเสียงเครปกระทบจานเบา ๆ และเสียงหิมะถล่มคำรามสนั่น ไม่มีภาพสโลว์โมชัน ไม่มีช่วงภาพนิ่งที่ไม่มีเนื้อหา ไม่มีหน้าจอ อินเทอร์เฟซ แดชบอร์ด แถบความคืบหน้า กราฟ คำบรรยาย ซับไตเติล โลโก้ หรือข้อความที่มองเห็นได้ ความสมจริงระดับภาพยนตร์พรีเมียม โฆษณาอาหารที่เต็มไปด้วยพลัง ภาพลวงตาแบบถ่ายเทกเดียวที่ดื่มด่ำ อัตราส่วนภาพ 16:9
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
ซีเควนซ์แอ็กชันแอนิเมชัน 3D แบบกราฟิก สีอิ่มตัวสูง ความยาว 9 วินาที ณ ท่าเทียบตู้คอนเทนเนอร์ในช่วงพลบค่ำ เปียโนแกรนด์สีแดงปะการังหลุดออกจากที่ยึดและพุ่งลงมาตามทางลาดเหล็ก ล้อเล็กแบบลูกล้อสั่นกระแทกและเด้งตามน้ำหนักที่น่าเชื่อถือ ขณะที่คนขับรถยกในชุดหมีสีน้ำเงินโคบอลต์เร่งไล่ตาม ลัดเลาะผ่านเครนสีเหลืองมัสตาร์ดและตู้คอนเทนเนอร์ที่ยกขึ้นลงอยู่ตลอดเวลา จนเกิดเป็นทางฉุกเฉินที่เปลี่ยนรูปไปมา เริ่มด้วยภาพติดตามมุมต่ำสุดขั้ว ห่างจากล้อที่กำลังหมุนและขาเปียโนที่กระตุกอย่างรุนแรงเพียงไม่กี่เซนติเมตร ประกายไฟและเสียงโลหะกระแทกซิงก์กันอย่างสมบูรณ์ จากนั้นยกกล้องขึ้นอย่างรวดเร็วสู่ภาพมุมสูงจากด้านบน เผยเส้นทางไล่ล่าที่เป็นเขาวงกตเรขาคณิตของบล็อกสีแดงปะการัง สีน้ำเงินโคบอลต์ และสีเหลืองมัสตาร์ด แล้วแพนกล้องฉับพลันพร้อมโคจรไปยังด้านหน้าของรถยกที่กำลังเร่งความเร็ว ขณะที่มันไล่จี้เข้ามาใกล้ เมื่อถึงขอบท่า คนขับพุ่งงารถยกสอดเข้าใต้เปียโน ยกร่างหนักขึ้นในจังหวะสุดท้าย หมุนตัวด้วยแรงส่งเพียงครั้งเดียว และวางเปียโนลงอย่างมั่นคงพร้อมเสียงโลหะกระทบหนักที่ซิงก์กัน ฝาเปียโนดีดเปิดตามแรงเฉื่อย ในจังหวะสุดท้าย นกนางนวลบินลงเกาะบนแป้นคีย์และกดโน้ตสุดท้ายที่คมชัดหนึ่งตัว การเคลื่อนไหวต่อเนื่องความหนาแน่นสูง โมเมนตัม การชน การเด้งของระบบกันสะเทือน น้ำหนักบรรทุกที่เคลื่อนตัว และอัตลักษณ์ของตัวละครกับวัตถุมีความน่าเชื่อถือทางฟิสิกส์และคงที่ตลอดทั้งฉาก เงาคมจัด องค์ประกอบเรขาคณิตโดดเด่น แอนิเมชัน 3D เชิงภาพยนตร์แบบมีสไตล์ แสงริมขอบยามพลบค่ำคมชัด และจังหวะเพอร์คัสชันอุตสาหกรรมที่สร้างจากเสียงล้อกระทบพื้น เสียงไฮดรอลิกฟู่ เสียงตู้คอนเทนเนอร์กระแทก เสียงเครื่องยนต์ฝืนกำลัง เสียงปีกนกนางนวล และโน้ตเปียโนสุดท้าย ไม่มีภาพสโลว์โมชัน ไม่มีช็อตนิ่ง ไม่มีการตัดภาพที่ทำลายความต่อเนื่องของพื้นที่ ไม่มีหน้าจอ อินเทอร์เฟซซอฟต์แวร์ แดชบอร์ด แถบความคืบหน้า กราฟ คำบรรยาย ป้ายกำกับ โลโก้ ลายน้ำ หรือข้อความอธิบาย อัตราส่วนภาพ 16:9
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
ตั้งแต่แนวคิดแคมเปญและแอนิเมชันผลิตภัณฑ์ ไปจนถึงวิดีโอแบรนด์ที่อิงภาพอ้างอิงและเครื่องมือสำหรับนักพัฒนา HappyHorse 1.1 เปลี่ยนพรอมต์และรูปภาพให้เป็นคอนเทนต์วิดีโอสั้นที่ปรับใช้ได้หลากหลาย
เปลี่ยนแนวคิดที่เขียนไว้ให้เป็นวิดีโอที่ความละเอียด 480P, 720P หรือ 1080P พร้อมอัตราส่วนภาพที่ยืดหยุ่น ทีมครีเอทีฟสามารถสร้างแนวคิดแคมเปญ โพสต์โซเชียล และพิตช์เรื่องราวได้โดยไม่ต้องใช้ฟุตเทจต้นฉบับหรือถ่ายทำ
เริ่มต้นด้วยภาพเฟรมแรก จากนั้นกำกับการเคลื่อนไหวด้วยพรอมต์เสริมที่เลือกใช้ได้ โดยกำหนดความยาวตั้งแต่ 3 ถึง 15 วินาที นักการตลาดผลิตภัณฑ์สามารถเปลี่ยนแอสเซ็ตภาพนิ่งให้เป็นคลิปเปิดตัว วิดีโอสำหรับดิสเพลย์ หรือสื่อเคลื่อนไหวสำหรับแคตตาล็อก
ใช้ภาพอ้างอิงตั้งแต่ 1 ถึง 9 ภาพ เพื่อให้โมเดลสร้างวิดีโอโดยยึดตามอินพุตภาพที่กำหนดที่ความละเอียดสูงสุด 1080P ทีมแบรนด์สามารถพัฒนารูปแบบแคมเปญต่าง ๆ โดยอิงภาพตัวละคร ผลิตภัณฑ์ หรือสภาพแวดล้อมที่ผ่านการอนุมัติแล้ว
เลือกอัตราส่วนภาพที่ยืดหยุ่นและระดับความละเอียด 3 ระดับ เพื่อเตรียมคลิปสำหรับตำแหน่งการแสดงผลที่แตกต่างกันจากเวิร์กโฟลว์การสร้างเดียว นักพัฒนาสามารถรองรับเลย์เอาต์แนวตั้ง แนวนอน และรูปแบบอื่น ๆ ในผลิตภัณฑ์คอนเทนต์และแคมเปญต่าง ๆ
ต้องการจังหวะสตอรีบอร์ดแบบรวดเร็วหรือช่วงนำเสนอผลิตภัณฑ์ที่ยาวขึ้นใช่ไหม ระยะเวลาตั้งแต่ 3 ถึง 15 วินาทีช่วยให้เครื่องมือครีเอทีฟรองรับแนวคิดเร่งด่วน คลิปโปรโมต และลำดับภาพสั้นกระชับได้ภายในอินเทอร์เฟซเดียว
สร้างแอปพลิเคชันวิดีโอโดยรองรับอินพุตแบบข้อความ ภาพเฟรมแรก และภาพอ้างอิงหลายภาพผ่านโมเดลตระกูลเดียว ผู้ใช้สามารถเลือกสื่อเริ่มต้นที่เหมาะกับการคิดไอเดีย การทำแอนิเมชัน หรือการสร้างคอนเทนต์ที่กำกับด้วยแบรนด์สำหรับแต่ละเวิร์กโฟลว์
เปรียบเทียบโหมดการสร้างของ HappyHorse 1.1 กับโมเดลวิดีโอของ Atlas Cloud ชั้นนำในด้านอินพุตที่รองรับ ระยะเวลาคลิป ความละเอียด จำนวนอินพุตอ้างอิงสูงสุด และราคาพื้นฐานที่ระบุ
| โมเดล | อินพุตที่รองรับ | ระยะเวลาผลลัพธ์ | ความละเอียด | จำนวนภาพอ้างอิงสูงสุด | ราคาพื้นฐานที่ระบุ |
|---|---|---|---|---|---|
| HappyHorse-1.1 Text-to-video | พรอมต์ข้อความ | 3 ถึง 15 วินาที | 480P, 720P, 1080P | - | $0.07 ไม่ได้ระบุหน่วย |
| HappyHorse-1.1 Image-to-video | ภาพเฟรมแรกและพรอมต์เสริม (ถ้ามี) | 3 ถึง 15 วินาที | 480P, 720P, 1080P | - | $0.07 ไม่ได้ระบุหน่วย |
| HappyHorse-1.1 Reference-to-video | พรอมต์ข้อความและภาพอ้างอิง | 3 ถึง 15 วินาที | 480P, 720P, 1080P | 9 | $0.07 ไม่ได้ระบุหน่วย |
| Wan-3.0 Reference-to-video | ข้อมูลอ้างอิงที่เป็นข้อความ ภาพ วิดีโอ เสียง เอกสาร หรือเว็บเพจ | 2 ถึง 30 วินาที หรือระยะเวลาอัจฉริยะ | 480P, 720P, 1080P | 10 | $0.05 ไม่ได้ระบุหน่วย |
| Seedance 2.5 Reference-to-Video | ข้อมูลอ้างอิงที่เป็นข้อความ ภาพ วิดีโอ และเสียง | สูงสุด 30 วินาที | - | 30 | $0.167 ไม่ได้ระบุหน่วย |
| MiniMax H3 Reference-to-Video | ข้อมูลอ้างอิงที่เป็นข้อความ ภาพ วิดีโอ และเสียง | 4 ถึง 15 วินาที | 768p เป็นค่าเริ่มต้น สูงสุด 2K | 9 | $0.038/วินาที |
เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud
สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล
การรวมโมเดล Happyhorse 1.1 ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้
เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์
API แบบรวมศูนย์:
รัน Happyhorse 1.1, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว
ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless
ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต
ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม
ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา
HappyHorse 1.1 คือโมเดลสร้างวิดีโอของ Alibaba ที่ให้บริการบน Atlas Cloud สำหรับเปลี่ยนข้อความ เฟรมแรก หรือภาพอ้างอิงให้เป็นคลิปวิดีโอสั้น ๆ โดยในตระกูลนี้มี endpoint แยกสำหรับ text-to-video, image-to-video และ reference-to-video
คุณสามารถสร้างฉากจาก prompt ข้อความ ทำให้ภาพนิ่งเคลื่อนไหว หรือใช้ภาพอ้างอิงหลายภาพเพื่อกำกับคลิปใหม่ได้ เวิร์กโฟลว์เหล่านี้ครอบคลุมวิดีโอที่สร้างจาก prompt เพียงอย่างเดียว แอนิเมชันจากเฟรมแรก และเนื้อหาที่กำกับด้วยภาพอ้างอิง
สร้างคีย์ Atlas Cloud API แล้วส่งคำขอ POST ที่ผ่านการยืนยันตัวตนไปยัง /api/v1/model/generateVideo พร้อมระบุ ID ของโมเดลที่เลือกและข้อมูลนำเข้าที่จำเป็น การตอบกลับจะมี task ID ซึ่งคุณสามารถใช้ตรวจสอบสถานะการคาดการณ์จนกว่าผลลัพธ์จะพร้อมใช้งาน
เลือก alibaba/happyhorse-1.1/text-to-video สำหรับการสร้างจาก prompt, alibaba/happyhorse-1.1/image-to-video สำหรับทำแอนิเมชันจากเฟรมแรก หรือ alibaba/happyhorse-1.1/reference-to-video สำหรับการกำกับด้วยภาพหลายภาพ แต่ละโหมดมี schema ของข้อมูลนำเข้าเป็นของตัวเอง
สำหรับ text-to-video และ reference-to-video คุณสามารถเลือก 480p, 720p หรือ 1080p ระยะเวลาตั้งแต่ 3 ถึง 15 วินาที และหนึ่งในอัตราส่วนภาพที่รองรับ 9 แบบ ส่วน image-to-video รองรับช่วงความละเอียดและระยะเวลาเดียวกัน โดยใช้ภาพที่อัปโหลดเป็นเฟรมแรก
Reference-to-video รองรับ URL ของภาพตั้งแต่ 1 ถึง 9 ภาพ พร้อม prompt ที่อธิบายว่าควรใช้ภาพเหล่านั้นเพื่อกำกับผลลัพธ์อย่างไร รองรับไฟล์ JPEG, JPG, PNG และ WEBP โดยจำกัดขนาดภาพละ 20 MB และด้านที่สั้นกว่าต้องมีความยาวอย่างน้อย 400 พิกเซล
Atlas Cloud ระบุราคามาตรฐานที่ $0.07 ต่อวินาทีสำหรับทั้ง 3 endpoint ของ HappyHorse 1.1 ระบบคิดค่าบริการตามการใช้งาน ดังนั้นค่าใช้จ่ายในการสร้างจะเพิ่มขึ้นตามระยะเวลาคลิปที่ร้องขอ
ใช้พารามิเตอร์ seed กับ text-to-video หรือ reference-to-video เมื่อต้องการควบคุมความสุ่มของการสร้าง Atlas Cloud รองรับค่าจำนวนเต็มที่ระบุเอง หรือใช้ -1 หากต้องการให้ระบบสุ่ม seed
แต่ละคำขอจะสร้างคลิปที่มีระยะเวลาระหว่าง 3 ถึง 15 วินาที โดย image-to-video ใช้ภาพเฟรมแรก 1 ภาพ ส่วน reference-to-video รองรับภาพอ้างอิงได้ไม่เกิน 9 ภาพ
คู่มือ บทแนะนำ และอัปเดตผลิตภัณฑ์ ที่ช่วยให้คุณใช้ Atlas Cloud ได้อย่างเต็มประสิทธิภาพ