Hero background 1Hero background 2Hero background 3

HappyHorse 1.1 Multi Image Video Generation

HappyHorse 1.1 คือกลุ่มโมเดลสร้างวิดีโอของ Alibaba สำหรับนักพัฒนาที่ทำงานจากข้อความ เฟรมต้นทาง หรือภาพอ้างอิง โดยเปลี่ยนพรอมป์ตให้เป็นคลิปวิดีโอ ทำให้เฟรมแรกที่เลือกเคลื่อนไหวได้พร้อมคำแนะนำเสริม และรองรับภาพอ้างอิงตั้งแต่หนึ่งถึงเก้าภาพเพื่อกำหนดทิศทางภาพได้อย่างแม่นยำ Atlas Cloud รวมเวิร์กโฟลว์เหล่านี้ไว้ในการผสานระบบเดียว พร้อมราคาแบบจ่ายตามการใช้งานที่โปร่งใส เริ่มสร้างสรรค์ได้วันนี้

Happyhorse 1.1 พัฒนาโดย Alibaba โดย Atlas Cloud (ดำเนินการโดย Atlas Cloud AI LLC) เป็นผู้ให้บริการเข้าถึงโมเดลนี้ แต่ไม่ได้เป็นเจ้าของโมเดล เครื่องหมายการค้าทั้งหมดเป็นของเจ้าของที่เกี่ยวข้อง

สำรวจโมเดลชั้นนำ

Atlas Cloud มอบโมเดลสร้างสรรค์ล่าสุดที่นำหน้าในอุตสาหกรรมให้กับคุณ

เปรียบเทียบโหมดการสร้างวิดีโอของ HappyHorse 1.1

เลือกอินพุตแบบข้อความ รูปภาพ หรือภาพอ้างอิงตามวิธีที่คุณต้องการกำหนดทิศทางของวิดีโอแต่ละรายการ

รูปแบบอินพุตคำอธิบาย
HappyHorse 1.1 T2V API (ข้อความเป็นวิดีโอ)แปลงพรอมต์ข้อความเป็นวิดีโอที่ความละเอียด 480P, 720P หรือ 1080P พร้อมอัตราส่วนภาพที่ยืดหยุ่นและระยะเวลาตั้งแต่ 3 ถึง 15 วินาที ใช้ endpoint นี้สำหรับสร้างภาพแนวคิด คอนเทนต์โซเชียล และการผลิตวิดีโอโดยไม่ต้องมีภาพต้นฉบับ
HappyHorse 1.1 I2V API (รูปภาพเป็นวิดีโอ)เริ่มต้นด้วยภาพเฟรมแรก แล้ว endpoint นี้จะสร้างวิดีโอความยาว 3 ถึง 15 วินาที พร้อมรองรับคำแนะนำจากพรอมต์และเอาต์พุตที่ความละเอียด 480P, 720P หรือ 1080P เหมาะสำหรับการทำภาพสินค้าให้เคลื่อนไหว การเคลื่อนไหวของตัวละคร และการเล่าเรื่องด้วยภาพที่สร้างจากองค์ประกอบภาพเดิม
HappyHorse 1.1 R2V API (ภาพอ้างอิงเป็นวิดีโอ)กำหนดทิศทางการสร้างวิดีโอด้วยภาพอ้างอิง 1 ถึง 9 ภาพร่วมกับพรอมต์ข้อความ โดยเลือกเอาต์พุตที่ความละเอียด 480P, 720P หรือ 1080P อัตราส่วนภาพที่ยืดหยุ่น และระยะเวลา 3 ถึง 15 วินาที เลือกใช้เมื่อสร้างฉากที่ยึดตามภาพอ้างอิง คลิปที่เน้นตัวละคร หรือโปรเจกต์ที่ต้องการการกำกับด้านภาพอย่างชัดเจนยิ่งขึ้น

ชุดเครื่องมือ HappyHorse 1.1 สำหรับอินพุตสามรูปแบบ

HappyHorse 1.1 แปลงพรอมต์ เฟรมแรก หรือภาพอ้างอิงสูงสุดเก้าภาพเป็นวิดีโอความยาว 3 ถึง 15 วินาที พร้อมเอาต์พุต 480P, 720P และ 1080P อัตราส่วนภาพเก้าแบบสำหรับโหมดข้อความและภาพอ้างอิง การควบคุม seed และการใช้งานแบบจ่ายตามจริงผ่าน Atlas Cloud

HappyHorse 1.1 การแปลงข้อความเป็นวิดีโอ

เริ่มต้นด้วยพรอมต์ข้อความความยาวสูงสุด 2,500 อักขระเพื่อสร้างคลิปสมบูรณ์โดยไม่ต้องใช้อินพุตภาพ HappyHorse 1.1 รองรับเอาต์พุต 480P, 720P หรือ 1080P และกำหนดระยะเวลาได้ตั้งแต่ 3 ถึง 15 วินาที เลือกอัตราส่วนภาพได้เก้าแบบสำหรับการนำเสนอแบบจอกว้าง แนวตั้ง สี่เหลี่ยมจัตุรัส แนวตั้งแบบพอร์ตเทรต หรืออัลตราไวด์ เวิร์กโฟลว์นี้เหมาะสำหรับการสร้างภาพแนวคิด โฆษณา และฉากเล่าเรื่องสั้น ๆ

การทำให้เฟรมแรกเคลื่อนไหว

เปลี่ยนภาพเฟรมแรกหนึ่งภาพให้กลายเป็นภาพเคลื่อนไหว พร้อมพรอมต์เสริมที่ช่วยกำกับการเคลื่อนไหว สไตล์ หรือรายละเอียดของฉาก image-to-video endpoint รองรับไฟล์ JPEG, JPG, PNG หรือ WEBP ขนาดสูงสุด 20 MB โดยทั้งสองมิติต้องมีอย่างน้อย 300 พิกเซล เลือก 480P, 720P หรือ 1080P และระยะเวลา 3 ถึง 15 วินาที เหมาะสำหรับภาพสินค้า ภาพพอร์ตเทรต และคีย์เฟรมจากสตอรีบอร์ด

การควบคุมด้วยภาพอ้างอิงของ HappyHorse 1.1

กำกับวิดีโอใหม่ด้วยภาพอ้างอิงตั้งแต่หนึ่งถึงเก้าภาพ พร้อมพรอมต์ข้อความที่จำเป็น ภาพอ้างอิง JPEG, JPG, PNG หรือ WEBP แต่ละภาพมีขนาดได้สูงสุด 20 MB และด้านที่สั้นกว่าต้องมีความยาวอย่างน้อย 400 พิกเซล กำหนดความละเอียด ระยะเวลา อัตราส่วนภาพ และ seed สำหรับเอาต์พุตได้ โหมดนี้ช่วยให้เวิร์กโฟลว์ด้านตัวละคร สินค้า และการกำกับศิลป์มีแหล่งข้อมูลสำหรับทำงานมากขึ้น

รูปแบบสำหรับทุกปลายทาง

กำหนดเฟรมให้เหมาะกับปลายทางของการสร้างวิดีโอจากข้อความหรือภาพอ้างอิงด้วยอัตราส่วนเก้าแบบ ได้แก่ 16:9, 9:16, 1:1, 4:3, 3:4, 4:5, 5:4, 9:21 และ 21:9 ความละเอียดครอบคลุม 480P, 720P และ 1080P ขณะที่ระยะเวลาอยู่ในช่วง 3 ถึง 15 วินาที ผสานการควบคุมเหล่านี้เพื่อสร้างคลิปสำหรับฟีดบนมือถือ เครื่องเล่นบนเว็บ พื้นที่จัดวางแบบสี่เหลี่ยมจัตุรัส ภาพพอร์ตเทรต หรือองค์ประกอบแบบอัลตราไวด์ได้โดยไม่ต้องเปลี่ยน endpoint

การควบคุม seed ของ HappyHorse 1.1

ใช้พารามิเตอร์ seed ร่วมกับการตั้งค่าพรอมต์ ความละเอียด อัตราส่วน และระยะเวลาเมื่อต้องการควบคุมอินพุตของการสร้างให้แม่นยำยิ่งขึ้น HappyHorse 1.1 รองรับค่า seed ตั้งแต่ -1 ถึง 2,147,483,647 โดย -1 จะขอให้สุ่ม seed รักษาการตั้งค่าอื่นให้ระบุไว้อย่างชัดเจนขณะทำซ้ำและปรับปรุง เวิร์กโฟลว์แบบกำหนดพารามิเตอร์นี้ช่วยให้นักพัฒนาจัดระเบียบการทดสอบเชิงสร้างสรรค์และเปรียบเทียบรูปแบบต่าง ๆ ด้วยโครงสร้างคำขอที่สอดคล้องกัน

คีย์เดียว สามเวิร์กโฟลว์

เข้าถึงเวิร์กโฟลว์ HappyHorse 1.1 ทั้งสามรูปแบบผ่าน Atlas Cloud ด้วยคีย์ที่เข้ากันได้กับ OpenAI เพียงหนึ่งคีย์และการเรียกเก็บเงินแบบจ่ายตามจริง ราคาเริ่มต้นมาตรฐานอยู่ที่ $0.07 ต่อวินาที และค่าใช้จ่ายจะเพิ่มตามการใช้งานแทนการสมัครสมาชิก สลับระหว่างเส้นทางโมเดล text-to-video, image-to-video และ reference-to-video ได้โดยใช้รูปแบบการผสานรวมเดิม การตั้งค่านี้เหมาะสำหรับนักพัฒนาที่สร้างผลิตภัณฑ์วิดีโอหลายโหมดโดยไม่ต้องมีบัญชีผู้ให้บริการแยกกัน

HappyHorse 1.1 ในการประชันพรอมต์ของสามโมเดล

ดูว่า HappyHorse 1.1 และโมเดลวิดีโออีกสองโมเดลที่เทียบเคียงกันตีความพรอมต์เดียวกันอย่างไร ทั้งในฉากแอ็กชันสไตล์ภาพยนตร์และการเล่าเรื่องแฟนตาซีเชิงศิลป์

พรอมต์

ซีเควนซ์ภาพยนตร์อาหารแบบต่อเนื่อง ความยาว 8–10 วินาที สมจริงราวภาพถ่าย ขณะอยู่บนตู้เสบียงที่กำลังแล่นฝ่าพายุหิมะรุนแรงบนเทือกเขาแอลป์ เชฟรถไฟผู้ชำนาญโอนเอนไปตามแรงเหวี่ยงซ้ายขวาอย่างเป็นธรรมชาติระหว่างทำอาหารเช้า เขาพลิกเครปบางสีทองขึ้นสูงด้วยมือข้างหนึ่ง จากนั้นไถลไปตามทางเดินแคบเพื่อคว้าส้มที่กำลังกลิ้งด้วยมืออีกข้าง แล้วใช้ขอบกระทะตีเครปที่กำลังร่วงลงมา ส่งให้ลอยเป็นวิถีโค้งสะอาดตาและสมจริงตามหลักฟิสิกส์ผ่านประตูเชื่อมระหว่างตู้รถไฟ เริ่มด้วยภาพโคลสอัปสุดขั้วที่ติดตามด้านข้างเตาไฟซึ่งกำลังลุกคำราม แป้งกำลังฉ่า และหยดเนยร้อนกระเซ็นบนเหล็กขัดเงา จากนั้นกวาดกล้องเข้าสู่การโคจรรอบตัวเชฟครึ่งวงอย่างรวดเร็ว ขณะที่เขาถ่ายน้ำหนักต้านแรงกระแทกทุกครั้ง เสื้อโค้ตและผ้ากันเปื้อนตอบสนองอย่างสมจริง แล้วพุ่งผ่านประตูด้วยภาพติดตามที่แม่นยำและล็อกอยู่กับเครปกลางอากาศ ขณะมันข้ามข้อต่อที่กำลังยืดหดเข้าสู่ตู้อาหารถัดไป เฉียดผ่านบริกรไปอย่างหวุดหวิด ก่อนตกลงบนจานอาหารเช้าของผู้โดยสารที่กำลังประหลาดใจได้พอดี ในจังหวะที่เครปลงจานพอดิบพอดี หิมะถล่มขนาดมหึมาพุ่งผ่านหน้าต่างด้านนอก ขณะที่รถไฟกำลังหนีออกมา สร้างจุดไคลแมกซ์ทางภาพที่คมชัด โคมไฟทังสเตนอุ่นและแสงไฟสีส้มปะทะกับแสงรุ่งสีน้ำเงินเย็นยะเยือกที่ส่องผ่านหน้าต่างซึ่งมีหิมะเกาะเป็นทาง โทนอาหารสีส้มทองหลายชั้น โลหะสีเงินเทา และผืนป่าสีน้ำเงินเย็น มุมมองตรงกลางที่ลึกและแคบ กรอบประตูซ้อนกรอบประตูซ้ำต่อเนื่อง พารัลแลกซ์เด่นชัด การสั่นไหวแบบถือกล้องเล็กน้อย ความคมชัดของการเคลื่อนไหวสูง ความต่อเนื่องของวัตถุและความสอดคล้องของพื้นที่อย่างไร้รอยต่อระหว่างตู้รถไฟทั้งสอง การทรงตัวที่สมจริง การกระเซ็นที่ลื่นไหล ความเฉื่อยของเนื้อผ้า การชน และฟิสิกส์ของวัตถุที่ถูกขว้าง ออกแบบเสียงให้ซิงก์กัน: เสียงล้อรถไฟกระทบรางและเสียงตู้รถไฟครางสร้างจังหวะหลัก เสียงกระทะฉ่าและเสียงเนยแตกเร่งจังหวะ ส้มกลิ้งสอดคล้องกับเสียงโลหะกระทบกัน การฟาดกระทะลงตรงกับจังหวะเพอร์คัสชันที่สดใส ตามด้วยเสียงเครปกระทบจานเบา ๆ และเสียงหิมะถล่มคำรามสนั่น ไม่มีภาพสโลว์โมชัน ไม่มีช่วงภาพนิ่งที่ไม่มีเนื้อหา ไม่มีหน้าจอ อินเทอร์เฟซ แดชบอร์ด แถบความคืบหน้า กราฟ คำบรรยาย ซับไตเติล โลโก้ หรือข้อความที่มองเห็นได้ ความสมจริงระดับภาพยนตร์พรีเมียม โฆษณาอาหารที่เต็มไปด้วยพลัง ภาพลวงตาแบบถ่ายเทกเดียวที่ดื่มด่ำ อัตราส่วนภาพ 16:9

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

พรอมต์

ซีเควนซ์แอ็กชันแอนิเมชัน 3D แบบกราฟิก สีอิ่มตัวสูง ความยาว 9 วินาที ณ ท่าเทียบตู้คอนเทนเนอร์ในช่วงพลบค่ำ เปียโนแกรนด์สีแดงปะการังหลุดออกจากที่ยึดและพุ่งลงมาตามทางลาดเหล็ก ล้อเล็กแบบลูกล้อสั่นกระแทกและเด้งตามน้ำหนักที่น่าเชื่อถือ ขณะที่คนขับรถยกในชุดหมีสีน้ำเงินโคบอลต์เร่งไล่ตาม ลัดเลาะผ่านเครนสีเหลืองมัสตาร์ดและตู้คอนเทนเนอร์ที่ยกขึ้นลงอยู่ตลอดเวลา จนเกิดเป็นทางฉุกเฉินที่เปลี่ยนรูปไปมา เริ่มด้วยภาพติดตามมุมต่ำสุดขั้ว ห่างจากล้อที่กำลังหมุนและขาเปียโนที่กระตุกอย่างรุนแรงเพียงไม่กี่เซนติเมตร ประกายไฟและเสียงโลหะกระแทกซิงก์กันอย่างสมบูรณ์ จากนั้นยกกล้องขึ้นอย่างรวดเร็วสู่ภาพมุมสูงจากด้านบน เผยเส้นทางไล่ล่าที่เป็นเขาวงกตเรขาคณิตของบล็อกสีแดงปะการัง สีน้ำเงินโคบอลต์ และสีเหลืองมัสตาร์ด แล้วแพนกล้องฉับพลันพร้อมโคจรไปยังด้านหน้าของรถยกที่กำลังเร่งความเร็ว ขณะที่มันไล่จี้เข้ามาใกล้ เมื่อถึงขอบท่า คนขับพุ่งงารถยกสอดเข้าใต้เปียโน ยกร่างหนักขึ้นในจังหวะสุดท้าย หมุนตัวด้วยแรงส่งเพียงครั้งเดียว และวางเปียโนลงอย่างมั่นคงพร้อมเสียงโลหะกระทบหนักที่ซิงก์กัน ฝาเปียโนดีดเปิดตามแรงเฉื่อย ในจังหวะสุดท้าย นกนางนวลบินลงเกาะบนแป้นคีย์และกดโน้ตสุดท้ายที่คมชัดหนึ่งตัว การเคลื่อนไหวต่อเนื่องความหนาแน่นสูง โมเมนตัม การชน การเด้งของระบบกันสะเทือน น้ำหนักบรรทุกที่เคลื่อนตัว และอัตลักษณ์ของตัวละครกับวัตถุมีความน่าเชื่อถือทางฟิสิกส์และคงที่ตลอดทั้งฉาก เงาคมจัด องค์ประกอบเรขาคณิตโดดเด่น แอนิเมชัน 3D เชิงภาพยนตร์แบบมีสไตล์ แสงริมขอบยามพลบค่ำคมชัด และจังหวะเพอร์คัสชันอุตสาหกรรมที่สร้างจากเสียงล้อกระทบพื้น เสียงไฮดรอลิกฟู่ เสียงตู้คอนเทนเนอร์กระแทก เสียงเครื่องยนต์ฝืนกำลัง เสียงปีกนกนางนวล และโน้ตเปียโนสุดท้าย ไม่มีภาพสโลว์โมชัน ไม่มีช็อตนิ่ง ไม่มีการตัดภาพที่ทำลายความต่อเนื่องของพื้นที่ ไม่มีหน้าจอ อินเทอร์เฟซซอฟต์แวร์ แดชบอร์ด แถบความคืบหน้า กราฟ คำบรรยาย ป้ายกำกับ โลโก้ ลายน้ำ หรือข้อความอธิบาย อัตราส่วนภาพ 16:9

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

HappyHorse 1.1 ในกระบวนการสร้างสรรค์ที่หลากหลาย

ตั้งแต่แนวคิดแคมเปญและแอนิเมชันผลิตภัณฑ์ ไปจนถึงวิดีโอแบรนด์ที่อิงภาพอ้างอิงและเครื่องมือสำหรับนักพัฒนา HappyHorse 1.1 เปลี่ยนพรอมต์และรูปภาพให้เป็นคอนเทนต์วิดีโอสั้นที่ปรับใช้ได้หลากหลาย

แนวคิดแคมเปญด้วย HappyHorse 1.1

เปลี่ยนแนวคิดที่เขียนไว้ให้เป็นวิดีโอที่ความละเอียด 480P, 720P หรือ 1080P พร้อมอัตราส่วนภาพที่ยืดหยุ่น ทีมครีเอทีฟสามารถสร้างแนวคิดแคมเปญ โพสต์โซเชียล และพิตช์เรื่องราวได้โดยไม่ต้องใช้ฟุตเทจต้นฉบับหรือถ่ายทำ

เปลี่ยนภาพนิ่งให้เคลื่อนไหว

เริ่มต้นด้วยภาพเฟรมแรก จากนั้นกำกับการเคลื่อนไหวด้วยพรอมต์เสริมที่เลือกใช้ได้ โดยกำหนดความยาวตั้งแต่ 3 ถึง 15 วินาที นักการตลาดผลิตภัณฑ์สามารถเปลี่ยนแอสเซ็ตภาพนิ่งให้เป็นคลิปเปิดตัว วิดีโอสำหรับดิสเพลย์ หรือสื่อเคลื่อนไหวสำหรับแคตตาล็อก

สร้างรูปแบบแบรนด์โดยอิงภาพอ้างอิง

ใช้ภาพอ้างอิงตั้งแต่ 1 ถึง 9 ภาพ เพื่อให้โมเดลสร้างวิดีโอโดยยึดตามอินพุตภาพที่กำหนดที่ความละเอียดสูงสุด 1080P ทีมแบรนด์สามารถพัฒนารูปแบบแคมเปญต่าง ๆ โดยอิงภาพตัวละคร ผลิตภัณฑ์ หรือสภาพแวดล้อมที่ผ่านการอนุมัติแล้ว

ไปป์ไลน์คอนเทนต์หลายรูปแบบ

เลือกอัตราส่วนภาพที่ยืดหยุ่นและระดับความละเอียด 3 ระดับ เพื่อเตรียมคลิปสำหรับตำแหน่งการแสดงผลที่แตกต่างกันจากเวิร์กโฟลว์การสร้างเดียว นักพัฒนาสามารถรองรับเลย์เอาต์แนวตั้ง แนวนอน และรูปแบบอื่น ๆ ในผลิตภัณฑ์คอนเทนต์และแคมเปญต่าง ๆ

วางแผนคลิปด้วย HappyHorse 1.1

ต้องการจังหวะสตอรีบอร์ดแบบรวดเร็วหรือช่วงนำเสนอผลิตภัณฑ์ที่ยาวขึ้นใช่ไหม ระยะเวลาตั้งแต่ 3 ถึง 15 วินาทีช่วยให้เครื่องมือครีเอทีฟรองรับแนวคิดเร่งด่วน คลิปโปรโมต และลำดับภาพสั้นกระชับได้ภายในอินเทอร์เฟซเดียว

อินพุตที่ยืดหยุ่นสำหรับแอปวิดีโอ

สร้างแอปพลิเคชันวิดีโอโดยรองรับอินพุตแบบข้อความ ภาพเฟรมแรก และภาพอ้างอิงหลายภาพผ่านโมเดลตระกูลเดียว ผู้ใช้สามารถเลือกสื่อเริ่มต้นที่เหมาะกับการคิดไอเดีย การทำแอนิเมชัน หรือการสร้างคอนเทนต์ที่กำกับด้วยแบรนด์สำหรับแต่ละเวิร์กโฟลว์

HappyHorse 1.1 โดดเด่นเพียงใดสำหรับการสร้างวิดีโอ

เปรียบเทียบโหมดการสร้างของ HappyHorse 1.1 กับโมเดลวิดีโอของ Atlas Cloud ชั้นนำในด้านอินพุตที่รองรับ ระยะเวลาคลิป ความละเอียด จำนวนอินพุตอ้างอิงสูงสุด และราคาพื้นฐานที่ระบุ

โมเดลอินพุตที่รองรับระยะเวลาผลลัพธ์ความละเอียดจำนวนภาพอ้างอิงสูงสุดราคาพื้นฐานที่ระบุ
HappyHorse-1.1 Text-to-videoพรอมต์ข้อความ3 ถึง 15 วินาที480P, 720P, 1080P-$0.07 ไม่ได้ระบุหน่วย
HappyHorse-1.1 Image-to-videoภาพเฟรมแรกและพรอมต์เสริม (ถ้ามี)3 ถึง 15 วินาที480P, 720P, 1080P-$0.07 ไม่ได้ระบุหน่วย
HappyHorse-1.1 Reference-to-videoพรอมต์ข้อความและภาพอ้างอิง3 ถึง 15 วินาที480P, 720P, 1080P9$0.07 ไม่ได้ระบุหน่วย
Wan-3.0 Reference-to-videoข้อมูลอ้างอิงที่เป็นข้อความ ภาพ วิดีโอ เสียง เอกสาร หรือเว็บเพจ2 ถึง 30 วินาที หรือระยะเวลาอัจฉริยะ480P, 720P, 1080P10$0.05 ไม่ได้ระบุหน่วย
Seedance 2.5 Reference-to-Videoข้อมูลอ้างอิงที่เป็นข้อความ ภาพ วิดีโอ และเสียงสูงสุด 30 วินาที-30$0.167 ไม่ได้ระบุหน่วย
MiniMax H3 Reference-to-Videoข้อมูลอ้างอิงที่เป็นข้อความ ภาพ วิดีโอ และเสียง4 ถึง 15 วินาที768p เป็นค่าเริ่มต้น สูงสุด 2K9$0.038/วินาที

วิธีใช้ Happyhorse 1.1 บน Atlas Cloud

เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud

สร้างบัญชี Atlas Cloud

สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล

ทำไมต้องใช้ Happyhorse 1.1 บน Atlas Cloud

การรวมโมเดล Happyhorse 1.1 ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้

ประสิทธิภาพและความยืดหยุ่น

เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์

API แบบรวมศูนย์:
รัน Happyhorse 1.1, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว

ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless

องค์กรและขนาด

ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต

ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม

ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา

การพัฒนาด้วย HappyHorse 1.1: คำถามที่พบบ่อย

HappyHorse 1.1 คือโมเดลสร้างวิดีโอของ Alibaba ที่ให้บริการบน Atlas Cloud สำหรับเปลี่ยนข้อความ เฟรมแรก หรือภาพอ้างอิงให้เป็นคลิปวิดีโอสั้น ๆ โดยในตระกูลนี้มี endpoint แยกสำหรับ text-to-video, image-to-video และ reference-to-video

คุณสามารถสร้างฉากจาก prompt ข้อความ ทำให้ภาพนิ่งเคลื่อนไหว หรือใช้ภาพอ้างอิงหลายภาพเพื่อกำกับคลิปใหม่ได้ เวิร์กโฟลว์เหล่านี้ครอบคลุมวิดีโอที่สร้างจาก prompt เพียงอย่างเดียว แอนิเมชันจากเฟรมแรก และเนื้อหาที่กำกับด้วยภาพอ้างอิง

สร้างคีย์ Atlas Cloud API แล้วส่งคำขอ POST ที่ผ่านการยืนยันตัวตนไปยัง /api/v1/model/generateVideo พร้อมระบุ ID ของโมเดลที่เลือกและข้อมูลนำเข้าที่จำเป็น การตอบกลับจะมี task ID ซึ่งคุณสามารถใช้ตรวจสอบสถานะการคาดการณ์จนกว่าผลลัพธ์จะพร้อมใช้งาน

เลือก alibaba/happyhorse-1.1/text-to-video สำหรับการสร้างจาก prompt, alibaba/happyhorse-1.1/image-to-video สำหรับทำแอนิเมชันจากเฟรมแรก หรือ alibaba/happyhorse-1.1/reference-to-video สำหรับการกำกับด้วยภาพหลายภาพ แต่ละโหมดมี schema ของข้อมูลนำเข้าเป็นของตัวเอง

สำหรับ text-to-video และ reference-to-video คุณสามารถเลือก 480p, 720p หรือ 1080p ระยะเวลาตั้งแต่ 3 ถึง 15 วินาที และหนึ่งในอัตราส่วนภาพที่รองรับ 9 แบบ ส่วน image-to-video รองรับช่วงความละเอียดและระยะเวลาเดียวกัน โดยใช้ภาพที่อัปโหลดเป็นเฟรมแรก

Reference-to-video รองรับ URL ของภาพตั้งแต่ 1 ถึง 9 ภาพ พร้อม prompt ที่อธิบายว่าควรใช้ภาพเหล่านั้นเพื่อกำกับผลลัพธ์อย่างไร รองรับไฟล์ JPEG, JPG, PNG และ WEBP โดยจำกัดขนาดภาพละ 20 MB และด้านที่สั้นกว่าต้องมีความยาวอย่างน้อย 400 พิกเซล

Atlas Cloud ระบุราคามาตรฐานที่ $0.07 ต่อวินาทีสำหรับทั้ง 3 endpoint ของ HappyHorse 1.1 ระบบคิดค่าบริการตามการใช้งาน ดังนั้นค่าใช้จ่ายในการสร้างจะเพิ่มขึ้นตามระยะเวลาคลิปที่ร้องขอ

ใช้พารามิเตอร์ seed กับ text-to-video หรือ reference-to-video เมื่อต้องการควบคุมความสุ่มของการสร้าง Atlas Cloud รองรับค่าจำนวนเต็มที่ระบุเอง หรือใช้ -1 หากต้องการให้ระบบสุ่ม seed

แต่ละคำขอจะสร้างคลิปที่มีระยะเวลาระหว่าง 3 ถึง 15 วินาที โดย image-to-video ใช้ภาพเฟรมแรก 1 ภาพ ส่วน reference-to-video รองรับภาพอ้างอิงได้ไม่เกิน 9 ภาพ

สำรวจกลุ่มเพิ่มเติม

Seedance 2.5

Seedance 2.5 API พร้อมใช้งานแล้วบน Atlas Cloud! มอบโมเดลวิดีโอใหม่ล่าสุดของ ByteDance ให้กับนักพัฒนา สร้างวิดีโอเนทีฟได้นานถึง 30 วินาทีในการประมวลผลเพียงครั้งเดียวจากข้อความ รูปภาพเดียว หรือการอ้างอิงหลายรูปแบบสูงสุด 50 รายการ พร้อมเสียงที่ซิงโครไนซ์และข้อความหลายภาษาในเฟรม บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว โดยมีความสอดคล้องของวัตถุและระบบฟิสิกส์ที่ได้รับการปรับปรุงซึ่งช่วยให้ภาพระยะยาวมีความต่อเนื่อง

ดูกลุ่ม

Wan 3.0

Wan 3.0 API คือเจเนอเรชันถัดไปของตระกูลวิดีโอ Wan จาก Alibaba ซึ่งสร้างขึ้นเพื่อยกระดับการสร้างวิดีโอแบบยาว การควบคุมแบบหลายข้อมูลอ้างอิง และคุณภาพของภาพและเสียงให้ก้าวไปอีกขั้น Atlas Cloud ได้โฮสต์ Wan 2.7, 2.6 และ 2.5 ไว้แล้ว และ Wan 3.0 สามารถทำงานบนคีย์แบบรวมเดียวกันโดยไม่ต้องตั้งค่าแยกต่างหาก เริ่มต้นสร้างสรรค์ได้ตั้งแต่วันนี้ เลื่อนลงไปที่ส่วนจัดแสดงเพื่อดูว่า Wan 3.0 สามารถสร้างอะไรได้บ้าง

ดูกลุ่ม

MiniMax H3

MiniMax H3 คือผลิตภัณฑ์วิดีโอแบบมัลติโมดัลของ MiniMax สำหรับการสร้างสรรค์โดยใช้ข้อความ รูปภาพ และข้อมูลอ้างอิง ในเส้นทาง API ที่รองรับ ระบบจะคงลักษณะของวัตถุจากสื่ออ้างอิงไว้ มีอัตราส่วนภาพที่ยืดหยุ่น และจับคู่เสียงที่สร้างขึ้นกับภาพผ่าน H3 Developer โดยโปรไฟล์เอาต์พุตจะถูกเลือกตาม endpoint Atlas Cloud รวมผลิตภัณฑ์ในตระกูลนี้ไว้เบื้องหลังคีย์เดียวที่รองรับ OpenAI พร้อมการคิดค่าบริการตามการใช้งานอย่างโปร่งใส เริ่มต้นที่อัตรามาตรฐาน $0.038 ต่อวินาที เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

Seedream 5.0 Pro

Seedream 5.0 Pro API มอบโมเดลการแก้ไขภาพที่ควบคุมได้ของ ByteDance บน Atlas Cloud ให้กับนักพัฒนา โดยจะวางการแก้ไขอย่างแม่นยำด้วยจุดยึดและพิกัด แยกภาพออกเป็นเลเยอร์ที่แก้ไขได้ ผสานข้อมูลอ้างอิงหลายรายการ และจับคู่สีและวัสดุที่แน่นอน พร้อมข้อความหลายภาษาที่ความละเอียด 2K และ 3K บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว!

ดูกลุ่ม

Seedance 2.0

Seedance 2.0 คือโมเดลวิดีโอสำหรับการใช้งานจริงของ ByteDance ที่ออกแบบมาเพื่อสร้างช็อตได้อย่างแม่นยำ เปลี่ยนพรอมป์ต์เป็นวิดีโอ ทำให้ภาพเฟรมแรกเคลื่อนไหวโดยมีตัวเลือกให้ใช้คำแนะนำจากเฟรมสุดท้าย หรือปรับแต่งผลลัพธ์ด้วยสื่ออ้างอิงและการค้นหาเว็บแบบเลือกใช้ได้ Atlas Cloud รวมเวิร์กโฟลว์เหล่านี้ไว้ใน API เดียว พร้อมการคิดค่าบริการตามการใช้งานจริงอย่างโปร่งใสและคีย์เดียวที่เข้ากันได้กับ OpenAI เริ่มสร้างสรรค์ได้วันนี้

ดูกลุ่ม

GPT Image 2.5

ตระกูล gpt-image-2.5 จาก OpenAI มอบทางเลือก Flare และ Sunburst ให้แก่นักพัฒนาสำหรับกระบวนการทำงานด้านการสร้างภาพเพื่อใช้งานจริง เรนเดอร์ด้วยความละเอียดตามต้องการสูงสุด 3840x2160 และเลือกได้จากระดับคุณภาพ 5 ระดับ รวมถึง xhigh และ max เพื่อให้ตรงตามข้อกำหนดของเอาต์พุตแต่ละแบบ Atlas Cloud ให้บริการอนุมานผ่าน REST ที่พร้อมใช้งาน โดยไม่มี cold start และคิดค่าบริการตามมาตรฐานเริ่มต้นที่ $0.004 ต่อการสร้างภาพ เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

GPT Image 2

GPT Image 2 API ช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลรูปภาพล่าสุดของ OpenAI ซึ่งเป็นรุ่นสืบทอดจาก GPT Image 1.5 โดยสามารถสร้างและแก้ไขรูปภาพพร้อมกับการเรนเดอร์ข้อความที่แม่นยำทั้งในอักษรละตินและ CJK รวมถึงการจัดวางองค์ประกอบที่ยอดเยี่ยมสำหรับโปสเตอร์ ม็อกอัป และอินโฟกราฟิก บน Atlas Cloud คุณสามารถเข้าถึงโมเดลนี้ผ่าน API ที่เป็นหนึ่งเดียวร่วมกับโมเดลอื่นๆ อีกกว่า 300 รุ่น พร้อมเครดิตฟรี เวลาทำงาน 99.99% และไม่จำเป็นต้องมีการตรวจสอบยืนยันองค์กรจาก OpenAI

ดูกลุ่ม

Gemini Omni Flash

Gemini Omni คือชุดโมเดลวิดีโอแบบมัลติโมดัลโดยกำเนิดจาก Google DeepMind สำหรับการสร้างและตัดต่อวิดีโอตามพรอมต์ สร้างวิดีโอจากข้อความ ทำให้ภาพนิ่งเคลื่อนไหว หรือปรับแก้ฟุตเทจเดิมด้วยภาพอ้างอิงเสริมได้ โดยคงเนื้อหาที่ไม่ได้เลือกแก้ไขไว้ตามเดิม การควบคุมความละเอียด อัตราส่วนภาพ และระยะเวลาอย่างยืดหยุ่นรองรับเวิร์กโฟลว์การผลิตที่หลากหลาย Atlas Cloud รวมการเข้าถึงไว้ในที่เดียว พร้อมการคิดค่าบริการแบบจ่ายตามการใช้งานอย่างโปร่งใส เริ่มสร้างสรรค์ได้แล้ววันนี้

ดูกลุ่ม

Grok Imagine

Grok Imagine API ครอบคลุมโมเดลรูปภาพ วิดีโอ และพูดของ xAI ตั้งแต่ Image 2.0 ถึง Video 1.5 และ xAI TTS v1 สร้างรูปภาพนิ่ง 1K หรือ 2K ในอัตราส่วน 14 แบบ ขยายฉากไปยัง 15 วินาทีของวิดีโอ 1080p ควบคุมภาพด้วยรูปภาพอ้างอิงได้ถึง 7 รูป หรือเพิ่มบรรยายเสียงในภาษา 20 ภาษา Atlas Cloud รันทุกโหมดบนเอนด์พอยต์เดียว มีราคาแบบจ่ายตามการใช้งาน ตั้งแต่ $0.02 ต่อรูปภาพและ $0.05 ต่อวินาที เริ่มสร้างวันนี้

ดูกลุ่ม

Google

โมเดลเชิงสร้างสรรค์ที่ทรงพลังที่สุดของ Google พร้อมใช้งานแล้วบน Atlas Cloud โดย Veo 3.1 นำเสนอการสร้างวิดีโอระดับภาพยนตร์ Nano Banana 2 ขับเคลื่อนการสร้างภาพที่มีความเที่ยงตรงสูง และ Gemini นำความชาญฉลาดแบบมัลติโมดัลมาสู่ทุกเวิร์กโฟลว์ เข้าถึงชุดโมเดลของ Google เต็มรูปแบบผ่าน API key เดียวพร้อมความพร้อมใช้งานระดับ Day-0 และการกำหนดราคาแบบจ่ายตามการใช้งาน (pay-as-you-go)

ดูกลุ่ม

Seedance 2.0 Mini

Seedance 2.0 Mini นำเสนอการสร้างวิดีโอแบบมัลติโมดัลของ ByteDance สู่เวิร์กโฟลว์ที่ความเร็วและต้นทุนมีความสำคัญสูงสุด โดยมอบความสามารถหลักของ Seedance 2.0 ในรูปแบบที่ใช้ทรัพยากรน้อยลง — สร้างได้เร็วกว่า ต้นทุนต่อวิดีโอต่ำกว่า และใช้การผสานรวม API เดิมที่คุณใช้อยู่แล้ว สำหรับทีมที่จัดการไปป์ไลน์ปริมาณมากหรือสร้างต้นแบบในสเกลขนาดใหญ่ Mini คือตัวเลือกเริ่มต้นที่ใช้งานได้จริง

ดูกลุ่ม

ByteDance

ตั้งแต่การสร้างวิดีโอระดับภาพยนตร์ไปจนถึงการสร้างภาพที่มีความละเอียดสูง โมเดลที่ทรงพลังที่สุดของ ByteDance พร้อมใช้งานแล้วบน Atlas Cloud รัน Seedance และ Seedream ในสเกลขนาดใหญ่ด้วยราคาการอนุมานที่ต่ำที่สุด และไม่มีค่าใช้จ่ายแฝงด้านโครงสร้างพื้นฐาน

ดูกลุ่ม

API เดียวสำหรับ AI สื่อทุกประเภท

สำรวจโมเดลทั้งหมด