
LTX-2 API นำตระกูลวิดีโอแบบ open-weight ของ Lightricks มาใช้งานในระดับโปรดักชัน โดยสร้างวิดีโอและเสียงที่ซิงก์กันได้ใน pass เดียว สั่งงานจากข้อความ, ทำให้ภาพนิ่งเคลื่อนไหว หรือขยายคลิปที่มีอยู่ และทุกผลลัพธ์จะมาพร้อม lip sync, foley และเสียงบรรยากาศที่เข้ากัน บน Atlas Cloud คุณเข้าถึงได้ผ่านคีย์ที่เข้ากันได้กับ OpenAI เพียงคีย์เดียว พร้อมราคาจ่ายตามการใช้งานจริงที่โปร่งใส และสิทธิ์เข้าถึง Day-0 เริ่มสร้างได้วันนี้
Atlas Cloud มอบโมเดลสร้างสรรค์ล่าสุดที่นำหน้าในอุตสาหกรรมให้กับคุณ
เปรียบเทียบทุก modality ของ Ltx-2 API ในมุมมองเดียว ตั้งแต่การสร้างจาก prompt ไปจนถึงการทำให้ภาพนิ่งเคลื่อนไหวและการต่อคลิปที่มีอยู่ พร้อมตัวเลือกเสียงที่ซิงโครไนซ์
| Modality | คำอธิบาย |
|---|---|
| Ltx-2 T2V API (ข้อความเป็นวิดีโอ) | ป้อน prompt ข้อความได้สูงสุด 2,000 ตัวอักษร แล้ว Ltx-2 API จะส่งคืนวิดีโอที่เรนเดอร์เสร็จสมบูรณ์ พร้อมเสียงที่ซิงโครไนซ์เป็นตัวเลือกเมื่อเปิดใช้ generate_audio ความยาวคลิปปรับได้ตั้งแต่ 25 ถึง 257 frames และมี preset ความละเอียด 6 แบบ ครอบคลุมเอาต์พุตแบบจัตุรัส แนวตั้ง 9:16 และแนวนอน 16:9 endpoint นี้เหมาะสำหรับคอนเซ็ปต์โฆษณา วิดีโอสั้นสำหรับโซเชียล และพรีวิว storyboard ที่สร้างจากคำอธิบายเป็นลายลักษณ์อักษรทั้งหมด โดยคิดราคาที่อัตราฐานมาตรฐาน $0.002 |
| Ltx-2 I2V API (รูปภาพเป็นวิดีโอ) | ส่งภาพนิ่งในรูปแบบ jpg, png, webp, gif หรือ avif พร้อม motion prompt แล้ว endpoint นี้จะทำให้ภาพเคลื่อนไหวเป็นคลิปวิดีโอ พร้อมตัวเลือกการสร้างเสียง ช่วง 25 ถึง 257 frames และ preset อัตราส่วนภาพ 6 แบบยังคงเหมือนเดิม ดังนั้นเฟรมต้นฉบับเพียงเฟรมเดียวจึงกลายเป็นวิดีโอแนวนอนหรือแนวตั้งได้ ภาพสินค้า ภาพพอร์ตเทรตตัวละคร และคอนเซ็ปต์อาร์ตล้วนเป็นอินพุตที่เหมาะสม ทั้งหมดคิดราคาฐานมาตรฐาน $0.002 |
| Ltx-2 Extend Video API | เมื่อคลิปที่มีอยู่ต้องการความยาวเพิ่มเติม endpoint นี้จะต่อคลิปไปข้างหน้าหรือย้อนกลับจากแหล่งที่มา mp4, mov, webm, m4v หรือ gif ที่ส่งเข้ามาได้ รองรับการขยายซีเควนซ์ได้สูงสุด 481 frames รักษาจังหวะเดิมผ่าน match_input_fps และสามารถใส่เสียงที่สร้างขึ้นซ้อนเข้าไปได้ เหมาะสำหรับการเพิ่มความยาว b-roll ทำฉากวนซ้ำ หรือเชื่อมต่อระหว่างคัต โดยคิดราคาที่อัตราฐานเดียวกัน $0.002 |
Ltx-2 API ผสานโหมดการสร้างจากข้อความ รูปภาพ และการต่อขยายเข้ากับเสียงที่ซิงก์กันแบบเนทีฟ ควบคุมจำนวนเฟรมได้ และมีพรีเซ็ตอัตราส่วนภาพ 6 แบบ ทั้งหมดเรียกใช้ได้ผ่านคีย์เดียวที่เข้ากันได้กับ OpenAI พร้อมราคาจ่ายตามการใช้งานจริงที่โปร่งใส
บรรยายฉากได้สูงสุด 2,000 ตัวอักษร แล้ว Ltx-2 API จะเปลี่ยนข้อความล้วนให้เป็นคลิปที่เคลื่อนไหวและมีเสียง โดยไม่ต้องใช้แอสเซ็ตอ้างอิง พรอมป์ของคุณควบคุมตัวแบบ การเคลื่อนไหว แสง และพฤติกรรมของกล้อง ขณะที่ seed แบบไม่บังคับช่วยล็อกผลลัพธ์เพื่อการทำซ้ำและปรับแต่งได้อย่างสม่ำเสมอ เพราะทุกอย่างเริ่มจากภาษา จึงเหมาะกับการทำสตอรีบอร์ด การนำเสนอคอนเซปต์ และการสำรวจไอเดียอย่างรวดเร็วเมื่อคุณมีไอเดียแต่ยังไม่มีฟุตเทจ
ป้อนภาพนิ่งเพียงภาพเดียวในรูปแบบ jpg, png, webp, gif หรือ avif แล้วโมเดลจะทำให้ภาพนั้นเคลื่อนไหวเป็นวิดีโอพร้อมเสียงที่เข้ากัน พรอมป์จะกำหนดว่าภาพควรเคลื่อนไหวอย่างไร ตั้งแต่การค่อย ๆ push-in ไปจนถึงจังหวะแอ็กชันเต็มรูปแบบ โดยที่องค์ประกอบเดิมยังคงอยู่ ช่างภาพ นักออกแบบ และทีมผลิตภัณฑ์ใช้วิธีนี้เพื่อเปลี่ยนภาพ hero เพียงภาพเดียวให้กลายเป็นคอนเทนต์เคลื่อนไหวที่แชร์ได้ โดยไม่ต้องถ่ายใหม่
อัปโหลดคลิปที่มีอยู่ แล้ว Ltx-2 API จะสร้างต่อให้ทั้งไปข้างหน้าหรือย้อนกลับ โดยสร้างเฟรมเพิ่มเติมได้สูงสุด 481 เฟรมที่สืบทอดสไตล์และจังหวะจากต้นฉบับ ตัวเลือก match_input_fps ช่วยล็อกฟุตเทจใหม่ให้ตรงกับเฟรมเรตของแหล่งที่มา ทำให้รอยต่อดูแนบเนียน นี่คือวิธีเปลี่ยนเทคสั้นให้กลายเป็นซีเควนซ์ยาว และช่วยกู้ฉากที่จบเร็วไปเพียงจังหวะเดียว
ควบคุมจำนวนเฟรมได้เต็มที่ตั้งแต่ 25 ถึง 257 เฟรมในโหมดข้อความและรูปภาพ โดยตั้งค่าเป็นจำนวนที่เป็นผลคูณของแปดบวกหนึ่งเสมอเพื่อการ sampling ที่สะอาด พรีเซ็ตความละเอียด 6 แบบครอบคลุม HD แบบสี่เหลี่ยมจัตุรัสที่ 1024 by 1024, สี่เหลี่ยมจัตุรัส 512, แนวตั้ง 3:4, แนวตั้ง 9:16, แนวนอน 4:3 และแนวนอน 16:9 ทำให้โมเดลเดียวรองรับทั้งภาพยนตร์ โซเชียล และฟีดแนวตั้ง เลือกรูปทรงก่อน แล้วให้คำขอเดียวส่งคืนครอปที่ถูกต้อง
ทุกคำขอส่งผ่านคีย์เดียวที่เข้ากันได้กับ OpenAI บน Atlas Cloud พร้อมราคาจ่ายตามการใช้งานจริงที่โปร่งใสและไม่มีการสมัครสมาชิก ส่ง seed คงที่พร้อมพรอมป์เดิม แล้วโมเดลจะคืนคลิปเดิม ทำให้การสร้างที่เคยคาดเดายากกลายเป็นขั้นตอนที่ควบคุมและจัดเวอร์ชันได้ การเข้าถึงแบบ Day-0 หมายความว่า Ltx-2 API รุ่นใหม่จะเรียกใช้ได้ทันทีที่เปิดตัว ทีมจึงสามารถทำมาตรฐานให้กับ video pipeline และสเกลได้โดยไม่ต้องจัดการ GPUs
ส่งพรอมต์เดียวกันทุกประการไปยัง Ltx-2 API และโมเดลวิดีโอยอดนิยมอีกสองตัวบน Atlas Cloud จากนั้นเปรียบเทียบว่าแต่ละตัวจัดการการเคลื่อนไหว เสียงที่ซิงก์กัน และรายละเอียดแบบภาพยนตร์จากคำสั่งชุดเดียวกันอย่างไร
ลิงแสมขี้สงสัยตัวหนึ่งพุ่งลัดเลาะผ่านตลาดเครื่องเทศ Marrakech ที่แน่นขนัดในช่วง golden hour แล้วฉก fez สีแดงสดของพ่อค้าออกจากแผง มันกระโดดข้ามกระสอบ saffron และ paprika ที่เปิดอยู่จนฝุ่นสีส้มฟุ้งวนขึ้นมา จากนั้นหยุดนิ่งอยู่บนยอดเสา canopy แล้วเหลียวกลับมามองพอดีกับที่พ่อค้าหัวเราะพลางวิ่งไล่ตาม เปิดด้วยช็อต tracking มุมต่ำที่เคลื่อนตามหลังลิงฝ่าฝูงชน whip pan ไปยังใบหน้าตกใจของพ่อค้า แล้วค่อยยกขึ้นเป็นช็อต crane กวาดกว้างเหนือแผงค้าทั้งหมด ขณะที่ฝุ่นระยิบระยับในแสงอุ่น สไตล์ภาพยนตร์สมจริง ระยะชัดตื้น โทนสี earthy เข้มข้น Audio: เสียงตลาดคึกคัก เสียงทองเหลืองกระทบกัน และจังหวะกลองมือที่เร่งเร้าขึ้นพร้อมการไล่ล่า 16:9 aspect ratio.
Generated with Ltx 2.3 Quality on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Seedance 2.0 on Atlas Cloud
ผู้ส่งสารบนฟ้าวัยเยาว์ในผ้าคลุม crimson ที่พลิ้วไหว กระโจนออกจากขอบวิหารหินลอยฟ้า แล้วขี่นกกระเรียนกระดาษกลไกฝ่าหมู่เมฆในหุบเขา เลี้ยวหลบโคมไฟเรืองแสงที่ลอยอยู่ เธอเอียงตัวเลี้ยวแรงอ้อมยอดหินแหลม คว้าจดหมายระยิบระยับกลางอากาศ แล้วหุบตัวดิ่งลงอย่างชัน ขณะที่นักร่อนคู่แข่งทะลุหมอกตามมาติด ๆ เริ่มด้วยมุมมอง first-person POV เหนือไหล่ของเธอตอนนกกระเรียนทะยานขึ้น ตัดไปเป็นช็อต drone ที่พุ่งเคียงข้างการดิ่ง แล้วลดลงเป็นช็อตมุมต่ำเงยขึ้นเมื่อเธอเชิดตัวออกจากการดิ่งเข้าสู่แสงอาทิตย์จ้าจนตาพร่า สไตล์ anime สีสันสดใส แบบ cel-shaded พาเลต luminous magic-hour Audio: เสียงลมพุ่งผ่าน เสียงปีกกระดาษกระพือ และเสียงเครื่องสายออร์เคสตราที่พุ่งสูงอย่างยิ่งใหญ่ตรงจังหวะเชิดตัวขึ้น 16:9 aspect ratio.
Generated with Ltx 2.3 Quality on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Seedance 2.0 on Atlas Cloud
ตั้งแต่พรอมป์ข้อความและรูปภาพ ไปจนถึงคลิปยาวและเสียงที่ซิงค์กัน Ltx-2 API ครอบคลุมเส้นทางทั้งหมดตั้งแต่ร่างแรกจนถึงการส่งมอบ 4K สำหรับงานการตลาด อีคอมเมิร์ซ และโปรดักชันเชิงสร้างสรรค์
พรอมป์ที่เขียนเพียงชุดเดียวช่วยให้ Ltx-2 API สร้างวิดีโอ native 4K พร้อมเสียงที่สร้างในกระบวนการเดียวกันได้ สตูดิโอและทีมโฆษณาสามารถแปลงบรีฟแคมเปญให้เป็นสปอตโซเชียลที่พร้อมใช้งาน โดยไม่ต้องใช้กล้องหรือการตัดต่อด้วยมือ
อัปโหลดภาพนิ่งเพียงภาพเดียว แล้วการสร้างแบบ image-to-video จะทำให้ภาพนั้นเคลื่อนไหว โดยคงองค์ประกอบของต้นฉบับไว้พร้อมเพิ่มการเคลื่อนกล้องที่สมจริง ผู้ขายอีคอมเมิร์ซและนักวาดภาพประกอบสามารถทำให้แคตตาล็อกและพอร์ตโฟลิโอแบบนิ่งมีชีวิตชีวาในฟีดที่หยุดนิ้วผู้ชมได้
ต้องการเทคที่ยาวขึ้นใช่ไหม endpoint extend-video จะต่อเฟรมใหม่เข้ากับคลิปที่มีอยู่ พร้อมรักษาการเคลื่อนไหว สไตล์ และเสียงให้ต่อเนื่อง ครีเอเตอร์สามารถร้อยงานสร้างสั้น ๆ ให้เป็นเรื่องเล่าที่ลื่นไหลเกินขีดจำกัดของคำขอเดียว
เมื่อเสียงเป็นเรื่องสำคัญ Ltx-2 API จะสังเคราะห์บทพูด foley และเสียงบรรยากาศพร้อมกับภาพในครั้งเดียว โดยล็อกให้ตรงกับการเคลื่อนไหว เหมาะสำหรับวิดีโออธิบาย เทรลเลอร์ และฉากที่ต้องการเสียงเข้าจังหวะพอดี
สำหรับการส่งมอบขั้นสุดท้าย Ltx-2 API เรนเดอร์เฟรม native 4K พร้อมการเคลื่อนไหวที่สะอาดตาและพื้นผิวคมชัด แทนที่จะเป็นพรีวิวที่อัปสเกล เอเจนซีและสตูดิโอสามารถส่งออกมาสเตอร์พร้อมออกอากาศจาก endpoint เข้าสู่ไปป์ไลน์ตัดต่อได้โดยตรง
เพราะ LTX-2 เป็น open model ที่มีประสิทธิภาพ งานปริมาณมากจึงรันได้บนราคาจ่ายตามการใช้งานจริงที่โปร่งใส พร้อมให้คุณสลับโหมดประสิทธิภาพได้ในแต่ละคำขอ ทีมผลิตภัณฑ์สามารถทำต้นแบบได้ในต้นทุนต่ำ แล้วค่อยเพิ่มความละเอียดสมจริงสำหรับการปล่อยใช้งาน
เปรียบเทียบ Ltx-2 API กับโมเดลวิดีโอที่ขับเคลื่อนด้วยข้อความและรูปภาพที่ใกล้เคียงกันบน Atlas Cloud ในด้านโหมดการสร้าง ความละเอียด เสียงเนทีฟ ความยาวคลิป และราคาเริ่มต้น
| โมเดล | โหมดการสร้าง | ความละเอียดสูงสุด | เสียงที่ซิงโครไนซ์ | ความยาวคลิปสูงสุด | ราคาเริ่มต้น |
|---|---|---|---|---|---|
| LTX-2.3 Quality Text-to-Video | สร้างวิดีโอจากข้อความ | พรีเซ็ต 1024×1024 (ค่าเริ่มต้น 16:9) | √ (สลับเปิด/ปิดได้ตามต้องการ) | สูงสุด 257 เฟรม | $0.002 |
| LTX-2.3 Quality Image-to-Video | สร้างวิดีโอจากรูปภาพ, ขยายต่อ | พรีเซ็ต 1024×1024 (ค่าเริ่มต้น 16:9) | √ (สลับเปิด/ปิดได้ตามต้องการ) | สูงสุด 257 เฟรม | $0.002 |
| Seedance 2.0 Text-to-Video | สร้างวิดีโอจากข้อความ | สูงสุด 2K | √ เนทีฟ | 4 ถึง 15 s | $0.112 |
| Veo 3.1 Text-to-Video | สร้างวิดีโอจากข้อความ | สูงสุด 4K | √ เนทีฟ | 8 s (ขยายต่อได้) | $0.2 |
| Kling Video O3 4K Text-to-Video | สร้างวิดีโอจากข้อความและรูปภาพ | Native 4K (3840×2160) | √ เนทีฟ | 3 ถึง 15 s | $0.42 |
เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud
สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล
การรวมโมเดล Ltx-2 ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้
เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์
API แบบรวมศูนย์:
รัน Ltx-2, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว
ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless
ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต
ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม
ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา
Ltx-2 API ช่วยให้นักพัฒนาเข้าถึง LTX-2 ซึ่งเป็นโมเดล foundation ด้านเสียง-วิดีโอแบบ open-weight จาก Lightricks ผ่านโปรแกรมได้ โดยแปลงพรอมป์ข้อความหรือรูปภาพให้เป็นวิดีโอและเสียงที่ซิงโครไนซ์กันในรอบการสร้างเดียว และบน Atlas Cloud คุณเข้าถึงได้ผ่าน endpoint เดียวที่เข้ากันได้กับ OpenAI พร้อมการคิดค่าบริการตามการใช้งานจริง
LTX-2 รองรับ text-to-video, image-to-video และการขยายคลิป คุณจึงเปลี่ยนฉากที่เขียนไว้ให้เป็นภาพเคลื่อนไหว ทำให้ภาพนิ่งเคลื่อนไหว หรือยืดความยาวช็อตที่มีอยู่แล้วได้ ทุกโหมดสามารถเรนเดอร์เสียงประกอบได้ จึงเหมาะกับหนังสั้น โฆษณา เดโมสินค้า และคอนเทนต์โซเชียล
ใช่ เสียงและวิดีโอถูกสร้างขึ้นในรอบเดียวที่ซิงโครไนซ์กัน ไม่ใช่นำมาต่อรวมกันภายหลัง โดยครอบคลุมทั้งลิปซิงก์บทสนทนา ซาวด์เอฟเฟกต์ และเสียงบรรยากาศ บน Atlas Cloud คุณเปิดใช้ได้ด้วยพารามิเตอร์ generate_audio ซึ่งปิดอยู่ตามค่าเริ่มต้น
โมเดล LTX-2 รองรับแบบเนทีฟได้สูงสุดถึงความละเอียด 4K ที่สูงสุด 50 fps โดยคลิปยาวได้ถึง 20 วินาที ครอบคลุมเฟรมเรต 24, 25, 48 และ 50 บน Atlas Cloud endpoint แบบ quality ให้คุณเลือกอัตราส่วนภาพและกำหนดความยาวคลิปผ่านจำนวนเฟรมระหว่าง 25 ถึง 257 เฟรมได้
ส่งคำขอมาตรฐานไปยัง Atlas Cloud endpoint พร้อมพรอมป์ของคุณ โมเดล เช่น ltx-2.3-quality/text-to-video อัตราส่วนภาพ จำนวนเฟรม และ seed แบบไม่บังคับเพื่อให้สร้างผลลัพธ์ซ้ำได้ เนื่องจาก endpoint เข้ากันได้กับ OpenAI คีย์เดียวจึงใช้ได้ทั้งกับ Ltx-2 API และโมเดลอื่นทั้งหมดบนแพลตฟอร์ม การผสานรวมจึงมักใช้เวลาเพียงไม่กี่นาที
ได้แน่นอน โมเดล ltx-2.3-quality/extend-video จะต่อความยาวคลิป LTX-2 ที่มีอยู่ โดยยังคงความสอดคล้องของการเคลื่อนไหวและเสียงหลังจากความยาวเดิม เหมาะเมื่อการสร้างครั้งเดียวให้ความยาวสั้นกว่าที่ฉากต้องการจริง
LTX-2 มาพร้อม open weights และมีประสิทธิภาพพอที่จะรันบน GPU ระดับผู้บริโภคได้ ดังนั้นการ self-host จึงเป็นทางเลือกที่ทำได้จริง หากคุณไม่อยากจัดเตรียม GPU จัดการคิว และดูแลการสเกล Hosted API จะให้โมเดลเดียวกันโดยไม่ต้องดูแลโครงสร้างพื้นฐานเอง
Atlas Cloud คิดค่าบริการ Ltx-2 API ตามการใช้งานจริง พร้อมราคาต่อการเรียกใช้ที่โปร่งใส และไม่มีค่าสมัครสมาชิกหรือข้อผูกมัดขั้นต่ำ คุณจ่ายเฉพาะสิ่งที่สร้าง และคีย์เดียวกันยังให้คุณเข้าถึงโมเดลรุ่นใหม่ได้ตั้งแต่ Day-0 เริ่มสร้างได้วันนี้
LTX-2.3 คือเวอร์ชันปัจจุบันของตระกูล LTX-2 และเป็นเวอร์ชันที่ Atlas Cloud ให้บริการผ่าน endpoint แบบ quality สำหรับ text-to-video, image-to-video และ extend-video โดยปรับปรุงจากรุ่นแรก ขณะยังคงแนวทางสร้างเสียงและวิดีโอที่ซิงโครไนซ์กันเหมือนเดิม คุณจึงได้คุณภาพล่าสุดโดยไม่ต้องเปลี่ยนวิธีเรียกใช้โมเดล