เพียง 2 สัปดาห์เท่านั้น | รับส่วนลด 20% สำหรับ Seedream 5.0 Pro!
LTX-2 API for Synchronized Audio and Video

LTX-2 API for Synchronized Audio and Video

LTX-2 API นำตระกูลวิดีโอแบบ open-weight ของ Lightricks มาใช้งานในระดับโปรดักชัน โดยสร้างวิดีโอและเสียงที่ซิงก์กันได้ใน pass เดียว สั่งงานจากข้อความ, ทำให้ภาพนิ่งเคลื่อนไหว หรือขยายคลิปที่มีอยู่ และทุกผลลัพธ์จะมาพร้อม lip sync, foley และเสียงบรรยากาศที่เข้ากัน บน Atlas Cloud คุณเข้าถึงได้ผ่านคีย์ที่เข้ากันได้กับ OpenAI เพียงคีย์เดียว พร้อมราคาจ่ายตามการใช้งานจริงที่โปร่งใส และสิทธิ์เข้าถึง Day-0 เริ่มสร้างได้วันนี้

สำรวจโมเดลชั้นนำ

Atlas Cloud มอบโมเดลสร้างสรรค์ล่าสุดที่นำหน้าในอุตสาหกรรมให้กับคุณ

เปรียบเทียบ Ltx-2 API Endpoints แบบเคียงข้างกัน: ข้อความ รูปภาพ และการขยายวิดีโอ

เปรียบเทียบทุก modality ของ Ltx-2 API ในมุมมองเดียว ตั้งแต่การสร้างจาก prompt ไปจนถึงการทำให้ภาพนิ่งเคลื่อนไหวและการต่อคลิปที่มีอยู่ พร้อมตัวเลือกเสียงที่ซิงโครไนซ์

Modalityคำอธิบาย
Ltx-2 T2V API (ข้อความเป็นวิดีโอ)ป้อน prompt ข้อความได้สูงสุด 2,000 ตัวอักษร แล้ว Ltx-2 API จะส่งคืนวิดีโอที่เรนเดอร์เสร็จสมบูรณ์ พร้อมเสียงที่ซิงโครไนซ์เป็นตัวเลือกเมื่อเปิดใช้ generate_audio ความยาวคลิปปรับได้ตั้งแต่ 25 ถึง 257 frames และมี preset ความละเอียด 6 แบบ ครอบคลุมเอาต์พุตแบบจัตุรัส แนวตั้ง 9:16 และแนวนอน 16:9 endpoint นี้เหมาะสำหรับคอนเซ็ปต์โฆษณา วิดีโอสั้นสำหรับโซเชียล และพรีวิว storyboard ที่สร้างจากคำอธิบายเป็นลายลักษณ์อักษรทั้งหมด โดยคิดราคาที่อัตราฐานมาตรฐาน $0.002
Ltx-2 I2V API (รูปภาพเป็นวิดีโอ)ส่งภาพนิ่งในรูปแบบ jpg, png, webp, gif หรือ avif พร้อม motion prompt แล้ว endpoint นี้จะทำให้ภาพเคลื่อนไหวเป็นคลิปวิดีโอ พร้อมตัวเลือกการสร้างเสียง ช่วง 25 ถึง 257 frames และ preset อัตราส่วนภาพ 6 แบบยังคงเหมือนเดิม ดังนั้นเฟรมต้นฉบับเพียงเฟรมเดียวจึงกลายเป็นวิดีโอแนวนอนหรือแนวตั้งได้ ภาพสินค้า ภาพพอร์ตเทรตตัวละคร และคอนเซ็ปต์อาร์ตล้วนเป็นอินพุตที่เหมาะสม ทั้งหมดคิดราคาฐานมาตรฐาน $0.002
Ltx-2 Extend Video APIเมื่อคลิปที่มีอยู่ต้องการความยาวเพิ่มเติม endpoint นี้จะต่อคลิปไปข้างหน้าหรือย้อนกลับจากแหล่งที่มา mp4, mov, webm, m4v หรือ gif ที่ส่งเข้ามาได้ รองรับการขยายซีเควนซ์ได้สูงสุด 481 frames รักษาจังหวะเดิมผ่าน match_input_fps และสามารถใส่เสียงที่สร้างขึ้นซ้อนเข้าไปได้ เหมาะสำหรับการเพิ่มความยาว b-roll ทำฉากวนซ้ำ หรือเชื่อมต่อระหว่างคัต โดยคิดราคาที่อัตราฐานเดียวกัน $0.002

สร้างเสียงและวิดีโอพร้อมกันด้วย Ltx-2 API

Ltx-2 API ผสานโหมดการสร้างจากข้อความ รูปภาพ และการต่อขยายเข้ากับเสียงที่ซิงก์กันแบบเนทีฟ ควบคุมจำนวนเฟรมได้ และมีพรีเซ็ตอัตราส่วนภาพ 6 แบบ ทั้งหมดเรียกใช้ได้ผ่านคีย์เดียวที่เข้ากันได้กับ OpenAI พร้อมราคาจ่ายตามการใช้งานจริงที่โปร่งใส

จากข้อความสู่ฉากที่เสร็จสมบูรณ์ด้วย Ltx-2 API

บรรยายฉากได้สูงสุด 2,000 ตัวอักษร แล้ว Ltx-2 API จะเปลี่ยนข้อความล้วนให้เป็นคลิปที่เคลื่อนไหวและมีเสียง โดยไม่ต้องใช้แอสเซ็ตอ้างอิง พรอมป์ของคุณควบคุมตัวแบบ การเคลื่อนไหว แสง และพฤติกรรมของกล้อง ขณะที่ seed แบบไม่บังคับช่วยล็อกผลลัพธ์เพื่อการทำซ้ำและปรับแต่งได้อย่างสม่ำเสมอ เพราะทุกอย่างเริ่มจากภาษา จึงเหมาะกับการทำสตอรีบอร์ด การนำเสนอคอนเซปต์ และการสำรวจไอเดียอย่างรวดเร็วเมื่อคุณมีไอเดียแต่ยังไม่มีฟุตเทจ

ทำให้ภาพนิ่งใด ๆ มีชีวิต

ป้อนภาพนิ่งเพียงภาพเดียวในรูปแบบ jpg, png, webp, gif หรือ avif แล้วโมเดลจะทำให้ภาพนั้นเคลื่อนไหวเป็นวิดีโอพร้อมเสียงที่เข้ากัน พรอมป์จะกำหนดว่าภาพควรเคลื่อนไหวอย่างไร ตั้งแต่การค่อย ๆ push-in ไปจนถึงจังหวะแอ็กชันเต็มรูปแบบ โดยที่องค์ประกอบเดิมยังคงอยู่ ช่างภาพ นักออกแบบ และทีมผลิตภัณฑ์ใช้วิธีนี้เพื่อเปลี่ยนภาพ hero เพียงภาพเดียวให้กลายเป็นคอนเทนต์เคลื่อนไหวที่แชร์ได้ โดยไม่ต้องถ่ายใหม่

ต่อขยายคลิปได้อย่างไร้รอยต่อผ่าน Ltx-2 API

อัปโหลดคลิปที่มีอยู่ แล้ว Ltx-2 API จะสร้างต่อให้ทั้งไปข้างหน้าหรือย้อนกลับ โดยสร้างเฟรมเพิ่มเติมได้สูงสุด 481 เฟรมที่สืบทอดสไตล์และจังหวะจากต้นฉบับ ตัวเลือก match_input_fps ช่วยล็อกฟุตเทจใหม่ให้ตรงกับเฟรมเรตของแหล่งที่มา ทำให้รอยต่อดูแนบเนียน นี่คือวิธีเปลี่ยนเทคสั้นให้กลายเป็นซีเควนซ์ยาว และช่วยกู้ฉากที่จบเร็วไปเพียงจังหวะเดียว

กำหนดจำนวนเฟรมและอัตราส่วนภาพได้ตามต้องการ

ควบคุมจำนวนเฟรมได้เต็มที่ตั้งแต่ 25 ถึง 257 เฟรมในโหมดข้อความและรูปภาพ โดยตั้งค่าเป็นจำนวนที่เป็นผลคูณของแปดบวกหนึ่งเสมอเพื่อการ sampling ที่สะอาด พรีเซ็ตความละเอียด 6 แบบครอบคลุม HD แบบสี่เหลี่ยมจัตุรัสที่ 1024 by 1024, สี่เหลี่ยมจัตุรัส 512, แนวตั้ง 3:4, แนวตั้ง 9:16, แนวนอน 4:3 และแนวนอน 16:9 ทำให้โมเดลเดียวรองรับทั้งภาพยนตร์ โซเชียล และฟีดแนวตั้ง เลือกรูปทรงก่อน แล้วให้คำขอเดียวส่งคืนครอปที่ถูกต้อง

คีย์เดียวและการรันที่ทำซ้ำได้บน Ltx-2 API

ทุกคำขอส่งผ่านคีย์เดียวที่เข้ากันได้กับ OpenAI บน Atlas Cloud พร้อมราคาจ่ายตามการใช้งานจริงที่โปร่งใสและไม่มีการสมัครสมาชิก ส่ง seed คงที่พร้อมพรอมป์เดิม แล้วโมเดลจะคืนคลิปเดิม ทำให้การสร้างที่เคยคาดเดายากกลายเป็นขั้นตอนที่ควบคุมและจัดเวอร์ชันได้ การเข้าถึงแบบ Day-0 หมายความว่า Ltx-2 API รุ่นใหม่จะเรียกใช้ได้ทันทีที่เปิดตัว ทีมจึงสามารถทำมาตรฐานให้กับ video pipeline และสเกลได้โดยไม่ต้องจัดการ GPUs

พรอมต์เดียว สามเอนจิน: เทียบ Ltx-2 API แบบตัวต่อตัว

ส่งพรอมต์เดียวกันทุกประการไปยัง Ltx-2 API และโมเดลวิดีโอยอดนิยมอีกสองตัวบน Atlas Cloud จากนั้นเปรียบเทียบว่าแต่ละตัวจัดการการเคลื่อนไหว เสียงที่ซิงก์กัน และรายละเอียดแบบภาพยนตร์จากคำสั่งชุดเดียวกันอย่างไร

พรอมต์

ลิงแสมขี้สงสัยตัวหนึ่งพุ่งลัดเลาะผ่านตลาดเครื่องเทศ Marrakech ที่แน่นขนัดในช่วง golden hour แล้วฉก fez สีแดงสดของพ่อค้าออกจากแผง มันกระโดดข้ามกระสอบ saffron และ paprika ที่เปิดอยู่จนฝุ่นสีส้มฟุ้งวนขึ้นมา จากนั้นหยุดนิ่งอยู่บนยอดเสา canopy แล้วเหลียวกลับมามองพอดีกับที่พ่อค้าหัวเราะพลางวิ่งไล่ตาม เปิดด้วยช็อต tracking มุมต่ำที่เคลื่อนตามหลังลิงฝ่าฝูงชน whip pan ไปยังใบหน้าตกใจของพ่อค้า แล้วค่อยยกขึ้นเป็นช็อต crane กวาดกว้างเหนือแผงค้าทั้งหมด ขณะที่ฝุ่นระยิบระยับในแสงอุ่น สไตล์ภาพยนตร์สมจริง ระยะชัดตื้น โทนสี earthy เข้มข้น Audio: เสียงตลาดคึกคัก เสียงทองเหลืองกระทบกัน และจังหวะกลองมือที่เร่งเร้าขึ้นพร้อมการไล่ล่า 16:9 aspect ratio.

Generated with Ltx 2.3 Quality on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

พรอมต์

ผู้ส่งสารบนฟ้าวัยเยาว์ในผ้าคลุม crimson ที่พลิ้วไหว กระโจนออกจากขอบวิหารหินลอยฟ้า แล้วขี่นกกระเรียนกระดาษกลไกฝ่าหมู่เมฆในหุบเขา เลี้ยวหลบโคมไฟเรืองแสงที่ลอยอยู่ เธอเอียงตัวเลี้ยวแรงอ้อมยอดหินแหลม คว้าจดหมายระยิบระยับกลางอากาศ แล้วหุบตัวดิ่งลงอย่างชัน ขณะที่นักร่อนคู่แข่งทะลุหมอกตามมาติด ๆ เริ่มด้วยมุมมอง first-person POV เหนือไหล่ของเธอตอนนกกระเรียนทะยานขึ้น ตัดไปเป็นช็อต drone ที่พุ่งเคียงข้างการดิ่ง แล้วลดลงเป็นช็อตมุมต่ำเงยขึ้นเมื่อเธอเชิดตัวออกจากการดิ่งเข้าสู่แสงอาทิตย์จ้าจนตาพร่า สไตล์ anime สีสันสดใส แบบ cel-shaded พาเลต luminous magic-hour Audio: เสียงลมพุ่งผ่าน เสียงปีกกระดาษกระพือ และเสียงเครื่องสายออร์เคสตราที่พุ่งสูงอย่างยิ่งใหญ่ตรงจังหวะเชิดตัวขึ้น 16:9 aspect ratio.

Generated with Ltx 2.3 Quality on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

ส่งมอบวิดีโอและเสียงระดับโปรดักชันด้วย Ltx-2 API

ตั้งแต่พรอมป์ข้อความและรูปภาพ ไปจนถึงคลิปยาวและเสียงที่ซิงค์กัน Ltx-2 API ครอบคลุมเส้นทางทั้งหมดตั้งแต่ร่างแรกจนถึงการส่งมอบ 4K สำหรับงานการตลาด อีคอมเมิร์ซ และโปรดักชันเชิงสร้างสรรค์

สร้างวิดีโอจากพรอมป์ด้วย Ltx-2 API

พรอมป์ที่เขียนเพียงชุดเดียวช่วยให้ Ltx-2 API สร้างวิดีโอ native 4K พร้อมเสียงที่สร้างในกระบวนการเดียวกันได้ สตูดิโอและทีมโฆษณาสามารถแปลงบรีฟแคมเปญให้เป็นสปอตโซเชียลที่พร้อมใช้งาน โดยไม่ต้องใช้กล้องหรือการตัดต่อด้วยมือ

ทำให้ภาพนิ่งเคลื่อนไหว

อัปโหลดภาพนิ่งเพียงภาพเดียว แล้วการสร้างแบบ image-to-video จะทำให้ภาพนั้นเคลื่อนไหว โดยคงองค์ประกอบของต้นฉบับไว้พร้อมเพิ่มการเคลื่อนกล้องที่สมจริง ผู้ขายอีคอมเมิร์ซและนักวาดภาพประกอบสามารถทำให้แคตตาล็อกและพอร์ตโฟลิโอแบบนิ่งมีชีวิตชีวาในฟีดที่หยุดนิ้วผู้ชมได้

ต่อคลิปให้เป็นฉากที่ยาวขึ้น

ต้องการเทคที่ยาวขึ้นใช่ไหม endpoint extend-video จะต่อเฟรมใหม่เข้ากับคลิปที่มีอยู่ พร้อมรักษาการเคลื่อนไหว สไตล์ และเสียงให้ต่อเนื่อง ครีเอเตอร์สามารถร้อยงานสร้างสั้น ๆ ให้เป็นเรื่องเล่าที่ลื่นไหลเกินขีดจำกัดของคำขอเดียว

เสียงที่ซิงค์กันผ่าน Ltx-2 API

เมื่อเสียงเป็นเรื่องสำคัญ Ltx-2 API จะสังเคราะห์บทพูด foley และเสียงบรรยากาศพร้อมกับภาพในครั้งเดียว โดยล็อกให้ตรงกับการเคลื่อนไหว เหมาะสำหรับวิดีโออธิบาย เทรลเลอร์ และฉากที่ต้องการเสียงเข้าจังหวะพอดี

มาสเตอร์ 4K จาก Ltx-2 API

สำหรับการส่งมอบขั้นสุดท้าย Ltx-2 API เรนเดอร์เฟรม native 4K พร้อมการเคลื่อนไหวที่สะอาดตาและพื้นผิวคมชัด แทนที่จะเป็นพรีวิวที่อัปสเกล เอเจนซีและสตูดิโอสามารถส่งออกมาสเตอร์พร้อมออกอากาศจาก endpoint เข้าสู่ไปป์ไลน์ตัดต่อได้โดยตรง

ขยายการสร้างแบบแบตช์ในต้นทุนที่คุ้มค่า

เพราะ LTX-2 เป็น open model ที่มีประสิทธิภาพ งานปริมาณมากจึงรันได้บนราคาจ่ายตามการใช้งานจริงที่โปร่งใส พร้อมให้คุณสลับโหมดประสิทธิภาพได้ในแต่ละคำขอ ทีมผลิตภัณฑ์สามารถทำต้นแบบได้ในต้นทุนต่ำ แล้วค่อยเพิ่มความละเอียดสมจริงสำหรับการปล่อยใช้งาน

Ltx-2 API เมื่อเทียบกับโมเดลวิดีโอสำหรับงานโปรดักชันอื่น ๆ

เปรียบเทียบ Ltx-2 API กับโมเดลวิดีโอที่ขับเคลื่อนด้วยข้อความและรูปภาพที่ใกล้เคียงกันบน Atlas Cloud ในด้านโหมดการสร้าง ความละเอียด เสียงเนทีฟ ความยาวคลิป และราคาเริ่มต้น

โมเดลโหมดการสร้างความละเอียดสูงสุดเสียงที่ซิงโครไนซ์ความยาวคลิปสูงสุดราคาเริ่มต้น
LTX-2.3 Quality Text-to-Videoสร้างวิดีโอจากข้อความพรีเซ็ต 1024×1024 (ค่าเริ่มต้น 16:9)√ (สลับเปิด/ปิดได้ตามต้องการ)สูงสุด 257 เฟรม$0.002
LTX-2.3 Quality Image-to-Videoสร้างวิดีโอจากรูปภาพ, ขยายต่อพรีเซ็ต 1024×1024 (ค่าเริ่มต้น 16:9)√ (สลับเปิด/ปิดได้ตามต้องการ)สูงสุด 257 เฟรม$0.002
Seedance 2.0 Text-to-Videoสร้างวิดีโอจากข้อความสูงสุด 2K√ เนทีฟ4 ถึง 15 s$0.112
Veo 3.1 Text-to-Videoสร้างวิดีโอจากข้อความสูงสุด 4K√ เนทีฟ8 s (ขยายต่อได้)$0.2
Kling Video O3 4K Text-to-Videoสร้างวิดีโอจากข้อความและรูปภาพNative 4K (3840×2160)√ เนทีฟ3 ถึง 15 s$0.42

วิธีใช้ Ltx-2 บน Atlas Cloud

เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud

สร้างบัญชี Atlas Cloud

สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล

ทำไมต้องใช้ Ltx-2 บน Atlas Cloud

การรวมโมเดล Ltx-2 ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้

ประสิทธิภาพและความยืดหยุ่น

เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์

API แบบรวมศูนย์:
รัน Ltx-2, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว

ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless

องค์กรและขนาด

ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต

ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม

ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา

Ltx-2 API: คำตอบสำหรับคำถามที่นักพัฒนาพบบ่อย

Ltx-2 API ช่วยให้นักพัฒนาเข้าถึง LTX-2 ซึ่งเป็นโมเดล foundation ด้านเสียง-วิดีโอแบบ open-weight จาก Lightricks ผ่านโปรแกรมได้ โดยแปลงพรอมป์ข้อความหรือรูปภาพให้เป็นวิดีโอและเสียงที่ซิงโครไนซ์กันในรอบการสร้างเดียว และบน Atlas Cloud คุณเข้าถึงได้ผ่าน endpoint เดียวที่เข้ากันได้กับ OpenAI พร้อมการคิดค่าบริการตามการใช้งานจริง

LTX-2 รองรับ text-to-video, image-to-video และการขยายคลิป คุณจึงเปลี่ยนฉากที่เขียนไว้ให้เป็นภาพเคลื่อนไหว ทำให้ภาพนิ่งเคลื่อนไหว หรือยืดความยาวช็อตที่มีอยู่แล้วได้ ทุกโหมดสามารถเรนเดอร์เสียงประกอบได้ จึงเหมาะกับหนังสั้น โฆษณา เดโมสินค้า และคอนเทนต์โซเชียล

ใช่ เสียงและวิดีโอถูกสร้างขึ้นในรอบเดียวที่ซิงโครไนซ์กัน ไม่ใช่นำมาต่อรวมกันภายหลัง โดยครอบคลุมทั้งลิปซิงก์บทสนทนา ซาวด์เอฟเฟกต์ และเสียงบรรยากาศ บน Atlas Cloud คุณเปิดใช้ได้ด้วยพารามิเตอร์ generate_audio ซึ่งปิดอยู่ตามค่าเริ่มต้น

โมเดล LTX-2 รองรับแบบเนทีฟได้สูงสุดถึงความละเอียด 4K ที่สูงสุด 50 fps โดยคลิปยาวได้ถึง 20 วินาที ครอบคลุมเฟรมเรต 24, 25, 48 และ 50 บน Atlas Cloud endpoint แบบ quality ให้คุณเลือกอัตราส่วนภาพและกำหนดความยาวคลิปผ่านจำนวนเฟรมระหว่าง 25 ถึง 257 เฟรมได้

ส่งคำขอมาตรฐานไปยัง Atlas Cloud endpoint พร้อมพรอมป์ของคุณ โมเดล เช่น ltx-2.3-quality/text-to-video อัตราส่วนภาพ จำนวนเฟรม และ seed แบบไม่บังคับเพื่อให้สร้างผลลัพธ์ซ้ำได้ เนื่องจาก endpoint เข้ากันได้กับ OpenAI คีย์เดียวจึงใช้ได้ทั้งกับ Ltx-2 API และโมเดลอื่นทั้งหมดบนแพลตฟอร์ม การผสานรวมจึงมักใช้เวลาเพียงไม่กี่นาที

ได้แน่นอน โมเดล ltx-2.3-quality/extend-video จะต่อความยาวคลิป LTX-2 ที่มีอยู่ โดยยังคงความสอดคล้องของการเคลื่อนไหวและเสียงหลังจากความยาวเดิม เหมาะเมื่อการสร้างครั้งเดียวให้ความยาวสั้นกว่าที่ฉากต้องการจริง

LTX-2 มาพร้อม open weights และมีประสิทธิภาพพอที่จะรันบน GPU ระดับผู้บริโภคได้ ดังนั้นการ self-host จึงเป็นทางเลือกที่ทำได้จริง หากคุณไม่อยากจัดเตรียม GPU จัดการคิว และดูแลการสเกล Hosted API จะให้โมเดลเดียวกันโดยไม่ต้องดูแลโครงสร้างพื้นฐานเอง

Atlas Cloud คิดค่าบริการ Ltx-2 API ตามการใช้งานจริง พร้อมราคาต่อการเรียกใช้ที่โปร่งใส และไม่มีค่าสมัครสมาชิกหรือข้อผูกมัดขั้นต่ำ คุณจ่ายเฉพาะสิ่งที่สร้าง และคีย์เดียวกันยังให้คุณเข้าถึงโมเดลรุ่นใหม่ได้ตั้งแต่ Day-0 เริ่มสร้างได้วันนี้

LTX-2.3 คือเวอร์ชันปัจจุบันของตระกูล LTX-2 และเป็นเวอร์ชันที่ Atlas Cloud ให้บริการผ่าน endpoint แบบ quality สำหรับ text-to-video, image-to-video และ extend-video โดยปรับปรุงจากรุ่นแรก ขณะยังคงแนวทางสร้างเสียงและวิดีโอที่ซิงโครไนซ์กันเหมือนเดิม คุณจึงได้คุณภาพล่าสุดโดยไม่ต้องเปลี่ยนวิธีเรียกใช้โมเดล

สำรวจกลุ่มเพิ่มเติม

Seedance 2.0

Seedance 2.0 API ให้คุณเข้าถึงระดับโปรดักชันของโมเดลวิดีโอแบบมัลติโมดัลจาก ByteDance — รองรับอินพุต 4 รูปแบบ (ข้อความ, รูปภาพ, วิดีโอ, เสียง) และระบบ "Universal Reference" ชั้นนำของอุตสาหกรรมที่ล็อกองค์ประกอบภาพ การเคลื่อนไหวของกล้อง และการกระทำของตัวละครในทุกช็อต ผสานรวมการควบคุมระดับผู้กำกับด้วยการเรียกใช้ API เพียงครั้งเดียว ในราคาคงที่ $0.09/วินาที รับคีย์ได้ทันที และไม่มีคิวรอ — พร้อมการรับประกันเวลาพร้อมใช้งานและการปฏิบัติตามข้อกำหนดระดับองค์กร Seedance 2.0 Native 4K เปิดใช้งานแล้ววันนี้!

ดูกลุ่ม

Grok Imagine

Grok Imagine API นำเสนอการสร้างภาพ วิดีโอ และเสียงของ xAI ให้นักพัฒนาในชุดเครื่องมือเดียว สามารถสร้างภาพความละเอียดสูงสุด 2K พร้อมการเรนเดอร์ข้อความหลายภาษา รวมถึงวิดีโอความยาวสูงสุด 15 วินาทีพร้อมเสียงที่ซิงโครไนซ์แบบเนทีฟและการแก้ไขตามข้อมูลอ้างอิง บน Atlas Cloud คีย์เดียวสามารถรัน Grok Imagine ได้ทุกโหมด คุณจึงสามารถสลับไปมาระหว่างภาพ วิดีโอ และเสียงได้โดยไม่ต้องตั้งค่าแยกกัน เริ่มต้นที่ $0.02 ต่อภาพ และ $0.05 ต่อวินาที

ดูกลุ่ม

Gemini Omni Flash

Gemini Omni API นำโมเดลสร้างและแก้ไขวิดีโอแบบมัลติโมดัลของ Google DeepMind ซึ่งเปิดตัวในงาน Google I/O 2026 มาสู่สแต็กของคุณ Gemini Omni ผสานเอนจินการใช้เหตุผลของ Gemini เข้ากับสื่อเชิงสร้างสรรค์ รองรับอินพุตทุกรูปแบบทั้งข้อความ รูปภาพ วิดีโอ และเสียง เพื่อสร้างผลลัพธ์ที่สอดคล้องกันและอิงตามความรู้ ปรับแต่งผลลัพธ์ผ่านการสนทนาอย่างเป็นธรรมชาติ ไม่ว่าจะเปลี่ยนวัตถุ เขียนฉากใหม่ หรือปรับสไตล์ โดยที่ฟิสิกส์ ตัวละคร และความต่อเนื่องยังคงเดิม Atlas Cloud ให้บริการ Gemini Omni Flash ครบทั้งไลน์อัป ทั้งการสร้างวิดีโอจากข้อความ การสร้างวิดีโอจากรูปภาพพร้อมรูปอ้างอิงสูงสุด 7 รูป และการสร้างวิดีโอจากรูปอ้างอิง ผ่าน API เดียวแบบครบวงจร ด้วยราคาต่อวินาทีที่โปร่งใสเริ่มต้นที่ $0.112 โดยไม่ต้องสมัครสมาชิก เริ่มสร้างได้เลยวันนี้

ดูกลุ่ม

GPT Image 2

GPT Image 2 API ช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลรูปภาพล่าสุดของ OpenAI ซึ่งเป็นรุ่นสืบทอดจาก GPT Image 1.5 โดยสามารถสร้างและแก้ไขรูปภาพพร้อมกับการเรนเดอร์ข้อความที่แม่นยำทั้งในอักษรละตินและ CJK รวมถึงการจัดวางองค์ประกอบที่ยอดเยี่ยมสำหรับโปสเตอร์ ม็อกอัป และอินโฟกราฟิก บน Atlas Cloud คุณสามารถเข้าถึงโมเดลนี้ผ่าน API ที่เป็นหนึ่งเดียวร่วมกับโมเดลอื่นๆ อีกกว่า 300 รุ่น พร้อมเครดิตฟรี เวลาทำงาน 99.99% และไม่จำเป็นต้องมีการตรวจสอบยืนยันองค์กรจาก OpenAI

ดูกลุ่ม

Google

โมเดลเชิงสร้างสรรค์ที่ทรงพลังที่สุดของ Google พร้อมใช้งานแล้วบน Atlas Cloud โดย Veo 3.1 นำเสนอการสร้างวิดีโอระดับภาพยนตร์ Nano Banana 2 ขับเคลื่อนการสร้างภาพที่มีความเที่ยงตรงสูง และ Gemini นำความชาญฉลาดแบบมัลติโมดัลมาสู่ทุกเวิร์กโฟลว์ เข้าถึงชุดโมเดลของ Google เต็มรูปแบบผ่าน API key เดียวพร้อมความพร้อมใช้งานระดับ Day-0 และการกำหนดราคาแบบจ่ายตามการใช้งาน (pay-as-you-go)

ดูกลุ่ม

Seedance 2.0 Mini

Seedance 2.0 Mini นำเสนอการสร้างวิดีโอแบบมัลติโมดัลของ ByteDance สู่เวิร์กโฟลว์ที่ความเร็วและต้นทุนมีความสำคัญสูงสุด โดยมอบความสามารถหลักของ Seedance 2.0 ในรูปแบบที่ใช้ทรัพยากรน้อยลง — สร้างได้เร็วกว่า ต้นทุนต่อวิดีโอต่ำกว่า และใช้การผสานรวม API เดิมที่คุณใช้อยู่แล้ว สำหรับทีมที่จัดการไปป์ไลน์ปริมาณมากหรือสร้างต้นแบบในสเกลขนาดใหญ่ Mini คือตัวเลือกเริ่มต้นที่ใช้งานได้จริง

ดูกลุ่ม

ByteDance

ตั้งแต่การสร้างวิดีโอระดับภาพยนตร์ไปจนถึงการสร้างภาพที่มีความละเอียดสูง โมเดลที่ทรงพลังที่สุดของ ByteDance พร้อมใช้งานแล้วบน Atlas Cloud รัน Seedance และ Seedream ในสเกลขนาดใหญ่ด้วยราคาการอนุมานที่ต่ำที่สุด และไม่มีค่าใช้จ่ายแฝงด้านโครงสร้างพื้นฐาน

ดูกลุ่ม

Alibaba

Atlas Cloud รวบรวมโมเดลทั้งหมดของ Alibaba ไว้ใน API เดียว: Qwen สำหรับงานด้านภาษาและรูปภาพ และ Wan สำหรับการสร้างวิดีโอความละเอียดสูงสุด 1080p เข้าถึงทุกโมเดลในรูปแบบจ่ายตามการใช้งานจริง (pay-as-you-go) โดยไม่ต้องสมัครสมาชิก Alibaba API พร้อมใช้งานผ่าน base URL เดียวโดยใช้ไคลเอนต์ที่รองรับ OpenAI ที่คุณมีอยู่แล้ว

ดูกลุ่ม

OpenAI

Atlas Cloud ให้คุณเข้าถึงกลุ่มผลิตภัณฑ์ OpenAI API แบบครบวงจร ตั้งแต่ GPT Image 2 สำหรับการสร้างภาพถ่าย ไปจนถึง Sora 2 สำหรับวิดีโอ ทุกโมเดลพร้อมใช้งานแบบจ่ายตามการใช้งานจริง (pay-as-you-go) โดยไม่มีข้อผูกมัดรายเดือน เชื่อมต่อได้ง่ายดายด้วยการสลับ base URL เพียงจุดเดียวโดยใช้ API ที่เข้ากันได้กับ OpenAI

ดูกลุ่ม

xAI

สร้างไปป์ไลน์ภาพและวิดีโอที่สมบูรณ์โดยใช้ xAI API บน Atlas Cloud สร้างที่ความละเอียด 2K แก้ไขด้วยภาพอ้างอิง และทำให้ภาพเคลื่อนไหวเป็นคลิปที่ซิงค์กับเสียง

ดูกลุ่ม

Kwaivgi

Kwaivgi API ในราคาที่ถูกกว่าราคามาตรฐาน 15% Atlas Cloud มอบการเข้าถึง Day-0 สำหรับการเปิดตัว Kling ใหม่ด้วยการกำหนดราคาแบบจ่ายตามการใช้งานจริง (pay-as-you-go) และไม่จำกัดจำนวนผู้ใช้ บัญชีเดียว คีย์เดียว สำหรับโมเดล Kling ทุกรุ่นตั้งแต่ระดับมาตรฐานไปจนถึงระดับมาสเตอร์

ดูกลุ่ม

Seedream 5.0 Pro

Seedream 5.0 Pro API มอบโมเดลการแก้ไขภาพที่ควบคุมได้ของ ByteDance บน Atlas Cloud ให้กับนักพัฒนา โดยจะวางการแก้ไขอย่างแม่นยำด้วยจุดยึดและพิกัด แยกภาพออกเป็นเลเยอร์ที่แก้ไขได้ ผสานข้อมูลอ้างอิงหลายรายการ และจับคู่สีและวัสดุที่แน่นอน พร้อมข้อความหลายภาษาที่ความละเอียด 2K และ 3K บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว!

ดูกลุ่ม

API เดียวสำหรับ AI สื่อทุกประเภท

สำรวจโมเดลทั้งหมด