Seedance 2.0 Mini & Fast API ในราคาถูกที่สุดในโลก — ลดสูงสุดถึง 68% จากราคาทางการ
LTX-2 API for Synchronized Audio and Video

LTX-2 API for Synchronized Audio and Video

LTX-2 API นำตระกูลวิดีโอแบบ open-weight ของ Lightricks มาใช้งานในระดับโปรดักชัน โดยสร้างวิดีโอและเสียงที่ซิงก์กันได้ใน pass เดียว สั่งงานจากข้อความ, ทำให้ภาพนิ่งเคลื่อนไหว หรือขยายคลิปที่มีอยู่ และทุกผลลัพธ์จะมาพร้อม lip sync, foley และเสียงบรรยากาศที่เข้ากัน บน Atlas Cloud คุณเข้าถึงได้ผ่านคีย์ที่เข้ากันได้กับ OpenAI เพียงคีย์เดียว พร้อมราคาจ่ายตามการใช้งานจริงที่โปร่งใส และสิทธิ์เข้าถึง Day-0 เริ่มสร้างได้วันนี้

Ltx-2 พัฒนาโดย Lightricks โดย Atlas Cloud (ดำเนินการโดย Atlas Cloud AI LLC) เป็นผู้ให้บริการเข้าถึงโมเดลนี้ แต่ไม่ได้เป็นเจ้าของโมเดล เครื่องหมายการค้าทั้งหมดเป็นของเจ้าของที่เกี่ยวข้อง

สำรวจโมเดลชั้นนำ

Atlas Cloud มอบโมเดลสร้างสรรค์ล่าสุดที่นำหน้าในอุตสาหกรรมให้กับคุณ

เปรียบเทียบ Ltx-2 API Endpoints แบบเคียงข้างกัน: ข้อความ รูปภาพ และการขยายวิดีโอ

เปรียบเทียบทุก modality ของ Ltx-2 API ในมุมมองเดียว ตั้งแต่การสร้างจาก prompt ไปจนถึงการทำให้ภาพนิ่งเคลื่อนไหวและการต่อคลิปที่มีอยู่ พร้อมตัวเลือกเสียงที่ซิงโครไนซ์

Modalityคำอธิบาย
Ltx-2 T2V API (ข้อความเป็นวิดีโอ)ป้อน prompt ข้อความได้สูงสุด 2,000 ตัวอักษร แล้ว Ltx-2 API จะส่งคืนวิดีโอที่เรนเดอร์เสร็จสมบูรณ์ พร้อมเสียงที่ซิงโครไนซ์เป็นตัวเลือกเมื่อเปิดใช้ generate_audio ความยาวคลิปปรับได้ตั้งแต่ 25 ถึง 257 frames และมี preset ความละเอียด 6 แบบ ครอบคลุมเอาต์พุตแบบจัตุรัส แนวตั้ง 9:16 และแนวนอน 16:9 endpoint นี้เหมาะสำหรับคอนเซ็ปต์โฆษณา วิดีโอสั้นสำหรับโซเชียล และพรีวิว storyboard ที่สร้างจากคำอธิบายเป็นลายลักษณ์อักษรทั้งหมด โดยคิดราคาที่อัตราฐานมาตรฐาน $0.002
Ltx-2 I2V API (รูปภาพเป็นวิดีโอ)ส่งภาพนิ่งในรูปแบบ jpg, png, webp, gif หรือ avif พร้อม motion prompt แล้ว endpoint นี้จะทำให้ภาพเคลื่อนไหวเป็นคลิปวิดีโอ พร้อมตัวเลือกการสร้างเสียง ช่วง 25 ถึง 257 frames และ preset อัตราส่วนภาพ 6 แบบยังคงเหมือนเดิม ดังนั้นเฟรมต้นฉบับเพียงเฟรมเดียวจึงกลายเป็นวิดีโอแนวนอนหรือแนวตั้งได้ ภาพสินค้า ภาพพอร์ตเทรตตัวละคร และคอนเซ็ปต์อาร์ตล้วนเป็นอินพุตที่เหมาะสม ทั้งหมดคิดราคาฐานมาตรฐาน $0.002
Ltx-2 Extend Video APIเมื่อคลิปที่มีอยู่ต้องการความยาวเพิ่มเติม endpoint นี้จะต่อคลิปไปข้างหน้าหรือย้อนกลับจากแหล่งที่มา mp4, mov, webm, m4v หรือ gif ที่ส่งเข้ามาได้ รองรับการขยายซีเควนซ์ได้สูงสุด 481 frames รักษาจังหวะเดิมผ่าน match_input_fps และสามารถใส่เสียงที่สร้างขึ้นซ้อนเข้าไปได้ เหมาะสำหรับการเพิ่มความยาว b-roll ทำฉากวนซ้ำ หรือเชื่อมต่อระหว่างคัต โดยคิดราคาที่อัตราฐานเดียวกัน $0.002

สร้างเสียงและวิดีโอพร้อมกันด้วย Ltx-2 API

Ltx-2 API ผสานโหมดการสร้างจากข้อความ รูปภาพ และการต่อขยายเข้ากับเสียงที่ซิงก์กันแบบเนทีฟ ควบคุมจำนวนเฟรมได้ และมีพรีเซ็ตอัตราส่วนภาพ 6 แบบ ทั้งหมดเรียกใช้ได้ผ่านคีย์เดียวที่เข้ากันได้กับ OpenAI พร้อมราคาจ่ายตามการใช้งานจริงที่โปร่งใส

จากข้อความสู่ฉากที่เสร็จสมบูรณ์ด้วย Ltx-2 API

บรรยายฉากได้สูงสุด 2,000 ตัวอักษร แล้ว Ltx-2 API จะเปลี่ยนข้อความล้วนให้เป็นคลิปที่เคลื่อนไหวและมีเสียง โดยไม่ต้องใช้แอสเซ็ตอ้างอิง พรอมป์ของคุณควบคุมตัวแบบ การเคลื่อนไหว แสง และพฤติกรรมของกล้อง ขณะที่ seed แบบไม่บังคับช่วยล็อกผลลัพธ์เพื่อการทำซ้ำและปรับแต่งได้อย่างสม่ำเสมอ เพราะทุกอย่างเริ่มจากภาษา จึงเหมาะกับการทำสตอรีบอร์ด การนำเสนอคอนเซปต์ และการสำรวจไอเดียอย่างรวดเร็วเมื่อคุณมีไอเดียแต่ยังไม่มีฟุตเทจ

ทำให้ภาพนิ่งใด ๆ มีชีวิต

ป้อนภาพนิ่งเพียงภาพเดียวในรูปแบบ jpg, png, webp, gif หรือ avif แล้วโมเดลจะทำให้ภาพนั้นเคลื่อนไหวเป็นวิดีโอพร้อมเสียงที่เข้ากัน พรอมป์จะกำหนดว่าภาพควรเคลื่อนไหวอย่างไร ตั้งแต่การค่อย ๆ push-in ไปจนถึงจังหวะแอ็กชันเต็มรูปแบบ โดยที่องค์ประกอบเดิมยังคงอยู่ ช่างภาพ นักออกแบบ และทีมผลิตภัณฑ์ใช้วิธีนี้เพื่อเปลี่ยนภาพ hero เพียงภาพเดียวให้กลายเป็นคอนเทนต์เคลื่อนไหวที่แชร์ได้ โดยไม่ต้องถ่ายใหม่

ต่อขยายคลิปได้อย่างไร้รอยต่อผ่าน Ltx-2 API

อัปโหลดคลิปที่มีอยู่ แล้ว Ltx-2 API จะสร้างต่อให้ทั้งไปข้างหน้าหรือย้อนกลับ โดยสร้างเฟรมเพิ่มเติมได้สูงสุด 481 เฟรมที่สืบทอดสไตล์และจังหวะจากต้นฉบับ ตัวเลือก match_input_fps ช่วยล็อกฟุตเทจใหม่ให้ตรงกับเฟรมเรตของแหล่งที่มา ทำให้รอยต่อดูแนบเนียน นี่คือวิธีเปลี่ยนเทคสั้นให้กลายเป็นซีเควนซ์ยาว และช่วยกู้ฉากที่จบเร็วไปเพียงจังหวะเดียว

กำหนดจำนวนเฟรมและอัตราส่วนภาพได้ตามต้องการ

ควบคุมจำนวนเฟรมได้เต็มที่ตั้งแต่ 25 ถึง 257 เฟรมในโหมดข้อความและรูปภาพ โดยตั้งค่าเป็นจำนวนที่เป็นผลคูณของแปดบวกหนึ่งเสมอเพื่อการ sampling ที่สะอาด พรีเซ็ตความละเอียด 6 แบบครอบคลุม HD แบบสี่เหลี่ยมจัตุรัสที่ 1024 by 1024, สี่เหลี่ยมจัตุรัส 512, แนวตั้ง 3:4, แนวตั้ง 9:16, แนวนอน 4:3 และแนวนอน 16:9 ทำให้โมเดลเดียวรองรับทั้งภาพยนตร์ โซเชียล และฟีดแนวตั้ง เลือกรูปทรงก่อน แล้วให้คำขอเดียวส่งคืนครอปที่ถูกต้อง

คีย์เดียวและการรันที่ทำซ้ำได้บน Ltx-2 API

ทุกคำขอส่งผ่านคีย์เดียวที่เข้ากันได้กับ OpenAI บน Atlas Cloud พร้อมราคาจ่ายตามการใช้งานจริงที่โปร่งใสและไม่มีการสมัครสมาชิก ส่ง seed คงที่พร้อมพรอมป์เดิม แล้วโมเดลจะคืนคลิปเดิม ทำให้การสร้างที่เคยคาดเดายากกลายเป็นขั้นตอนที่ควบคุมและจัดเวอร์ชันได้ การเข้าถึงแบบ Day-0 หมายความว่า Ltx-2 API รุ่นใหม่จะเรียกใช้ได้ทันทีที่เปิดตัว ทีมจึงสามารถทำมาตรฐานให้กับ video pipeline และสเกลได้โดยไม่ต้องจัดการ GPUs

พรอมต์เดียว สามเอนจิน: เทียบ Ltx-2 API แบบตัวต่อตัว

ส่งพรอมต์เดียวกันทุกประการไปยัง Ltx-2 API และโมเดลวิดีโอยอดนิยมอีกสองตัวบน Atlas Cloud จากนั้นเปรียบเทียบว่าแต่ละตัวจัดการการเคลื่อนไหว เสียงที่ซิงก์กัน และรายละเอียดแบบภาพยนตร์จากคำสั่งชุดเดียวกันอย่างไร

พรอมต์

ลิงแสมขี้สงสัยตัวหนึ่งพุ่งลัดเลาะผ่านตลาดเครื่องเทศ Marrakech ที่แน่นขนัดในช่วง golden hour แล้วฉก fez สีแดงสดของพ่อค้าออกจากแผง มันกระโดดข้ามกระสอบ saffron และ paprika ที่เปิดอยู่จนฝุ่นสีส้มฟุ้งวนขึ้นมา จากนั้นหยุดนิ่งอยู่บนยอดเสา canopy แล้วเหลียวกลับมามองพอดีกับที่พ่อค้าหัวเราะพลางวิ่งไล่ตาม เปิดด้วยช็อต tracking มุมต่ำที่เคลื่อนตามหลังลิงฝ่าฝูงชน whip pan ไปยังใบหน้าตกใจของพ่อค้า แล้วค่อยยกขึ้นเป็นช็อต crane กวาดกว้างเหนือแผงค้าทั้งหมด ขณะที่ฝุ่นระยิบระยับในแสงอุ่น สไตล์ภาพยนตร์สมจริง ระยะชัดตื้น โทนสี earthy เข้มข้น Audio: เสียงตลาดคึกคัก เสียงทองเหลืองกระทบกัน และจังหวะกลองมือที่เร่งเร้าขึ้นพร้อมการไล่ล่า 16:9 aspect ratio.

Generated with Ltx 2.3 Quality on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

พรอมต์

ผู้ส่งสารบนฟ้าวัยเยาว์ในผ้าคลุม crimson ที่พลิ้วไหว กระโจนออกจากขอบวิหารหินลอยฟ้า แล้วขี่นกกระเรียนกระดาษกลไกฝ่าหมู่เมฆในหุบเขา เลี้ยวหลบโคมไฟเรืองแสงที่ลอยอยู่ เธอเอียงตัวเลี้ยวแรงอ้อมยอดหินแหลม คว้าจดหมายระยิบระยับกลางอากาศ แล้วหุบตัวดิ่งลงอย่างชัน ขณะที่นักร่อนคู่แข่งทะลุหมอกตามมาติด ๆ เริ่มด้วยมุมมอง first-person POV เหนือไหล่ของเธอตอนนกกระเรียนทะยานขึ้น ตัดไปเป็นช็อต drone ที่พุ่งเคียงข้างการดิ่ง แล้วลดลงเป็นช็อตมุมต่ำเงยขึ้นเมื่อเธอเชิดตัวออกจากการดิ่งเข้าสู่แสงอาทิตย์จ้าจนตาพร่า สไตล์ anime สีสันสดใส แบบ cel-shaded พาเลต luminous magic-hour Audio: เสียงลมพุ่งผ่าน เสียงปีกกระดาษกระพือ และเสียงเครื่องสายออร์เคสตราที่พุ่งสูงอย่างยิ่งใหญ่ตรงจังหวะเชิดตัวขึ้น 16:9 aspect ratio.

Generated with Ltx 2.3 Quality on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

ส่งมอบวิดีโอและเสียงระดับโปรดักชันด้วย Ltx-2 API

ตั้งแต่พรอมป์ข้อความและรูปภาพ ไปจนถึงคลิปยาวและเสียงที่ซิงค์กัน Ltx-2 API ครอบคลุมเส้นทางทั้งหมดตั้งแต่ร่างแรกจนถึงการส่งมอบ 4K สำหรับงานการตลาด อีคอมเมิร์ซ และโปรดักชันเชิงสร้างสรรค์

สร้างวิดีโอจากพรอมป์ด้วย Ltx-2 API

พรอมป์ที่เขียนเพียงชุดเดียวช่วยให้ Ltx-2 API สร้างวิดีโอ native 4K พร้อมเสียงที่สร้างในกระบวนการเดียวกันได้ สตูดิโอและทีมโฆษณาสามารถแปลงบรีฟแคมเปญให้เป็นสปอตโซเชียลที่พร้อมใช้งาน โดยไม่ต้องใช้กล้องหรือการตัดต่อด้วยมือ

ทำให้ภาพนิ่งเคลื่อนไหว

อัปโหลดภาพนิ่งเพียงภาพเดียว แล้วการสร้างแบบ image-to-video จะทำให้ภาพนั้นเคลื่อนไหว โดยคงองค์ประกอบของต้นฉบับไว้พร้อมเพิ่มการเคลื่อนกล้องที่สมจริง ผู้ขายอีคอมเมิร์ซและนักวาดภาพประกอบสามารถทำให้แคตตาล็อกและพอร์ตโฟลิโอแบบนิ่งมีชีวิตชีวาในฟีดที่หยุดนิ้วผู้ชมได้

ต่อคลิปให้เป็นฉากที่ยาวขึ้น

ต้องการเทคที่ยาวขึ้นใช่ไหม endpoint extend-video จะต่อเฟรมใหม่เข้ากับคลิปที่มีอยู่ พร้อมรักษาการเคลื่อนไหว สไตล์ และเสียงให้ต่อเนื่อง ครีเอเตอร์สามารถร้อยงานสร้างสั้น ๆ ให้เป็นเรื่องเล่าที่ลื่นไหลเกินขีดจำกัดของคำขอเดียว

เสียงที่ซิงค์กันผ่าน Ltx-2 API

เมื่อเสียงเป็นเรื่องสำคัญ Ltx-2 API จะสังเคราะห์บทพูด foley และเสียงบรรยากาศพร้อมกับภาพในครั้งเดียว โดยล็อกให้ตรงกับการเคลื่อนไหว เหมาะสำหรับวิดีโออธิบาย เทรลเลอร์ และฉากที่ต้องการเสียงเข้าจังหวะพอดี

มาสเตอร์ 4K จาก Ltx-2 API

สำหรับการส่งมอบขั้นสุดท้าย Ltx-2 API เรนเดอร์เฟรม native 4K พร้อมการเคลื่อนไหวที่สะอาดตาและพื้นผิวคมชัด แทนที่จะเป็นพรีวิวที่อัปสเกล เอเจนซีและสตูดิโอสามารถส่งออกมาสเตอร์พร้อมออกอากาศจาก endpoint เข้าสู่ไปป์ไลน์ตัดต่อได้โดยตรง

ขยายการสร้างแบบแบตช์ในต้นทุนที่คุ้มค่า

เพราะ LTX-2 เป็น open model ที่มีประสิทธิภาพ งานปริมาณมากจึงรันได้บนราคาจ่ายตามการใช้งานจริงที่โปร่งใส พร้อมให้คุณสลับโหมดประสิทธิภาพได้ในแต่ละคำขอ ทีมผลิตภัณฑ์สามารถทำต้นแบบได้ในต้นทุนต่ำ แล้วค่อยเพิ่มความละเอียดสมจริงสำหรับการปล่อยใช้งาน

Ltx-2 API เมื่อเทียบกับโมเดลวิดีโอสำหรับงานโปรดักชันอื่น ๆ

เปรียบเทียบ Ltx-2 API กับโมเดลวิดีโอที่ขับเคลื่อนด้วยข้อความและรูปภาพที่ใกล้เคียงกันบน Atlas Cloud ในด้านโหมดการสร้าง ความละเอียด เสียงเนทีฟ ความยาวคลิป และราคาเริ่มต้น

โมเดลโหมดการสร้างความละเอียดสูงสุดเสียงที่ซิงโครไนซ์ความยาวคลิปสูงสุดราคาเริ่มต้น
LTX-2.3 Quality Text-to-Videoสร้างวิดีโอจากข้อความพรีเซ็ต 1024×1024 (ค่าเริ่มต้น 16:9)√ (สลับเปิด/ปิดได้ตามต้องการ)สูงสุด 257 เฟรม$0.002
LTX-2.3 Quality Image-to-Videoสร้างวิดีโอจากรูปภาพ, ขยายต่อพรีเซ็ต 1024×1024 (ค่าเริ่มต้น 16:9)√ (สลับเปิด/ปิดได้ตามต้องการ)สูงสุด 257 เฟรม$0.002
Seedance 2.0 Text-to-Videoสร้างวิดีโอจากข้อความสูงสุด 2K√ เนทีฟ4 ถึง 15 s$0.112
Veo 3.1 Text-to-Videoสร้างวิดีโอจากข้อความสูงสุด 4K√ เนทีฟ8 s (ขยายต่อได้)$0.2
Kling Video O3 4K Text-to-Videoสร้างวิดีโอจากข้อความและรูปภาพNative 4K (3840×2160)√ เนทีฟ3 ถึง 15 s$0.42

วิธีใช้ Ltx-2 บน Atlas Cloud

เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud

สร้างบัญชี Atlas Cloud

สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล

ทำไมต้องใช้ Ltx-2 บน Atlas Cloud

การรวมโมเดล Ltx-2 ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้

ประสิทธิภาพและความยืดหยุ่น

เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์

API แบบรวมศูนย์:
รัน Ltx-2, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว

ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless

องค์กรและขนาด

ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต

ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม

ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา

Ltx-2 API: คำตอบสำหรับคำถามที่นักพัฒนาพบบ่อย

Ltx-2 API ช่วยให้นักพัฒนาเข้าถึง LTX-2 ซึ่งเป็นโมเดล foundation ด้านเสียง-วิดีโอแบบ open-weight จาก Lightricks ผ่านโปรแกรมได้ โดยแปลงพรอมป์ข้อความหรือรูปภาพให้เป็นวิดีโอและเสียงที่ซิงโครไนซ์กันในรอบการสร้างเดียว และบน Atlas Cloud คุณเข้าถึงได้ผ่าน endpoint เดียวที่เข้ากันได้กับ OpenAI พร้อมการคิดค่าบริการตามการใช้งานจริง

LTX-2 รองรับ text-to-video, image-to-video และการขยายคลิป คุณจึงเปลี่ยนฉากที่เขียนไว้ให้เป็นภาพเคลื่อนไหว ทำให้ภาพนิ่งเคลื่อนไหว หรือยืดความยาวช็อตที่มีอยู่แล้วได้ ทุกโหมดสามารถเรนเดอร์เสียงประกอบได้ จึงเหมาะกับหนังสั้น โฆษณา เดโมสินค้า และคอนเทนต์โซเชียล

ใช่ เสียงและวิดีโอถูกสร้างขึ้นในรอบเดียวที่ซิงโครไนซ์กัน ไม่ใช่นำมาต่อรวมกันภายหลัง โดยครอบคลุมทั้งลิปซิงก์บทสนทนา ซาวด์เอฟเฟกต์ และเสียงบรรยากาศ บน Atlas Cloud คุณเปิดใช้ได้ด้วยพารามิเตอร์ generate_audio ซึ่งปิดอยู่ตามค่าเริ่มต้น

โมเดล LTX-2 รองรับแบบเนทีฟได้สูงสุดถึงความละเอียด 4K ที่สูงสุด 50 fps โดยคลิปยาวได้ถึง 20 วินาที ครอบคลุมเฟรมเรต 24, 25, 48 และ 50 บน Atlas Cloud endpoint แบบ quality ให้คุณเลือกอัตราส่วนภาพและกำหนดความยาวคลิปผ่านจำนวนเฟรมระหว่าง 25 ถึง 257 เฟรมได้

ส่งคำขอมาตรฐานไปยัง Atlas Cloud endpoint พร้อมพรอมป์ของคุณ โมเดล เช่น ltx-2.3-quality/text-to-video อัตราส่วนภาพ จำนวนเฟรม และ seed แบบไม่บังคับเพื่อให้สร้างผลลัพธ์ซ้ำได้ เนื่องจาก endpoint เข้ากันได้กับ OpenAI คีย์เดียวจึงใช้ได้ทั้งกับ Ltx-2 API และโมเดลอื่นทั้งหมดบนแพลตฟอร์ม การผสานรวมจึงมักใช้เวลาเพียงไม่กี่นาที

ได้แน่นอน โมเดล ltx-2.3-quality/extend-video จะต่อความยาวคลิป LTX-2 ที่มีอยู่ โดยยังคงความสอดคล้องของการเคลื่อนไหวและเสียงหลังจากความยาวเดิม เหมาะเมื่อการสร้างครั้งเดียวให้ความยาวสั้นกว่าที่ฉากต้องการจริง

LTX-2 มาพร้อม open weights และมีประสิทธิภาพพอที่จะรันบน GPU ระดับผู้บริโภคได้ ดังนั้นการ self-host จึงเป็นทางเลือกที่ทำได้จริง หากคุณไม่อยากจัดเตรียม GPU จัดการคิว และดูแลการสเกล Hosted API จะให้โมเดลเดียวกันโดยไม่ต้องดูแลโครงสร้างพื้นฐานเอง

Atlas Cloud คิดค่าบริการ Ltx-2 API ตามการใช้งานจริง พร้อมราคาต่อการเรียกใช้ที่โปร่งใส และไม่มีค่าสมัครสมาชิกหรือข้อผูกมัดขั้นต่ำ คุณจ่ายเฉพาะสิ่งที่สร้าง และคีย์เดียวกันยังให้คุณเข้าถึงโมเดลรุ่นใหม่ได้ตั้งแต่ Day-0 เริ่มสร้างได้วันนี้

LTX-2.3 คือเวอร์ชันปัจจุบันของตระกูล LTX-2 และเป็นเวอร์ชันที่ Atlas Cloud ให้บริการผ่าน endpoint แบบ quality สำหรับ text-to-video, image-to-video และ extend-video โดยปรับปรุงจากรุ่นแรก ขณะยังคงแนวทางสร้างเสียงและวิดีโอที่ซิงโครไนซ์กันเหมือนเดิม คุณจึงได้คุณภาพล่าสุดโดยไม่ต้องเปลี่ยนวิธีเรียกใช้โมเดล

สำรวจกลุ่มเพิ่มเติม

Seedance 2.5

Seedance 2.5 API พร้อมใช้งานแล้วบน Atlas Cloud! มอบโมเดลวิดีโอใหม่ล่าสุดของ ByteDance ให้กับนักพัฒนา สร้างวิดีโอเนทีฟได้นานถึง 30 วินาทีในการประมวลผลเพียงครั้งเดียวจากข้อความ รูปภาพเดียว หรือการอ้างอิงหลายรูปแบบสูงสุด 50 รายการ พร้อมเสียงที่ซิงโครไนซ์และข้อความหลายภาษาในเฟรม บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว โดยมีความสอดคล้องของวัตถุและระบบฟิสิกส์ที่ได้รับการปรับปรุงซึ่งช่วยให้ภาพระยะยาวมีความต่อเนื่อง

ดูกลุ่ม

Wan 3.0

Wan 3.0 API คือเจเนอเรชันถัดไปของตระกูลวิดีโอ Wan จาก Alibaba ซึ่งสร้างขึ้นเพื่อยกระดับการสร้างวิดีโอแบบยาว การควบคุมแบบหลายข้อมูลอ้างอิง และคุณภาพของภาพและเสียงให้ก้าวไปอีกขั้น Atlas Cloud ได้โฮสต์ Wan 2.7, 2.6 และ 2.5 ไว้แล้ว และ Wan 3.0 สามารถทำงานบนคีย์แบบรวมเดียวกันโดยไม่ต้องตั้งค่าแยกต่างหาก เริ่มต้นสร้างสรรค์ได้ตั้งแต่วันนี้ เลื่อนลงไปที่ส่วนจัดแสดงเพื่อดูว่า Wan 3.0 สามารถสร้างอะไรได้บ้าง

ดูกลุ่ม

MiniMax H3

MiniMax H3 คือกลุ่มโมเดลวิดีโอของ MiniMax สำหรับการสร้างวิดีโอจากข้อความ รูปภาพ และข้อมูลอ้างอิง สร้างคลิปความยาว 5 ถึง 15 วินาที กำหนดการเคลื่อนไหวด้วยเฟรมสุดท้ายที่เลือกใช้ได้ รักษาองค์ประกอบของวัตถุจากรูปภาพอ้างอิง หรือเลือก H3 Developer เมื่อเสียงที่สร้างขึ้นเหมาะกับเวิร์กโฟลว์ของคุณ Atlas Cloud รวม H3, H3 Fast, H3 Max และ H3 Developer ไว้ในเวิร์กโฟลว์ API เดียว พร้อมราคาแบบมาตรฐานเริ่มต้นที่ $0.038 ต่อวินาที เริ่มพัฒนาได้แล้ววันนี้

ดูกลุ่ม

Seedream 5.0 Pro

Seedream 5.0 Pro API มอบโมเดลการแก้ไขภาพที่ควบคุมได้ของ ByteDance บน Atlas Cloud ให้กับนักพัฒนา โดยจะวางการแก้ไขอย่างแม่นยำด้วยจุดยึดและพิกัด แยกภาพออกเป็นเลเยอร์ที่แก้ไขได้ ผสานข้อมูลอ้างอิงหลายรายการ และจับคู่สีและวัสดุที่แน่นอน พร้อมข้อความหลายภาษาที่ความละเอียด 2K และ 3K บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว!

ดูกลุ่ม

Seedance 2.0

Seedance 2.0 API ให้คุณเข้าถึงระดับโปรดักชันของโมเดลวิดีโอแบบมัลติโมดัลจาก ByteDance — รองรับอินพุต 4 รูปแบบ (ข้อความ, รูปภาพ, วิดีโอ, เสียง) และระบบ "Universal Reference" ชั้นนำของอุตสาหกรรมที่ล็อกองค์ประกอบภาพ การเคลื่อนไหวของกล้อง และการกระทำของตัวละครในทุกช็อต ผสานรวมการควบคุมระดับผู้กำกับด้วยการเรียกใช้ API เพียงครั้งเดียว ในราคาคงที่ $0.09/วินาที รับคีย์ได้ทันที และไม่มีคิวรอ — พร้อมการรับประกันเวลาพร้อมใช้งานและการปฏิบัติตามข้อกำหนดระดับองค์กร Seedance 2.0 Native 4K เปิดใช้งานแล้ววันนี้!

ดูกลุ่ม

GPT Image 2.5

ตระกูล GPT Image 2.5 จาก OpenAI ให้ทางเลือกแก่นักพัฒนาในการใช้ Flare และ Sunburst สำหรับเวิร์กโฟลว์รูปภาพในระดับโปรดักชัน เรนเดอร์ที่ความละเอียดใดก็ได้สูงสุด 3840x2160 และเลือกจากระดับคุณภาพห้าระดับ รวมถึง xhigh และ max เพื่อให้ตรงตามความต้องการผลลัพธ์ที่เฉพาะเจาะจง Atlas Cloud ให้บริการการอนุมาน REST ที่พร้อมใช้งานโดยไม่มีการเริ่มต้นแบบเย็นและราคามาตรฐานเริ่มต้นที่ 0.004 ดอลลาร์ต่อการสร้าง เริ่มต้นสร้างได้แล้ววันนี้

ดูกลุ่ม

GPT Image 2

GPT Image 2 API ช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลรูปภาพล่าสุดของ OpenAI ซึ่งเป็นรุ่นสืบทอดจาก GPT Image 1.5 โดยสามารถสร้างและแก้ไขรูปภาพพร้อมกับการเรนเดอร์ข้อความที่แม่นยำทั้งในอักษรละตินและ CJK รวมถึงการจัดวางองค์ประกอบที่ยอดเยี่ยมสำหรับโปสเตอร์ ม็อกอัป และอินโฟกราฟิก บน Atlas Cloud คุณสามารถเข้าถึงโมเดลนี้ผ่าน API ที่เป็นหนึ่งเดียวร่วมกับโมเดลอื่นๆ อีกกว่า 300 รุ่น พร้อมเครดิตฟรี เวลาทำงาน 99.99% และไม่จำเป็นต้องมีการตรวจสอบยืนยันองค์กรจาก OpenAI

ดูกลุ่ม

Gemini Omni Flash

API ของ gemini omni นำตระกูล Gemini Omni Flash แบบมัลติโมดัลโดยกำเนิดจาก Google DeepMind ซึ่งรวมถึง Gemini Omni 1.1 Flash มาสู่นักพัฒนา สร้างวิดีโอสไตล์ภาพยนตร์พร้อมเสียงเนทีฟที่ซิงโครไนซ์กัน ทำให้ภาพนิ่งเคลื่อนไหวได้ด้วยการควบคุมเฟรมเริ่มต้นและเฟรมสิ้นสุดอย่างแม่นยำ หรือปรับแก้ฟุตเทจที่มีอยู่ผ่านการแก้ไขด้วยคำสั่งข้อความ โดยยังคงรักษาเนื้อหาที่ไม่ได้แก้ไขไว้ Atlas Cloud มอบคีย์เดียวที่เข้ากันได้กับ OpenAI การเข้าถึงแบบรวมศูนย์ และราคาที่โปร่งใสโดยคิดค่าบริการตามการใช้งาน เริ่มพัฒนาได้วันนี้

ดูกลุ่ม

Grok Imagine

Grok Imagine API ครอบคลุมโมเดลรูปภาพ วิดีโอ และพูดของ xAI ตั้งแต่ Image 2.0 ถึง Video 1.5 และ xAI TTS v1 สร้างรูปภาพนิ่ง 1K หรือ 2K ในอัตราส่วน 14 แบบ ขยายฉากไปยัง 15 วินาทีของวิดีโอ 1080p ควบคุมภาพด้วยรูปภาพอ้างอิงได้ถึง 7 รูป หรือเพิ่มบรรยายเสียงในภาษา 20 ภาษา Atlas Cloud รันทุกโหมดบนเอนด์พอยต์เดียว มีราคาแบบจ่ายตามการใช้งาน ตั้งแต่ $0.02 ต่อรูปภาพและ $0.05 ต่อวินาที เริ่มสร้างวันนี้

ดูกลุ่ม

Google

โมเดลเชิงสร้างสรรค์ที่ทรงพลังที่สุดของ Google พร้อมใช้งานแล้วบน Atlas Cloud โดย Veo 3.1 นำเสนอการสร้างวิดีโอระดับภาพยนตร์ Nano Banana 2 ขับเคลื่อนการสร้างภาพที่มีความเที่ยงตรงสูง และ Gemini นำความชาญฉลาดแบบมัลติโมดัลมาสู่ทุกเวิร์กโฟลว์ เข้าถึงชุดโมเดลของ Google เต็มรูปแบบผ่าน API key เดียวพร้อมความพร้อมใช้งานระดับ Day-0 และการกำหนดราคาแบบจ่ายตามการใช้งาน (pay-as-you-go)

ดูกลุ่ม

Seedance 2.0 Mini

Seedance 2.0 Mini นำเสนอการสร้างวิดีโอแบบมัลติโมดัลของ ByteDance สู่เวิร์กโฟลว์ที่ความเร็วและต้นทุนมีความสำคัญสูงสุด โดยมอบความสามารถหลักของ Seedance 2.0 ในรูปแบบที่ใช้ทรัพยากรน้อยลง — สร้างได้เร็วกว่า ต้นทุนต่อวิดีโอต่ำกว่า และใช้การผสานรวม API เดิมที่คุณใช้อยู่แล้ว สำหรับทีมที่จัดการไปป์ไลน์ปริมาณมากหรือสร้างต้นแบบในสเกลขนาดใหญ่ Mini คือตัวเลือกเริ่มต้นที่ใช้งานได้จริง

ดูกลุ่ม

ByteDance

ตั้งแต่การสร้างวิดีโอระดับภาพยนตร์ไปจนถึงการสร้างภาพที่มีความละเอียดสูง โมเดลที่ทรงพลังที่สุดของ ByteDance พร้อมใช้งานแล้วบน Atlas Cloud รัน Seedance และ Seedream ในสเกลขนาดใหญ่ด้วยราคาการอนุมานที่ต่ำที่สุด และไม่มีค่าใช้จ่ายแฝงด้านโครงสร้างพื้นฐาน

ดูกลุ่ม

API เดียวสำหรับ AI สื่อทุกประเภท

สำรวจโมเดลทั้งหมด