Seedance 2.5 ใช้งานได้แล้ววันนี้ — ที่แรกบน Atlas Cloud

Wan 3.0 API is Coming to Atlas Cloud Soon

Wan 3.0 API คือเจเนอเรชันถัดไปของตระกูลวิดีโอ Wan จาก Alibaba ที่สร้างขึ้นเพื่อยกระดับการสร้างวิดีโอแบบยาว การควบคุมแบบหลายแหล่งอ้างอิง และคุณภาพของภาพและเสียงให้ก้าวไปอีกขั้น Atlas Cloud ได้โฮสต์ Wan 2.7, 2.6 และ 2.5 ไว้แล้ว ดังนั้น Wan 3.0 จะใช้คีย์แบบรวมศูนย์เดียวกันและทำงานได้โดยไม่ต้องตั้งค่าแยกต่างหาก รับสิทธิ์การเข้าถึงล่วงหน้าในวันที่เปิดตัว เลื่อนลงไปที่ส่วนจัดแสดงเพื่อดูตัวอย่างล่วงหน้าว่า Wan 3.0 สามารถสร้างอะไรได้บ้าง

Wan 3.0 พัฒนาโดย Alibaba โดย Atlas Cloud (ดำเนินการโดย Atlas Cloud AI LLC) เป็นผู้ให้บริการเข้าถึงโมเดลนี้ แต่ไม่ได้เป็นเจ้าของโมเดล เครื่องหมายการค้าทั้งหมดเป็นของเจ้าของที่เกี่ยวข้อง

เร็วๆ นี้

โมเดลกำลังจะเปิดตัว

เรากำลังเก็บรายละเอียดสุดท้ายของคอลเลกชันนี้ — ในระหว่างนี้ ลองสำรวจคอลเลกชันที่คล้ายกันด้านล่าง

สำรวจกลุ่มเพิ่มเติม

Seedance 2.5

Seedance 2.5 API พร้อมใช้งานแล้วบน Atlas Cloud! มอบโมเดลวิดีโอใหม่ล่าสุดของ ByteDance ให้กับนักพัฒนา สร้างวิดีโอเนทีฟได้นานถึง 30 วินาทีในการประมวลผลเพียงครั้งเดียวจากข้อความ รูปภาพเดียว หรือการอ้างอิงหลายรูปแบบสูงสุด 50 รายการ พร้อมเสียงที่ซิงโครไนซ์และข้อความหลายภาษาในเฟรม บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว โดยมีความสอดคล้องของวัตถุและระบบฟิสิกส์ที่ได้รับการปรับปรุงซึ่งช่วยให้ภาพระยะยาวมีความต่อเนื่อง

ดูกลุ่ม

MiniMax H3

MiniMax H3 API เปิดให้ใช้งานโมเดลวิดีโอมัลติโหมดอเนกประสงค์ของ MiniMax ซึ่งอ่าน text, images, video และ audio เป็นบริบทเดียว แทนที่จะประมวลผลทีละงาน คลิปมีความยาว 5 ถึง 15 วินาทีที่ 24 FPS รองรับอัตราส่วนภาพตั้งแต่ 21:9 ถึง 9:16 และ prompt เดียวสามารถสลับตัวละคร เปลี่ยนฉากหลัง เขียนบทสนทนาใหม่ หรือโคลนเสียงจากคลิปอ้างอิงได้ Atlas Cloud ให้บริการทั้งหมดนี้ผ่าน endpoint เดียวที่เข้ากันได้กับ OpenAI เริ่มสร้างได้วันนี้

ดูกลุ่ม

Seedream 5.0 Pro

Seedream 5.0 Pro API มอบโมเดลการแก้ไขภาพที่ควบคุมได้ของ ByteDance บน Atlas Cloud ให้กับนักพัฒนา โดยจะวางการแก้ไขอย่างแม่นยำด้วยจุดยึดและพิกัด แยกภาพออกเป็นเลเยอร์ที่แก้ไขได้ ผสานข้อมูลอ้างอิงหลายรายการ และจับคู่สีและวัสดุที่แน่นอน พร้อมข้อความหลายภาษาที่ความละเอียด 2K และ 3K บน Atlas Cloud คุณสามารถเข้าถึงได้ผ่านคีย์เดียว!

ดูกลุ่ม

Seedance 2.0

Seedance 2.0 API ให้คุณเข้าถึงระดับโปรดักชันของโมเดลวิดีโอแบบมัลติโมดัลจาก ByteDance — รองรับอินพุต 4 รูปแบบ (ข้อความ, รูปภาพ, วิดีโอ, เสียง) และระบบ "Universal Reference" ชั้นนำของอุตสาหกรรมที่ล็อกองค์ประกอบภาพ การเคลื่อนไหวของกล้อง และการกระทำของตัวละครในทุกช็อต ผสานรวมการควบคุมระดับผู้กำกับด้วยการเรียกใช้ API เพียงครั้งเดียว ในราคาคงที่ $0.09/วินาที รับคีย์ได้ทันที และไม่มีคิวรอ — พร้อมการรับประกันเวลาพร้อมใช้งานและการปฏิบัติตามข้อกำหนดระดับองค์กร Seedance 2.0 Native 4K เปิดใช้งานแล้ววันนี้!

ดูกลุ่ม

GPT Image 2

GPT Image 2 API ช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลรูปภาพล่าสุดของ OpenAI ซึ่งเป็นรุ่นสืบทอดจาก GPT Image 1.5 โดยสามารถสร้างและแก้ไขรูปภาพพร้อมกับการเรนเดอร์ข้อความที่แม่นยำทั้งในอักษรละตินและ CJK รวมถึงการจัดวางองค์ประกอบที่ยอดเยี่ยมสำหรับโปสเตอร์ ม็อกอัป และอินโฟกราฟิก บน Atlas Cloud คุณสามารถเข้าถึงโมเดลนี้ผ่าน API ที่เป็นหนึ่งเดียวร่วมกับโมเดลอื่นๆ อีกกว่า 300 รุ่น พร้อมเครดิตฟรี เวลาทำงาน 99.99% และไม่จำเป็นต้องมีการตรวจสอบยืนยันองค์กรจาก OpenAI

ดูกลุ่ม

Gemini Omni Flash

Gemini Omni API นำโมเดลสร้างและแก้ไขวิดีโอแบบมัลติโมดัลของ Google DeepMind ซึ่งเปิดตัวในงาน Google I/O 2026 มาสู่สแต็กของคุณ Gemini Omni ผสานเอนจินการใช้เหตุผลของ Gemini เข้ากับสื่อเชิงสร้างสรรค์ รองรับอินพุตทุกรูปแบบทั้งข้อความ รูปภาพ วิดีโอ และเสียง เพื่อสร้างผลลัพธ์ที่สอดคล้องกันและอิงตามความรู้ ปรับแต่งผลลัพธ์ผ่านการสนทนาอย่างเป็นธรรมชาติ ไม่ว่าจะเปลี่ยนวัตถุ เขียนฉากใหม่ หรือปรับสไตล์ โดยที่ฟิสิกส์ ตัวละคร และความต่อเนื่องยังคงเดิม Atlas Cloud ให้บริการ Gemini Omni Flash ครบทั้งไลน์อัป ทั้งการสร้างวิดีโอจากข้อความ การสร้างวิดีโอจากรูปภาพพร้อมรูปอ้างอิงสูงสุด 7 รูป และการสร้างวิดีโอจากรูปอ้างอิง ผ่าน API เดียวแบบครบวงจร ด้วยราคาต่อวินาทีที่โปร่งใสเริ่มต้นที่ $0.112 โดยไม่ต้องสมัครสมาชิก เริ่มสร้างได้เลยวันนี้

ดูกลุ่ม

Grok Imagine

Grok Imagine API ครอบคลุมโมเดลรูปภาพ วิดีโอ และพูดของ xAI ตั้งแต่ Image 2.0 ถึง Video 1.5 และ xAI TTS v1 สร้างรูปภาพนิ่ง 1K หรือ 2K ในอัตราส่วน 14 แบบ ขยายฉากไปยัง 15 วินาทีของวิดีโอ 1080p ควบคุมภาพด้วยรูปภาพอ้างอิงได้ถึง 7 รูป หรือเพิ่มบรรยายเสียงในภาษา 20 ภาษา Atlas Cloud รันทุกโหมดบนเอนด์พอยต์เดียว มีราคาแบบจ่ายตามการใช้งาน ตั้งแต่ $0.02 ต่อรูปภาพและ $0.05 ต่อวินาที เริ่มสร้างวันนี้

ดูกลุ่ม

Google

โมเดลเชิงสร้างสรรค์ที่ทรงพลังที่สุดของ Google พร้อมใช้งานแล้วบน Atlas Cloud โดย Veo 3.1 นำเสนอการสร้างวิดีโอระดับภาพยนตร์ Nano Banana 2 ขับเคลื่อนการสร้างภาพที่มีความเที่ยงตรงสูง และ Gemini นำความชาญฉลาดแบบมัลติโมดัลมาสู่ทุกเวิร์กโฟลว์ เข้าถึงชุดโมเดลของ Google เต็มรูปแบบผ่าน API key เดียวพร้อมความพร้อมใช้งานระดับ Day-0 และการกำหนดราคาแบบจ่ายตามการใช้งาน (pay-as-you-go)

ดูกลุ่ม

Seedance 2.0 Mini

Seedance 2.0 Mini นำเสนอการสร้างวิดีโอแบบมัลติโมดัลของ ByteDance สู่เวิร์กโฟลว์ที่ความเร็วและต้นทุนมีความสำคัญสูงสุด โดยมอบความสามารถหลักของ Seedance 2.0 ในรูปแบบที่ใช้ทรัพยากรน้อยลง — สร้างได้เร็วกว่า ต้นทุนต่อวิดีโอต่ำกว่า และใช้การผสานรวม API เดิมที่คุณใช้อยู่แล้ว สำหรับทีมที่จัดการไปป์ไลน์ปริมาณมากหรือสร้างต้นแบบในสเกลขนาดใหญ่ Mini คือตัวเลือกเริ่มต้นที่ใช้งานได้จริง

ดูกลุ่ม

ByteDance

ตั้งแต่การสร้างวิดีโอระดับภาพยนตร์ไปจนถึงการสร้างภาพที่มีความละเอียดสูง โมเดลที่ทรงพลังที่สุดของ ByteDance พร้อมใช้งานแล้วบน Atlas Cloud รัน Seedance และ Seedream ในสเกลขนาดใหญ่ด้วยราคาการอนุมานที่ต่ำที่สุด และไม่มีค่าใช้จ่ายแฝงด้านโครงสร้างพื้นฐาน

ดูกลุ่ม

Alibaba

Atlas Cloud รวบรวมโมเดลทั้งหมดของ Alibaba ไว้ใน API เดียว: Qwen สำหรับงานด้านภาษาและรูปภาพ และ Wan สำหรับการสร้างวิดีโอความละเอียดสูงสุด 1080p เข้าถึงทุกโมเดลในรูปแบบจ่ายตามการใช้งานจริง (pay-as-you-go) โดยไม่ต้องสมัครสมาชิก Alibaba API พร้อมใช้งานผ่าน base URL เดียวโดยใช้ไคลเอนต์ที่รองรับ OpenAI ที่คุณมีอยู่แล้ว

ดูกลุ่ม

OpenAI

Atlas Cloud ให้คุณเข้าถึงกลุ่มผลิตภัณฑ์ OpenAI API แบบครบวงจร ตั้งแต่ GPT Image 2 สำหรับการสร้างภาพถ่าย ไปจนถึง Sora 2 สำหรับวิดีโอ ทุกโมเดลพร้อมใช้งานแบบจ่ายตามการใช้งานจริง (pay-as-you-go) โดยไม่มีข้อผูกมัดรายเดือน เชื่อมต่อได้ง่ายดายด้วยการสลับ base URL เพียงจุดเดียวโดยใช้ API ที่เข้ากันได้กับ OpenAI

ดูกลุ่ม

Wan 3.0 ในการทำงาน

6 ความสามารถหลักที่แสดงให้เห็นว่าคำขอ Wan 3.0 เพียงครั้งเดียวสามารถสร้างอะไรได้บ้าง ตั้งแต่ภาพยนตร์แบรนด์แบบอ้างอิงหลายรายการไปจนถึงการถ่ายทำแบบรวดเดียวจบ 30 วินาที

ภาพยนตร์แบรนด์แบบอ้างอิงหลายแหล่ง

โหมด Omni สามารถนำเข้าข้อมูลวัสดุอ้างอิงได้สูงสุด 20 รายการ, รูปภาพ 10 รูป, คลิป 5 คลิป และแทร็กเสียง 5 แทร็ก รวมถึงเอกสารแหล่งที่มาหรือหน้าเว็บอีกหนึ่งรายการ เพื่อให้ชุดเครื่องมือแบรนด์ทั้งหมดกลายเป็นวิดีโอที่ตรงตามอัตลักษณ์ของแบรนด์เพียงหนึ่งเดียวในการประมวลผลแค่ครั้งเดียว

เรื่องราวแบบเทคเดียวความยาว 30 วินาที

เอาต์พุตดั้งเดิมความยาว 30 วินาทีมอบพื้นที่ให้การเล่าเรื่องได้ดำเนินไปอย่างเป็นธรรมชาติ รองรับการเคลื่อนไหวของกล้องที่ต่อเนื่องและฉากที่ถ่ายทำแบบลองเทคซึ่งคลิปที่สั้นกว่าไม่สามารถทำได้ ระบบควบคุมความยาวอัจฉริยะช่วยให้โมเดลสามารถกำหนดจังหวะของแต่ละฉากได้ด้วยตัวเอง

ความสอดคล้องของการอ้างอิงระดับพิกเซล

ใบหน้า ผลิตภัณฑ์ และรายละเอียดที่ละเอียดอ่อนจะถูกจำลองขึ้นใหม่ด้วยความเที่ยงตรงระดับพิกเซลในทุกเฟรม ทีมผู้ผลิตจะได้รับความแน่นอนในการส่งมอบงานตามที่ตัวละครที่ปรากฏซ้ำและสินทรัพย์ของแบรนด์ที่ต้องการความแม่นยำเรียกร้อง

เสียงที่ดื่มด่ำและความสมจริง

ความสมจริง พื้นผิวของภาพ และเสียงต้นฉบับได้รับการยกระดับไปพร้อมกัน ดังนั้นฉากที่สร้างขึ้นจึงมาพร้อมกับเสียงที่เข้ากันแทนที่จะเป็นภาพเคลื่อนไหวที่ไม่มีเสียง ผลลัพธ์ที่ได้จึงสร้างผลกระทบทางภาพและเสียงได้อย่างแท้จริง

การแก้ไขคำสั่งและข้อมูลอ้างอิง

การตัดต่อที่แม่นยำจะปรับปรุงฟุตเทจที่มีอยู่ตามคำสั่งที่เป็นลายลักษณ์อักษรหรือคลิปอ้างอิง โดยเปลี่ยนวัตถุ สไตล์ หรือช่วงเวลาโดยไม่ต้องสร้างวิดีโอใหม่ทั้งหมด

เอกสารและหน้าเว็บเป็นวิดีโอ

นอกเหนือจากข้อความ รูปภาพ เสียง และวิดีโอแล้ว Wan 3.0 ยังสามารถอ่านไฟล์ doc, xls, ppt, pdf และ md รวมถึงหน้าเว็บแบบเรียลไทม์ โดยเปลี่ยนรายงานหรือชุดสไลด์ให้เป็นคลิปที่เสร็จสมบูรณ์ได้โดยตรง

การเปรียบเทียบวิดีโอในพรอมต์เดียวกัน

รับชมวิดีโอพรีเซนเทชันที่สร้างขึ้นโดยโมเดล Wan 3.0, Seedance 2.5 และ Wan 2.7

พรอมต์

Generating a 30-second, 16:9 widescreen adult sci-fi war animated short film. Visual style: Ultra-photorealistic CGI Biomechanical structures Fusion of gray-white bone and black metal Insect-like joints Extremely fine bone texturing Dried blood streaks, ceramic cracks, and industrial oil grime Abandoned futuristic city Cold gray skylight Sparse toxic-green organisms High-contrast cinematic lighting Low-saturation cool color palette Minimal orange-red used only for flames and alarms Realistic physical destruction Oppressive, heavy, unheroic tone Characters no longer have complete flesh bodies. They are composed primarily of: Human spine Ribs Skull Black hydraulic muscle Metal joints Neural fiber optics Weapon interface ports The skeletons are not zombies — they are "legacy hardware" still being operated by military-industrial systems. Narrative & Dynamic Timeline 0–4 sec | Still Fighting After Death The shot opens on a soldier's dog tag lying in a pool of standing water. Want me to continue translating the rest of the timeline if you have more seconds/beats written out? This looks like it's cut off after the 0-4 second beat.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

พรอมต์

Generating a 15-second, 16:9 ultra-widescreen plush-universe adventure clip. A spaceship made of plush fabric, buttons, zippers, and stuffing cotton is fleeing at high speed through a universe made of giant yarn planets, fuzzy nebulae, and rag-doll megafauna. The ship is piloted by three small plush animals: a rabbit, a fox, and a crow. A giant interstellar whale-beast covered in deep-blue long plush fur, with eyes like two glass buttons, chases the ship out of the nebula. Overall style: ultra-fine plush textures, cinematic space scale, a strong contrast between cute appearance and intense action, exaggerated FPV camera work, and realistic soft-body physics. **15-Second Dynamic Timeline** **0–3 sec | Zipper Ship Ejection Launch** The shot is inside the plush ship, with a cockpit made of stitching, buttons, and fabric instrument panels. A red warning button flashes rapidly. The rabbit pulls down a giant zipper-lever control, and the ship's forward hatch splits open like a cloth sack. The camera pulls back rapidly from the cockpit, passes through the zipper hatch, and emerges outside the ship. The ship ejects and launches out of the knitted crater of a yarn planet. **3–6 sec | High-Speed Orbit Skimming the Yarn Planet** The camera hugs the ship's tail, flying low over the planet's surface. The ground is woven from giant strands of yarn: - Knitted mountain ranges streak past below at high speed - Loose thread-ends sway like a forest - The ship dodges sharply left and right - The camera continuously banks and rolls - The thrusters emit a trailing wake of white cotton fluff **6–8.5 sec | The Giant Plush Whale Appears** The fuzzy nebula suddenly parts to either side as a giant deep-blue plush whale bursts out from behind. The long fur on the whale's body is blown backward by the high-speed airflow, and its glass-button eyes reflect the planet's light. The camera whips halfway around the ship, switching to a rear-facing (reverse) view, so the whale continuously grows larger in the frame behind the ship.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

Wan 3.0 API - สร้างขึ้นสำหรับกระบวนการทำงานเชิงสร้างสรรค์ที่แท้จริง

การอัปเกรดของ Wan 3.0 มีที่มาจากความต้องการที่แท้จริงของอุตสาหกรรม โดยผสานเข้ากับเวิร์กโฟลว์การผลิตด้านล่างโดยตรง ตั้งแต่ละครสั้นไปจนถึงวิดีโอองค์กร

ภาพยนตร์, ทีวี, ซีรีส์สั้น & MV

การถ่ายทำแบบเนทีฟความยาว 30 วินาทีและการจำลองฉากจริงช่วยให้ภาพยนตร์ AI ละครสั้น และมิวสิกวิดีโอสามารถข้ามขั้นตอนการถ่ายทำจริงไปได้มาก ความสอดคล้องของพิกเซลช่วยรักษาภาพลักษณ์ของตัวละครหลักที่ปรากฏซ้ำ และเสียงเนทีฟถูกซิงค์เข้ากับทุกการตัดต่อได้อย่างสมบูรณ์แบบ

แอนิเมชัน แบรนด์ และ IP

การควบคุมสไตล์ทั้งหมดสามารถปรับเปลี่ยนจากความสมจริงไปจนถึงอนิเมะได้ภายในโมเดลเดียว ในขณะที่ความสม่ำเสมอของพิกเซลจะล็อกมาสคอต โลโก้ หรือตัวละคร IP ไว้ในทุกเฟรม แอนิเมชันแบรนด์แบบเต็มรูปแบบสามารถเรนเดอร์ได้โดยไม่ต้องผ่านขั้นตอนการผลิตที่ยุ่งยาก

การโฆษณาและการส่งเสริมองค์กร

การสร้างสรรค์แบบ Omni ก้าวข้ามขีดจำกัดของข้อความและรูปภาพสำหรับแบรนด์เครื่องใช้ไฟฟ้าในบ้าน ความงาม ยานยนต์ สินค้าอุปโภคบริโภค (FMCG) และเครื่องแต่งกาย เพียงป้อนหน้าผลิตภัณฑ์หรือรายงานของบริษัทโดยตรงเพื่อสร้างสรรค์ทุกสิ่ง ตั้งแต่การสาธิตผลิตภัณฑ์ไปจนถึงภาพยนตร์แบรนด์ขององค์กร

การออกแบบซอฟต์แวร์และผลิตภัณฑ์

ป้อนข้อมูลการสาธิต UI ของผลิตภัณฑ์ แอนิเมชันของฟีเจอร์ หรือการแสดงข้อมูลด้วยภาพ แล้ว Wan 3.0 จะคงความสวยงามดั้งเดิมไว้ในขณะที่เปลี่ยนให้เป็นชิ้นงานเคลื่อนไหวที่ขับเคลื่อนด้วยเรื่องราว ขั้นตอนการทำแอนิเมชันที่น่าเบื่อหน่ายจะหายไป

การศึกษา

การนำเข้าเอกสารสามารถอ่าน PDF, PPT หรือหน้าเว็บได้โดยตรง ดังนั้นบทเรียนหรือรายงานการวิจัยจึงกลายเป็นวิดีโออธิบายที่ชัดเจนโดยไม่ต้องใช้สคริปต์แยกต่างหาก เนื้อหาที่ซับซ้อนจะกลายเป็นภาพในขั้นตอนเดียว

การท่องเที่ยวเชิงวัฒนธรรม

การฟื้นฟูฉากจริงช่วยสร้างภูมิทัศน์ สถานที่ทางมรดก และอาหารท้องถิ่นขึ้นมาใหม่โดยไม่ต้องถ่ายทำในสเกลขนาดใหญ่ ทำให้ภาพยนตร์โปรโมตเมืองและการแปลงข้อมูลวัฒนธรรมเป็นดิจิทัลเสร็จสมบูรณ์ด้วยต้นทุนต่ำ สถานที่ห่างไกลจึงปรากฏอยู่ตรงหน้าผู้ชมอย่างสมจริง

วิธีใช้ Wan 3.0 บน Atlas Cloud

เริ่มต้นได้ในไม่กี่นาที — ทำตามขั้นตอนง่าย ๆ เหล่านี้เพื่อเชื่อมต่อและใช้งานโมเดลผ่านแพลตฟอร์ม Atlas Cloud

สร้างบัญชี Atlas Cloud

สมัครสมาชิกที่ atlascloud.ai และยืนยันตัวตน ผู้ใช้ใหม่จะได้รับเครดิตฟรีเพื่อสำรวจแพลตฟอร์มและทดสอบโมเดล

ทำไมต้องใช้ Wan 3.0 บน Atlas Cloud

การรวมโมเดล Wan 3.0 ขั้นสูงเข้ากับแพลตฟอร์มที่เร่งด้วย GPU ของ Atlas Cloud ให้ประสิทธิภาพ ความสามารถในการขยาย และประสบการณ์นักพัฒนาที่ไม่มีใครเทียบได้

ประสิทธิภาพและความยืดหยุ่น

เวลาแฝงต่ำ:
inference ที่ปรับแต่ง GPU เพื่อการตอบสนองแบบเรียลไทม์

API แบบรวมศูนย์:
รัน Wan 3.0, GPT, Gemini และ DeepSeek ด้วยการเชื่อมต่อเดียว

ราคาโปร่งใส:
ชำระเงินต่อโทเค็นที่คาดเดาได้พร้อมตัวเลือก serverless

องค์กรและขนาด

ประสบการณ์นักพัฒนา:
SDK, การวิเคราะห์, เครื่องมือปรับแต่ง และเทมเพลต

ความน่าเชื่อถือ:
ความพร้อมใช้งาน 99.99%, RBAC และการบันทึกที่พร้อมสำหรับการปฏิบัติตาม

ความปลอดภัยและการปฏิบัติตาม:
SOC 2 Type II, สอดคล้อง HIPAA, อธิปไตยข้อมูลในสหรัฐอเมริกา

คำถามที่พบบ่อยเกี่ยวกับ Wan 3.0 API

Wan 3.0 คือโมเดลวิดีโอแบบออลอินวันของ Alibaba เจเนอเรชันถัดไป ซึ่งขณะนี้อยู่ในช่วงทดสอบเบต้าสาธารณะ การร้องขอเพียงครั้งเดียวสามารถเปลี่ยนข้อความ รูปภาพ วิดีโอ เสียง เอกสาร หรือหน้าเว็บให้เป็นวิดีโอความยาวสูงสุด 30 วินาทีได้ และโมเดลนี้จะผสานอินพุตที่หลากหลายเข้ากับความสอดคล้องระดับพิกเซล การตัดต่อที่แม่นยำ และเสียงที่สร้างขึ้นโดยตรงจากระบบ

Atlas Cloud มีแผนที่จะเพิ่ม Wan 3.0 API ทันทีที่ Alibaba เปิดตัว โดยมีเป้าหมายเพื่อให้สามารถเข้าถึงได้แบบ Day-0 ลงทะเบียนและรับการแจ้งเตือนในวันที่ระบบเปิดให้ใช้งาน

Wan 3.0 เป็นรุ่นที่ครอบคลุมมากที่สุดในซีรีส์นี้ โดยเพิ่มความยาววิดีโอเริ่มต้นเป็น 30 วินาที รองรับเอกสารอ้างอิงแบบผสมสูงสุด 20 รายการ รวมถึงเอกสารและหน้าเว็บในโหมด omni-reference เพิ่มโหมดเฟรมแรกและเฟรมสุดท้าย และผลักดันไปสู่ความสอดคล้องระดับพิกเซลด้วยระบบเสียงเริ่มต้น เวอร์ชัน Wan ก่อนหน้านี้บน Atlas Cloud ยังคงเป็นตัวเลือกที่ยอดเยี่ยมสำหรับงาน text-to-video และ image-to-video ที่สั้นและเน้นเฉพาะจุดมากขึ้น

Wan 3.0 ประมวลผลเนื้อหาต้นฉบับได้มากกว่าเพียงแค่พรอมต์ คำขอเดียวสามารถดึงข้อมูลอ้างอิงแบบผสมได้สูงสุด 20 รายการ, รูปภาพ 10 ภาพ, วิดีโอคลิป 5 คลิปความยาวรวม 15 วินาที และคลิปเสียง 5 คลิปความยาวรวม 15 วินาที พร้อมด้วยเอกสาร 1 ไฟล์ (doc, xls, ppt, pdf หรือ md) หรือหน้าเว็บเพจ ในขณะที่พรอมต์ข้อความสามารถมีความยาวได้ถึง 20,000 ตัวอักษร

คลิปสามารถรันแบบเนทีฟได้นานสูงสุด 30 วินาที คำขอที่เป็นข้อความหรือรูปภาพอาจมีความยาวตั้งแต่ 2 ถึง 30 วินาที ในขณะที่คำขอที่รวมวิดีโอจะจำกัดเวลาอินพุตและเอาต์พุตรวมกันไม่เกิน 30 วินาที และฟีเจอร์ระยะเวลาอัจฉริยะสามารถกำหนดความยาวให้คุณได้ ความละเอียดครอบคลุมตั้งแต่ 480p, 720p และ 1080p โดยมีอัตราส่วน 16:9, 9:16, 4:3, 3:4, 1:1 และอัตราส่วนอัจฉริยะให้เลือก

ความสม่ำเสมอถูกจัดการในระดับพิกเซล ดังนั้นใบหน้า เครื่องแต่งกาย ผลิตภัณฑ์ หรือรายละเอียดอ้างอิงเล็กๆ น้อยๆ จะยังคงรูปลักษณ์เดิมไว้เมื่อมีการตัดฉากและตัวแบบเคลื่อนไหว สำหรับกระบวนการผลิตที่มีการนำตัวละครเดิมหรือสินทรัพย์ของแบรนด์ที่แน่นอนกลับมาใช้ใหม่ ความเสถียรดังกล่าวคือสิ่งที่ทำให้สามารถคาดการณ์ผลลัพธ์ของการส่งมอบแต่ละครั้งได้

ใช่ ผ่านทั้งการใช้คำสั่งและการอ้างอิง ข้อความที่เขียนหรือคลิปตัวอย่างสามารถปรับเปลี่ยนรูปแบบของวัตถุ เปลี่ยนการจัดแสง หรือแทนที่ส่วนใดส่วนหนึ่งได้ และองค์ประกอบที่คุณต้องการให้คงไว้จะยังคงอยู่เหมือนเดิมตลอดการตัดต่อ

ใช่ Atlas Cloud ให้บริการ Wan 2.7, 2.6 และ 2.5 ภายใต้คีย์แบบรวมศูนย์เดียวกันแล้ว และ Wan 3.0 จะเข้าร่วมในคีย์เดียวกันนี้โดยไม่ต้องสร้างบัญชีใหม่ ไม่ต้องสับเปลี่ยนเอนด์พอยต์ และไม่ต้องตั้งค่าแยกต่างหาก ทีมงานที่มีการเรียกใช้งานตระกูล Wan อยู่แล้วสามารถเข้าถึง Wan 3.0 ได้เพียงแค่เปลี่ยนชื่อรุ่นเมื่อระบบเปิดใช้งานจริง

API เดียวสำหรับ AI สื่อทุกประเภท

สำรวจโมเดลทั้งหมด