Seedance 2.5 đã chính thức ra mắt — Có mặt đầu tiên trên Atlas Cloud

Wan 3.0 API is Coming to Atlas Cloud Soon

Wan 3.0 API là thế hệ tiếp theo của dòng sản phẩm video Wan từ Alibaba, được xây dựng để đẩy mạnh khả năng tạo video thời lượng dài, điều khiển đa tham chiếu và chất lượng nghe nhìn lên một tầm cao mới. Atlas Cloud đã lưu trữ Wan 2.7, 2.6 và 2.5, do đó Wan 3.0 sẽ sử dụng cùng một khóa thống nhất và hoạt động mà không cần thiết lập riêng. Nhận quyền truy cập sớm vào ngày sản phẩm ra mắt. Cuộn xuống phần trưng bày để có cái nhìn sớm về những gì Wan 3.0 có thể tạo ra.

Wan 3.0 do Alibaba phát triển. Atlas Cloud (vận hành bởi Atlas Cloud AI LLC) cung cấp quyền truy cập vào mô hình này và không sở hữu mô hình. Mọi thương hiệu đều thuộc về chủ sở hữu tương ứng.

Sắp Ra Mắt

Mô hình sắp ra mắt

Chúng tôi đang hoàn thiện bộ sưu tập này — trong khi đó, hãy khám phá các bộ sưu tập tương tự bên dưới.

Khám phá Thêm Dòng

Seedance 2.5

Seedance 2.5 API hiện đã có mặt trên Atlas Cloud! Cung cấp cho các nhà phát triển mô hình video mới nhất của ByteDance. Nó tạo ra tối đa 30 giây video gốc chỉ trong một lần xử lý từ văn bản, một hình ảnh duy nhất hoặc tối đa 50 tài liệu tham khảo đa phương thức, với âm thanh được đồng bộ hóa và văn bản đa ngôn ngữ trong khung hình. Trên Atlas Cloud, bạn có thể truy cập thông qua một khóa duy nhất, với tính nhất quán của chủ thể và vật lý được cải thiện giúp giữ cho các cảnh quay dài luôn mạch lạc.

Xem Dòng

MiniMax H3

API MiniMax H3 mở quyền truy cập vào mô hình video đa phương thức đa dụng của MiniMax, có thể đọc văn bản, hình ảnh, video và âm thanh như một ngữ cảnh duy nhất thay vì xử lý từng tác vụ riêng lẻ. Các clip có thời lượng từ 5 đến 15 giây ở 24 FPS, hỗ trợ nhiều tỷ lệ khung hình từ 21:9 đến 9:16; chỉ với một prompt, bạn có thể hoán đổi nhân vật, thay nền, viết lại hội thoại hoặc sao chép giọng nói từ một clip tham chiếu. Atlas Cloud cung cấp toàn bộ khả năng này thông qua một endpoint tương thích OpenAI. Hãy bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Seedream 5.0 Pro

Seedream 5.0 Pro API cung cấp cho các nhà phát triển mô hình chỉnh sửa hình ảnh có thể kiểm soát của ByteDance trên Atlas Cloud. Nó đặt các chỉnh sửa một cách chính xác bằng các điểm neo và tọa độ, tách hình ảnh thành các lớp có thể chỉnh sửa, kết hợp nhiều tham chiếu và khớp màu sắc cũng như vật liệu chính xác, với văn bản đa ngôn ngữ ở độ phân giải 2K và 3K. Trên Atlas Cloud, bạn có thể truy cập nó chỉ bằng một khóa!

Xem Dòng

Seedance 2.0

Seedance 2.0 API cung cấp cho bạn quyền truy cập cấp sản xuất vào mô hình video đa phương thức của ByteDance — đầu vào bốn phương thức (văn bản, hình ảnh, video, âm thanh) và hệ thống "Universal Reference" hàng đầu trong ngành giúp khóa bố cục, chuyển động của camera và hành động của nhân vật trên các cảnh quay. Tích hợp quyền kiểm soát cấp độ đạo diễn bằng một lệnh gọi API, mức giá cố định $0,09/giây, cấp khóa tức thì và không có danh sách chờ — được hỗ trợ bởi thời gian hoạt động và sự tuân thủ cấp doanh nghiệp. Seedance 2.0 Native 4K hiện đã ra mắt!

Xem Dòng

GPT Image 2

GPT Image 2 API cung cấp cho các nhà phát triển quyền truy cập vào mô hình hình ảnh mới nhất của OpenAI, phiên bản kế nhiệm của GPT Image 1.5. Mô hình này tạo và chỉnh sửa hình ảnh với khả năng hiển thị văn bản chính xác trên các chữ viết Latinh và CJK, cùng với bố cục mạnh mẽ cho áp phích, mockup và đồ họa thông tin. Trên Atlas Cloud, bạn có thể truy cập nó thông qua một API thống nhất cùng với hơn 300 mô hình khác, với tín dụng miễn phí, 99,99% thời gian hoạt động và không yêu cầu xác minh tổ chức OpenAI.

Xem Dòng

Gemini Omni Flash

Gemini Omni API đưa mô hình tạo và chỉnh sửa video đa phương thức của Google DeepMind, được giới thiệu tại Google I/O 2026, vào stack của bạn. Gemini Omni kết hợp công cụ suy luận của Gemini với media tạo sinh, chấp nhận mọi tổ hợp văn bản, hình ảnh, video và âm thanh để tạo ra kết quả nhất quán, dựa trên nền tảng tri thức. Tinh chỉnh kết quả qua hội thoại tự nhiên — hoán đổi vật thể, viết lại cảnh quay và thay đổi phong cách, trong khi vật lý, nhân vật và tính liên tục vẫn được giữ nguyên. Atlas Cloud cung cấp trọn bộ dòng Gemini Omni Flash — chuyển văn bản thành video, chuyển hình ảnh thành video với tối đa 7 hình ảnh tham chiếu, và chuyển tham chiếu thành video — thông qua một API hợp nhất với mức giá minh bạch tính theo giây từ $0.112 và không cần đăng ký thuê bao. Bắt đầu xây dựng ngay hôm nay.

Xem Dòng

Grok Imagine

Grok Imagine API của xAI cung cấp các mô hình hình ảnh, video và lời nói, từ Image 2.0 đến Video 1.5 và xAI TTS v1. Render 1K hoặc 2K hình tĩnh trên 14 tỷ lệ khung hình, tạo cảnh 15 giây video 1080p, điều hướng các shot bằng tối đa 7 hình ảnh tham chiếu, hoặc cung cấp lời tường thuật bằng 20 ngôn ngữ. Atlas Cloud chạy mọi chế độ trên một endpoint, có giá theo mô hình trả tiền khi sử dụng từ $0.02 mỗi hình ảnh và $0.05 mỗi giây. Bắt đầu xây dựng hôm nay.

Xem Dòng

Google

Các mô hình sáng tạo mạnh mẽ nhất của Google hiện đều có sẵn trên Atlas Cloud. Veo 3.1 cung cấp khả năng tạo video đậm chất điện ảnh, Nano Banana 2 hỗ trợ tạo hình ảnh có độ chân thực cao, và Gemini mang trí tuệ đa phương thức vào mọi quy trình làm việc. Truy cập toàn bộ bộ mô hình Google thông qua một API key duy nhất với tính khả dụng Day-0 và mức giá dùng bao nhiêu trả bấy nhiêu (pay-as-you-go).

Xem Dòng

Seedance 2.0 Mini

Seedance 2.0 Mini mang khả năng tạo video đa phương thức của ByteDance vào các quy trình làm việc nơi tốc độ và chi phí là quan trọng nhất. Nó cung cấp các khả năng cốt lõi của Seedance 2.0 với mức tiêu thụ tài nguyên nhẹ hơn — tạo nhanh hơn, chi phí mỗi video thấp hơn và tích hợp API giống như bạn đã sử dụng. Đối với các nhóm chạy các quy trình (pipeline) khối lượng lớn hoặc tạo nguyên mẫu ở quy mô lớn, Mini là lựa chọn mặc định thiết thực.

Xem Dòng

ByteDance

Từ tạo video điện ảnh đến kiến tạo hình ảnh có độ trung thực cao, các mô hình mạnh mẽ nhất của ByteDance hiện đã có mặt trên Atlas Cloud. Chạy Seedance và Seedream ở quy mô lớn với mức giá suy luận thấp nhất và không có chi phí quản lý cơ sở hạ tầng.

Xem Dòng

Alibaba

Atlas Cloud tập hợp toàn bộ dòng mô hình của Alibaba dưới một API duy nhất: Qwen cho các tác vụ ngôn ngữ và hình ảnh, Wan để tạo video với độ phân giải lên đến 1080p. Truy cập mọi mô hình theo hình thức dùng đến đâu trả tiền đến đó (pay-as-you-go) mà không cần đăng ký gói. Alibaba API có sẵn thông qua một URL cơ sở (base URL) duy nhất bằng cách sử dụng ứng dụng khách tương thích với OpenAI hiện có của bạn.

Xem Dòng

OpenAI

Atlas Cloud cấp cho bạn quyền truy cập vào toàn bộ danh mục OpenAI API, từ GPT Image 2 để tạo hình ảnh đến Sora 2 cho video. Mọi mô hình đều có sẵn theo hình thức dùng đến đâu trả tiền đến đó (pay-as-you-go) mà không cần cam kết hàng tháng. Tích hợp dễ dàng chỉ bằng cách thay đổi một base URL thông qua API tương thích với OpenAI.

Xem Dòng

Wan 3.0 trong thực tế

6 tính năng hàng đầu cho thấy một yêu cầu Wan 3.0 có thể tạo ra những gì, từ phim thương hiệu đa tham chiếu đến các cú máy dài 30 giây.

Phim thương hiệu đa tham chiếu

Chế độ Omni thu thập tối đa 20 tài liệu tham khảo, 10 hình ảnh, 5 clip và 5 bản nhạc âm thanh, cộng với một tài liệu nguồn hoặc trang web, nhờ đó, toàn bộ bộ nhận diện thương hiệu sẽ trở thành một video chuẩn thương hiệu duy nhất chỉ trong một lần xử lý.

Những câu chuyện 30 giây một cú máy

Đầu ra 30 giây gốc mang đến cho không gian kể chuyện sự thoải mái để phát triển, hỗ trợ các chuyển động máy ảnh liên tục và các chuỗi quay một cú máy (one-shot) mà các video ngắn hơn không thể truyền tải. Thời lượng thông minh cho phép mô hình tự điều chỉnh nhịp độ của từng cảnh.

Tính Nhất Quán Tham Chiếu Cấp Độ Pixel

Khuôn mặt, sản phẩm và các chi tiết tinh xảo được tái tạo với độ trung thực ở mức điểm ảnh trên mỗi khung hình. Các nhóm sản xuất có được sự chắc chắn trong khâu phân phối mà các nhân vật lặp lại và tài sản thương hiệu chính xác đòi hỏi.

Âm thanh Đắm chìm và Độ chân thực

Tính chân thực, kết cấu hình ảnh và âm thanh gốc đều được nâng cấp đồng thời, do đó một cảnh được tạo ra sẽ đi kèm với âm thanh phù hợp thay vì các thước phim câm. Kết quả mang lại hiệu ứng nghe nhìn thực sự ấn tượng.

Chỉnh sửa Chỉ thị và Tham chiếu

Chỉnh sửa chính xác gia công lại cảnh quay hiện có từ một hướng dẫn bằng văn bản hoặc một đoạn clip tham khảo, thay đổi chủ thể, phong cách hoặc khoảnh khắc mà không cần tạo lại toàn bộ video.

Tài liệu và Trang web thành Video

Vượt ra ngoài văn bản, hình ảnh, âm thanh và video, Wan 3.0 có thể đọc các tệp doc, xls, ppt, pdf và md cũng như các trang web trực tiếp, biến một báo cáo hoặc bản trình bày trực tiếp thành một video clip hoàn chỉnh.

So sánh video trong cùng một prompt

Xem bản trình bày video được tạo bởi các mô hình Wan 3.0, Seedance 2.5 và Wan 2.7.

Prompt

Generating a 30-second, 16:9 widescreen adult sci-fi war animated short film. Visual style: Ultra-photorealistic CGI Biomechanical structures Fusion of gray-white bone and black metal Insect-like joints Extremely fine bone texturing Dried blood streaks, ceramic cracks, and industrial oil grime Abandoned futuristic city Cold gray skylight Sparse toxic-green organisms High-contrast cinematic lighting Low-saturation cool color palette Minimal orange-red used only for flames and alarms Realistic physical destruction Oppressive, heavy, unheroic tone Characters no longer have complete flesh bodies. They are composed primarily of: Human spine Ribs Skull Black hydraulic muscle Metal joints Neural fiber optics Weapon interface ports The skeletons are not zombies — they are "legacy hardware" still being operated by military-industrial systems. Narrative & Dynamic Timeline 0–4 sec | Still Fighting After Death The shot opens on a soldier's dog tag lying in a pool of standing water. Want me to continue translating the rest of the timeline if you have more seconds/beats written out? This looks like it's cut off after the 0-4 second beat.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

Prompt

Generating a 15-second, 16:9 ultra-widescreen plush-universe adventure clip. A spaceship made of plush fabric, buttons, zippers, and stuffing cotton is fleeing at high speed through a universe made of giant yarn planets, fuzzy nebulae, and rag-doll megafauna. The ship is piloted by three small plush animals: a rabbit, a fox, and a crow. A giant interstellar whale-beast covered in deep-blue long plush fur, with eyes like two glass buttons, chases the ship out of the nebula. Overall style: ultra-fine plush textures, cinematic space scale, a strong contrast between cute appearance and intense action, exaggerated FPV camera work, and realistic soft-body physics. **15-Second Dynamic Timeline** **0–3 sec | Zipper Ship Ejection Launch** The shot is inside the plush ship, with a cockpit made of stitching, buttons, and fabric instrument panels. A red warning button flashes rapidly. The rabbit pulls down a giant zipper-lever control, and the ship's forward hatch splits open like a cloth sack. The camera pulls back rapidly from the cockpit, passes through the zipper hatch, and emerges outside the ship. The ship ejects and launches out of the knitted crater of a yarn planet. **3–6 sec | High-Speed Orbit Skimming the Yarn Planet** The camera hugs the ship's tail, flying low over the planet's surface. The ground is woven from giant strands of yarn: - Knitted mountain ranges streak past below at high speed - Loose thread-ends sway like a forest - The ship dodges sharply left and right - The camera continuously banks and rolls - The thrusters emit a trailing wake of white cotton fluff **6–8.5 sec | The Giant Plush Whale Appears** The fuzzy nebula suddenly parts to either side as a giant deep-blue plush whale bursts out from behind. The long fur on the whale's body is blown backward by the high-speed airflow, and its glass-button eyes reflect the planet's light. The camera whips halfway around the ship, switching to a rear-facing (reverse) view, so the whale continuously grows larger in the frame behind the ship.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

Wan 3.0 API - Được xây dựng cho các quy trình sáng tạo thực tiễn

Các bản nâng cấp của Wan 3.0 bắt nguồn từ nhu cầu thực tế của ngành, tích hợp trực tiếp vào các quy trình sản xuất dưới đây, từ phim truyền hình ngắn đến phim doanh nghiệp.

Phim ảnh, TV, Phim ngắn & MV

Các cảnh quay gốc dài 30 giây và khả năng phục hồi bối cảnh thực giúp các bộ phim AI, phim truyền hình ngắn và video âm nhạc (MV) bỏ qua phần lớn việc quay phim thực tế. Độ nhất quán của pixel giữ nguyên tạo hình của các nhân vật chính lặp lại và âm thanh gốc được đồng bộ chuẩn xác với từng cảnh cắt.

Hoạt hình, Thương hiệu & IP

Khả năng kiểm soát toàn bộ phong cách chuyển từ chân thực sang anime chỉ trong một mô hình, trong khi tính nhất quán của pixel khóa chặt linh vật, logo hoặc nhân vật IP trong mọi khung hình. Hình ảnh động toàn diện của thương hiệu được kết xuất mà không cần đến chuỗi sản xuất phức tạp.

Quảng cáo & Quảng bá Doanh nghiệp

Khả năng sáng tạo Omni vượt qua giới hạn của văn bản và hình ảnh đối với các thương hiệu thiết bị gia dụng, làm đẹp, ô tô, FMCG (hàng tiêu dùng nhanh) và hàng may mặc. Chỉ cần đưa trực tiếp một trang sản phẩm hoặc báo cáo của công ty vào để tạo ra mọi thứ, từ bản demo sản phẩm đến phim quảng cáo thương hiệu doanh nghiệp.

Thiết kế Phần mềm & Sản phẩm

Cung cấp một bản hướng dẫn giao diện người dùng sản phẩm, một hoạt ảnh tính năng hoặc một hình ảnh hóa dữ liệu, và Wan 3.0 sẽ giữ nguyên tính thẩm mỹ ban đầu trong khi biến nó thành một tác phẩm chuyển động có cốt truyện. Bước làm hoạt ảnh nhàm chán sẽ biến mất.

Giáo dục

Đầu vào tài liệu đọc trực tiếp tệp PDF, PPT hoặc trang web, nhờ đó một bài học hoặc báo cáo nghiên cứu sẽ trở thành một video giải thích rõ ràng mà không cần kịch bản riêng. Tài liệu phức tạp trở thành hình ảnh trực quan chỉ trong một bước.

Du lịch Văn hóa

Phục dựng cảnh thực tái tạo cảnh quan, khu di sản và ẩm thực địa phương mà không cần quay phim quy mô lớn, nhờ đó các thước phim về thành phố và số hóa văn hóa được hoàn thành với chi phí thấp. Những vùng đất xa xôi hiện ra ngay trước mắt người xem.

Cách Sử Dụng Wan 3.0 trên Atlas Cloud

Bắt đầu trong vài phút — làm theo các bước đơn giản sau để tích hợp và triển khai mô hình qua nền tảng Atlas Cloud.

Tạo Tài Khoản Atlas Cloud

Đăng ký tại atlascloud.ai và hoàn tất xác minh. Người dùng mới nhận được tín dụng miễn phí để khám phá nền tảng và thử nghiệm mô hình.

Tại sao Sử dụng Wan 3.0 trên Atlas Cloud

Sự kết hợp của các mô hình tiên tiến của Wan 3.0 với nền tảng được tăng tốc GPU của Atlas Cloud mang lại hiệu suất, khả năng mở rộng và trải nghiệm nhà phát triển độc đáo.

Hiệu suất và Tính linh hoạt

Độ Trễ Thấp:
Suy luận được tối ưu hóa GPU cho suy luận thời gian thực.

API Thống nhất:
Chạy Wan 3.0, GPT, Gemini và DeepSeek với một tích hợp duy nhất.

Giá cả Minh bạch:
Thanh toán dựa trên token có thể dự đoán với tùy chọn serverless.

Doanh nghiệp và Mở rộng

Trải nghiệm Nhà phát triển:
SDK, phân tích, công cụ tinh chỉnh và mẫu.

Độ tin cậy:
99,99% khả dụng, RBAC và ghi nhật ký sẵn sàng cho tuân thủ.

Bảo mật và Tuân thủ:
SOC 2 Type II, tuân thủ HIPAA, chủ quyền dữ liệu tại Hoa Kỳ.

Câu hỏi thường gặp về API Wan 3.0

Wan 3.0 là mô hình video tất-cả-trong-một thế hệ tiếp theo của Alibaba, hiện đang trong giai đoạn thử nghiệm công khai. Một yêu cầu duy nhất có thể chuyển đổi văn bản, hình ảnh, video, âm thanh, tài liệu hoặc trang web thành video dài tối đa 30 giây và mô hình này kết hợp dữ liệu đầu vào rộng lớn đó với tính nhất quán ở cấp độ điểm ảnh, khả năng chỉnh sửa chính xác và âm thanh được tạo ra theo cách gốc.

Atlas Cloud dự kiến bổ sung Wan 3.0 API ngay khi Alibaba phát hành, với mục tiêu cung cấp quyền truy cập Day-0. Hãy đăng ký và nhận thông báo vào ngày sản phẩm chính thức ra mắt.

Wan 3.0 là phiên bản phát hành toàn diện nhất trong dòng sản phẩm này. Nó nâng thời lượng gốc lên 30 giây, chấp nhận tới 20 tài liệu tham khảo hỗn hợp cùng với các tài liệu và trang web trong chế độ tham chiếu toàn diện (omni-reference), bổ sung chế độ khung hình đầu và cuối, đồng thời hướng tới tính nhất quán ở cấp độ điểm ảnh với âm thanh gốc. Các phiên bản Wan trước đó trên Atlas Cloud vẫn là những lựa chọn mạnh mẽ cho các công việc chuyển đổi văn bản thành video và hình ảnh thành video ngắn hơn và tập trung hơn.

Wan 3.0 xử lý nhiều hơn một prompt dưới dạng tài liệu nguồn. Một yêu cầu duy nhất có thể trích xuất từ tối đa 20 tài liệu tham khảo hỗn hợp, 10 hình ảnh, 5 video clip với tổng thời lượng 15 giây và 5 đoạn âm thanh với tổng thời lượng 15 giây, cùng với một tài liệu duy nhất (doc, xls, ppt, pdf hoặc md) hoặc trang web, trong khi bản thân prompt văn bản có thể dài tới 20.000 ký tự.

Các clip chạy nguyên bản lên đến 30 giây. Yêu cầu bằng văn bản hoặc hình ảnh có thể kéo dài từ 2 đến 30 giây, trong khi yêu cầu bao gồm video giữ cả đầu vào và đầu ra trong tổng thời gian 30 giây và tính năng thời lượng thông minh có thể tự động đặt độ dài cho bạn. Độ phân giải bao gồm 480p, 720p và 1080p, với các tỷ lệ 16:9, 9:16, 4:3, 3:4, 1:1 và tỷ lệ thông minh có sẵn.

Tính nhất quán được xử lý ở cấp độ pixel, do đó khuôn mặt, trang phục, sản phẩm hoặc chi tiết tham chiếu tinh tế sẽ giữ nguyên được vẻ ngoài khi cảnh quay chuyển đổi và chủ thể di chuyển. Đối với các chu kỳ sản xuất tái sử dụng cùng một nhân vật hoặc một tài sản thương hiệu chính xác, sự ổn định đó chính là yếu tố làm cho mỗi lần bàn giao đều có thể dự đoán được.

Có, thông qua cả hướng dẫn và tham chiếu. Một đoạn ghi chú bằng văn bản hoặc một clip mẫu có thể định hình lại phong cách của chủ thể, thay đổi ánh sáng hoặc thay thế một phân đoạn duy nhất, và các yếu tố bạn muốn giữ nguyên sẽ không bị ảnh hưởng trong suốt quá trình chỉnh sửa.

Có. Atlas Cloud đã cung cấp Wan 2.7, 2.6 và 2.5 dưới một khóa hợp nhất duy nhất và Wan 3.0 sẽ dùng chung khóa đó mà không cần tài khoản mới, không cần thay đổi endpoint và không cần thiết lập riêng. Các nhóm đã và đang gọi các mô hình thuộc dòng Wan có thể truy cập Wan 3.0 chỉ bằng cách đổi tên mô hình khi nó được phát hành.

Một API cho mọi AI đa phương tiện.

Khám phá tất cả mô hình