Seedance 2.5 现已上线 — 首发 Atlas Cloud

Wan 3.0 API is Coming to Atlas Cloud Soon

Wan 3.0 API 是 Alibaba 的 Wan 视频家族的新一代产品,旨在将长视频生成、多参考控制以及音视频质量推向新的高度。Atlas Cloud 已托管 Wan 2.7、2.6 和 2.5,因此 Wan 3.0 将使用相同的统一密钥,无需进行额外的设置。在产品上线首日即可获取抢先体验资格。请向下滚动至展示区,抢先预览 Wan 3.0 的生成效果。

Wan 3.0 由 Alibaba 开发。Atlas Cloud(由 Atlas Cloud AI LLC 运营)仅提供接入服务,并不拥有该模型。所有商标均归其各自所有者所有。

即将上线

模型即将上架

我们正在为该系列做最后的准备,您可以先看看下方相似的模型系列。

探索更多系列

Seedance 2.5

Seedance 2.5 API 现已在 Atlas Cloud 上线!它为开发者提供了 ByteDance 最新的视频模型。该模型可通过文本、单张图像或多达 50 个多模态参考,一次性生成长达 30 秒的原生视频,并包含同步音频和画面内的多语言文本。在 Atlas Cloud 上,您可以通过单个密钥访问它,其主体一致性和改进的物理特性能够保持长镜头的连贯性。

查看系列

MiniMax H3

The MiniMax H3 API opens MiniMax's general purpose multimodal video model, which reads text, images, video and audio as one context instead of one task at a time. Clips run 5 to 15 seconds at 24 FPS across aspect ratios from 21:9 to 9:16, and one prompt can swap characters, replace backgrounds, rewrite dialogue or clone a voice from a reference clip. Atlas Cloud serves it all through one OpenAI-compatible endpoint. Start building today.

查看系列

Seedream 5.0 Pro

Seedream 5.0 Pro API 为开发者在 Atlas Cloud 上提供了字节跳动的可控图像编辑模型。它通过锚点和坐标精确定位编辑,将图像分离为可编辑图层,融合多个参考,并精准匹配颜色和材质,支持 2K 和 3K 分辨率的多语言文本。在 Atlas Cloud 上,您只需一个密钥即可访问!

查看系列

Seedance 2.0

Seedance 2.0 API 为您提供 ByteDance 多模态视频模型的生产级访问权限——支持四模态输入(文本、图像、视频、音频),以及行业领先的“Universal Reference”(通用参考)系统,可在不同镜头间锁定构图、运镜和角色动作。只需一次 API 调用即可集成导演级控制,固定费率为 $0.09/秒,即时获取密钥,无需排队——由企业级正常运行时间和合规性提供保障。Seedance 2.0 原生 4K 现已上线!

查看系列

GPT Image 2

GPT Image 2 API 为开发者提供了访问 OpenAI 最新图像模型的途径,它是 GPT Image 1.5 的继任者。该模型可生成和编辑图像,能够在拉丁和 CJK 文字上实现准确的文本渲染,并在海报、样机和信息图表方面具备强大的排版能力。在 Atlas Cloud 上,您可以通过一个统一的 API 与 300 多个模型一起访问它,并享受免费额度、99.99% 的正常运行时间,且无需 OpenAI 组织验证。

查看系列

Gemini Omni Flash

Gemini Omni API 将 Google DeepMind 在 Google I/O 2026 上发布的多模态视频生成与编辑模型带入你的技术栈。Gemini Omni 将 Gemini 的推理引擎与生成式媒体融合,可接受文本、图像、视频和音频的任意组合输入,生成一致且以知识为依据的输出。通过自然对话不断打磨结果:替换物体、重写场景、切换风格,同时保持物理规律、角色形象和画面连贯性不变。Atlas Cloud 通过统一的 API 提供完整的 Gemini Omni Flash 系列——文生视频、支持最多 7 张参考图的图生视频,以及参考图生视频——按秒计费、价格透明,低至 $0.112 起,且无需订阅。立即开始构建。

查看系列

Grok Imagine

Grok Imagine API 涵盖 xAI 的图像、视频和语音模型,包括 Image 2.0、Video 1.5 和 xAI TTS v1。支持生成跨 14 种宽高比的 1K 或 2K 静帧、生成最长 15 秒的 1080p 视频、通过最多 7 张参考图像引导镜头、或用 20 种语言进行配音。Atlas Cloud 在单一端点上运行所有功能,采用按量计费,起价为每张图像 $0.02、每秒 $0.05。立即开始使用。

查看系列

Google

Google最强大的创意模型现已在Atlas Cloud上全面可用。Veo 3.1提供电影级别的视频生成,Nano Banana 2支持高保真图像创建,而Gemini为每个工作流带来多模态智能。通过单一API key即可访问完整的Google模型套件,提供Day-0可用性和按需付费(pay-as-you-go)定价。

查看系列

Seedance 2.0 Mini

Seedance 2.0 Mini 将 ByteDance 的多模态视频生成技术引入到对速度和成本要求极高的工作流中。它以更轻量的占用空间提供 Seedance 2.0 的核心能力——更快的生成速度、更低的单条视频成本,并且使用您现有的同款 API 集成。对于运行高吞吐量流水线或进行大规模原型设计的团队来说,Mini 是最实用的默认选择。

查看系列

ByteDance

从电影级视频生成到高保真图像创建,ByteDance 最强大的模型现已在 Atlas Cloud 上线。以最低的推理定价和零基础设施开销,大规模运行 Seedance 和 Seedream。

查看系列

Alibaba

Atlas Cloud 将 Alibaba 的全系模型阵容整合至同一个 API 中:Qwen 用于语言和图像任务,Wan 用于高达 1080p 的视频生成。所有模型均采用按需付费模式,无需订阅。您可以使用现有的 OpenAI 兼容客户端,通过单一的 base URL 访问 Alibaba API。

查看系列

OpenAI

Atlas Cloud 为您提供访问完整 OpenAI API 产品线的权限,从用于图像生成的 GPT Image 2 到用于视频的 Sora 2。每个模型均采用按需付费模式,无月度消费限制。使用兼容 OpenAI 的 API,只需简单替换基础 URL 即可轻松接入。

查看系列

Wan 3.0 实战

展示一次 Wan 3.0 请求所能生成的 6 大旗舰功能,涵盖从多参考品牌宣传片到 30 秒一镜到底的广泛应用。

多参考品牌影片

Omni模式最多可摄取20份参考资料、10张图片、5段短片和5条音轨,外加一份源文档或网页,从而只需一次处理,即可将完整的品牌套件转化为符合品牌形象的单一视频。

30秒一镜到底故事

原生30秒输出为叙事留出了充裕的展开空间,能够承载较短片段无法实现的连续运镜和一镜到底序列。智能时长让模型能够自主掌控每个场景的节奏。

像素级参考一致性

面孔、产品和精致细节在每一帧中都以像素级保真度得以重现。这为制作团队提供了重复出现的角色和精确的品牌资产所必需的交付确定性。

沉浸式音效与真实感

真实感、图像纹理和原生音频同步提升,生成的场景自带匹配的声音,而不再是无声画面。最终呈现出真正具有视听冲击力的效果。

指令与参考编辑

精准编辑可根据书面指令或参考片段对现有素材进行重制,在无需重新生成整个视频的情况下改变主体、风格或特定时刻。

文档与网页转视频

除了文本、图像、音频和视频,Wan 3.0 还能读取 doc、xls、ppt、pdf 和 md 文件以及实时网页,将报告或幻灯片直接转化为最终的视频片段。

同一提示词中的视频对比

请观看由 Wan 3.0、Seedance 2.5 和 Wan 2.7 模型生成的视频演示。

提示词

Generating a 30-second, 16:9 widescreen adult sci-fi war animated short film. Visual style: Ultra-photorealistic CGI Biomechanical structures Fusion of gray-white bone and black metal Insect-like joints Extremely fine bone texturing Dried blood streaks, ceramic cracks, and industrial oil grime Abandoned futuristic city Cold gray skylight Sparse toxic-green organisms High-contrast cinematic lighting Low-saturation cool color palette Minimal orange-red used only for flames and alarms Realistic physical destruction Oppressive, heavy, unheroic tone Characters no longer have complete flesh bodies. They are composed primarily of: Human spine Ribs Skull Black hydraulic muscle Metal joints Neural fiber optics Weapon interface ports The skeletons are not zombies — they are "legacy hardware" still being operated by military-industrial systems. Narrative & Dynamic Timeline 0–4 sec | Still Fighting After Death The shot opens on a soldier's dog tag lying in a pool of standing water. Want me to continue translating the rest of the timeline if you have more seconds/beats written out? This looks like it's cut off after the 0-4 second beat.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

提示词

Generating a 15-second, 16:9 ultra-widescreen plush-universe adventure clip. A spaceship made of plush fabric, buttons, zippers, and stuffing cotton is fleeing at high speed through a universe made of giant yarn planets, fuzzy nebulae, and rag-doll megafauna. The ship is piloted by three small plush animals: a rabbit, a fox, and a crow. A giant interstellar whale-beast covered in deep-blue long plush fur, with eyes like two glass buttons, chases the ship out of the nebula. Overall style: ultra-fine plush textures, cinematic space scale, a strong contrast between cute appearance and intense action, exaggerated FPV camera work, and realistic soft-body physics. **15-Second Dynamic Timeline** **0–3 sec | Zipper Ship Ejection Launch** The shot is inside the plush ship, with a cockpit made of stitching, buttons, and fabric instrument panels. A red warning button flashes rapidly. The rabbit pulls down a giant zipper-lever control, and the ship's forward hatch splits open like a cloth sack. The camera pulls back rapidly from the cockpit, passes through the zipper hatch, and emerges outside the ship. The ship ejects and launches out of the knitted crater of a yarn planet. **3–6 sec | High-Speed Orbit Skimming the Yarn Planet** The camera hugs the ship's tail, flying low over the planet's surface. The ground is woven from giant strands of yarn: - Knitted mountain ranges streak past below at high speed - Loose thread-ends sway like a forest - The ship dodges sharply left and right - The camera continuously banks and rolls - The thrusters emit a trailing wake of white cotton fluff **6–8.5 sec | The Giant Plush Whale Appears** The fuzzy nebula suddenly parts to either side as a giant deep-blue plush whale bursts out from behind. The long fur on the whale's body is blown backward by the high-speed airflow, and its glass-button eyes reflect the planet's light. The camera whips halfway around the ship, switching to a rear-facing (reverse) view, so the whale continuously grows larger in the frame behind the ship.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

Wan 3.0 API - 专为真正的创意工作流打造

Wan 3.0 的升级源于真实的行业需求,直接无缝融入以下生产工作流中,涵盖从短剧到企业宣传片的各个领域。

电影、电视、短剧与 MV

原生30秒长镜头与实景还原技术,让AI电影、短剧和音乐MV能够省去大部分的实体拍摄。像素级一致性确保了主角形象的连贯,且生成的原生音频能与每个剪辑精准匹配。

动画、品牌与 IP

单个模型即可实现从写实到动漫的全风格控制,同时像素级一致性可将吉祥物、徽标或IP角色锁定在每一帧中。无需繁琐的制作流程即可渲染出完整的品牌动画。

广告与企业推广

全能创作突破了图文的局限,为家电、美妆、汽车、快消品及服饰品牌赋能。只需直接输入产品页面或公司报告,即可生成从产品演示到企业品牌宣传片的各类内容。

软件与产品设计

输入产品UI演示、功能动画或数据可视化,Wan 3.0 能够在保持原有美感的同时,将其转化为以故事为驱动的动态作品。繁琐的动画制作步骤就此消失。

教育

文档输入功能可直接读取 PDF、PPT 或网页,让课程或研究报告无需单独编写脚本,即可转化为清晰的讲解视频。只需一步,复杂材料即可实现可视化。

文化旅游

实景还原技术无需大规模拍摄即可重现自然景观、文化遗产和地方美食,从而以低成本完成城市宣传片和文化数字化。遥远的地方得以真实呈现在观众面前。

如何在 Atlas Cloud 上使用 Wan 3.0

几分钟即可上手 — 按照以下简单步骤,通过 Atlas Cloud 平台集成和部署模型。

创建 Atlas Cloud 账户

在 atlascloud.ai 注册并完成验证。新用户可获得免费额度,用于探索平台和测试模型。

为何在 Atlas Cloud 使用 Wan 3.0

将先进的 Wan 3.0 模型与 Atlas Cloud 的 GPU 加速平台相结合,提供无与伦比的性能、可扩展性和开发体验。

性能与灵活性

低延迟:
GPU 优化推理,实现实时响应。

统一 API:
一次集成,畅用 Wan 3.0、GPT、Gemini 和 DeepSeek。

透明定价:
按 Token 计费,支持 Serverless 模式。

企业与规模

开发者体验:
SDK、数据分析、微调工具和模板一应俱全。

可靠性:
99.99% 可用性、RBAC 权限控制、合规日志。

安全与合规:
SOC 2 Type II 认证、HIPAA 合规、美国数据主权。

Wan 3.0 API 常见问题解答

Wan 3.0 是 Alibaba 的下一代全能视频模型,现已开启公开测试。只需一次请求即可将文本、图像、视频、音频、文档或网页转化为长达30秒的视频,该模型将广泛的输入与像素级的一致性、精确的编辑以及原生生成的音频完美结合。

Atlas Cloud 计划在 Alibaba 发布 Wan 3.0 API 后立即将其接入,并以实现 Day-0 访问为目标。立即注册,在产品上线当天即可获得通知。

Wan 3.0 是该系列中最为广泛的发布版本。它将原生时长提升至 30 秒,在全参考模式下可接收多达 20 种混合参考材料以及文档和网页,新增了首尾帧模式,并致力于实现与原生音频的像素级一致性。Atlas Cloud 上的早期 Wan 版本仍然是进行更简短、更专注的文本生成视频和图像生成视频工作的有力选择。

Wan 3.0 将远远不止提示词作为源材料。一次请求可以调用多达 20 个混合参考资料、10 张图像、5 段总长 15 秒的视频剪辑以及 5 段总长 15 秒的音频剪辑,此外还可附加单个文档(doc、xls、ppt、pdf 或 md)或网页,而文本提示词本身的长度可达 20000 个字符。

片段原生支持最长30秒。文本或图像请求生成的时长在2到30秒之间,而包含视频的请求会将输入和输出总时长控制在30秒以内,此外,智能时长功能可以为您自动设置长度。分辨率涵盖480p、720p和1080p,并提供16:9、9:16、4:3、3:4、1:1及智能比例供选择。

一致性在像素级别进行处理,因此无论是人脸、服装、产品还是精细的参考细节,在场景切换和主体移动时都能保持原貌。对于重复使用同一角色或特定品牌资产的制作流程而言,正是这种稳定性使得每次交付的结果都具有可预测性。

是的,通过指令和参考均可实现。一段文字说明或一个样本片段就可以对主体进行重新风格化、改变光照或替换单个片段,而您希望保持原样的元素在整个编辑过程中将保持不变。

是的。Atlas Cloud 已经通过一个统一密钥提供 Wan 2.7、2.6 和 2.5,而 Wan 3.0 也将使用该密钥,无需创建新账户,无需更改端点,也无需单独设置。已经在调用 Wan 系列的团队只需在 Wan 3.0 上线后更改模型名称即可访问。

一个 API,畅享全模态 AI。

探索全部模型