Seedance 2.5 现已上线 — 首发 Atlas Cloud

Wan 3.0 对比 Seedance 2.5 对比 MiniMax H3:10次相同提示测试,每次三面板

我们使用一个提示词,分别通过Wan 3.0、Seedance 2.5和MiniMax H3,针对10个简报(每个简报含3个面板)进行了测试。观看全部十个,复制提示词,然后自行运行。

大多数模型对比只会给你一个精心挑选的片段和一个赢家。而这次,我们给你的是原始素材。

我们取了十个简报,每个都用完全相同的提示词,同时在三款视频模型上运行:Wan 3.0 vs Seedance 2.5 vs MiniMax H3。下面的每个结果都是三个画面堆叠在同一帧中,顺序始终不变,从上到下:Wan 3.0、Seedance 2.5、MiniMax H3。没有针对模型的提示词调优。没有为了好看而重新生成。观看,然后自行判断。

这也是本文的要点。选择视频模型的诚实方法不是看排行榜,而是给所有模型相同的提示词,然后并排观察三个输出。你可以在一个浏览器标签页中对这三款模型做同样的事。最后一部分会告诉你如何操作。

关键要点

  • 一个提示词、三款模型、三个画面——这才是诚实的测试。没有一款模型能赢下全部十个。
  • Seedance 2.5 在画面内文字和干净的产品外观上表现最强;MiniMax H3 保持了人物身份和动作一致性;Wan 3.0 则能处理长篇幅、多镜头的复杂简报。
  • 三款模型都在 Atlas Cloud 上通过同一个密钥运行,Model Explorer 会并行向三款模型发送相同的提示词,并在生成前显示成本。
  • 官方 64 个 Wan 3.0 提示词已在 Prompt Hub 中准备好,可直接复制粘贴,你可以重现任何测试。
  • Wan 3.0 将于 2026 年 8 月 24 日登陆 Atlas Cloud。先观看全部十个测试,然后排队等候。

测试 1:Wan 3.0 vs Seedance 2.5 vs MiniMax H3 —— 30 秒海怪

从这套测试中最难的简报开始。一个 1,758 字符的提示词,完整写出十个镜头,包含完整的“铺垫、骚动、揭示”弧线,以及一个太平洋-里姆级别的生物在暴雨中破水而出。它考验大规模 VFX 和水模拟,也是对长提示词遵循能力的残酷测试:模型能否在 30 秒内保持十个脚本节拍而不偏离。

一个提示词,三款模型,从上到下:Wan 3.0、Seedance 2.5、MiniMax H3。观察风暴如何酝酿、水体如何位移,以及渔船上“WAN”的标记如何在多个镜头中保持。片段带有声音,三款模型都生成了原生音频。

注意这个贯穿整个场景的提示词技巧:船体标记被单独命名了四次,一次在概述中,另外三次在不同镜头中。在长提示词中,让某个元素重复出现的可靠方法不是详细描述一次,而是在每个应该出现的时间戳上再次写出它。正是这个习惯让标签在剪辑中得以保留。

为什么同提示词、三模型测试优于任何排行榜

单模型的高光片段只能告诉你该模型在最佳状态、使用精心调校的提示词时能做什么。它几乎无法告诉你,在周二、用你自己的提示词、赶着截止日期时,你会得到什么结果。

将相同的提示词同时输入 Wan 3.0、Seedance 2.5 和 MiniMax H3,消除了两个最大的造假来源:提示词调优和重新生成。当输入固定、输出并排摆放时,那些真正重要的差异会自行显现。一个画面中文字清晰渲染,另一个画面中却模糊不清。一张脸在一个画面中保持不变,在另一个画面中却变形。一个镜头运动在一个画面中保持稳定,在另一个画面中却撕裂。

在这十个测试中,没有一款模型全面胜出。Seedance 2.5 保持了画面内文字和产品表面清晰。MiniMax H3 保持了人物身份和自然动作。Wan 3.0 则能处理最长、最过度指定的简报。这些差异中哪一个对你更重要,只有你自己的镜头列表才能回答——这正是为什么你应该自己运行对比的全部理由。

Wan 3.0 vs Seedance 2.5 vs MiniMax H3:实际有差异的规格

在另外九个测试之前,以下是三款模型在纸面上真正不同的地方。这些是已发布的能力规格,检查于 2026 年 8 月。Wan 3.0 是即将推出的模型;其 Atlas Cloud 页面现已开放早期访问注册,而 Seedance 2.5 和 MiniMax H3 已经可用。

能力Wan 3.0Seedance 2.5MiniMax H3
片段长度2 到 30 秒,默认 5 秒4 到 30 秒,或自动5 到 15 秒
分辨率480P / 720P / 1080P720p 及以上,ESR 超分辨率至 4K,最高 60fps最高 1440p
宽高比自适应,16:9, 4:3, 1:1, 3:4, 9:16六种比例 + 自适应21:9, 16:9, 4:3, 1:1, 3:4, 9:16
原生音频支持,可开关支持,在同一轮生成中支持,原生立体声
模式文字、图片(首帧/首尾帧)、视频参考文字、图片、视频参考文字、图片、视频参考
参考输入图片、视频、音频,共 20 个最多 50 个多模态参考最多 12 个文件
文档/网页转视频支持:doc, xls, ppt, pdf, md 和网页链接未公布未公布
提示词限制20,000 字符无硬性字符限制7,000 字符
开源权重否,仅 API否,仅 API部分:H3-Base 权重已发布,其他变体仅 API

这里有三个容易误读的地方。时长和分辨率不是同一个维度:Wan 3.0 和 Seedance 2.5 都能达到 30 秒,而 MiniMax H3 上限为 15 秒,但在分辨率上,Seedance 2.5 通过超分辨率达到 4K,而其他两款分别标注为 1080P 和 1440p。参考限制每家供应商计算方式不同,因此原始数字不可直接比较。而文档转视频——将电子表格或网页链接直接输入模型——是 Wan 3.0 独有的输入通道,另外两款没有对应功能。

实际结论:三款模型都位于 Atlas Cloud 的同一目录下,使用同一个 API 密钥,这才使得同提示词运行成为可能。你选择模型,写一次提示词,然后同时向所有模型发送。

另外九个 Wan 3.0 vs Seedance 2.5 vs MiniMax H3 测试

格式始终如一:一个提示词,三个画面,Wan 3.0 在上,接着是 Seedance 2.5,然后是 MiniMax H3。每个片段都带有原生音频。所有这些测试的完整、可直接复制粘贴的提示词都位于 Wan 3.0 Prompt Hub,共 64 个,并附有官方参考片段。

测试 2,购物车维度跳跃(30 秒)。 这套测试中最充满动感的简报:一个不间断的 30 秒长镜头,一个孩子骑着购物车沿加州大道飞驰,撞穿广告牌。它考验无剪辑的连续高速运动、烈日下的色彩一致性,以及画面内文字——广告牌上的“WAN”。观察哪个画面在撞击时仍能保持字母清晰可辨。

提示词技巧提示:四个时间段的每个开头都重复了“无剪辑,一个连续的长镜头”。在每个节拍处重复这一约束,比只在开头声明一次,能更好地保持一次拍摄的错觉。

测试 3,银发女孩跃入云海(30 秒)。 一个日本 2D 赛璐珞风格片段。关键在于平涂的动漫风格能否在 30 秒内保持不退化,同时保持天空渐变色彩和戏剧性逆光。2D 风格是三款模型差异最明显的领域之一。

测试 4,CGI 生物机械战争(30 秒)。 硬表面与有机体的结合:骨纹理、陶瓷裂纹、工业污垢,再加上屏幕上的英文平视文字。提示词只有 320 字符,时间线在前四秒后就结束了,因此真正的考验是每款模型如何编造出剩余 26 秒的内容。

测试 5,毕业礼服特写(30 秒)。 一个 202 字符的提示词,需要承载一个 30 秒的单人特写长镜头。这是这套测试中最考验时长稳定性的项目:面孔是否保持同一个人,皮肤是否保持质感,手持呼吸感是否真实,目光是否自然地从平视移向下方。以下是完整的提示词,足够简短,可直接复制:

Plain
1一个正面中近景特写,一位年轻黑人女性,头部和上半身,穿着蓝色毕业礼服。画面略微偏离中心,左侧隐约可见另一个人,但背景模糊。她正对着镜头说话,嘴巴在动,眉头微皱,表情严肃且略带担忧。光线从上方洒落,自然勾勒出她的面部轮廓,可见真实的皮肤纹理。摄像机固定但带有轻微的手持呼吸感,她的目光缓慢地从前方看向自己的双手。

测试 6,五人女子团 MV(25 秒)。 多主体测试:五位表演者,各有独特的外貌和位置,必须保持锁定,不能出现面部互换或身体融合,舞步要踩在间断的鼓点上,整体为黑白硬光时尚风格。

提示词技巧提示:这个 930 字符的提示词完全没有镜头编号。它将时间线绑定在音乐上,例如“在第一个鼓点响起时”、“在重音唱出第一个歌词时”、“进入桥段”。对于以节拍为驱动力的作品,将提示挂在歌曲结构上,比按秒切分更有效。

测试 7,手绘 UFO 绑架奶牛(30 秒)。 整套测试中信息量最低的简报,仅 79 字符,却要撑满 30 秒。这实际上是在考验模型能自行编造多少内容,以及编造的是否合理,同时还要保持油画笔触风格。

测试 8,城市动态图形追逐(30 秒)。 两个角色之间的一场高端动态图形追逐。它考验动态图形纹理的一致性,以及在快速运动中保持两个角色造型的稳定。

提示词技巧提示:简报用了一整段来规定发光球体“不能”做什么——只能一个,大小稳定,从不复制,从不消失。对于一个需要在长片段中持续存在的道具,明确禁止的行为比堆砌更多外观描述更有效。一个公平性说明:这个简报指定了三张参考图片,但只有一个画面使用了它们,因此请将其视为纹理和动作测试,而非参考保真度测试。

测试 9,两段式电影情感(30 秒)。 真实人物美学,带有胶片颗粒和暖色调,在 30 秒内完成一次完整的情感和时间转折:从阳光明媚的玫瑰园到雨中的车窗。提示词写成四个带时间码的段落,因此时间线遵循能力也在考验之列。

测试 10,“夏日色彩”时尚短片(25 秒)。 这是最接近可交付商业广告的测试,以水平三画面并排显示,方便你并排阅读画面。它融合了真人实拍、手绘动画和排版:观察屏幕上的英文标题“color of summer”如何渲染,图形层如何覆盖在模特身上,以及服装和超大的黑色骰子如何保持一致性。一个说明:这里的 MiniMax H3 画面是由两个 15 秒片段在第 15 秒处拼接而成,因此不要将其视为一次拍摄的时长测试。

纵观这十个测试,反复出现的模式是:跨镜头一致性是通过明确的负面约束——“不改变”、“保持相同比例”——而非无限加长的描述来实现的。这是这套测试中最具可迁移性的一个教训。

运行你自己的 Wan 3.0 vs Seedance 2.5 vs MiniMax H3 对比

十个测试足以形成观点。但还不足以让你信任自己的镜头列表。解决办法是,用你自己的简报在三款模型上运行对比,这只需大约一分钟的设置。

这部分你不需要构建任何管道。打开 Atlas Cloud Model Explorer(我们上面所有片段使用的同一工具),它会向多个模型并行发送一个提示词,并并排显示结果。

  1. 将任务切换为 视频,然后选择 文本转视频 子类型。
  2. 在模型选择器中,选择 bytedance/seedance-2.5alibaba/wan-3.0minimax/h3。计数器显示 3 / 10。
  3. 将同一个提示词粘贴到单个提示词字段中,设置一次时长和宽高比,查看预估成本。然后同时运行所有三个。

一个视频生成界面,比较 wan 3.0 vs seedance 2.5 vs minimax h3

Atlas Cloud Model Explorer 设置为文本转视频,已选择 Seedance 2.5、Wan 3.0 和 MiniMax H3,一个提示词,并在生成前估算每次运行的成本_三款_ 视频模型已选定,提示词只写一次,生成任何一帧之前就能看到三款模型的预估成本。这个提前显示的数字就是关键:你在花费之前就能看到一次三模型对比的成本。

成本预估会随着你更改模型和时长而实时更新,因此你只有在看到数字后才会决定提交。只写一次,运行三个,在一个视图中对比,用你自己的简报,而不是我们的。

常见问题

Wan 3.0、Seedance 2.5 和 MiniMax H3 哪个更好?

没有唯一的赢家,这正是为什么这是一个十测试对比,而不是一个排名。在这些简报中,Seedance 2.5 在画面内文字和干净的产品表面方面最强,MiniMax H3 在保持人物身份和自然动作方面最佳,而 Wan 3.0 能处理最长、最过度指定的多镜头提示词。正确的选择取决于你的镜头列表,因此请用你自己的提示词在三款模型上运行。

Wan 3.0 何时在 Atlas Cloud 上可用?

Wan 3.0 将于 2026 年 8 月 24 日登陆 Atlas Cloud。模型页面现已开放早期访问注册,以便你在上线当天就能获得访问权限,而 Wan 2.7、2.6 和 2.5 今天已经在同一个密钥下可用。

我需要三个账户来比较 Wan 3.0、Seedance 2.5 和 MiniMax H3 吗?

不需要。三款模型都位于 Atlas Cloud 的同一个目录下,使用同一个 API 密钥。在 Model Explorer 中,你选择模型,写一次提示词,然后在一个浏览器标签页中并行运行它们,并在生成前显示成本。

我能获得这些测试中使用的确切提示词吗?

可以。所有十个提示词都来自官方 Wan 3.0 创作者手册,完整的 64 个提示词(每个都附有官方参考片段)已在 Wan 3.0 Prompt Hub 中准备好,可直接复制粘贴,还有一个开源镜像在 GitHub 上。复制任何一个,粘贴到 Model Explorer 中,即可重现对比。

Wan 3.0、Seedance 2.5 和 MiniMax H3 能生成原生声音吗?

三款模型都能在生成画面的同一轮中生成原生音频,因此上面每个片段中的声音都来自模型,而非后期编辑。在 Wan 3.0 中,音频可以关闭,如果你想要无声渲染。


这十个对比片段产自 Atlas Cloud。提示词来自官方 Wan 3.0 创作者手册。模型能力反映各供应商截至 2026 年 8 月发布的规格,并可能发生变化。

最新模型

一个 API,畅享全模态 AI。

探索全部模型