Seedance 2.5 现已上线 — 首发 Atlas Cloud

Wan 3.0 评测:我们进行了49次同种子测试,对比 Seedance 2.0 和 Wan 2.7

基于固定种子和720p的49个图生视频案例对Wan 3.0进行评测,并与Seedance 2.0和Wan 2.7在相同输入下对比评分。它的优势所在,它的短板所在。

最早期对 Wan 3.0 的评价大多只截取单一片段。本文是另一种评测:49 个图生视频案例,覆盖 10 个能力维度,每个案例使用固定种子、720p 分辨率,然后在 Seedance 2.0 和 Wan 2.7 上以相同的首帧、相同的提示词和相同的种子重新运行。以下每一项结论背后都有对应的视频片段,重要部分已嵌入,你可以一帧一帧地反驳我。

一句话总结:Wan 3.0 相比 Wan 2.7 有广泛且可见的进步,与 Seedance 2.0 相比则处于同一梯队,但风格截然不同。Wan 3.0 在忠实度和稳定性上胜出,即首帧保真度、运动中的身份一致性、物理效果,以及独有的 30 秒时长。Seedance 2.0 在想象力上胜出,即多主体场景、超现实指令和风格化内容。有一个问题频繁出现,足以成为风险部分的标题:Wan 3.0 会不断切到没人要求的镜头角度。

关键要点

  • 忠实与大胆是真正的分水岭。当提示词与输入图像矛盾时,Wan 3.0 保护图片而弱化指令;Seedance 2.0 执行指令并围绕指令重建图片。根据你能承受哪种失败来选择。
  • 物理效果是 Wan 3.0 的最强项:玻璃碎裂和台球开球在同一种子下均优于 Wan 2.7 和 Seedance 2.0,碎裂图案更清晰,碰撞传递更准确。
  • 身份保持:所有 9 个 30 秒运行中,没有角色换脸、换服装或换场景。运动中的一致性在直接对比中也优于 Seedance 2.0。
  • 阻挡缺陷是未经指令的镜头切换:生硬、未请求的镜头变化,有时伴有鬼影,在标准运行中重现,并在 30 秒片段内反复出现。
  • 单次生成长达 30 秒在当前对比中是独有特性。Seedance 2.0 和 Wan 2.7 均止步于 15 秒。

本次 Wan 3.0 评测的构建方式:相同种子、相同帧、相同提示词

视频模型间的比较通常在开始前就已失败,因为每个模型使用了不同的起始图像、重写的提示词或幸运的第二次尝试。本基准测试消除了这三个变量。49 个案例中的每一个都固定了首帧、提示词和种子,然后这个精确的三元组在三个模型上运行。没有模型获得重试机会。片段之间唯一的变化就是模型,没有其他因素。

10 个维度涵盖:主体运动、镜头移动、物理效果、多主体交互、环境变化、静态保持、屏幕文字与 UI、风格化内容、图像-提示词冲突、以及长 30 秒生成。结果通过人工逐片段审查评分,而非依赖指标。

以下是其风格示例。一杯水从桌边掉落。相同帧、相同种子 3001,三个模型:

三块相同的气泡水玻璃杯面板

玻璃杯掉落测试的三方对比:左 Wan 2.7,中 Wan 3.0,右 Seedance 2.0,相同首帧、提示词和种子

提示词:一个玻璃杯从桌边掉落,水洒出,玻璃杯在地上碎裂。从左到右:Wan 2.7、Wan 3.0、Seedance 2.0。观察下落弧线和碎裂:Wan 3.0 的碎裂看起来是玻璃,而不是纹理替换。

这个片段浓缩了整个评测。Wan 2.7 明显落后一代。Wan 3.0 和 Seedance 2.0 在同一水平上互有胜负,哪个“更好”完全取决于你的镜头所在维度。

Wan 3.0 在评测中的胜出点:身份、物理效果和镜头锁定主体

运动中的身份一致性。 在报纸测试(种子 1004)中,一位老人放下报纸,抬头、微笑并挥手。很简单,但连续的人体运动正是视频模型悄悄换脸的地方。Wan 3.0 在整个动作链中保持了老人的脸、服装和房间细节。Seedance 2.0 在相同输入下让主体发生了漂移。

一位戴帽子的男人坐在公园长椅上看越南报纸

报纸挥手测试的并排对比,左 Wan 3.0 保持身份,右 Seedance 2.0 漂移

种子 1004,5 秒:男人放下报纸,微笑,挥手。左 Wan 3.0,右 Seedance 2.0。检查挥手前后的面部。

运动逻辑超越前代。 芭蕾测试(种子 1005)要求原地优雅旋转一圈,裙摆跟随。Wan 3.0 完成了一次连续、物理连贯的旋转,且舞者前后是同一人。Wan 2.7 的尝试让升级变得显而易见。

一位身着白色芭蕾舞裙的芭蕾舞者站在舞台聚光灯下

芭蕾旋转对比纵向排列,上 Wan 3.0 完成干净旋转,下 Wan 2.7 丢失运动

种子 1005,5 秒:旋转一圈,裙摆飘动。上 Wan 3.0,下 Wan 2.7。这就是“运动逻辑”的实际表现。

在不接触主体的情况下改变环境。 极光测试(种子 5004)要求天空在雪山上从绿色舞动到紫色。陷阱在于大多数模型会让雪山随着天空一起晃动。Wan 3.0 在极光动画时保持雪山静止;Seedance 2.0 的雪山明显移动。如果你的工作是产品展示、房地产或任何锁定主体的场景,这是你需要关注的维度。

星空下雪山的山峰

雪山上空的极光,左 Wan 3.0 雪山锁定,右 Seedance 2.0 主体漂移

种子 5004,6 秒:极光从绿变紫,雪山必须不动。左 Wan 3.0,右 Seedance 2.0。

物理效果你已在三方玻璃杯掉落中看到。台球开球案例(种子 3003)重复了这一模式:白球撞击,彩球以可信的动量传递散开并继续相互碰撞,两个竞争对手在相同输入下均落后。

Wan 3.0 的失分点:未经指令的镜头切换和胆怯的超现实

诚实的 Wan 3.0 评测必须在此花费足够时间,因为两个弱点都是结构性的,而非表面问题。

镜头自行切换。 要求一个连续镜头移动,Wan 3.0 经常插入一个生硬、未请求的镜头变化。塔测试(种子 2004)要求从塔基缓慢倾斜到塔顶,然后拉远到全景。大约在 3.5 秒处,模型直接切到一个不同的构图,切点处有明显的色彩分级跳跃。

日落时分山脊上的多层石塔

Wan 3.0 塔测试显示在约 3.5 秒处出现未经指令的硬切,而非连续倾斜

种子 2004,8 秒,提示词要求一次连续倾斜和揭示。观察 3.5 秒:从未要求过那个切点。

公平地说,镜头控制是整个领域当前的弱点:Seedance 2.0 在同一基准测试中也未能完成一次完整环绕,Wan 2.7 也没有优势。Wan 3.0 更糟糕的是,相同的切行为在 30 秒运行内再次出现,而单次连续镜头正是最重要的场景。下面更多讨论。

超现实指令被弱化。 冲突维度给模型提供与输入图像矛盾的提示词,这是所有超现实广告概念的核心。输入:一个普通客厅。提示词:室内开始下大雨,打湿家具。

极简客厅

室内下雨冲突测试的输入帧:一个普通的客厅内部

两个模型收到的输入帧。提示词要求在此场景中下室内雨,种子 10001。

极简米色客厅,弧形沙发和抽象肖像画

室内下雨冲突测试,左 Wan 3.0 几乎不改变房间,右 Seedance 2.0 完全投入室内降雨

左 Wan 3.0:光照变化,植物附近局部水花,没有雨。右 Seedance 2.0:真实的室内雨,连贯整合。这是整个基准测试中差距最大的部分。

Wan 3.0 以光照变化和在盆栽附近象征性的水花回应。Seedance 2.0 完全投入:真实的室内雨,房间在淋湿的同时保持连贯。第二个冲突案例,鲸鱼在会议室上方滑翔(种子 10003),因相同原因但以不同方式失败,Wan 3.0 将整个办公室染成蓝色而非整合鲸鱼。模式一致:当图像和提示词不一致时,Wan 3.0 站在图像一边。对于忠实的产品工作,这种本能是优点。对于想象力驱动的创意简报,这正是使用其他工具的原因。

Wan 3.0 的 30 秒独有特性,以及削弱它的镜头切换

单次生成长达 30 秒是 Wan 3.0 的 headline 能力,在此对比中其他模型均无法达到:Seedance 2.0 和 Wan 2.7 都止步于 15 秒。基准测试为此分配了六个专用案例加上时长阶梯,而长生成的核心风险——身份崩溃——并未发生。在九个 30 秒片段中,没有人变成另一个人,没有场景悄然变成另一个房间。

长时间线内的指令遵循也保持良好。足球案例(种子 11006)编排了四个连续节拍:一名儿童后退拉开距离,两人传球三次,一人远射,另一人欢呼。四个节拍均按顺序实现:

种子 11006,30 秒,单次生成:后退,三次传球,远射,庆祝。单次提示词中的多阶段编排,按顺序执行。

然后,镜头部分相同的缺陷再次出现。招牌案例(种子 11004)要求一次极其缓慢的推近和拉远,招牌文字保持清晰。大约在 4 到 5 秒处,片段通过重影双重曝光溶解到不同的构图:

种子 11004,30 秒:提示词要求对招牌进行一次连续推拉。观察 4 到 5 秒:未经指令的溶解,伴有短暂重影,进入新构图。

第三个长案例,一个 30 秒的说话人像(种子 11002),在约 15 到 17 秒处重复了溶解加上姿势和构图变化。模型的行为仿佛在导演一部多镜头短片,而指令是单次拍摄。片段越长,它越倾向于这种操作。在解决此问题之前,请将 30 秒输出视为可能需要剪辑的序列,而非保证一次连续镜头,并保持对独有特性的客观认识:它真实存在,能保持身份,但目前附带一个你并未雇佣的内置剪辑师。

Wan 3.0 vs Seedance 2.0:哪个模型适合哪种工作

完整的 10 维度评分卡,精简版。“持平”意味着在此基准测试中双方均无可复现的优势。

维度vs Wan 2.7vs Seedance 2.0
主体运动运动逻辑更好Wan 3.0 身份保持更好
镜头移动持平,均弱持平,均弱,Wan 3.0 增加未经指令的切
物理效果大幅提升Wan 3.0 领先,更忠实于首帧
多主体交互持平Seedance 2.0 明显领先
环境变化领先领先,主体保持锁定
静态保持领先场景道具略落后,真人主体领先
文字与 UI领先分叉,UI 交互两者均差
风格化内容领先Seedance 2.0 在风格语义上明显领先
图像-提示词冲突持平Seedance 2.0 大幅领先,基准测试中差距最大
30 秒生成独有独有,Seedance 2.0 止步于 15 秒

选择逻辑两行总结。严格图生视频忠实度、锁定主体、物理事件、真人素材,或任何超过 15 秒的内容:选 Wan 3.0。多角色场景、超现实或冲突驱动的创意、风格化格式:选 Seedance 2.0。

你今天就可以测试此表的一半内容,无需等待任何东西。Seedance 2.0 图生视频Wan 2.7 图生视频 均在 Atlas Cloud 上以单一密钥上线,每次运行的成本在点击按钮前即可查看。固定你自己的种子,重复使用一个首帧,并逐字运行本文中的玻璃杯掉落或室内下雨提示词。当 Wan 3.0 上线时(该系列有在 Atlas 上 Day 0 上线的历史),你的基准测试可原封不动地迁移,你的提示词也已校准好。如果你想要提示词方面的准备,Wan 3.0 提示词指南 逐案例分解了官方手册的结构。

常见问题

Wan 3.0 比 Seedance 2.0 更好吗?

两者均未占据主导;在相同种子基准测试中,它们按风格分裂。Wan 3.0 在忠实度上胜出:运动中的身份保持、物理效果、环境与主体分离、首帧保真度,外加独有的 30 秒输出。Seedance 2.0 在想象力上胜出:多主体交互、超现实指令跟随和风格化内容,其中冲突维度是其最大胜场。根据具体镜头选择,而非品牌。

本次 Wan 3.0 评测中最大的问题是什么?

未经指令的镜头切换。要求一次连续移动的提示词反复出现生硬、未请求的镜头变化,有时伴有鬼影:在 8 秒倾斜测试的 3.5 秒处(种子 2004),在 30 秒运行中的 4 到 5 秒和 15 到 17 秒处(种子 11004, 11002)。它易于重现,直接限制了单次拍摄的可用性。

Wan 3.0 真的能生成 30 秒视频吗?

是的,单次生成,且所有九个 30 秒基准测试运行中身份保持良好,一个四节拍脚本序列(种子 11006)按顺序执行。但副作用是相同的切缺陷:长运行往往包含至少一次未经指令的溶解或镜头变化,因此计划剪辑而非期望一次保证的连续镜头。

本次 Wan 3.0 评测是如何测试的?

49 个图生视频案例,覆盖 10 个维度,每个案例以 720p 和固定种子运行,并将相同的首帧、提示词和种子在 Seedance 2.0 和 Wan 2.7 上重新运行。所有结果均经过人工逐片段审查,无任何模型获得重试机会。嵌入的片段是实际的基准测试输出(包含种子),因此可直接验证比较结果。

我能在 Wan 3.0 发布前重现这个基准测试吗?

该方法今天即可迁移:固定一个种子,锁定一个首帧和提示词,然后在已上线的模型上运行相同的三元组。Seedance 2.0 和整个 Wan 2.7 系列现在已在 Atlas Cloud 上,该平台在该模型系列更新时通常提供 Day 0 访问权限,因此相同的基准测试应在 Wan 3.0 开放当天即可扩展使用。

结论

Wan 3.0 读起来像是一个由珍视输入图像的团队构建的模型:你给它的东西,它会保护,通过运动、物理效果,以及整整 30 秒。这种纪律正是忠实商业图生视频工作所需要的,也是为什么模型在面对要求图像变成其他事物的提示词时会退缩。将其与一个大胆想象力的模型配对而非替换,并关注其公开发布时的一个数字:未经指令的切率是否下降。这一个修复决定了 30 秒独有特性是 headline 还是 caveat。

最新模型

一个 API,畅享全模态 AI。

探索全部模型