初期のWan 3.0に関する評価のほとんどは、単一の選りすぐりのクリップに基づいています。こちらは別の種類のレビューです。10の能力次元にわたる49の画像から動画へのケースを、すべて固定シード、720pで実行し、同一の最初のフレーム、同一のプロンプト、同一のシードでSeedance 2.0とWan 2.7でも再実行しました。以下の主張はすべて裏付けとなるクリップがあり、重要なものは埋め込まれているので、フレームごとに私と意見を異にすることができます。
1段落の結論:Wan 3.0は、Wan 2.7から広く目に見える一歩前進であり、Seedance 2.0と比較すると、明確に性格の異なる同程度の階層に位置します。Wan 3.0は忠実性と安定性で勝り、つまり最初のフレームの忠実性、動きを通した同一性の一貫性、物理演算、そして排他的な30秒の長さを意味します。Seedance 2.0は想像力で勝り、つまり複数の被写体がいるシーン、シュールな指示、スタイライズされたコンテンツを意味します。そして、リスクセクションで見出しとなるほど頻繁に現れるバグが1つあります:Wan 3.0は、誰も要求していない新しいカメラアングルに頻繁にカットすることです。
主なポイント
- 忠実対大胆が本当の違いです。入力画像と矛盾するプロンプトが与えられた場合、Wan 3.0は画像を保護し、指示を軽く扱います。Seedance 2.0は指示を実行し、その周りに画像を再構築します。どちらの失敗を許容できるかで選んでください。
- 物理演算はWan 3.0の最も得意とする分野です:割れるガラスとビリヤードのブレイクは、どちらも同じシードでWan 2.7とSeedance 2.0を上回り、よりきれいな破片パターンと衝突の伝達を示します。
- 同一性は保持されます。9つの30秒ランすべてで、キャラクターの顔、服、セットが入れ替わることはありませんでした。動きを通した一貫性も、直接比較でSeedance 2.0を上回りました。
- ブロッキングの欠陥は、指示されていないカメラカットです:ハードで、要求されていないショット変更。時にはゴーストが発生し、標準的なランでも、30秒クリップ内でも繰り返し再現されます。
- 1世代での30秒は、現在この対決では排他的です。Seedance 2.0とWan 2.7はどちらも15秒で停止します。
このWan 3.0レビューの構築方法:同一シード、同一フレーム、同一プロンプト
動画モデル間の比較は、通常、始まる前に失敗します。なぜなら、各モデルが異なる開始画像、書き直されたプロンプト、またはラッキーな2回目の試行を得るからです。このベンチマークはこれら3つの変数をすべて排除します。49のケースそれぞれで、1つの最初のフレーム、1つのプロンプト、1つのシードを固定し、その正確な3つ組を3つのモデルすべてで実行します。誰も再試行はできません。クリップ間で変わったのはモデルだけであり、他には何も変わりません。
10の次元は、被写体の動き、カメラの動き、物理演算、複数被写体の相互作用、環境変化、静止保持、画面上のテキストとUI、スタイライズされたコンテンツ、画像とプロンプトの矛盾、長い30秒の生成をカバーします。結果は、指標ではなく、すべてのクリップの人間によるレビューで採点されました。
その雰囲気を以下に示します。1杯の水がテーブルから落ちます。同じフレーム、同じシード3001、3つのモデル:

落下するグラステストの3方向比較:左Wan 2.7、中央Wan 3.0、右Seedance 2.0、同一の最初のフレーム、プロンプト、シード
プロンプト:グラスがテーブル端から落ち、水がこぼれ、グラスが床で割れる。左から右へ:Wan 2.7、Wan 3.0、Seedance 2.0。落下の弧と破片に注目:Wan 3.0の破片は、テクスチャの交換ではなく、ガラスとして読める。
そのクリップは、レビュー全体を縮図として示しています。Wan 2.7は明らかに世代遅れです。Wan 3.0とSeedance 2.0は同じレベルで互角に戦っており、どちらが「優れている」かは、あなたのショットがどの次元に属するかに完全に依存します。
Wan 3.0がレビューで勝利する点:同一性、物理演算、カメラ固定の被写体
動きを通した同一性。 新聞テスト(シード1004)では、高齢の男性が新聞を下ろし、顔を上げ、微笑み、手を振ります。単純ですが、連続的な人間の動きはまさに動画モデルが静かに顔を入れ替える箇所です。Wan 3.0は、ジェスチャーの連鎖全体を通して、男性の顔、服装、部屋の詳細を固定します。Seedance 2.0は、同じ入力で、被写体を漂わせます。

新聞の手を振るテストの並べ替え、左Wan 3.0が同一性を保持、右Seedance 2.0が漂う
シード1004、5秒:男性が新聞を下ろし、微笑み、手を振る。左Wan 3.0、右Seedance 2.0。手を振る前後の顔を確認。
前世代に対する動きの論理。 バレエテスト(シード1005)は、スカートをなびかせながらその場で1回の優雅な回転を求めます。Wan 3.0は、ターンを1つの連続した物理的に一貫した動きとして完了し、ダンサーはその前後で同じ人物です。Wan 2.7の試みは、アップグレードの必要性を明らかにします。

バレエの回転比較、上下に重ねて表示、上Wan 3.0がきれいなターンを完了、下Wan 2.7が動きを失う
シード1005、5秒:1回転、スカートがなびく。上Wan 3.0、下Wan 2.7。これが実際の「動きの論理」の意味。
被写体に触れずに環境を変更する。 オーロラテスト(シード5004)は、雪の山の上の空が緑から紫に踊るように変化することを求めます。落とし穴は、ほとんどのモデルが山を空と一緒に揺らしてしまうことです。Wan 3.0は、オーロラがアニメーションする間、山を静止させます。Seedance 2.0の山は明らかに動きます。あなたの仕事が商品撮影、不動産、または被写体固定のシーンワークであれば、これは注目すべき次元です。

雪の山の上のオーロラ、左Wan 3.0が山を固定、右Seedance 2.0が被写体のドリフト
シード5004、6秒:オーロラが緑から紫に変化、山は動いてはいけない。左Wan 3.0、右Seedance 2.0。
物理演算は、3方向のグラス落下で既に見ました。ビリヤードブレイクのケース(シード3003)もパターンを繰り返します:白球が当たり、色球が信じられる運動量の伝達で散らばり、互いに衝突し続け、両方の競合モデルは同じ入力で遅れをとります。
Wan 3.0が負ける点:指示されていないカットと控えめなシュルレアリスム
正直なWan 3.0レビューは、ここに十分な時間を割く必要があります。なぜなら、両方の弱点が構造的であり、表面的ではないからです。
カメラが勝手にカットする。 1回の連続カメラ移動を要求すると、Wan 3.0は要求されていないハードなショット変更を挿入する癖があります。タワーテスト(シード2004)は、基部から上部へのスローティルト、その後フルビューへのプルバックを要求します。約3.5秒で、モデルは単に異なるセットアップにカットし、カットをまたいで目に見えるカラーグレードのジャンプがあります。

Wan 3.0タワーテスト、連続ティルトの代わりに約3.5秒で指示されていないハードカットを示す
シード2004、8秒、プロンプトは1回の連続ティルトアンドリビールを要求。3.5秒に注目:そのカットは決して要求されていない。
公平を期すために、カメラ制御は現在、この分野全体の弱点です:Seedance 2.0もこのベンチマークで完全なオービットに失敗し、Wan 2.7は利点を提供しません。Wan 3.0でさらに悪いのは、同じカット動作が30秒ラン内で再発することであり、これはまさに単一の途切れないショットが最も重要となる場所です。これについては後述します。
シュールな指示は軽減される。 矛盾の次元では、モデルに入力画像と矛盾するプロンプトを与えます。これはすべてのシュールな広告コンセプトのバックボーンです。入力:普通のリビングルーム。プロンプト:室内に激しい雨が降り始め、家具をびしょ濡れにする。

室内の雨の矛盾テストの入力フレーム:普通のリビングルームの内部
両方のモデルが受け取った入力フレーム。プロンプトはこのシーンに室内の雨を要求、シード10001。

室内の雨の矛盾テスト、左Wan 3.0は部屋をほとんど変えず、右Seedance 2.0は完全な室内降雨にコミット
左Wan 3.0:照明が変化し、観葉植物の近くに局所的な飛沫があるが、雨はない。右Seedance 2.0:実際の室内雨、一貫して統合されている。これがベンチマーク全体で最大の差だった。
Wan 3.0は、照明の変化と観葉植物の近くの象徴的な飛沫で応答します。Seedance 2.0はコミットします:実際の雨、室内で、部屋はびしょ濡れになりながらも一貫性を保ちます。2番目の矛盾ケース、会議室の上を滑空するクジラ(シード10003)は、異なる方法で失敗しますが、同じ理由で、Wan 3.0はクジラを統合する代わりにオフィス全体を青く染めます。パターンは一貫しています:画像とプロンプトが矛盾する場合、Wan 3.0は画像の側に立ちます。忠実な製品作業にとって、その本能は機能です。想像力主導のブリーフにとっては、他の何かを使用する理由です。
Wan 3.0の30秒排他的機能、およびそれを弱体化させるカット
1回の生成での30秒は、Wan 3.0の見出しとなる機能であり、この対決では他の何も到達しません:Seedance 2.0とWan 2.7はどちらも15秒で上限があります。ベンチマークは、これに6つの専用ケースと期間ラダーを与えました。そして、長い生成の核心的なリスクである同一性の崩壊は発生しませんでした。9つの30秒クリップ全体で、誰かが別の人物に変わったり、セットが静かに別の部屋になったりすることはありませんでした。
長いタイムラインにわたる指示のフォローも保持されました。サッカーのケース(シード11006)は、4つの連続するビートをスクリプト化します:1人の子供が下がって距離を開け、2人が3回パスし、1人がロングシュートし、もう1人が応援する。すべて4つが順序通りに着地します:
シード11006、30秒、1世代:下がる、3回パス、ロングシュート、歓声。単一プロンプトでのマルチステージの演出、順序通りに実行。
その後、カメラセクションと同じ欠陥が再び現れます。看板ケース(シード11004)は、看板のテキストが読みやすいまま、非常に遅いプッシュインとプルバックを1回要求します。約4〜5秒で、クリップはゴーストのような二重露光を通して異なる構図に溶けていきます:
シード11004、30秒:プロンプトは看板に対する1回の連続プッシュプルを要求。4〜5秒を観察:指示されていないディゾルブ、短いゴーストを伴い、新しいフレーミングへ。
3番目の長いケース、30秒のトーキングポートレート(シード11002)は、約15〜17秒でそれを繰り返し、ディゾルブと姿勢およびフレーミングの変更があります。モデルは、ブリーフが単一テイクであったときに、マルチショットの短編映画を監督しているかのように振る舞います。クリップが長いほど、より多くの機会を取ります。それが抑制されるまで、30秒の出力は、保証された1つの途切れないテイクではなく、トリミングが必要になる可能性があるシーケンスとして扱い、排他的機能を適切な視点で捉えてください:それは本物であり、同一性を保持し、現在はあなたが雇っていない組み込みの編集者と一緒に出荷されます。
Wan 3.0 vs Seedance 2.0:どのジョブにどのモデルか
完全な10次元スコアカード、要約版。「Even」は、このベンチマークではどちらの側にも再現可能な優位性がなかったことを意味します。
| 次元 | vs Wan 2.7 | vs Seedance 2.0 |
|---|---|---|
| 被写体の動き | 動きの論理が優れている | Wan 3.0が同一性をよりよく保持 |
| カメラの動き | 同等、両方弱い | 同等、両方弱い、Wan 3.0は指示されていないカットを追加 |
| 物理演算 | 大きなステップアップ | Wan 3.0が先行、最初のフレームにより忠実 |
| 複数被写体の相互作用 | 同等 | Seedance 2.0が明らかに先行 |
| 環境変化 | 先行 | 先行、被写体は固定されたまま |
| 静止保持 | 先行 | シーンプロップはやや劣る、実写の人物は先行 |
| テキストとUI | 先行 | 分割、UI相互作用は両方とも貧弱 |
| スタイライズされたコンテンツ | 先行 | Seedance 2.0がスタイルのセマンティクスで明らかに先行 |
| 画像とプロンプトの矛盾 | 同等 | Seedance 2.0がはるかに先行、ベンチマークで最大の差 |
| 30秒生成 | 排他的 | 排他的、Seedance 2.0は15秒で停止 |
2行での選択ロジック。厳密な画像から動画への忠実性、固定された被写体、物理的イベント、実写素材、または15秒を超えるもの:Wan 3.0。複数キャラクターのシーン、シュールまたは矛盾駆動のクリエイティブ、スタイライズされたフォーマット:Seedance 2.0。
あなたは今日、このテーブルの半分を何も待たずに試すことができます。Seedance 2.0 画像から動画へ と Wan 2.7 画像から動画へ はどちらもAtlas Cloudで1つのキーでライブであり、実行ごとのコストはコミットする前にボタンに表示されます。独自のシードを固定し、1つの最初のフレームを再利用し、この記事のグラス落下または室内雨のプロンプトをそのまま実行してください。Wan 3.0がリリースされるとき(このファミリーはAtlasにDay 0で到着する歴史があります)、あなたのベンチマークは変更なしで移行し、プロンプトはすでに調整されています。その準備のプロンプト側が必要な場合、Wan 3.0 プロンプトガイド は、公式ハンドブックの構造をケースごとに分解しています。
よくある質問
Wan 3.0はSeedance 2.0より優れていますか?
どちらも支配的ではありません。同じシードのベンチマークでは、気質によって分かれます。Wan 3.0は忠実性で勝ちます:動きを通した同一性、物理演算、環境と被写体の分離、最初のフレームの忠実性、さらに排他的な30秒出力。Seedance 2.0は想像力で勝ちます:複数被写体の相互作用、シュールな指示のフォロー、スタイライズされたコンテンツ。矛盾の次元がその最大の勝利です。ブランドごとではなく、ショットごとに選んでください。
このWan 3.0レビューでの最大の問題は何ですか?
指示されていないカメラカット。連続的な動きを求めるプロンプトが、繰り返しハードで要求されていないショット変更を受け取り、時にはゴーストを伴います:8秒のティルト(シード2004)で3.5秒、30秒ラン内(シード11004、11002)で4〜5秒と15〜17秒。容易に再現可能であり、単一テイクのユーザビリティを直接制限します。
Wan 3.0は本当に30秒の動画を生成しますか?
はい、1回の生成で、9つのベンチマークランすべてで同一性は保持され、4ビートのスクリプト化されたシーケンス(シード11006)が順序通りに実行されました。ただし、注意点は同じカット欠陥です:長いランは、少なくとも1つの指示されていないディゾルブまたはショット変更を含む傾向があるため、保証された1つの途切れないテイクを期待するのではなく、トリミングする計画を立ててください。
このWan 3.0レビューはどのようにテストされましたか?
10の次元にわたる49の画像から動画へのケース、すべてのケースを720p、固定シードで実行し、同一の最初のフレーム、プロンプト、シードをSeedance 2.0とWan 2.7で再実行しました。すべての結果は、人間がクリップごとにレビューし、どのモデルにも再試行はありませんでした。埋め込まれたクリップは実際のベンチマーク出力であり、シードも含まれているため、比較を直接確認できます。
Wan 3.0がリリースされる前に、このベンチマークを再現できますか?
方法は今日から移行可能です:シードを固定し、1つの最初のフレームとプロンプトをロックし、同じ3つ組をライブモデルで実行します。Seedance 2.0とWan 2.7ファミリー全体は現在Atlas Cloud上にあり、このモデルファミリーが更新されるときにDay 0アクセスの習慣があるため、同じベンチマークがWan 3.0が公開された日に拡張されるはずです。
結論
Wan 3.0は、入力画像を重視する人々によって構築されたモデルのように読めます:あなたが与えたものを、動きを通して、物理演算を通して、そして30秒全体を通して保護します。その規律はまさに忠実な商業用画像から動画への作業に必要なものであり、同時に、モデルが画像にそれ以外のものになることを求めるプロンプトでひるむ理由でもあります。1つのモデルを置き換えるのではなく、大胆な想像力のモデルと組み合わせて、公開されたときに1つの数値に注目してください:指示されていないカット率が低下するかどうか。その単一の修正が、30秒の排他的機能が見出しになるか、注意点になるかを決定します。






