Seedance 2.5 現已上線 — 首發於 Atlas Cloud

Wan 3.0 評測:我們進行了49次相同種子測試,對比 Seedance 2.0 和 Wan 2.7

Wan 3.0 評測基於 49 個圖像轉影片案例,使用固定種子和 720p 解析度,與 Seedance 2.0 和 Wan 2.7 在相同輸入下進行評分。說明其優點與問題所在。

大部分早期對 Wan 3.0 的評論都只是單一精心挑選的片段。以下則是另一種評測:橫跨 10 個能力維度的 49 個圖生影片案例,每個案例皆以固定種子、720p 解析度執行,然後再以相同首幀、相同提示詞與相同種子,在 Seedance 2.0 和 Wan 2.7 上重新執行。以下每個說法背後都有對應的影片片段,而重要的片段已嵌入,方便你逐幀提出異議。

一句話總結:Wan 3.0 相較於 Wan 2.7 有全面且顯著的進步,而與 Seedance 2.0 相比,則落在同一層級,但各有鮮明的個性。Wan 3.0 在忠實度與穩定性上勝出,意指首幀保真度、動態中的身份一致性、物理效果,以及獨家的 30 秒時長。Seedance 2.0 則在想像力上勝出,意指多主體場景、超現實指令與風格化內容。此外,有一個問題出現頻率夠高,足以成為風險章節的標題:Wan 3.0 不斷切換到無人要求的全新攝影機角度。

重點摘要

  • 忠實 vs 大膽是真正的分野。當提示詞與輸入圖片衝突時,Wan 3.0 保護圖片內容,並淡化指令;Seedance 2.0 則執行指令,並圍繞指令重建圖片。請根據你能承受哪種失敗來選擇。
  • 物理效果是 Wan 3.0 最強的項目:在相同種子下,玻璃碎裂與撞球開球的效果皆優於 Wan 2.7 和 Seedance 2.0,展現更乾淨的碎裂模式與碰撞傳遞。
  • 身份保持力強。在全部九個 30 秒的執行中,沒有任何一個角色發生臉部、服裝或場景的替換。在直接比較中,動態中的一致性也勝過 Seedance 2.0。
  • 阻斷缺陷是非指令的攝影機切換:生硬、未經請求的鏡頭變換,有時伴隨殘影,在標準執行中重現,並在 30 秒片段中反覆出現。
  • 在此次對決中,一次生成 30 秒是目前獨家功能。Seedance 2.0 和 Wan 2.7 都只到 15 秒。

這份 Wan 3.0 評測是如何建立的:相同種子、相同幀、相同提示詞

影片模型之間的比較通常在開始前就失敗了,因為每個模型會使用不同的起始圖片、改寫過的提示詞,或是幸運的第二次嘗試。這組評測消除了這三個變數。在 49 個案例中,每個案例都固定一個首幀、一個提示詞和一個種子,而這個精確的三元組會在所有三個模型上執行。沒有人可以重試。影片之間唯一改變的是模型,沒有其他因素。

10 個維度涵蓋主體運動、攝影機運鏡、物理效果、多主體互動、環境變化、靜止保持、螢幕文字與 UI、風格化內容、圖像提示詞衝突,以及長達 30 秒的生成。結果由人工審查每個影片片段來評分,而非使用指標。

以下是其中的風味。一杯水從桌上掉下來。相同幀、相同種子 3001,三個模型:

Three identical panels of a glass of fizzy water

掉落玻璃杯測試的三方比較:Wan 2.7 左、Wan 3.0 中、Seedance 2.0 右,相同首幀、提示詞與種子

提示詞:一個玻璃杯從桌緣掉落,水灑出,玻璃杯在地上碎裂。左至右:Wan 2.7、Wan 3.0、Seedance 2.0。觀察掉落弧線與碎裂:Wan 3.0 的破裂讀起來像玻璃,而非紋理替換。

那個片段濃縮了整篇評測。Wan 2.7 明顯落後一個世代。Wan 3.0 和 Seedance 2.0 在同一層級上互有勝負,而哪個「更好」完全取決於你的鏡頭屬於哪個維度。

Wan 3.0 在評測中勝出的地方:身份、物理效果,以及鎖定攝影機的主體

動態中的身份保持。 在報紙測試(種子 1004)中,一位老人放下報紙,抬頭,微笑並揮手。很簡單,但連續的人類運動正是影片模型悄悄替換臉部的地方。Wan 3.0 在整個動作鏈中鎖定了老人的臉部、服裝和房間細節。Seedance 2.0 在相同的輸入下,讓主體發生偏移。

Man in a cap reading a Vietnamese newspaper on a park bench

報紙揮手測試的並排比較,左側 Wan 3.0 保持身份,右側 Seedance 2.0 偏移

種子 1004,5 秒:男人放下報紙,微笑,揮手。左 Wan 3.0,右 Seedance 2.0。檢查揮手前後的臉部。

相較於前一代的運動邏輯。 芭蕾測試(種子 1005)要求一個優雅的原地板旋轉,裙擺隨之飄動。Wan 3.0 完成了一個連續、物理上連貫的旋轉,且舞者在旋轉前後是同一人。Wan 2.7 的嘗試則凸顯了升級的必要性。

A ballerina in a white tutu standing under a stage spotlight

芭蕾旋轉比較垂直堆疊,上方 Wan 3.0 完成乾淨旋轉,下方 Wan 2.7 失去運動

種子 1005,5 秒:一個旋轉,裙擺飄逸。上 Wan 3.0,下 Wan 2.7。這就是「運動邏輯」在實務上的意義。

在不觸碰主體的情況下改變環境。 極光測試(種子 5004)要求天空在雪山上方從綠色舞動到紫色。陷阱在於大多數模型會讓山脈隨著天空一起晃動。Wan 3.0 在極光動畫時保持山脈靜止;Seedance 2.0 的山脈則明顯移動。如果你的工作是產品展示、房地產或任何鎖定主體的場景,這就是你該關心的維度。

Snowy mountain peaks under a starry night sky

雪山上的極光,左側 Wan 3.0 鎖定山脈,右側 Seedance 2.0 主體偏移

種子 5004,6 秒:極光從綠色轉為紫色,山脈不得移動。左 Wan 3.0,右 Seedance 2.0。

物理效果你已經在三方玻璃杯掉落中見過了。撞球開球案例(種子 3003)重複了這個模式:白球撞擊,彩色球以可信的動量傳遞散開,並持續互相碰撞,而競爭對手在相同輸入下皆落後。

Wan 3.0 輸掉的地方:非指令的切換與膽怯的超現實主義

一份誠實的 Wan 3.0 評測必須在此花費足夠時間,因為這兩個弱點都是結構性的,而非表面問題。

攝影機自行切換。 要求一個連續的攝影機運鏡,Wan 3.0 卻習慣插入一個生硬、未經請求的鏡頭變換。塔測試(種子 2004)要求從底部緩慢向上傾斜到頂部,然後拉遠到全景。在大約 3.5 秒時,模型直接切換到一個不同的設定,在切換處有明顯的色彩階調跳躍。

A multi-tiered stone pagoda on a mountain ridge at sunset

Wan 3.0 塔測試顯示在大約 3.5 秒處出現非指令的生硬切換,而非連續傾斜

種子 2004,8 秒,提示詞要求一個連續的傾斜與揭示。注意 3.5 秒:那個切換從未被要求。

平心而論,攝影機控制是整個領域目前的弱點:Seedance 2.0 在此評測中也未能完成一次完整的環繞,而 Wan 2.7 並無優勢。在 Wan 3.0 上更糟的是,相同的切換行為在 30 秒的執行中會再次觸發,而這正是單一不間斷鏡頭最重要的地方。下面會詳述。

超現實指令被淡化。 衝突維度給模型一個與輸入圖片矛盾的提示詞,這是每個超現實廣告概念的基礎。輸入:一個普通的客廳。提示詞:室內開始下起大雨,浸濕家具。

Minimalist living

室內下雨衝突測試的輸入幀:一個普通的客廳內部

兩個模型接收到的輸入幀。提示詞要求在此場景中下室內雨,種子 10001。

Minimalist beige living room with curved sofa and abstract portrait painting

室內下雨衝突測試,左側 Wan 3.0 幾乎未改變房間,右側 Seedance 2.0 完全投入室內降雨

左 Wan 3.0:燈光變化,植物附近有局部水花,沒有雨。右 Seedance 2.0:實際的室內雨,整體連貫。這是整組評測中差距最大的項目。

Wan 3.0 的回應是燈光改變和室內盆栽附近的一點象徵性水花。Seedance 2.0 則全力以赴:真正的雨,在室內,且房間在被淋濕的過程中保持連貫。第二個衝突案例,一隻鯨魚在會議室上方滑行(種子 10003),以不同方式失敗但原因相同:Wan 3.0 將整個辦公室染成藍色,而非整合鯨魚。模式一致:當圖片與提示詞不一致時,Wan 3.0 站在圖片那一邊。對於需要忠實度的產品工作,這個直覺是優點。對於想像力驅動的創意簡報,這就是使用其他模型的原因。

Wan 3.0 的 30 秒獨家功能,以及削弱它的切換問題

一次生成 30 秒是 Wan 3.0 的頭號能力,在此次對決中沒有任何其他模型能達到:Seedance 2.0 和 Wan 2.7 都限制在 15 秒。評測中分配了六個專屬案例加上時長階梯,而長生成的核心風險——身份崩潰——並未發生。在九個 30 秒的影片中,沒有人變成另一個人,場景也沒有悄悄變成另一個房間。

長時間線上的指令遵循也保持住了。足球案例(種子 11006)編寫了四個連續的節拍:一個孩子後退拉開距離,兩人傳球三次,一人遠射,另一人歡呼。四個節拍全部按順序出現:

種子 11006,30 秒,一次生成:後退、三次傳球、遠射、慶祝。單一提示詞中的多階段場景設定,按順序執行。

然後,攝影機章節的同一個缺陷又回來了。招牌案例(種子 11004)要求一個極慢的推近與拉遠,同時招牌文字保持可讀。在大約 4 到 5 秒時,影片透過一個鬼影般的雙重曝光溶解到一個不同的構圖:

種子 11004,30 秒:提示詞要求對招牌進行一個連續的推拉。注意 4 到 5 秒:一個非指令的溶解,帶有短暫殘影,進入新的畫面構圖。

第三個長案例,一個 30 秒的說話人像(種子 11002),在大約 15 到 17 秒處重複此模式,出現一個溶解加上姿勢和畫面構圖的改變。模型表現得好像它在導演一部多鏡頭的短片,而簡報要求的是單一鏡頭。影片越長,它抓住的機會就越多。在解決這個問題之前,請將 30 秒的輸出視為一個可能需要修剪的序列,而非一個保證不間斷的鏡頭,並保持對獨家功能的謹慎態度:它是真實的,它能保持身份,但它目前附帶了一個你並未聘用的內建剪輯師。

Wan 3.0 vs Seedance 2.0:哪個模型適合哪項工作

完整的 10 維度評分卡,濃縮版。「持平」表示在此評測中雙方均無可重複的優勢。

維度與 Wan 2.7 相比與 Seedance 2.0 相比
主體運動更好的運動邏輯Wan 3.0 在身份保持上更佳
攝影機運鏡持平,兩者皆弱持平,兩者皆弱,Wan 3.0 增加非指令切換
物理效果大幅提升Wan 3.0 領先,更忠於首幀
多主體互動持平Seedance 2.0 明顯領先
環境變化領先領先,主體保持鎖定
靜止保持領先場景道具略遜一籌,真人演員領先
文字與 UI領先各有所長,兩者在 UI 互動上皆表現不佳
風格化內容領先Seedance 2.0 在風格語義上明顯領先
圖像提示詞衝突持平Seedance 2.0 大幅領先,為評測中最大差距
30 秒生成獨家功能獨家功能,Seedance 2.0 止於 15 秒

兩行選擇邏輯。嚴格的圖生影片忠實度、鎖定主體、物理事件、真人素材,或任何超過 15 秒的內容:Wan 3.0。多角色場景、超現實或衝突驅動的創意、風格化格式:Seedance 2.0。

你現在就可以測試這張表的一半,無需等待。Seedance 2.0 圖生影片Wan 2.7 圖生影片 都在 Atlas Cloud 上使用一個金鑰即可使用,每次執行的成本會在按鈕上顯示,然後再決定是否執行。設定你自己的種子,重複使用一個首幀,並逐字運行本文中的玻璃掉落或室內下雨提示詞。當 Wan 3.0 上線時——而且這個家族有在 Atlas 上第零天抵達的歷史——你的評測基準可以直接轉移,你的提示詞也已校準。如果你想要準備提示詞的這一方面,Wan 3.0 提示詞指南 逐案分解了官方手冊的結構。

常見問題

Wan 3.0 比 Seedance 2.0 好嗎?

兩者皆非主導;它們在相同種子評測中按性格分野。Wan 3.0 在忠實度上勝出:動態中的身份、物理效果、環境與主體分離、首幀保真度,加上獨家的 30 秒輸出。Seedance 2.0 在想像力上勝出:多主體互動、超現實指令遵循與風格化內容,其中衝突維度是其最大優勢。根據每個鏡頭選擇,而非根據品牌。

這份 Wan 3.0 評測中最大的問題是什麼?

非指令的攝影機切換。要求一次連續運鏡的提示詞反覆出現生硬、未經請求的鏡頭變換,有時伴隨殘影:在 8 秒傾斜測試(種子 2004)的 3.5 秒處,在 30 秒執行(種子 11004、11002)的 4 到 5 秒以及 15 到 17 秒處。這個問題很容易重現,並直接限制了單一鏡頭的可用性。

Wan 3.0 真的能生成 30 秒的影片嗎?

是的,一次生成,且身份在全部九個 30 秒評測執行中保持不變,一個四節拍的編排序列(種子 11006)也按順序執行。但警告是同樣的切換缺陷:長執行往往包含至少一個非指令的溶解或鏡頭變換,因此請計畫進行修剪,而非期望一個保證不間斷的鏡頭。

這份 Wan 3.0 評測是如何測試的?

49 個圖生影片案例,橫跨 10 個維度,每個案例以 720p 和固定種子執行,並在 Seedance 2.0 和 Wan 2.7 上以相同的首幀、提示詞和種子重新執行。所有結果由人工審查,逐片段進行,沒有任何模型獲得重試機會。嵌入的影片片段是實際的評測輸出,包含種子,因此可以直接檢查比較結果。

我可以在 Wan 3.0 發布之前重現這個評測嗎?

這個方法今天就可以轉移:固定一個種子,鎖定一個首幀和提示詞,然後在現有模型上執行相同的三元組。Seedance 2.0 和整個 Wan 2.7 家族現在都在 Atlas Cloud 上,而當這個模型家族更新時,該平台通常也會在第零天提供存取權限,因此同樣的評測應該可以在 Wan 3.0 上線當天擴展到它。

結論

Wan 3.0 讀起來像是一個由重視輸入圖片的人所建立的模型:你給它的東西,它會保護,透過運動、透過物理效果,以及透過完整的 30 秒。這種紀律正是忠實的商業圖生影片工作所需要的,也正是模型在看到要求圖片變成其他東西的提示詞時會退縮的原因。將它與一個大膽想像力的模型配對,而非取代它,並在它公開上線時觀察一個數字:非指令切換率是否會下降。這單一項修復將決定 30 秒獨家功能是頭條亮點還是附帶條件。

最新模型

一個 API,暢享全模態 AI。

探索全部模型