Seedance 2.5 現已上線 — 首發於 Atlas Cloud

Wan 3.0 Preview 正式上線:沒有 4K、沒有開放權重,以及我試圖仿造時撞上的 15 秒高牆

Wan 3.0 Preview 已於 2026 年 8 月 6 日進入公開測試。本文逐項對照 Alibaba 官方文件核對所有規格,並記錄我試圖仿造它的一鏡到底時撞上的 15 秒限制。

一位影片剪輯師在控制面板前操作,面對多台螢幕

調色室牆面上顯示同一段雨中屋頂鏡頭,時間碼從 00:00 到 00:30

三十秒的一鏡到底,攤開在時間軸上。如何抵達那裡,就是整個故事。

Wan 3.0 Preview 進入公開測試的那天,我開始尋找它的規格表。搜尋結果第一頁告訴我它支援原生 4K、以 Apache 2.0 釋出,還有「六機位 AI 導演模式」。六個不同網站、同樣的說法,卻沒有任何一個連到第一手來源。

所以我打開 Alibaba 自家的模型頁面。480P、720P、1080P。沒有 4K。接著我直接打 Hugging Face API,拉出 Wan-AI 組織底下的所有 repository。最新的是 Wan2.2-Animate-2,推送日期和 Wan 3.0 發表同一天。沒有任何 3.0 相關項目。

然後我做了其他人沒在做的部分。Wan 3.0 的主打是單次生成 30 秒連續影片,而我沒有它的存取權,所以我試著用今天實際能呼叫的模型重現那個結果。我失敗了。而我失敗的方式,最後成了這篇文章裡最有用的部分。

重點摘要

  • Wan 3.0 Preview 已於 2026 年 8 月 6 日進入公開測試。 模型 ID 為 wan3.0-video,需透過 Alibaba Cloud Model Studio 和 Qwen Cloud 申請才能使用。它不是開放註冊。
  • 真正的規格: 單次生成最長 30 秒,480P/720P/1080P,每輸出秒 $0.05/$0.10/$0.20。
  • 沒有 4K,也沒有開放權重。 我查詢了 Wan-AI 底下每個 repo 的 Hugging Face API。沒有任何高於 Wan 2.2 的項目可下載。
  • 速率限制才是真正瓶頸: 2 個並行請求、30 RPM、50 個排隊非同步任務。
  • 你無法用 Wan 2.7 假造 30 秒一鏡到底。 三個未記載的限制把真正連續的最長片段卡在 15 秒;而串接第二段 continuation 會讓模型往回循環,而不是向前推進。

15 秒高牆:Wan 3.0 Preview 真正在賣的是什麼

這是我能得到的最佳結果。1080P 下十五秒不間斷:鏡頭推向霓虹招牌,雨中屋頂咖啡攤的攤主收攤,接著鏡頭吊臂下降到潮濕街道與一輛計程車。單一連續生成檔,沒有剪接,生成音訊。

顯示中文字與 SHENZHEN 的粉紅與青色霓虹招牌

十五秒連續 Wan 2.7 影片:霓虹招牌、屋頂攤主、吊臂下降到雨中街道與計程車

Wan 2.7 系列為我產出的最長真正連續片段:15 秒、1080P、單一檔案。這裡以無聲 GIF 呈現;交付檔案本身帶有 44.1kHz 立體聲音訊。

這已經很好。但它也正好只有 Wan 3.0 宣稱單次呼叫可做到的一半,而 15 秒就是天花板被焊死的位置。以下就是我如何找到那道焊縫。

為什麼你讀到的 Wan 3.0 Preview 規格表很可能都是錯的

這次發表特別吵雜有兩個原因。第一,單次生成 30 秒確實是這個系列首次做到。Wan2.7-Video 最長 15 秒,而多數主流影片模型落在 5 到 15 秒之間(TNGlobal,2026 年 8 月)。第二,Wan 3.0 接受的參考輸入是其他模型沒有的:除了文字、圖片、音訊和影片,它也接受 doc、xls、ppt、pdf、md 檔案以及網頁,所以投影片簡報能變成影片(AlphaSignal,2026 年 8 月)。

這樣的組合讓一大堆從未打開文件的網站大量報導。以下是所有廣泛流傳的說法,並對照第一手來源逐項核對。

表 A:Wan 3.0 Preview 規格核對

流傳說法第一手來源怎麼說判定
單次生成 30 秒已確認,相較 Wan 2.7 的 2 到 15 秒✅ 真的
原生 4K 輸出官方解析度只有 480P、720P 和 1080P❌ 錯誤
Apache 2.0 開放權重Hugging Face 的 Wan-AI 底下不存在 Wan 3.0 repository❌ 錯誤
文件轉影片(PDF、PPT、XLS)已確認為參考輸入類型✅ 真的
「六機位 AI 導演模式」未出現在任何 Alibaba 文件中❌ 無依據
「12 種語言唇同步搭配身分鎖定」未出現在任何 Alibaba 文件中❌ 無依據
每秒 $0.05 / $0.10 / $0.20已確認對應 480P / 720P / 1080P✅ 真的
對所有人開放在 Model Studio 和 Qwen Cloud 上需申請⚠️ Beta,需邀請

價格和速率限制直接來自模型頁面:2 個並行請求、每分鐘 30 個請求,以及 50 個任務的非同步佇列(QwenCloud,2026 年 8 月)。這個並行數字幾乎沒什麼報導,卻是頁面上最重要的一行。兩個平行工作、每個都要跑幾分鐘,拿來做發表 demo 可以。它不是 pipeline。

接著是開源社群真正關心的問題。Wan 2.1 和 Wan 2.2 都釋出了可下載 checkpoint。Wan 2.5 承諾的權重從未到位,Wan 2.6 完全封閉,Wan 2.7 則維持 API-only。我透過 Hugging Face API 查詢 Wan-AI 組織下所有模型、依建立日期排序,確認 3.0 是否打破這條連續紀錄。最新的三個 repository 全都是 Wan2.2-Animate-2 變體,建立於 2026 年 8 月 6 日,也就是 Wan 3.0 發表同一天。下載量最高的 repo 仍是 Wan2.2-TI2V-5B-Diffusers,過去 30 天約 179,000 次下載(Hugging Face,2026 年 8 月)。

所以答案是否定的,而 Wan 2.2 仍是開放權重的天花板。如果你的計畫包含本機執行或微調它,那裡沒有任何東西可跑。

Wan 3.0 Preview 技術棧:你今天實際能跑什麼

情況分得很清楚。Wan 3.0 躲在申請表後面,並有兩個工作的並行上限。在它之前的所有版本,從 Wan 2.7 往回到 2.2,都能用同一把 API key 立即呼叫,並可搭配 Seedance 和 Kling 做跨模型比較。本文中的所有內容都是這樣跑出來的,全程在同一個瀏覽器分頁裡完成。

以下價格取自 2026 年 8 月 10 日的 Atlas Cloud 模型目錄,不是來自任何部落格文章。

表 B:Wan 3.0 Preview 對比現有可用模型

模型最長單次生成解析度存取方式並行數標示每秒價格
Wan 3.0 Preview30s480P / 720P / 1080P需申請2$0.05 / $0.10 / $0.20
Wan 2.7 text-to-video15s720P / 1080P / 1080P-SR / 1440P-SR開放標準$0.10 起
Wan 2.7 image-to-video15s720P / 1080P開放標準$0.10 起
Wan 2.6 text-to-video15s720p / 1080p開放標準$0.07($0.10 的 7 折)
Wan 2.5 text-to-video10s720p / 1080p開放標準$0.035($0.05 的 7 折)
Wan 2.2 image-to-video10s480p / 720p開放,權重可下載標準$0.03
Seedance 2.5 text-to-video30s480p / 720p開放標準$0.134 起
Kling v3.0 Pro text-to-video15s模型預設開放標準$0.095($0.112 的 85 折)

折扣截至 2026 年 8 月仍在生效且有時效限制,因此在用它們編列預算前,請先查看模型頁面。

從那張表可以看出兩件事。Wan 3.0 的 30 秒單次生成已經不再獨一無二:Seedance 2.5 已經能在一次呼叫中接受 4 到 30 秒的 duration,只是上限為 720p。而 Wan 2.7 是唯一提供 1440P-SR 的列項,這是一個超解析度層級,依其 schema 以原生 1080P 的 80% 計費,Wan 3.0 沒有這個選項。

Wan 3.0 擁有而其他模型沒有的是單次生成 30 秒 1080P,再加上文件參考輸入。Wan 3.0 在 Atlas Cloud 上已有一個標示 Coming Soon 的占位頁面,所以等它上線時會落在同一把 key 上。在那之前,以下是舊模型究竟能把你帶到多遠。

Wan 3.0 Preview 教學步驟 1:撰寫一鏡到底簡報

這份 brief 會在不同 generation 之間沿用,所以一次寫好。Wan 3.0 偏好較長、帶時間碼的鏡頭描述,而 Wan 2.7 在 5,000 字元 prompt 限制內也接受同樣結構。

有效的模板是:Shot [timecode] + subject action + camera move + light + ambient audio。第一行就聲明這是一段連續 take,並明確描述 sound bed,因為 Wan 2.7 會原生生成音訊;如果你留白,它會自己發明一些不太有用的東西。

我刻意選了雨夜屋頂咖啡攤。它能壓力測試四件通常會同時崩壞的事:持續運鏡、臉部一致性隨時間維持、濕潤霓虹反射,以及連續環境音床。

text
1BEAT 1 (0-10s): Slow dolly-in from a flickering pink-and-cyan neon sign toward a
2young female vendor wiping down a steel counter on a rooftop coffee stall.
3BEAT 2 (10-15s): The camera cranes down over the rooftop edge to the wet street
4below, gliding toward a taxi idling at the curb.
5Constant: heavy rain, neon palette, 35mm anamorphic, film grain, no cuts.
6

那是計畫,不是 prompt。你要貼上的 prompts 在下面。

步驟 2:以 1080P 生成開場

打開 Wan 2.7 text-to-video 頁面,貼上完整寫出的 Beat 1。

text
1Continuous single take, no cuts. A rainy night rooftop coffee stall in Shenzhen.
2Shot [0-4s]: Slow dolly-in from a flickering pink-and-cyan neon sign toward a
3young female vendor wiping down a steel counter, rain streaking through the neon
4glow, steam rising from a kettle.
5Shot [4-10s]: The camera settles at chest height as she looks up and half-smiles,
6shallow depth of field, wet reflections on the counter, raindrops visible against
7the dark sky behind her.
8Audio: steady rain, distant traffic hum, the clink of a ceramic cup.
9Cinematic, anamorphic, 35mm, high dynamic range, fine film grain.
10

設定: Resolution 1080P、Aspect ratio 16:9、Duration 10、Prompt extend OFF

Prompt extend 預設為開啟,而它會在生成前改寫你的 prompt,悄悄破壞帶時間碼的鏡頭控制。只要鏡頭拆解是重點,就把它關掉。

Duration 設為 10,而不是 15 秒上限。這不是成本考量,原因要到步驟 3 才會看見。

顯示輸入設定與已完成影片輸出的 AI 影片生成介面

Atlas Cloud 上的 Wan 2.7 text-to-video,執行完成,OUTPUT 面板中可見 1080P 輸出

Playground 中的步驟 2:prompt 已貼上,1080P、16:9,執行完成且右側顯示結果。注意 Run 按鈕對五秒 1080P 工作的報價是 $0.75,換算為每秒 $0.15,而不是目錄中的「$0.10 起」。

步驟 3:延續它,然後看它在哪裡斷掉

Wan 2.7 的 image-to-video endpoint 有 video-continuation mode,可以接收現有片段並繼續拍下去。拿你的步驟 2 輸出 URL,放進 video 欄位,把 Duration 設為 15,並貼上 Beat 2:

text
1Continue the same unbroken take with identical camera language and lighting.
2The crane-down continues past the rooftop edge to street level, the camera
3gliding forward through the rain toward a taxi idling at the curb, wipers
4sweeping. Keep the rain intensity, neon colour palette, film grain and ambient
5audio identical to the source clip. No cut, no fade, no scene change.
6

這會產出本文開頭的 15 秒片段。接著是我碰到的三個限制,沒有任何一個寫在文件裡。

第一:來源片段必須是 2 到 10 秒。 這就是為什麼步驟 2 要限制在 10 秒。生成 15 秒開場後,你完全無法延伸它,因為 15 秒檔案不是合法輸入。

第二:要求的 duration 必須大於來源 duration。 餵入 10 秒片段並要求 10 秒時,API 會直接拒絕:first_clip duration (10s after trim) must be less than the requested duration (10s)。所以輸出會包含來源,而一次最多只能多得到 5 秒。

第三:它不會保留你的來源片段。 這才是關鍵。下面,上排是原始 10 秒片段在 5s 和 9.9s 的畫面。下排是 continuation 輸出在同樣兩個時間碼的畫面。

一名女子擦拭櫃檯,以及雨中城市街道上的一輛計程車

四個影格比較來源片段與 continuation 輸出在 5 秒和 9.9 秒的畫面

上排:來源片段在 5s 與 9.9s。下排:continuation 輸出在相同時間碼。5s 時它們相符。到了 9.9s,來源仍停在攤主身上,但 continuation 已經切到街道,因為它把來源重新壓縮成大約前六秒,並把剩餘時間用於新素材。

所以 continuation 不是 concatenation。它會用更快速度重新渲染你的片段來騰出空間,而你原始表演最後幾秒就這樣消失了。

這自然引出一個明顯想法:串接它。把 15 秒結果再餵回去,要求再來 15 秒。我試了。回來的是這個。

夜晚戶外一名女子擦拭金屬櫃檯

串接第二次 continuation,場景沒有前進,反而漂回屋頂攤主

第二次 continuation。它重播街道和計程車,然後不是繼續往前,而是循環回序列最一開始的屋頂攤主。串接不會累積。

這就是那道牆。輸出上限是 15 秒、輸入上限是 10 秒,而鏈條中的第二節會往回跑。對這個模型系列來說,十五秒真正連續素材就是天花板。再長就會是剪接,不是 take,而剪接正是 30 秒單次生成存在要消除的東西。

一點揭露:這個 continuation 步驟的 playground 截圖失敗了三次,因為頁面的預設參考圖片一直劫持執行,所以步驟 3 是透過 API 而非 playground UI 執行。上面的 prompt、設定與輸出都來自那次真實執行。

Wan 3.0 Preview 的 30 秒實際要花多少錢

步驟 2 的 Run 按鈕對五秒 1080P 工作報價 $0.75。那是每秒 $0.15,不是目錄標示的 $0.10,因為標示數字是地板價,而計費會隨解析度調整。永遠相信報價,而不是卡片上的價格。

以這個實際費率計算,我的 15 秒連續素材花了 $1.50 的 10 秒開場,加上 $2.25 的 continuation,所以 15 秒交付內容共 $3.75

表 C:30 秒的五種成本

路徑計算總計你實際得到的內容
Wan 3.0 Preview,1080P$0.20 × 30$6.0030s 連續,單次生成,沒有接縫
Wan 3.0 Preview,720P$0.10 × 30$3.00720P 下 30s 連續
Wan 3.0 Preview,480P$0.05 × 30$1.50480P 下 30s 連續
Wan 2.7,開場加 continuation$0.15 × 25 billed$3.75只有 15s。 無法達到 30。
Seedance 2.5,480pfrom $0.134 × 30~$4.0530s 連續,上限為 720p

再讀一次第四列。在 Wan 2.7 上製作 15 秒連續內容,比 Wan 3.0 對 30 秒 720P 連續內容的收費還貴。workaround 不是便宜選項;它是比較貴、而且也行不通的選項。

Seedance 那一列有個但書:它標示的費率是 480p 地板價,而模型按像素面積計費,所以 720p 實務上大約是該數字的 2.25 倍。

授權方面要小心。Wan 3.0 仍在 beta,因此商業條款來自你申請時接受的 Alibaba Cloud 服務協議,而不是任何模型授權,且在一般可用前可能改變。沒有公開權重,就沒有本機部署與微調選項。在交付客戶作品前,請依你自己帳號的條款確認署名與浮水印要求。

常見問題

Wan 3.0 Preview 現在已經對所有人開放了嗎?

沒有。它於 2026 年 8 月 6 日進入公開測試,但存取需透過 Alibaba Cloud Model Studio 和 Qwen Cloud 申請。獲准帳號有 2 個並行請求、30 RPM 和 50 個任務的非同步佇列,這個規模是為評估而不是生產設計的。

Wan 3.0 Preview 是開源嗎?權重在哪裡?

沒有權重。查詢 Wan-AI 組織底下每個 repository 的 Hugging Face API,不會得到任何高於 Wan 2.2 的項目。最新三個 repo 都是 Wan2.2-Animate-2 變體,建立於 Wan 3.0 發表同一天。Wan 2.2 仍是開放權重天花板。

Wan 3.0 Preview 真的支援原生 4K 嗎?

沒有。官方文件列出的是 480P、720P 和 1080P。4K 說法來自互相引用的聚合網站,而不是第一手來源,且它與 Alibaba 自家的價格表相矛盾;那張表只有三個解析度層級。

一支 30 秒 Wan 3.0 Preview 影片要多少錢?

1080P 下,每輸出秒 $0.20,30 秒就是 $6.00。720P 是 $3.00,480P 是 $1.50。作為比較,我在 Wan 2.7 以 1080P 做 15 秒連續內容,按實際計費費率花了 $3.75。

沒有 Wan 3.0 Preview 存取權,今天能生成 30 秒一鏡到底嗎?

不能用 Wan 2.7。它的 continuation mode 把輸出限制在 15 秒,只接受 10 秒或更短的來源片段,而且串接時會往回循環。Seedance 2.5 可以單次生成 4 到 30 秒,但最高只有 720p。

Wan 3.0 Preview 對比 Wan 2.7:值得等嗎?

如果你需要超過 15 秒的單一連續鏡頭,或需要文件與網頁參考輸入,那值得,而且沒有 workaround。至於 15 秒以內的任何內容,Wan 2.7 目前更實用,因為 2 個請求的並行上限會讓 3.0 的批次工作比它取代的模型還慢。

最新模型

一個 API,暢享全模態 AI。

探索全部模型