Seedance 2.5 が提供開始 — Atlas Cloud で先行リリース

Wan 3.0 vs Wan 2.7: 阿里巴巴の公式デモファイルを開いてみた。誰もがコピーした3つの仕様が間違っている。

Wan 3.0 vs Wan 2.7: 30秒クリップ、20の参照スロット、4Kなし、オープンウェイトなし。Alibaba公式のデモファイルを開き、今日実行できるテストを再構築しました。

カラーグレーディングコンソールとモニターに巨大な海の怪物のシーンが表示されている

最新情報: Wan 3.0 は 2026 年 8 月 24 日より稼働しています。

2台の編集用モニターが並び、左側は海の怪物が嵐を破るシーン、右側は同じ嵐が途中で止められたシーン

アリババが Wan 3.0 ベータ版に同梱した 30 秒の海の怪物クリップを再生してください。漁船、土砂降りの雨、稲妻、そして海が激しく噴き上がります。10 の異なるショット。カットは一つもありません。その下にあるオーケストラのスコアはモデルによって書かれました。

最初の反応は「すごい」ではありません。「私の Wan 2.7 には一体何が欠けているのか?」です。

そこで答えを探し始めたところ、最初にわかったのは、インターネットの大部分が間違った答えをしていることです。wan 3.0 vs wan 2.7 を検索すると、トップ結果は自信満々に「Wan 3.0 はネイティブ 4K をレンダリングする」「重みは Hugging Face にある」と述べています。どちらも真実ではありません。私は公式デモファイルをノートパソコンに取り込み、ffmpeg で読み取り、モデルレジストリと公開価格帯を確認しました。実際のアップグレードは大きいです。ただ、人々が説明しているようなアップグレードではありません。

Wan 3.0 vs Wan 2.7:重要なポイント

  • 注目は持続時間です。 Wan 3.0 は、自動「スマート持続時間」推奨により、1 パスで 30 秒を生成します。Wan 2.7 は、テキストからビデオおよび画像からビデオで最大 15 秒、参照からビデオおよびビデオ編集で最大 10 秒です。
  • 参照が一握りから多数へ。 Wan 2.7 は最大 5 つの参照アイテムを受け入れます。Wan 3.0 は最大 20 の参照アイテムを受け入れ、初めて doc、xls、ppt、pdf、md ファイル、および Web ページを生成入力として受け入れます。
  • 4K はありません。 アリババ自身の API 価格表には、480P、720P、1080P の 3 つのティアしかありません。Atlas Cloud では、Wan 2.7 は 1080P-SR および 1440P-SR の超解像オプションを通じて、実際により高い上限を提供します。
  • 重みは公開されていません。 Hugging Face の Wan-AI 組織は、依然として Wan 2.2 で頭打ちです。3.0 リポジトリ、2.7 リポジトリ、2.5 リポジトリはありません。
  • Wan 3.0 はベータ版のみ、かつファーストパーティのみです。 アリババクラウド Bailian、Wanxiang サイト、Qianwen 作成デスクトップアプリ、およびいくつかの関連製品で実行されます。今週本番環境で呼び出せる API が必要な場合、Wan 2.7 が依然として応答する世代です。
  • プロンプト文法を学ぶ前にフォーマットを見たいですか? Atlas Cloud には、1 つの製品説明を 15 秒の 2 キャラクターコメディ広告(音声対話付き)に変換する 無料の AI 広告スキットジェネレーター があります。無料で 1 回生成、透かしなし。

完全な 30 秒の怪獣シーケンス。アリババが公開ベータ期間中に Wan 3.0 で生成し、公式の Wan 3.0 クリエイターハンドブックに掲載されたものです。このクリップは私たちが生成したものではありません。音声をオンにしてください:スコアは出力の一部であり、後から追加された音楽ではありません。配信ファイル:1920x1072、24fps、30.07 秒、44.1kHz ステレオ AAC。

仕様書が見逃している最初のことは次のとおりです。そのファイルは 1920x1072 であり、1920x1080 ではありません。公式ハンドブックのすべての「1080p」デモは高さ 1072 ピクセルに収まり、公開されている他のデモのいくつかは単なる 1280x720 です。ハンドブックの 19 のクリップのうち 12 は 30.05 秒から 30.07 秒で動作しており、30 秒の上限が実際の厳格な制限であり、マーケティング上の丸められた数字ではないことを示しています。

Wan 3.0 と Wan 2.7 の比較が実際よりも難しく見える理由

正直な答えは、ほとんど誰も同じプロンプトで両方のモデルを実行したことがないということです。なぜなら、ほとんど誰もそれができないからです。Wan 3.0 は 2026 年 8 月 6 日に公開ベータ版が開始され、アリババ自身のサーフェス上にあります(QbitAI、2026 年 8 月)。サードパーティの推論プラットフォームはまだ対応していません。したがって、存在する比較コンテンツは仕様書同士の比較であり、仕様書はエラーが固まるまで横にコピーされてきました。

完全に間違っている 3 つの Wan 3.0 vs Wan 2.7 の「事実」

「Wan 3.0 はネイティブ 4K です。」 違います。公開されている API 価格表は、480P、720P、1080P で、1 秒あたり ¥0.3、¥0.6、¥1.2 です。3 つのティア、4 番目はありません。一方、Atlas Cloud は Wan 2.7 で 1080P-SR と 1440P-SR を公開しているため、純粋なピクセル上限では、古い世代が現在勝利しています。

「Wan 3.0 の重みは公開されています。」 違います。Hugging Face を閲覧すると、Wan-AI 組織の最新リリースファミリーは Wan 2.2 であり、Animate および S2V バリアントが含まれています。コアビデオラインは 2.2 以降、重みを出荷していません。ローカルの ComfyUI グラフ用に何かが必要な場合、2.1 と 2.2 がオプションであり、それは変わっていません。

「プロンプト文法はそのまま引き継がれます。」 これは、あなたを困らせる方法で半分正しいです。単語は引き継がれます。構造は引き継がれません。Wan 3.0 の公式プロンプトはタイムスタンプ付きのマルチショットスクリプトです。怪獣プロンプトは 10 の番号付きショット、ビルボードプロンプトは明示的な秒数の範囲を持つ 4 つのラベル付きビートです。10 ショットのスクリプトを 15 秒のモデルに貼り付けても、6 つのショットを優雅に選択することはありません。圧縮されます。

なぜ Wan 3.0 と Wan 2.7 の間でプロンプトを単純に交換できないのか

その下にはもう 1 つの罠があり、それが「2 つのクリップを単につなぎ合わせる」だけではあなたを救えない理由です。

Wan 2.7 にはビデオ継続モードがあります。30 秒への道のように見えます。そうではありません。入力するソースクリップは 2 ~ 10 秒である必要があるため、15 秒の生成をシードにすることはできません。出力はソースを再エンコードし、入力したクリップの末尾を食いつぶします。また、継続を連鎖させると、ストーリーを前進させるよりも、最初のビートに戻る傾向があります。15 秒は、1 つの連続した Wan 2.7 ファイルのハードな上限です。それより長いものは、生成ではなく編集です。

これら 2 つの世代間の真の移行コストであり、比較表ではそれを示してくれません。

Wan 3.0 vs Wan 2.7 仕様書、そして実際に実行する場所

これをテストするには、テキストからビデオ、参照からビデオ、ビデオ編集を同じアカウントで実行でき、失敗したテイクのコストが秒単位で課金され、サブスクリプションにならない場所が必要です。この記事の Wan 2.7 側のすべては、Atlas Cloud で実行されます。Atlas Cloud は 4 つの Wan 2.7 エンドポイントと、参照テストに使用される画像モデルをホストしています。Wan 3.0 は、Atlas Cloud やその他のサードパーティプラットフォームにはまだありません。これがまさに、この記事の Wan 3.0 のマテリアルがアリババ自身のベータ公開から来ている理由です。

表 1: Wan 3.0 vs Wan 2.7、世代間比較

Wan 3.0 (公開ベータ)Wan 2.7 (本番)
最大持続時間 (1 パス)30 秒、スマート持続時間機能付き15 秒 (t2v, i2v)、10 秒 (r2v, ビデオ編集)
参照アイテム最大 20最大 5 (被写体あたり画像 1 枚、動画最大 3 本)
入力モダリティテキスト、画像、動画、音声、doc/xls/ppt/pdf/md、Web ページテキスト、画像、動画、音声
ドキュメント入力単一ファイルまたはリンク、最大 100MB、50 ページ非対応
解像度ティア480P / 720P / 1080P720P / 1080P / 1080P-SR / 1440P-SR
ネイティブ音声ありあり
ビデオ編集指示および参照編集専用ビデオ編集エンドポイント
オープンウェイトなしなし
実行可能な場所アリババファーストパーティサーフェスのみサードパーティ API (Atlas Cloud を含む)
表示価格ティア別 1 秒あたり ¥0.3 / ¥0.6 / ¥1.2720P ベースライン 1 秒あたり $0.1

表 2: この記事で使用した Wan 2.7 エンドポイント

エンドポイント最大持続時間解像度参照制限表示価格
テキストからビデオ2-15 秒720P、1080P、1080P-SR、1440P-SRなし$0.1 / 秒
参照からビデオ2-10 秒720P、1080P、1080P-SR、1440P-SR5 アイテム$0.1 / 秒
画像からビデオ2-15 秒720P、1080P、1080P-SR、1440P-SRソースクリップ 2-10 秒$0.1 / 秒
ビデオ編集出力 2-10 秒、入力 2-10 秒720P (1.0x)、1080P (1.5x)画像 3 枚$0.1 / 秒

何かを実行する前に理解しておくべき価格の詳細の 1 つ:「1 秒あたり $0.1」という見出しは 720P ベースラインです。ビデオ編集ページでは、1080P の場合は 1.5 倍の乗数が適用されることが明記されており、Run ボタンは選択したティアの実際の数値を表示します。ヘッダーではなく、ボタンを読んでください。

現在ホストされている実行については、Atlas Cloud 上の Wan 3.0 を開き、ワークフローを公開する前に以下のようなプロンプトをテストしてください。

Wan 3.0 プロンプトと生成効果のスクリーンショット

Wan 3.0 プロンプトから結果へのスクリーンショット:モデル一致比較。

自分で Wan 3.0 と Wan 2.7 のテストを実行する

4 つのステップ。そのうち 2 つはアリババの公開資料を固定参照点として使用し、残りの 2 つは自分で実行するものです。ここでは Wan 3.0 ベータ版へのアクセスは必要ありません。

ステップ 1: Wan 3.0 クリップとその元のプロンプトを入手する

このテストの Wan 3.0 側は、あなたが生成するものではありません。読むものです。完全な怪獣プロンプトは、公式 Wan 3.0 クリエイターハンドブック に、完成したクリップとともに、「災難电影」の例として掲載されています。これは 10 の番号付きショットとスコアを説明する別の段落を持つ中国語のスクリプトです。

他のことをする前に、一度読んでください。構造が教訓です:10 のショット、それぞれに独自のカメラ、被写体、照明のメモがあり、最後にスコアリングの概要があります。これが 30 秒の 1 パス生成プロンプトの姿です。

ステップ 2: 同じプロンプトを Wan 2.7 テキストからビデオで実行する

Wan 2.7 テキストからビデオのプレイグラウンドを開き、同じスクリプトの英語版を貼り付けます。まだ短縮しないでください。意図が上限を超えたときにモデルが何をするかを見たいのです。

Plain
1A 30-second, photoreal cinematic sequence: a deep-sea kaiju emerges at night in a raging storm. Open on a small, battered fishing trawler with the white letters "WAN" on its hull, fighting through enormous waves under torrential rain; lightning briefly lights the whole ocean. Push to a mid-close shot on the deck: waves smash over the bow, ropes, nets and metal railings whip in the wind, rain streaks the lens. Then the sea ahead swells unnaturally, an enormous vortex forms, and a vast dark shape passes beneath the boat, lifting it. A crewman in a soaked rain jacket grips the rail, terrified, and turns toward the water. Finally the surface explodes upward and a colossal Pacific-Rim-style sea monster breaches: wet, scarred, ridged skin, huge jaws, tens of meters of spray. Close on its head roaring in the lightning. The trawler is nearly swallowed. End on a wide shot: the kaiju towering over the churning sea, the boat tiny in the foreground, one final lightning strike. Hollywood disaster-movie scoring: low sub-bass rumble and sparse strings building to brass and heavy percussion at the breach, ending on an oppressive sustained low chord. Photoreal scale, volumetric water, high-contrast storm lighting.
2

設定: 解像度 1080P、持続時間 15 秒 (最大)、アスペクト比 16:9、音声はオンのままにしてモデル自身でスコアリングさせます。参照音声スロットは空のままにします。

AI ビデオジェネレーターインターフェース、番号付きステップと生成されたビデオ

Wan 2.7 テキストからビデオプレイグラウンド (Atlas Cloud)、怪獣プロンプトが読み込まれ、OUTPUT パネルに完成した 15 秒クリップが表示されている

Wan 2.7 テキストからビデオ (Atlas Cloud)、プロンプト貼り付け、1080P と 16:9 選択。Run ボタンはこの短いテストテイクで $0.75 と表示しており、これは 1 秒あたり $0.15 に相当します:見出しの数字が $0.1 のモデルページで、1080P の 1.5 倍乗数がはっきりと表示されています。

次に、プロンプトに 1 行追加して 2 回目を実行します。

Plain
1Single continuous take, no cuts. Prioritize the breach moment; compress the setup.
2

その 1 行が、ミニチュアでの移行作業です。30 秒のスクリプトは 15 秒の意図として再作成する必要があり、どの 7 つのショットを削除するかを決めるのはあなたです。

左:公式 Wan 3.0 出力、30 秒。右:Atlas Cloud 上の Wan 2.7、同じプロンプトを実行、15 秒の上限で停止。

ステップ 3: Wan 3.0 と Wan 2.7 の識別テスト用の参照画像を作成する

持続時間は明らかなアップグレードです。ピクセルレベルの一貫性は、実際に制作作業を変えるものであり、2 匹の猫でテストできます。

アリババのハンドブックには、同じラグドール猫と黒猫が 5 つのまったく異なる環境 (対称的なホテルの廊下、断面図、洗濯機のドラム、空港の手荷物ベルト、赤い電話ボックス) で生き残らなければならない Wes Anderson 風のパスティーシュが含まれています。両方の猫は @Image1 および @Image2 参照タグで固定されています。

最初に自分自身の 2 つの参照を生成します。GPT Image 2 を品質高、16:9 フレームで使用し、2 回実行します。

Plain
1A studio portrait of a fluffy ragdoll cat with blue eyes and a dark mask, sitting upright facing the camera, evenly lit against a plain pale pink background, sharp fur detail, full body visible, clean reference-sheet framing.
2
Plain
1A studio portrait of a small sleek black cat with bright amber eyes, standing in profile facing right, evenly lit against a plain pale pink background, sharp fur detail, full body visible, clean reference-sheet framing.
2

AI 画像ジェネレーターインターフェース、入力設定と生成された猫

Atlas Cloud 上の GPT Image 2 プレイグラウンド、品質高、OUTPUT パネルにレンダリングされたラグドール猫の参照シート

GPT Image 2、品質高、16:9。2 番目のプロンプトも同様に実行して黒猫を取得します。

ステップ 4: Wan 2.7 参照からビデオで識別テストを実行する

両方の猫を Wan 2.7 参照からビデオエンドポイントにアップロードします。解像度 1080P、アスペクト比 16:9、持続時間 10 秒 (このエンドポイントの最大値)。以下のプロンプトは、ハンドブックのショットリストを 5 ビートから 3 ビートに圧縮したものです。なぜなら、10 秒では 5 ビートを保持できないからです。

Plain
1Wes Anderson style, perfectly symmetrical, flat frontal compositions, pastel palette. Reference image 1 is the ragdoll cat, reference image 2 is the black cat; keep both cats identical in every shot. Shot 1: an endless symmetrical hotel corridor, the ragdoll cat running straight toward the camera with a solemn expression, the black cat sprinting away in the background with its head twisted back 180 degrees. Shot 2: a cutaway side view of the corridor, pink patterned wallpaper and gold picture frames, the ragdoll walking left to right and the black cat crossing right to left. Shot 3: frontal macro on a mint-green vintage washing machine door, both cats floating stiffly inside the drum among suds, eyes blank, rainbow-ordered detergent bottles lined up behind. Rigid horizontals and verticals, no camera tilt, deadpan absurd humor.
2

AI ビデオジェネレーターインターフェース、テキストプロンプトと生成された猫のビデオ

Atlas Cloud 上の Wan 2.7 参照からビデオプレイグラウンド、両方の猫の参照が読み込まれ、OUTPUT パネルに完成したクリップが表示されている

Wan 2.7 参照からビデオ:両方の猫が画像参照スロットに読み込まれ、解像度は 1080P に設定され、Run ボタンが開始前にテイクの金額を表示しています。2 つの参照は、このエンドポイントが受け入れるもののかなりの部分をすでに占めています。Wan 3.0 は 20 の参照アイテムを受け入れます。

次に、2 つを並べて配置します。

ふわふわの猫が立っている、黒い猫と一緒に壮大な廊下に

公式 Wan 3.0 のアイデンティティロッククリップ:同じラグドールと黒猫が、ホテルの廊下、断面図の壁、洗濯機のドラム、手荷物ベルト、赤い電話ボックスにわたって一貫して保持されている

アリババが公開ベータ期間中に Wan 3.0 で生成し、公式クリエイターハンドブックに掲載。5 つの環境、19.9 秒、両方の猫が参照タグで固定。ここではサイレント GIF として表示。配信ファイルには 44.1kHz ステレオ音声が含まれています。

2 匹の猫が長いピンクの廊下を歩いている

同じ概要での Wan 2.7 参照からビデオの結果、10 秒の上限内で 3 つのショット

Atlas Cloud 上の Wan 2.7 参照からビデオ、同じ 2 つの参照。ここではサイレント GIF として表示。これはエンドポイントのデフォルトの 5 秒テイクであり、完全な 10 秒ではありません。持続時間コントロールが常に設定どおりにコミットされるとは限らないため、Run ボタンの見積もりを押す前に読む価値があります。猫の模様とラグドールのマスクに注目してください。それが「ピクセルレベルの一貫性」という主張の次元です。

再実行する価値のあるさらに 4 つの Wan 3.0 vs Wan 2.7 プロンプト

怪獣クリップは持続時間と物理を強調します。これら 3 つは異なるものを強調し、それぞれが異なる Wan 2.7 の制限に衝突します。3 つすべては、公式ハンドブックからのアリババ自身のベータ出力です。

Wan 3.0、公式ベータ出力:蛍光灯の病院の廊下を 1 つの 30 秒の連続プッシュバック、淡い緑のモノクロームグレード、女優が助けを叫ぶ。音声オン。パフォーマンス、足音、機器のハム音はすべてモデル生成。

表 3: 各プロンプトが要求するもの、および Wan 2.7 がそれを制限する場所

プロンプトスクリプトが要求するものWan 2.7 の公開された制限テストされる次元
怪獣の出現30 秒間の 10 の番号付きショット、およびスコアリングの概要テキストからビデオで最大 15 秒持続時間とマルチショットナラティブ
病院の廊下1 つの 30 秒の連続テイク、音声対話あり最大 15 秒、ネイティブ音声利用可能長回しでのパフォーマンスと対話
ガソリンスタンドのカウガール4 つのタイムドアクトでの 30 秒コメディアーク最大 15 秒なので、2 つのアクトを削除する必要がある実行時間を必要とするコメディタイミング
ビルボードワンテイク明示的な秒数範囲を持つ 4 ビート、カットなし最大 15 秒なので、範囲を書き直す必要がある長い動きにわたるカメラ物理
2 匹の猫、5 つの部屋2 つのタグ付き被写体を 5 つの環境にわたって保持最大 10 秒、5 つの参照スロットアイデンティティの一貫性

同じアイデアの無料の 15 秒バージョン

ガソリンスタンドのクリップをもう一度見てください。そのフォーマット、つまり 2 人のキャラクター、逆転、オチのある短いコメディスキットは、Wan 3.0 の追加ランタイムが最も効果を発揮する場所です。また、何かを売る可能性が最も高いフォーマットでもあります。

問題はプロンプトです。ハンドブックのコメディの例は、明示的なタイムスタンプとブロッキングを含む 800 語です。それは本当のスキルであり、習得に週末が必要です。

その週末を投資する前に、そのフォーマットがあなたの製品に効果があるかどうかを知りたいだけなら、Atlas Cloud にはプロンプトエンジニアリングを完全にスキップする無料ツールがあります。製品を説明し、オプションで最大 4 枚の製品写真(各 8MB)をアップロードし、6 つのトーン(面白いミーム、プロットツイスト、シットコム、感動的、高級、ハードセル)から 1 つ選択すると、2 人のキャラクターのスクリプトを作成し、声をキャストし、ダイアログと効果音を生成し、1 つの連続シーンとして完成した 15 秒の広告を返します。ダウンロードはクリーンで、透かしはありません。サインインする必要があり、クレジットをチャージする前に 1 回の無料生成が可能です。

テキスト入力が AI ビデオ広告に変換される図

1 行の製品コピーを入力すると、完成した 15 秒のコメディ広告が出力されます:Atlas Cloud の無料 AI 広告スキットジェネレーター

無料 AI 広告スキットジェネレーター:1 つの製品説明から、1 つの 15 秒の 2 キャラクター広告を出力します。

公園で黒いバックパックの中を見ている興奮した若い男

無料ジェネレーターからの実際の出力。音声オン:スクリプト、2 つの声、効果音はすべて 1 回の実行から得られます。

Wan 3.0 と Wan 2.7 の比較を実行するコスト

1 秒あたり、720P ティアでは 2 つの世代は同じような価格帯です。コストの違いは構造的です:以前は 15 秒だったクリップが今では 30 秒になるため、完成品はほぼ 2 倍になります。

表 4: 同じ怪獣シーケンス、4 つの方法

実行レート合計
Wan 3.0、30 秒、720P1 秒あたり ¥0.6¥18、約 $2.50
Wan 3.0、30 秒、1080P1 秒あたり ¥1.2¥36、約 $5.00
Wan 2.7、15 秒、720P1 秒あたり $0.10$1.50
Wan 2.7、15 秒、1080P1 秒あたり $0.10、ティア乗数 1.5 倍$2.25
Wan 2.7、15 秒、1440P-SRRun ボタンでライブ見積もりライブ見積もり
無料 AI 広告スキット、15 秒無料、アカウントあたり 1 生成$0.00

2 つの注意点。ベータ価格は一般提供価格ではなく、アリババは API が間もなくより広く開放されると述べているため、¥の数値は確定レートではなく公開ベータのスナップショットとして扱ってください。また、Atlas Cloud 側では、コミットする前に常に Run ボタンのライブ見積もりを読んでください。解像度の乗数はそこで適用され、見出し価格には適用されません。

アリババはまた、Wan 3.0 がまだ弱い点について異常に率直であり、モデルは「音質とテキストの精度においてまだ改善の余地がある」と述べています。これはファイルが示すものと一致しています:公式デモの音声は 44.1kHz ステレオですが、控えめな 32 kb/s でエンコードされており、プレビューには十分ですが、デリバリーマスターには薄いです。

Wan 3.0 vs Wan 2.7 ライセンス:実際に出荷できるもの

短いバージョン。ただし、クライアントの前に何かを出す前に、必ず現在の条件を自分で確認してください。

Wan 3.0 は公開ベータ版であり、その商用条件は確定していません。重みがリリースされていないため、セルフホストのパスはまったくありません。作成するものはすべてアリババの API またはコンシューマーサーフェスを経由し、生成した時点でのそれらの条件に拘束されます。Wan 2.7 は重みに関して同じ状況ですが、本番環境で十分に長い間稼働しており、プラットフォーム API 条件は安定しています。サードパーティのプラットフォームを介して実行している場合、商用権利はそのプラットフォームの利用規約に基づくため、実際にアカウントに適用されるものを読んでください。これらの段落のいずれも法的アドバイスではありません。

Wan 3.0 vs Wan 2.7 FAQ

Wan 3.0 はオープンソースですか? ComfyUI で実行できますか?

いいえ。2026 年 8 月現在、Hugging Face の Wan-AI 組織の下に Wan 3.0 リポジトリはなく、Wan-Video GitHub にもありません。重みがリリースされている最新の Wan ファミリーは Wan 2.2 であり、Animate および S2V バリアントが含まれます。ローカルの ComfyUI グラフの場合、まだ 2.1 または 2.2 を使用しています。Wan 3.0 は API と Web のみです。

Wan 3.0 vs Wan 2.7 解像度:Wan 3.0 は本当に 4K を生成しますか?

いいえ。公開されている API 価格表には、480P、720P、1080P の 3 つの解像度ティアがあります。ネイティブ 4K を主張する広く共有されている比較記事のいくつかは間違っています。生の出力上限では、Atlas Cloud 上の Wan 2.7 は、1080P-SR および 1440P-SR の超解像オプションを通じて、実際により高い解像度を提供します。

Wan 2.7 でクリップを拡張して 30 秒を取得できますか?

1 つの連続ファイルとしては取得できません。継続モードでは、2 ~ 10 秒のソースクリップが必要なため、完全な 15 秒の生成をシードにすることはできません。出力は入力したものの末尾を再エンコードしてトリミングし、連鎖的な継続は最初のビートに向かってループバックする傾向があります。15 秒を超えると、生成ではなく編集になります。

Wan 3.0 vs Wan 2.7:今日、それぞれを実際にどこで実行できますか?

Wan 3.0 は、アリババの独自のサーフェスで公開ベータ版です:アリババクラウド Bailian、Wanjing Yike、Wanxiang サイト、Qianwen 作成デスクトップクライアント、IF STUDIO、Duiyou。Qianwen アプリではグレースケールアクセスが可能です。サードパーティの推論プラットフォームはまだホストしていません。Wan 2.7 は、テキストからビデオ、画像からビデオ、参照からビデオ、ビデオ編集エンドポイント全体で、依然として直接呼び出すことができる世代です。

Wan 3.0 vs Wan 2.7 価格:完成クリップあたりのコストが高いのはどちらですか?

720P ティアでは 1 秒あたりのコストは近いです。完成クリップあたりでは、自然な出力長が 15 秒から 30 秒になったため、ほぼ 2 倍になると予想されます。レートの変更ではなく、ランタイムの変更に予算を計上し、ベータ価格が一般提供まで維持されない可能性があることを覚えておいてください。

Wan 2.7 のプロンプトを Wan 3.0 用に書き直す必要がありますか?

はい、そして書き直しは語彙的ではなく構造的です。Wan 2.7 のプロンプトは、1 つの連続したショットを豊富な詳細で説明します。Wan 3.0 のプロンプトはタイムスタンプ付きのショットリストであり、場合によっては別のスコアリング段落があり、モデルは入力として pdf やデッキも読み取ります。経験則:Wan 2.7 の場合は 1 つのショットについて 1 段落を書き、Wan 3.0 の場合は秒数の範囲を持つ番号付きシーン内訳を書きます。

最新モデル

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索