Seedance 2.5 が提供開始 — Atlas Cloud で先行リリース

Wan 3.0 Previewが公開: 4Kなし、オープンウェイトなし、「一発撮り」をごまかそうとしてぶつかった15秒の壁

Wan 3.0 Previewは2026年8月6日にパブリックベータへ移行。Alibaba自身のドキュメントで全仕様を照合し、さらにそのワンテイクを疑似再現しようとしてぶつかった15秒の壁を検証しました。

複数のモニターに向かってコントロールパネルで作業する動画編集者

00:00から00:30までのタイムコードで同じ雨の屋上ショットを表示しているカラーグレーディングルームの壁

1本の連続テイク30秒をタイムライン上に並べたもの。そこへ到達するまでが、この話のすべてです。

Wan 3.0 Previewがパブリックベータに入った日、私は仕様書を探しました。検索結果の最初のページには、ネイティブ4K対応、Apache 2.0で提供、「6カメラAIディレクターモード」搭載と書かれていました。6つの異なるサイトが同じ主張をしていて、そのどれも一次情報にリンクしていませんでした。

そこでAlibaba自身のモデルページを開きました。480P、720P、1080P。4Kはありません。次にHugging Face APIを直接叩き、Wan-AI organization配下の全リポジトリを取得しました。最新のものはWan 3.0のローンチと同じ日にpushされたWan2.2-Animate-2です。3.0に該当するものは何もありません。

そして、ほかの誰もやっていない部分に取り組みました。Wan 3.0の目玉は、1回のパスで30秒の連続動画を生成できることです。私はそれにアクセスできないので、今日実際に呼び出せるモデルで同じ結果を再現しようとしました。失敗しました。ただ、その失敗の仕方こそが、この記事で最も有用な部分になりました。

主なポイント

  • Wan 3.0 Previewは2026年8月6日にパブリックベータへ移行しました。 モデルIDはwan3.0-videoで、Alibaba Cloud Model StudioとQwen Cloud上の申請制です。誰でも自由にサインアップできるわけではありません。
  • 実際の仕様: 1回のパスで最大30秒、480P/720P/1080P、出力1秒あたり$0.05/$0.10/$0.20。
  • 4Kはなく、オープンウェイトもありません。 Wan-AI配下の全リポジトリをHugging Face APIで照会しました。ダウンロード可能なものとしてWan 2.2を超えるものは存在しません。
  • 本当のボトルネックはレート制限です: 同時リクエスト2件、30 RPM、非同期キュー50タスク。
  • Wan 2.7で30秒のワンテイクを偽装することはできません。 ドキュメントにない3つの制限により、本当に連続している最長クリップは15秒で頭打ちになり、2本目の継続生成をつなぐと、モデルは前に進むのではなく後ろへループします。

15秒の壁: Wan 3.0 Previewが本当に売っているもの

これが私の得られた最良の結果です。1080Pで途切れない15秒。ネオンサインへ寄り、雨の中で屋上のコーヒースタンドを片付ける店員を映し、そこから濡れた通りとタクシーへクレーンダウンする。編集なし、生成音声ありの、1本の連続生成ファイルです。

中国語の文字とSHENZHENを表示するピンクとシアンのネオンサイン

Wan 2.7による15秒の連続動画: ネオンサイン、屋上の店員、雨の通りとタクシーへのクレーンダウン

Wan 2.7ファミリーが私に生成できた、本当に連続した最長クリップ: 15秒、1080P、1ファイル。ここでは無音GIFとして表示していますが、納品ファイルには44.1kHzステレオ音声が含まれています。

これは良い結果です。同時に、Wan 3.0が1回の呼び出しで実現すると主張するもののちょうど半分でもあります。そして15秒のところで天井は完全に溶接されています。以下は、その溶接箇所をどう見つけたかです。

あなたが読むWan 3.0 Previewの仕様表が、おそらく間違っている理由

このローンチが異常に騒がしい理由は2つあります。第一に、1回の生成パスで30秒というのは、このファミリーにとって本当に初めてのことです。Wan2.7-Videoは15秒が上限で、主流の動画モデルの多くは5〜15秒の範囲に収まっています(TNGlobal、2026年8月)。第二に、Wan 3.0は他が受け付けない参照入力を受け付けます。テキスト、画像、音声、動画に加えて、doc、xls、ppt、pdf、mdファイルおよびWebページを受け付けるため、スライドデッキを動画にできます(AlphaSignal、2026年8月)。

この組み合わせにより、ドキュメントを開いてもいないサイトから膨大な記事が生まれました。広く出回っている主張を、一次情報と照合した結果が以下です。

表A: Wan 3.0 Preview仕様チェック

広まっている主張一次情報が述べていること判定
1回の生成パスで30秒確認済み。Wan 2.7の2〜15秒に対するもの✅ 本当
ネイティブ4K出力公式解像度は480P、720P、1080Pのみ❌ 誤り
Apache 2.0のオープンウェイトHugging FaceのWan-AI配下にWan 3.0リポジトリは存在しない❌ 誤り
ドキュメントから動画へ(PDF、PPT、XLS)参照入力タイプとして確認済み✅ 本当
「6カメラAIディレクターモード」Alibabaのドキュメントには一切登場しない❌ 裏付けなし
「12言語リップシンクとIDロック」Alibabaのドキュメントには一切登場しない❌ 裏付けなし
1秒あたり$0.05 / $0.10 / $0.20480P / 720P / 1080Pで確認済み✅ 本当
誰でも利用可能Model StudioとQwen Cloudで申請制⚠️ ベータ、招待が必要

価格とレート制限はモデルページに直接記載されています。同時リクエスト2件、毎分30リクエスト、非同期キュー50タスクです(QwenCloud、2026年8月)。この同時実行数はほとんど報じられていませんが、ページ上で最も重要な行です。並列ジョブ2つで、それぞれに数分かかるなら、ローンチデモには十分です。しかしパイプラインではありません。

次は、オープンソースコミュニティが本当に気にしている問いです。Wan 2.1とWan 2.2はダウンロード可能なチェックポイントを提供しました。Wan 2.5はウェイト提供を約束しながら実現せず、Wan 2.6は完全にクローズドで、Wan 2.7はAPIのみのままでした。3.0がこの流れを断ち切るのかを確認するため、Wan-AI organization配下の全モデルをHugging Face APIで作成日順に照会しました。最新の3リポジトリはいずれもWan2.2-Animate-2のバリアントで、Wan 3.0がローンチした同じ2026年8月6日に作成されています。最もダウンロードされているリポジトリは今もWan2.2-TI2V-5B-Diffusersで、直近30日間のダウンロード数は約179,000です(Hugging Face、2026年8月)。

したがって答えはノーで、オープンウェイトの上限はWan 2.2のままです。ローカル実行やファインチューニングを計画していたなら、実行できるものは何もありません。

Wan 3.0 Previewのスタック: 今日実際に動かせるもの

状況はきれいに二分されます。Wan 3.0は申請フォームの背後にあり、同時実行は2ジョブに制限されています。それ以前のWan 2.7から2.2までは、SeedanceやKlingと並べてクロスモデル比較するために、1つのAPIキーですぐに呼び出せます。この記事のすべては、その方法で、ブラウザの1タブ内で実行しました。

以下の価格は、ブログ記事ではなく、2026年8月10日時点のAtlas Cloudモデルカタログに基づいています。

表B: Wan 3.0 Previewと、棚にあるものの比較

モデル最長の1回パス解像度アクセス同時実行表示価格(1秒あたり)
Wan 3.0 Preview30s480P / 720P / 1080P申請が必要2$0.05 / $0.10 / $0.20
Wan 2.7 text-to-video15s720P / 1080P / 1080P-SR / 1440P-SRオープン標準$0.10から
Wan 2.7 image-to-video15s720P / 1080Pオープン標準$0.10から
Wan 2.6 text-to-video15s720p / 1080pオープン標準$0.07($0.10から30%オフ)
Wan 2.5 text-to-video10s720p / 1080pオープン標準$0.035($0.05から30%オフ)
Wan 2.2 image-to-video10s480p / 720pオープン、ウェイトはダウンロード可能標準$0.03
Seedance 2.5 text-to-video30s480p / 720pオープン標準$0.134から
Kling v3.0 Pro text-to-video15sモデル既定オープン標準$0.095($0.112から15%オフ)

割引は2026年8月時点で有効ですが期間限定なので、その価格を前提に予算を組む前にモデルページを確認してください。

この表から分かることが2つあります。Wan 3.0の30秒シングルパスは、もはや唯一無二ではありません。Seedance 2.5はすでに1回の呼び出しで4〜30秒のdurationを受け付けます。ただし720pが上限です。そしてWan 2.7は1440P-SRを提供する唯一の行です。これは独自スキーマ上、ネイティブ1080Pの80%で課金される超解像ティアで、Wan 3.0にはありません。

Wan 3.0だけが持っているのは、1回のパスで30秒を1080Pで生成できることと、ドキュメント参照入力です。Wan 3.0にはAtlas Cloud上にComing Soonと表示されたプレースホルダーページがあり、提供開始時には同じキーで使えるようになります。それまでは、旧モデルでどこまで行けるのかを正確に示します。

Wan 3.0 Previewチュートリアル Step 1: ワンテイクのブリーフを書く

ブリーフは世代をまたいで使い回すので、一度だけ書きます。Wan 3.0は長く、タイムコード付きのショット説明に報いてくれます。Wan 2.7も5,000文字のプロンプト上限内で同じ構造を受け付けます。

有効なテンプレートは、Shot [timecode] + subject action + camera move + light + ambient audioです。最初の行でテイクが連続していることを宣言し、サウンドベッドを明示的に記述します。Wan 2.7は音声をネイティブ生成するため、空欄にすると役に立たないものを勝手に作ります。

私は意図的に、雨の夜の屋上コーヒースタンドを選びました。同時に壊れがちな4つの要素、つまり持続的なカメラ移動、時間をまたぐ顔の一貫性、濡れたネオン反射、連続した環境音ベッドをストレステストできるからです。

text
1BEAT 1 (0-10s): Slow dolly-in from a flickering pink-and-cyan neon sign toward a
2young female vendor wiping down a steel counter on a rooftop coffee stall.
3BEAT 2 (10-15s): The camera cranes down over the rooftop edge to the wet street
4below, gliding toward a taxi idling at the curb.
5Constant: heavy rain, neon palette, 35mm anamorphic, film grain, no cuts.
6

これは計画であって、プロンプトではありません。貼り付けるプロンプトは以下です。

Step 2: 1080Pで冒頭を生成する

Wan 2.7 text-to-videoページを開き、Beat 1を完全に書き出して貼り付けます。

text
1Continuous single take, no cuts. A rainy night rooftop coffee stall in Shenzhen.
2Shot [0-4s]: Slow dolly-in from a flickering pink-and-cyan neon sign toward a
3young female vendor wiping down a steel counter, rain streaking through the neon
4glow, steam rising from a kettle.
5Shot [4-10s]: The camera settles at chest height as she looks up and half-smiles,
6shallow depth of field, wet reflections on the counter, raindrops visible against
7the dark sky behind her.
8Audio: steady rain, distant traffic hum, the clink of a ceramic cup.
9Cinematic, anamorphic, 35mm, high dynamic range, fine film grain.
10

設定: Resolution 1080P、Aspect ratio 16:9、Duration 10、Prompt extend OFF

Prompt extendはデフォルトでオンになっており、生成前にプロンプトを書き換えるため、タイムコード付きのショット制御が静かに破壊されます。ショット分解が重要な場合は必ずオフにしてください。

Durationは最大の15秒ではなく10秒に設定します。これはコスト上の判断ではなく、その理由はStep 3で初めて見えてきます。

入力設定と完了した動画出力を表示するAI動画生成インターフェース

Atlas Cloud上のWan 2.7 text-to-video。実行完了、OUTPUTパネルに1080P出力が表示されている

プレイグラウンドでのStep 2: プロンプトを貼り付け、1080P、16:9で実行し、右側に結果が表示されています。Runボタンの見積もりが5秒の1080Pジョブで$0.75になっている点に注目してください。これは1秒あたり$0.15で、カタログの「$0.10から」とは異なります。

Step 3: 継続生成し、どこで壊れるかを見る

Wan 2.7のimage-to-videoエンドポイントには、既存クリップを受け取って撮影を続ける動画継続モードがあります。Step 2の出力URLをvideoフィールドに入れ、Durationを15に設定し、Beat 2を貼り付けます。

text
1Continue the same unbroken take with identical camera language and lighting.
2The crane-down continues past the rooftop edge to street level, the camera
3gliding forward through the rain toward a taxi idling at the curb, wipers
4sweeping. Keep the rain intensity, neon colour palette, film grain and ambient
5audio identical to the source clip. No cut, no fade, no scene change.
6

これで、この記事の冒頭にある15秒クリップが生成されます。ここで、私がぶつかった3つの制限があります。いずれもドキュメントには載っていません。

1つ目: ソースクリップは2〜10秒でなければなりません。 だからStep 2は10秒に制限しています。15秒の冒頭を生成すると、15秒ファイルは有効な入力ではないため、まったく延長できません。

2つ目: 要求するdurationはソースdurationを上回っていなければなりません。 10秒のクリップを入力して10秒を要求すると、APIは即座に拒否します: first_clip duration (10s after trim) must be less than the requested duration (10s)。つまり出力にはソースが含まれ、1回のパスで追加できるのは最大5秒です。

3つ目: ソースクリップを保持しません。 これが重要です。下の上段は元の10秒クリップの5秒時点と9.9秒時点です。下段は継続生成出力の同じ2つのタイムコードです。

カウンターを拭く女性と雨の都会の通りにいるタクシー

ソースクリップと継続生成出力を5秒時点と9.9秒時点で比較する4フレーム

上段: ソースクリップの5秒時点と9.9秒時点。下段: 継続生成出力の同じタイムコード。5秒時点では一致しています。9.9秒までには、ソースはまだ店員を映しているのに、継続生成のほうはすでに通りへ切り替わっています。ソースをおおよそ最初の6秒に再圧縮し、残りを新しい素材に使っているためです。

つまり、継続生成は連結ではありません。クリップを速く再レンダリングして余地を作り、元の演技の最後の数秒は単純に消えます。

そこで当然、チェーンすればよいのではという考えが浮かびます。15秒の結果を再び入力し、さらに15秒を要求する。試しました。返ってきたのがこれです。

夜の屋外で金属カウンターを拭く女性

シーンを前進させるのではなく屋上の店員へ戻ってしまう、2回目のチェーン継続生成

2回目の継続生成パス。通りとタクシーを再生した後、先へ進むのではなく、シーケンスの最初にある屋上の店員へループバックします。チェーンしても蓄積されません。

これが壁です。出力上限は15秒、入力上限は10秒、そしてチェーンの2つ目のリンクは逆方向へ進みます。本当に連続したフッテージは、このモデルファミリーでは15秒が天井です。それより長いものはテイクではなくカットであり、30秒のシングルパスが存在する理由は、まさにそのカットをなくすことです。

開示を1つ。この継続生成ステップのプレイグラウンドキャプチャは、ページのプリセット参照画像が実行を横取りし続けたため3回失敗しました。そのためStep 3はプレイグラウンドUIではなくAPI経由で実行しました。上記のプロンプト、設定、出力はいずれもその実行から得たものです。

Wan 3.0 Previewの30秒は実際いくらかかるのか

Step 2のRunボタンは、5秒の1080Pジョブに対して$0.75を提示しました。これは1秒あたり$0.15で、カタログに記載された$0.10ではありません。記載額は下限であり、課金は解像度に応じてスケールするためです。カード表示よりも、必ず見積もりを信じてください。

その実際のレートでは、私の15秒の連続フッテージは、10秒の冒頭に$1.50、継続生成に$2.25かかったため、納品された15秒で$3.75でした。

表C: 30秒のコスト、5つの方法

経路計算合計実際に得られるもの
Wan 3.0 Preview、1080P$0.20 × 30$6.0030秒連続、1回のパス、継ぎ目なし
Wan 3.0 Preview、720P$0.10 × 30$3.00720Pで30秒連続
Wan 3.0 Preview、480P$0.05 × 30$1.50480Pで30秒連続
Wan 2.7、冒頭+継続生成$0.15 × 25 billed$3.7515秒のみ。 30秒には到達不可。
Seedance 2.5、480pfrom $0.134 × 30~$4.0530秒連続、720pが上限

4行目をもう一度読んでください。Wan 2.7で15秒の連続映像を生成するコストは、Wan 3.0が720Pで30秒の連続映像に課す料金より高くなりました。回避策は安い選択肢ではありません。高いうえに、機能しない選択肢です。

Seedanceの行について1つ注意があります。表示レートは480pの下限で、このモデルはピクセル面積で課金されるため、720pでは実際にはおおよそその2.25倍になります。

ライセンスについては慎重になるべきです。Wan 3.0はベータ中なので、商用条件はモデルライセンスではなく、申請時に同意するAlibaba Cloudのサービス契約に基づきます。また、一般提供前に変更される可能性があります。公開ウェイトがないため、ローカルデプロイやファインチューニングは選択肢になりません。クライアントワークを出荷する前に、帰属表示やウォーターマークの要件を自分のアカウント条件で確認してください。

よくある質問

Wan 3.0 Previewはもう誰でも使えますか?

いいえ。2026年8月6日にパブリックベータへ移行しましたが、アクセスはAlibaba Cloud Model StudioとQwen Cloudを通じた申請制です。承認されたアカウントには同時リクエスト2件、30 RPM、非同期キュー50タスクが付与されますが、これは本番環境ではなく評価向けの規模です。

Wan 3.0 Previewはオープンソースですか?ウェイトはどこにありますか?

ありません。Wan-AI organization配下の全リポジトリをHugging Face APIで照会しても、Wan 2.2を超えるものは返ってきません。最新の3リポジトリはいずれもWan2.2-Animate-2のバリアントで、Wan 3.0がローンチした同じ日に作成されました。Wan 2.2がオープンウェイトの上限のままです。

Wan 3.0 Previewは本当にネイティブ4Kに対応していますか?

いいえ。公式ドキュメントに記載されているのは480P、720P、1080Pです。4Kという主張は、一次情報ではなく互いを引用し合うアグリゲーターサイトから来ており、解像度ティアが3つしかないAlibaba自身の価格表とも矛盾します。

30秒のWan 3.0 Preview動画はいくらですか?

1080Pでは出力1秒あたり$0.20なので、30秒で$6.00です。720Pでは$3.00、480Pでは$1.50です。比較として、Wan 2.7で1080Pの15秒連続映像を作るのに、実際の課金レートで私は$3.75支払いました。

Wan 3.0 Previewへのアクセスなしで、今日30秒のワンテイクを生成できますか?

Wan 2.7ではできません。その継続生成モードは出力が15秒で頭打ちになり、10秒以下のソースクリップしか受け付けず、チェーンすると後ろへループします。Seedance 2.5なら1回のパスで4〜30秒を生成できますが、上限は720pです。

Wan 3.0 PreviewとWan 2.7: 待つ価値はありますか?

15秒を超える1本の連続ショット、またはドキュメントやWebページの参照入力が必要なら、はい。回避策はありません。15秒以下のものなら、現時点ではWan 2.7のほうが実用的です。同時リクエスト2件という制限により、3.0でのバッチ作業は、それが置き換えるモデルより遅くなるからです。

最新モデル

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索