30秒のクリップは、プロンプトが崩れる30のチャンスを与えます。Seedance 2.5は2026年7月31日に正式ローンチし、まずJimeng AIとDoubaoプロフェッショナル向けで展開、その後Volcano ArkでAPIアクセスが可能になります。出力長の倍増、50アセットの参照上限、より細かい編集制御は、何よりも一つのスキルを報います。それは、プロンプトをショットリストのように書き、各参照ファイルに名前付きの役割を与えることです。

Seedance 2.0を学んだ人にとって良いニュース:文法は変わっていません。Seedance 2.5は、Seedance 2.0を定義した同じ3つのタスク分割(参照、編集、拡張)を維持しています。変わったのは、どれだけの素材を入力できるか、そしてモデルがどれだけ長く一貫性を保たなければならないかです。このガイドでは、その両方を説明します。
重要ポイント
- Seedance 2.5は1回のパスで最大30秒を生成し、1ジョブあたり最大50の参照アセット(画像30、動画クリップ10、音声クリップ10)を受け付けます。
- コアとなるプロンプト構造はSeedance 2.0から引き継がれています:被写体を定義し、番号付きのショットを書き、対話を{}で囲み、品質と制約ワードで締めくくります。
- 編集プロンプトは1つの厳格なルールに従います:特性を借用する場合のみ「reference @video1」と書き、編集の場合は動画を平易に命名します。そうしないと、モデルが編集を参照ジョブと誤解する可能性があります。
- Seedance 2.5はローンチ時点ではAtlas Cloudにまだリストされていません。同じ参照文法は、現在Atlas Cloud上のSeedance 2.0ファミリーで動作しており、2026年7月31日時点で有効な20%割引で約1秒あたり0.09ドルから利用できます。
Seedance 2.5がプロンプトライターに与える変化
キーボード上で重要な4つのアップグレードがあります。1回のパス出力が15秒から30秒に拡大。参照上限が3倍の50アセットに。編集が第一級のプロンプトタスクとなり、独自の文法(このガイドの別セクションで扱います)が追加されました。そして、対話生成が10以上の言語でネイティブに動作するようになりました。

ByteDanceは30秒出力と50アセット上限を世界初と称しています。これはベンダーの主張として扱い、確定したベンチマークとは考えないでください。出力品質にとって実際に重要なのは方向性です:照明、カメラワーク、演技、感情の読み取りやすさがすべて改善され、AI特有のテカリが減り、映画グレードのショットワークを提案できるレベルになりました。
それでも引き続き持つべき習慣:30秒未満の出力でも、プロンプトが構造化されていれば動作は良好です。長いキャンバスはドリフトを隠すのではなく、むしろ増幅させます。
練習する場所:Atlas CloudでSeedanceプロンプトを実行する
7月31日時点では、Seedance 2.5はサードパーティプラットフォームに到達しておらず、APIアクセスとArkプレイグラウンドは2026年8月7日に完全オープン予定です。今週の実用的な動き:まったく同じ参照文法をSeedance 2.0ファミリーで練習することです。Atlas Cloudは、Seedanceモデルファミリーを通じて、テキストから動画、画像から動画、およびマルチモーダルな参照から動画へのプレイグラウンドを提供しています。@ subject構文、参照スロット、編集動詞:すべて移行可能です。
参照エンドポイントの価格はトークンベースで、モデルページには実勢レートが明記されています:720p出力は1秒あたり0.2419ドル、動画入力を含むジョブは720pで1秒あたり0.1486ドルに下がります。ファミリー全体のエントリ価格はさらに低く始まります。テキストから動画のカードは、1秒あたり約0.112ドルから、2026年7月31日時点で有効な20%割引で約0.09ドルです。Seedance 2.0 Fastは割引後約0.072ドル/秒、軽量なMiniは約0.045ドル/秒からです。割引にはカウントダウンタイマーが付いているため、プロジェクト予算を組む前にモデルページで現在の数字を確認してください。
方法1:Atlas Cloud上のSeedanceプレイグラウンド
ログインし、参照から動画へのプレイグラウンドを開くと、コードを書かずにこの記事のすべてのパターンを実行できます。左側で参照ファイルをアップロードし、プロンプトボックスに@と入力して、被写体を特定の画像、動画、または音声スロットにバインドします。

そのページのデフォルトの例はテンプレートとして読む価値があります。重要な名詞はすべて@imageにピン留めされているため、モデルはどの街やどのロボットを指すのか推測する必要がありません。
方法2:Atlas Cloud APIを通じたSeedanceプロンプト
ステップ1:APIキーを取得する。 Atlas Cloudコンソールで作成し、コピーします。


ステップ2:APIドキュメントを確認する。 エンドポイント、パラメータ、認証はAPIドキュメントにあります。
ステップ3:最初のリクエストを行う。 参照エンドポイントは、プロンプトと各参照タイプの並列配列を受け取ります:
plaintext1curl -X POST https://api.atlascloud.ai/api/v1/model/generateVideo \ 2 -H "Content-Type: application/json" \ 3 -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \ 4 -d '{ 5 "model": "bytedance/seedance-2.0/reference-to-video", 6 "prompt": "Define the woman in @image1 as Mara. Shot 1: medium tracking shot, Mara walks through the night market @image2, neon reflections on wet pavement. <sizzling from food stalls>", 7 "reference_images": ["https://your-cdn/mara-face-closeup.jpg", "https://your-cdn/night-market.jpg"], 8 "reference_videos": [], 9 "reference_audios": [], 10 "duration": -1, 11 "resolution": "720p", 12 "ratio": "16:9", 13 "generate_audio": true 14 }'
durationを-1に設定すると、モデルがこのエンドポイントの4〜15秒の範囲内で自然な長さを選択できます。返されたprediction IDをポーリングして完了するまで待ちます:
plaintext1curl https://api.atlascloud.ai/api/v1/model/prediction/<prediction_id> \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY"
完了したレスポンスには、ホストされた動画URLが含まれます。Atlas Cloudはプラットフォーム全体で1つのAPIを実行しているため、新しいSeedanceエンドポイントが追加されれば、モデル文字列を1行変更するだけで済みます。参照配列、ポーリングループ、プロンプトファイルは変更されません。
Seedance 2.0から引き継がれたSeedance 2.5プロンプトの公式
モデルを、テキスト、画像、動画、音声を読み取り、ジョブを空間レイヤー(フレーム内のもの)と時間レイヤー(時間とともにどう変化するか)に分割するマルチモーダルディレクターと考えてください。これは6つのスロットの公式に変換され、最初の2つのスロット以降はすべてオプションです:
被写体 + アクションまたはイベント + シーンと環境 + 視覚スタイル + カメラワーク + 音声
Seedance 2.0時代の拡張(照明語、品質語、「字幕なし、ウォーターマークなし」などの制約)は、これらのスロット内に収まるため、学んだことは無駄になりません。注意すべきルールの1つ:durationやresolutionなどの生成設定はプロンプトから完全に除外し、ページまたはAPIパラメータに属します。
実際には、6つのスロットは4つの書き込み行にまとめられます。以下は基本テンプレートの例を翻訳したものです:

被写体は最初に来ます。なぜなら、モデルがどの顔を指すのかを知るまで参照は役に立たないからです。各被写体を一度定義し、2〜3の安定した特徴を指定し、その後はどこでもそのラベルを再利用します。
- Define the woman in @image1 (red dress, straw hat) as Mara.
- Mara walks along the pier at dusk...

定義が漏れないようにするための3つのルール。すべての@参照に即座に役割の説明を与え、モデルが無視すべきものも含めます:「@image1は陶芸家の特徴、髪、緑のエプロンのためで、画像の背景は無視」のスタイルで。密着した顔のクローズアップを、全身ショットとは別の画像として使用します。これはSeedance 2.0時代のアイデンティティドリフト対策のテクニックで、今でも同様に効果的です。また、複数アングルのビューは慎重に扱います:被写体が5人以下の場合は単一ビューでも複数ビューでも機能しますが、5人を超える場合は単一ビューに留め、アングルシートを別々の画像に分割し、明示的に宣言するのが最善です(「これら4枚の画像は同じ折りたたみランプを定義しています。動画には1つのランプだけが表示されます」)。
音声とテキストはそれぞれ独自のラッパーを持つため、モデルが対話とキャプションを混同することはありません:
| 情報タイプ | ラッパー | 例 |
|---|---|---|
| 対話 | { } | She smiles and says {We can definitely do it} |
| 音楽 | ( ) | (upbeat rock plays in the background) |
| 効果音 | < > | |
| 画面上の字幕 | 【 】 | 【Chapter One: Departure】 |
すべての対話行は1つの言語に保ち、中括弧の前に言語を指定します。アクセント制御には専用のパターンがあります:言語、地域バリエーション、話し方、話者、そして台詞。例:「Dialogue language: natural, conversational American English. The girl says: {I thought you weren't coming.}」
Seedance 2.5プロンプトで50の参照スロットを使いこなす
50スロットの内訳は、画像30、動画クリップ10、音声クリップ10です。動画と音声の時間は別々に予算化されます:動画参照は最大30秒、音声参照も最大30秒で、各クリップは2〜30秒です。画像は最大4K、30MBまで、動画は最大4K、200MBまで、音声はmp3またはwavで15MBまで。音声のみの参照も機能します:モデルに音声トラックとテキストプロンプトだけを渡すこともできます。スロット数はSeedance 2.0の3倍、参照映像は2倍になり、その余白を埋める最悪の方法はただ詰め込むことです。

音声または動画の被写体参照は5つ以下に抑え(ジョブが要求する場合は6〜10まで)、被写体画像は8枚以下に抑えます(最大9〜12枚)。個々のクリップは5〜10秒が最適です:約2秒未満ではアイデンティティを固定するには情報が少なすぎ、一方30秒のフル参照はコピーしたい特徴を薄めてしまいます。それでも山が増えた場合の推奨カット順は、コアキャラクターを最初に、次にキーとなる製品や小道具、次にシーン、最後に全体的なスタイルです。
では、余分なヘッドルームは何に使うのでしょうか?アンサンブルシーンです。代表的な初期の例は、20の番号付きキャラクターと小道具の画像と3つの音声サンプルから構築された30秒の宮殿パーティーで、すべてのゲストが@参照にピン留めされています。そのショーケースリストも同様に動きます:複数キャラクターのグループシーン、32参照の武術シーケンス、よじ登るゴリラへのモーショントランスファーなど、すべてがスタックされたフルモダリティ参照に依存しています。
ショットリストが30秒のSeedance 2.5プロンプトを一貫性のあるものにする
引き継ぐべき最も効果的な習慣:気分を書くのをやめ、番号付きのショットを書き始めることです。「A man runs through the street, very cinematic」では、時間レイヤーにスケジュールするものが何もありません。ショットリストなら可能です:
plaintext1Define the girl in @image1 as Lin. @image2 sets the dorm scene. Reference @video1 for camera movement. 2Shot 1: medium tracking shot, early evening. Lin walks to the dorm door, pauses, takes a slow breath, slightly nervous. Warm light from the corridor window. 3Shot 2: cut to interior medium shot. Lin pushes the door open. Roommates look up from their desks. One asks {So? Did you pass?}. Slow half-body cuts between faces. 4Shot 3: close-up on Lin. She lowers her head, then breaks into a laugh and says {Got you all}. The roommates chase her around. Camera pulls back to a wide shot of the room. 5Documentary realism, warm tones, soft light. Faces stay stable. No subtitles, no watermark.

この例はパターンをよく示しています。各ショットは同じ4つの質問に答えます:
| ショット内の行 | 書くべき内容 | 例のフレーズ |
|---|---|---|
| カメラ | 最初は1ショット1ムーブ、標準用語 | "slow push-in", "fixed camera", "cut to close-up" |
| アクション | 体の部分+速度や力 | "slowly raises a hand", "grips the strap hard" |
| 空間 | 被写体が今どこにいるか | "at the dorm door", "crossing the rooftop" |
| 音声 | このショットの対話、効果音、または音楽 | {line}, , (music) |
2つの書き方ルールが重い仕事をします。動きを定量化し(slowly, sharply, slightly)、動かす手足を指定します。そして感情をラベル付けするのではなく外部化します:「head down, shoulders trembling slightly, fingers twisting the hem of her jacket」はアニメーションしますが、「she is sad」はしません。1つのSeedance 2.0時代のルールは緩和されました:以前のバージョンでは各ショットを1つのカメラムーブに制限していましたが、Seedance 2.5では複合ムーブ(フォロー+クレーン+回転を1人のアスリート入場ロングテイクで)を安定して実行できます。シンプルに始め、ショットがそれに値するときに組み合わせてください。
タイミングはSeedance 2.5が前身と異なる点です。秒単位のキュー...はSeedance 2.0では生成を不安定にしていました。その制限はなくなりました:Seedance 2.5のプロンプトは全体にタイムコードが付けられています:武術シーケンスは[0-3s]、[3-5s]、[5-10s]のセグメントで書かれ、月の形成解説はナレーションに合わせて秒単位でスクリプト化されています。ショットの順序は依然としてストーリーを伝えますが、秒範囲によってビートが30秒のどこに位置するかを指定できるようになりました。以下はその武術プロンプトがタイムラインをどのように使うかの例です:

Seedance 2.5編集プロンプト:1つだけ変更し、残りを保持する
編集は、1つの動詞がタスクタイプを決定するため、言葉遣いが最も許容されない部分です。ルールは明示的です:「reference @video1」と書くのは、新しい動画に特性を借用したい場合のみです。クリップ自体を変更したい場合は、平易に名前を付けます(「@video1」、「strictly edit @video1」)。そうしないと、モデルがジョブを参照タスクと誤解し、シーン全体を再生成する可能性があります。
優れた編集プロンプトは3つの動きに圧縮されます:@video1でソースを指し、変更内容を正確に範囲指定し(被写体を交換する場合は参照画像を追加)、「everything else stays unchanged」のようなロック行で閉じて、モデルが言及しなかった部分を再描画しないようにします。ここで2つのパラメータは制御できません:編集されたクリップはソースのアスペクト比とおおよその持続時間を保持します。拡張も比率を継承しますが、追加された長さはプロンプトで設定できます(「extend by 6 seconds」)。
| 操作 | 文のパターン | 残りは安定するか? |
|---|---|---|
| 追加 | 新しい要素、それが現れる時間と場所を説明 | はい、デフォルトでは言及されていない部分は変更されません |
| 置換 | "Strictly edit @video1, change [古い特徴] to [新しい特徴]" | はい、ただし重要な保持要素は明示的に述べること |
| 削除 | 削除する要素を指定し、残すべきものを指定 | 保持要素を強化することで測定可能な効果があります |
| 拡張 | "Extend @video1 backward/forward: [次に起こること]" | スタイル、被写体、ストーリーを一定として指定する必要があります |
| 再スコア | "Keep @video1's picture and camera unchanged, replace the background music with @audio1" | 音声編集はフレームをそのままにします |
| ブリッジ | "@video1, [トランジションの説明], then @video2" | Seedance 2.0は動画入力を3クリップ、合計15秒に制限;Seedance 2.5の上限は10クリップ、30秒に引き上げ |
タイムスタンプターゲティングと参照ガイド編集の両方がサポートされています(「replace the scene from 0:02 to 0:05 in @video1, keep the action and pacing」);さらに、グリーンスクリーン交換、カメラ視点変更も可能です。ショーケースはほとんどの人が必要とする以上の範囲をカバーしています:完成したシーンの再照明(「change @video1's light from harsh noon top-light to sunset side-light」)、女優を20代から60歳まで1つの途切れのないショットで老化させる、クリップをマンガ、アニメ、水墨画スタイルで循環させる、3つのSKU色にわたる飲料ボトルの一括交換、すべて編集として分類され、完全な再生成は含まれません。
Seedance 2.5の動作が安定するまで、Seedance 2.0時代の2つの修復テクニックは知っておく価値があります。拡張されたクリップが継ぎ目でジャンプする場合、最初のセグメントの最後から6フレーム、2番目のセグメントの先頭から1フレームをトリミングしてからつなぎ合わせます。また、繰り返しの拡張パスで画質が低下する場合の回避策の1つは、ソースを最初に白い3Dモデルレンダリングに変換し、そのクリーンなベースから拡張することです。
Seedance 2.5がさまざまな業界で何ができるか
明確なユースケースギャラリーが浮かび上がってきました:5つの業界と4つの主要機能を掛け合わせ、各セルに実践的なプロンプトと完成したクリップが用意されています。要約:
| ドメイン | 代表的なジョブ |
|---|---|
| 映画 | 1つの30秒テイクで完全なストーリービート、スタックされた俳優アセットからのアンサンブルシーン、ワイヤーリグバグ除去、1つのマスターカットを言語間で再ボイス |
| 広告、Eコマース | ワンショットTVCストーリーテリング、ブランドアセットにロックされた製品ルック、価格タグの書き換え、輸出市場向けプレゼンター交換 |
| 教育 | 1つの概念を30秒で説明、原理の可視化、シリーズ全体で一貫したホストキャラクター、多言語配信 |
| 産業 | 組み立てウォークスルー、3Dホワイトモデル製品プレビュー、製品ライン間のネームプレート交換、多言語の安全トレーニング |
| エンタメIP | ゲーム風トレーラー、バーチャルアイドルパフォーマンス、ホリデースキンビデオ、多言語バーチャルアンカー |
最も静かなものの1つ:30秒の対話なしストーリーが1つの段落で書かれ、ショット番号はまったくなく、シーンの説明とアンビエント音だけで完全に伝えられます:
plaintext1A 30-second wordless visual story with the quiet elegance of rural France, on a Provence summer afternoon. A young woman in an off-white linen dress finishes a handwritten letter at an old wooden table inside a stone cottage, steps out, follows a gravel path through a sunflower field, and slips the letter into a vintage yellow mailbox at the village edge. The camera opens on a shallow-focus close-up of the desk, passes through the doorway as light gives way to shadow, then rises and pulls back into a wide shot of the golden valley. Ambient sound only: cicadas, wind, the scratch of pen on paper, the soft click of the mailbox closing.

作品が1つの連続したムードに乗っている場合、番号付きショットの足場は不要になります。どちらのパターンも有効です。
広告ギャラリーは、ワンマスターパイプラインを2段階で示しています。マスターは、秒単位の対話ビートでスクリプト化された12秒のスポークスパーソン広告です。その後、すべてのローカライズ版は単一の編集行です:
plaintext1Swap the presenter for an American woman, re-voice the copy in English. 2Swap the presenter for a Spanish man, re-voice the copy in Spanish. 3Swap the presenter for an Indonesian woman, re-voice the copy in Indonesian.

教育の行は、このガイドで別々に説明した2つのテクニックを融合させています:30秒の博物館ドキュメンタリーで、1人のガイドが4つのギャラリーを歩き、英語、マンダリン、マレー語、日本語を話し、各セグメントが7.5秒のウィンドウにピン留めされています。そして産業用FPVドローンプロンプトは、公式セクションの制約テールを定型文からアップグレードします:動きとシーンの制約で閉じます。「no on-screen text or markers, do not fly backward, weather and lighting stay constant」のような行です。
よくある質問
Seedance 2.5はまだAPIで利用可能ですか?
ローンチ時点では利用できません。7月31日のロールアウトは、まずByteDance自身のアプリ(Jimeng AIやDoubaoプロフェッショナル向けなど)をカバーします。APIアクセスとArkプレイグラウンドは2026年8月7日に完全オープン予定で、2つのアクセス詳細に注意が必要です:無料枠はなく、アクティベーションには口座残高が200 RMB以上またはアクティブなSeedance 2.0リソースパックが必要です。その間、Seedance 2.0ファミリーはAPIを通じて完全にサービス提供されています。
Seedance 2.0のプロンプトはSeedance 2.5でも動作しますか?
構造は移行可能です:被写体定義、@参照、番号付きショット、対話と音声のラッパー、参照/編集/拡張のタスク分割はすべて変更なくSeedance 2.5に引き継がれます。再テストすべきは古い回避策です。Seedance 2.0のいくつかの痛点(短い単一パス、粗い編集制御、不安定なタイミングキュー)は、まさにSeedance 2.5が修正すると主張している点だからです。
Seedance 2.5プロンプトにはいくつの参照ファイルを含められますか?
1ジョブあたり最大50:画像30、動画クリップ10、音声クリップ10。動画参照は合計最大30秒、音声も最大30秒、各クリップは2〜30秒です。フル予算はアンサンブルキャストや参照の多いシーンを想定しています。参照スロットのセクションでは、日常的なジョブの推奨比率上限を説明しています。
Seedance 2.5は英語や中国語以外の言語で対話を生成できますか?
はい。ネイティブサポート言語には、中国語、英語、スペイン語、インドネシア語、マレー語、タイ語、アラビア語、ポルトガル語、ベトナム語、日本語、韓国語などが含まれ、ワンマスターマルチランゲージ配信を提案しています。そのトレーラーデモは、1行の編集プロンプトで同じカットを日本語とフランス語に再ボイスしています。各対話行の前に言語をタグ付けします。公式セクションのアクセントパターンは変更なく適用されます。
Seedance 2.5の動画は最大どのくらいの長さですか?
1回のパスで30秒、マルチラウンド拡張でさらに長いカットも可能です。これを参照クリップの30秒制限と混同しないでください。それは入力の予算であり、出力ではありません。
結論
プロンプト言語は安定した部分です。一度定義され@で参照される被写体、番号順のショット、中括弧内の対話、最後の制約。その文法は2月に15秒のクリップを書き、今は30秒のクリップを書きます。変わったのはその周りの上限です。今すぐSeedance 2.0エンドポイントで文法を練習し、参照セットを小さく名前付きに保ち、Seedance 2.5がAPI経由で開かれたら、プロンプトを移植するのが簡単なステップになるはずです。






