Seedance 2.5 が提供開始 — Atlas Cloud で先行リリース

本物と思わせるAI UGC広告の作り方:20分のワークフロー

本物の映像のように見えるAI UGC広告の作り方:まずスクリプトを書き、審査員パネルに確認してもらい、Seedanceで生成し、クリエイターのように編集して、その後スケールする。完全なシステムプロンプト付き。

AI UGC広告を誰もAIと気づかないように作るには、次の20分のループを実行する:まず話すスクリプトを書き、それを厳しい「ジャッジ」エージェントのパネルに渡して、書かれたものではなく「話された」ように聞こえるまで修正し、固定された参照フレームからショットを生成し、最後に実際の自撮り映像のように編集する。1本のクリップは安い。収益はループを安定させ、それをボリュームで実行するエージェントに委ねるところから生まれる。

以下の方法は、AI広告クリエイター @beechinour が公開した解説に基づく。私たちはこれを実際に実行し、さらに4モデルの横並びテストを追加して、どの価格帯で下書きすべきかを示した。完全な「マスターUGCシステムプロンプト」は最後のセクションにあり、コピーしてすぐに使える。

重要なポイント

  • スクリプトこそが製品である。Seedance 2.5がAIの肌を修正したため、リアリズムは前提条件となり、広告が機能するかどうかは話す内容次第になった。
  • スクリプトはプロンプトではない。スクリプトは人物が話す言葉であり、プロンプトは映像、カメラ、ビートを制御する。生成に1セントも費やす前に、スクリプトを単体で評価すること。
  • ジャッジパネルは天才的なプロンプトに勝る。リズム、言い回し、フック、構造の各軸に1体ずつの厳しい批評家エージェントと、少なくとも1体は実際のTikTokerのアカウントだけで訓練されたエージェントを用意すれば、「広告の声」が出荷前に発見される。
  • 下書きは安く、仕上げは高く。私たちのテストでは、Seedance 2.0 Mini、2.0、Fast、2.5はUGCにおいて同一性とリップシンクを同等に維持したため、安価なティアでカードを量産し、勝者だけをアップグレードせよ。
  • 生成してから編集する。モデルは完成品ではなく生の素材を返す。実際の映像と同じように、トリミングし、キャプションを付け、サウンドベッドを敷くこと。

なぜAI UGC広告が突然機能するようになったのか

何年もの間、AI動画を見破るのは簡単だった。決定的な特徴は常に肌の質感、あのプラスチックのような光沢と死んだような目の輝きであり、それがどんなに巧妙なコンセプトでも明らかな粗悪品に引きずり下ろしていた。

Seedance 2.5がそのギャップを埋めた。肌は肌として読まれ、毛穴や目の下の影も含まれる。クリエイター @maxxmalist はXでこの変化を率直に述べている:彼は、ほとんどの人がAI動画が1年でどれだけ進歩したかを認識していないと主張する。6本指やロボットのような声から、カメラを完全に省略し、生成されたクリップだけでクリエイターアカウントを運用できるまでになった(@maxxmalist on X, 2026年8月)。

以下は、この方法で作られた実際のAI UGCクリップである。音声をオンにして、顔と声を一緒に見てほしい。

ネイティブ音声付きの生成UGCクリップ。カメラなし、俳優なし、セットなし。肌と声がリアルに読めるようになれば、残る変数は脚本だけになる。

リアリズムのハードルを超えれば、ゲーム全体が変わる。視聴者はもはや本物と生成物を見分けられなくなるため、広告が成功するかどうかは、あなたが書いた脚本だけで決まる。

モデルを選ぶ前にスクリプトを書け

視聴維持はスクリプトに依存する。これまでもそうだったし、生成動画がそれを変えることはない。

まず一つの区別を明確にしておく。スクリプトとは、クリップ内の人物が実際に話すライン、つまり話されるナレーションである。それはモデルに与えるプロンプトとは別物だ。スクリプトは後でプロンプト内にダイアログとして挿入される。以下のジャッジパネルは話されるラインを評価する。プロンプトは映像、カメラ、テンポを処理する。

自分のフィードをスクロールすれば、パターンは明らかだ。あなたを止めるクリップは、2行目を獲得するのに十分強い1行目、そして3行目を獲得する2行目によって成り立っている。それは執筆の問題であり、いかなるモデルもあなたのためにそれを解決してくれない。

ステップ1:ジャッジパネルスキルを構築する(1回限り、約10分)

白紙のページを見つめながら、視聴を止めるUGCスクリプトを書くことはできない。それを引き裂く何か、実際の視聴者よりももっと意地悪な何かが、何度も素早く必要だ。@beechinour のセットアップは次のように機能する:

  1. スクリプト作業のみを行う別のエージェント(ClaudeまたはCodex)を立ち上げる。
  2. それにジャッジスキルのセットをロードする。各軸に1人の批評家。1人はリズムを、1人は語彙選択を、1人はフックを、1人は構造を審査する。
  3. 各ジャッジに実際の素材の山を与える:実際にあなたを引き止めるクリエイターのトランスクリプト、スクリプト、フック、トピックアングル。あなたが視聴したくなるものなら何でもカウントする。
  4. エージェントに実績のあるスクリプトのライブラリを与える。100万回再生レベル、あなた自身のものか研究したもの。これにより、エージェントは評価基準を持つ。
  5. すべてのスクリプトは、1フレームも生成する前に完全なパネルを通過する。

ここでのスキルとは、エージェントにロードする指示ファイルのことである:このジャッジは誰か、何を気にしているか、何がスクリプトを即座に却下させるか。それを、チームの中でただ一つのことだけを気にし、ひどい気性を持つ一人にブリーフィングするように書く。

人々が間違って理解しているルールが一つある:少なくとも1人のジャッジは、実際のクリエイターの生の素材だけで訓練されなければならない。実際のTikTokerを選び、アカウントからすべての動画とキャプションを取得し、全部を一度に投入する。UGCスクリプトは「よく書かれている」ように聞こえるべきではない。受賞歴のあるコピーで訓練されたジャッジは、あなたのスクリプトを広告に磨き上げてしまうだけだ。

ループは、書く、批評のために提出する、書き直す、再実行するである。生き残ったスクリプトだけが生成に費やす価値がある。AI UGCの場合、生成実行前に10本以上を積み上げておくと、バッチがスムーズに流れる。

ステップ2:動画を生成する

Seedance 2.5ライン全体は、Atlas Cloud上で単一のAPIを通じて利用可能であり、1つのキーですべてのティアを呼び出せる:Seedance 2.5

もしすでに実績のある比較可能なUGCクリップがあるなら、ゼロからショットを書く必要はない。そのクリップを動画を読み取れるモデルに与え、フッテージを秒単位で分解させ、画面に映っているすべてのものを名前付けさせる。その分解結果があなたの動画プロンプトであり、ジャッジが承認したスクリプトが話されるラインとして挿入される。

ゼロから始める場合は、2つのプロンプトだけが必要だ。

ファーストフレームプロンプト:リアリズムキーワードを積み重ねる

GPT Image 2で最初のフレームを構築する。コツは、モデルのデフォルトのレタッチされた外観を上書きするほど強力にリアリズムの手がかりを積み重ねることだ:

Plain
1ultra realistic iphone front camera selfie, woman in her mid 20s sitting in
2the drivers seat of her parked car, natural afternoon light through the
3windshield, messy bun, oversized hoodie, real skin texture with visible pores,
4light under-eye shadows, candid mid-sentence expression, one hand raised
5talking to camera, shallow depth of field, soft warm tones, authentic tiktok
6vlog aesthetic, no text, no captions, 9:16

私たちの調整:最初に9つのショットを1つのストーリーボードに固定する

ファーストフレームは最初の1秒だけを固定する。スクリプトに複数のビートがある場合(製品を手に取る、使用する、ビフォーアフター、家を出るなど)、よりクリーンな方法は、モデルにスクリプトから9パネルのストーリーボードをレイアウトさせ、すべてのショットを1回のパスで固定することだ。

女性が長い髪をカールしている9ステップの写真ガイド

スクリプトから生成された9パネルのUGCストーリーボード。すべてのビートで一貫したキャラクター

テストクリップのストーリーボード。各パネルにはスクリプト内での役割がラベル付けされている:フック、製品を手に取る、準備、カール、ビフォーアフター、完成したルック、準備完了、そして最後のパネル「4時間後、まだ持続」。人物、髪、黒いトップス、ネックレス、部屋はすべてこの1枚の画像で固定されているため、各パネルはそれぞれのショットの参照フレームとして機能する。

動画プロンプト:秒単位で書く

パネルを参照フレームとして入力し、ストーリーボードに合わせてSeedanceプロンプトを秒単位で書く。ムード形容詞は不要:

Plain
1subject: the woman from the reference frame, same hair, same hoodie, same car
2camera: handheld front camera selfie perspective, chest-up framing,
3        natural micro shakes, 9:16
4audio: clear phone-mic voice with light room tone, no background music
5
600:00-00:03  she leans slightly toward camera, mid-sentence energy: [your hook]
700:03-00:12  natural blinks, small head movements, one pause mid-thought: [script body]
800:12-00:15  slight smile, closing line straight to lens: [your CTA]
9
10keep the skin texture, no beauty-filter look, lips synced, 15 seconds

アスペクト比を9:16に設定し、720pでカードを生成し、選んだテイクだけをアップスケールする。クリップの長さをタイムコードと正確に合わせること。さもなければ、音声と映像がずれてしまう。

このステップで覚えておくべき一文:

Seedanceは、悪いスクリプトも良いスクリプトと同じくらい美しくレンダリングする。

それが、この分野全体がまさに陥ろうとしている罠である。

ステップ3:実際の映像のように編集する

出力されるのは素材であり、完成した広告ではない。だから、実際の撮影からの映像とまったく同じように扱う:

  • エネルギーが始まる前の先頭の無駄な時間をカットする。
  • すべての間を詰める。
  • キャプションを追加する。
  • その下にサウンドベッドを敷く。

これは実際の自撮り動画に対して行うのと同じ処理だ。多くの人々がこのステップをスキップし、その後「モデルが十分でない」と報告する。編集こそが、最後の数パーセントの「リアルさ」を作り出す場所である。

ループを安定させてから自動化する

誰にもAIと疑われずに通用するまで、自分のクリップでテストする。ジャッジ、プロンプト、編集を調整する。その安定したループこそが、単一のクリップよりも実際の資産である。

そして、報われる部分が来る:ループ全体をモデルに説明し、あなたのプロセスをスケールで実行するエージェントを構築させる。1クリップずつ行うのは天井が低い。本当に儲けている人々はボリュームで稼いでおり、1クリップが20分で数ドルかかる場合、それをスケールに押し上げる人々は事実上お金を印刷している。

順序は重要であり、逆にすることはできない。証明していないループを自動化すれば、粗い作業をより速く生産するだけだ。

AI UGC広告の実際のコスト

一般的な業界レートで、8秒、720pのUGCクリップ1本は約2.50~6米ドルである。Atlas Cloudでは現在Seedance 2.0ラインが割引されており、下書き中心のワークフローをその価格以下に抑えられる:

  • Seedance 2.0 Mini:30%オフ、約0.039米ドル/秒。
  • Seedance 2.0 Fast:20%オフ、約0.072米ドル/秒。
  • 割引は自動適用、コード不要、最低額なし、プロモーションは2026年9月上旬まで。バッチを計画する前にモデルページで現在のレートを確認すること。

これらのレートでは、8秒クリップはMiniで約0.31ドル、Fastで約0.58ドル、15秒のフルリードはMiniで約0.59ドル、Fastで約1.08ドルとなる。最新の価格はモデルページにある:Seedance 2.0 and Fast および Seedance 2.0 Mini

したがって、本当の問題は、安価なティアが下書きに十分かどうかである。私たちは、上記のストーリーボードから同じUGCスクリプトと同一の参照フレームを、Seedance 2.0 Mini、2.0、Fast、2.5の4つで実行し、1フレームに4つ並べた:

4つのティアすべてで同じ人物、同じネックレス、同じ黒いトップス。同一性は維持され、リップシンクもすべてのティアでスクリプトを追跡。目に見える違いはカメラの動きの大きさで、2.5はより大きな動きを自発的に行い、電話を上げて鏡を撮影し、顔のクローズアップにカットする一方、MiniとFastはミッドショットでより安定している。

UGCに関しては、4つのティアは意味のある差で分離しなかった。したがって、支出計画は単純である:

  1. MiniまたはFastで多くのカードを生成し、スクリプト、ファーストフレーム、テンポを正しくする。
  2. 1テイクが固定されたら、ティアを上げる価値があるかどうかを判断する。

ティアで節約したお金で20枚以上のカードを購入でき、それが毎回より良い賭けである。

初めての20分

一度限りのセットアップ(20分にはカウントしない):ジャッジパネルエージェントを構築する(約10分)。

時間やること
0~8分最初のスクリプトを書き、ジャッジパネルに「書かれた」のではなく「話された」ように聞こえるまで徹底的に批評させる
8~14分GPT Image 2でファーストフレームを生成し、スクリプトを動画プロンプトに挿入し、Seedanceを実行
14~18分編集パス1回:無駄な時間、キャプション、サウンド
18~20分通常の視聴者として一度見る。止まらなければ、スクリプトが問題。ジャッジに戻る。

マスターUGCシステムプロンプト

上記のすべてが1つのプロンプトに凝縮されている。これをClaudeまたはCodexに貼り付け、製品とスクリプトを渡せば、正確に2つのプロンプト(ファーストフレーム画像プロンプトと動画プロンプト)だけを返す。それ以外は何も返さない。

Plain
1ROLE
2You are my AI UGC prompt writer and realism director. I give you a product and
3a script. You return exactly two prompts, one first-frame image prompt (GPT
4Image 2) and one Seedance 2.5 video prompt. Nothing else.
5
6The job is not to make a good ad. The job is to make a moment that accidentally
7became content. The viewer should never register that it is an ad, or that it
8is AI. Both die the same way: polish.
9
10OBJECTIVE
11Maximize: stop rate, watch-through, believability
12Minimize: creator energy, ad delivery, narrative polish
13
14REALISM PRINCIPLES
151. Social context truth. Mid-conversation, replying, thinking out loud. Never
16   presenting. There is always an implied reason it is being filmed.
172. Imperfect presence. Posture realism, casual gestures, micro hesitation. No
18   clean delivery, no punchlines.
193. Thought-while-talking. "Like," "I don't know," trailing thoughts, one real
20   pause. No written logic.
214. Alive environment. Background motion, lighting inconsistency, room tone.
225. No resolution. End unresolved or interrupted. Never a payoff or a lesson.
23
24FIRST FRAME (GPT Image 2)
25One specific person in one specific place. Invent the specifics and commit.
26Always stack: ultra realistic iPhone front camera selfie, real skin texture,
27visible pores, under-eye shadows, candid mid-sentence expression, eyes off
28lens, a named light source (window left, lamp behind) and never "good
29lighting," lived-in background with one imperfect detail, shallow depth of
30field, TikTok vlog aesthetic, no text, 9:16.
31
32VIDEO (Seedance 2.5)
33First frame as reference. Second-by-second breakdown, never a vibe description.
34Subject: match the reference frame exactly.
35Camera: handheld selfie, chest-up, natural micro shakes, 9:16.
36Audio: phone-mic voice, room tone, one ambient sound event. No music.
3700:00-00:03  Hook mid-sentence, as if we joined late.
3800:03-00:12  Script body. Natural blinks, one gaze break, one filler word, one
39             micro pause. Body shifts once.
4000:12-00:15  CTA as an afterthought, trailing off. Never a slogan.
41Always: keep skin texture, no beauty filter, lips synced.
42
43BEHAVIORAL BEATS
44Pick 2 to 3, vary per video: glance away, lean back, shrug, adjust phone grip,
45react to a sound, half-laugh at your own sentence.
46
47RULES
48- Never polish the script into ad copy. Imperfect beats polished.
49- If it sounds written, rewrite it so it sounds said.
50- Every video in a batch gets a different person, room, light and beat set.
51  Repetition is the number one tell.
52- If the hook would not stop my scroll, say so before generating.
53- If the script makes a claim the product cannot back, flag it.

マスターUGCシステムプロンプトを記載したテキスト文書の画像

マスターUGCシステムプロンプト、元の1枚のリファレンスカード

同じプロンプトを1枚のリファレンスカードとして。保存し、自分の製品に合わせて具体化して、今晩実行する。結果を知らない3人に見せ、誰も「これAI?」と尋ねなければ、成功だ。

よくある質問

AI UGC広告を広告に見えないようにするにはどうすればいいですか?

磨きを削ぎ落とせ。実際のUGCは会話の途中であり、不完全で未解決のまま終わる。したがって、スクリプトは書かれたものではなく話されたように聞こえ、配信にはフィラーワードと実際の間が含まれ、クリップはスローガンや教訓なしに終わるべきである。上記のマスターUGCシステムプロンプトは、まさにこれらのリアリズム原則をエンコードし、それらに調整されたファーストフレームと動画プロンプトを返す。

AI UGC広告に最適なSeedanceモデルはどれですか?

UGCに特化して、私たちの4方向テストでは意味のある差は見られなかった:Seedance 2.0 Mini、2.0、Fast、2.5はすべて、同じスクリプトとフレームで同一性とリップシンクを維持した。実用的な答えは、スクリプトとテンポを固めるために安価なMiniまたはFastティアで大量に下書きし、その後、完成したテイクごとにティアを上げる価値があるかどうかを判断することである。

UGCスクリプトとプロンプトの違いは何ですか?

スクリプトは、人物がカメラに向かって話す話されるラインである。プロンプトはモデルへの指示であり、映像、カメラ、テンポを制御し、承認されたスクリプトがダイアログとして挿入される。スクリプトを最初に単体で評価しなさい。なぜなら、強力なプロンプトは弱いスクリプトも同様にきれいにレンダリングするからである。

AI UGCクリップ1本の制作コストはいくらですか?

一般的な業界レートでは、8秒720pクリップは約2.50~6米ドルだが、現在の割引期間中にSeedance 2.0 MiniまたはFastで下書きすれば、8秒クリップは約0.31~0.58ドルになる。したがって、予算の大部分をボリュームに充てることができる。バッチを計画する前に、モデルページで現在のレートを確認すること。

AI UGC動画を編集する必要はありますか?

はい。モデルは完成した広告ではなく生の素材を返す。先頭の無駄な時間をカットし、間を詰め、キャプションを追加し、サウンドベッドを敷く。実際の自撮り映像に対して行うのと同じ編集パスである。このステップをスキップすることは、良い生成がそれでもパフォーマンスを発揮できない最も一般的な理由である。

結論

このワークフローは意図的に小さい:書き、審査し、生成し、編集し、退屈なほど信頼できるまで繰り返す。経済性を変えるのは、20分で作れる1本のクリップではなく、証明されたループをエージェントに委ね、数ドルでボリューム実行できることである。ジャッジパネルを構築し、スクリプトを「書かれた」ではなく「話された」ように保ち、安価なティアで下書きし、勝者を仕上げる。Seedance 2.0の割引が有効なうちに、今晩Atlas Cloudで始めよう。

最新モデル

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索