Seedance 2.5 現已上線 — 首發於 Atlas Cloud

如何製作以假亂真的AI UGC廣告:20分鐘工作流程

如何製作看起來像真實畫面的AI UGC廣告:先撰寫腳本,再通過評審團審核,使用Seedance生成,像創作者一樣編輯,然後擴展規模。包含完整系統提示。

為了製作出沒人察覺是 AI 的 UGC 廣告,你只需要執行一個 20 分鐘的循環:先寫出口語腳本,交給一組嚴厲的「評審」代理反覆批判,直到它聽起來像是「說出來」而非「寫出來」;接著從鎖定的參考畫面生成影片,最後像編輯真實自拍素材一樣去後製。單一影片成本很低,真正的獲利關鍵在於讓這個循環穩定下來,然後交給一個能大量執行的代理。

以下方法來自 AI 廣告創作者 @beechinour 的公開拆解。我們親自跑完整個流程,並加入四款模型的對比測試,讓你知道該用哪個價位進行草稿。完整的「大師級 UGC 系統提示詞」放在最後一段,可直接複製使用。

重點摘要

  • 腳本本身就是產品。 Seedance 2.5 已解決 AI 皮膚問題,因此真實感只是基本門檻,廣告是否有效完全取決於人物說了什麼。
  • 腳本不是提示詞。 腳本是人物說出的話語;提示詞控制畫面、鏡頭與節奏。在花錢生成之前,先獨立評判腳本本身。
  • 評審團勝過天才提示詞。 針對每個軸線(節奏、用詞、鉤子、結構)設置一位嚴厲的批評者,並至少有一位只訓練於真實 TikToker 的帳號,這樣才能在腳本上架前就抓出「廣告腔」。
  • 草稿用便宜的,最終版用貴的。 在我們的測試中,Seedance 2.0 Mini、2.0、Fast 和 2.5 在 UGC 的身份保持與唇形同步上表現同樣出色,因此先用便宜方案大量產出,只升級勝出的版本。
  • 先生成再編輯。 模型產出的是原始素材,不是完成的廣告。要像處理真實影片一樣,進行修剪、加上字幕、鋪上背景音。

為什麼 AI UGC 廣告突然可行了

多年來,認出 AI 影片毫不費力。關鍵總是皮膚——那種塑膠光澤與死氣沉沉的雙眼,會讓即使巧妙的點子也淪為明顯的劣質品。

Seedance 2.5 填補了這個差距。皮膚看起來就是皮膚,包含毛孔與眼下陰影。創作者 @maxxmalist 在 X 上直言:他認為多數人還沒有意識到 AI 影片在一年內進步了多少——從六根手指與機器人聲音,進化到你可以完全不用相機,只靠生成的影片片段就能經營一個完整的創作者帳號(@maxxmalist 在 X 上,2026 年 8 月)。

以下是一個用這種方法製作出的真實 AI UGC 影片。請開啟聲音,同時觀察臉部與聲音。

一個包含原生音訊的生成 UGC 影片。沒有相機、沒有演員、沒有場景。一旦皮膚與聲音聽起來真實,剩下的唯一變數就是文案。

一旦真實感門檻被跨越,整個遊戲就轉變了。觀眾再也無法分辨何為真實、何為生成,因此廣告是否成功,完全取決於你寫了什麼。

在選擇模型之前先寫腳本

留存率取決於腳本。向來如此,生成式影片並不會改變這一點。

首先釐清一個區別。腳本是影片中人物實際說出的台詞,也就是口白。 這與你餵給模型的提示詞是截然不同的東西。腳本會以對話形式放入提示詞的末尾。下面的評審團會評分的是口白部分。提示詞則負責處理畫面、鏡頭與節奏。

滑動你自己的動態牆,模式很明顯。能讓你停下來的影片,都是靠第一句夠強,足以讓你願意聽第二句;第二句夠強,足以讓你願意聽第三句。這是個文案問題,沒有任何模型能幫你解決。

步驟 1:建立評審團技能(一次性,約 10 分鐘)

你無法靠盯著空白頁面寫出能讓人停下的 UGC 腳本。你需要一個能快速、反覆將其撕碎的東西,而且要比你的真實觀眾更嚴厲。@beechinour 的設定方式如下:

  1. 建立一個專門處理腳本的獨立代理(Claude 或 Codex)。
  2. 為它載入一組評審技能,每個軸線一位批評者:一位評斷節奏、一位評斷用詞、一位評斷鉤子、一位評斷結構。
  3. 提供每位評審大量真實素材:來自那些真正能讓你停下來的創作者的逐字稿、腳本、鉤子與主題角度。任何能讓你觀看的都算數。
  4. 給代理一個經過驗證的腳本庫,百萬觀看級別,無論是你自己的還是你研究過的,讓它有一個衡量標準。
  5. 每個腳本在生成任何一個畫面之前,都必須通過整個評審團。

這裡的「技能」只是一個你載入代理的指令檔案:說明這位評審是誰、它關心什麼、以及什麼會讓它直接淘汰一個腳本。把它寫成像是你在向團隊中唯一只關心一件事、而且脾氣很差的那個人做簡報。

有一條規則人們常搞錯:至少有一位評審必須只訓練於真實創作者的原始素材。 選一個實際的 TikToker,從該帳號拉出所有影片與字幕,一次性全部餵入。UGC 腳本不應該聽起來「寫得很好」。一個訓練於得獎文案的評審,只會把你的腳本打磨成廣告。

循環就是:寫、提交評論、重寫、再跑一次。只有通過的腳本才值得花錢生成。對於 AI UGC 來說,在進行一次生成批次前,最好累積十個以上腳本,這樣批次才能順利流動。

步驟 2:生成影片

整個 Seedance 2.5 系列已透過單一 API 在 Atlas Cloud 上線,因此你可以用一個金鑰呼叫所有層級:Seedance 2.5

如果你已經有一個表現不錯的可比 UGC 影片,不要從頭撰寫畫面。將該影片餵給一個能讀取影片的模型,讓它逐秒拆解,說出畫面上的所有內容。這個拆解結果就是你的影片提示詞,而評審團批准的腳本則作為口白放入。

從零開始,你只需要兩個提示詞。

第一幀提示詞:堆疊真實感關鍵字

GPT Image 2 中建立開場畫面。訣竅是強烈疊加真實感線索,以覆蓋模型預設的修圖外觀:

Plain
1ultra realistic iphone front camera selfie, woman in her mid 20s sitting in
2the drivers seat of her parked car, natural afternoon light through the
3windshield, messy bun, oversized hoodie, real skin texture with visible pores,
4light under-eye shadows, candid mid-sentence expression, one hand raised
5talking to camera, shallow depth of field, soft warm tones, authentic tiktok
6vlog aesthetic, no text, no captions, 9:16

我們的調整:先鎖定一個九格分鏡腳本

第一幀只鎖定第一秒。當你的腳本有數個節拍時——拿起產品、使用它、使用前後、出門前——更乾淨的做法是讓模型根據腳本先佈局一個九格分鏡,這樣九個畫面就能一次固定。

Nine step photo guide of a woman curling her long hair

根據腳本生成的九格 UGC 分鏡,每個節拍都維持同一個角色

我們測試影片的分鏡。每個格子標示了它在腳本中的功能:鉤子、拿起產品、準備、上捲、使用前後、完成造型、準備出門,以及最後一格「4 小時後,依然維持」。這個人、頭髮、黑色上衣、項鍊和房間都在這張圖片中鎖定,因此每個格子都可以作為其對應畫面的參考畫面。

影片提示詞:逐秒撰寫

將一個格子作為參考畫面餵入,並根據分鏡逐秒撰寫 Seedance 提示詞。不要使用情緒形容詞:

Plain
1subject: the woman from the reference frame, same hair, same hoodie, same car
2camera: handheld front camera selfie perspective, chest-up framing,
3        natural micro shakes, 9:16
4audio: clear phone-mic voice with light room tone, no background music
5
600:00-00:03  she leans slightly toward camera, mid-sentence energy: [your hook]
700:03-00:12  natural blinks, small head movements, one pause mid-thought: [script body]
800:12-00:15  slight smile, closing line straight to lens: [your CTA]
9
10keep the skin texture, no beauty-filter look, lips synced, 15 seconds

設定比例為 9:16,以 720p 輸出,只對你選中的片段進行升頻。讓影片長度與你的時間碼完全一致,否則聲音與畫面會脫節。

在這個步驟中,需要記住的一句話是:

Seedance 會把爛腳本渲染得跟好腳本一樣漂亮。

這就是整個領域即將踏入的陷阱。

步驟 3:像編輯真實影片一樣編輯它

產出的東西是素材,不是完成的廣告,所以要像對待真實拍攝的影片一樣處理:

  • 剪掉開頭能量還沒起來前的空白時間。
  • 收緊每個停頓。
  • 加上字幕。
  • 鋪上背景音。

這跟處理真實自拍影片的流程一模一樣。很多人跳過這個步驟,然後回報說模型不夠好。編輯正是完成最後那百分之幾「真實感」的關鍵。

讓循環穩定,然後自動化

先用你自己的影片測試,直到它們能通過考驗,沒有人懷疑是 AI。你會調整評審、調整提示詞、調整編輯。這個穩定的循環才是真正的資產,比任何單一影片都更有價值。

然後來到真正能獲利的部分:將整個循環描述給一個模型,讓它為你建立一個能大規模執行你流程的代理。一次只做一個影片,天花板很低。真正賺錢的人是在靠數量取勝,而當一個影片只需 20 分鐘、成本幾美元時,能將其推向規模化的人,基本上就是在印鈔。

順序很重要,不能顛倒。自動化一個未經證實的循環,只會更快產出粗糙的作品。

AI UGC 廣告的實際成本

以常見的行業費率,一個 8 秒、720p 的 UGC 影片成本大約在 2.50 到 6 美元之間。在 Atlas Cloud 上,Seedance 2.0 系列目前有折扣,這使得大量草稿的工作流程成本遠低於此:

  • Seedance 2.0 Mini:七折,約每秒 0.039 美元。
  • Seedance 2.0 Fast:八折,約每秒 0.072 美元。
  • 折扣自動套用,無需代碼,無最低消費,促銷活動持續到 2026 年 9 月初。在規劃批次前,請先查看模型頁面上的當前價格。

以這些費率計算,一個 8 秒的影片在 Mini 上約為 0.31 美元,在 Fast 上約為 0.58 美元;一個完整的 15 秒影片在 Mini 上約為 0.59 美元,在 Fast 上約為 1.08 美元。即時價格可在模型頁面上查看:Seedance 2.0 和 Fast 以及 Seedance 2.0 Mini

因此,真正的問題是:便宜的方案是否足夠用來打草稿?我們將相同的 UGC 腳本和上方分鏡中相同的參考畫面,分別在 Seedance 2.0 Mini、2.0、Fast 和 2.5 上執行,四款結果並排顯示:

同一個人、同一條項鍊、同一件黑色上衣,四個層級都維持住身份,嘴唇也追蹤著腳本。可見的差異在於鏡頭的動態:2.5 會自行產生更大的運鏡,舉起手機拍攝鏡子,並切換到臉部特寫,而 Mini 和 Fast 則更穩定地停留在中景。

對於 UGC 而言,四個層級在任何重要的方面都沒有顯著差距。因此,花費策略很簡單:

  1. 在 Mini 或 Fast 上大量產出,以確定腳本、第一幀和節奏。
  2. 一旦鎖定一個片段,再決定是否值得升級到更高層級。

你在層級上省下的錢,可以多買二十個片段,這永遠是更划算的賭注。

你的第一個 20 分鐘

一次性設定,不計入這 20 分鐘:建立評審團代理,約 10 分鐘。

時間你的行動
0 到 8 分鐘撰寫第一個腳本,讓評審團反覆抨擊,直到它聽起來像是「說出來」而非「寫出來」
8 到 14 分鐘在 GPT Image 2 中生成第一幀,將腳本放入影片提示詞,執行 Seedance
14 到 18 分鐘一次編輯:去除空白時間、加字幕、加音效
18 到 20 分鐘像一般觀眾一樣觀看一次。如果你不會停下來,那問題就在腳本,回到評審那裡

大師級 UGC 系統提示詞

以上所有內容可濃縮成一個提示詞。將其貼入 Claude 或 Codex,提供你的產品和腳本,它會回傳兩個提示詞:一個第一幀圖片提示詞(GPT Image 2)和一個影片提示詞(Seedance 2.5),沒有其他東西。

Plain
1ROLE
2You are my AI UGC prompt writer and realism director. I give you a product and
3a script. You return exactly two prompts, one first-frame image prompt (GPT
4Image 2) and one Seedance 2.5 video prompt. Nothing else.
5
6The job is not to make a good ad. The job is to make a moment that accidentally
7became content. The viewer should never register that it is an ad, or that it
8is AI. Both die the same way: polish.
9
10OBJECTIVE
11Maximize: stop rate, watch-through, believability
12Minimize: creator energy, ad delivery, narrative polish
13
14REALISM PRINCIPLES
151. Social context truth. Mid-conversation, replying, thinking out loud. Never
16   presenting. There is always an implied reason it is being filmed.
172. Imperfect presence. Posture realism, casual gestures, micro hesitation. No
18   clean delivery, no punchlines.
193. Thought-while-talking. "Like," "I don't know," trailing thoughts, one real
20   pause. No written logic.
214. Alive environment. Background motion, lighting inconsistency, room tone.
225. No resolution. End unresolved or interrupted. Never a payoff or a lesson.
23
24FIRST FRAME (GPT Image 2)
25One specific person in one specific place. Invent the specifics and commit.
26Always stack: ultra realistic iPhone front camera selfie, real skin texture,
27visible pores, under-eye shadows, candid mid-sentence expression, eyes off
28lens, a named light source (window left, lamp behind) and never "good
29lighting," lived-in background with one imperfect detail, shallow depth of
30field, TikTok vlog aesthetic, no text, 9:16.
31
32VIDEO (Seedance 2.5)
33First frame as reference. Second-by-second breakdown, never a vibe description.
34Subject: match the reference frame exactly.
35Camera: handheld selfie, chest-up, natural micro shakes, 9:16.
36Audio: phone-mic voice, room tone, one ambient sound event. No music.
3700:00-00:03  Hook mid-sentence, as if we joined late.
3800:03-00:12  Script body. Natural blinks, one gaze break, one filler word, one
39             micro pause. Body shifts once.
4000:12-00:15  CTA as an afterthought, trailing off. Never a slogan.
41Always: keep skin texture, no beauty filter, lips synced.
42
43BEHAVIORAL BEATS
44Pick 2 to 3, vary per video: glance away, lean back, shrug, adjust phone grip,
45react to a sound, half-laugh at your own sentence.
46
47RULES
48- Never polish the script into ad copy. Imperfect beats polished.
49- If it sounds written, rewrite it so it sounds said.
50- Every video in a batch gets a different person, room, light and beat set.
51  Repetition is the number one tell.
52- If the hook would not stop my scroll, say so before generating.
53- If the script makes a claim the product cannot back, flag it.

Text document detailing a master UGC system prompt for AI video generation

大師級 UGC 系統提示詞,原始單卡參考

與上述相同的提示詞,以單張參考卡呈現。儲存它,根據你的產品調整細節,今晚就執行一次。將結果展示給三位不知情的人,如果沒有人問「這是 AI 嗎?」,你就通過了。

常見問題

如何讓 AI UGC 廣告看起來不像廣告?

去除修飾。真實的 UGC 是對話中的、不完美的、未解決的,因此腳本應該聽起來像是「說出來」而非「寫出來」,表達中應包含一個填充詞和一個真實的停頓,影片結尾不應有口號或教訓。上述的大師級 UGC 系統提示詞正編碼了這些真實感原則,並會回傳針對這些原則調整過的第一幀和影片提示詞。

哪個 Seedance 模型最適合 AI UGC 廣告?

具體針對 UGC,我們的四向測試發現沒有顯著差距:Seedance 2.0 Mini、2.0、Fast 和 2.5 在相同的腳本和畫面上,身份保持與唇形同步都表現良好。實際的答案是:先在較便宜的 Mini 或 Fast 層級上大量產出草稿,以確定腳本和節奏,然後再針對每個片段決定是否值得升級。

UGC 腳本和提示詞有什麼差別?

腳本是人物在鏡頭前說出的台詞。 提示詞是給模型的指令,用於控制畫面、鏡頭和節奏,並將批准後的腳本作為對話放入。先獨立評分腳本,因為一個強大的提示詞會同樣乾淨地渲染一個弱腳本。

製作一個 AI UGC 影片要花多少錢?

一個 8 秒、720p 的影片,常見行業費率約為 2.50 到 6 美元,但在目前的折扣期間,使用 Seedance 2.0 Mini 或 Fast 進行草稿,一個 8 秒影片的成本約為 0.31 到 0.58 美元,因此大部分預算可以用於數量。在規劃批次前,請先確認模型頁面上的即時價格。

我仍然需要編輯 AI UGC 影片嗎?

是的。模型產出的是原始素材,不是完成的廣告。你需要修剪開頭的空白時間、收緊停頓、加上字幕並鋪上背景音——這與處理真實自拍影片的編輯流程完全相同。跳過這個步驟是大部分生成結果雖然不差但仍表現不佳的最常見原因。

結論

這個工作流程刻意設計得很精簡:寫、評、生、編,然後重複直到變得無聊地可靠。真正改變你經濟效益的,不是你能在 20 分鐘內做出的一支影片,而是你已經證明可行的循環可以被交給一個代理,以每支幾美元的成本大量執行。建立好評審團,讓腳本聽起來像是「說出來」而非「寫出來」,用便宜的層級打草稿,最後完成勝出的版本。趁 Seedance 2.0 折扣還在,今晚就透過 Atlas Cloud 開始執行一次。

最新模型

一個 API,暢享全模態 AI。

探索全部模型