Seedance 2.5 于 7 月 31 日发布,支持 30 秒输出和 50 个参考槽位。以下是从 Seedance 2.0 延续下来的提示语法、变化内容,以及今天即可练习的路径。
Seedance 2.5 可以将一个提示转化为 30 秒的完整视频。但这个提示需要承载大量信息:它必须指明主体、控制镜头,有时还要同时绑定多达 50 个参考文件。
大多数 Seedance 2.5 提示失败的原因相同:它们能很好地描述前 3 秒,但之后便失控。本指南将完整的 Seedance 2.5 提示系统拆解为可复用的模板。你将学到核心公式、参考绑定规则,以及对话、音乐和音效的特殊语法。你还将学习如何编写用于剪辑、扩展和完整 30 秒故事的提示。每个模板都附有原创示例,而非官方手册的复制品。
关键要点
- Seedance 2.5 提示遵循六部分公式:主体、动作、场景、风格、镜头和声音。只有主体和动作是必需的。
- 一个提示最多可携带 50 个参考文件:30 张图片、10 个视频片段和 10 个音频片段。
- 四个括号控制声音和文本:() 表示音乐,<> 表示音效,{} 表示对话,【】 表示字幕。
- 剪辑、首帧/末帧和扩展任务各自锁定不同的设置,因此编写前请检查适用规则。
- Atlas Cloud 正在为 Seedance 2.5 提供 Day-0 API 访问,而 Seedance 2.0 今天已上线,可用于测试相同的提示模式。
什么是 Seedance 2.5 提示公式?
Seedance 2.5 提示由六部分组成。只有主体和动作是必需的,其他部分均可省略,你可以根据需要删除任何部分。
完整公式如下:
主体 + 动作或事件 + 场景与环境(可选) + 视觉风格(可选) + 镜头运动或切换(可选) + 音频(可选)
以下是每个部分实际控制的内容:
- 主体 + 动作:谁在做什么。这是每个提示都必需的部分。
- 场景与环境:地点、时间、天气以及物体在空间中的位置。
- 视觉风格:灯光、色彩、质感和整体氛围。
- 镜头运动:景别、角度、运动以及切换发生的位置。
- 音频:对话、人声、环境音、音效和音乐。
大多数初学者能写出不错的主体和动作,但就此止步。对于 3 秒的测试片段来说这没问题。但一旦你瞄准完整的 30 秒 Seedance 2.5 提示,场景、风格和镜头层才是防止画面中途漂移的关键。
一个简单的入门方法是用这个基础模板:
plaintext1<主体> 在 <场景与环境> 中执行 <主要动作或事件>。 2视觉呈现 <视觉风格>。 3使用 <景别、镜头角度、镜头运动或切换>。 4音频包括 <对话、环境音、音效或音乐>。 5
以下是该模板填充后的原创示例:
plaintext1一群购物者在黄金时段穿过一条狭窄的鹅卵石市场街,经过水果摊和挂满丝绸围巾的货架。 2低角度太阳背光照射着条纹遮阳伞,前景中一盘新鲜糕点上的蒸汽袅袅升起。 3从糕点的特写镜头开始,然后拉远到市场街道和人群的全景。 4保持市场低沉的嘈杂声、硬币的叮当声和远处街头艺人的音乐声。 5
注意缺少了什么。没有提及时长、分辨率或帧率。这些设置存在于生成页面或 API 调用中,而非提示本身。保持提示专注于镜头应看到和听到的内容。
如何在 Seedance 2.5 提示中选择和绑定参考材料?
Seedance 2.5 在一个提示中最多可接受 50 个参考文件。即 30 张图片、10 个视频片段和 10 个音频片段,每种类型都有其舒适范围。
td {white-space:nowrap;border:0.5pt solid #dee0e3;font-size:10pt;font-style:normal;font-weight:normal;vertical-align:middle;word-break:normal;word-wrap:normal;}
| 材料 | 硬限制 | 舒适范围 |
| 图片 | 最多 30 张,每张低于 4K | 1 到 8 个不同的主体 |
| 视频 | 最多 10 个片段,总计 30 秒 | 1 到 5 个主体,每个片段 5 到 10 秒 |
| 音频 | 最多 10 个片段,总计 30 秒 | 仅场景实际需要的内容 |
| 视频剪辑源 | 1 个源视频加参考图片 | 源视频少于 20 秒,1 到 5 张图片 |
这些范围并非硬性界限。你可以超出它们,例如在一批图片中使用 9 到 12 个主体,模型仍会尝试。但稳定性通常会随着数量增加而下降。如果一个主体需要多个角度,请将每个角度放在单独的图片中,而不是将它们拼接成一个拼贴图。单独的图片比网格更可靠地对齐。
文件上传后,要明确说明每个文件的贡献。不要指望模型猜测哪张脸对应哪个名字。如果参考图片的背景或额外人物可能渗入输出,请添加排除说明。
plaintext1@Image 1 定义 <主体> 的 <外观、服装、结构或材质>。 2@Video 1 定义 <运动、镜头运动或节奏>。 3@Audio 1 定义 <角色或声音类型> 的 <语音、对话、环境音或音乐>。 4 5<主体> 在 <场景> 中完成 <主要动作或事件>。 6视觉呈现 <视觉风格>,使用 <镜头处理>。 7
以下是一个基于该模式的新示例:
plaintext1@Image 1 定义奶油色法式联排别墅的立面、阳台和屋顶线。 2@Image 2 定义黄色拱廊建筑的拱门和比例。 3@Image 3 定义青色街角商铺的店面、招牌和自动售货机。 4@Video 1 定义缓慢的转台旋转和均匀的摄影棚灯光。不要使用其背景。 5 6将每栋建筑渲染为无缝白色背景上的干净 3D 微型模型,依次呈现。 7围绕每个模型缓慢旋转,采用柔和均匀的光线和清晰的材质细节。 8保持安静的环境嗡鸣声,无音乐。 9
如果多张图片显示同一物体的不同角度,请直接说明:
plaintext1@Image 1 定义同一双跑鞋的正视图。 2@Image 2 定义同一双跑鞋的侧视图。 3@Image 3 定义同一双跑鞋的鞋底图案。 4这三张图片定义同一双跑鞋。输出中只能显示一只鞋。 5
还有一点值得了解:如果参考视频已经完美呈现了你想要的运动和镜头路径,则无需用文字重新描述每个动作。只需说明要保留哪些部分。重新描述动作实际上可能与视频已显示的内容冲突。一个粗略的运动参考主要传递运动和空间布局,因此你的提示仍需要在此基础上指定真实的主体、场景和视觉风格。
什么语法区分对话、音乐、音效和字幕?
对于大多数 Seedance 2.5 提示,普通语言即可。但当需要对声音和屏幕文本进行更精确控制时,四种括号类型可以胜任。
td {white-space:nowrap;border:0.5pt solid #dee0e3;font-size:10pt;font-style:normal;font-weight:normal;vertical-align:middle;word-break:normal;word-wrap:normal;}
| 元素 | 括号 | 示例 |
| 音乐 | () | (一段缓慢的原声吉他旋律响起) |
| 音效 | <> | <自行车铃声响了两声> |
| 对话 | {} | {订单来了,六号桌。} |
| 字幕 | 【】 | 【第一天:面试】 |
为什么一定要用括号?因为普通文本可能会模糊对话和声音提示之间的界限,模型需要猜测。括号消除了猜测。
如果对话不是中文,还需要额外一层说明。在对话前指明语言,如果需要,还可以添加地区口音。使用此顺序:
plaintext1对话语言 + 地区变体或口音 + 表达方式 + 说话者 + {对话} 2
两个快速示例:
plaintext1对话语言:英式英语。两个朋友靠在阳光明媚的天际线上方的石栏杆上。女性用温暖的伦敦口音说:{Looks like the clouds are finally breaking.} 男性仍然望着屋顶回答:{About time. Fancy a walk before the light goes?} 保持轻柔的风声和远处的教堂钟声。(一段缓慢的钢琴旋律在下方演奏) 2
plaintext1对话语言:地道的德克萨斯英语。牧场主用缓慢的德克萨斯口音说:{We best get moving before the storm hits.} 2
跳过这一步,模型可能会默认使用错误的口音,甚至更糟,完全错误的语言。
如何为多个角色和道具编写 Seedance 2.5 提示?
面对 50 个参考槽位,很容易把所有内容塞进一个长句。但真正的目标是将每个主体映射到自己的文件,然后仅为特定场景选择所需内容。
按顺序执行以下步骤:定义每个材料的作用、映射主体、按类型分组、为重复出现的角色构建主体档案,然后按场景选择参考。
步骤 1:单独命名并映射每个主体。
plaintext1<角色A> 对应 @Image 1。仅使用其外观、发型和服装。 2<角色B> 对应 @Image 2。仅使用其外观、发型和服装。 3<道具A> 对应 @Image 3。仅使用其结构、材质和颜色。 4<场景A> 参考 @Image 4。仅使用其空间布局、建筑和灯光。不要使用图片中的人物。 5
避免使用模糊的捷径,例如“图片 1 到 4 定义了四个角色”。这句话从未说明哪张图片对应哪个角色,模型只能猜测。
步骤 2:按类型分组材料。
以下是一个以单一模特时尚造型手册为基础的更完整示例:
plaintext1[角色] 2<模特> 对应 @Image 1。仅使用其面部、发型和体型。 3 4[道具和服装] 5<街头服饰> 对应 @Image 2,仅在咖啡馆场景中穿着。 6<耳机> 对应 @Image 3,仅属于街头风格造型。 7<晚礼服> 对应 @Image 4,仅在红毯上穿着。 8 9[场景] 10<咖啡馆露台> 参考 @Image 5。仅使用其空间、材料和灯光。不要使用图片中的人物。 11<石拱廊> 参考 @Image 6。仅使用其空间、材料和灯光。 12<红毯> 参考 @Image 7。仅使用其空间、材料和灯光。 13 14[运动和音频] 15@Video 1 定义 T 台式的行走和节奏。不要使用视频中的人物或场景。 16@Audio 1 定义背景音乐曲目。 17
步骤 3:为跨场景重复出现的任何主体构建档案。
plaintext1[主体档案:模特] 2外观:@Image 1。 3按场景的服装:咖啡馆场景穿 <街头服饰>,红毯场景穿 <晚礼服>。 4地点:<咖啡馆露台>、<石拱廊> 和 <红毯>。 5运动参考:来自 @Video 1 的行走。 6不要使用:任何第二个人物。每次换装保持同一张脸。 7
步骤 4:按场景选择参考,而非一次性全部选择。
plaintext1场景 1 | 咖啡馆露台 2使用:<模特>、<街头服饰>、<耳机>、<咖啡馆露台>。 3事件:<模特> 走过鲜花环绕的咖啡馆,调整着耳机。 4结束状态:<模特> 从画面右侧离开,没有其他人进入。 5 6场景 2 | 红毯 7使用:<模特>、<晚礼服>、<红毯>。 8事件:<模特> 在柱子之间走过红毯,并停顿摆姿势。 9结束状态:<模特> 站在地毯中央,礼服垂落,独自在画面中。 10
整个系统的要点是为当前场景选择合适的文件,而不是强制所有文件同时出现在画面中。要深入了解参考系统如何在完整的 30 秒剪辑中锁定身份,请参阅 Seedance 2.5 角色一致性指南,该指南讲解了模型如何将最多 50 个多模态输入视为锚点而非建议。
如何构建完整的 30 秒 Seedance 2.5 提示?
30 秒的 Seedance 2.5 视频需要划分为阶段。每个阶段只给一个主要变化和一个明确的结束状态。跳过这一步,故事往往在下半段偏离。这种分阶段方法正是制作单次通过广告的关键,Seedance 2.5 广告工作流程分解展示了品牌如何利用它完全跳过拼接步骤。
以下是长视频模板:
plaintext1[生成目标] 2生成一个 <视频类型>。中心主体是 <主体>,主要事件是 <故事摘要>。 3 4[阶段 1] 5初始状态:<角色、道具和场景的初始状态>。 6主要事件:<一个主要动作或事件>。 7结束状态:<角色位置、道具归属或可见场景状态>。 8 9[阶段 2] 10从上一阶段继续:<必须保持不变的状态>。 11主要事件:<一个主要动作或事件>。 12结束状态:<可观察状态>。 13 14[阶段 3] 15主要事件:<结束事件>。 16结束状态:<最终可见状态>。 17 18[保持一致性] 19保持 <角色身份、角色数量、服装、道具归属、空间方向、音频关系> 一致。 20
以下是一个新的示例,30 秒香水广告:
plaintext1[生成目标] 2生成一个 30 秒香水广告。中心主体是 <香水瓶>,主要事件是从微距细节到阳光静物的平静展示。 3 4[阶段 1] 5初始状态:瓶子金属盖和玻璃肩部的极端微距镜头,背景有模糊的绿色植物。 6主要事件:镜头缓慢拉远,露出石台上完整的瓶子。 7结束状态:整个瓶子居中放置,阳光斜射在玻璃上。 8 9[阶段 2] 10从上一阶段继续:同一瓶子、瓶盖和标签保持不变。 11主要事件:一块奶油色亚麻布在瓶子后面飘入,光线变暖。 12结束状态:瓶子放在亚麻布旁,背光被低角度太阳照亮。 13 14[阶段 3] 15主要事件:最后缓慢推近,微风轻拂树叶。 16结束状态:瓶子保持画面中心,玻璃发光,其他一切柔和。 17 18[保持一致性] 19保持瓶子的形状、瓶盖、标签和液体水平一致,并保持温暖自然光的外观不变。 20
时间戳与节奏。大多数情况下,仅阶段就足够了。仅在需要精确确定特定交接、入场或剪辑点时,才使用精确计时。在提示中使用时间有三种方式:
td {white-space:nowrap;border:0.5pt solid #dee0e3;font-size:10pt;font-style:normal;font-weight:normal;vertical-align:middle;word-break:normal;word-wrap:normal;}
| 模式 | 示例 |
| 时间范围 | 0-3 秒... 3-7 秒... 7-12 秒... |
| 精确时间点 | 在 5 秒时,镜头快速向左摇摄并完成切换。 |
| 相对时间 | 门关闭两秒后,走廊灯光变暗。 |
一个使用时间范围的简短原创示例:
plaintext10-5 秒:展示一个空置的展示架。一只手放下一辆红色玩具车。结束状态:手离开画面,只有红色车居中。 25-10 秒:移除红色车,然后放置一个蓝色玩具机器人。结束状态:只有蓝色机器人居中。 310-15 秒:移除机器人,然后放置一个黄色玩具飞机。结束状态:只有黄色飞机居中。 4
时间范围类似于预算,而非精确的剪辑点。给定的范围太小,模型会漫无目的。塞入太多内容,会导致匆忙的剪辑或丢失节拍。不要使用时间戳要求不合理的内容,例如一秒钟内挤入三个独立动作。
哪些任务会自动锁定你的宽高比和时长?
三种 Seedance 2.5 任务类型会默默地自行锁定生成设置:视频剪辑、首帧或首末帧生成,以及视频扩展。了解适用规则可以避免你围绕一个实际上无法控制的设置编写提示。
td {white-space:nowrap;border:0.5pt solid #dee0e3;font-size:10pt;font-style:normal;font-weight:normal;vertical-align:middle;word-break:normal;word-wrap:normal;}
| 任务 | 宽高比 | 时长 |
| 视频剪辑 | 锁定为输入视频的宽高比 | 锁定为大致输入长度,加减约 0.3 秒 |
| 首帧或首末帧生成 | 锁定为第一张图片的宽高比 | 可自由设置 |
| 视频扩展 | 锁定为输入视频的宽高比 | 可自由设置 |
任何以这种方式锁定的内容都无法在生成页面或通过 API 覆盖。如果为视频搭配首帧和末帧,请确保两张图片具有相同的宽高比。不匹配的宽高比可能会拉伸末帧的形状。
如何为视频剪辑编写 Seedance 2.5 提示?
剪辑提示每次都需要四个部分:哪个视频是母版、要更改什么、更改范围有多大,以及哪些内容必须完全保持原样。
plaintext1[剪辑目标] 2剪辑 @Video 1。在 <整个视频或特定时间范围> 内,<添加、移除、替换或调整> <视觉对象、区域或音频类别>。 3 4[源视频角色] 5@Video 1 是唯一的剪辑母版。它定义 <角色、场景、动作、构图、镜头运动、遮挡关系、音频和事件顺序>。 6 7[目标材料角色] 8@Image 1 或 @Audio 1 定义 <目标对象或声音的指定属性>。 9 10[剪辑范围] 11仅修改 <对象、区域、时间范围或音频类别>。 12 13[要保留的内容] 14保留 @Video 1 中 <必须不变的视觉内容、运动、音频和时序关系>。 15
一个新示例,更改商店招牌的灯光:
plaintext1[剪辑目标] 2剪辑 @Video 1。保持构图、镜头位置、灯光和表演节奏不变,仅重写女主角的面部和表情。 3 4[源视频角色] 5@Video 1 是唯一的剪辑母版。它定义女主角、取景、镜头位置、灯光以及她表演的时机。 6 7[剪辑范围] 8自然地让她从二十多岁衰老到六十岁。让她的眼神中克制的悲伤慢慢融化,一滴泪水滑过眼角,嘴角逐渐上扬,直到她含泪微笑。 9 10[要保留的内容] 11保持单一连续拍摄,无跳切和闪烁,让她的特征随年龄变化,但不偏离 @Video 1。 12
风格也可以就地调整。保持运动,改变外观:
plaintext1剪辑 @Video 1。保持 @Video 1 的镜头运动和节奏。按顺序将视觉风格更改为黑白漫画、日本动画、美式硬边漫画和墨水动画。 2
主体替换遵循类似的模式,但添加了一个时间线继承规则,使新对象像旧对象一样移动:
plaintext1[剪辑目标] 2剪辑 @Video 1。仅将 <原始对象> 更改为 <目标对象>。 3 4[源视频角色] 5@Video 1 是唯一的剪辑母版。它定义原始场景、镜头位置、镜头运动、运动路径、遮挡关系和事件顺序。 6 7[目标参考角色] 8@Image 1 定义 <目标对象> 的 <外观、结构或材质>。不要使用 <无关的背景、人物或构图>。 9 10[剪辑范围] 11仅修改 <特定对象和区域>。整个视频包含 <数量> 个目标对象。不要修改 <要保留的内容>。 12 13[时间线继承] 14<目标对象> 继承 <原始对象> 的每一次出现、运动、遮挡和退出,包括时机、时长、路径和速度变化。 15
以下是填充后的形状,替换海滩场景中的饮料瓶:
plaintext1[剪辑目标] 2剪辑 @Video 1。仅将视频中的汽水瓶替换为 @Image 3 中的粉色饮料瓶。 3 4[源视频角色] 5@Video 1 是唯一的剪辑母版。它定义海滩上的三个朋友、他们的行走和干杯、构图、镜头运动和事件顺序。 6 7[目标参考角色] 8@Image 3 定义粉色饮料瓶的形状、标签和材质。不要使用参考中的任何背景或人物。 9 10[时间线继承] 11粉色瓶子继承原始汽水瓶的每个位置、运动和手部遮挡,包括时机和速度。将 @Image 3 替换为 @Image 5 以获得绿色瓶子。 12
背景替换以相同方式工作,只是针对主体周围的空间,而非主体携带的物体。将普通工作室背景替换为阳光明媚的屋顶花园,主体的身份、位置和运动保持不变,只有他们背后的空间发生变化。
音频编辑可以独立运行,与视觉内容无关:
plaintext1剪辑 @Video 1。仅移除背景音乐。保留主持人对话、口型同步和街道环境音。保留 @Video 1 的视觉内容和剪辑节奏。 2
plaintext1剪辑 @Video 1。将 <主持人> 的口头语言更改为自然的澳大利亚英语,同时保留对话内容和时机。保留 @Video 1 的所有其他人声、音乐和视觉内容。 2
如何编写 Seedance 2.5 提示来向前或向后扩展视频?
向前扩展在剪辑结束后继续。向后扩展在剪辑开始前添加一个开头。无论哪种方式,首先要锁定边界帧,然后描述接下来发生的事情。
向前扩展:
plaintext1@Video 1 是要向前扩展的源视频。 2 3向前扩展 @Video 1。扩展段的第一帧直接延续 @Video 1 的最后一帧。保持 <主体姿势和方向>、<道具位置>、<背景和空间关系>、<镜头位置和构图>、<灯光> 和 <运动方向> 的连续性。 4 5然后,<描述要添加的新动作、事件、镜头处理或音频>。 6 7在整个扩展过程中,保持 <角色身份和服装>、<关键道具>、<背景布局> 和 <行为轴> 的连续性。 8
示例:将微距花朵镜头扩展为蜜蜂授粉序列。
plaintext1@Video 1 是要向前扩展的源视频。 2 3向前扩展 @Video 1。扩展段的第一帧直接延续 @Video 1 的最后一帧。保持花朵的位置、微距取景和柔和自然光。 4 5然后,一只蜜蜂飞入并落在花朵上。切换到蜜蜂腿部和腹部沾满金色花粉粒的微距特写。蜜蜂拍动翅膀起飞,镜头跟随它到另一朵同种花上。慢动作中,花粉从蜜蜂的绒毛上抖落,精确地落入花朵中心,放大了授粉的瞬间。 6 7在整个扩展过程中,保持花朵的身份、植物的位置和微距灯光一致。 8
向后扩展则相反。描述剪辑开始前发生的事情,然后将源视频的第一帧视为你正在构建的精确结束状态。仅仅写“连接到源视频”是不够的,这可能会让角色或效果过早出现。
plaintext1@Video 1 是要向后扩展的源视频。 2 3向后扩展 @Video 1。在源视频开始之前,<描述前面的动作、事件、镜头处理或音频>。 4 5扩展段的最后一帧自然地连接到 @Video 1 的第一帧:<主体姿势和方向>、<道具位置> 和 <背景和空间关系>。匹配 @Video 1 第一帧的 <镜头位置和构图>、<灯光> 和 <运动方向>。 6 7在整个扩展过程中,保持 <角色身份和服装>、<关键道具>、<背景布局> 和 <行为轴> 的连续性。 8
示例:在顾客走进来之前,咖啡师准备吧台。
plaintext1@Video 1 是要向后扩展的源视频。 2 3向后扩展 @Video 1。在源视频开始之前,咖啡师擦拭吧台,放好一叠杯子,并打开浓缩咖啡机。 4 5扩展段的最后一帧自然地连接到 @Video 1 的第一帧:咖啡师站在吧台后面,机器嗡嗡作响,杯子堆在左边。匹配 @Video 1 第一帧的平视静态镜头和温暖的顶光。 6
如何使用关键帧、故事板和分镜参考?
首帧和末帧。明确说明一张图片是开场帧,另一张是结束帧。没有单独的切换模式。
plaintext1@Image 1 是第一帧。它定义开场构图、主体位置、姿势、道具状态、场景和镜头方向。 2@Image 2 是末帧。它定义结束构图、主体位置、姿势、道具状态、场景和镜头方向。 3 4<描述一个连续的动作或事件>。 5视频从第一帧自然开始,经过连续动作后到达末帧。 6
示例:蒸汽火车冲出复古电影院屏幕。
plaintext1@Image 1 是第一帧。它显示了一个复古黑白电影院:戴着帽子的观众看着屏幕上驶来的蒸汽火车,一道放映光束穿过黑暗。 2@Image 2 是末帧。它显示同一辆蒸汽火车以全彩冲出屏幕进入剧院,一辆红色和黑色的机车笼罩在蒸汽中,冲向座位。 3 4从第一帧的姿势开始,屏幕上的火车获得色彩和深度,然后冲破屏幕冲入大厅,自然到达末帧。 5
两帧应具有相同的宽高比,否则末帧可能被拉伸。
多个关键帧。当不同的图片标记不同的阶段时,先说明,然后描述每张图片显示的内容。
plaintext1按顺序使用 @Image 1 到 @Image N 作为关键帧。 2 3@Image 1 是第一帧。它定义 <开场构图>。 4@Image 2 定义第二个关键帧:<阶段 1 的可见结束状态>。 5@Image N 是末帧。它定义 <结束构图>。 6 7视频按顺序通过这些状态,使用连续运动在它们之间移动。 8
示例:一粒种子在四张图片中成长为花朵。
plaintext1按顺序使用 @Image 1 到 @Image 4 作为关键帧。 2 3@Image 1 是第一帧。它显示一颗种子躺在深色土壤中。 4@Image 2 定义第二个关键帧:一颗小绿芽破土而出。 5@Image 3 定义第三个关键帧:一个带有紧闭未开花瓣的芽茎。 6@Image 4 是末帧。它显示同一株植物在正午光线下完全绽放。 7 8视频按顺序通过这四个状态,在它们之间连续、逐渐地生长。 9
故事板网格。一个网格传达粗略的镜头顺序和构图,而非精确细节。保持在 15 个面板以内,并明确说明阅读顺序。
示例:一个四格拿铁艺术序列。
plaintext1@Image 1 提供了一个四格拿铁艺术故事板,用于镜头顺序和构图。从左到右、从上到下阅读。不要使用故事板的草图风格或文字标签。 2@Image 2 定义咖啡师的面部、围裙和短发。 3 4镜头 1:浓缩咖啡吧的全景,咖啡师正在萃取咖啡。 5镜头 2:蒸汽牛奶倒入杯中的特写。 6镜头 3:咖啡师在奶泡中勾画叶子图案的俯视镜头。 7镜头 4:成品拿铁放在吧台上的中景镜头。 8 9使用明亮、逼真的咖啡馆风格。保持蒸汽棒的嘶嘶声和安静的咖啡馆交谈声。 10
分镜参考分为两种类型。粗略分镜主要传递运动、路径和剪辑。精细分镜已具有完整结构,用于重新渲染材质和风格。
td {white-space:nowrap;border:0.5pt solid #dee0e3;font-size:10pt;font-style:normal;font-weight:normal;vertical-align:middle;word-break:normal;word-wrap:normal;}
| 类型 | 最适合 | 提示重点 |
| 粗略分镜 | 预览动作、遮挡或剪辑的简单形状 | 将每个分镜形状映射到真实主体,说明要继承什么 |
| 精细分镜 | 需要新材质或风格的完整模型 | 保持结构和运动,定义要重新渲染的内容 |
粗略分镜示例:送货无人机的飞行路径。
plaintext1@Video 1 是粗略分镜参考。它仅提供无人机的飞行路径、高度变化和一次镜头平移。不要使用其灰色几何体或空场景。 2@Video 1 中的小球体对应 <送货无人机>。 3@Image 1 定义 <送货无人机> 的白色外壳和橙色旋翼防护罩。 4@Image 2 定义屋顶着陆平台的栏杆和灯光。 5 6<送货无人机> 降落到屋顶平台并轻轻降落在其中心。 7保持 @Video 1 的飞行路径、高度变化和镜头平移。 8
精细分镜示例:将手办模型重新渲染为青铜公园雕像。
plaintext1@Video 1 是精细分镜参考。保留人物的完整结构、其缓慢的转台旋转和环绕镜头运动。不要使用其灰色塑料材质或空背景。 2@Image 1 定义风化青铜表面,带有柔和绿色铜绿。 3@Image 2 定义公园场景,带有石铺路面和秋树。 4 5将 @Video 1 中的人物重新渲染为青铜雕像,并将场景重新渲染为公园。 6保持 @Video 1 的结构、旋转速度和镜头运动。 7
如何用 Seedance 2.5 提示将图片或片段转化为一键视频或无缝过渡?
一键视频将一组图片,或图片加风格参考片段,转化为一个配有节奏和剪辑的视频。说明每个材料的职责、显示顺序、添加多少运动以及音频。
plaintext1[材料角色] 2@Image 1 用于 <开场图片>。 3@Image 2 用于 <过程图片>。 4@Image 3 用于 <结束图片>。 5 6[排列] 7按 <指定顺序> 显示图片。 8 9[图片运动] 10对每张图片应用 <微妙运动、推近或视差>。 11 12[最终风格] 13使用 <剪辑节奏和色彩风格>。 14 15[音频] 16包括 <环境音、音效或音乐>。 17
示例:一次通过一系列参考房间的单次旅程。
plaintext1[材料角色] 2@Image 1 用于穿过房间的男人。 3@Image 2 用于向日葵田野窗户。 4@Image 3 用于画架前的画家。 5@Image 4 用于野花房间。 6@Image 5 用于晚间派对。 7 8[排列] 9以一次连续拍摄的方式显示场景,从一个房间移动到另一个房间,无剪辑。 10 11[图片运动] 12通过每个门口进行稳定的向前推进,前景缓慢视差。 13 14[最终风格] 15使用温暖、梦幻的色彩调色板,伴有柔和的金色光线。 16 17[音频] 18包括安静的脚步声、柔和的钢琴旋律,以及派对上的嘈杂声渐强。 19
无缝过渡是将两个独立的片段连接成一个连续动作。说明之前的片段、之后的片段,以及触发它们之间切换的确切内容。
td {white-space:nowrap;border:0.5pt solid #dee0e3;font-size:10pt;font-style:normal;font-weight:normal;vertical-align:middle;word-break:normal;word-wrap:normal;}
| 过渡方式 | 要指定什么 |
| 俯冲或反向运动 | 镜头方向、速度变化、下一个场景何时开始 |
| 物体变形 | 对应的形状、材质和变换 |
| 推近或焦点变化 | 镜头运动、焦点目标、空间关系 |
示例:地铁列车俯冲进入隧道,降落在天文馆穹顶内。
plaintext1@Video 1 是过渡前的片段。使用其地铁站台、进站的列车和站台广播。 2@Video 2 是过渡后的片段。使用其天文馆穹顶、向上的镜头运动和安静的礼堂回响。 3 4在 @Video 1 的结尾,列车的前灯充满画面,进入隧道。 5镜头继续向前,隧道的弧形天花板逐渐变成穹顶的弧形内部。 6过渡自然结束于 @Video 2 的向上看的开场镜头。 7列车的隆隆声逐渐消失为观众的低语。 8
如何将情感和镜头方向写入 Seedance 2.5 提示?
像“紧张”或“温暖”这样的词指向一个方向,但实际表演仍留有猜测空间。为了更稳定的结果,将任何情感词与相机实际能看到或听到的东西配对:眼神、呼吸、手势、节奏变化。
单一情感过渡:
plaintext1整体情感从 <起始情感> 转变为 <结束情感>。 2在 <触发事件> 之后,<主体> 首先表现出 <即时的可观察反应>。 3然后,<眼睛、眉毛、嘴巴、呼吸、目光或手部动作> 逐渐 <变化>。 4最后,<主体> 通过 <克制或外显的行为> 表达 <目标情感>。 5
示例:剧院观众中的女性被感动落泪。
plaintext1整体情感从压抑的悲伤转变为含泪的微笑。 2在表演达到高潮后,观众席中的年轻女性首先表现出眼睛湿润、泪水盈眶。 3然后,她的眉毛扬起,一滴泪水滑落,紧握的双手压向嘴唇。 4最后,她破涕为笑,含泪笑着,目光从未离开舞台。 5
多阶段情感在感受多次变化时效果更好,由不同事件触发。示例:跑者冲过终点线。
plaintext1当跑者看到终点线时,步伐加快,手臂摆动更用力。 2当人群欢呼声升高时,跑者的眼睛睁大,脸上露出微笑。 3冲过终点线后,跑者减速停下,双手放在膝盖上,胸膛起伏。 4最后,跑者举起双臂大笑,仍在喘气。 5
镜头语言。大多数标准术语可以直接放入提示,无需额外解释。
td {white-space:nowrap;border:0.5pt solid #dee0e3;font-size:10pt;font-style:normal;font-weight:normal;vertical-align:middle;word-break:normal;word-wrap:normal;}
| 类型 | 常见术语 |
| 景别 | 极远景、远景、中景、特写、极特写 |
| 镜头运动 | 推近、拉远、平移、横移、跟拍、环绕、后退、仰拍、手持抖动 |
| 镜头位置 | 低角度、俯视、第一人称视角 |
流行技巧有其自身的期望,但说明镜头跟随什么以及移动开始和结束的位置仍然有帮助:
td {white-space:nowrap;border:0.5pt solid #dee0e3;font-size:10pt;font-style:normal;font-weight:normal;vertical-align:middle;word-break:normal;word-wrap:normal;}
| 技巧 | 要指定什么 |
| 一镜到底 | 镜头经过的主体和空间,按顺序 |
| 推拉变焦 | 要保持稳定的主体大小,以及背景是拉近还是拉远 |
| 子弹时间 | 什么动作冻结或放慢,以及镜头环绕的方向 |
不常见的术语需要翻译成可见的东西。使用此顺序:摄影术语、主体、视觉变化以及方向或速度。
- 浅景深:保持小提琴手的弓手和面部清晰,同时背景的串灯模糊成柔和的光圈。
- 跟拍镜头:以匹配速度沿着骑行者移动,保持骑行者清晰,同时护栏形成水平模糊。
- 黄金时段:温暖、低角度的阳光从攀登者背后射来,在岩壁上投下长长的阴影。
- 自然暗角:逐渐使四个角落变暗,同时中心的吹号手保持自然肤色,无明显边界。
- 快速摇摄过渡:在 4 秒时,相机向右快速摇摄,当一辆经过的公共汽车完全遮挡画面时切换,然后以相同速度继续向右摇摄进入下一个场景。
提交前检查清单和 Seedance 2.5 提示的已知限制
在提交之前,请检查此清单:
- 提示是否明确命名了主体和主要动作?
- 每个参考文件是否说明了要使用什么以及要忽略什么?
- 每个角色、产品和道具是否都已命名并绑定到唯一一个文件?
- 参考是否按场景选择,而非强制一次性全部出现?
- 长视频的每个阶段是否只有一个主要变化和一个明确的结束状态?
- 角色数量、服装、道具归属和空间位置在整个过程中是否保持一致?
- 对于剪辑,提示是否命名了母版视频、精确范围和要保留的内容?
- 情感词和镜头术语是否与可见或可听的内容配对?
- 每个首帧、末帧或关键帧图片是否获得一个明确的工作?
- 对于故事板,提示是否说明了要继承什么结构?对于分镜,是否明确标记为粗略或精细?
- 剪辑、首帧/末帧和扩展提示是否尊重前面介绍过的锁定参数规则?
- 对于扩展,是否检查了边界帧、运动方向和音频连续性?
一个有助于任何长、多角色提示的快速习惯:在编写时,在旁边保留一个纯文本列表,列出每个命名的主体及其分配的文件编号。这听起来微不足道,但这是在点击生成之前捕捉不匹配参考的最快方法。
一些限制值得提前了解,这样你就不会追求系统无法提供的结果:
- 时间戳设置了一个时间预算。它们不是帧精确的剪辑点。
- 剪辑提示提高了击中正确节拍的概率,但不能保证与源帧精确对齐。
- 多参考提示是关于为每个场景选择正确的文件,而不是强制所有文件同时可见。
- 对于字幕,精确的公式、标志或精确规格,请将模型与准备好的参考和后期制作配合使用。
- 剪辑锁定输入的宽高比和大致时长。输出可能漂移约 0.3 秒。
- 首帧和首末帧生成将宽高比锁定到第一张图片,但时长可自由设置。
- 扩展锁定输入的宽高比,并且添加的片段的音频电平可能无法完美匹配源。
今天在哪里可以练习这些 Seedance 2.5 提示?
字节跳动于 2026 年 6 月发布了 Seedance 2.5,Atlas Cloud 正在通过已服务于 Seedance 2.0 和 1.5 的同一统一端点,为 Seedance 2.5 提供 Day-0 API 访问。2.5 层的最终定价尚未公布。
实际的部分是:本指南中的参考绑定语法,即 @Image、@Video 和 @Audio 标签,已经可以在 Seedance 2.0 上运行。这意味着你现在就可以在实时端点上测试和优化提示模板,而无需等待 2.5 访问开放。如果你想找一个现成的起点,可以浏览我们的 Seedance 2.5 提示中心,获取可直接复制粘贴的提示示例。
常见问题
一个 Seedance 2.5 提示中可以使用多少个参考文件?
单个请求最多可携带 50 个多模态参考文件。具体为 30 张图片、10 个视频片段和 10 个音频片段,不过保持 8 个或更少的不同主体通常比推满上限更稳定。
对话括号和音效括号有什么区别?
对话使用花括号,例如 {Hello there.},用于口语对话。音效使用尖括号,例如 <门铃声>,用于环境或偶发声音。混淆它们可能导致模型将音效当作口语对话来发音。
如何在整个视频中保持角色一致性?
尽早将角色绑定到一个特定的参考图片,明确说明要使用什么(如面部、发型或服装),并在角色后续出现时每次重复同一名称。避免每次从头重新描述他们的外观。
粗略分镜和精细分镜有什么区别?
粗略分镜是简单的几何体,主要传递运动、路径和镜头切换。精细分镜是完整的、详细的模型,用于重新渲染新的材质、颜色或风格,同时保持其结构和运动不变。
我什么时候可以在 Atlas Cloud 上调用 Seedance 2.5 API?
Atlas Cloud 将 Seedance 2.5 访问列为即将推出,定价尚未公布。Seedance 2.0 和 1.5 现在已在同一平台上上线,因此今天构建的提示模板应在 2.5 端点开放后直接迁移。
结论
一个强大的 Seedance 2.5 提示不在于更长,而在于更好的组织。从六部分公式开始,将每个参考绑定到命名的主体,并将任何超过几秒的内容分解为具有明确结束状态的阶段。然后,本指南中的剪辑、扩展和关键帧模板可以根据项目需要随时插入。
收藏你最常重用的模板,并在 Atlas Cloud 上通过 Seedance 2.0 今天就开始测试它们,同时等待 Seedance 2.5 访问的推出。






