一段30秒的视频片段,让你的提示有三十次机会崩盘。Seedance 2.5 已于2026年7月31日正式发布,首先通过即梦AI和豆包专业版推出,随后在火山引擎上开放API访问。输出时长翻倍、50个参考素材上限、更精细的编辑控制,所有这些都奖励一项最重要的技能:像写分镜头脚本一样写提示词,每个参考文件都承担明确的命名任务。

对于学过Seedance 2.0的人来说,好消息是:语法没有变。Seedance 2.5保留了Seedance 2.0中定义的三项任务拆分(参考、编辑、扩展)。变化在于你能喂给它多少素材,以及模型需要保持多长时间的连贯性。本指南将逐一讲解。
关键要点
- Seedance 2.5 单次生成最长30秒,每项任务最多接受50个参考素材:30张图片、10个视频片段、10个音频片段。
- 核心提示词结构延续自Seedance 2.0:定义主体、编写编号镜头、用{}包裹对话、以质量词加上约束词结尾。
- 编辑提示词遵循一条硬性规则:只有在借用特征时才写“reference @video1”。对于编辑操作,直接命名视频,否则模型可能将你的编辑误读为参考任务。
- 截至发布时,Seedance 2.5尚未在Atlas Cloud上架。目前该平台上的Seedance 2.0系列使用相同的参考语法,价格约为每秒0.09美元(含截至2026年7月31日的20%折扣)。
对于提示词写作者,Seedance 2.5改变了什么
键盘上有四项升级值得关注。单次输出从15秒延长至30秒。参考素材上限增至50个。编辑成为一等提示词任务,拥有自己的语法(本指南有专门章节)。此外,对话生成现在原生支持十多种语言。

字节跳动称30秒输出和50个素材上限为全球首创。可以将其视为厂商宣传,而非既定基准。对输出质量真正重要的是方向性改进:灯光、运镜、表演和情感可读性均有提升,足以让公司现在宣传电影级镜头作品,而AI痕迹则有所减少。
无论如何,有一个习惯值得延续:虽然30秒以下的内容在提示词结构良好时表现更佳,但更长的画幅会放大漂移而非掩盖它。
练习地点:在Atlas Cloud上运行Seedance提示词
截至7月31日,Seedance 2.5尚未登陆第三方平台,API和Ark playground预计于2026年8月7日全面开放。本周的实际操作是:在Seedance 2.0系列上练习完全相同的参考语法,该系列可通过Atlas Cloud的Seedance模型家族使用,包括文生视频、图生视频以及多模态参考转视频playground。@主体语法、参考槽位、编辑动词:所有这些都直接迁移。
参考端点的定价基于令牌,模型页面明确标注了当前费率:720p输出按每秒0.2419美元计费,包含视频输入的任务降至每秒0.1486美元(720p)。整个系列的门槛价格更低。文生视频卡片显示约每秒0.112美元,含截至2026年7月31日20%折扣后约为0.09美元。Seedance 2.0 Fast折扣后约每秒0.072美元,轻量版Mini约0.045美元。折扣带有倒计时,因此在预算项目前请务必在模型页面核实当前价格。
方法一:Atlas Cloud上的Seedance Playground
登录后打开参考转视频playground,无需编写代码即可运行本文中的所有模式。在左侧上传参考文件,然后在提示词框中输入@将主体绑定到特定图片、视频或音频槽位。

该页面上的默认示例值得作为模板研读。每个重要的名词都通过@image绑定,因此模型永远不会猜测你指的是哪个城市或哪个机器人。
方法二:通过Atlas Cloud API使用Seedance提示词
第一步:获取API密钥。 在Atlas Cloud控制台创建一个密钥并复制。


第二步:查看API文档。 端点、参数和认证信息位于API文档中。
第三步:发起第一个请求。 参考端点接受提示词以及每种参考类型的并行数组:
plaintext1curl -X POST https://api.atlascloud.ai/api/v1/model/generateVideo \ 2 -H "Content-Type: application/json" \ 3 -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \ 4 -d '{ 5 "model": "bytedance/seedance-2.0/reference-to-video", 6 "prompt": "将 @image1 中的女性定义为 Mara。镜头1:中景跟拍,Mara 穿过 @image2 的夜市,霓虹灯倒映在湿漉漉的路面上。 <街边摊的滋滋声>", 7 "reference_images": ["https://your-cdn/mara-face-closeup.jpg", "https://your-cdn/night-market.jpg"], 8 "reference_videos": [], 9 "reference_audios": [], 10 "duration": -1, 11 "resolution": "720p", 12 "ratio": "16:9", 13 "generate_audio": true 14 }'
将duration设置为-1可让模型在此端点4至15秒的范围内自行选择自然长度。轮询返回的预测ID,直到完成:
plaintext1curl https://api.atlascloud.ai/api/v1/model/prediction/<prediction_id> \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY"
完成后的响应包含托管的视频URL。由于Atlas Cloud在整个平台上运行统一的API,任何新出现的Seedance端点只需将模型字符串改为一行代码即可。你的参考数组、轮询循环和提示词文件保持不变。
Seedance 2.5提示词公式(延续自Seedance 2.0)
将模型视为一个多模态导演,它读取你的文本、图像、视频和音频,然后将任务拆分为空间层(画面中有什么)和时间层(随时间如何变化)。这转化为一个六槽公式,前两个槽之后的内容均为可选:
主体 + 动作或事件 + 场景和环境 + 视觉风格 + 运镜 + 声音
Seedance 2.0时代的扩展内容(照明词、质量词、约束结尾如“无字幕、无水印”)仍然适用于这些槽位,因此你学到的内容不会浪费。一个值得注意的规则是:生成设置(如时长和分辨率)应完全放在提示词之外,它们属于页面或API参数。
在实际操作中,六个槽位折叠为四行可写的文字。以下是基础模板示例,翻译后:

主体优先,因为除非模型知道你指的是哪张脸,否则参考素材毫无用处。每个主体定义一次,附带两到三个稳定特征,然后在任何地方重复使用该标签。
- 将 @image1(红裙、草帽)中的女性定义为 Mara。
- Mara 在黄昏时分沿着码头行走……

三条规则可防止定义泄露。为每个@引用赋予即时的工作描述,包括模型应忽略的内容:以“@image1 用于陶艺师的面部特征、头发和绿色围裙,而不是图像背景”的风格。使用面部特写作为独立图像,与全身照分开——这是Seedance 2.0时代防止身份漂移的技巧,现在同样有效。另外,处理多角度视图时需谨慎:对于五个或更少的主体,单视图或多视图图像均可;但超过五个后,最好坚持使用单视图,将角度拆分图单独存放,并明确声明(“这四张图像定义同一盏折叠台灯;视频中只出现一盏灯”)。
声音和文本各自有专用包装,以便模型从不混淆对话与字幕:
| 信息类型 | 包装 | 示例 |
|---|---|---|
| 对话 | { } | 她微笑着说道 {我们一定能做到} |
| 音乐 | ( ) | (背景播放欢快的摇滚乐) |
| 音效 | < > | <脚步声> |
| 画面字幕 | 【 】 | 【第一章:出发】 |
每行对话保持同一种语言,并在大括号前指明语言。对于口音控制,有专门的模式:语言、地区变体、表达方式、说话者,然后是对白,例如“对话语言:自然、口语化的美式英语。女孩说:{我以为你不来了。}”
在Seedance 2.5提示词中使用50个参考槽位
五十个槽位分配为:30张图片、10个视频片段、10个音频片段。视频和音频时长单独预算:最多30秒视频参考和另外30秒音频参考,每个片段时长在2至30秒之间。图片最大4K、30MB,视频最大4K、200MB,音频15MB(mp3或wav格式)。纯音频参考也可行:你可以只给模型一个音频轨道和一段文本提示。槽位数量是Seedance 2.0的三倍,参考素材时长翻倍,而最糟糕的做法就是把这些空间填满。

将音频或视频主体参考控制在5个以内(任务需要时可增至6至10个),主体图片控制在8张以内(最多9至12张)。单个片段的最佳时长为5至10秒:短于约2秒则特征太少难以锁定,而整段30秒的参考则会稀释你想要复制的特征。当素材确实堆积起来时,建议的裁剪顺序是:核心角色优先,其次关键产品或道具,然后是场景,最后是整体风格。
那么额外的空间用来做什么?群戏场景。一个旗舰早期示例是30秒的宫廷派对,由20张编号角色和道具图片加上三个语音样本构建,每位宾客都通过@引用绑定。它的展示列表也是同样的思路:多角色群戏场景、一个32个参考素材的武侠序列、以及将动作迁移到攀爬大猩猩上,都依赖堆叠的全模态参考。
分镜头列表让30秒的Seedance 2.5提示词保持连贯
最值得延续的习惯:停止写情绪文案,开始写编号镜头。“一个男人跑过街道,非常电影化”这句话没有给时间层任何调度内容。而分镜头列表则能做到:
plaintext1将 @image1 中的女孩定义为 Lin。@image2 设定宿舍场景。参考 @video1 的运镜。 2镜头1:中景跟拍,傍晚。Lin 走到宿舍门口,停顿,深吸一口气,略显紧张。走廊窗户透出暖光。 3镜头2:切换至室内中景。Lin 推开门。室友们从书桌上抬起头。一人问道 {所以?过了吗?}。缓慢的过半身切换,画面在面孔之间切换。 4镜头3:特写 Lin。她低下头,然后突然笑出声,说道 {骗到你们了}。室友们追着她跑。镜头拉远至房间全景。 5纪实风格,暖色调,柔和光线。面部保持稳定。无字幕,无水印。

这个例子很好地展示了模式。每个镜头回答四个相同的问题:
| 镜头的行 | 写什么 | 示例表述 |
|---|---|---|
| 运镜 | 每个镜头开始一个运动,使用标准术语 | “缓慢推近”、“固定镜头”、“切换至特写” |
| 动作 | 身体部位加上速度或力度 | “慢慢举起一只手”、“紧紧抓住肩带” |
| 空间 | 主体现在的位置 | “在宿舍门口”、“穿过屋顶” |
| 音频 | 该镜头的对话、音效或音乐 | {对白}、<音效>、(音乐) |
两条写作规则能起到很大作用。量化运动(缓慢地、急剧地、稍微地),并指明是哪个肢体在运动。同时将情绪外化,而不是直接贴标签:“低头,肩膀微微颤抖,手指捻着夹克下摆”能赋予画面动感,而“她很悲伤”则不能。Seedance 2.0时代的一条规则有所放宽:之前每个镜头只能有一个运镜动作,而Seedance 2.5可以处理组合运镜(在一个运动员入场的长镜头中同时进行跟拍、升降和旋转),并且稳定执行。从简单开始,当镜头值得时再组合。
时间安排是Seedance 2.5与其前身的不同之处。精确到秒的提示……在Seedance 2.0中曾导致生成不稳定。这个限制已经消失:Seedance 2.5提示词全程使用时间码:一个武侠序列写为[0-3秒]、[3-5秒]、[5-10秒]段落,一个月球形成讲解视频逐秒对照旁白进行脚本化。镜头顺序仍然承载故事;秒数范围现在让你能精确定位某个节拍在30秒内的位置。以下是那个武侠提示词如何分配时间:

Seedance 2.5编辑提示词:只改一处,其他不变
编辑是措辞最不宽容的地方,因为一个动词就决定了任务类型。规则明确:只有当你希望借用特征到新视频中时,才写“reference @video1”。当你想要修改片段本身时,直接命名视频(“@video1”、“严格编辑 @video1”),否则模型可能将任务误读为参考任务并重新生成整个场景。
好的编辑提示词压缩为三个动作:用@video1指向源素材,明确限定修改范围(如果替换主体,则添加参考图像),最后以一句锁定词结尾,如“其他一切保持不变”,这样模型就不会重新绘制你未提及的内容。这里有两个参数不由你控制:编辑后的片段会保留源素材的宽高比和大致时长。扩展也会继承宽高比,但增加的时长由你通过提示词设置(“向前扩展6秒”)。
| 操作 | 句型 | 是否保持其他部分稳定? |
|---|---|---|
| 添加 | 描述新元素、出现时间、出现位置 | 是,默认情况下未提及部分保持不变 |
| 替换 | “严格编辑 @video1,将 [旧特征] 改为 [新特征]” | 是,但需明确说明关键保留元素 |
| 删除 | 命名要删除的元素,然后命名必须保留的元素 | 强化保留的元素能显著帮助 |
| 扩展 | “将 @video1 向后/向前扩展:[接下来发生什么]” | 必须将风格、主体、故事声明为不变 |
| 重新配乐 | “保持 @video1 的画面和运镜不变,将背景音乐替换为 @audio1” | 音频编辑完全不改动画面 |
| 桥接 | “@video1,[过渡描述],然后 @video2” | Seedance 2.0 限制视频输入为3个片段、总时长15秒;Seedance 2.5 上限提升至10个片段、30秒 |
支持时间戳定位和参考引导的编辑(“替换 @video1 中 0:02 到 0:05 的场景,保持动作和节奏”);此外还支持绿幕替换和摄像机视角变换。展示案例比大多数人会用到的更进一步:对已完成场景重新打光(“将 @video1 的光线从正午强顶光改为日落侧光”)、让女演员在一个不间断镜头中从20岁变老到60岁、将片段循环切换为漫画、动漫和水墨风格、以及批量替换三种SKU颜色的饮料瓶——所有这些都归入编辑,无需完全重新生成。
在Seedance 2.5行为稳定之前,有两个Seedance 2.0时代的修复技巧仍然值得了解。如果扩展后的片段在接缝处出现跳跃,从第一段末尾剪掉六帧,再从第二段开头剪掉一帧,然后拼接。如果多次扩展导致画质下降,一种解决方法是先将源素材转换为白色3D模型渲染,然后从该干净基础开始扩展。
Seedance 2.5在各行业的能力
一个清晰的用例图已经浮现:五个行业对应四项核心能力,每个单元格都有已完成的提示词和最终片段支持。概览如下:
| 领域 | 标志性任务 |
|---|---|
| 电影 | 一个30秒长镜头讲述完整故事节奏、基于堆叠演员素材的群戏场景、威亚故障移除、一个主剪辑跨语言重新配音 |
| 广告、电商 | 一次性电视广告故事讲述、产品外观锁定品牌资产、价格标签重写、面向出口市场的主持人替换 |
| 教育 | 一个概念在30秒内解释清楚、原理可视化、系列中保持一致的主持人角色、多语言交付 |
| 工业 | 装配流程演示、3D白模产品预览、跨产品线铭牌替换、多语言安全培训 |
| 娱乐IP | 游戏风格预告片、虚拟偶像演出、节日皮肤视频、多语言虚拟主播 |
首先是最安静的一个:一个30秒无对话故事,仅用一段文字描述,没有镜头编号,完全依靠场景描述和环境音:
plaintext1一段30秒的无言视觉故事,展现法国乡村的静谧优雅,发生在普罗旺斯夏日下午。一位年轻女子身穿米白色亚麻连衣裙,在一间石砌小屋内的旧木桌上写完一封手写信,走出门,沿着一条穿过向日葵田的碎石小路,最后将信投入村庄边缘一个复古黄色邮箱中。镜头以浅景深特写开篇,聚焦书桌;穿过门口时,光线变为阴影;然后上升并拉远,展现金色山谷的广角镜头。仅环境音:蝉鸣、风声、笔尖划过纸面的沙沙声、邮箱关闭时轻柔的咔哒声。

当一段内容依赖单一连续情绪时,编号镜头的框架可以去掉。两种模式都有效。
广告图库展示了“一个主版本”流程的两个阶段。主版本是一个12秒的代言人广告,脚本按秒设定对话节拍。每个本地化版本只需单行编辑提示词:
plaintext1将主持人替换为一位美国女性,用英语重新配音文案。 2将主持人替换为一位西班牙男性,用西班牙语重新配音文案。 3将主持人替换为一位印尼女性,用印尼语重新配音文案。

教育行将本指南分别介绍的两项技术合并:一个30秒的博物馆纪录片,一位导游走过四个展厅,分别讲英语、普通话、马来语和日语,每个段落固定在7.5秒窗口内。而工业FPV无人机提示词则将公式部分的约束结尾升级,超越了样板文字:它们以运动和场景约束结尾,如“无屏幕文字或标记,不要向后飞行,天气和光照保持不变。”
常见问题
Seedance 2.5现在可以通过API使用吗?
发布时还不能。7月31日的发布覆盖字节跳动自己的应用,首先是即梦AI和豆包专业版。API访问和Ark playground预计于2026年8月7日全面开放,有两个访问细节值得注意:没有免费额度,激活需要账户余额超过200元人民币或拥有一个活跃的Seedance 2.0资源包。在此期间,Seedance 2.0系列仍可通过API完整使用。
Seedance 2.0的提示词在Seedance 2.5上还能用吗?
结构可以迁移:主体定义、@引用、编号镜头、对话和声音包装、以及参考/编辑/扩展任务拆分,所有这些都原封不动地延续到Seedance 2.5。你应该重新测试的是旧的变通方法,因为Seedance 2.0的几个痛点(单次输出短、编辑控制粗糙、时间提示不稳定)正是Seedance 2.5声称要修复的。
一个Seedance 2.5提示词可以包含多少个参考文件?
每项任务最多50个:30张图片、10个视频片段、10个音频片段。视频参考总时长最多30秒,音频也是30秒,每个片段时长在2至30秒之间。完整的预算用于群戏和大量参考的场景;日常任务的比例上限请参考上文的参考槽位部分。
Seedance 2.5能否生成英语或中文以外的其他语言的对话?
可以。原生支持的语言包括中文、英语、西班牙语、印尼语、马来语、泰语、阿拉伯语、葡萄牙语、越南语、日语和韩语等,并支持“一个主版本,多语言分发”的流程:其预告片演示用一行编辑提示词将同一剪辑重新配音为日语和法语。在每行对话前标注语言;公式部分中的口音模式同样适用。
一个Seedance 2.5视频可以运行多长时间?
单次输出30秒,可在其基础上进行多轮扩展以获得更长的剪辑。不要将其与参考片段的30秒上限混淆;后者是输入预算,而非输出。
结论
提示词语言是稳定的部分。主体定义一次并用@引用,镜头按顺序编号,对话用大括号,约束放在结尾:这套语法在二月份写出了15秒的片段,现在写出了30秒的片段。变化的是围绕它的上限。今天在Seedance 2.0端点上练习语法,保持参考集小而命名明确,一旦Seedance 2.5通过API开放,移植你的提示词应该是简单的一步。






