仅限两周 | Seedream 5.0 Pro 立享 8 折!

Seedance 2.5 保持30秒的连贯提示词

Seedance 2.5 于7月31日发布,支持30秒输出和50个参考槽。以下是从 Seedance 2.0 延续下来的提示语法、变更内容以及现有的实践位置。

一段30秒的视频片段,让你的提示有三十次机会崩盘。Seedance 2.5 已于2026年7月31日正式发布,首先通过即梦AI和豆包专业版推出,随后在火山引擎上开放API访问。输出时长翻倍、50个参考素材上限、更精细的编辑控制,所有这些都奖励一项最重要的技能:像写分镜头脚本一样写提示词,每个参考文件都承担明确的命名任务。

AI生成的电影感静帧画面:一位白发女王身穿暗色皮甲,站在沙漠城市上空一只喷火的黑色巨龙面前,背景是日落时分。这种单一场景的奇观镜头,需要一段30秒的Seedance 2.5提示词从第一帧到最后一帧保持连贯。

对于学过Seedance 2.0的人来说,好消息是:语法没有变。Seedance 2.5保留了Seedance 2.0中定义的三项任务拆分(参考、编辑、扩展)。变化在于你能喂给它多少素材,以及模型需要保持多长时间的连贯性。本指南将逐一讲解。

关键要点

  • Seedance 2.5 单次生成最长30秒,每项任务最多接受50个参考素材:30张图片、10个视频片段、10个音频片段。
  • 核心提示词结构延续自Seedance 2.0:定义主体、编写编号镜头、用{}包裹对话、以质量词加上约束词结尾。
  • 编辑提示词遵循一条硬性规则:只有在借用特征时才写“reference @video1”。对于编辑操作,直接命名视频,否则模型可能将你的编辑误读为参考任务。
  • 截至发布时,Seedance 2.5尚未在Atlas Cloud上架。目前该平台上的Seedance 2.0系列使用相同的参考语法,价格约为每秒0.09美元(含截至2026年7月31日的20%折扣)。

对于提示词写作者,Seedance 2.5改变了什么

键盘上有四项升级值得关注。单次输出从15秒延长至30秒。参考素材上限增至50个。编辑成为一等提示词任务,拥有自己的语法(本指南有专门章节)。此外,对话生成现在原生支持十多种语言。

分组水平条形图,标题“Seedance 2.5为提示词写作者提升了什么”。五对条形图显示Seedance 2.0(灰色)与Seedance 2.5(蓝色)对比:参考图片从9张增至30张,参考视频片段从3个增至10个,参考音频片段从3个增至10个,视频参考时长从15秒增至30秒,单次输出时长从15秒增至30秒。脚注说明2.5版将视频和音频参考时长分别预算为30秒。

字节跳动称30秒输出和50个素材上限为全球首创。可以将其视为厂商宣传,而非既定基准。对输出质量真正重要的是方向性改进:灯光、运镜、表演和情感可读性均有提升,足以让公司现在宣传电影级镜头作品,而AI痕迹则有所减少。

无论如何,有一个习惯值得延续:虽然30秒以下的内容在提示词结构良好时表现更佳,但更长的画幅会放大漂移而非掩盖它。

练习地点:在Atlas Cloud上运行Seedance提示词

截至7月31日,Seedance 2.5尚未登陆第三方平台,API和Ark playground预计于2026年8月7日全面开放。本周的实际操作是:在Seedance 2.0系列上练习完全相同的参考语法,该系列可通过Atlas CloudSeedance模型家族使用,包括文生视频、图生视频以及多模态参考转视频playground。@主体语法、参考槽位、编辑动词:所有这些都直接迁移。

参考端点的定价基于令牌,模型页面明确标注了当前费率:720p输出按每秒0.2419美元计费,包含视频输入的任务降至每秒0.1486美元(720p)。整个系列的门槛价格更低。文生视频卡片显示约每秒0.112美元,含截至2026年7月31日20%折扣后约为0.09美元。Seedance 2.0 Fast折扣后约每秒0.072美元,轻量版Mini约0.045美元。折扣带有倒计时,因此在预算项目前请务必在模型页面核实当前价格。

方法一:Atlas Cloud上的Seedance Playground

登录后打开参考转视频playground,无需编写代码即可运行本文中的所有模式。在左侧上传参考文件,然后在提示词框中输入@将主体绑定到特定图片、视频或音频槽位。

Atlas Cloud上Seedance 2.0参考转视频playground的真实截图。提示词字段显示:“在城市中 @image2,镜头拉远,露出一个机器人 @image3 坐在屋顶上;一辆飞车 @image1 驶近,机器人 @image3 站起来,登上车辆 @image1 并开走。”同时加载了三张参考图片(一辆未来感汽车、一条城市街道、一个机器人头部),参考视频槽位为空,运行按钮显示约1.94美元,并带有-20%徽章,覆盖了划掉的约2.43美元。

该页面上的默认示例值得作为模板研读。每个重要的名词都通过@image绑定,因此模型永远不会猜测你指的是哪个城市或哪个机器人。

方法二:通过Atlas Cloud API使用Seedance提示词

第一步:获取API密钥。 在Atlas Cloud控制台创建一个密钥并复制。

Atlas Cloud首页控制台导航截图,显示顶部导航栏中的Console按钮位置,用于访问API密钥管理

Atlas Cloud API密钥管理仪表板截图,分步骤展示点击API Keys菜单、点击Create API Key按钮并复制生成的API密钥

第二步:查看API文档。 端点、参数和认证信息位于API文档中。

第三步:发起第一个请求。 参考端点接受提示词以及每种参考类型的并行数组:

plaintext
1curl -X POST https://api.atlascloud.ai/api/v1/model/generateVideo \
2  -H "Content-Type: application/json" \
3  -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \
4  -d '{
5    "model": "bytedance/seedance-2.0/reference-to-video",
6    "prompt": "将 @image1 中的女性定义为 Mara。镜头1:中景跟拍,Mara 穿过 @image2 的夜市,霓虹灯倒映在湿漉漉的路面上。 <街边摊的滋滋声>",
7    "reference_images": ["https://your-cdn/mara-face-closeup.jpg", "https://your-cdn/night-market.jpg"],
8    "reference_videos": [],
9    "reference_audios": [],
10    "duration": -1,
11    "resolution": "720p",
12    "ratio": "16:9",
13    "generate_audio": true
14  }'

将duration设置为-1可让模型在此端点4至15秒的范围内自行选择自然长度。轮询返回的预测ID,直到完成:

plaintext
1curl https://api.atlascloud.ai/api/v1/model/prediction/<prediction_id> \
2  -H "Authorization: Bearer $ATLASCLOUD_API_KEY"

完成后的响应包含托管的视频URL。由于Atlas Cloud在整个平台上运行统一的API,任何新出现的Seedance端点只需将模型字符串改为一行代码即可。你的参考数组、轮询循环和提示词文件保持不变。

Seedance 2.5提示词公式(延续自Seedance 2.0)

将模型视为一个多模态导演,它读取你的文本、图像、视频和音频,然后将任务拆分为空间层(画面中有什么)和时间层(随时间如何变化)。这转化为一个六槽公式,前两个槽之后的内容均为可选:

主体 + 动作或事件 + 场景和环境 + 视觉风格 + 运镜 + 声音

Seedance 2.0时代的扩展内容(照明词、质量词、约束结尾如“无字幕、无水印”)仍然适用于这些槽位,因此你学到的内容不会浪费。一个值得注意的规则是:生成设置(如时长和分辨率)应完全放在提示词之外,它们属于页面或API参数。

在实际操作中,六个槽位折叠为四行可写的文字。以下是基础模板示例,翻译后:

图表标题“Seedance 2.5基础模板,每项任务一行”。四行颜色编码的行将官方公式映射到陶艺工作室示例:蓝色“主体+动作”芯片旁写着“一位陶艺师在清晨的工作室里完成一只浅蓝色杯子,将其从轮盘上取下,放在木架中央”;琥珀色“场景+风格”芯片旁写着“透过窗户的柔和晨光,湿粘土呈现细腻光泽,工作台保持整洁”;紫色“运镜”芯片旁写着“拉坯的中景,缓慢推近至釉面纹理,切换至正面拍架子”;青色“声音”芯片旁写着“轮盘的低沉嗡鸣、粘土刮擦声、微弱的房间环境音”。

主体优先,因为除非模型知道你指的是哪张脸,否则参考素材毫无用处。每个主体定义一次,附带两到三个稳定特征,然后在任何地方重复使用该标签。

  1. 将 @image1(红裙、草帽)中的女性定义为 Mara。
  2. Mara 在黄昏时分沿着码头行走……

分屏示意图:左侧为参考图片,标注为@image1,显示一位身着红裙、头戴草帽的女性;右侧为视频预览,显示Mara在码头行走

三条规则可防止定义泄露。为每个@引用赋予即时的工作描述,包括模型应忽略的内容:以“@image1 用于陶艺师的面部特征、头发和绿色围裙,而不是图像背景”的风格。使用面部特写作为独立图像,与全身照分开——这是Seedance 2.0时代防止身份漂移的技巧,现在同样有效。另外,处理多角度视图时需谨慎:对于五个或更少的主体,单视图或多视图图像均可;但超过五个后,最好坚持使用单视图,将角度拆分图单独存放,并明确声明(“这四张图像定义同一盏折叠台灯;视频中只出现一盏灯”)。

声音和文本各自有专用包装,以便模型从不混淆对话与字幕:

信息类型包装示例
对话{ }她微笑着说道 {我们一定能做到}
音乐( )(背景播放欢快的摇滚乐)
音效< ><脚步声>
画面字幕【 】【第一章:出发】

每行对话保持同一种语言,并在大括号前指明语言。对于口音控制,有专门的模式:语言、地区变体、表达方式、说话者,然后是对白,例如“对话语言:自然、口语化的美式英语。女孩说:{我以为你不来了。}”

在Seedance 2.5提示词中使用50个参考槽位

五十个槽位分配为:30张图片、10个视频片段、10个音频片段。视频和音频时长单独预算:最多30秒视频参考和另外30秒音频参考,每个片段时长在2至30秒之间。图片最大4K、30MB,视频最大4K、200MB,音频15MB(mp3或wav格式)。纯音频参考也可行:你可以只给模型一个音频轨道和一段文本提示。槽位数量是Seedance 2.0的三倍,参考素材时长翻倍,而最糟糕的做法就是把这些空间填满。

堆叠式水平条形图,标题“Seedance 2.5参考预算:上限vs工作集”。顶部条形图显示50个槽位上限制分为30个蓝色图片槽、10个橙色视频槽、10个绿色音频槽。底部较短的条形图显示推荐的起始组合为4至5个素材:约3张图片、1个视频片段、1个音频片段。脚注列出了手册中的比例上限:主体图片不超过8张,音频或视频主体素材不超过5个,每个片段时长5至10秒。

将音频或视频主体参考控制在5个以内(任务需要时可增至6至10个),主体图片控制在8张以内(最多9至12张)。单个片段的最佳时长为5至10秒:短于约2秒则特征太少难以锁定,而整段30秒的参考则会稀释你想要复制的特征。当素材确实堆积起来时,建议的裁剪顺序是:核心角色优先,其次关键产品或道具,然后是场景,最后是整体风格。

那么额外的空间用来做什么?群戏场景。一个旗舰早期示例是30秒的宫廷派对,由20张编号角色和道具图片加上三个语音样本构建,每位宾客都通过@引用绑定。它的展示列表也是同样的思路:多角色群戏场景、一个32个参考素材的武侠序列、以及将动作迁移到攀爬大猩猩上,都依赖堆叠的全模态参考。

分镜头列表让30秒的Seedance 2.5提示词保持连贯

最值得延续的习惯:停止写情绪文案,开始写编号镜头。“一个男人跑过街道,非常电影化”这句话没有给时间层任何调度内容。而分镜头列表则能做到:

plaintext
1将 @image1 中的女孩定义为 Lin。@image2 设定宿舍场景。参考 @video1 的运镜。
2镜头1:中景跟拍,傍晚。Lin 走到宿舍门口,停顿,深吸一口气,略显紧张。走廊窗户透出暖光。
3镜头2:切换至室内中景。Lin 推开门。室友们从书桌上抬起头。一人问道 {所以?过了吗?}。缓慢的过半身切换,画面在面孔之间切换。
4镜头3:特写 Lin。她低下头,然后突然笑出声,说道 {骗到你们了}。室友们追着她跑。镜头拉远至房间全景。
5纪实风格,暖色调,柔和光线。面部保持稳定。无字幕,无水印。

三栏故事板,显示Lin走近宿舍门、室友抬头、以及Lin笑着特写的画面,带有视频播放器UI叠加层

这个例子很好地展示了模式。每个镜头回答四个相同的问题:

镜头的行写什么示例表述
运镜每个镜头开始一个运动,使用标准术语“缓慢推近”、“固定镜头”、“切换至特写”
动作身体部位加上速度或力度“慢慢举起一只手”、“紧紧抓住肩带”
空间主体现在的位置“在宿舍门口”、“穿过屋顶”
音频该镜头的对话、音效或音乐{对白}、<音效>、(音乐)

两条写作规则能起到很大作用。量化运动(缓慢地、急剧地、稍微地),并指明是哪个肢体在运动。同时将情绪外化,而不是直接贴标签:“低头,肩膀微微颤抖,手指捻着夹克下摆”能赋予画面动感,而“她很悲伤”则不能。Seedance 2.0时代的一条规则有所放宽:之前每个镜头只能有一个运镜动作,而Seedance 2.5可以处理组合运镜(在一个运动员入场的长镜头中同时进行跟拍、升降和旋转),并且稳定执行。从简单开始,当镜头值得时再组合。

时间安排是Seedance 2.5与其前身的不同之处。精确到秒的提示……在Seedance 2.0中曾导致生成不稳定。这个限制已经消失:Seedance 2.5提示词全程使用时间码:一个武侠序列写为[0-3秒]、[3-5秒]、[5-10秒]段落,一个月球形成讲解视频逐秒对照旁白进行脚本化。镜头顺序仍然承载故事;秒数范围现在让你能精确定位某个节拍在30秒内的位置。以下是那个武侠提示词如何分配时间:

水平时间线,标题“Seedance 2.5展示提示词如何为其镜头添加时间码”。一条30秒的条被分割成蓝色块:0-3秒为古琴上双手的特写,画面左侧有香炉烟雾;3-5秒为白衣男子起身,一名红衣女子进攻;5-10秒为湖上决斗,波纹呈环形扩散;10-20秒为追逐至竹林,穿过水面。最后20-30秒块为灰色虚线,标记为在源文档中不可见。

Seedance 2.5编辑提示词:只改一处,其他不变

编辑是措辞最不宽容的地方,因为一个动词就决定了任务类型。规则明确:只有当你希望借用特征到新视频中时,才写“reference @video1”。当你想要修改片段本身时,直接命名视频(“@video1”、“严格编辑 @video1”),否则模型可能将任务误读为参考任务并重新生成整个场景。

好的编辑提示词压缩为三个动作:用@video1指向源素材,明确限定修改范围(如果替换主体,则添加参考图像),最后以一句锁定词结尾,如“其他一切保持不变”,这样模型就不会重新绘制你未提及的内容。这里有两个参数不由你控制:编辑后的片段会保留源素材的宽高比和大致时长。扩展也会继承宽高比,但增加的时长由你通过提示词设置(“向前扩展6秒”)。

操作句型是否保持其他部分稳定?
添加描述新元素、出现时间、出现位置是,默认情况下未提及部分保持不变
替换“严格编辑 @video1,将 [旧特征] 改为 [新特征]”是,但需明确说明关键保留元素
删除命名要删除的元素,然后命名必须保留的元素强化保留的元素能显著帮助
扩展“将 @video1 向后/向前扩展:[接下来发生什么]”必须将风格、主体、故事声明为不变
重新配乐“保持 @video1 的画面和运镜不变,将背景音乐替换为 @audio1”音频编辑完全不改动画面
桥接“@video1,[过渡描述],然后 @video2”Seedance 2.0 限制视频输入为3个片段、总时长15秒;Seedance 2.5 上限提升至10个片段、30秒

支持时间戳定位和参考引导的编辑(“替换 @video1 中 0:02 到 0:05 的场景,保持动作和节奏”);此外还支持绿幕替换和摄像机视角变换。展示案例比大多数人会用到的更进一步:对已完成场景重新打光(“将 @video1 的光线从正午强顶光改为日落侧光”)、让女演员在一个不间断镜头中从20岁变老到60岁、将片段循环切换为漫画、动漫和水墨风格、以及批量替换三种SKU颜色的饮料瓶——所有这些都归入编辑,无需完全重新生成。

在Seedance 2.5行为稳定之前,有两个Seedance 2.0时代的修复技巧仍然值得了解。如果扩展后的片段在接缝处出现跳跃,从第一段末尾剪掉六帧,再从第二段开头剪掉一帧,然后拼接。如果多次扩展导致画质下降,一种解决方法是先将源素材转换为白色3D模型渲染,然后从该干净基础开始扩展。

Seedance 2.5在各行业的能力

一个清晰的用例图已经浮现:五个行业对应四项核心能力,每个单元格都有已完成的提示词和最终片段支持。概览如下:

领域标志性任务
电影一个30秒长镜头讲述完整故事节奏、基于堆叠演员素材的群戏场景、威亚故障移除、一个主剪辑跨语言重新配音
广告、电商一次性电视广告故事讲述、产品外观锁定品牌资产、价格标签重写、面向出口市场的主持人替换
教育一个概念在30秒内解释清楚、原理可视化、系列中保持一致的主持人角色、多语言交付
工业装配流程演示、3D白模产品预览、跨产品线铭牌替换、多语言安全培训
娱乐IP游戏风格预告片、虚拟偶像演出、节日皮肤视频、多语言虚拟主播

首先是最安静的一个:一个30秒无对话故事,仅用一段文字描述,没有镜头编号,完全依靠场景描述和环境音:

plaintext
1一段30秒的无言视觉故事,展现法国乡村的静谧优雅,发生在普罗旺斯夏日下午。一位年轻女子身穿米白色亚麻连衣裙,在一间石砌小屋内的旧木桌上写完一封手写信,走出门,沿着一条穿过向日葵田的碎石小路,最后将信投入村庄边缘一个复古黄色邮箱中。镜头以浅景深特写开篇,聚焦书桌;穿过门口时,光线变为阴影;然后上升并拉远,展现金色山谷的广角镜头。仅环境音:蝉鸣、风声、笔尖划过纸面的沙沙声、邮箱关闭时轻柔的咔哒声。

三栏故事板,显示女子在石砌小屋中写信、穿过向日葵田、以及将信放入黄色邮箱的画面,带有视频播放器UI叠加层

当一段内容依赖单一连续情绪时,编号镜头的框架可以去掉。两种模式都有效。

广告图库展示了“一个主版本”流程的两个阶段。主版本是一个12秒的代言人广告,脚本按秒设定对话节拍。每个本地化版本只需单行编辑提示词:

plaintext
1将主持人替换为一位美国女性,用英语重新配音文案。
2将主持人替换为一位西班牙男性,用西班牙语重新配音文案。
3将主持人替换为一位印尼女性,用印尼语重新配音文案。

三栏对比,显示同一广告本地化为英语美国女性、西班牙男性和印尼女性,带有语言徽章EN、ES、ID,构图完全相同

教育行将本指南分别介绍的两项技术合并:一个30秒的博物馆纪录片,一位导游走过四个展厅,分别讲英语、普通话、马来语和日语,每个段落固定在7.5秒窗口内。而工业FPV无人机提示词则将公式部分的约束结尾升级,超越了样板文字:它们以运动和场景约束结尾,如“无屏幕文字或标记,不要向后飞行,天气和光照保持不变。”

常见问题

Seedance 2.5现在可以通过API使用吗?

发布时还不能。7月31日的发布覆盖字节跳动自己的应用,首先是即梦AI和豆包专业版。API访问和Ark playground预计于2026年8月7日全面开放,有两个访问细节值得注意:没有免费额度,激活需要账户余额超过200元人民币或拥有一个活跃的Seedance 2.0资源包。在此期间,Seedance 2.0系列仍可通过API完整使用。

Seedance 2.0的提示词在Seedance 2.5上还能用吗?

结构可以迁移:主体定义、@引用、编号镜头、对话和声音包装、以及参考/编辑/扩展任务拆分,所有这些都原封不动地延续到Seedance 2.5。你应该重新测试的是旧的变通方法,因为Seedance 2.0的几个痛点(单次输出短、编辑控制粗糙、时间提示不稳定)正是Seedance 2.5声称要修复的。

一个Seedance 2.5提示词可以包含多少个参考文件?

每项任务最多50个:30张图片、10个视频片段、10个音频片段。视频参考总时长最多30秒,音频也是30秒,每个片段时长在2至30秒之间。完整的预算用于群戏和大量参考的场景;日常任务的比例上限请参考上文的参考槽位部分。

Seedance 2.5能否生成英语或中文以外的其他语言的对话?

可以。原生支持的语言包括中文、英语、西班牙语、印尼语、马来语、泰语、阿拉伯语、葡萄牙语、越南语、日语和韩语等,并支持“一个主版本,多语言分发”的流程:其预告片演示用一行编辑提示词将同一剪辑重新配音为日语和法语。在每行对话前标注语言;公式部分中的口音模式同样适用。

一个Seedance 2.5视频可以运行多长时间?

单次输出30秒,可在其基础上进行多轮扩展以获得更长的剪辑。不要将其与参考片段的30秒上限混淆;后者是输入预算,而非输出。

结论

提示词语言是稳定的部分。主体定义一次并用@引用,镜头按顺序编号,对话用大括号,约束放在结尾:这套语法在二月份写出了15秒的片段,现在写出了30秒的片段。变化的是围绕它的上限。今天在Seedance 2.0端点上练习语法,保持参考集小而命名明确,一旦Seedance 2.5通过API开放,移植你的提示词应该是简单的一步。

最新模型

一个 API,畅享全模态 AI。

探索全部模型