一位导演在停车场拍摄了一场排练,随后决定这个场景应该发生在一艘宇宙飞船上。一年前,这意味着重拍,或者给合成师一周时间。现在,这意味着一句话和一段源素材。
这正是 Luma Modify Video 背后的卖点,它是 Luma AI 的 Ray 模型系列中的视频转视频模式。你提供已有的素材,描述新的外观,它就会重新渲染这段视频,同时保留你拍摄的运动、构图和表演。自 2025 年 6 月以来,这项功能已多次更改名称、模型和定价,因此本指南锁定当前状态:由哪个模型运行它、九个强度预设各自的作用、在 Luma 自家 API 上一段视频的花费,以及如何在 Atlas Cloud 上运行同样的 Ray 3.2 模型,并与另外七个视频编辑器并列使用。

要点速览
- Luma Modify Video 是 Luma Ray 3.2 模型的视频转视频模式。消费级应用现在将其标记为“Video To Video”,而 API 将其称为 video_edit 请求。
- 三个区间共九个强度预设决定源素材保留多少:adhere 保留运动与结构,flex 平衡,reimagine 让提示词主导。
- 输出保持源视频的宽高比,以 540p、720p 或 1080p 运行,长度为 5 秒或 10 秒。Atlas Cloud 端点返回的是无声视频。
- Luma 自家 API 将源视频限制在 18 秒和 200 MB 以内,而 Ray 3.2 允许你沿视频固定最多 64 张引导图像。
- 你可以在 Atlas Cloud 的视频生成器上运行同样的 Ray 3.2 视频转视频模型,一个 API 密钥同时覆盖 Seedance、Kling 和 Wan。
什么是 Luma Modify Video?
Luma 于 2025 年 6 月 2 日发布了 Modify Video,作为其 Dream Machine 应用中的一项功能。发布文章将该功能的目标描述为让你“保留重要的部分,演化其他一切”:把停车场变成宇宙飞船,把白天变成夜晚,或让演员在场景中变老,而无需绿幕或手动跟踪。在底层,模型从源素材中读取表演信号,Luma 指出姿态、面部表情和场景结构,然后用它们决定保留什么、重塑什么。
自首次发布以来,有三件事发生了变化:
- 名称一分为二。 Luma 的产品页面现在将消费级功能称为“Video To Video”,而 API 文档和更新日志仍沿用 Modify Video。它们指向同一项能力。
- 模型变了。 2025 年的版本运行在 Ray 2 和 Ray Flash 2 上。Luma 当前的 API 文档将 Ray 3.2 列为每个 video_edit 请求背后的模型。
- Ray3 Modify 于 2025 年 12 月 18 日到来。 该更新首次为视频转视频工作流带来了起始帧和结束帧控制,以及角色参考控制。
Luma 在 2025 年 6 月发布时同步公布了自己的盲测评估。外部评估者在不知道哪段是哪段的情况下,将 Modify Video 的输出与 Runway 的视频转视频模式进行比较,Luma 报告称其模型在六项标准中的大多数上更受青睐。下面的图表是 Luma 自己的;坐标轴没有数值标签,因此请将其视为偏好方向,而非实测差距。

来源: Luma AI,Introducing Modify Video ,2025 年 6 月
Adhere、Flex 还是 Reimagine:该用哪种 Luma Modify Video 模式
每个 Modify Video 请求都带有一个强度预设,而预设对结果可辨识度的影响比提示词更大。Luma 将九个值分为三个区间。发布文章用通俗语言定义了这些区间,而 Ray 3.2 的 API 文档保留了相同的九个线上值。
| 区间 | 线上值 | Luma 的定义(2025 年 6 月发布文章) | Ray 3.2 文档,2026 年 9 月 | 适用时机 |
|---|---|---|---|---|
| Adhere | adhere_1, adhere_2, adhere_3 | “紧密遵循原始视频的外观和结构,主要优先进行纹理重绘。” | adhere_1“紧密保留源素材的运动、构图和结构”;adhere_3 是该区间最强值 | 改变衬衫颜色、天空或表面材质,而镜头仍是原镜头 |
| Flex | flex_1, flex_2, flex_3 | “在模型创造力与输入保真度之间取得平衡。” | flex_1“保留运动,让提示词重塑风格和内容”;flex_2 是“大多数编辑的常见默认值” | 将实拍转化为动画风格,或在保留走位的同时更换场景 |
| Reimagine | reimagine_1, reimagine_2, reimagine_3 | “优先考虑创作自由。启用全场景重新诠释,包括将人类映射为非人形形态”,如怪物或生物 | reimagine_1:“提示词驱动大部分输出;源素材提供宽松基础”;reimagine_3 是最强值 | 让演员变成生物,或只从原始素材保留相机路径 |
在每个区间内,数字是一个调节旋钮。Luma 的文档指出,数字越低越轻,数字越高越强,因此 adhere_3 仍属于 adhere 编辑,但比 adhere_1 推进得更远。Luma 的 API 和 Atlas Cloud 上的默认值都是 flex_2。
一个实际后果是:同一提示词在 adhere_2 和 reimagine_2 下会产生两段不同的视频,而两者都没有错。如果客户想认出地点,就从 adhere 开始。如果地点正是要被替换的对象,就从 flex 开始,只有当 flex 保留了过多源素材时再转向 reimagine。
Atlas Cloud:与另外 7 个编辑模型一起运行 Luma Ray 3.2 视频转视频
Atlas Cloud 托管当前的 Ray 3.2 视频转视频端点,路径为 luma/ray-3.2/video-to-video,具有相同的九个强度预设、540p、720p 和 1080p 档位,以及 Luma 在其自家 API 上定价的 5 秒或 10 秒输出长度。它与 Video Edit 标签页处于同一账户中,其中 Seedance 2.5、Seedance 2.0、Gemini Omni Flash、HappyHorse-1.0、Wan 2.7、Kling Video O3 Pro 和一个 xAI 模型负责基于指令的编辑。因此,如果某个模型对一段视频的处理不是你想要的,同一源素材和同一指令可以发往另一个模型,而无需离开账户,并且每次运行都从同一余额中扣费。
这里是该模型在其默认设置 flex_2 下的实际效果。左侧是源视频,右侧是要求生成雨夜东京街道的一条指令的输出:女性、她的步伐和相机运动都延续下来,储物柜则没有。
强度预设是结果分叉之处。一段 5 秒的视频,内容是一位女性走过一排白色储物柜,用同一提示词通过模型运行了三次,要求生成雨夜东京街道,同时保留人物、她的步伐、构图和相机路径。只有强度发生了变化。

这些帧来自同一时刻,即第 2.5 秒。在 adhere_2 下,女性的脸、头发和步伐保留下来,储物柜变成雨水冲刷的店面,带有手绘边缘渲染。在 flex_2 下,构图和步伐保持不变,而模型重铸了人物,并将墙壁换成潮湿的砖墙,视频结尾处有霓虹灯牌。这种重铸并不固定:这段视频上的三次 flex_2 运行有两次改变了人物,一次保留了她,上面的视频是保留她的那次运行,因此当脸部很重要时,请计划进行第二轮。在 reimagine_2 下,相机本身也移动了:镜头变成宽广的街景,顶部有招牌,人物穿过画面。三者都以 1280 x 720 和 5 秒返回,无声,每次运行大约三分钟。
第二轮不必再运行一次 Luma。同一段储物柜视频和同一句话也发给了 Seedance 2.5,它是 Video Edit 标签页中的模型之一,两个模型对指令的解读不同。Luma 的 flex_2 运行保留了步伐和构图,置于一条黑暗、被雨水浸透的小巷中,墙上有海报。Seedance 保留了女性的脸、她的长发和源素材中的棕色皮夹克,并构建了一条更明亮的霓虹大道,湿漉漉的路面上有倒影。两者都以 1280 x 720 返回且无声,因此任一结果都可以放入同一个编辑中。
方法一:从模型试验场重塑视频风格
- 登录并打开 Luma Ray 3.2 视频转视频试验场。Prompt 字段已预加载一条示例指令和一段示例视频;清空两者。
- 上传你的源视频,或使用 Add URL 粘贴一个公开 MP4 链接。Video 字段每次运行接受一段视频。
- 将指令写为一句关于新外观的话,再加一句关于必须保留什么的话。明确命名运动和相机,可为模型提供可抓住的依据。
- 选择一个 Strength 预设。第一轮保持 flex_2,然后根据返回结果上下调整一个区间。
- 将 Duration 设置为与视频匹配的 5 秒或 10 秒,选择 540p、720p 或 1080p,然后按 Run。完成的视频会出现在 Output 面板中,并带有 Download 按钮,过去的运行记录保存在 Request History 下。

方法二:三步获取 API 访问
步骤 1:获取你的 API 密钥。 在 Atlas Cloud 控制台中创建一个并复制它。

步骤 2:查看 API 文档。 参数、接受的格式和时长限制都在 API 文档中。
步骤 3:发出你的第一个请求。 提交视频和指令:
plaintext1curl -X POST https://api.atlascloud.ai/api/v1/model/generateVideo \ 2 -H "Content-Type: application/json" \ 3 -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \ 4 -d '{ 5 "model": "luma/ray-3.2/video-to-video", 6 "video": "<public_https_url_to_your_clip.mp4>", 7 "prompt": "Turn the scene into a rainy night street in Tokyo with neon reflections on wet pavement. Keep the person, their motion and the camera path unchanged.", 8 "strength": "flex_2", 9 "duration": 5, 10 "resolution": "720p" 11 }'
轮询作业直到完成:
plaintext1curl https://api.atlascloud.ai/api/v1/model/prediction/<prediction_id> \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY"
video 字段需要一个可公开访问的 HTTPS MP4 链接,完成的文件会在 URL 返回前传输到 Atlas Cloud 存储,因此你收到的链接是 Atlas Cloud 地址,而不是 Luma 的一小时预签名 URL。同一端点、同一请求头和同一轮询循环驱动 Atlas Cloud 上的视频模型。将模型字符串换成 bytedance/seedance-2.5/reference-to-video 或 Kling O3,集成中的其他内容都无需改动。
Luma Modify Video 定价:Luma 与 Atlas Cloud 上每段视频费率
Luma 在其 API 上按视频为视频转视频定价,5 秒和 10 秒输出有不同费率,并且视频编辑档位的定价与文生视频不同。以下是 2026 年 9 月 Luma 的 API 定价页面上的数字,适用于标准动态范围的 Ray 3.2:
| Luma API,Ray 3.2 视频转视频 | 540p | 720p | 1080p |
|---|---|---|---|
| 5 秒输出 | $0.72 | $1.44 | $2.16 |
| 10 秒输出 | $1.08 | $2.16 | $4.32 |
根据同一页面,HDR 输出使基础费率翻倍,而带 EXR 导出的 HDR 则使其增至三倍。在 Ray 2 代际下,Luma 改为按百万像素为 Modify Video 计费,其中 720p 5 秒示例报价为 $1.75,因此转为按视频定价是 Ray 3.2 变更的一部分,而非同等的更新。
Atlas Cloud 也按每次运行为托管的 luma/ray-3.2/video-to-video 端点定价,价格随分辨率档位和输出长度变化。费率于 2026 年 9 月 28 日在该模型的定价计算器上查询,未激活任何折扣:
| Atlas Cloud,Luma Ray 3.2 视频转视频 | 540p | 720p | 1080p |
|---|---|---|---|
| 5 秒输出 | $0.792 | $1.188 | $2.376 |
| 10 秒输出 | $1.584 | $2.376 | $4.752 |
在 720p 和 5 秒下开启 HDR 会使该次运行达到 $2.376。Atlas Cloud 上的价格在你提交前会显示在 Run 按钮上,因此你在试验场中看到的数字就是你要支付的数字。
时长、分辨率和源视频限制
Luma 针对 Ray 3.2 API 的营销文案称视频转视频“最长可达 20 秒”。开发者文档更为严格,而这才应是你的规划依据:
| Luma video_edit 规则 | 文档化限制 |
|---|---|
| 通过 URL 或内联上传的源视频 | 最大 200 MB 且 18 秒 |
| 来自先前 Luma 生成的源素材 | 无上传大小限制 |
| 输出分辨率 | 360p 草稿档位、540p、720p 或 1080p;默认 720p |
| HDR | 仅 720p 或 1080p;EXR 导出需要 HDR |
| 宽高比 | 继承自源素材;你发送的任何 aspect_ratio 都会被静默忽略 |
| 引导图像 | 最多 64 个关键帧,带匹配的帧索引,或一个起始帧 |
| 提示词 | 1 到 6,000 个字符 |
| 结果链接 | 一小时过期的预签名 MP4 URL |
在 Atlas Cloud 上,Ray 3.2 端点接受公开 HTTPS MP4 作为源素材,以 540p、720p 或 1080p 输出 5 秒或 10 秒,并暴露强度预设以及一个在 5 秒长度下可用于 720p 和 1080p 的 HDR 开关。输出到达时是无声视频,因此请计划在风格重塑后的画面完成后,在编辑器中重新加入原始音频。
音频是 Luma 自家公告跳过的细节。2025 年 6 月的发布文章和 Ray3 Modify 更新都没有说明消费级应用是否保留源音轨,因此如果声音对你的交付很重要,请在确定工作流前测试一段视频。
Luma Modify Video API:关键帧、控制项以及相较 Ray 2 的变化
在 2025 年中期集成 Modify Video 的开发者,针对的是不同的接口编写代码。原始端点接受 media、model 和 mode,模型选项为 ray-2 和 ray-flash-2,并有一个可选的起始帧图像来引导外观。Ray 3.2 重建了该接口。

对于任何重建集成的人来说,三项新增最为重要:
- 关键帧取代了单一起始帧。 一个 video_edit 请求最多可携带 64 张引导图像,每张固定到源素材中的一个帧索引。Luma 的文档称关键帧是复杂编辑中“对输出质量影响最大的单一杠杆”。单图像简写仍作为 start_frame 存在。
- 逐信号控制位于强度预设之下。 你可以分别启用姿态、深度、法线、轨迹和面部条件,而不是一个旋钮,每项都有自己的调节值。这不能与自动模式结合使用,自动模式会从源素材推导调度。
- 重新取景分离为独立请求。 更改宽高比现在是 video_reframe,按秒计费,并且在 Atlas Cloud 上也以 luma/ray-3.2/reframe 托管。
有一件事保持不变:九个强度值。已经将 flex_2 作为 mode 字符串传递的代码只需重命名字段。另一项从 Luma 的 API 条款延续下来的内容是:Luma 声明不会使用 API 输入或输出来“训练、微调或以其他方式开发”其模型,这一承诺写入了 Luma 的 API 使用条款。API 定价页面也将“无训练保证”列为其企业级功能之一。
如果想了解另一家供应商如何围绕单一端点和固定每秒费率组织同样的工作,我们的 Runway Aleph 指南详细介绍了 Aleph 2.0 的积分和视频上限。
与强度设置相匹配的 Luma Modify Video 提示词技巧
为 reimagine 写的提示词在 adhere 中会令人失望,反之亦然。强度预设决定模型可以对你的句子施加多少作用,因此请针对你选择的区间来写。
在 adhere 中,描述表面和光线,而不是场景。“让混凝土墙变成风化的红砖,并将光线转为傍晚”给模型的是纹理重绘工作,而这正是 Luma 所说 adhere 优先处理的内容。要求 adhere 把演员移到海滩,会得到一个海滩色的停车场。
在 flex 中,命名新场景,然后同时锁定表演。Luma 的 Ray 3.2 文档将 flex 描述为保留运动,同时让提示词“重塑风格和内容”,因此句子的后半部分才是保持步态循环和相机路径完整的关键。
在 reimagine 中,提示词承担大部分重量,源素材提供 Luma 所说的“宽松基础”。把它当作一个恰好继承相机运动的文生视频提示词。描述主体变成什么,让源素材处理相机。
另外两个习惯在三个区间中都适用。每个请求只做一次编辑,因为一段在一个句子中改变地点、服装和时间的视频会给模型三个相互竞争的目标。并且将数字一次移动一格,然后查看,因为区间内的旋钮移动幅度比名称暗示的更大。在储物柜视频上,flex_1 保留了女性的脸和实拍外观,置于贴满海报的墙前。flex_3,同一提示词和同一源素材,保留了构图和步伐,但将人物重绘为手绘风格中的另一个角色。
Luma Modify Video 是免费的吗?
Luma 的定价页面列出了三个个人计划:Plus 每月 $30、Pro 每月 $90、Ultra 每月 $300,按月计费,按年计费最高可享 20% 折扣。2026 年 9 月页面上没有出现免费计划。每个计划都附带一定积分额度,页面的成本表将 Ray 3.2 视频转视频定为 540p 每秒 48 积分、720p 每秒 72 积分、1080p 每秒 144 积分,HDR 使该数字翻倍。

截图来自 Luma 官方定价页面,2026 年 9 月
算一下,在应用内一段 5 秒 720p 风格重塑花费 360 积分,因此 Plus 计划的 10,000 积分在生成其他任何内容之前,大致可覆盖每月 27 段此类视频。Luma 的 API 与订阅分开,按视频以上述定价部分中的费率计费。
Atlas Cloud 对同一模型采用按次付费的方式。没有需要持有的月度计划,同一余额还覆盖 Video Edit 标签页中的其他视频编辑器,因此一次 Luma 风格重塑和一次 Seedance 清理都从同一账户扣费。
常见问题
Luma Modify Video 和 Luma Video to Video 是一样的吗?
是的。Luma 的消费级产品页面现在带有“Video To Video”标题,而 API 文档和最初的公告使用 Modify Video。两者都描述一个 Ray 模型根据文本指令重新渲染现有视频,同时保留其运动。API 仅接受 Ray 3.2,而应用的成本表将 Ray 3.2 列为顶级视频转视频引擎,其下还有一个 Ray 3.14 档位。
Ray 2 Modify 发生了什么?
Luma 较旧的 Modify Video 文档仍列出 ray-2 和 ray-flash-2,并分别有 10 秒和 15 秒上限,但 API 定价页面在视频转视频中仅报价 Ray 3.2,因此请将 Ray 2 的数字视为历史信息。如果你有在 Ray 2 下生成并想重新编辑的视频,完成的 Luma 生成可通过其生成 ID 作为源素材传入,且该路径没有上传大小限制。
Luma Modify Video 会保留音频吗?
在 Atlas Cloud 上,Ray 3.2 视频转视频端点返回无声视频,因此你在风格重塑后于编辑器中重新附加原始音轨。Luma 自家的发布文章和 Ray3 Modify 公告都没有说明消费级应用的音频处理方式,因此一段短视频测试是最安全的了解 Dream Machine 版本如何处理声音的方法。
在 Atlas Cloud 上一段 Luma Modify Video 视频要多少钱?
在未激活折扣的情况下,720p 的 5 秒运行花费 $1.188,10 秒版本翻倍。540p 和 1080p 档位以及 HDR 附加费在上面的定价表中。由于试验场会在你提交前将数字显示在 Run 按钮上,视频长度与时长设置之间的不匹配会在产生任何费用之前就显露出来。
结语
Modify Video 最初是 Dream Machine 内一个带三个预设的风格重塑工具,如今已发展为一个完整的视频编辑请求,具有九个强度级别、逐信号控制以及最多 64 张引导关键帧。按钮上的名称变了,底层模型变了两次,计费也从像素转向视频。没有改变的是 2025 年 6 月发布时的核心承诺:你拍摄的运动和表演得以保留,而它们周围的世界可以重新协商。
如果你想在不订阅的情况下尝试它,同样的 Ray 3.2 模型在 Atlas Cloud 的试验场和 API 上运行,具有相同的预设和分辨率档位,按次定价,并且与 Seedance、Kling 和 Wan 仅一键之隔,可用于 Luma Modify Video 并非为之打造的编辑任务。






