Seedance 2.0 Mini & Fast API 全球最低价 —— 比官方定价最高低 68%

当每次生成都在八秒时停止,如何让 Veo 3 生成超过 8 秒

将 Veo 3 延长到超过 8 秒需要执行一次扩展处理。如何在 Flow、Gemini API 或 Atlas Cloud 中延长 Veo 3 视频,并保留原始音频。

她从手上抬起下巴,举起胶片相机,说光只能再持续几分钟。然后片段结束了,因为 Veo 在八秒处停止。让 Veo 3 超过 8 秒 是可能的,只是永远不能在一次渲染中完成。多出来的时间必须来自扩展生成或剪辑。

Google 现在在多个地方提供 Veo 扩展,每一种都带有一个很容易被忽略的条件,除非你阅读文档。下面我们会逐一介绍 Flow、Gemini API 和 Google Cloud。然后我们拿一个下载好的 Veo 3.1 片段,在 Atlas Cloud 上扩展它,并测量接缝处声音发生了什么变化。

来自一段 14 秒视频的三帧竖幅画面:一位红发女子身穿黑色露背裙,在黄金时刻的逆光中倚靠石栏杆:0:05 时她举起一台复古胶片相机说话,0:08 是 Veo 3.1 Fast 源素材的最后一帧,她低头看着相机,0:12 是扩展后的一帧,她把相机举到脸旁,对着镜头微笑;上方是一条时间线,分为 0 到 8 秒的 Veo 和 8 到 14 秒的 Grok Imagine 扩展

关键要点

  • 每一次 Veo 3 和 Veo 3.1 生成仍然在 8 秒结束,所以想更长总是意味着一次扩展生成或一次剪辑。
  • Google 自己的扩展只适用于 Veo 制作的片段:Flow 在 Veo 3.1 Lite 上运行它,而 Gemini API 每次为过去两天内生成的片段增加 7 秒。
  • Gemini API 的 Veo 3.1 预览模型将于 2026 年 10 月 22 日关闭,Gemini Omni 被指定为替代品。
  • 一个你已经下载的 Veo 文件可以进入 Atlas Cloud 的 Video Extend 标签页,它会原样返回最初的 8 秒及其音频,随后是新的画面。
  • 把下一句对白用引号写入扩展提示词,并让 Veo 的台词在片段最后一秒之前结束。

为什么每个 Veo 3 片段都在 8 秒处停止

Google 的开发者文档直白地说明了上限:“Veo 3.1 是一个用于生成 8 秒视频(720p、1080p 或 4k)并带有原生生成音频的模型。”你可以要求 4、6 或 8 秒。菜单上没有更长的选项,而且某些设置还会去掉更短的选项。

模型最长单段片段什么会强制使用 8 秒设置
Veo 3.18 秒(4、6 或 8)1080p、4K、参考图像或扩展
Veo 3.1 Fast8 秒(4、6 或 8)与 Veo 3.1 相同
Veo 3.1 Lite8 秒(4、6 或 8)1080p 或参考图像
Gemini Omni Flash(Google 较新的模型,用于对比)10 秒不适用

这种困惑通常始于 Google 自己的营销。当 Flow 为 Extend 添加音频时,公告说你可以创建“持续一分钟或更久”的视频。这个数字描述的是一连串扩展缝合到一个片段上的结果。自 2025 年 6 月以来,Google AI 开发者论坛里的人们一直在问如何突破 8 秒限制,而 2025 年 10 月的一个帖子显示,一位用户期待 Veo 3.1 本身就能渲染 60 秒。

所以真正的问题变成:哪条扩展路径适合你手头的片段。最古老的那条就在 Flow 里面。

如何在 Google Flow 中扩展 Veo 3 视频

Flow 的 Extend 按钮在用户眼皮底下已经变了。2025 年 6 月,Google 的 Flow 技巧帖说 Jump To 和 Extend“只适用于 Veo 2”,那个夏天的教程描述的就是那个版本。然后在 2025 年 10 月 15 日,Google 宣布 正在“为‘Ingredients to Video’、‘Frames to Video’和‘Extend’等现有功能带来音频。”

今天有一个不同的陷阱。Flow 的 模型功能页面 将 Extend 列为在 Veo 3.1 Fast 和 Quality 上不受支持,并在 Lite 下添加了这条提示:

Google Flow 帮助页面摘录,在 Veo 3.1 Lite 下列出扩展视频,支持两种宽高比,仅限 8 秒视频,仅限 Veo 3.1 Lite、Fast 和 Quality 视频,还有一条提示说所有 Veo 3.1 8 秒视频都可以扩展,但必须使用 Veo 3.1 Lite 来扩展它们

截图来自 Google Flow 帮助,“了解 Google Flow 模型及支持的功能”,2026 年 9 月。

以下按照 Flow 的编辑帮助页面来运行它:

  1. 打开项目,点击你想要继续的片段。它必须是一个 8 秒的 Veo 3.1 片段。
  2. 在底部点击 Extend。
  3. 在提示框中描述动作应如何继续,然后点击 Generate。

每个新片段都由前一个片段的最后一秒构建。Google 的公告说,这使 Extend“最适合创建更长的定场镜头”。同一帮助页面还给出另外两个限制:Flow“目前只能扩展 Veo 生成的视频”,并且扩展后的片段不能使用其他编辑模式,例如插入、移除或镜头变化。

TikTok 上的一些 Flow 教程跳过 Extend,改为手动串联片段。它们取一个片段的最终帧,并将其用作新的 Frames to Video 生成的第一帧,Flow 的功能页面为全部三个 Veo 3.1 模型列出了这种模式。它适用于不是 8 秒长的片段,但那条链中的每一环都是单独渲染,并带有自己新生成的声音,所以把每个接合处都当作剪辑来处理。

这就留下了一个缺口。如果你的片段来自 Veo 3.1 Quality,Flow 仍然把续接交给 Lite。而如果你已经导出了 MP4、裁剪过它,或者是在 Flow 以外的地方制作的,你就需要一个能接受上传的工具。

在 Atlas Cloud 上扩展下载好的 Veo 3 片段

Atlas Cloud 直接接收文件本身。其 视频生成器 中的 Video Extend 标签页接受长度在 2 到 15 秒之间的 MP4,无论它由哪个模型制作,所以 8 秒的 Veo 导出文件放进去绰绰有余。

我们把一张肖像照,在 Atlas Cloud 上变成了一个带对白的 8 秒竖幅片段,然后用 Grok Imagine 将它扩展了 6 秒。打开声音:

缩略图拼版,包含 14 帧竖幅画面,分别来自返回文件的每一秒,显示红发女子从手上抬起下巴并举起胶片相机,在 Veo 3.1 Fast 素材的前 8 秒里说话,然后在 8.0 秒处的接缝标记之后,低头看着相机,把它举到脸旁,对着镜头微笑

返回的文件为 14 秒、720 × 1280、24 fps,与源素材相同的竖幅画幅。它的前 8 秒是源片段。与源素材逐帧比较,除了重新编码带来的噪点外没有其他变化,音轨也逐秒与原始文件匹配。新的 6 秒包含了我们写入提示词的那句台词:“Got it. One more before the sun goes.”,在 9 到 12 秒之间说出,当时她把相机举起,对着镜头微笑。

Grok Imagine 是 Atlas Cloud 上 xAI 模型家族 的一部分,也是该标签页的默认模型。它从你上传内容的最后一帧继续,每次可添加 2 到 10 秒,最高 720p。同一个下拉菜单还列出了 PixVerse v6、Wan 2.5 和 LTX 2.3。

方法 1:在 Video Extend 标签页中运行扩展

登录,打开 Video Extend 标签页,并保持选中 Grok Imagine。

  1. 上传 Veo MP4。 将它拖入 Video to extend 槽位。如果 Flow 在导出文件角上盖了文字水印,我们的 Veo 水印指南 介绍了如何去除。
  2. 写下接下来会发生什么。 以新动作开头,把下一句对白放在引号里,然后重述人物、服装、场景和光线。最后写上你想继续听到的声音。
  3. 设置时长。 DURATION 滑块从 2 到 10 秒,Run 按钮会显示该次运行的价格。
  4. 运行它。 结果是一个文件:你的 Veo 片段后面接着扩展部分。

这是上面演示背后的提示词:

plaintext
1She raises the vintage film camera to her eye, takes a photo of the garden and presses the shutter, then lowers the camera, smiles into the lens and says: "Got it. One more before the sun goes." Same woman, same long copper-red hair, same crystal earrings, same black backless dress, same stone balustrade and cypress trees, same warm golden-hour backlight and camera angle. Birdsong and the breeze continue, with the soft click of the shutter.

Atlas Cloud 视频生成器,选中 Video Extend 标签页,模型为 Grok Imagine,参考槽中加载了一个红发女子拿着胶片相机的 Veo 片段,续写提示词中包含带引号的台词 Got it,时长滑块设为 6 秒,Run 按钮显示运行价格

该模型还有自己的 Grok Imagine 扩展页面,具有相同的输入项和一个 API 标签页。

方法 2:通过 API 将 Veo 片段发送到 Extend 端点

如果你要扩展一批 Veo 渲染结果,或者把它接入剪辑流程,API 接受同样的三个输入。

第 1 步:创建 API 密钥。 在 Atlas Cloud 控制台 中创建一个并复制它。将它保存在服务端。一个密钥即可覆盖平台上的所有模型。

Atlas Cloud 控制台设置页面,API Keys 面板已打开,有一个 Create API Key 按钮,以及一个以遮蔽形式显示的现有密钥

第 2 步:检查请求结构。 Atlas Cloud API 文档 涵盖了身份验证和轮询。extend 模型需要 video_url(指向 2 到 15 秒 MP4 的公开链接)、prompt 和 duration(添加 2 到 10 秒)。你笔记本电脑上的 Veo 导出文件需要先上传到存储桶或 CDN,以便模型能够获取它。

第 3 步:发送请求并轮询。

plaintext
1curl -X POST https://api.atlascloud.ai/api/v1/model/generateVideo \
2  -H "Content-Type: application/json" \
3  -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \
4  -d '{
5    "model": "xai/grok-imagine-video/extend-video",
6    "video_url": "<public_https_url_to_your_veo_clip.mp4>",
7    "prompt": "She raises the vintage film camera to her eye, takes a photo of the garden and presses the shutter, then lowers the camera, smiles into the lens and says: "Got it. One more before the sun goes." Same woman, same long copper-red hair, same crystal earrings, same black backless dress, same stone balustrade and cypress trees, same warm golden-hour backlight and camera angle. Birdsong and the breeze continue, with the soft click of the shutter.",
8    "duration": 6
9  }'

响应会返回一个 prediction ID。轮询它,直到状态显示 completed:

plaintext
1curl https://api.atlascloud.ai/api/v1/model/prediction/<prediction_id> \
2  -H "Authorization: Bearer $ATLASCLOUD_API_KEY"

完成的响应会链接到完整文件,即源片段加扩展部分。Atlas Cloud 在其目录中运行一套 API,因此生成源片段的 Veo 3.1 和这次扩展共享相同的端点、认证头和轮询循环。切换模型意味着更改模型字符串以及该模型自己的字段。

通过 Gemini API 扩展 Veo 3.1 视频

通过 Google API 生成 Veo 片段的开发者会得到一个有文档记载的 148 秒上限,只要片段不离开 Google 的存储。 Gemini API 文档 是这样写的:“使用 Veo 3.1 将你之前用 Veo 生成的视频延长 7 秒,最多可延长 20 次。”一个 8 秒片段加上 20 次每次 7 秒的延长,就得到了 148 秒。

Gemini API 文档中标题为 Extending Veo videos 的章节,指出该功能仅适用于 Veo 3.1 和 Veo 3.1 Fast,不适用于 Veo 3.1 Lite,并列出输入限制:仅限 Veo 生成的视频,最长 141 秒,视频存储 2 天,宽高比 9:16 或 16:9,分辨率 720p,输出最长 148 秒

截图来自 Google AI for Developers,“Generate videos with Veo 3.1 in Gemini API”,页面最后更新于 2026 年 9 月 17 日。

在你围绕它们构建循环之前,请仔细阅读输入规则:

  • 输入必须是对之前生成的引用的引用,而不是你上传的文件。文档说,Gemini API“仅支持对 Veo 生成的视频进行视频扩展”。
  • 生成的视频会存储两天。引用其中一个进行扩展会重置该计时器,但上周的片段已经没了。
  • 输入必须是 720p,9:16 或 16:9,且不超过 141 秒。
  • Veo 3.1 Lite 在这里不能扩展,这与 Flow 相反,在 Flow 中 Lite 负责每一次扩展。

Google Cloud 的版本现在位于 Gemini Enterprise Agent Platform 下,对输入更灵活:其扩展页面接受 1 到 30 秒、24 fps、720p、1080p 或 4K 的 MP4。它仍然一次增加 7 秒,并将 Veo 扩展限制在 37 秒。

然后是日程表。Google 的弃用页面将 2026 年 10 月 22 日列为 Gemini API 中全部三个 Veo 3.1 预览模型的关闭日期,替代品是 gemini-omni-1.1-flash。你本周针对 veo-3.1-generate-preview 构建的扩展循环大约还有三周寿命。

哪条 Veo 3 扩展路径适合你的片段

每条路径都基于关于你的片段存放在哪里的不同假设。把它们列出来,选择基本上就不言自明了:

路径接受什么每次添加最长结果扩展中的声音
Google Flow ExtendFlow 项目内的 8 秒 Veo 3.1 片段,用 Veo 3.1 Lite 扩展Flow 帮助页面未列出据 Google 称“一分钟或更久”自 2025 年 10 月起生成
Gemini API过去两天内生成或引用的 Veo 片段,720p,最长 141 秒7 秒148 秒只有当语音在最后一秒内时,声音才会继续
Google Cloud(Gemini Enterprise Agent Platform)MP4,1 到 30 秒,24 fps,720p 到 4K7 秒37 秒扩展页面上未描述
Atlas Cloud Video Extend(Grok Imagine)任何 2 到 15 秒的 MP42 到 10 秒源片段加上每次最多 10 秒保留源音轨,为新增秒数生成新声音

2026 年 6 月,Google 又加入了一个入口:Google Vids;根据 Google 的 Workspace Updates 博客,它允许 Workspace 和个人账户在 Vids 项目内用 Veo 扩展现有片段。

还在 Flow 中剪辑,并且对 Lite 作为扩展模型感到满意?那就留在那里。要在 Gemini API 上构建应用,就计划在 10 月 22 日之前迁移到 Gemini Omni。如果片段已经是硬盘上的 MP4、经过裁剪、调色,或者超过两天,就把它上传到 Video Extend 标签页。

无论你选择哪条路径,接缝都是观众会注意到问题的地方,而在带对白的片段中,声音断裂很难被忽略。

如何让声音在接缝处保持连续

Google 的文档在同一页上明确说明了声音规则:“如果视频最后 1 秒中没有语音,就无法有效扩展语音。”它的扩展从片段的最后一秒开始工作,所以必须有声音才能延续。这会把对白推到紧贴接缝的位置,从而造成用户描述的另一种失败。在 2026 年 6 月 Google 开发者论坛关于 Flow 的一个帖子中,一位用户写道,即使使用 extend,“对白的最后一个词仍然会流入”下一个片段的开头。

我们的 Atlas Cloud 运行采取了相反的方法。我们让 Veo 的台词提前结束,并把下一句写进提示词。下面是返回文件的音轨与源素材的对比:

14 秒返回文件的响度图,Veo 3.1 Fast 源音轨叠加在前 8 秒并与之匹配,源素材部分标出 The light only lasts a few more minutes 这句,8.0 秒处有一条虚线接缝,扩展部分中 9 到 12.5 秒之间标出新台词 Got it, one more before the sun goes

Veo 的对白在 6.9 秒结束,在接缝前留下了一秒多一点的环境音,所以没有任何词被切开。原始音轨与源素材逐秒匹配,匹配度为 0.94 到 1.00。新台词在 9 到 12.3 秒之间出现,与提示词中引用的内容完全一致。

三个习惯带来了这个结果:

  • 让 Veo 的台词在最后一秒之前结束。 编写 Veo 提示词,让角色在约 6 秒处说完。这样接缝就落在房间底噪中,而不是词说到一半。
  • 在扩展提示词中引用下一句台词。 Grok Imagine 逐字说出了“Got it. One more before the sun goes”。如果没有引用的台词,模型会自行决定是否有人说话。
  • 再次说明声音底噪。 我们的提示词以鸟鸣和微风结尾,与 Veo 提示词中描述的声音相同,外加新动作的快门声,所以扩展部分有相同的环境音可以参考。

一个好的接缝仍然只能为同一个镜头多争取几秒钟。超过这个范围,规划场景比扩展它更能带来收益。

何时应在 8 秒镜头之间剪辑,而不是扩展

扩展会从同一镜头结束的地方继续。这对倒酒、走路或风暴袭来来说是对的,而对一场自然会切到特写的对话来说则是错的。串联足够多的次数后,人脸和服装会开始漂移,我们在 AI 视频扩展器指南 中逐次测试过这一点。

所以按 8 秒块来规划。让每个机位都有自己的 Veo 生成,只扩展那些持续运动的镜头,并在剪辑器中在块与块之间硬切。一个 30 秒的场景可以变成三次生成加一次扩展:

一个 30 秒 Veo 场景的故事板时间线:镜头 A,一个 8 秒的 Veo 广角生成,包含第一句对白,无剪辑地接上扩展 A,同一镜头的另外六秒,包含第二句台词,然后硬切到镜头 B,一个单独生成的特写反应,再硬切到镜头 C,一个反向角度,包含最后一句台词

剪辑也能让你摆脱音频麻烦。房间底噪的轻微变化在硬切时可以通过,而在连续镜头中间出现同样的变化往往会听起来像故障。在每个块的提示词中描述相同的环境音,场景听起来仍然像同一个地方。

对于必须与现有镜头精确衔接的引入镜头,Frames to Video 的首尾帧模式会连接两张图像,而不是继续一个片段。

常见问题

用 Veo 3 能制作的最长视频是多少?

每次渲染 8 秒,所有 Veo 3 和 Veo 3.1 模型都是如此。任何更长的内容都是一条链:Google 所说的“一分钟或更久”描述的是 Flow 的 Extend 向一个片段添加分段,所以一个 60 秒的作品意味着同一镜头的多次扩展、多个镜头剪在一起,或两者兼有。

Veo 3 仍然可用吗,还是一切都已转移到 Veo 3.1?

在 Gemini API 中,veo-3.0-generate-001 和 veo-3.0-fast-generate-001 模型已于 2026 年 6 月 30 日关闭,Veo 3.1 模型被列为替代品。Flow 的模型页面列出了 Veo 3.1 Lite、Fast 和 Quality。今天大多数说“Veo 3”的教程描述的其实是 Veo 3.1,而 8 秒上限是一样的。

Gemini Omni 能制作超过 8 秒的视频吗?

能,但只长一点。Flow 的模型页面为 Gemini Omni Flash 1.1 列出了 10 秒片段,Gemini API 的 Omni 指南说你可以将 Omni 视频“延长 10 秒,总长度最长 40 秒”。Google 的 Gemini 应用页面还说 Omni“将在 Gemini 应用中取代 Veo”,所以该应用也在逐渐弃用 Veo。

在 Atlas Cloud 上制作并扩展一个 8 秒 Veo 片段需要多少钱?

一个 8 秒、720p、带音频的 Veo 3.1 Fast 片段价格为 $0.768,对其做一个 6 秒的 Grok Imagine 扩展价格为 $0.50,所以我们 14 秒的演示总共花费约 $1.27。Grok Imagine 按每新增一秒 $0.07 加上你上传源素材每秒 $0.01 计费。这意味着同一片段完整 10 秒扩展的价格是 $0.78。添加付款方式的新账户可获得 $1 免费额度,足以在你已有的片段上试用扩展。

结论

花园片段之所以是 8 秒,是因为 Veo 3.1 渲染 8 秒;而它之所以是 14 秒,是因为扩展读取了它的最后一帧并继续下去,同时原始画面和声音保持 Veo 制作时的样子。Flow、Gemini API 和 Atlas Cloud 都是这样工作的,每个新片段都从上一个片段的结尾构建。区别在于每条路径接受哪些片段,以及会保留它们多久。

如果片段仍在 Flow 中,就用 Veo 3.1 Lite 在那里扩展它。如果它在 Gemini API 中,就在 10 月 22 日关闭之前使用 7 秒的扩展批次。如果它已经是硬盘上的 MP4,就把它上传到 Atlas Cloud 的 Video Extend 标签页,让对白在接缝之前结束,并在提示词中引用下一句台词。这就是如何让 Veo 3 超过 8 秒,并保留片段开始时的声音。

最新模型

一个 API,畅享全模态 AI。

探索全部模型