你让 ChatGPT 给你一段短片,它却回你一份剧本。到 2026 年 10 月,这仍是默认答案。ChatGPT 能制作视频吗? 单靠它自己不行。OpenAI 已于 2026 年 4 月 26 日关闭 Sora 应用,又于 9 月 24 日关闭 Sora API,而 ChatGPT 本身至今仍没有视频生成器。
一个插件能填补这道缺口。安装 Atlas Cloud,同一个聊天窗口就能返回真正的视频文件。我们在免费版 ChatGPT 账号上测试了三种方式:从文本提示词生成、从照片生成,以及从参考图生成。下面每一段短片都是在聊天窗口内返回的。

三种模式,三段短片,各用一个 ChatGPT 对话。
要点
- 2026 年,ChatGPT 没有内置视频生成器,Sora 的应用和 API 均已关闭。
- 添加Atlas Cloud 插件,同一个聊天窗口就能返回制作完成的 Seedance 2.5 视频文件。
- 文本生成视频能构建全新场景;图片生成视频则从首帧开始让你的照片动起来。
- 参考图生成视频能在周围场景不断变化时,保持人脸或产品的一致性。
- 每段 Seedance 2.5 短片时长为 4 到 30 秒,默认生成声音。
ChatGPT 自身具备视频生成能力吗?
没有。OpenAI 的套餐对比页面列出了 Free、Go、Plus 和 Pro 上的图像生成功能,但视频生成在那里根本没有对应条目。最接近的功能是带视频的语音,让你说话时 ChatGPT 能通过摄像头查看。它能读取视频,但无法制作视频。
我们还是试了一下。在 ChatGPT 桌面应用中,我们在提示词里排除了插件,要求生成一段五秒钟的短片:热气球在日出时从红岩峡谷上空升空。
回复开头写道:"I can't generate a finished 5-second video using only ChatGPT's built-in tools."(我无法仅用 ChatGPT 的内置工具生成一段完整的五秒视频。)它改为提供了一张该场景的静态图像,并指出生成动态短片需要它并不具备的视频生成能力。

不用插件,你得到的是围绕视频的一堆文书工作:一份剧本、一份镜头清单、一段可粘贴到别处的提示词,或一张可作为起点的静态图像。这些都很有用。但要渲染出一帧动态画面,你还是得离开聊天窗口。
如何用 Atlas Cloud 插件让 ChatGPT 制作视频
Atlas Cloud 将 ChatGPT 连接到 Seedance 2.5 以及 400 多个模型构成的目录中的其余模型。从其插件目录页面安装一次,然后用你的 Atlas 账号登录。我们的上手指南逐步介绍了每一次点击。此后,制作完成的短片就会和你的请求出现在同一个对话里,并直接在那里播放。

做到这一点需要三步:
- 附加你的图片 —— 如果短片要从照片生成,点击加号按钮。纯文本提示词则跳过这一步。
- 撰写请求。 说明插件、模型和模式,然后写明时长、分辨率和场景。要求在执行前先查看请求内容。
- 发送。 插件会回复它计划提交的确切设置,然后等待。回复"confirm"后,它便会启动作业、检查进度,并在短片就绪时向你汇报。

真正的决策在于模式。Seedance 2.5 在 Atlas 上有三种模式,接下来三节各测试一种。
ChatGPT 能从文本提示词生成视频吗?
可以,当场景尚不存在时,这正是该用的模式。文本生成视频完全根据你的文字构建一切:主体、地点、运镜和配乐。
我们要求生成一个没有任何参考的科幻着陆镜头。以下是完整消息,可直接粘贴:
plaintext1Use the Atlas Cloud plugin: Seedance 2.5 text-to-video, 8 seconds, 16:9, 720p, sound on. A test pilot in a white flight suit walks across a cracked salt flat at dawn toward a sleek silver spacecraft with its landing ramp lowered, her helmet tucked under one arm. Low tracking shot from behind her shoulder that drifts around to her profile as the engines wind down. Fine dust drifts across the ground, pale pink sky, long shadows, realistic film grain. Sound: wind, salt crunching under her boots, a fading turbine hum. Show me the exact request and the price, and wait for my confirmation before submitting.
回复一次"confirm"之后,作业便开始运行。镜头从她踩过龟裂地面的靴子低角度开场,向上掠过她腋下夹着的头盔,在着陆坡道充满画面时转到她的侧脸。音轨与画面在同一份文件里返回,与画面在同一轮生成。
注意提示词中很大一部分篇幅都用在运镜和声音上,而非主体。这正是文本生成视频成败的关键所在。我们关于撰写 Seedance 2.5 提示词的指南逐行拆解了这一结构。

ChatGPT 图片生成视频:从首帧开始让照片动起来
图片生成视频从你已有的照片出发。该图像成为第一帧,因此在任何东西动起来之前,人脸、服装和光线就已经是你自己的了。你的提示词只需描述动态即可。
我们附上了一张女子低垂视线望向一侧的特写人像,然后要求做一个细微而自然的动作:
plaintext1Use the Atlas Cloud plugin: Seedance 2.5 image-to-video with the attached photo as the first frame, 6 seconds, 720p, sound on. She slowly lifts her gaze and turns her head toward the camera, a small smile forming, loose strands of hair moving in a light breeze. Soft window light from the left, the white wall stays as it is, the camera holds still with a gentle push-in. Sound: quiet room tone and a soft rustle of fabric. Show me the exact request and the price, and wait for my confirmation before submitting.
插件将照片上传到 Atlas,并将其设为第一帧。到六秒结束时,她已抬起眼、转过头面向镜头,并露出微笑,同时镜头缓缓推近。她的马尾辫、青绿色针织衣领以及身后的白墙,从第一帧到最后一帧都保持稳定。
在你亲自尝试之前,有两个细节值得了解。输出会保留你照片的比例,因为 Seedance 2.5 图片生成视频会匹配源图像的宽高比。我们这段返回的结果接近正方形,因为那张人像就是如此。
如果你知道镜头的终点在哪里,可以再附上第二张照片作为最后一帧,模型会补全两者之间的动态。如果你更愿意填表单而非聊天,Seedance 2.5 图片生成视频页面上有同样的设置。

ChatGPT 中的参考图生成视频:把同一张脸放进新场景
参考图生成视频把你的图像当作演员表,而非起始帧。模型会学习这个人是谁、产品长什么样,然后围绕它们构建新镜头。当某个角色必须出现在你照片从未展示过的地方时,就用它。
在提示词中,每张图像按上传顺序称呼:@Image1 代表第一张附件,@Image2 代表第二张。我们附上了一张在室内拍摄的年轻男子人像,以及一张 clubmaster 太阳镜的产品照,然后把他移到两张照片都未曾出现过的地方:
plaintext1Use the Atlas Cloud plugin: Seedance 2.5 reference-to-video, 8 seconds, 9:16, 720p, sound on. Pass the first attached photo as @Image1 (the man) and the second as @Image2 (the sunglasses). The man from @Image1 leans on the rail of a sailboat on a bright summer afternoon, wind in his hair, the sea glittering behind him. He takes the sunglasses from @Image2 out of his shirt pocket, puts them on and grins at the camera. Handheld medium shot that pushes in to a close-up. Keep his face, hair and dark shirt as in @Image1 and the frame shape of the sunglasses as in @Image2. Sound: waves, rigging clinking, a gull overhead. Show me the exact request and the price, and wait for my confirmation before submitting.
它向我们展示的请求将 @Image1 对应人像、@Image2 对应太阳镜,因此在任何内容运行之前,顺序都很容易核对。
短片中,他身处阳光明媚的甲板上,身后是开阔的水面。他从口袋里掏出眼镜,展开,戴上,并在镜头推近时露出笑容。人脸、后梳的头发和深色衬衫都从人像延续下来,镜框也保留了产品照中的 clubmaster 形状。
一次请求最多可携带 30 张参考图,外加参考视频和音频片段。正是这种余量,让 ChatGPT 成为处理反复出现角色的实用视频生成器:保留同一张参考照片,改动场景描述,那张脸就会跟着你进入下一段短片。

文本、图片还是参考图:哪种 ChatGPT 视频模式适合你的短片?
从你已有的素材出发。只有提示词,就用文本生成视频。有一张好照片,就用图片生成视频。某个必须在全新地点仍可辨认的人或产品,就用参考图生成视频。
| 模式 | 你发送什么 | 什么保持锁定 | 宽高比 | 何时选用 |
|---|---|---|---|---|
| 文本生成视频 | 仅提示词 | 无;模型自创每一帧 | 由你选择,从 21:9 到 9:16 | 你需要一个尚不存在的场景 |
| 图片生成视频 | 一张照片,另可选一张末帧 | 第一帧,与拍摄时完全一致 | 跟随你的照片 | 你想让某张特定照片动起来 |
| 参考图生成视频 | 参考图,另可选视频或音频 | 你参考的人脸、产品和风格 | 由你选择 | 同一个人或产品需要全新场景 |
常见问题
ChatGPT 能免费制作视频吗?
ChatGPT 这一侧不额外收费。我们所有测试都在免费版 ChatGPT 账号上运行。Atlas 则按短片从你自己的余额中收取视频本身的费用。
截至 2026 年 10 月,Seedance 2.5 在 Atlas 上享有 20% 折扣,未列出截止日期。按此费率,Atlas 给我们的报价是:8 秒文本生成视频 $2.42,6 秒图片生成视频 $1.82,8 秒参考图生成视频 $2.42,均为 720p。以 480p 试做则每一项还能更低。
ChatGPT 能制作带声音的视频吗?
可以,只要插件就位。Seedance 2.5 默认生成同步音频,涵盖环境音、音效,以及在你提示词中包含台词时的语音。像描述画面一样描述你想要的声音。如果你打算稍后为短片配上自己的音乐,就要求不带音频。
一段 ChatGPT 视频能做多长?
每段 Seedance 2.5 短片时长为 4 到 30 秒,你在请求中设定长度。若想更长,把一段成品短片作为参考视频发回,并让模型继续。参考图生成视频可处理这种延长,因此一分钟的片段就是在同一对话里的两到三次请求。
ChatGPT 能编辑你已有的视频吗?
可以,针对 4 到 30 秒的短片。将其作为参考视频上传,并描述改动,例如换一个背景或换一件夹克。当提示词要求修改输入短片时,Seedance 2.5 会切换到编辑模式,结果会保留你短片原本的长度。
结语
ChatGPT 仍然无法独自渲染视频,而 Sora 的关停也带走了 OpenAI 自家的视频应用。它能做的是替你驱动一个视频模型。装好插件后,一段文本提示词、一张照片或一组参考图,无需离开对话就能变成制作完成的 Seedance 2.5 短片。
根据你已有的素材选择模式,描述动态和声音,并在运行前先确认请求。那么,ChatGPT 能制作视频吗?开箱即用并不行。加一个插件,你的下一段短片就和它的剧本从同一个聊天开始。






