Seedance 2.0 First and Last Frame Control

Seedance 2.0 First and Last Frame Control

Seedance 2.0 是 ByteDance 面向生产环境的视频模型,专用于精准镜头创作。将提示词转换为视频,使用首帧图像生成动画并可选用尾帧引导,或结合参考媒体和可选的联网搜索来塑造结果。Atlas Cloud 将这些工作流整合到统一的 API 中,提供透明的按量付费定价和一个兼容 OpenAI 的密钥。立即开始构建。

Seedance 2.0 由 ByteDance 开发。Atlas Cloud(由 Atlas Cloud AI LLC 运营)仅提供接入服务,并不拥有该模型。所有商标均归其各自所有者所有。

探索领先模型

Atlas Cloud 为您提供最新的行业领先创意模型。

Seedance 2.0 生产级视频 API 输入模式

比较 Seedance 2.0 各端点中的文本、图像和多模态参考工作流。

模态描述
Seedance 2.0 T2V API (Text To Video)将文本提示词转换为带原生音频的生成视频;当需要更多上下文时,还可选择启用网页搜索。此端点适用于概念可视化、短篇叙事场景,以及由文字指引的营销活动创意构思。
Seedance 2.0 I2V API (Image To Video)以首帧图像为起点,Seedance 2.0 I2V API 可生成带原生音频的视频。还可选择提供末帧图像来引导结尾效果,因此该端点适用于产品动画、视觉转场和以图像为主导的叙事创作。
Seedance 2.0 R2V API (Reference To Video)提供图像、视频和音频参考素材,以引导多模态视频生成。该端点支持视频编辑与扩展,适用于基于参考素材创建场景、修改现有视频片段,以及延续视频序列等工作流。

深入了解 Seedance 2.0 生产工具包

Seedance 2.0 将多模态参考、同步原生音频、定向镜头运动、首帧与尾帧控制、稳定物理效果、原生 4K 文生视频输出,以及通过 Atlas Cloud 获取生产能力集于一体。

Seedance 2.0 多模态参考

通过 Seedance 2.0 reference to video endpoint,将文本指令与图像、视频和音频参考结合起来。这些素材可在一次请求中共同引导人物身份、构图、运动、镜头语言、视觉风格和节奏。同一接口还支持视频编辑与延展,因此现有素材可以变成受控的后续片段或全新场景。这套工作流适用于品牌营销活动、系列角色和镜头匹配。

原生音频与画面同步

启用 generate_audio 后,声音会与画面同步生成,涵盖人声、音效和背景音乐。由于运动与音频在同一次请求中生成,对话可以匹配唇部动作,脚步声、环境音和节奏型鼓点也能与动作保持一致。在提示词中同时指导场景与配乐。生成结果适合音乐驱动的短片、对话场景、广告,以及需要声音协调配合的电影化片段。

首帧与尾帧控制

以一张图像作为起点,并在目标构图有明确要求时添加可选的尾帧。image to video endpoint 会为开场静帧生成动画,同时由第二张图像锚定场景的结束状态。可直接在提示词中描述推轨、环绕跟拍、POV 切换、光照和表演。这种控制尤其适合产品揭示、分镜衔接,以及必须落在预设结尾画面的镜头。

物理效果与运动稳定性

当主体、物体、布料、液体和转场在不同帧之间保持连贯时,快速动作也能产出可用结果。Seedance 2.0 可以模拟物体坠落、碰撞、碎裂、流水和织物运动,同时保持角色外观与比例稳定。与其刻意隐藏运动,不如用追逐、特技或多人互动来发挥它的能力。这项能力适用于动作场景、时尚短片,以及任何视觉漂移都会破坏镜头效果的叙事型片段。

Seedance 2.0 原生 4K 输出

完整的 Seedance 2.0 text to video endpoint 支持 16:9 比例下 3840 × 2160 的原生 4K 输出。同时提供 720p SR、1080p SR 和 1440p SR 选项,并支持高码率模式,以生成更清晰的文件。原生 4K 使用 10 bit H.265 或 HEVC 编码。时长可在 4 到 15 秒之间选择,适合主视觉素材、大型显示屏或对细节敏感的后期制作。

Seedance 2.0 Production API

开发者只需一个 Atlas Cloud API key,即可通过三个专用 endpoint 构建文本、图像和参考驱动的视频工作流。标准价格从每秒 $0.112 起,按实际用量付费。text endpoint 可选用 web search;seed、watermark 和 return last frame 控制则有助于构建更具可重复性的生产流程。这套配置为开发者提供了从实验到部署的一致路径。

Seedance 2.0 与其他模型对比 - 一条提示词

使用同一条提示词,由 Seedance 2.0 和其他主流视频模型生成:带障碍物的追逐场景。重点表现动作、追逐场面和物理模拟。

提示词

镜头跟随一名身穿黑衣、快速逃跑的男子,身后一群人紧追不舍。镜头切换为侧面跟拍。角色惊慌失措,撞翻路边的水果摊后爬起来继续逃跑。背景中传来惊慌人群的声音。

Generated with Seedance 2.0 on Atlas Cloud

Generated with Kling 3.0 on Atlas Cloud

Generated with Seedance 1.5 Pro on Atlas Cloud

提示词

异世界幻想风格的动画场景。场景设定在另一个世界的城镇中。不要绘制城堡。场景概览:男性角色 1 突然被女性角色 2 和女性角色 3 包围,而女性角色 4 在远处嫉妒地注视着这一切,导致男性角色 1、女性角色 2 和女性角色 3 都露出惊慌的表情。 **场景 1(0–3 秒):**俯视镜头展现男性角色 1(一名男性冒险者)穿过集市。女性角色 2(一名兽耳少女)挽住他的手臂,对着他微笑,并称呼他为 "Zahha-san"。随后,女性角色 3(一名女骑士)挽住他的另一条手臂,对着他微笑,并称呼他为 "Zahha"。 **场景 2(3–7 秒):**侧面视角。男性角色 1 显得手足无措,说道:"你、你们两个?" 女性角色 2 和女性角色 3 仍分别挽着他的手臂,对着他微笑。突然,三人身后的背景变暗,出现小型闪电特效(类似危险信号),三人转身看向画面,露出惊慌的表情。 **场景 3(7–9 秒):**全身镜头展现女性角色 4 站在集市前方,双臂交叉。路人从她身旁经过。 **场景 4(9–11 秒):**女性角色 4 的特写镜头。随后背景变暗。尽管她面带微笑,背景中却充满嫉妒的火焰特效。她的一只眼睛正在抽搐。 **场景 5(11–13 秒):**男性角色 1、女性角色 2 和女性角色 3 同时陷入惊慌的场景。他们的脸变成日式漫画风格的 Q 版形态。眼睛变得又圆又白,没有瞳孔;嘴巴扭曲变形;圆形的汗滴向四周飞散。

Generated with Seedance 2.0 on Atlas Cloud

Generated with Kling 3.0 Turbo on Atlas Cloud

Generated with Wan 2.7 on Atlas Cloud

Seedance 2.0 贯穿制作流程

从预可视化、商业电商、音乐、品牌叙事、视频剪辑到 4K 交付,Seedance 2.0 通过 Atlas Cloud 将多模态参考素材转化为同步的制作资产。

使用 Seedance 2.0 制作电影级预演

使用 Seedance 2.0 将脚本、分镜和参考素材转化为可控的预演内容,同时保留镜头意图和场景衔接。导演和游戏团队可以在投入完整制作前先行审看片段。

用静态图像制作产品发布影片

将首帧产品图像制作成精致的发布短片,并可通过可选的尾帧控制引导最终构图。电商团队无需为每个 SKU 重新拍摄,即可制作目录视频、产品展示片和营销素材。

以节拍驱动的音乐视觉内容

将音频参考素材输入 Seedance 2.0,以塑造节奏;原生音频则确保动作与声音保持同步。音乐人和创意工作室可以制作节拍驱动的宣传片、演出视觉内容和营销循环视频。

Seedance 2.0 视频剪辑与延展

使用参考转视频生成来修改或延展现有素材,同时保留源视频的运动和节奏。后期制作团队可以基于提供的片段制作不同剪辑版本、视觉处理方案和无缝衔接的延续内容。

参考素材引导的品牌叙事

结合图像、视频和音频参考素材,引导品牌故事中的角色、风格、镜头运动和声音。创意团队无需为每个镜头重新制定方向,即可交付连贯的营销场景。

使用 Seedance 2.0 进行 4K 交付

当最终交付需要比预览流程更清晰的细节时,以 4K 渲染 Seedance 2.0 视频。制作团队可以创建主视觉镜头、大屏营销素材和精致的演示视频,供客户审阅。

Seedance 2.0 与多模态视频替代方案对比

比较 Seedance 2.0 与参考生视频模型在支持的输入类型、片段时长、分辨率、原生音频和 Atlas Cloud 标准价格方面的差异。

模型输入类型输出时长最高分辨率原生音频标准价格
Seedance 2.0 Reference-to-Video文本、图像、视频、音频4–15 秒4K√$0.112/秒
MiniMax H3 Reference-to-Video文本、图像、视频、音频4–15 秒2K√$0.038/秒
Wan-2.7 Reference-to-video文本、图像、视频、音频2–10 秒1080p√$0.10/秒

如何在 Atlas Cloud 上使用 Seedance 2.0

几分钟即可上手 — 按照以下简单步骤,通过 Atlas Cloud 平台集成和部署模型。

创建 Atlas Cloud 账户

在 atlascloud.ai 注册并完成验证。新用户可获得免费额度,用于探索平台和测试模型。

为何在 Atlas Cloud 使用 Seedance 2.0

将先进的 Seedance 2.0 模型与 Atlas Cloud 的 GPU 加速平台相结合,提供无与伦比的性能、可扩展性和开发体验。

性能与灵活性

低延迟:
GPU 优化推理,实现实时响应。

统一 API:
一次集成,畅用 Seedance 2.0、GPT、Gemini 和 DeepSeek。

透明定价:
按 Token 计费,支持 Serverless 模式。

企业与规模

开发者体验:
SDK、数据分析、微调工具和模板一应俱全。

可靠性:
99.99% 可用性、RBAC 权限控制、合规日志。

安全与合规:
SOC 2 Type II 认证、HIPAA 合规、美国数据主权。

Seedance 2.0 生产 API 常见问题

Seedance 2.0 是 ByteDance 推出的多模态视频生成模型,可根据文本、图像、视频和音频参考素材创建和编辑视频。Atlas Cloud 提供 text-to-video、image-to-video 和 reference-to-video endpoint,并支持同步原生音频。

创建 Atlas Cloud API key,并将其安全地存储为环境变量。向视频生成 endpoint 发送经过身份验证的 POST 请求,并提供相应的 model ID、提示词和生成设置。使用返回的 prediction ID 获取已完成的输出。

如果场景从文字提示词开始,请选择 text-to-video。若要使用首帧图像生成动画,并可选提供尾帧,请使用 image-to-video;如果需要通过图像、视频或音频来引导人物身份、动作、风格、编辑或扩展,则选择 reference-to-video。

可用输入取决于 endpoint,包括提示词、首帧和尾帧、参考图像、参考视频以及参考音频。完整模型支持 4 到 15 秒的视频输出、多种宽高比、同步音频、码率选择、seed 控制、可选水印以及单独传递尾帧。

Atlas Cloud 已验证的标准价格为上述三个系列 endpoint 均按每秒 $0.112 计费。该标准费率不依赖临时折扣假设,可为开发者估算生产成本提供稳定基准。

生成请求会在处理继续异步进行的同时返回 prediction ID。持续轮询 prediction endpoint,直到状态变为 completed、failed 或 timeout,然后从 outputs 数组中读取生成媒体的 URL。在原始请求仍处于处理状态时,请避免提交重复任务。

调用完整 Seedance 2.0 endpoint 时,将 resolution 字段设置为 4k,因为 Fast 和 Mini 变体不支持此选项。原生 4K 输出的分辨率为 3840 by 2160、宽高比为 16:9,并采用 10-bit H.265 或 HEVC 编码。如果浏览器无法播放,请使用兼容 HEVC 的播放器打开文件,或将其转码以获得更广泛的兼容性。

普通 reference 工作流不支持直接上传包含真实人脸的参考图像或视频。如有可用选项,请使用平台批准的虚拟肖像或已获得适当授权的肖像素材;在生成基于人物肖像的内容前,还应取得相关主体的同意。

首先检查 model ID、必填提示词、时长、分辨率、宽高比,以及所有参考媒体 URL 是否可访问。真实人脸限制和内容安全检查也可能导致原本有效的请求被拒绝。如果提交成功,请先检查 prediction 状态和错误响应,再进行重试。

探索更多系列

Seedance 2.5

Seedance 2.5 API 现已在 Atlas Cloud 上线!它为开发者提供了 ByteDance 最新的视频模型。该模型可通过文本、单张图像或多达 50 个多模态参考,一次性生成长达 30 秒的原生视频,并包含同步音频和画面内的多语言文本。在 Atlas Cloud 上,您可以通过单个密钥访问它,其主体一致性和改进的物理特性能够保持长镜头的连贯性。

查看系列

Wan 3.0

Wan 3.0 API 是阿里巴巴 Wan 视频系列的下一代产品,旨在将长视频生成、多参考控制和音视频质量推向新的高度。Atlas Cloud 已经托管了 Wan 2.7、2.6 和 2.5,而 Wan 3.0 使用相同的统一密钥运行,无需额外设置。立即开始构建吧。向下滚动至展示区,查看 Wan 3.0 的创作能力。

查看系列

MiniMax H3

MiniMax H3 是 MiniMax 的多模态视频系列,支持文本、图像和参考内容引导创作。在支持的路由中,它能够保留参考媒体中的主体,提供灵活的宽高比,并通过 H3 Developer 将生成的声音与画面结合;输出配置则由 endpoint 选择。Atlas Cloud 通过一个 OpenAI 兼容密钥统一接入整个系列,并提供透明的按量付费定价,标准费率为每秒 $0.038。立即开始构建。

查看系列

Seedream 5.0 Pro

Seedream 5.0 Pro API 为开发者在 Atlas Cloud 上提供了字节跳动的可控图像编辑模型。它通过锚点和坐标精确定位编辑,将图像分离为可编辑图层,融合多个参考,并精准匹配颜色和材质,支持 2K 和 3K 分辨率的多语言文本。在 Atlas Cloud 上,您只需一个密钥即可访问!

查看系列

Seedance 2.0

Seedance 2.0 是 ByteDance 面向生产环境的视频模型,专用于精准镜头创作。将提示词转换为视频,使用首帧图像生成动画并可选用尾帧引导,或结合参考媒体和可选的联网搜索来塑造结果。Atlas Cloud 将这些工作流整合到统一的 API 中,提供透明的按量付费定价和一个兼容 OpenAI 的密钥。立即开始构建。

查看系列

GPT Image 2.5

OpenAI 的 gpt-image-2.5 系列为开发者提供 Flare 和 Sunburst 两种选择,满足生产级图像工作流需求。支持最高 3840x2160 的任意分辨率渲染,并提供包括 xhigh 和 max 在内的五档质量等级,以匹配特定的输出要求。Atlas Cloud 提供开箱即用的 REST 推理服务,无冷启动,每次生成起价 $0.004,采用标准定价。立即开始构建。

查看系列

GPT Image 2

GPT Image 2 API 为开发者提供了访问 OpenAI 最新图像模型的途径,它是 GPT Image 1.5 的继任者。该模型可生成和编辑图像,能够在拉丁和 CJK 文字上实现准确的文本渲染,并在海报、样机和信息图表方面具备强大的排版能力。在 Atlas Cloud 上,您可以通过一个统一的 API 与 300 多个模型一起访问它,并享受免费额度、99.99% 的正常运行时间,且无需 OpenAI 组织验证。

查看系列

Gemini Omni Flash

Gemini Omni 是 Google DeepMind 原生多模态视频系列,支持通过提示词引导创作与编辑。可从文本生成视频、让静态图像动起来,或在可选视觉参考的辅助下修改现有素材,同时保留未改动的内容。灵活的分辨率、宽高比和时长控制,满足多样化的制作流程。Atlas Cloud 通过透明的按需付费定价模式,统一提供访问能力。立即开始构建。

查看系列

Grok Imagine

Grok Imagine API 涵盖 xAI 的图像、视频和语音模型,包括 Image 2.0、Video 1.5 和 xAI TTS v1。支持生成跨 14 种宽高比的 1K 或 2K 静帧、生成最长 15 秒的 1080p 视频、通过最多 7 张参考图像引导镜头、或用 20 种语言进行配音。Atlas Cloud 在单一端点上运行所有功能,采用按量计费,起价为每张图像 $0.02、每秒 $0.05。立即开始使用。

查看系列

Google

Google最强大的创意模型现已在Atlas Cloud上全面可用。Veo 3.1提供电影级别的视频生成,Nano Banana 2支持高保真图像创建,而Gemini为每个工作流带来多模态智能。通过单一API key即可访问完整的Google模型套件,提供Day-0可用性和按需付费(pay-as-you-go)定价。

查看系列

Seedance 2.0 Mini

Seedance 2.0 Mini 将 ByteDance 的多模态视频生成技术引入到对速度和成本要求极高的工作流中。它以更轻量的占用空间提供 Seedance 2.0 的核心能力——更快的生成速度、更低的单条视频成本,并且使用您现有的同款 API 集成。对于运行高吞吐量流水线或进行大规模原型设计的团队来说,Mini 是最实用的默认选择。

查看系列

ByteDance

从电影级视频生成到高保真图像创建,ByteDance 最强大的模型现已在 Atlas Cloud 上线。以最低的推理定价和零基础设施开销,大规模运行 Seedance 和 Seedream。

查看系列

一个 API,畅享全模态 AI。

探索全部模型