Seedance 2.5 现已上线 — 首发 Atlas Cloud
Wan 2.7 API for All-in-One AI Video

Wan 2.7 API for All-in-One AI Video

Wan 2.7 API 为开发者提供了 Alibaba 的全能视频套件,涵盖文本生成视频、图像生成视频、参考生成视频和视频编辑,以及图像生成功能。它可以生成长达 15 秒、带同步音频的原生 1080p 视频片段,支持首尾帧控制,以及最多 5 个角色参考。在 Atlas Cloud 上,您可以通过一个统一的 API 访问它以及 300 多种模型,价格从每秒 0.10 美元起,并保证 99.99% 的正常运行时间。

探索领先模型

Atlas Cloud 为您提供最新的行业领先创意模型。

Wan 2.7 API Modalities

Wan 2.7 API Endpoints

ModalityDescription
Wan 2.7 T2V API (Text to Video)Wan 2.7 T2V API 赋能开发者将文本提示词转化为原生1080p视频片段。凭借多镜头叙事控制和音画同步音频技术,它能为营销、社交叙事和快速分镜制作生成完整的场景。
Wan 2.7 I2V API (Image to Video)Wan 2.7 I2V API 赋能开发者将静态图像转化为动态视频。通过首帧及首尾帧控制、视频延续和音频驱动模式,它以电影级的动态效果让产品、人像和概念栩栩如生。
Wan 2.7 R2V API (Reference to Video)Wan 2.7 R2V API 使开发者能够根据参考图像和视频生成以角色为驱动的视频。凭借对多主体和声音克隆的支持,它能在个性化和系列内容中保持外观、声音和口型同步的一致性。
Wan 2.7 V2V API (Video Edit)Wan 2.7 V2V API 赋能开发者通过自然语言指令编辑现有视频。结合参考图像、风格迁移和多模态输入,它能够重塑场景风格、替换元素,并在完全的创意控制下重新生成视频素材。
Wan 2.7 Pro T2I API (Text to Image)Wan 2.7 Pro T2I API 赋能开发者通过文本提示生成高保真图像。专为卓越品质和支持4K的工作流打造,它为广告、产品设计和专业创意制作提供细节丰富的视觉效果。
Wan 2.7 Pro I2I API (Image to Image)Wan 2.7 Pro I2I API 赋予开发者使用文本指令和多图像参考来编辑和重组图像的能力。经过微调以提供更高质量的输出,它支持精确的风格重塑和排版,从而生成精美的、可用于生产环境的素材。
Wan 2.7 T2I API (Text to Image)Wan 2.7 T2I API 使开发者能够通过文本提示词生成图像,具备快速迭代和高度还原提示词的特点。它支持插画和照片写实两种风格,非常适合大批量的创意工作流。
Wan 2.7 I2I API (Image to Image)Wan 2.7 I2I API 赋予开发者使用文本指令、多图参考以及可选的交互框来编辑和重组图像的能力。这为修图、风格重塑和资产迭代提供了精确的、具备区域感知能力的控制。

Wan 2.7 API 的功能与案例展示

探索 Wan 2.7 API 提供的卓越功能,涵盖从首帧到尾帧的精准控制、最多 5 个参考输入,以及原生同步音频、声音克隆和基于指令的视频编辑。

首尾帧控制

Wan 2.7 允许您同时设置起始帧和结束帧,然后生成两者之间的运动过渡。这为您提供了对每个片段发展轨迹的精确控制,非常适合匹配剪辑、画面变换以及基于故事板驱动的序列。

真人输入及最多5项参考

Wan 2.7 在单次请求中支持真人图像输入以及最多五个图像或视频参考。这确保了角色、外观和身份在整个视频片段中保持一致,即使在复杂的多主体场景中也是如此。

音频控制:保留或重新生成

音频控制:保留或重新生成

在编辑视频时,Wan 2.7 允许您保留原始音频轨道,或重新生成新的音频以匹配您的修改。这种灵活性既支持忠实于原画的编辑,也支持完全重构的场景。

指令驱动的视频编辑

Wan 2.7 通过简单的自然语言指令编辑或重新生成现有视频,无需手动添加遮罩。您可以应用风格迁移、更改场景并替换元素,从而让迭代式视频制作变得快速且可控。

扩展的 2 至 15 秒片段

Wan 2.7 能够一次性生成2到15秒的流畅高清视频。这一时长足以满足广告、产品演示和社交媒体叙事的需求,无需将较短的片段拼接在一起。

语音克隆

提供语音参考,Wan 2.7 即可在生成的视频中将其复现,并实现音色匹配与唇形同步。这保持了角色声音和外观的一致性,对于系列作品和个性化内容极具价值。

多样本叙事

Wan 2.7 能够读取单一提示词中描述的多个镜头,并将其切分为一个连贯的序列。在各个镜头之间,主体、风格和转场保持一致,从而支持生成更长的叙事片段,而无需手动拼接。

同步原生音频

Wan 2.7 生成的视频带有原生的音画同步音频,而不是独立的音轨。对话、音效和画面动作在一次生成中保持对齐,使得视频片段无需额外的音频后期制作即可直接使用。

同一提示词,三种渲染:Wan 2.7 API 横向对比

将同一个提示词分别输入 Wan 2.7 API、一个领先的外部竞品,以及上一代 Wan 模型,看看各个模型如何把完全相同的文字转化为成片视频。

提示词

一只街头猫叼着一条银色鲭鱼,从鱼贩的推车上纵身跃下,飞快冲进拥挤的夜市。低机位跟拍镜头追随它在摊位桌腿间穿梭、踏过水洼,头顶霓虹招牌化作光 streak 掠过。镜头快速甩向鱼贩,只见他无奈地举起双手,随后又迅速切入高速推轨近景:猫猛地滑停,回头瞥了一眼,随即钻进旁边小巷;几乎同时,鱼贩大笑着冲出来追了上去。温暖的霓虹倒影、湿漉漉的鹅卵石路、浅景深、粗粝的电影级写实风格。环境音包含夜市人声、炒锅滋滋声,以及与猫飞奔节奏同步的俏皮欢快律动。16:9 aspect ratio。

Generated with Wan-2.7 on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Wan-2.2 on Atlas Cloud

提示词

Anime cel-shaded style。一位年轻女巫在黎明时分从屋顶蹬地起飞,骑着扫帚掠过雾气弥漫的海滨小镇,围巾在风中猎猎作响。一个大范围 drone shot 围绕她盘旋拍摄,她在钟楼之间侧身转弯,随后切入第一人称 POV,朝着闪耀的港湾俯冲,受惊的海鸥从她翼尖般的扫帚旁四散飞过。镜头切到低机位英雄式画面:她在最后一刻猛然拉起,贴着水面掠过,激起一道朝向日出的水花弧线。鲜艳的手绘天空、体积光、流畅的工作室级动画。呼啸的风声、昂扬的管弦乐渐强,以及拉起瞬间的一记胜利感鼓点。16:9 aspect ratio。

Generated with Wan-2.7 on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Wan-2.2 on Atlas Cloud

使用 Wan 2.7 API 构建

探索您可以使用 Wan 2.7 API 构建的内容:从广告、产品演示和社交内容,到角色驱动视频、创意原型设计和本地化。

广告与营销

借助 Wan 2.7 API,通过文本或图像参考生成精美的广告创意、宣传短片和落地页视频。在所有输出结果中锁定品牌视觉效果,从而大规模生成营销活动变体。

产品演示与电子商务

将演示者参考图像与产品图像相结合,以创建演示和生活方式片段,并在新场景中保持演示者形象的一致性。这适用于电子商务列表、产品发布和教程内容。

社交与短篇内容

批量生成短视频引流片段、生活方式短片和场景转场,然后使用 Wan 2.7 Edit API 替换背景或改变基调。角色一致性确保了固定人设在每日发布的内容中具有高辨识度。

角色驱动视频

在一次调用中传递最多五个图像、视频或音频参考,以锁定外观、声音、唇形同步和摄像机运动。这使得 Wan 2.7 在处理多角色场景和系列内容时非常可靠。

影视与创意原型设计

在正式制作之前,通过在几分钟内生成具有不同场面调度、灯光或角色互动的多种变体来制作场景原型。首尾帧控制赋予导演对每个镜头发展轨迹的精确掌控。

本地化

通过 Edit API,只需输入一条自然语言指令即可针对不同市场对现有视频进行改编,例如替换背景或改变基调。这能将一个原始片段转化为多个区域版本,而无需重新拍摄。

Wan 2.7 与其他模型对比

查看不同厂商的模型表现 — 对比性能、价格和独特优势,做出明智决策。

模型 输入类型 输出时长分辨率
Wan 2.7文本、图像、视频、音频2~15s1080P, 720P
Seedance 2.0 文本、图像、视频、音频4~15s 4K, 1440P, 1080P, 720P, 480P
Kling 3.0文本、图像、视频、音频 3~15s1080P, 720P
Veo 3.1文本、图像 4s;6s;8s1080P, 720P
Wan 2.6文本、图像、视频、音频5s;10s;15s1080P, 720P

如何在 Atlas Cloud 上使用 Wan 2.7

几分钟即可上手 — 按照以下简单步骤,通过 Atlas Cloud 平台集成和部署模型。

创建 Atlas Cloud 账户

在 atlascloud.ai 注册并完成验证。新用户可获得免费额度,用于探索平台和测试模型。

为何在 Atlas Cloud 使用 Wan 2.7

将先进的 Wan 2.7 模型与 Atlas Cloud 的 GPU 加速平台相结合,提供无与伦比的性能、可扩展性和开发体验。

性能与灵活性

低延迟:
GPU 优化推理,实现实时响应。

统一 API:
一次集成,畅用 Wan 2.7、GPT、Gemini 和 DeepSeek。

透明定价:
按 Token 计费,支持 Serverless 模式。

企业与规模

开发者体验:
SDK、数据分析、微调工具和模板一应俱全。

可靠性:
99.99% 可用性、RBAC 权限控制、合规日志。

安全与合规:
SOC 2 Type II 认证、HIPAA 合规、美国数据主权。

关于 Wan 2.7 API 的常见问题解答

Wan 2.7 API 为开发者提供了访问阿里巴巴一站式视频套件的权限,涵盖文生视频、图生视频、参考图生视频、视频编辑以及图像生成。它可生成长达 15 秒、带有同步音频的原生 1080p 视频片段。在 Atlas Cloud 上,您可以通过一个统一的 API 调用它以及另外 300 多个模型。

Wan 2.7 将最大片段长度从 Wan 2.6 的约 5 秒延长至 15 秒,并在视觉清晰度、同步音频和运动一致性方面实现了重大提升。它还通过首尾帧引导和多达五个参考图像拓宽了控制范围。这两个版本均可通过一个统一的 API 在 Atlas Cloud 上访问。

是的。Wan 2.7由Alibaba基于Apache 2.0许可证发布,模型权重和推理代码已托管在HuggingFace和GitHub上,因此您可以自托管、修改和重新分发该模型。在本地运行它需要配备至少16GB显存(VRAM)的GPU,而Atlas Cloud托管了Wan 2.7 API,让您可以免除基础设施的配置。

是的。Wan 2.7 API 能够生成带有原生、音画同步音频的视频,而非独立的配乐。它还支持声音克隆技术,只需提供一段参考声音,即可在整个视频片段中重现该声音,并确保音色匹配与唇形同步。

是的。Atlas Cloud 提供兼容 OpenAI 的 API,因此您可以将 OpenAI SDK 指向 Atlas Cloud 的基础 URL,添加您的 Atlas 密钥,并使用您现有的代码调用 Wan 2.7 API。您可以在几分钟内发出首个请求,而无需构建新的集成。

Wan 2.7 API 可生成2至15秒的文生视频和图生视频片段,以及2至10秒的参考生视频片段。输出为原生1080p,支持720p,且包含16:9、9:16、1:1、4:3和3:4等宽高比。

Wan 2.7 Video Edit API 可根据自然语言指令转换现有视频,无需手动遮罩。您可以应用风格迁移、更改场景、替换元素和重新生成素材,并且可以选择保留原始音频或重新生成新的音轨。

探索更多系列

Seedance 2.5

Seedance 2.5 API 现已在 Atlas Cloud 上线!它为开发者提供了 ByteDance 最新的视频模型。该模型可通过文本、单张图像或多达 50 个多模态参考,一次性生成长达 30 秒的原生视频,并包含同步音频和画面内的多语言文本。在 Atlas Cloud 上,您可以通过单个密钥访问它,其主体一致性和改进的物理特性能够保持长镜头的连贯性。

查看系列

MiniMax H3

The MiniMax H3 API opens MiniMax's general purpose multimodal video model, which reads text, images, video and audio as one context instead of one task at a time. Clips run 5 to 15 seconds at 24 FPS across aspect ratios from 21:9 to 9:16, and one prompt can swap characters, replace backgrounds, rewrite dialogue or clone a voice from a reference clip. Atlas Cloud serves it all through one OpenAI-compatible endpoint. Start building today.

查看系列

Seedream 5.0 Pro

Seedream 5.0 Pro API 为开发者在 Atlas Cloud 上提供了字节跳动的可控图像编辑模型。它通过锚点和坐标精确定位编辑,将图像分离为可编辑图层,融合多个参考,并精准匹配颜色和材质,支持 2K 和 3K 分辨率的多语言文本。在 Atlas Cloud 上,您只需一个密钥即可访问!

查看系列

Seedance 2.0

Seedance 2.0 API 为您提供 ByteDance 多模态视频模型的生产级访问权限——支持四模态输入(文本、图像、视频、音频),以及行业领先的“Universal Reference”(通用参考)系统,可在不同镜头间锁定构图、运镜和角色动作。只需一次 API 调用即可集成导演级控制,固定费率为 $0.09/秒,即时获取密钥,无需排队——由企业级正常运行时间和合规性提供保障。Seedance 2.0 原生 4K 现已上线!

查看系列

GPT Image 2

GPT Image 2 API 为开发者提供了访问 OpenAI 最新图像模型的途径,它是 GPT Image 1.5 的继任者。该模型可生成和编辑图像,能够在拉丁和 CJK 文字上实现准确的文本渲染,并在海报、样机和信息图表方面具备强大的排版能力。在 Atlas Cloud 上,您可以通过一个统一的 API 与 300 多个模型一起访问它,并享受免费额度、99.99% 的正常运行时间,且无需 OpenAI 组织验证。

查看系列

Gemini Omni Flash

Gemini Omni API 将 Google DeepMind 在 Google I/O 2026 上发布的多模态视频生成与编辑模型带入你的技术栈。Gemini Omni 将 Gemini 的推理引擎与生成式媒体融合,可接受文本、图像、视频和音频的任意组合输入,生成一致且以知识为依据的输出。通过自然对话不断打磨结果:替换物体、重写场景、切换风格,同时保持物理规律、角色形象和画面连贯性不变。Atlas Cloud 通过统一的 API 提供完整的 Gemini Omni Flash 系列——文生视频、支持最多 7 张参考图的图生视频,以及参考图生视频——按秒计费、价格透明,低至 $0.112 起,且无需订阅。立即开始构建。

查看系列

Grok Imagine

Grok Imagine API 涵盖 xAI 的图像、视频和语音模型,包括 Image 2.0、Video 1.5 和 xAI TTS v1。支持生成跨 14 种宽高比的 1K 或 2K 静帧、生成最长 15 秒的 1080p 视频、通过最多 7 张参考图像引导镜头、或用 20 种语言进行配音。Atlas Cloud 在单一端点上运行所有功能,采用按量计费,起价为每张图像 $0.02、每秒 $0.05。立即开始使用。

查看系列

Google

Google最强大的创意模型现已在Atlas Cloud上全面可用。Veo 3.1提供电影级别的视频生成,Nano Banana 2支持高保真图像创建,而Gemini为每个工作流带来多模态智能。通过单一API key即可访问完整的Google模型套件,提供Day-0可用性和按需付费(pay-as-you-go)定价。

查看系列

Seedance 2.0 Mini

Seedance 2.0 Mini 将 ByteDance 的多模态视频生成技术引入到对速度和成本要求极高的工作流中。它以更轻量的占用空间提供 Seedance 2.0 的核心能力——更快的生成速度、更低的单条视频成本,并且使用您现有的同款 API 集成。对于运行高吞吐量流水线或进行大规模原型设计的团队来说,Mini 是最实用的默认选择。

查看系列

ByteDance

从电影级视频生成到高保真图像创建,ByteDance 最强大的模型现已在 Atlas Cloud 上线。以最低的推理定价和零基础设施开销,大规模运行 Seedance 和 Seedream。

查看系列

Alibaba

Atlas Cloud 将 Alibaba 的全系模型阵容整合至同一个 API 中:Qwen 用于语言和图像任务,Wan 用于高达 1080p 的视频生成。所有模型均采用按需付费模式,无需订阅。您可以使用现有的 OpenAI 兼容客户端,通过单一的 base URL 访问 Alibaba API。

查看系列

OpenAI

Atlas Cloud 为您提供访问完整 OpenAI API 产品线的权限,从用于图像生成的 GPT Image 2 到用于视频的 Sora 2。每个模型均采用按需付费模式,无月度消费限制。使用兼容 OpenAI 的 API,只需简单替换基础 URL 即可轻松接入。

查看系列

一个 API,畅享全模态 AI。

探索全部模型