
Wan 2.7 API 为开发者提供了 Alibaba 的全能视频套件,涵盖文本生成视频、图像生成视频、参考生成视频和视频编辑,以及图像生成功能。它可以生成长达 15 秒、带同步音频的原生 1080p 视频片段,支持首尾帧控制,以及最多 5 个角色参考。在 Atlas Cloud 上,您可以通过一个统一的 API 访问它以及 300 多种模型,价格从每秒 0.10 美元起,并保证 99.99% 的正常运行时间。
Atlas Cloud 为您提供最新的行业领先创意模型。
Wan 2.7 API Endpoints
| Modality | Description |
|---|---|
| Wan 2.7 T2V API (Text to Video) | Wan 2.7 T2V API 赋能开发者将文本提示词转化为原生1080p视频片段。凭借多镜头叙事控制和音画同步音频技术,它能为营销、社交叙事和快速分镜制作生成完整的场景。 |
| Wan 2.7 I2V API (Image to Video) | Wan 2.7 I2V API 赋能开发者将静态图像转化为动态视频。通过首帧及首尾帧控制、视频延续和音频驱动模式,它以电影级的动态效果让产品、人像和概念栩栩如生。 |
| Wan 2.7 R2V API (Reference to Video) | Wan 2.7 R2V API 使开发者能够根据参考图像和视频生成以角色为驱动的视频。凭借对多主体和声音克隆的支持,它能在个性化和系列内容中保持外观、声音和口型同步的一致性。 |
| Wan 2.7 V2V API (Video Edit) | Wan 2.7 V2V API 赋能开发者通过自然语言指令编辑现有视频。结合参考图像、风格迁移和多模态输入,它能够重塑场景风格、替换元素,并在完全的创意控制下重新生成视频素材。 |
| Wan 2.7 Pro T2I API (Text to Image) | Wan 2.7 Pro T2I API 赋能开发者通过文本提示生成高保真图像。专为卓越品质和支持4K的工作流打造,它为广告、产品设计和专业创意制作提供细节丰富的视觉效果。 |
| Wan 2.7 Pro I2I API (Image to Image) | Wan 2.7 Pro I2I API 赋予开发者使用文本指令和多图像参考来编辑和重组图像的能力。经过微调以提供更高质量的输出,它支持精确的风格重塑和排版,从而生成精美的、可用于生产环境的素材。 |
| Wan 2.7 T2I API (Text to Image) | Wan 2.7 T2I API 使开发者能够通过文本提示词生成图像,具备快速迭代和高度还原提示词的特点。它支持插画和照片写实两种风格,非常适合大批量的创意工作流。 |
| Wan 2.7 I2I API (Image to Image) | Wan 2.7 I2I API 赋予开发者使用文本指令、多图参考以及可选的交互框来编辑和重组图像的能力。这为修图、风格重塑和资产迭代提供了精确的、具备区域感知能力的控制。 |
探索 Wan 2.7 API 提供的卓越功能,涵盖从首帧到尾帧的精准控制、最多 5 个参考输入,以及原生同步音频、声音克隆和基于指令的视频编辑。
Wan 2.7 允许您同时设置起始帧和结束帧,然后生成两者之间的运动过渡。这为您提供了对每个片段发展轨迹的精确控制,非常适合匹配剪辑、画面变换以及基于故事板驱动的序列。
Wan 2.7 在单次请求中支持真人图像输入以及最多五个图像或视频参考。这确保了角色、外观和身份在整个视频片段中保持一致,即使在复杂的多主体场景中也是如此。
在编辑视频时,Wan 2.7 允许您保留原始音频轨道,或重新生成新的音频以匹配您的修改。这种灵活性既支持忠实于原画的编辑,也支持完全重构的场景。
Wan 2.7 通过简单的自然语言指令编辑或重新生成现有视频,无需手动添加遮罩。您可以应用风格迁移、更改场景并替换元素,从而让迭代式视频制作变得快速且可控。
Wan 2.7 能够一次性生成2到15秒的流畅高清视频。这一时长足以满足广告、产品演示和社交媒体叙事的需求,无需将较短的片段拼接在一起。
提供语音参考,Wan 2.7 即可在生成的视频中将其复现,并实现音色匹配与唇形同步。这保持了角色声音和外观的一致性,对于系列作品和个性化内容极具价值。
Wan 2.7 能够读取单一提示词中描述的多个镜头,并将其切分为一个连贯的序列。在各个镜头之间,主体、风格和转场保持一致,从而支持生成更长的叙事片段,而无需手动拼接。
Wan 2.7 生成的视频带有原生的音画同步音频,而不是独立的音轨。对话、音效和画面动作在一次生成中保持对齐,使得视频片段无需额外的音频后期制作即可直接使用。
将同一个提示词分别输入 Wan 2.7 API、一个领先的外部竞品,以及上一代 Wan 模型,看看各个模型如何把完全相同的文字转化为成片视频。
一只街头猫叼着一条银色鲭鱼,从鱼贩的推车上纵身跃下,飞快冲进拥挤的夜市。低机位跟拍镜头追随它在摊位桌腿间穿梭、踏过水洼,头顶霓虹招牌化作光 streak 掠过。镜头快速甩向鱼贩,只见他无奈地举起双手,随后又迅速切入高速推轨近景:猫猛地滑停,回头瞥了一眼,随即钻进旁边小巷;几乎同时,鱼贩大笑着冲出来追了上去。温暖的霓虹倒影、湿漉漉的鹅卵石路、浅景深、粗粝的电影级写实风格。环境音包含夜市人声、炒锅滋滋声,以及与猫飞奔节奏同步的俏皮欢快律动。16:9 aspect ratio。
Generated with Wan-2.7 on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Wan-2.2 on Atlas Cloud
Anime cel-shaded style。一位年轻女巫在黎明时分从屋顶蹬地起飞,骑着扫帚掠过雾气弥漫的海滨小镇,围巾在风中猎猎作响。一个大范围 drone shot 围绕她盘旋拍摄,她在钟楼之间侧身转弯,随后切入第一人称 POV,朝着闪耀的港湾俯冲,受惊的海鸥从她翼尖般的扫帚旁四散飞过。镜头切到低机位英雄式画面:她在最后一刻猛然拉起,贴着水面掠过,激起一道朝向日出的水花弧线。鲜艳的手绘天空、体积光、流畅的工作室级动画。呼啸的风声、昂扬的管弦乐渐强,以及拉起瞬间的一记胜利感鼓点。16:9 aspect ratio。
Generated with Wan-2.7 on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Wan-2.2 on Atlas Cloud
探索您可以使用 Wan 2.7 API 构建的内容:从广告、产品演示和社交内容,到角色驱动视频、创意原型设计和本地化。
借助 Wan 2.7 API,通过文本或图像参考生成精美的广告创意、宣传短片和落地页视频。在所有输出结果中锁定品牌视觉效果,从而大规模生成营销活动变体。
将演示者参考图像与产品图像相结合,以创建演示和生活方式片段,并在新场景中保持演示者形象的一致性。这适用于电子商务列表、产品发布和教程内容。
批量生成短视频引流片段、生活方式短片和场景转场,然后使用 Wan 2.7 Edit API 替换背景或改变基调。角色一致性确保了固定人设在每日发布的内容中具有高辨识度。
在一次调用中传递最多五个图像、视频或音频参考,以锁定外观、声音、唇形同步和摄像机运动。这使得 Wan 2.7 在处理多角色场景和系列内容时非常可靠。
在正式制作之前,通过在几分钟内生成具有不同场面调度、灯光或角色互动的多种变体来制作场景原型。首尾帧控制赋予导演对每个镜头发展轨迹的精确掌控。
通过 Edit API,只需输入一条自然语言指令即可针对不同市场对现有视频进行改编,例如替换背景或改变基调。这能将一个原始片段转化为多个区域版本,而无需重新拍摄。
查看不同厂商的模型表现 — 对比性能、价格和独特优势,做出明智决策。
| 模型 | 输入类型 | 输出时长 | 分辨率 |
|---|---|---|---|
| Wan 2.7 | 文本、图像、视频、音频 | 2~15s | 1080P, 720P |
| Seedance 2.0 | 文本、图像、视频、音频 | 4~15s | 4K, 1440P, 1080P, 720P, 480P |
| Kling 3.0 | 文本、图像、视频、音频 | 3~15s | 1080P, 720P |
| Veo 3.1 | 文本、图像 | 4s;6s;8s | 1080P, 720P |
| Wan 2.6 | 文本、图像、视频、音频 | 5s;10s;15s | 1080P, 720P |
几分钟即可上手 — 按照以下简单步骤,通过 Atlas Cloud 平台集成和部署模型。
在 atlascloud.ai 注册并完成验证。新用户可获得免费额度,用于探索平台和测试模型。
将先进的 Wan 2.7 模型与 Atlas Cloud 的 GPU 加速平台相结合,提供无与伦比的性能、可扩展性和开发体验。
低延迟:
GPU 优化推理,实现实时响应。
统一 API:
一次集成,畅用 Wan 2.7、GPT、Gemini 和 DeepSeek。
透明定价:
按 Token 计费,支持 Serverless 模式。
开发者体验:
SDK、数据分析、微调工具和模板一应俱全。
可靠性:
99.99% 可用性、RBAC 权限控制、合规日志。
安全与合规:
SOC 2 Type II 认证、HIPAA 合规、美国数据主权。
Wan 2.7 API 为开发者提供了访问阿里巴巴一站式视频套件的权限,涵盖文生视频、图生视频、参考图生视频、视频编辑以及图像生成。它可生成长达 15 秒、带有同步音频的原生 1080p 视频片段。在 Atlas Cloud 上,您可以通过一个统一的 API 调用它以及另外 300 多个模型。
Wan 2.7 将最大片段长度从 Wan 2.6 的约 5 秒延长至 15 秒,并在视觉清晰度、同步音频和运动一致性方面实现了重大提升。它还通过首尾帧引导和多达五个参考图像拓宽了控制范围。这两个版本均可通过一个统一的 API 在 Atlas Cloud 上访问。
是的。Wan 2.7由Alibaba基于Apache 2.0许可证发布,模型权重和推理代码已托管在HuggingFace和GitHub上,因此您可以自托管、修改和重新分发该模型。在本地运行它需要配备至少16GB显存(VRAM)的GPU,而Atlas Cloud托管了Wan 2.7 API,让您可以免除基础设施的配置。
是的。Wan 2.7 API 能够生成带有原生、音画同步音频的视频,而非独立的配乐。它还支持声音克隆技术,只需提供一段参考声音,即可在整个视频片段中重现该声音,并确保音色匹配与唇形同步。
是的。Atlas Cloud 提供兼容 OpenAI 的 API,因此您可以将 OpenAI SDK 指向 Atlas Cloud 的基础 URL,添加您的 Atlas 密钥,并使用您现有的代码调用 Wan 2.7 API。您可以在几分钟内发出首个请求,而无需构建新的集成。
Wan 2.7 API 可生成2至15秒的文生视频和图生视频片段,以及2至10秒的参考生视频片段。输出为原生1080p,支持720p,且包含16:9、9:16、1:1、4:3和3:4等宽高比。
Wan 2.7 Video Edit API 可根据自然语言指令转换现有视频,无需手动遮罩。您可以应用风格迁移、更改场景、替换元素和重新生成素材,并且可以选择保留原始音频或重新生成新的音轨。
指南、教程与产品动态,助你充分发挥 Atlas Cloud 的价值。