
Kling v2.6 是快手的视频模型系列,支持电影级文生视频和图生视频创作、AI 数字人以及基于参考内容的运动迁移。它支持灵活的画面比例、更丰富的动态效果、稳定的主体身份和跨专业工作流的时间一致性。Atlas Cloud 通过统一的端点提供 Pro 和 Standard 选项,并采用透明的按量付费定价。立即开始构建。
Kling 2.6 由 Kuaishou 开发。Atlas Cloud(由 Atlas Cloud AI LLC 运营)仅提供接入服务,并不拥有该模型。所有商标均归其各自所有者所有。
将每个 Kling v2.6 端点与其支持的输入工作流、生产优势和适用的视频使用场景进行匹配。
| 模态 | 描述 |
|---|---|
| Kling v2.6 Pro Avatar API (Avatar To Video) | 专为高品质头像生成而设计,该端点可生成细节清晰、运动稳定且身份一致性强的视频。适用于精致的个人资料视频、自我介绍和社交媒体内容。 |
| Kling v2.6 Std Avatar API (Avatar To Video) | 选择 Standard Avatar 端点,即可创建细节清晰、运动具有电影感且提示词遵循度可靠的 AI 头像视频。其能力适合个人资料视频、简短介绍以及持续性的社交媒体内容制作。 |
| Kling v2.6 Pro Motion Control API (Reference Motion To Video) | 参考动作片段可将舞蹈、动作或手势迁移到角色图像或源视频中,同时保持身份一致性和时间一致性。适用于根据特定录制动作生成流畅角色动画。 |
| Kling v2.6 Std Motion Control API (Image And Motion To Video) | 提供包含舞蹈、动作或手势的动作片段,即可让静态角色图像动起来。该端点会提取其中的动作,并生成流畅、逼真的视频,适合易于使用的动作迁移工作流。 |
| Kling v2.6 Pro API (Text To Video) | 通过该 Kuaishou 模型,文本提示词可生成带有声音和灵活宽高比的电影感视频。支持概念开发、叙事场景、广告以及其他由提示词驱动的视频项目。 |
| Kling v2.6 Pro API (Image To Video) | 以图像为起点,该端点可生成带声音且动态表现更丰富的电影感视频。当需要保持视觉连续性时,可将产品视觉素材、插画或创意静态图像转化为生动视频。 |
Kling v2.6 集原生视听生成、文本与图像工作流、参考驱动的动作控制、音频驱动的数字人、灵活参数以及 Standard 和 Pro 端点的按量付费访问于一体。
Kling v2.6 Pro 可根据文本提示词或源图像同时生成视频和声音。Atlas Cloud 的 Text to Video 和 Image to Video 端点默认启用声音开关,因此对白、音效和环境声可以随着场景展开自然呈现。对于需要连贯视听效果、又不想单独进行声音后期处理的短篇叙事视频,这是非常合适的选择。
使用 Pro 生成端点从文字描述的场景开始,或让静态图像动起来。文本提示词支持 1:1、9:16 和 16:9 输出;两种路径均支持 5 秒或 10 秒时长、声音开关、负面提示词,以及 0 到 1 的 CFG 控制。图像输入支持不超过 10 MB 的 JPG、JPEG 或 PNG 文件,为社交媒体、产品展示和电影感素材提供实用的开发控制能力。
向 Kling v2.6 Motion Control 提供角色图像和动作参考视频,即可迁移完整的舞蹈、动作或手势序列,同时保持身份特征和时间一致性。参考视频时长可为 3 到 30 秒。你可以选择构图跟随图像还是动作视频,并决定是否保留源音频。生成结果适用于连续表演、角色动画和动作导向的营销活动。
Standard 和 Pro Avatar 端点要求输入一张图像和一条音轨,并支持使用可选提示词引导生成结果。Pro 更注重细节清晰度、动作稳定性和较强的身份一致性;Standard 则将电影感动作与可靠的提示词遵循能力结合起来。当可识别的主体需要在个人简介视频、品牌介绍或持续更新的社交内容中演绎预先准备好的音频时,可以使用这条路径。
根据工作负载选择 Standard 或 Pro 端点,然后通过 Atlas Cloud 仅为实际发起的调用付费。Standard Avatar 起价为每次调用 $0.056,Standard Motion Control 为 $0.07,Pro Text to Video 和 Image to Video 为 $0.07,Pro Avatar 或 Motion Control 为 $0.112。一个账户即可覆盖全部六个端点,帮助开发者在无需订阅承诺的情况下平衡视觉质量、动作需求和制作成本。
了解 Kling v2.6 及两款 Atlas Cloud 替代模型如何针对相同提示词,演绎写实动作与风格化叙事。
一部时长 8–10 秒、超写实的时尚广告影片,场景设定在正午时分广阔的白色盐湖上:六名身披彩虹镜面斗篷的高速滑行者组成精准的几何“风筝盐采集团队”,每个人都牵引着绷紧的钴蓝色与荧光橙色线绳,这些线绳连接到一只巨大的蝠鲼风筝。以垂直俯拍的无人机镜头开场,同步编队在盐壳上刻画出锋利如剃的图案;无人机突然俯冲并贴近地面,从距离地面几英寸的高度拉平飞行,跟随领队加速前进,团队穿过不断飘动的旗门蛇形滑行,斗篷猎猎作响,绳索以真实张力弯曲。突然有一股尘卷风在他们身旁爆发,镜头快速甩拍切入 360 度环绕运动;松散的盐晶被卷入空中。六名骑手完美同步地做出反应,猛然收紧线绳,蝠鲼风筝折叠成戏剧性的俯冲姿态,穿透晶体漩涡,将闪耀的盐粒如 dazzling snowfall 般洒落在高速前进的团队上。全程保持从头到尾连续且协调的动作,每个镜头中的人物身份与队形保持一致,展现可信的滑行惯性、符合物理规律的绳索张力、空气动力学织物运动、细腻的盐粒、风 turbulences 与贴地阴影。刺眼的头顶阳光,清晰高对比度的顶部光照,镜面斗篷与盐湖表面映出棱彩虹色反射;以雪白、钴蓝色和荧光橙色构成分层画面,呈现高端超现实高时尚广告美学,电影级锐利细节,充满活力的打击乐与每次刻滑和镜头转场同步,伴随呼啸风声、刀刃刮擦声、织物拍击声、绳索收紧声,最终以明亮的晶体嘶鸣声收尾。不要慢动作,不要静态填充镜头,不要破坏空间连续性的剪辑,不要身体变形,不要人物重复,不要缠绕或断开的绳索,不要服装不一致,不要漂浮物体,不要屏幕,不要软件界面,不要仪表盘,不要进度条,不要图表,不要字幕,不要标志,不要水印,不要可读文字。16:9 宽高比。
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
一段时长 8–10 秒、连续不断的电影感深海追逐,场景位于一艘腐朽沉船中严重倾斜的舞厅内部:从半透明拟态章鱼的一条触手开始极近距离微距拍摄,它穿过破裂的吊灯水晶闪烁而行,并抓住一颗发光的“珍珠”;镜头快速向后推拉变焦,展现章鱼从腐蚀的栏杆上摆荡而过,越过倾倒的餐桌, mientras 海鳗穿梭于椅子之间追捕它;餐具、玻璃碎片、沉积物与一串串气泡在可信的水下物理效果中上升并彼此碰撞。随后转入紧凑的 360 度环绕追逐镜头,章鱼持续改变皮肤纹理与半透明度,使其匹配天鹅绒窗帘、失去光泽的黄铜和覆满藤壶的木材,接着喷出浓密的墨云,卷曲成一个逼真的章鱼形诱饵;海鳗攻击这个虚假的轮廓,而真正的章鱼从它们身旁悄然溜过。镜头快速甩拍并翻滚,转入戏剧性倾斜的俯视角:被偷走的“珍珠”突然睁开一只小眼睛,琥珀色光芒增强,巨大的伪装鮟鱇鱼脸庞从宴会桌下浮现——珍珠正是它的诱饵;章鱼滑稽地僵住一拍,鮟鱇鱼随即朝镜头猛扑而来。照片级深海电影写实感,冰冷的青色环境光与温暖的琥珀色生物荧光形成对比,体积水效果,漂浮颗粒,高密度软体触手运动,流体模拟,漂浮物碰撞,主体连续性无缝衔接,符合物理规律的惯性,清晰易读的动作表现,不要慢动作。沉浸式同步音效:沉闷的船体呻吟声、水晶碰撞声、气泡奔涌声、海鳗咬合声、脉冲式追逐打击乐、湿润的墨汁爆发声,随后在揭示真相时突然加入低音重击。不要屏幕、界面、仪表盘、进度条、图表、字幕、副标题、标志、水印或解释性文字。16:9 宽高比
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
从电影感提示词和动画营销静帧,到一致性头像与动作引导表演,Kling v2.6 支持开发者创作电影、广告、社交内容和品牌角色。
使用 Kling v2.6 Pro Text to Video,通过灵活的画面比例和生成音效,将文字构想转化为电影感视频。电影人只需一个提示词,即可制作预告片、戏剧化片段和视觉提案原型。
借助增强的动态表现、电影级画质和生成音效,让产品图片或营销静帧焕发生命力。营销团队可以基于现有素材制作上市预告、视觉演示和社交媒体推广内容。
通过 Pro Avatar 模型,创建细节清晰、动作稳定且身份一致性出色的精致头像视频。可用于个人简介、演示者片段以及持续运营的品牌社交媒体角色。
将舞蹈、动作或手势素材映射到角色图片上,同时保持身份和时间一致性。创作者可以利用录制的动作制作编舞测试、动画吉祥物和表演类社交短视频。
通过 Pro Motion Control,让角色图片或源视频呈现参考片段中的动作,同时保持角色一致性。制作团队可以探索不同表演者、风格化动作序列和一致的角色动画。
从文本提示词开始,以灵活的画面比例生成带声音的电影感视频。开发者无需提供开场图片,即可自动化生成短篇营销创意、创作者内容和适配不同平台的视觉素材。
从提供商、片段时长、原生音频和标准基础价格等维度,对比 Kling v2.6 与领先的文生视频模型。
| 模型 | 提供商 | 输出时长 | 原生音频 | 标准基础价格 |
|---|---|---|---|---|
| Kling v2.6 Pro Text-to-Video | Kuaishou | 5 秒或 10 秒 | √ | $0.07/秒 |
| Seedance 2.0 Text-to-Video | ByteDance | 4 至 15 秒 | √ | $0.112/秒 |
| Wan-2.7 Text-to-video | Qwen | 2 至 15 秒 | √ | $0.10/秒 |
| Veo 3.1 Lite Text-to-video | 4 秒、6 秒或 8 秒 | √ | $0.05/秒 |
几分钟即可上手 — 按照以下简单步骤,通过 Atlas Cloud 平台集成和部署模型。
在 atlascloud.ai 注册并完成验证。新用户可获得免费额度,用于探索平台和测试模型。
将先进的 Kling 2.6 模型与 Atlas Cloud 的 GPU 加速平台相结合,提供无与伦比的性能、可扩展性和开发体验。
低延迟:
GPU 优化推理,实现实时响应。
统一 API:
一次集成,畅用 Kling 2.6、GPT、Gemini 和 DeepSeek。
透明定价:
按 Token 计费,支持 Serverless 模式。
开发者体验:
SDK、数据分析、微调工具和模板一应俱全。
可靠性:
99.99% 可用性、RBAC 权限控制、合规日志。
安全与合规:
SOC 2 Type II 认证、HIPAA 合规、美国数据主权。
Kling v2.6 是可通过 Atlas Cloud 使用的快手 AI 视频模型系列。它包含用于 Pro 文生视频和图生视频的能力,以及用于数字人和动作控制的 Standard 和 Pro 端点。
你可以根据提示词生成视频、让源图像动起来、根据图像和音频生成数字人视频,或将参考视频中的舞蹈、动作和手势序列迁移到角色上。Pro Text-to-Video 和 Pro Image-to-Video 端点还可以在生成画面的同时生成声音。
如果从提示词开始,请选择 Text-to-Video;如果要让静态图像动起来,请选择 Image-to-Video。Avatar 端点会将图像与提供的音频结合,而 Motion Control 会将参考视频中的动作应用到角色上。
向 `/api/v1/model/generateVideo` 发送 POST 请求,并提供 Atlas Cloud API 密钥、准确的模型 ID 以及端点所需的输入参数。异步响应会返回 prediction ID,你可以通过 `/api/v1/model/prediction/{id}` 持续查询,直到任务完成。
具体控制项因端点而异。Text-to-Video 支持提示词、负面提示词、1:1、9:16 和 16:9 宽高比、5 秒或 10 秒时长、声音以及 guidance scale;其他工作流则会根据适用情况增加图像、音频、动作视频、方向或保留声音等输入。
对于 Pro Text-to-Video 和 Pro Image-to-Video,`sound` 参数用于控制同步声音生成。Avatar 模型则要求将音频输入与角色图像一并提供,而 Motion Control 可以保留参考视频的原始声音。
Atlas Cloud 列出的标准价格为:Pro Text-to-Video、Pro Image-to-Video 和 Standard Motion Control 均为每秒 $0.07。Standard Avatar 为每秒 $0.056,Pro Avatar 和 Pro Motion Control 均为每秒 $0.112,以上均采用原价,不含促销价格。
准备一张 JPG、JPEG 或 PNG 格式的角色图像,以及一个 MP4 或 MOV 格式的动作视频。每个文件不得超过 10 MB,两个维度均至少为 300 像素,宽高比需介于 1:2.5 和 2.5:1 之间。
首先确认模型 ID、Bearer 身份验证、必填字段以及端点特定的媒体限制。如果任务已被接受,请持续查询其 prediction ID,直到任务完成或失败,并检查返回的错误信息。如果画面存在不一致,请简化场景并使用清晰的源媒体,尤其是在迁移面部动作或处理与复杂物体的交互时。
指南、教程与产品动态,助你充分发挥 Atlas Cloud 的价值。