
Kling v2.1 是 Kuaishou 面向开发者打造生产级视频工作流的 AI 视频模型系列。该系列支持快速 720p 草稿生成、清晰流畅的图像动画、专业级视觉深度、复杂提示词理解、先进的运动逻辑,以及增强的动态镜头渲染。通过 Atlas Cloud 的统一 API,使用一个 OpenAI 兼容密钥即可访问这些能力,并享有 Day-0 模型可用性。立即开始构建。
Kling 2.1 由 Kuaishou 开发。Atlas Cloud(由 Atlas Cloud AI LLC 运营)仅提供接入服务,并不拥有该模型。所有商标均归其各自所有者所有。
选择符合源素材、运动要求和制作流程的 Kling v2.1 endpoint。
| 模态 | 描述 |
|---|---|
| Kling v2.1 I2V Pro Start End Frame API | 提供起始帧和结束帧,生成两幅图像之间具有受控运动连贯性的视频。更流畅的场景过渡使该 endpoint 适用于规划好的镜头切换、视觉序列和明确的故事节拍。 |
| Kling v2.1 T2V Master API (Text To Video) | 将复杂的文本提示词转化为视频,并呈现先进的运动逻辑和增强的动态镜头渲染效果。对于详细的场景指令、富有表现力的运动,以及依赖精心设计的镜头行为的创意概念,请选择此 endpoint。 |
| Kling v2.1 I2V Master API (Image To Video) | 专为专业级图生视频而打造,该 endpoint 可为源图像添加动画,同时保持精准的运动连贯性和视觉深度。适用于注重运动一致性与立体呈现的高品质创意制作。 |
| Kling v2.1 I2V Pro API (Image To Video) | 在将源图像转换为清晰流畅的视频时,兼顾生成速度与画面保真度。适用于一般创意制作,在无需依赖 Master endpoint 的情况下,也能获得稳定可靠的视觉质量。 |
| Kling v2.1 I2V Standard API (Image To Video) | 该 endpoint 适用于快速迭代,可将源图像转换为稳定可靠的 720p 视频。其速度优先的特性支持快速视觉草稿、早期概念评审和高效的视频原型制作。 |
Kling v2.1 通过一个 Atlas Cloud API 集成文生视频与图生视频、首尾帧条件控制、5 或 10 秒的视频片段、可调引导强度,以及 Standard、Pro 和 Master 版本。
Kling v2.1 Pro 支持同时指定首帧和尾帧,每张图片仅限 JPEG 或 PNG 格式,大小不超过 10 MB,且至少为 300 × 300 像素。模型会生成两个锚点之间的运动,同时保持过渡过程的连续性。你可以选择 5 秒或 10 秒的输出时长,用于设计揭示、变形和节奏紧凑的叙事段落。
Master 版本为高要求场景带来先进的运动逻辑、动态镜头渲染、精准连续性和视觉纵深。无论提示词要求快速追逐、层次丰富的角色运动,还是大幅度镜头移动,模型都致力于保持动作连贯。专业图生视频或复杂文生视频项目需要 Kling 系列最强能力时,可选择 Master。
你可以从文字开始创作,也可以让现有画面动起来,分别使用文生视频和图生视频模型。该系列提供 Standard、Pro 和 Master 三种基于图像的选项,Master 还支持文本提示词,并可选择 16:9、9:16 或 1:1 画幅。这种丰富的选择让一次集成即可覆盖快速草稿、常规创意制作和更具挑战性的电影级构想。
所有受支持的模型都可以设置为生成 5 秒或 10 秒的视频片段。较短的时长适合快速视觉测试,而较长的选项则能为运动、镜头变化和转场提供更多发展空间,无需更换生成 endpoint。Standard 针对快速 720p 草稿进行了优化,是将创意推进到 Pro 或 Master 之前的实用起点。
通过必填的正向提示词、可选的负向提示词,以及 0 到 1 的引导强度控制,塑造 Kling v2.1 的输出效果。调高或调低引导值,可以调整模型对提示词的遵循程度;负向提示词则用于指定希望模型避免的元素。这些控制项结合使用,有助于实现更明确的镜头语言、更整洁的构图,以及在不同创意变体之间进行可重复的迭代。
通过一个 Atlas Cloud API 访问全部五种变体,标准基础价格为:Standard $0.056、每个 Pro 选项 $0.098、每个 Master 选项 $0.28。仅需为实际发起的模型调用付费,并可根据生产需求变化灵活切换版本。一个兼容 OpenAI 的密钥即可将实验与部署统一在同一套集成中。
将两条完全相同的电影感提示词分别输入 Kling v2.1、Seedance 2.0 和 Kling V3.0 Turbo,对比动作连贯性、提示词遵循度、镜头控制和视觉叙事能力。
一段 8–10 秒的高能救援追逐:正午时分,广阔的盐湖被镜面般薄的水层覆盖。一名身穿钴蓝色赛车服的少女驾驶三轮陆地帆车全速追赶被猛烈阵风卷走的珊瑚红急救包。开场从极低机位的超近距离微距镜头拍摄锋利如刀的银白色盐晶,前轮疾驰掠过,闪耀的水花溅上镜头;随后加速切入横向跟拍,镜头与帆车并行飞驰,绷紧的帆布风帆在风中啪然作响,少女压低桅杆,从一群突然振翅飞起的火烈鸟下方穿过。镜头绕车快速甩 pan,进入充满动感的 360-degree 环绕镜头;一侧车轮在真实离心力作用下短暂离开水面。她探身而出却始终保持操控,用一只手勾住包带,将急救包拉上车。结尾镜头迅速升高,切入高空俯拍,展现帆车拖出的长长弧形尾迹——随后一只浑身湿透的小企鹅意外从敞开的包里探出脑袋,在少女惊喜又错愕的反应中发出叫声。确保每次镜头转场中人物、车辆、包和空间关系都保持完美连续;帆张力、车轮动力学、浅水飞溅、反射、火烈鸟避让、风阻和动量均符合物理规律。远处靛蓝色暴风云衬托着强烈、清晰的正午阳光,整体采用银白、钴蓝和珊瑚红的受控配色,呈现高级写实商业电影质感、触感细节、清晰自然的运动模糊和流畅连续的动作;不要慢动作或空洞的 establishing shots。沉浸式同步音效:呼啸的风声、拍击的帆布声、掠水而过的轮胎声、有节奏的水花声、翅膀拍击声、逐渐高涨的打击乐,以及揭示小企鹅时清晰的一声鸣叫。不得出现屏幕、软件界面、仪表盘、进度条、图表、字幕、标签、标志、水印或任何屏幕文字;不得出现解剖错误、主体重复、连续性跳跃、车辆几何形变、物体漂浮、不自然的物理效果或镜头抖动。16:9 画幅。
Generated with Kling v2.1 t2v Master on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
一段 8–10 秒的连续动画追逐:在凉爽的青 cyan 黄昏中,一位身穿靛蓝色围裙的老妇人在被狂风侵袭的白色地中海屋顶间追赶一条鲜艳的猩红色长围巾。围巾在突如其来的海风中自然地啪响、扭转并飘舞;老妇人跨越晾衣绳,沿倾斜的赤陶瓦屋顶滑下。开场使用低机位高速跟拍,镜头贴着狭窄屋脊掠过她奔跑的双脚;穿过疯狂飘动的白色床单,完成无缝遮挡转场;随后从上方俯冲而下,紧密环绕老妇人,围巾缠上风向标,并轻轻将一只受惊的橙色猫咪荡进她怀里。她接住猫咪却丝毫没有减慢脚步;风向标旋转,猫咪喵叫,她大笑起来,镜头快速甩拉后退,展现层层叠叠、向闪耀海面倾泻而下的海滨小镇。确保每次遮挡和镜头变化中人物、服装、猫咪和屋顶都保持精准连续;奔跑、跳跃、滑行和接住动作流畅且不中断,布料受复杂风力驱动并符合物理规律,具有强烈的前景到背景视差;采用富有表现力的手绘赛璐珞动画风格,搭配细腻的水彩背景;冷调青绿色暮光与温暖的琥珀色窗光形成对比,整幅画面中以猩红色围巾作为唯一高度饱和的视觉引导。加入有节奏的阵风、啪啪作响的晾衣物、瓦片上的急促脚步声、轻柔的金属风向标旋转声、一声受惊的喵叫、远处的海浪声,以及逐渐推向喜剧性接住动作高潮的活泼地中海弦乐。不得出现慢动作、静止镜头、文字、标志、边框或界面元素。16:9 画幅。
Generated with Kling v2.1 t2v Master on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
从文字概念和源图像出发,Kling v2.1 支持电影级预可视化、产品动态展示、可控帧间过渡、快速社交媒体草稿、艺术作品动画以及游戏场景规划,覆盖其 text to video 和 image to video 变体。
Kling v2.1 t2v Master 可运用先进的运动逻辑和动态镜头渲染来理解复杂提示词。导演和创意团队可以先将文字概念转化为电影级场景草稿,再决定是否投入制作资源。
通过 Pro endpoint,为产品图像添加锐利流畅的动态效果,同时兼顾生成速度与还原度。营销团队可以利用现有静态素材制作发布短片、店铺视觉内容和多种营销活动版本。
使用起始帧和结束帧引导动作连贯性,在两种视觉状态之间创建更流畅的过渡。适用于前后对比展示、场景衔接,以及具有明确起止点的规划性变换。
在速度至关重要时,Standard model 可生成稳定可靠的 720p image to video 草稿,支持快速迭代。社交媒体团队和独立创作者可以先测试动作创意、视觉吸引点和内容方向,再投入更高还原度的制作。
借助 i2v Master 的动作连贯性和视觉深度,让插画或角色静帧焕发生命力。艺术家可以在保留源图像视觉基础的同时,创作连续镜头、氛围循环或作品集内容。
需要根据文字简报生成动态游戏场景?Master text to video 可处理复杂提示词并渲染动态镜头,帮助开发者预览游戏环境、叙事节奏和电影化时刻。
按生成模式、片段时长、末帧控制和标准基础价格,对比 Atlas Cloud 上可用的 Kling v2.1 变体与其他视频模型。
| 模型 | 生成模式 | 片段时长 | 末帧控制 | 标准基础价格 |
|---|---|---|---|---|
| Kling v2.1 i2v Pro Start-end-frame | 起始帧和结束帧生成视频 | 5 or 10 sec | √ | $0.098 |
| Kling v2.1 t2v Master | 文本生成视频 | 5 or 10 sec | - | $0.28 |
| Kling v2.1 i2v Master | 图片生成视频 | 5 or 10 sec | - | $0.28 |
| Kling v2.1 i2v Pro | 图片生成视频 | 5 or 10 sec | - | $0.098 |
| Kling v2.1 i2v Standard | 图片生成视频 | 5 or 10 sec | - | $0.056 |
| Veo 3.1 Lite Start-End Frame to Video | 起始帧和结束帧生成视频 | 4, 6, or 8 sec | √ | $0.05 |
| Seedance 2.0 Image-to-Video | 图片生成视频 | 4 to 15 sec or auto | √ | $0.112 |
| Wan-2.7 Image-to-video | 图片生成视频 | 2 to 15 sec | √ | $0.10 |
几分钟即可上手 — 按照以下简单步骤,通过 Atlas Cloud 平台集成和部署模型。
在 atlascloud.ai 注册并完成验证。新用户可获得免费额度,用于探索平台和测试模型。
将先进的 Kling 2.1 模型与 Atlas Cloud 的 GPU 加速平台相结合,提供无与伦比的性能、可扩展性和开发体验。
低延迟:
GPU 优化推理,实现实时响应。
统一 API:
一次集成,畅用 Kling 2.1、GPT、Gemini 和 DeepSeek。
透明定价:
按 Token 计费,支持 Serverless 模式。
开发者体验:
SDK、数据分析、微调工具和模板一应俱全。
可靠性:
99.99% 可用性、RBAC 权限控制、合规日志。
安全与合规:
SOC 2 Type II 认证、HIPAA 合规、美国数据主权。
Kling v2.1 是快手推出的视频生成模型系列,支持文生视频和图生视频创作。Atlas Cloud 提供 Standard、Pro、Master 以及起止帧 endpoints,以满足不同的画质和控制需求。
使用 T2V Master 可将文本提示词转换为视频,或通过 Standard、Pro 和 Master I2V endpoints 让源图像动起来。起止帧版本可实现受控的运动连贯性,以及两张输入帧之间更平滑的过渡。
创建 Atlas Cloud API key,将其安全地保存在服务端环境中,然后向 /api/v1/model/generateVideo 发送经过身份验证的 POST 请求。使用返回的 prediction ID 监控任务,并在任务完成后从 outputs 中获取视频 URL。
当文本提示词是主要输入,且复杂运动逻辑或动态摄像机渲染很重要时,选择 T2V Master。对于图像动画,Standard 面向快速生成的 720p 草稿,Pro 在速度和保真度之间取得平衡,Master 优先保证运动连贯性和视觉深度,而起止帧 Pro 可同时控制边界帧。
可用控制项包括提示词、负面提示词、五秒或十秒时长,以及 guidance scale。T2V Master 还支持 16:9、9:16 和 1:1 宽高比;图像输入支持 JPG、JPEG 或 PNG 文件,大小上限为 10 MB,最低分辨率为 300 x 300 像素。起止帧 endpoint 还需要额外提供结束图像。
已验证的标准基础价格为:I2V Standard $0.056,I2V Pro 和起止帧 Pro 均为 $0.098,两个 Master endpoint 均为 $0.28。这些是原始标价,并非临时折扣价,因此提交前请查看当前请求预估费用。
先提交生成请求,Atlas Cloud 会返回 prediction ID,而不是已完成的视频。轮询 /api/v1/model/prediction/{prediction_id},直到 status 为 completed 或 succeeded,然后从 outputs 中读取生成的视频 URL。
向起止帧 endpoint 同时提供 image 和 end_image,并附带提示词。这两张边界帧会引导生成序列中的运动连贯性和过渡效果。每张图像都必须符合文档规定的格式、文件大小和分辨率要求。
不可以。除非某项功能出现在所选 endpoint 的 schema 中,否则应将 Kling 消费者应用中显示的功能视为无法通过 Atlas Cloud 模型系列使用。例如,这五个 endpoint 的已发布 schema 都没有提供 Multi-Elements 控制项。
首先确认 model ID、源图像、提示词、负面提示词、时长、guidance scale,以及适用时的宽高比都一致。已发布的 Atlas Cloud schema 没有为这些 endpoint 提供 seed 参数,因此无法通过列出的控制项配置完全确定性的重放。
指南、教程与产品动态,助你充分发挥 Atlas Cloud 的价值。