
Kling v2.6 是 Kuaishou 的影片模型系列,專為電影級文字生成影片與圖片生成影片、AI 虛擬人物,以及參考圖驅動的動作遷移而設計。支援彈性長寬比、增強動態效果、穩定的人物識別,以及適用於各種專門工作流程的時間一致性。Atlas Cloud 透過一致的端點提供 Pro 與 Standard 選項,並採透明的按用量計費定價。立即開始建置。
Kling 2.6 由 Kuaishou 開發。Atlas Cloud(由 Atlas Cloud AI LLC 營運)僅提供接取服務,並不擁有該模型。所有商標均歸其各自所有者所有。
將每個 Kling v2.6 端點與其支援的輸入工作流程、生產優勢及適用的影片使用情境相互對應。
| 模態 | 描述 |
|---|---|
| Kling v2.6 Pro Avatar API (Avatar To Video) | 專為高階虛擬角色生成而設計,此端點可產出細節清晰、動作穩定且身分一致性高的高品質影片。適合製作精緻的個人檔案影片、自我介紹及社群內容。 |
| Kling v2.6 Std Avatar API (Avatar To Video) | 選擇 Standard Avatar 端點,即可建立細節清晰、具電影感動態且能可靠遵循提示詞的 AI 虛擬角色影片。其功能適合個人檔案、簡短自我介紹及持續性的社群媒體內容製作。 |
| Kling v2.6 Pro Motion Control API (Reference Motion To Video) | 參考動作片段可將舞蹈、動作或手勢套用至角色影像或來源影片,同時維持身分與時間一致性。適合用於製作流暢的角色動畫,使其遵循特定的錄製動作。 |
| Kling v2.6 Std Motion Control API (Image And Motion To Video) | 提供包含舞蹈、動作或手勢的動作片段,即可為靜態角色影像製作動畫。此端點會擷取其中的動作,為易於使用的動作轉移工作流程生成流暢且逼真的影片。 |
| Kling v2.6 Pro API (Text To Video) | 透過此 Kuaishou 模型,文字提示詞可轉換為具電影感、支援聲音生成及彈性長寬比的影片。適用於概念開發、敘事場景、廣告及其他以提示詞驅動的影片專案。 |
| Kling v2.6 Pro API (Image To Video) | 以影像為起點,此端點可建立具電影感、支援聲音生成及強化動態效果的影片。當需要維持受控的視覺連貫性時,可將產品視覺、插畫或創意靜態影像轉化為生動影片。 |
Kling v2.6 結合原生視聽生成、文字與影像工作流程、以參考素材驅動的動態控制、音訊驅動的虛擬人、彈性參數,以及 Standard 和 Pro endpoints 的按用量付費存取方式。
Kling v2.6 Pro 可從文字提示或來源影像同時生成影片與聲音。Atlas Cloud 的 Text to Video 和 Image to Video endpoints 預設啟用聲音開關,因此對白、音效與環境音都能隨場景發展自然呈現。對於需要連貫視聽效果、又不想另外處理聲音的短篇敘事影片來說,這項功能非常適合。
使用 Pro generation endpoints,從文字描述的場景開始生成,或讓靜態影像動起來。文字提示支援 1:1、9:16 和 16:9 輸出,兩種路徑都提供 5 或 10 秒時長、聲音開關、negative prompts,以及 0 到 1 的 CFG 控制。影像輸入支援最大 10 MB 的 JPG、JPEG 或 PNG 檔案,讓開發者能實際掌控社群、產品與電影感素材。
將角色影像與參考動態影片交給 Kling v2.6 Motion Control,即可在維持身分特徵與時間一致性的同時,轉移完整的舞蹈、動作或手勢序列。參考影片長度可介於 3 到 30 秒。你可以選擇構圖要依照影像還是動態影片,也能決定是否保留來源音訊。這項功能適合連續表演、角色動畫與動作導向的行銷活動。
Standard 和 Pro Avatar endpoints 需要影像與音訊軌道作為輸入,另可選擇加入提示來引導生成結果。Pro 著重於清晰細節、穩定動態與高度身分一致性;Standard 則結合電影感動態與可靠的提示遵循能力。當可辨識的主體需要在個人檔案影片、品牌介紹或持續更新的社群內容中呈現預先準備好的音訊時,適合採用這條生成路徑。
依據工作負載選擇 Standard 或 Pro endpoints,並透過 Atlas Cloud 只為實際發出的呼叫付費。Standard Avatar 每次呼叫 $0.056 起,Standard Motion Control 為 $0.07,Pro Text to Video 和 Image to Video 為 $0.07,Pro Avatar 或 Motion Control 則為 $0.112。一個帳號即可使用全部六個 endpoints,協助開發者在不承諾訂閱的情況下,平衡視覺品質、動態需求與製作成本。
看看 Kling v2.6 與兩種 Atlas Cloud 替代方案,如何使用相同提示詞詮釋寫實動作與風格化敘事。
一部 8–10 秒、超寫實的時尚廣告影片,場景設定於正午時分、遼闊的白色鹽湖:六名高速滑行者披著虹彩鏡面斗篷,組成精準的幾何「風箏採鹽小隊」,每人拉著繃緊的鈷藍色與螢光橙色繩索,連接到一只巨大的魟魚風箏。以垂直俯拍的無人機鏡頭開場,同步隊形在鹽殼上劃出銳利如刀的圖案;無人機突然俯衝,並在距離地面僅幾英寸處拉平鏡頭,跟隨領隊加速前進,小隊穿梭於飄動的旗門之間,斗篷啪然作響,繩索以逼真的張力彎曲。當突如其來的塵捲風在他們身旁爆發,將鬆散的鹽晶捲入空中時,鏡頭快速甩移並進行 360 度環繞;六名騎手完美同步地做出反應,迅速收緊繩索,魟魚風箏折入戲劇性的俯衝姿態,穿透晶體漩渦,在高速前進的小隊上方散落閃耀鹽晶,如絢麗降雪。從頭到尾保持連續且協調的動作,每個鏡頭中的人物身分與隊形都一致,呈現可信的滑行動能、符合物理的繩索張力、空氣動力學般的布料運動、細緻的鹽粒、風湍流與貼地陰影。猛烈的頭頂陽光、清晰高對比的頂光,鏡面斗篷與鹽面上映射出棱彩虹光,以雪白、鈷藍與螢光橙構成分層畫面;高級超現實高級時裝廣告美學、銳利如刀的電影級細節,充滿活力的打擊樂與每次刻滑及鏡頭轉場同步,伴隨呼嘯風聲、刀刃刮擦聲、布料啪響聲、繩索收緊聲,最後以明亮的晶體嘶鳴聲收尾。不要慢動作,不要靜態填充鏡頭,不要破壞空間連續性的剪接,不要變形身體,不要重複人物,不要打結或斷開的繩索,不要不一致的服裝,不要漂浮物體,不要螢幕、軟體介面、儀表板、進度列、圖表、字幕、標誌、浮水印或可讀文字。16:9 長寬比。
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
一段 8–10 秒、連續的電影級深海追逐場景,發生在一艘腐朽沉船內部、嚴重傾斜的宴會廳中:以半透明擬態章魚觸手的極近距離微距鏡頭開場,觸手在破裂的水晶吊燈中閃爍,猛然抓住一顆發光的「珍珠」;鏡頭迅速向後推拉變焦,揭示章魚正從腐蝕的欄杆上盪過翻倒的餐桌,下方海鰻穿梭於椅子之間追逐它,餐具、玻璃碎片、沉積物與氣泡鏈在可信的水下物理效果中上升並彼此碰撞。轉入緊湊的 360 度環繞追逐鏡頭,章魚持續改變皮膚紋理與半透明度,使其匹配天鵝絨窗簾、失去光澤的黃銅與覆滿藤壺的木材,接著噴出濃密墨汁,捲曲形成令人信服的章魚形誘餌;海鰻襲向虛假的輪廓,真正的章魚則從旁滑過。鏡頭甩移並翻轉,進入戲劇性傾斜的俯拍視角:被偷走的「珍珠」突然睜開一隻小眼睛,琥珀色光芒逐漸增強,巨大且經過偽裝的鮟鱇魚臉龐從宴會桌下浮現——珍珠就是它的誘餌;章魚滑稽地僵住一拍,鮟鱇魚隨即朝鏡頭猛撲而來。逼真的深海電影級寫實風格,冷青色環境光與溫暖的琥珀色生物螢光形成對比,體積水效果、漂浮粒子、高密度軟體觸手運動、流體模擬、漂浮物碰撞、無縫主體連續性、符合物理的動能、清晰易讀的動作,不要慢動作。沉浸式同步音效:低沉的船殼呻吟聲、水晶碰撞聲、氣泡奔湧聲、海鰻咬擊聲、脈動的追逐打擊樂、濕潤的墨汁爆發聲,接著在揭露真相時突然響起低音重擊。不要螢幕、介面、儀表板、進度列、圖表、字幕、副標、標誌、浮水印或解說文字。16:9 長寬比
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
從電影感提示詞與動畫行銷靜幀,到一致的虛擬形象與動作引導表演,Kling v2.6 支援開發者創作電影、廣告、社群內容與品牌角色。
使用 Kling v2.6 Pro Text to Video,搭配彈性的畫面比例與生成音效,將文字概念轉化為電影感影片。電影創作者只需單一提示詞,即可製作預告片、戲劇性橋段與視覺提案原型。
透過更豐富的動態、電影級畫質與生成音效,讓產品圖片或行銷靜幀栩栩如生。行銷團隊可運用現有美術素材製作上市預告、視覺示範與社群宣傳內容。
透過 Pro Avatar 模型,建立細節清晰、動作穩定且身分一致性高的精緻虛擬形象影片。可用於個人檔案介紹、主持人片段與持續經營的品牌社群人物。
將舞蹈、動作或手勢影片套用到角色圖片上,同時維持角色身分與時間一致性。創作者可根據錄製的動作製作編舞測試、動畫吉祥物與表演導向的社群短片。
透過 Pro Motion Control,將參考片段中的動作套用到角色圖片或來源影片上。製作團隊可探索替代演員、風格化動作場景與一致的角色動畫。
從文字提示詞開始,在彈性的畫面比例下生成帶有音效的電影感影片。開發者無需提供開場圖片,即可自動化製作短篇行銷概念、創作者內容與平台專屬視覺素材。
比較 Kling v2.6 與領先的文字轉影片模型在供應商、片段時長、原生音訊及標準基礎價格方面的差異。
| 模型 | 供應商 | 輸出時長 | 原生音訊 | 標準基礎價格 |
|---|---|---|---|---|
| Kling v2.6 Pro Text-to-Video | Kuaishou | 5 或 10 秒 | √ | $0.07/秒 |
| Seedance 2.0 Text-to-Video | ByteDance | 4 至 15 秒 | √ | $0.112/秒 |
| Wan-2.7 Text-to-video | Qwen | 2 至 15 秒 | √ | $0.10/秒 |
| Veo 3.1 Lite Text-to-video | 4、6 或 8 秒 | √ | $0.05/秒 |
幾分鐘即可上手 — 按照以下簡單步驟,透過 Atlas Cloud 平台整合和部署模型。
在 atlascloud.ai 註冊並完成驗證。新用戶可獲得免費額度,用於探索平台和測試模型。
將先進的 Kling 2.6 模型與 Atlas Cloud 的 GPU 加速平台相結合,提供無與倫比的效能、可擴展性和開發體驗。
低延遲:
GPU 最佳化推理,實現即時回應。
統一 API:
一次整合,暢用 Kling 2.6、GPT、Gemini 和 DeepSeek。
透明定價:
按 Token 計費,支援 Serverless 模式。
開發者體驗:
SDK、資料分析、微調工具和模板一應俱全。
可靠性:
99.99% 可用性、RBAC 權限控制、合規日誌。
安全與合規:
SOC 2 Type II 認證、HIPAA 合規、美國資料主權。
Kling v2.6 是可透過 Atlas Cloud 使用的 Kuaishou AI 影片模型系列,包含 Pro Text-to-Video 與 Image-to-Video 生成,以及適用於虛擬角色和動作控制的 Standard 與 Pro endpoints。
您可以根據提示詞建立影片、讓來源圖片產生動畫、使用圖片和音訊製作虛擬角色影片,或將參考片段中的舞蹈、動作和手勢序列轉移至角色。Pro Text-to-Video 與 Image-to-Video endpoints 還能在生成畫面的同時產生音效。
若從提示詞開始,請選擇 Text-to-Video;若要讓靜態圖片產生動畫,請選擇 Image-to-Video。Avatar endpoints 會將圖片與提供的音訊配對,而 Motion Control 則會將參考影片中的動作套用至角色。
使用您的 Atlas Cloud API key、確切的 model ID,以及該 endpoint 專用的輸入內容,向 `/api/v1/model/generateVideo` 傳送 POST 請求。非同步回應會提供 prediction ID,您可以透過 `/api/v1/model/prediction/{id}` 查詢,直到任務完成。
可用控制項會依 endpoint 而異。Text-to-video 支援 prompts、negative prompts、1:1、9:16 和 16:9 長寬比、5 或 10 秒的影片長度、sound,以及 guidance scale;其他工作流程則會依需求增加 image、audio、motion video、orientation 或 sound-retention 等輸入。
對於 Pro Text-to-Video 與 Image-to-Video,`sound` 參數可控制同步音效生成。Avatar models 則需要將 audio input 與角色圖片一併提供,而 Motion Control 可以保留參考影片的原始音效。
Atlas Cloud 列出的標準費率為 Pro Text-to-Video、Pro Image-to-Video 和 Standard Motion Control 每秒 $0.07。Standard Avatar 每秒 $0.056;Pro Avatar 和 Pro Motion Control 每秒 $0.112。上述費率採用原價,不含促銷價格。
請準備一張 JPG、JPEG 或 PNG 格式的角色圖片,以及一部 MP4 或 MOV 格式的動作影片。每個檔案不得超過 10 MB,兩個尺寸方向都至少須有 300 pixels,且長寬比需介於 1:2.5 與 2.5:1 之間。
首先確認 model ID、Bearer 驗證、必要欄位,以及 endpoint 專用的媒體限制。如果任務已被接受,請持續輪詢其 prediction ID,直到任務完成或失敗,並檢查回傳的錯誤訊息。若出現視覺不一致,請簡化場景並使用清晰的來源媒體,尤其是在轉移臉部動作或與複雜物件互動時。
指南、教學與產品動態,助你充分發揮 Atlas Cloud 的價值。