
Kling O1 是快手以多模態視覺語言技術打造的影片模型系列。其文字生成影片與圖片生成影片工作流程,將語言與視覺脈絡相互串聯,透過提示詞或來源圖片建立流暢的場景動態。Atlas Cloud 透過可立即使用的 REST API 提供這兩種模式,無冷啟動,並採透明的隨用隨付計費。立即開始建置。
Kling o1 由 Kuaishou 開發。Atlas Cloud(由 Atlas Cloud AI LLC 營運)僅提供接取服務,並不擁有該模型。所有商標均歸其各自所有者所有。
比較 Kling O1 的文字與圖片工作流程,為您的專案選擇合適的影片生成端點。
| 模態 | 說明 |
|---|---|
| Kling O1 T2V API (Text To Video) | 透過 Kling O1 Text to Video endpoint,將文字提示轉換為電影感影片。其 MVL 技術支援精準的語意理解、一致的主體呈現,以及自然的物理模擬。適用於故事概念、產品敘事,以及透過文字指導的場景創作。 |
| Kling O1 I2V API (Image To Video) | 以靜態圖片為起點,Kling O1 Image to Video endpoint 能生成動態電影感影片。它在維持主體一致性的同時,加入自然動態、物理模擬與流暢的場景變化。此工作流程適合圖片動畫、視覺敘事與電影場景開發。 |
Kling O1 結合文字轉影片與圖片轉影片生成、主體一致性、自然物理效果、精準提示詞理解、首幀與尾幀控制、彈性的 5 或 10 秒時長、三種長寬比,以及可直接使用的 Atlas Cloud REST 存取服務,並採透明的用量計費定價。
Kling O1 透過 Atlas Cloud 專用的 text-to-video 與 image-to-video 端點,將文字提示詞或來源圖片轉換為電影感影片。其 MVL 架構能跨語言與視覺輸入理解場景意圖。選擇符合起始素材的模式,無須變更底層模型系列。這種彈性適合需要從早期概念發展到動畫行銷內容或故事鏡頭的團隊。
即使鏡頭移動、場景持續發展,模型仍能在動作展開時維持主體的可辨識度。圖片轉影片生成會將來源圖片的視覺特徵延伸至動態畫面,而文字轉影片則會根據提示詞建立一致的角色。穩定的主體能減少幀與幀之間令人分心的變化。這項優勢適合角色主導的故事、產品鏡頭,以及重視視覺連貫性的片段。
自然的物理模擬為動作帶來重量感、動量,以及與周遭場景可信的互動。Kling O1 能以彼此連貫而非生硬拼接的動態,讓人物、物件與環境元素動起來。在提示詞中搭配明確的動作指示與鏡頭方向。生成結果適合運動、美食、自然與動作類影片,因為這些內容的畫面品質取決於動態表現。
以單張圖片作為起點,或提供可選的尾幀圖片,以定義動態應該在哪個狀態結束。Atlas Cloud 的 image-to-video 結構支援 5 或 10 秒片段,讓短節奏與較長的轉場都能擁有清晰的節奏選擇。模型會在提示詞引導下,合成兩個視覺狀態之間的動態。這項控制特別適合產品揭示、變形效果與精簡的敘事弧線。
精準的語意理解能力讓 Kling O1 能將詳細提示詞轉換為主體、動作、場景動態與電影感鏡頭運動。使用 16:9、9:16 或 1:1 設定構圖,再以自然語言描述動態與氛圍。複雜的導演指示會轉化為結構化的生成請求,而不必手動製作動畫。這使模型適合社群短片、分鏡腳本與精緻的視覺概念。
透過 Atlas Cloud 統一的 REST API,建立即可支援 text-to-video 與 image-to-video 生成的工作流程。Atlas Cloud 不收取冷啟動費用,並依生成時長計費,每輸出 1 秒採標準費率 $0.112。以結構化參數提交提示詞、來源幀、時長與長寬比。這套配置能為開發者提供可預期的成本與直接整合能力,適用於正式環境的影片工作流程。
看看 Kling O1、Seedance 2.0 與 Kling V3.0 Turbo 如何解讀相同的兩組提示詞,展現電影級寫實感、動作連貫性、物理互動與風格化敘事。
建立一段 10 秒的電影級超寫實影片:一隻金毛獵犬在日出時分的擁擠花市中叼著一束花前行。以低角度跟拍鏡頭開場,狗狗在濕漉漉的石板路上飛奔,揚起花瓣並穿梭於移動的推車之間。快速甩鏡切換至從後方追趕的賣花人,接著繞拍狗狗,看著牠躍過倒下的籃子並自然落地。最後以快速推近鏡頭收尾:狗狗在一名孩童身旁停下,遞上花束,笑著的賣花人也追了上來。暖色逆光、逼真的毛髮、布料與花瓣物理效果、持續且充滿活力的動態,16:9 畫面比例。
Generated with Kling Video O1 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
建立一段 8 秒的風格化黏土定格動畫:場景位於月光照耀的麵包店內,一隻小狐狸廚師正在準備魔法糕點。以高空搖臂鏡頭開場,狐狸旋轉麵團、拋擲莓果,並閃避彈跳的餐具。切換至檯面跟拍視角,糕點飛快衝進烤箱並開始發光。快速環繞狐狸拍攝,此時烤箱猛然敞開,一隻迷你糕點小龍飛出,在飄散的麵粉間盤旋一圈,最後降落在廚師帽上。手工製作的黏土質感、富有表現力的動作、俏皮的藍色與琥珀色光線、無縫的動作連貫性,16:9 畫面比例。
Generated with Kling Video O1 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
從由提示詞驅動的電影感概念,到動畫化產品影像,Kling O1 為電影製作人、行銷人員、商務團隊與應用程式開發者,提供從文字或靜態畫面生成具一致性、符合物理感的影片之實用途徑。
透過精準的語意理解與自然物理效果,將詳細提示詞轉化為電影感十足的連續場景。電影製作人與前期視覺化團隊可以在投入昂貴的實景製作資源前,先探索氛圍、動作與鏡頭構想。
在保留產品主體的同時,為靜態產品影像加入流暢的場景動態。商務團隊可以將型錄視覺轉化為精緻的動態素材,用於產品上市、線上商店與行銷活動創意。
從文字概念開始,生成動作符合自然物理效果的電影感影片。社群團隊可以為公告、季節性活動與快速的跨頻道創意測試,探索全新的視覺方向。
透過精準的語意理解,將敘事提示詞轉化為連貫的動態場景。導演、代理商與遊戲工作室可以在早期創意開發與規劃階段,將角色動作、環境運動與電影感氛圍具體呈現。
為靜態肖像加入自然動態,同時由 Kling O1 image mode 維持主體一致性。創作者可以運用現有作品製作富有表現力的個人檔案影片、角色介紹與視覺敘事素材。
當提示詞描述複雜動作時,Kling O1 會運用自然物理模擬與精準的語意理解。動作設計師與概念團隊可以在製作開始前,預覽動態場景與可信的運動效果。
依供應商、生成模式、模型 ID 與標準目錄定價,比較 Kling O1 與 Atlas Cloud 的其他影片模型。
| 模型 | 供應商 | 生成模式 | Atlas 模型 ID | 列出的基本價格 |
|---|---|---|---|---|
| Kling Video O1 Text-to-video | Kuaishou | 文字生成影片 | kwaivgi/kling-video-o1/text-to-video | $0.112,未列出單位 |
| Kling Video O1 Image-to-video | Kuaishou | 圖像生成影片 | kwaivgi/kling-video-o1/image-to-video | $0.112,未列出單位 |
| Seedance 2.0 Text-to-Video | ByteDance | 文字生成影片 | bytedance/seedance-2.0/text-to-video | $0.112,未列出單位 |
| Wan-2.7 Image-to-video | Qwen | 圖像生成影片 | alibaba/wan-2.7/image-to-video | $0.10,未列出單位 |
| Veo 3.1 Lite Text-to-video | 文字生成影片 | google/veo3.1-lite/text-to-video | $0.05,未列出單位 | |
| MiniMax H3 Image-to-Video | MiniMax | 圖像生成影片 | minimax/h3/image-to-video | $0.038 每秒 |
幾分鐘即可上手 — 按照以下簡單步驟,透過 Atlas Cloud 平台整合和部署模型。
在 atlascloud.ai 註冊並完成驗證。新用戶可獲得免費額度,用於探索平台和測試模型。
將先進的 Kling o1 模型與 Atlas Cloud 的 GPU 加速平台相結合,提供無與倫比的效能、可擴展性和開發體驗。
低延遲:
GPU 最佳化推理,實現即時回應。
統一 API:
一次整合,暢用 Kling o1、GPT、Gemini 和 DeepSeek。
透明定價:
按 Token 計費,支援 Serverless 模式。
開發者體驗:
SDK、資料分析、微調工具和模板一應俱全。
可靠性:
99.99% 可用性、RBAC 權限控制、合規日誌。
安全與合規:
SOC 2 Type II 認證、HIPAA 合規、美國資料主權。
Kling O1 是快手運用多模態視覺語言技術打造的統一多模態影片模型。在 Atlas Cloud 上,經驗證的模型系列包含文字轉影片與圖片轉影片端點。它專注於語意提示詞理解、主體一致性,以及自然的物理模擬。
使用文字轉影片將文字描述的場景指示轉換成電影感片段,或透過圖片轉影片模式為來源圖片加入動畫。這兩個端點都支援適合一致主體、可控動態與逼真場景變化的工作流程。
如果專案從文字場景描述開始,請選擇文字轉影片。如果應由現有圖片先確立主體、構圖或首幀,再加入動態,請選擇圖片轉影片。
向 https://api.atlascloud.ai/api/v1/model/generateVideo 發送經過驗證的 POST 請求,並附上所選的模型 ID 與輸入內容。使用 kwaivgi/kling-video-o1/text-to-video 或 kwaivgi/kling-video-o1/image-to-video,接著使用回傳的 prediction ID 取得結果。
對於文字轉影片,請提供 prompt,並使用文件所述的長寬比與時長控制項。圖片轉影片需要提供 prompt 與 image,last_image 則為選用項目。其經驗證的長寬比包括 16:9、9:16 與 1:1,影片時長則為 5 或 10 秒。
Atlas Cloud 對兩個經驗證的影片端點均列出每秒 $0.112 的標準價格。費用會依要求的輸出時長計算,因此按照標準費率,生成 10 秒影片的費用是生成 5 秒影片的兩倍。
生成程序會從 POST 請求開始,並回傳 prediction ID 與處理狀態。請輪詢 https://api.atlascloud.ai/api/v1/model/prediction/{prediction_id},直到工作完成或失敗。成功的回應會將生成的影片 URL 放在 outputs 陣列中。
主體一致性是兩種可用模式所記載的功能,而圖片轉影片會使用來源影格來錨定視覺識別與構圖。不過,結果仍可能受到輸入品質與提示詞複雜度影響,因此建議使用清晰的來源圖片,並提供明確的動態指示。
不包含在此模型系列頁面已驗證的兩個 Atlas Cloud 端點中。目前的選項涵蓋文字轉影片與圖片轉影片,因此除非 Atlas Cloud 發布相容的端點與結構描述,否則不應提交 Elements、參考影片或編輯參數。
指南、教學與產品動態,助你充分發揮 Atlas Cloud 的價值。