
LTX-2 API 將 Lightricks 的開放權重影片模型系列帶入生產環境,可一次生成影片與同步音訊。你可以用文字提示生成、讓靜態圖片動起來,或延展既有片段;每個結果都會附上相符的唇形同步、擬音與環境音。在 Atlas Cloud 上,你可透過單一 OpenAI-compatible 金鑰使用它,享有透明的 pay-as-you-go 計價與 Day-0 access。立即開始建置。
Atlas Cloud 為您提供最新的行業領先創意模型。
在同一個檢視中比較每一種 Ltx-2 API 模態,涵蓋從提示詞驅動生成、讓靜態圖像動起來,到延續既有片段,且各自都可選擇加入同步音訊。
| 模態 | 說明 |
|---|---|
| Ltx-2 T2V API (Text to Video) | 輸入最多 2,000 個字元的文字提示詞,Ltx-2 API 會回傳完整算繪的影片;啟用 generate_audio 時,也可選擇產生同步音訊。片段長度可從 25 到 257 個影格彈性調整,並提供六種解析度預設,涵蓋正方形、直式 9:16 與橫式 16:9 輸出。此端點適合用於完全由文字描述建立的廣告概念、社群短影片與分鏡預覽,標準基本費率為 $0.002。 |
| Ltx-2 I2V API (Image to Video) | 提供 jpg、png、webp、gif 或 avif 格式的靜態圖像,並搭配動態提示詞,此端點就能將其動畫化為動態片段,且可選擇產生音訊。同樣適用 25 到 257 個影格範圍與六種長寬比預設,因此單一來源影格即可轉成橫式或直式影片。產品照片、角色肖像與概念美術都是很適合的輸入,標準基本價格皆為 $0.002。 |
| Ltx-2 Extend Video API | 當既有片段需要更長的播放時間時,此端點可從提供的 mp4、mov、webm、m4v 或 gif 來源,向前或向後延續影片。它可將序列延伸至最多 481 個影格,透過 match_input_fps 保留原始節奏,並可疊加生成音訊。適合用來加長 b-roll、製作循環場景或銜接剪輯,計費採相同的 $0.002 基本費率。 |
Ltx-2 API 將文字、影像與延伸生成模式結合原生同步音訊、可控的影格數,以及六種長寬比預設;全都可透過一把 OpenAI 相容金鑰使用,並採透明的隨用隨付計價。
用最多 2,000 個字元描述一個場景,Ltx-2 API 就能把純文字轉成帶有動態與聲音的短片,無需任何參考素材。你的提示詞會驅動主體、動作、光線與鏡頭行為,而選用的 seed 可鎖定結果,方便重複迭代。由於一切都從語言開始,當你只有想法、還沒有素材時,它非常適合分鏡、概念提案與快速創意探索。
輸入單張 jpg、png、webp、gif 或 avif 靜態影像,模型就會將其動畫化成帶有匹配音訊的影片。提示詞可引導畫面應如何移動,從緩慢推鏡到完整動作節拍皆可,同時保留原始構圖。攝影師、設計師與產品團隊可藉此把一張主視覺影像轉成適合分享的動態內容,不必重新拍攝。
上傳既有片段後,Ltx-2 API 可向前或向後延續內容,最多生成 481 個額外影格,並繼承原始風格與節奏。match_input_fps 選項會讓新素材鎖定來源影格率,使接合處保持無痕。這能把短鏡頭延展成長篇序列,也能拯救那些結束得稍早一拍的場景。
在文字與影像模式中,影格數可從 25 到 257 完全控制,並一律以 8 的倍數加 1 設定,以確保乾淨取樣。六種解析度預設涵蓋 1024 by 1024 的 square HD、512 square、portrait 3:4、portrait 9:16、landscape 4:3 與 landscape 16:9,因此單一模型即可服務電影、社群與直式動態牆。先選擇畫面形狀,再讓一次請求回傳正確裁切。
每個請求都透過 Atlas Cloud 上的一把 OpenAI 相容金鑰送出,採透明的隨用隨付計價,無需訂閱。搭配相同提示詞傳入固定 seed,模型就會回傳相同短片,將不可預測的生成轉為可控且可版本化的步驟。Day-0 access 代表新的 Ltx-2 API 版本一推出即可呼叫,讓團隊能標準化影片管線並擴大規模,而無需管理 GPU。
將同一個完全相同的提示詞送到 Ltx-2 API,以及 Atlas Cloud 上兩個最受歡迎的影片模型,然後比較它們如何依據完全相同的指令處理動作、同步音訊與電影感細節。
一隻好奇的獼猴在黃金時刻穿梭於擁擠的馬拉喀什香料市集,從攤位上一把搶走商人鮮紅色的菲斯帽。牠跳過一袋袋敞開的番紅花與紅椒粉,揚起旋轉的橘色塵雲,接著在遮棚支柱頂端突然停住,回頭偷看,正好看見大笑的商人追了上來。開場以低角度跟拍鏡頭從猴子身後穿過人群,快速搖鏡到商人驚訝的臉,接著升起成為高高俯瞰攤位的壯闊吊臂鏡頭,塵埃在溫暖光線中閃閃發亮。寫實電影風格、淺景深、濃郁的大地色調色。Audio: 熱鬧的市集人聲、黃銅器皿碰撞聲,以及隨追逐逐漸堆疊的節奏手鼓打擊樂。16:9 aspect ratio。
Generated with Ltx 2.3 Quality on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Seedance 2.0 on Atlas Cloud
一名年輕的空中信使披著飄逸的深紅斗篷,從漂浮石造神殿邊緣縱身一躍,乘著一隻機械紙鶴穿越峽谷雲海,在漂浮的發光燈籠之間穿梭。她猛然傾斜轉向繞過嶙峋的岩石尖塔,從空中攫取一封閃耀的信,接著收身俯衝;就在她身後,一名競爭對手的滑翔者衝破迷霧緊追而來。以第一人稱 POV 從她肩後開始,拍下紙鶴起飛,切到與俯衝並行疾馳的無人機鏡頭,接著降到低角度仰拍,看她拉出下墜軌跡衝入刺眼陽光。鮮明 anime 風格、cel-shaded、明亮的 magic-hour 色彩。Audio: 呼嘯風聲、紙翼拍動聲,以及配合拉升時機昂揚而起的管弦樂弦樂漸強。16:9 aspect ratio。
Generated with Ltx 2.3 Quality on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Seedance 2.0 on Atlas Cloud
從文字與圖像提示詞,到加長剪輯與同步音效,Ltx-2 API 涵蓋從初稿到 4K 交付的完整流程,適用於行銷、電子商務與創意製作。
只需一段文字提示詞,Ltx-2 API 就能輸出原生 4K 影片,並同步內嵌生成音訊。工作室與廣告團隊無需攝影機或手動剪輯,即可將活動簡報轉換成完成版社群短片。
上傳單張靜態圖片,image-to-video 生成就能讓畫面動起來,在保留來源構圖的同時加入逼真的鏡頭運動。電子商務賣家與插畫家可讓靜態型錄與作品集活起來,打造令人停下滑動的社群內容。
需要更長的鏡頭嗎?extend-video 端點會在既有短片後接續生成新影格,同時維持動作、風格與音訊的連貫。創作者可將短片生成結果串接成無縫敘事,突破單次請求的長度限制。
當聲音至關重要時,Ltx-2 API 可在一次流程中隨影像合成對白、擬音與環境音,並與動作精準同步。適合解說影片、預告片,以及需要音效準確對點的場景。
用於最終交付時,Ltx-2 API 會渲染原生 4K 影格,提供乾淨流暢的動作與銳利細緻的材質,而不是升頻預覽。代理商與工作室可直接從端點匯出符合播出標準的母版,銜接至既有剪輯流程。
由於 LTX-2 是高效率的開放模型,大量作業可採用透明的隨用隨付定價執行,並可針對每次請求切換不同效能模式。產品團隊能以低成本製作原型,再在發佈前提高品質。
在 Atlas Cloud 上,從生成模式、解析度、原生音訊、片段長度與起始價格等面向,比較 Ltx-2 API 與同類文字和圖像驅動的影片模型。
| 模型 | 生成模式 | 最高解析度 | 同步音訊 | 最大片段長度 | 起始價格 |
|---|---|---|---|---|---|
| LTX-2.3 Quality Text-to-Video | 文字轉影片 | 1024×1024 預設集(預設 16:9) | √(可選切換) | 最多 257 幀 | $0.002 |
| LTX-2.3 Quality Image-to-Video | 圖像轉影片、延展 | 1024×1024 預設集(預設 16:9) | √(可選切換) | 最多 257 幀 | $0.002 |
| Seedance 2.0 Text-to-Video | 文字轉影片 | 最高 2K | √ 原生 | 4 至 15 秒 | $0.112 |
| Veo 3.1 Text-to-Video | 文字轉影片 | 最高 4K | √ 原生 | 8 秒(可延展) | $0.2 |
| Kling Video O3 4K Text-to-Video | 文字與圖像轉影片 | 原生 4K(3840×2160) | √ 原生 | 3 至 15 秒 | $0.42 |
幾分鐘即可上手 — 按照以下簡單步驟,透過 Atlas Cloud 平台整合和部署模型。
在 atlascloud.ai 註冊並完成驗證。新用戶可獲得免費額度,用於探索平台和測試模型。
將先進的 Ltx-2 模型與 Atlas Cloud 的 GPU 加速平台相結合,提供無與倫比的效能、可擴展性和開發體驗。
低延遲:
GPU 最佳化推理,實現即時回應。
統一 API:
一次整合,暢用 Ltx-2、GPT、Gemini 和 DeepSeek。
透明定價:
按 Token 計費,支援 Serverless 模式。
開發者體驗:
SDK、資料分析、微調工具和模板一應俱全。
可靠性:
99.99% 可用性、RBAC 權限控制、合規日誌。
安全與合規:
SOC 2 Type II 認證、HIPAA 合規、美國資料主權。
Ltx-2 API 讓開發者能以程式化方式存取 LTX-2,這是 Lightricks 推出的開放權重音訊/影片基礎模型。它能在單次生成流程中,將文字或圖片提示轉換成同步的影片與音訊;在 Atlas Cloud 上,你可以透過一個 OpenAI-compatible endpoint 使用它,並採用 pay-as-you-go 定價。
LTX-2 支援 text-to-video、image-to-video 與 clip extension,因此你可以把文字場景轉成動態影片、讓靜態圖片動起來,或延長既有的鏡頭。每種模式都能渲染搭配的音訊,非常適合短片、廣告、產品示範與社群內容。
會。音訊與影片會在一次同步流程中產生,而不是事後拼接在一起,涵蓋對白 lip sync、音效與環境音。在 Atlas Cloud 上,你可以使用 generate_audio 參數啟用此功能;預設為關閉。
LTX-2 model 原生最高可達 4K resolution、最高 50 fps,片段最長可達 20 秒,支援 24、25、48 與 50 等 frame rates。在 Atlas Cloud 上,quality endpoints 可讓你選擇 aspect ratio,並透過 25 到 257 frames 之間的 frame count 設定片段長度。
向 Atlas Cloud endpoint 傳送標準請求,內容包含你的 prompt、ltx-2.3-quality/text-to-video 這類 model、aspect ratio、frame count,以及可選的 seed 以產生可重現的輸出。由於該 endpoint 與 OpenAI-compatible,單一 key 可同時用於 Ltx-2 API 和平台上的所有其他 model,因此整合通常只需要幾分鐘。
當然可以。ltx-2.3-quality/extend-video model 會延續既有的 LTX-2 片段,並在原始長度之後維持一致的動態與音訊。當單次生成的長度短於場景實際需求時,這項功能特別有用。
LTX-2 提供開放權重,且效率高到足以在消費級 GPU 上執行,因此自行託管確實可行。如果你想省去 GPU 佈建、佇列管理與擴展的工作,hosted API 可提供相同的 model,且無需維護任何基礎架構。
Atlas Cloud 對 Ltx-2 API 採用 pay-as-you-go 計費,提供透明的每次呼叫定價,沒有訂閱費或最低承諾用量。你只需為實際生成的內容付費,同一把 key 還能讓你在 Day-0 存取新 model releases。立即開始建置。
LTX-2.3 是 LTX-2 family 目前的版本,也是 Atlas Cloud 透過其 quality text-to-video、image-to-video 與 extend-video endpoints 提供的版本。它在原始版本基礎上進一步改良,同時保留相同的同步音訊/影片方法,因此你不需要改變呼叫 model 的方式,就能獲得最新品質。