僅限兩週 | Seedream 5.0 Pro 立享 8 折!
LTX-2 API for Synchronized Audio and Video

LTX-2 API for Synchronized Audio and Video

LTX-2 API 將 Lightricks 的開放權重影片模型系列帶入生產環境,可一次生成影片與同步音訊。你可以用文字提示生成、讓靜態圖片動起來,或延展既有片段;每個結果都會附上相符的唇形同步、擬音與環境音。在 Atlas Cloud 上,你可透過單一 OpenAI-compatible 金鑰使用它,享有透明的 pay-as-you-go 計價與 Day-0 access。立即開始建置。

探索領先模型

Atlas Cloud 為您提供最新的行業領先創意模型。

Ltx-2 API 端點並列比較:文字、圖像與影片延伸

在同一個檢視中比較每一種 Ltx-2 API 模態,涵蓋從提示詞驅動生成、讓靜態圖像動起來,到延續既有片段,且各自都可選擇加入同步音訊。

模態說明
Ltx-2 T2V API (Text to Video)輸入最多 2,000 個字元的文字提示詞,Ltx-2 API 會回傳完整算繪的影片;啟用 generate_audio 時,也可選擇產生同步音訊。片段長度可從 25 到 257 個影格彈性調整,並提供六種解析度預設,涵蓋正方形、直式 9:16 與橫式 16:9 輸出。此端點適合用於完全由文字描述建立的廣告概念、社群短影片與分鏡預覽,標準基本費率為 $0.002。
Ltx-2 I2V API (Image to Video)提供 jpg、png、webp、gif 或 avif 格式的靜態圖像,並搭配動態提示詞,此端點就能將其動畫化為動態片段,且可選擇產生音訊。同樣適用 25 到 257 個影格範圍與六種長寬比預設,因此單一來源影格即可轉成橫式或直式影片。產品照片、角色肖像與概念美術都是很適合的輸入,標準基本價格皆為 $0.002。
Ltx-2 Extend Video API當既有片段需要更長的播放時間時,此端點可從提供的 mp4、mov、webm、m4v 或 gif 來源,向前或向後延續影片。它可將序列延伸至最多 481 個影格,透過 match_input_fps 保留原始節奏,並可疊加生成音訊。適合用來加長 b-roll、製作循環場景或銜接剪輯,計費採相同的 $0.002 基本費率。

音訊與影片,由 Ltx-2 API 同步生成

Ltx-2 API 將文字、影像與延伸生成模式結合原生同步音訊、可控的影格數,以及六種長寬比預設;全都可透過一把 OpenAI 相容金鑰使用,並採透明的隨用隨付計價。

使用 Ltx-2 API 從文字生成完整場景

用最多 2,000 個字元描述一個場景,Ltx-2 API 就能把純文字轉成帶有動態與聲音的短片,無需任何參考素材。你的提示詞會驅動主體、動作、光線與鏡頭行為,而選用的 seed 可鎖定結果,方便重複迭代。由於一切都從語言開始,當你只有想法、還沒有素材時,它非常適合分鏡、概念提案與快速創意探索。

讓任何靜態影像動起來

輸入單張 jpg、png、webp、gif 或 avif 靜態影像,模型就會將其動畫化成帶有匹配音訊的影片。提示詞可引導畫面應如何移動,從緩慢推鏡到完整動作節拍皆可,同時保留原始構圖。攝影師、設計師與產品團隊可藉此把一張主視覺影像轉成適合分享的動態內容,不必重新拍攝。

透過 Ltx-2 API 無縫延伸片段

上傳既有片段後,Ltx-2 API 可向前或向後延續內容,最多生成 481 個額外影格,並繼承原始風格與節奏。match_input_fps 選項會讓新素材鎖定來源影格率,使接合處保持無痕。這能把短鏡頭延展成長篇序列,也能拯救那些結束得稍早一拍的場景。

影格數與長寬比皆由你掌控

在文字與影像模式中,影格數可從 25 到 257 完全控制,並一律以 8 的倍數加 1 設定,以確保乾淨取樣。六種解析度預設涵蓋 1024 by 1024 的 square HD、512 square、portrait 3:4、portrait 9:16、landscape 4:3 與 landscape 16:9,因此單一模型即可服務電影、社群與直式動態牆。先選擇畫面形狀,再讓一次請求回傳正確裁切。

Ltx-2 API:一把金鑰與可重現的執行結果

每個請求都透過 Atlas Cloud 上的一把 OpenAI 相容金鑰送出,採透明的隨用隨付計價,無需訂閱。搭配相同提示詞傳入固定 seed,模型就會回傳相同短片,將不可預測的生成轉為可控且可版本化的步驟。Day-0 access 代表新的 Ltx-2 API 版本一推出即可呼叫,讓團隊能標準化影片管線並擴大規模,而無需管理 GPU。

一個提示詞,三個引擎:讓 Ltx-2 API 正面對決

將同一個完全相同的提示詞送到 Ltx-2 API,以及 Atlas Cloud 上兩個最受歡迎的影片模型,然後比較它們如何依據完全相同的指令處理動作、同步音訊與電影感細節。

提示詞

一隻好奇的獼猴在黃金時刻穿梭於擁擠的馬拉喀什香料市集,從攤位上一把搶走商人鮮紅色的菲斯帽。牠跳過一袋袋敞開的番紅花與紅椒粉,揚起旋轉的橘色塵雲,接著在遮棚支柱頂端突然停住,回頭偷看,正好看見大笑的商人追了上來。開場以低角度跟拍鏡頭從猴子身後穿過人群,快速搖鏡到商人驚訝的臉,接著升起成為高高俯瞰攤位的壯闊吊臂鏡頭,塵埃在溫暖光線中閃閃發亮。寫實電影風格、淺景深、濃郁的大地色調色。Audio: 熱鬧的市集人聲、黃銅器皿碰撞聲,以及隨追逐逐漸堆疊的節奏手鼓打擊樂。16:9 aspect ratio。

Generated with Ltx 2.3 Quality on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

提示詞

一名年輕的空中信使披著飄逸的深紅斗篷,從漂浮石造神殿邊緣縱身一躍,乘著一隻機械紙鶴穿越峽谷雲海,在漂浮的發光燈籠之間穿梭。她猛然傾斜轉向繞過嶙峋的岩石尖塔,從空中攫取一封閃耀的信,接著收身俯衝;就在她身後,一名競爭對手的滑翔者衝破迷霧緊追而來。以第一人稱 POV 從她肩後開始,拍下紙鶴起飛,切到與俯衝並行疾馳的無人機鏡頭,接著降到低角度仰拍,看她拉出下墜軌跡衝入刺眼陽光。鮮明 anime 風格、cel-shaded、明亮的 magic-hour 色彩。Audio: 呼嘯風聲、紙翼拍動聲,以及配合拉升時機昂揚而起的管弦樂弦樂漸強。16:9 aspect ratio。

Generated with Ltx 2.3 Quality on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

使用 Ltx-2 API 交付可上線的影片與音訊

從文字與圖像提示詞,到加長剪輯與同步音效,Ltx-2 API 涵蓋從初稿到 4K 交付的完整流程,適用於行銷、電子商務與創意製作。

透過 Ltx-2 API 以提示詞生成影片

只需一段文字提示詞,Ltx-2 API 就能輸出原生 4K 影片,並同步內嵌生成音訊。工作室與廣告團隊無需攝影機或手動剪輯,即可將活動簡報轉換成完成版社群短片。

將靜態圖片轉為動態影像

上傳單張靜態圖片,image-to-video 生成就能讓畫面動起來,在保留來源構圖的同時加入逼真的鏡頭運動。電子商務賣家與插畫家可讓靜態型錄與作品集活起來,打造令人停下滑動的社群內容。

將短片延展為更長場景

需要更長的鏡頭嗎?extend-video 端點會在既有短片後接續生成新影格,同時維持動作、風格與音訊的連貫。創作者可將短片生成結果串接成無縫敘事,突破單次請求的長度限制。

透過 Ltx-2 API 生成同步音效

當聲音至關重要時,Ltx-2 API 可在一次流程中隨影像合成對白、擬音與環境音,並與動作精準同步。適合解說影片、預告片,以及需要音效準確對點的場景。

由 Ltx-2 API 輸出 4K 母版

用於最終交付時,Ltx-2 API 會渲染原生 4K 影格,提供乾淨流暢的動作與銳利細緻的材質,而不是升頻預覽。代理商與工作室可直接從端點匯出符合播出標準的母版,銜接至既有剪輯流程。

以可負擔成本擴展批次生成

由於 LTX-2 是高效率的開放模型,大量作業可採用透明的隨用隨付定價執行,並可針對每次請求切換不同效能模式。產品團隊能以低成本製作原型,再在發佈前提高品質。

Ltx-2 API 與其他生產級影片模型比較

在 Atlas Cloud 上,從生成模式、解析度、原生音訊、片段長度與起始價格等面向,比較 Ltx-2 API 與同類文字和圖像驅動的影片模型。

模型生成模式最高解析度同步音訊最大片段長度起始價格
LTX-2.3 Quality Text-to-Video文字轉影片1024×1024 預設集(預設 16:9)√(可選切換)最多 257 幀$0.002
LTX-2.3 Quality Image-to-Video圖像轉影片、延展1024×1024 預設集(預設 16:9)√(可選切換)最多 257 幀$0.002
Seedance 2.0 Text-to-Video文字轉影片最高 2K√ 原生4 至 15 秒$0.112
Veo 3.1 Text-to-Video文字轉影片最高 4K√ 原生8 秒(可延展)$0.2
Kling Video O3 4K Text-to-Video文字與圖像轉影片原生 4K(3840×2160)√ 原生3 至 15 秒$0.42

如何在 Atlas Cloud 上使用 Ltx-2

幾分鐘即可上手 — 按照以下簡單步驟,透過 Atlas Cloud 平台整合和部署模型。

建立 Atlas Cloud 帳戶

在 atlascloud.ai 註冊並完成驗證。新用戶可獲得免費額度,用於探索平台和測試模型。

為何在 Atlas Cloud 使用 Ltx-2

將先進的 Ltx-2 模型與 Atlas Cloud 的 GPU 加速平台相結合,提供無與倫比的效能、可擴展性和開發體驗。

效能與靈活性

低延遲:
GPU 最佳化推理,實現即時回應。

統一 API:
一次整合,暢用 Ltx-2、GPT、Gemini 和 DeepSeek。

透明定價:
按 Token 計費,支援 Serverless 模式。

企業與規模

開發者體驗:
SDK、資料分析、微調工具和模板一應俱全。

可靠性:
99.99% 可用性、RBAC 權限控制、合規日誌。

安全與合規:
SOC 2 Type II 認證、HIPAA 合規、美國資料主權。

Ltx-2 API:常見開發者問題解答

Ltx-2 API 讓開發者能以程式化方式存取 LTX-2,這是 Lightricks 推出的開放權重音訊/影片基礎模型。它能在單次生成流程中,將文字或圖片提示轉換成同步的影片與音訊;在 Atlas Cloud 上,你可以透過一個 OpenAI-compatible endpoint 使用它,並採用 pay-as-you-go 定價。

LTX-2 支援 text-to-video、image-to-video 與 clip extension,因此你可以把文字場景轉成動態影片、讓靜態圖片動起來,或延長既有的鏡頭。每種模式都能渲染搭配的音訊,非常適合短片、廣告、產品示範與社群內容。

會。音訊與影片會在一次同步流程中產生,而不是事後拼接在一起,涵蓋對白 lip sync、音效與環境音。在 Atlas Cloud 上,你可以使用 generate_audio 參數啟用此功能;預設為關閉。

LTX-2 model 原生最高可達 4K resolution、最高 50 fps,片段最長可達 20 秒,支援 24、25、48 與 50 等 frame rates。在 Atlas Cloud 上,quality endpoints 可讓你選擇 aspect ratio,並透過 25 到 257 frames 之間的 frame count 設定片段長度。

向 Atlas Cloud endpoint 傳送標準請求,內容包含你的 prompt、ltx-2.3-quality/text-to-video 這類 model、aspect ratio、frame count,以及可選的 seed 以產生可重現的輸出。由於該 endpoint 與 OpenAI-compatible,單一 key 可同時用於 Ltx-2 API 和平台上的所有其他 model,因此整合通常只需要幾分鐘。

當然可以。ltx-2.3-quality/extend-video model 會延續既有的 LTX-2 片段,並在原始長度之後維持一致的動態與音訊。當單次生成的長度短於場景實際需求時,這項功能特別有用。

LTX-2 提供開放權重,且效率高到足以在消費級 GPU 上執行,因此自行託管確實可行。如果你想省去 GPU 佈建、佇列管理與擴展的工作,hosted API 可提供相同的 model,且無需維護任何基礎架構。

Atlas Cloud 對 Ltx-2 API 採用 pay-as-you-go 計費,提供透明的每次呼叫定價,沒有訂閱費或最低承諾用量。你只需為實際生成的內容付費,同一把 key 還能讓你在 Day-0 存取新 model releases。立即開始建置。

LTX-2.3 是 LTX-2 family 目前的版本,也是 Atlas Cloud 透過其 quality text-to-video、image-to-video 與 extend-video endpoints 提供的版本。它在原始版本基礎上進一步改良,同時保留相同的同步音訊/影片方法,因此你不需要改變呼叫 model 的方式,就能獲得最新品質。

探索更多系列

Seedance 2.0

Seedance 2.0 API 為您提供 ByteDance 多模態影片模型的生產級存取權限——支援四模態輸入(文字、影像、影片、音訊),以及業界領先的「Universal Reference」(通用參考)系統,可在不同鏡頭間鎖定構圖、運鏡與角色動作。只需一次 API 呼叫即可整合導演級控制,固定費率為 $0.09/秒,即時取得金鑰,無需排隊——由企業級正常運行時間與合規性提供保障。Seedance 2.0 原生 4K 現已上線!

檢視系列

Grok Imagine

Grok Imagine API 為開發者提供 xAI 的圖像、影片和音訊生成一站式套件。它可以生成解析度高達 2K 且支援多語言文本渲染的圖像,以及長達 15 秒且帶有原生同步音訊和基於參考圖像編輯功能的影片。在 Atlas Cloud 上,只需一個金鑰即可執行每個 Grok Imagine 模式,因此您可以在圖像、影片和音訊之間無縫切換,無需單獨設定,每張圖像 0.02 美元起,每秒 0.05 美元起。

檢視系列

Gemini Omni Flash

Gemini Omni API 將 Google DeepMind 於 Google I/O 2026 發表的多模態影片生成與編輯模型帶進你的技術棧。Gemini Omni 將 Gemini 的推理引擎與生成式媒體融合,可接受文字、圖片、影片與音訊的任意組合輸入,產生一致且以知識為根據的輸出。透過自然對話持續打磨成果:替換物件、改寫場景、切換風格,同時維持物理規律、角色與畫面連貫性不變。Atlas Cloud 透過單一整合 API 提供完整的 Gemini Omni Flash 系列——文字生成影片、支援最多 7 張參考圖片的圖片生成影片,以及參考圖生成影片——採每秒計費、價格透明,$0.112 起,無需訂閱。立即開始打造。

檢視系列

GPT Image 2

GPT Image 2 API 為開發者提供了訪問 OpenAI 最新圖像模型的途徑,它是 GPT Image 1.5 的繼任者。該模型可生成和編輯圖像,能夠在拉丁和 CJK 文字上實現準確的文本渲染,並在海報、樣機和資訊圖表方面具備強大的排版能力。在 Atlas Cloud 上,您可以透過一個統一的 API 與 300 多個模型一起訪問它,並享受免費額度、99.99% 的正常運行時間,且無需 OpenAI 組織驗證。

檢視系列

Google

Google最強大的創意模型現已在Atlas Cloud上全面可用。Veo 3.1提供電影等級的影片生成,Nano Banana 2支援高保真圖像建立,而Gemini為每個工作流程帶來多模態智慧。透過單一API key即可存取完整的Google模型套件,提供Day-0可用性和隨用隨付(pay-as-you-go)定價。

檢視系列

Seedance 2.0 Mini

Seedance 2.0 Mini 將 ByteDance 的多模態影片生成技術引入到對速度和成本要求極高的工作流程中。它以更輕量的佔用空間提供 Seedance 2.0 的核心能力——更快的生成速度、更低的單支影片成本,並且使用您現有的同款 API 整合。對於運行高吞吐量流水線或進行大規模原型設計的團隊來說,Mini 是最實用的預設選擇。

檢視系列

ByteDance

從電影級影片生成到高保真影像建立,ByteDance 最強大的模型現已在 Atlas Cloud 上線。以最低的推論定價和零基礎設施開銷,大規模執行 Seedance 和 Seedream。

檢視系列

Alibaba

Atlas Cloud 將 Alibaba 的全系模型陣容整合至同一個 API 中:Qwen 適用於語言和圖像任務,Wan 適用於高達 1080p 的影片生成。所有模型均採用按需付費模式,無需訂閱。您可以使用現有的 OpenAI 兼容客戶端,透過單一的 base URL 存取 Alibaba API。

檢視系列

OpenAI

Atlas Cloud 為您提供存取完整 OpenAI API 產品線的權限,從用於圖像生成的 GPT Image 2 到用於影片的 Sora 2。每個模型均採用按需付費模式,無月度消費限制。使用相容 OpenAI 的 API,只需簡單替換基礎 URL 即可輕鬆接入。

檢視系列

xAI

在 Atlas Cloud 上使用 xAI API 建構完整的影像與影片處理管線。以 2K 解析度生成、使用參考影像進行編輯,並將影像動畫化為音訊同步的影片片段。

檢視系列

Kwaivgi

Kwaivgi API 價格低於標準定價 15%。Atlas Cloud 提供對最新 Kling 版本的零日(Day-0)存取權限,採用按需付費定價且無席位限制。一個帳戶,一個金鑰,暢享從標準版到大師版的所有 Kling 模型。

檢視系列

Seedream 5.0 Pro

Seedream 5.0 Pro API 為開發者在 Atlas Cloud 上提供了字節跳動的可控圖像編輯模型。它透過錨點和座標精確定位編輯,將圖像分離為可編輯圖層,融合多個參考,並精準匹配顏色和材質,支援 2K 和 3K 解析度的多語言文本。在 Atlas Cloud 上,您只需一個金鑰即可存取!

檢視系列

一個 API,暢享全模態 AI。

探索全部模型