


Veo 3.1 Lite 是 Google 面向開發者打造可擴展生產流程的影片模型系列。根據端點不同,您可以使用彈性的影片時長選項,在指定的首幀與尾幀之間建立 8 秒轉場,或以常見的畫面比例生成影片。Atlas Cloud 透過單一 OpenAI 相容金鑰提供這些能力,搭配透明的按用量計費價格與簡化的 API 存取方式。立即開始建構。
Veo 3.1 Lite 由 Google 開發。Atlas Cloud(由 Atlas Cloud AI LLC 營運)僅提供接取服務,並不擁有該模型。所有商標均歸其各自所有者所有。
Atlas Cloud 為您提供最新的行業領先創意模型。
選擇符合來源素材、輸出控制項與製作流程的 Veo 3.1 Lite 端點。
| 模態 | 說明 |
|---|---|
| Veo 3.1 Lite T2V API (Text to Video) | 將文字提示轉換為 720p 或 1080p 影片,並提供同步音訊與彈性的影片長度選項。此端點專為高性價比的大量生成而設計,適合自動化內容管線、行銷素材與快速概念製作。 |
| Veo 3.1 Lite Start-End Frame to Video API | 提供首幀與末幀,在兩者之間生成包含動態與音訊的 8 秒影片。此面向開發者的端點適合用於受控轉場、產品揭示、視覺轉換,以及明確定義的場景結尾。 |
| Veo 3.1 Lite I2V API (Image to Video) | 將輸入影像製作成動畫,生成 720p 或 1080p 影片,並提供同步音訊及常見長寬比支援。具成本效益的處理方式適合可擴充的影像動畫、社群內容、廣告素材與視覺敘事流程。 |
Veo 3.1 Lite 將文字、單張圖片,以及首尾影格生成整合至單一 Atlas Cloud API,支援同步音訊、720p 或 1080p 輸出、彈性的影片長度、橫向與直向畫面比例、種子控制,以及透明的按用量計費方案。
使用 Veo 3.1 Lite 將自然語言提示轉換為完成的影片。它可生成 4、6 或 8 秒的 720p 影片,其中 1080p 僅適用於 8 秒輸出。只需一則提示,即可描述主體、場景、動作、鏡頭移動、光線與聲音。此方式適合快速概念影片、行銷活動變體,以及大量影片敘事工作流程。
從一張最大 8MB 的圖片開始,將其製作成 4、6 或 8 秒的 720p 影片,或 8 秒的 1080p 影片。動態提示可引導主體行為、鏡頭移動、氛圍與音訊,同時由圖片固定開場構圖。可將產品照片、藝術作品、肖像或分鏡畫面轉換為動態素材。
定義首尾兩個影格,每個影格最大 8MB,再讓模型生成兩者之間的動態。可選擇 720p 的 4、6 或 8 秒影片,或使用 8 秒生成 1080p 輸出。加入以提示為基礎的動作與音訊指示,塑造銜接兩個影格的序列。此控制方式適合變形效果、前後對照揭示,以及分鏡轉場。
Veo 3.1 Lite 可在文字、圖片,以及起始與結束影格工作流程中,為影片產生同步音訊。將對白寫在引號內,並在提示中描述音效或環境音,讓配樂與場景同步。從配合追逐場景的腳步聲,到廚房中滋滋作響的食物,音訊會作為生成影片的一部分呈現,讓敘事更加完整。
可選擇 720p 或 1080p 輸出、16:9 或 9:16 畫面比例,以及 4、6 或 8 秒的影片長度。使用 1080p 時,請將影片長度設為 8 秒;不支援 4K 輸出與影片延長功能。種子參數有助於進行可重複的實驗,但不保證產生完全相同的結果,讓開發者能實際掌控原型、社群媒體素材與正式製作候選版本。
透過 Atlas Cloud API 使用全部三種 Veo 3.1 Lite 生成模式,並享有透明的按用量計費。每個列出的 Lite endpoint 都採用經驗證的標準基本價格 $0.05。可在單一整合中切換文字、單張圖片,以及首尾影格工作流程。這種架構讓大規模影片實驗更容易進行預算規劃與維護。
比較 Veo 3.1 Lite 與兩個 Atlas Cloud 替代方案,如何透過動態、鏡頭控制、視覺連貫性與同步音效,詮釋同一個充滿動作感的影片提示詞。
一段 8–10 秒、極高精度的復古科幻動畫電影場景,背景設定於零重力軌道溫室內:一名造型始終一致的復古太空人,身穿帶有銅製配件的奶油色加壓太空服,正急切追逐一顆從透明培植艙中逃出的發光藍色種子。開場以漂浮水滴內部的極端微距鏡頭呈現,太空人與種子透過水滴顫動的弧形表面產生清晰折射;鏡頭迅速拉遠,他伸手撞上水滴,將其炸裂成數百顆符合物理效果、閃閃發亮的水珠。接著轉入動態 360 度環繞廣角鏡頭,他穿越漂浮的葉片與根系向前推進,但一條活藤突然纏住他的腳踝,將他猛地向後扯。動作不中斷,他抓住旋轉中的銅製扶手,以可信的零重力動量繞著扶手擺盪,踢開藤蔓,朝觀景窗飛去。平順地翻轉至第一人稱頭盔 POV——戴著手套的雙手在遼闊藍色地球前合攏,握住種子——隨後種子瞬間綻放成一頂微小而 radiant 的藍色花冠。最後快速推近花朵的水晶般花瓣,在其中可看見彎曲地球的精緻倒影。冷青色地球光與脈動的琥珀色緊急照明交替映照,深海軍藍陰影、銅金色硬體、螢光藍生物發光效果、精細流體動力學、富彈性的藤蔓運動、自然慣性、持續且高密度的動作場面、強烈的主體與服裝一致性、戲劇性的敘事反轉、高級手工打造的復古未來主義動畫電影品質、銳利的電影細節與細膩底片顆粒。音效:悶響的太空服呼吸聲、金屬扶手震動聲、輕微撞擊聲、散落的水珠敲擊玻璃時發出的清脆聲響、逐漸升高的類比合成器脈衝,接著在揭曉時綻放出細緻的水晶般花音。不要出現螢幕、軟體介面、儀表板、儀表、進度列、圖表、字幕、文字、標誌或浮水印。16:9 畫面比例。
Generated with Veo 3.1 Lite Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud
一段寫實感十足的復古鬧劇追逐戲,以一個無縫銜接的 8–10 秒連續場景呈現:暴風雨的夜晚,在一間歷經歲月的 1950 年代理髮店內,一名表情生動的理髮師剛在顧客臉上塗滿厚厚的刮鬍泡,顧客的鞋子卻意外踩下黃銅地板踏板,讓鍍鉻理髮椅高速旋轉,並一路滾出敞開的店門;鮮紅披肩在身後飛揚,成為持續貫穿畫面的視覺錨點。開場以緊湊推近鏡頭穿過雨點斑駁鏡面中兩人完全一致的倒影;機械裝置喀噠一聲作響時快速搖攝,接著降低至貼地追蹤鏡頭,沿著嘎嘎作響的腳輪拍攝理髮椅越過門檻,衝入霓虹浸染的狹窄巷弄。理髮師保持步伐追上去,一手安全地高舉直刃剃刀,另一手拿著冒著熱氣的毛巾,閃避水窪、木箱與搖晃的招牌;每次撞擊都讓雨水自然飛濺,濕透的紅披肩也以令人信服的重量與氣流感扭動。雷光閃現時,鏡頭快速環繞旋轉中的理髮椅;理髮師抓住下垂的曬衣繩,擺盪穿越巷弄,在顧客身旁放手,配合理髮椅的旋轉,精準刮掉下巴上最後一道狹窄的泡沫——以一個令人振奮的喜劇收尾,確保臉孔、服裝、倒影、道具位置與空間連貫性一致,並呈現寫實的雨水、布料、車輪與動量物理效果。理髮店溫暖的鎢絲燈琥珀光,與青藍色雨幕及洋紅色霓虹交錯碰撞;電影感寬銀幕構圖、紋理豐富的時代場景設計、細膩底片顆粒、清晰動態、不要慢動作、不要字幕、不要文字、不要介面、不要圖像。同步音效:踏板喀噠聲、逐漸加速的車輪 rattling 聲、配合最後一下刮鬍動作的剃刀刮擦聲、毛巾揮動聲、濺水的腳步聲、霓虹燈嗡鳴聲,以及在落地瞬間以一聲清脆雷鳴作為強烈節點;帶有趣味的銅管與小鼓追逐音樂逐步升高,直到最後一拍。16:9 畫面比例。
Generated with Veo 3.1 Lite Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud
Veo 3.1 Lite 可將提示詞、靜態圖片與成對關鍵影格轉換為具同步音訊的影片,適用於社群行銷活動、產品視覺素材、故事原型,以及可規模化的內容製作。
將文字提示詞轉換為具同步音訊的 720p 或 1080p 影片。為社群內容行事曆、創作者行銷活動,以及需要跨多個頻道高效大規模產出的內容團隊,製作可重複使用的短片素材。
使用 text to video endpoint,將修改後的提示詞轉換為新影片,並提供彈性的影片長度選項。行銷團隊可在選定概念投入付費與自然觸及活動前,探索多種創意方向。
將產品圖片製作成具同步音訊的 720p 或 1080p 影片。以提供的圖片作為起點,為電子商務商品頁、上市頁面與視覺行銷活動打造動態素材。
定義第一格與最後一格影像,再由模型生成具音訊的銜接動態。此工作流程會產生八秒影片,適合用於動畫分鏡、場景轉場、動態研究,以及具備受控起訖點的分鏡序列。
從文字場景出發,在單一工作流程中生成具同步音效的影片。導演、設計師與創意開發者可在投入製作資源前,測試節奏、氛圍與視覺方向。
當已有核准的靜態圖片時,可直接將其製作成影片,無須從文字開始。編輯團隊與內容製作者可將行銷圖稿、插畫或主視覺轉化為可重複使用的影片素材。
依輸入路徑、片段時長、解析度、同步音訊及標準每秒價格,比較 Veo 3.1 Lite 與其他影片 API。
| 模型 | 輸入路徑 | 輸出時長 | 解析度選項 | 同步音訊 | 標準價格 |
|---|---|---|---|---|---|
| Veo 3.1 Lite Text-to-video | 文字 | 4、6 或 8 秒 | 720p、1080p | √ | $0.05/秒 |
| Veo 3.1 Lite Start-End Frame to Video | 文字、首幀、末幀 | 4、6 或 8 秒 | 720p、1080p | √ | $0.05/秒 |
| Veo 3.1 Lite Image-to-video | 文字、圖片 | 4、6 或 8 秒 | 720p、1080p | √ | $0.05/秒 |
| Seedance 2.0 Mini Text-to-Video | 文字 | 4 至 15 秒,或自動 | 480p、720p,最高 1440p-SR | √ | $0.056/秒 |
| Wan-3.0 Text-to-video | 文字 | 2 至 30 秒,或智慧時長 | 480p、720p、1080p;ESR 最高 4K | √ | $0.05/秒 |
| Kling V3.0 Turbo Text-to-Video | 文字 | 3 至 15 秒 | 720p、1080p | √ | $0.112/秒 |
幾分鐘即可上手 — 按照以下簡單步驟,透過 Atlas Cloud 平台整合和部署模型。
在 atlascloud.ai 註冊並完成驗證。新用戶可獲得免費額度,用於探索平台和測試模型。
將先進的 Veo 3.1 Lite 模型與 Atlas Cloud 的 GPU 加速平台相結合,提供無與倫比的效能、可擴展性和開發體驗。
低延遲:
GPU 最佳化推理,實現即時回應。
統一 API:
一次整合,暢用 Veo 3.1 Lite、GPT、Gemini 和 DeepSeek。
透明定價:
按 Token 計費,支援 Serverless 模式。
開發者體驗:
SDK、資料分析、微調工具和模板一應俱全。
可靠性:
99.99% 可用性、RBAC 權限控制、合規日誌。
安全與合規:
SOC 2 Type II 認證、HIPAA 合規、美國資料主權。
Veo 3.1 Lite 是 Google 推出的高效率影片生成模型,適合注重成本效益且需要大量產出的工作流程。它能根據文字提示、輸入圖片,或指定的起始與結束影格,生成具備同步音訊的影片。
您可以選擇文字轉影片,根據提示詞生成內容;圖片轉影片,讓靜態圖片產生動畫;或起始影格與結束影格轉影片,引導兩個影格之間的動態。Atlas Cloud 會為每種工作流程提供專用 endpoint。
建立 Atlas Cloud API 金鑰,然後向影片生成 endpoint 傳送 POST 請求,並提供適當的模型 ID 與必要輸入。回應會包含 prediction ID,您可以持續輪詢,直到輸出準備完成。
會。文字轉影片與圖片轉影片 endpoint 都會生成同步音訊;起始影格與結束影格工作流程則會為所提供影格之間生成的動態加入音訊。
三個經驗證的 endpoint 都支援 720p 與 1080p 輸出。此模型系列不支援 4K 生成。
經驗證的標準基本價格為三個 Atlas Cloud endpoint 各自每次 $0.05。計費方式為隨用隨付;這是標準價格,並非暫時性的促銷費率。
提供開頭影格、結尾影格,以及描述兩者之間預期動態的提示詞。經驗證的 Atlas Cloud 後端設定列出一個 8 秒工作流程,支援音訊以及 720p 或 1080p 輸出。
Lite 優先提升可擴展影片工作負載的價格效益,同時保留同步音訊及 720p 或 1080p 輸出。主要限制是無法輸出 4K,也不支援影片 Extension。
需要視覺錨定時,請使用圖片轉影片,或同時提供起始與結束影格,不要只依賴文字。清楚描述主體動態、攝影機行為、場景變化與音訊提示,讓請求包含更明確的限制條件。
首先確認 bearer 授權、正確的模型 ID、必要的提示詞或圖片欄位,以及支援的解析度設定。如果 prediction 進入失敗狀態,請先檢查回傳的錯誤,再修改 payload 或提交其他請求。
指南、教學與產品動態,助你充分發揮 Atlas Cloud 的價值。