Seedance 2.5 現已上線 — 首發於 Atlas Cloud
Hero background 1Hero background 2Hero background 3

FLUX 3 API: 20-Second Video With Native Audio

FLUX 3 API 將 Black Forest Labs 最新的基礎模型帶進你的技術堆疊,採用單一 Self-Flow 架構,聯合以影像、影片與音訊訓練。你可以一次生成最長 20 秒的片段,內含多語對話、音效與環境音,或是輸出具備精準排版的文字生圖作品。Atlas Cloud 透過一組 OpenAI 相容金鑰提供服務,採按次呼叫計費,並可在 Day-0 立即存取。

探索領先模型

Atlas Cloud 為您提供最新的行業領先創意模型。

Every FLUX 3 API Endpoint, Modality by Modality

Five video endpoints sit behind one FLUX 3 API surface, and the table below shows what each one takes in, what it sends back, and what it costs per second.

ModalityDescription
FLUX 3 T2V API (Text to Video)Text prompts become clips of 5 to 20 seconds with audio generated in the same pass, since generate_audio is enabled by default. Output runs at 720p or 1080p across seven fixed aspect ratios from 21:9 to 9:16 plus an auto option, and a seed value makes any result reproducible. Pricing is $0.17 per second of generated video.
FLUX 3 I2V API (Image to Video)Supply a single PNG, JPEG, or WebP image and the model animates forward from that frame, taking motion and pacing from the prompt. Duration is selectable anywhere from 5 to 20 seconds, which suits product shots, character intros, and social cutdowns built on artwork you already own. Billing runs at $0.17 per second of generated video.
FLUX 3 Keyframes API (Keyframes to Video)When a shot has to hit specific beats, up to 10 keyframe images can be pinned to exact frame positions along a 24 fps timeline. Each frame_index has to stay within duration multiplied by 24, which gives storyboard and previz teams direct control over what appears and when. The rate matches the other generation endpoints at $0.17 per second of generated video.
FLUX 3 FLF API (First and Last Frame to Video)Need a clip to land on an exact closing image? Passing start_image_url and end_image_url locks both ends of the shot while the model fills in the motion between them. Logo reveals, transformation sequences, and scene handoffs that must match surrounding footage all fit here, at $0.17 per second of generated video.
FLUX 3 Extend API (Video Extension)Existing footage carries the story forward on this endpoint: an MP4 under 50 MB and shorter than 15 seconds is continued from its final frames according to the prompt. Audio keeps generating alongside the picture, and the same 720p or 1080p output and 5 to 20 second range still apply. Extension is priced at $0.41 per second of generated video.

在單次 FLUX 3 API 呼叫中生成影片、音訊與導演指令

FLUX 3 API 由 Black Forest Labs 建構於單一多模態骨幹之上,可在同一次生成流程中回傳最長二十秒的 HD 或 Full HD 影片,並同步生成對白、音效與環境聲;過程中也能依照鏡頭、關鍵影格、語言與畫面文字等指令進行控制。

一次生成二十秒的畫面與聲音

單次呼叫即可回傳 5 到 20 秒的影片,音訊在同一次流程中生成,絕非事後配音。對白、音效與環境音軌會精準落在事件發生的影格上,輸出可達 720p HD 或 1080p Full HD。正是這種時間同步,讓炒鍋竄火或門被重重摔上看起來像實拍,而不是後期拼接。

在同一次生成中切換場景與鏡位

只要要求切鏡,模型就能做到。場景與攝影機角度可在同一次生成中變換,同時讓同一角色、服裝與燈光邏輯貫穿每個鏡頭。更長的作品可透過 agentic clip chaining 產生,將多次獨立生成串接成長達數分鐘的序列。過去需要四次渲染和一位剪輯師處理的分鏡,如今可直接回傳為一段連續作品。

進入 FLUX 3 API 的五種方式

純文字、單張靜態圖、首尾影格組合、沿時間軸放置的關鍵影格,或用既有片段繼續生成:五種入口皆受支援。關鍵影格可鎖定發生的內容與時間點,而續寫則會接續你手上的既有素材。手上已有品牌靜態圖或半成品剪輯的工作室,可直接從這些資產開始,而不必從零描述每個鏡頭。

支援十三種語言且精準對上的對白

原生對白涵蓋 English dialects、Chinese、Spanish、French、German、Japanese、Portuguese、Russian、Italian、Indonesian、Turkish、Hindi、Punjabi 等更多語言,唇形會配合你要求的語言同步。排版文字也會作為場景的一部分渲染,因此招牌與標題會自然位於畫面中,而不是之後再合成上去。因此,一個提示詞就能交付在地化廣告,並且連畫面中的文字都已就位。

透過一組 Atlas Cloud 金鑰存取背後的 FLUX 3 API

Atlas Cloud 透過與其其餘目錄相同的統一 endpoint 提供 FLUX 3,因此一組金鑰即可存取影片、影像與語言模型,無需第二套整合。計費維持 pay as you go,沒有訂閱費,也沒有 seat fees,你只需為實際執行的生成付費。切換模型只要改一個字串。立即開始建構。

一個提示詞,三個模型:FLUX 3 API 並排比較

下方每一列都會在 Atlas Cloud 上,將同一個完全相同的提示詞分別交給 FLUX 3 API 與另外兩個影片模型執行,因此可以基於同一份簡述評估動作連貫性、鏡頭切換與原生音訊,而不是看精挑細選的示範片段。

提示詞

電影感真人實拍,夜晚雨水濕滑的東京後巷。一隻穿著小小黃色雨衣的柴犬踩著滑板沿巷子滑行,在水窪與蒸氣孔之間穿梭。開場是一個低角度跟拍鏡頭,貼近濕漉漉的地面,從滑板後方掠過,霓虹倒影在旁飛速劃過。狗狗擦撞到一疊紙燈籠,燈籠瞬間飛散到空中;鏡頭以甩鏡跟隨其中一盞旋轉的燈籠,翻滾著朝拉麵攤飛去。切到空拍鏡頭向上並向後拉遠,同時柴犬一掌拍下,讓滑板旋轉後急停,並對著大笑的拉麵師傅吠叫一聲;師傅彈出一片叉燒,狗狗在半空中接住。溫暖的攤位燈光對比冰冷霓虹,水花由背光照亮。音訊:嘶嘶作響的雨聲、聚氨酯輪子滾過石板的隆隆聲、炒鍋的滋滋聲、一聲尖銳犬吠、某處上方駛過的列車聲。16:9 畫面比例。

Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Kling v3.0 on Atlas Cloud

提示詞

手繪動畫風格,明亮正午,位於無邊無際的雲海之上。一名十幾歲的天空釣手站在木製飛空艇甲板上穩住身形,將長長的釣線拋入雲海。以第一人稱視角從欄杆上方開場,釣線甩出並消失在一片白茫茫之中。釣竿猛然繃緊,鏡頭切換成繞著甲板快速環繞的運鏡;她被拖著橫越木板,繩索在手套間摩擦冒煙,一隻靴子勾住一圈索具。她一腳踩上欄杆,奮力向後拉,就在此時,一條鯨魚般巨大的錦鯉從她身後的雲層中破雲躍出,鱗片將彩虹般的光芒灑滿船帆。最後以低角度英雄鏡頭收尾,船員們爆出歡呼,雲霧水花飄過畫面。繪畫感賽璐璐上色,溫暖的輪廓光,可見筆觸質感。音訊:呼嘯的風聲、繩索吱嘎聲、逐漸升起的管弦樂高潮、破雲躍出時深沉的水聲轟鳴。16:9 畫面比例。

Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Generated with Kling v3.0 on Atlas Cloud

團隊如何運用 FLUX 3 API

無論任務是帶有原生音訊、長達二十秒的社群短片、以關鍵影格構成的分鏡、在地化廣告剪輯,或是在最終算圖前快速產出草稿版本,FLUX 3 API 都能在 Atlas Cloud 上支援,採用 pay-as-you-go 計價並提供 Day-0 access。

自帶聲音的社群短片

只要一段文字提示,就能生成最長二十秒的影片,並同步產生語音、音效與環境聲。社群團隊不必再另外處理音訊,就能取得完成版短片。

透過 FLUX 3 API 製作多鏡頭分鏡

有序的關鍵影格讓 FLUX 3 API 能依照定義好的時刻推進場景,在單次生成中切換攝影機角度與場景設定。分鏡藝術家可在安排任何拍攝前,先預覽完整序列。

畫面中的字體與文字

生成場景中的字體能精準呈現,多語文字處理也比早期 FLUX 世代更進步。包裝模型、標題卡與在地化橫幅都能透過單次呼叫產出,並可直接進入審核。

使用 FLUX 3 API 製作在地化廣告剪輯

需要同一支廣告投放六個市場?FLUX 3 API 會隨影片生成同步的多語對白,讓每個版本都具備各自的在地化聲音軌,而不需要配音流程。

讓既有素材獲得第二生命

既有影片素材可以帶入新的情境、以相符的音訊延展,或在保留核心元素的前提下重新塑形。代理商能讓舊有活動資產重獲新生,而不必再委託一次拍攝。

FLUX 3 API 上的低成本草稿流程

草稿模式能以較低成本快速回傳 HD 預覽,核准後的鏡頭可再透過 FLUX 3 API 以 HD 或 FHD 重新算圖。當一個概念需要嘗試二十次時,迭代成本仍能保持可負擔。

FLUX 3 API 與 Atlas Cloud 上其他影片模型並排比較

比較影片長度、輸出解析度、原生音訊與每秒成本,看看 FLUX 3 API 在哪些地方更有優勢,以及 Atlas Cloud 的其他模型何時更適合你的工作流程。

模型最大片長最大輸出解析度原生音訊每秒價格
FLUX 3 Video (Text-to-Video)20 sFHD,每幀最高 2 MP√ 對白、SFX、環境音$0.17 HD / $0.29 FHD
FLUX 3 Video (Video-to-Video)20 sFHD,每幀最高 2 MP√ 對白、SFX、環境音$0.41 HD / $0.53 FHD
Seedance 2.0 Text-to-Video15 s4K (3840 x 2160)√ 預設開啟$0.112
Kling V3.0 Turbo Text-to-Video15 s1080p√ 可選,預設關閉$0.112
Wan-2.7 Text-to-video15 s原生 1080p,1440p-SR√ SFX、音樂、環境音$0.10
Veo3.1 Text-to-video8 s1080p√ 同步音訊$0.20

如何在 Atlas Cloud 上使用 FLUX 3

幾分鐘即可上手 — 按照以下簡單步驟,透過 Atlas Cloud 平台整合和部署模型。

建立 Atlas Cloud 帳戶

在 atlascloud.ai 註冊並完成驗證。新用戶可獲得免費額度,用於探索平台和測試模型。

為何在 Atlas Cloud 使用 FLUX 3

將先進的 FLUX 3 模型與 Atlas Cloud 的 GPU 加速平台相結合,提供無與倫比的效能、可擴展性和開發體驗。

效能與靈活性

低延遲:
GPU 最佳化推理,實現即時回應。

統一 API:
一次整合,暢用 FLUX 3、GPT、Gemini 和 DeepSeek。

透明定價:
按 Token 計費,支援 Serverless 模式。

企業與規模

開發者體驗:
SDK、資料分析、微調工具和模板一應俱全。

可靠性:
99.99% 可用性、RBAC 權限控制、合規日誌。

安全與合規:
SOC 2 Type II 認證、HIPAA 合規、美國資料主權。

FLUX 3 API 開發者常見問題解答

FLUX 3 是 Black Forest Labs 的多模態基礎模型,並非由多個獨立系統拼接而成,而是針對影像、影片、音訊與動作預測進行聯合訓練。FLUX 3 API 透過 Atlas Cloud 開放此模型,因此單次請求即可傳回含同步音訊的影片。一組 OpenAI-compatible 金鑰可同時用於目錄中的所有其他模型,並按使用量計費。

目前已正式可用的能力是影片生成,涵蓋文字轉影片、影像轉影片、關鍵影格引導鏡頭,以及既有片段續寫,且每項都可選擇加入原生音訊。Black Forest Labs 正分階段推出此系列,因此 FLUX 3 Image 與 FLUX 3 Action 會在影片端點之後推出,而非同步上線。

建立帳號、產生 API 金鑰,並將現有用戶端指向 FLUX 3 API 端點即可。請求採用 Atlas Cloud 目錄中一致的 OpenAI-compatible 模式,因此不需要學習額外的 SDK,也不必日後處理供應商綁定問題。計費採隨用隨付、依每次生成收費,不需要先訂閱。立即開始建置。

會,而且是在同一次生成流程中完成,而不是透過第二個模型處理,因此能讓對白、音效與環境音和畫面保持同步。FLUX 3 支援十多種語言的語音對嘴,包括 English、Chinese、Spanish、Japanese 與 Hindi。若你只需要無聲素材,也可以在每次請求中關閉音訊。

生成長度可從 5 到 20 seconds,輸出為 HD 720p;若細節比成本更重要,也可使用 Full HD 1080p。支援寬螢幕、正方形與直式構圖,因此同一段提示可用於登陸頁首屏主視覺或行動裝置動態牆。較長的故事最好由多個可控片段組成,而不是透過單一過大的請求生成。

提供一張起始影像,模型就能將其動畫化;若鏡頭必須依照特定順序命中指定時刻,也可以固定關鍵影格。既有影片素材也可以續寫,並從輸入片段尾端延續動作與構圖。請謹慎串接續寫,因為每次延伸都會建立在前一次結果之上,視覺一致性會逐漸偏移。

Draft 模式會以較低成本傳回 HD 預覽,讓你在支付最終算圖費用之前,先評估構圖、節奏與音訊。可先在此模式中反覆調整提示,然後在不變更請求結構的情況下,以標準 HD 或 Full HD 重新執行最佳提示。需要推出大量變體的團隊,最能從這個流程中受益。

影片依輸出秒數計費,因此短片段的成本只是長片段的一小部分,而且你只需為實際生成的內容付費。解析度會決定費率,Full HD 高於標準 HD,Draft 模式則低於兩者。Atlas Cloud 不會額外收取訂閱費、席位費或最低消費。立即開始。

還不行。FLUX 3 Video 是此系列中已發布的部分,FLUX 3 Image 正在分階段推出,而開放權重的 FLUX 3 Dev 變體已宣布稍後提供。Atlas Cloud 會在每個新的 FLUX 3 端點推出時加入支援,因此影像生成上線後,同一組金鑰仍可繼續使用。

聯合模型省去了拼接步驟:不需要第二次處理來讓聲音對準嘴型,也不需要在完成的剪輯下方再疊加環境音。這對對白場景尤其重要,因為音軌之間的偏移會立刻被觀眾看出來。流程可從多個服務縮減為一次呼叫,也代表需要監控的故障點更少。

探索更多系列

Seedance 2.5

Seedance 2.5 API 現已在 Atlas Cloud 上線!它為開發者提供了 ByteDance 最新的影片模型。該模型可透過文本、單張影像或多達 50 個多模態參考,一次性生成長達 30 秒的原生影片,並包含同步音訊和畫面內的多語言文本。在 Atlas Cloud 上,您可以透過單個金鑰存取它,其主體一致性和改進的物理特性可保持長鏡頭的連貫性。

檢視系列

MiniMax H3

MiniMax H3 API 開放 MiniMax 的通用多模態影片模型,可將文字、圖片、影片與音訊作為同一個脈絡來理解,而不是一次只處理一項任務。片段長度為 5 到 15 秒、24 FPS,支援從 21:9 到 9:16 的各種長寬比;只需一個 prompt,就能替換角色、更換背景、改寫對白,或從參考片段複製聲音。Atlas Cloud 透過單一 OpenAI-compatible endpoint 提供所有功能。立即開始建置。

檢視系列

Seedream 5.0 Pro

Seedream 5.0 Pro API 為開發者在 Atlas Cloud 上提供了字節跳動的可控圖像編輯模型。它透過錨點和座標精確定位編輯,將圖像分離為可編輯圖層,融合多個參考,並精準匹配顏色和材質,支援 2K 和 3K 解析度的多語言文本。在 Atlas Cloud 上,您只需一個金鑰即可存取!

檢視系列

Seedance 2.0

Seedance 2.0 API 為您提供 ByteDance 多模態影片模型的生產級存取權限——支援四模態輸入(文字、影像、影片、音訊),以及業界領先的「Universal Reference」(通用參考)系統,可在不同鏡頭間鎖定構圖、運鏡與角色動作。只需一次 API 呼叫即可整合導演級控制,固定費率為 $0.09/秒,即時取得金鑰,無需排隊——由企業級正常運行時間與合規性提供保障。Seedance 2.0 原生 4K 現已上線!

檢視系列

GPT Image 2

GPT Image 2 API 為開發者提供了訪問 OpenAI 最新圖像模型的途徑,它是 GPT Image 1.5 的繼任者。該模型可生成和編輯圖像,能夠在拉丁和 CJK 文字上實現準確的文本渲染,並在海報、樣機和資訊圖表方面具備強大的排版能力。在 Atlas Cloud 上,您可以透過一個統一的 API 與 300 多個模型一起訪問它,並享受免費額度、99.99% 的正常運行時間,且無需 OpenAI 組織驗證。

檢視系列

Gemini Omni Flash

Gemini Omni API 將 Google DeepMind 於 Google I/O 2026 發表的多模態影片生成與編輯模型帶進你的技術棧。Gemini Omni 將 Gemini 的推理引擎與生成式媒體融合,可接受文字、圖片、影片與音訊的任意組合輸入,產生一致且以知識為根據的輸出。透過自然對話持續打磨成果:替換物件、改寫場景、切換風格,同時維持物理規律、角色與畫面連貫性不變。Atlas Cloud 透過單一整合 API 提供完整的 Gemini Omni Flash 系列——文字生成影片、支援最多 7 張參考圖片的圖片生成影片,以及參考圖生成影片——採每秒計費、價格透明,$0.112 起,無需訂閱。立即開始打造。

檢視系列

Grok Imagine

Grok Imagine API 涵蓋 xAI 的圖像、影片和語音模型,從 Image 2.0 到 Video 1.5 和 xAI TTS v1。在 14 種寬高比下生成 1K 或 2K 靜止畫面,將場景擴展為 15 秒的 1080p 動態影像,使用高達 7 張參考圖像操控鏡頭,或用 20 種語言配音。Atlas Cloud 在單一端點運行所有模式,按使用量付費定價,從每張圖像 $0.02 和每秒 $0.05 起。立即開始建置。

檢視系列

Google

Google最強大的創意模型現已在Atlas Cloud上全面可用。Veo 3.1提供電影等級的影片生成,Nano Banana 2支援高保真圖像建立,而Gemini為每個工作流程帶來多模態智慧。透過單一API key即可存取完整的Google模型套件,提供Day-0可用性和隨用隨付(pay-as-you-go)定價。

檢視系列

Seedance 2.0 Mini

Seedance 2.0 Mini 將 ByteDance 的多模態影片生成技術引入到對速度和成本要求極高的工作流程中。它以更輕量的佔用空間提供 Seedance 2.0 的核心能力——更快的生成速度、更低的單支影片成本,並且使用您現有的同款 API 整合。對於運行高吞吐量流水線或進行大規模原型設計的團隊來說,Mini 是最實用的預設選擇。

檢視系列

ByteDance

從電影級影片生成到高保真影像建立,ByteDance 最強大的模型現已在 Atlas Cloud 上線。以最低的推論定價和零基礎設施開銷,大規模執行 Seedance 和 Seedream。

檢視系列

Alibaba

Atlas Cloud 將 Alibaba 的全系模型陣容整合至同一個 API 中:Qwen 適用於語言和圖像任務,Wan 適用於高達 1080p 的影片生成。所有模型均採用按需付費模式,無需訂閱。您可以使用現有的 OpenAI 兼容客戶端,透過單一的 base URL 存取 Alibaba API。

檢視系列

OpenAI

Atlas Cloud 為您提供存取完整 OpenAI API 產品線的權限,從用於圖像生成的 GPT Image 2 到用於影片的 Sora 2。每個模型均採用按需付費模式,無月度消費限制。使用相容 OpenAI 的 API,只需簡單替換基礎 URL 即可輕鬆接入。

檢視系列

一個 API,暢享全模態 AI。

探索全部模型