Seedance 2.0 Mini & Fast API 全球最低價 —— 比官方定價最高低 68%
Hero background 1Hero background 2

MiniMax H3 Multimodal Video API

MiniMax H3 是 MiniMax 的影片模型系列,支援文字、圖片與參考內容驅動的生成。建立 5 至 15 秒的影片片段,使用可選的最後一幀引導動態,保留參考圖片中的主體;若生成音訊符合工作流程,也可選擇 H3 Developer。Atlas Cloud 將 H3、H3 Fast、H3 Max 與 H3 Developer 整合至單一 API 工作流程,標準價格低至每秒 $0.038。立即開始建置。

MiniMax H3 由 MiniMax 開發。Atlas Cloud(由 Atlas Cloud AI LLC 營運)僅提供接取服務,並不擁有該模型。所有商標均歸其各自所有者所有。

探索領先模型

Atlas Cloud 為您提供最新的行業領先創意模型。

比較 MiniMax H3 影片生成端點

依解析度、時長、音訊功能、長寬比與標準價格,將 MiniMax H3、H3 Fast、H3 Max 和 H3 Developer 端點與文字、圖片或參考輸入進行配對。

模態說明
MiniMax H3 Max T2V API (Text to Video)輸入文字提示詞,即可生成 480P 或 768P 的電影感影片,時長介於 5 到 15 秒。可選擇 16:9、9:16、1:1 或自適應構圖,適合廣告、預告片與社群內容,標準價格為每秒 $0.05。
MiniMax H3 Max I2V API (Image to Video)以首幀開始,透過文字提示詞控制動畫效果,也可選用末幀來控制最終構圖。輸出解析度為 480P 或 768P,時長為 5 到 15 秒,適合產品動態展示、主視覺動畫與分鏡轉場,價格為每秒 $0.05。
MiniMax H3 Fast T2V API (Text to Video)針對文字驅動的 480P 製作,MiniMax H3 Fast 可生成時長介於 5 到 15 秒的電影感片段。其 16:9、9:16、1:1 與自適應選項支援快速概念影片及平台專用內容,標準價格為每秒 $0.046。
MiniMax H3 Fast I2V API (Image to Video)以提供的首幀搭配提示詞控制動態效果;若結尾需要視覺引導,也可加入選用的末幀。輸出為 480P、時長 5 到 15 秒,適合產品示範、動畫化作品與短篇社群素材,價格為每秒 $0.046。
MiniMax H3 Fast Reference to Video API保留參考圖片中的主體,同時透過文字提示詞定義生成的 480P 影片。此 5 到 15 秒的端點非常適合重複出現的角色、具辨識度的產品與一致的行銷視覺,標準價格為每秒 $0.046。
MiniMax H3 Developer T2V API (Text to Video)透過自架的 MiniMax H3 Developer 端點,將文字提示詞轉換為帶有生成音訊的影片。可選擇 480P、768P 或 2K 輸出,並使用 16:9、9:16 或 1:1,適合敘事概念、行銷預覽與社群製作,價格為每秒 $0.05。
MiniMax H3 Developer I2V API (Image to Video)提供開場圖片、選用的最終幀與文字提示詞,生成帶有生成音訊的動態效果。480P、768P 與 2K 輸出選項,使此自架端點適合主視覺動畫、產品場景與分鏡序列,價格為每秒 $0.05。
MiniMax H3 Developer Reference to Video API當連貫性取決於既有媒體時,可使用一張或多張參考圖片或影片,在新提示詞引導的影片中保留主體,並加入生成音訊。可使用 480P、768P 或 2K 輸出,適合重複出現的角色與相互連貫的品牌影片序列,標準價格為每秒 $0.05。
MiniMax H3 T2V API (Text to Video)將文字提示詞轉換為電影感 2K 影片,時長可選擇 5 到 15 秒。每個結果都能使用 16:9、9:16、1:1 或自適應長寬比,適合精緻的預告片、直式故事與行銷素材,價格為每秒 $0.038。
MiniMax H3 I2V API (Image to Video)將首幀與文字提示詞結合,必要時加入選用的末幀,讓 2K 解析度的畫面栩栩如生。5 到 15 秒的輸出時長適合產品揭示、角色動畫與規劃好的視覺轉場,標準價格為每秒 $0.038。
MiniMax H3 Reference to Video API參考引導生成會保留輸入圖片中的主體,同時由提示詞引導生成 2K 影片。影片時長介於 5 到 15 秒,適合以角色為核心的場景與一致的產品視覺,價格為每秒 $0.038。

一次 MiniMax H3 API 呼叫,兼具畫面、聲音與剪輯

MiniMax H3 API 回傳的每段影片最長可達 15 秒、支援 1440p 並內建原生立體聲音訊;可任意混合文字、圖片、影片與語音參考素材,且同一個呼叫還能編輯既有影片中的角色、場景與對白。

十二個參考檔案,一次 MiniMax H3 API 呼叫

一次 MiniMax H3 API 請求最多接受 9 張參考圖片、3 段影片與 3 條音訊,總數上限為 12 個檔案。模型不會把它們視為彼此獨立的輸入欄位,而是將文字、影像與聲音視為同一個情境,從照片擷取角色、從影片取得鏡頭運動、從音軌提取情緒,並整合到同一個場景中。對已有素材的團隊而言,這提供了直達完成鏡頭的途徑。

每段影片皆具備原生立體聲音訊

每個結果都附帶聲音。對白、環境音與音樂會在以每秒 24 格算繪畫面的同一輪處理中,以原生立體聲生成,因此不需要事後配樂或配音。由於鏡頭生成時就會決定時間安排,腳步聲、語音與剪接都能與動作保持同步。短篇廣告與社群影片產出後即可發布。

透過 MiniMax H3 API 進行提示詞層級的編輯

需要把貓換成狗、替換綠幕,或改寫一句對白嗎?MiniMax H3 API 可對你提供的影片套用這類編輯,涵蓋角色、物件、背景、光線與特效;未提及的部分則會盡量維持接近原始內容。提示詞最長可達 7000 個字元,因此可以在一次處理中疊加十多項變更,讓已核准剪輯版本的反覆修改更加實際。

語音音色轉移與對白替換

將語音樣本與圖片或影片素材一同送出,生成的角色就會以該音色說話。每次請求最多可加入 3 個音訊參考素材,每個長度介於 2 至 15 秒;音訊必須始終搭配視覺輸入,不能單獨送出。既有對白也能替換,並調整表演以符合原本的呈現方式。系列內容可在每一集維持一致且易於辨識的聲音。

MiniMax H3 API 支援 1440p 與 6 種長寬比

影片長度介於 5 至 15 秒;1440p 模式會將短邊設為 1440 像素,適用於 16:9 至 9:16 的範圍;在 21:9 等較寬長寬比下,則約為 3.7 百萬像素,例如 2976 × 1248。共有 6 種長寬比可選,從電影感的 21:9 到直式 9:16,MiniMax H3 API 也能替你自動選擇。這個範圍足以涵蓋預告片、產品循環影片與直式劇情內容,無需切換模型。

直接輸入製作格式,無需轉檔

如果來源檔案直接來自攝影機或剪輯時間軸,可以原格式送入:H.264 與 H.265 影片、JPG、PNG、WEBP、HEIC 與 HEIF 靜態圖片,以及 WAV 與 MP3 音訊。單一檔案上限為影片 50MB、圖片 30MB、音訊 15MB;透過 URL 傳遞素材則可讓請求維持在 64MB 的本文大小限制內。在 Atlas Cloud 上,整套素材可透過單一 OpenAI 相容金鑰處理,並採用隨用隨付計費。

相同提示詞,三款引擎:MiniMax H3 API 正面對決

此組中的每段片段都來自同一段完全相同的提示詞,分別送至 MiniMax H3 API 以及 Atlas Cloud 上託管的另外兩個影片模型,因此可在不改動任何一個字的情況下,比較動態、聲音與指令遵循度。

提示詞

15 秒,16:9 橫向短影片。深夜自助洗衣店的真人實拍影像,融合手繪發光動畫,形成混合媒材畫面。一間小型自助洗衣店,螢光燈微微閃爍;店內有運轉中的洗衣機、塑膠洗衣籃和一張老舊長椅,地上躺著一隻襪子。整個空間很安靜,帶著淡淡的懷舊氛圍。畫面具有單手手持手機拍攝的質感,明顯有攝影機晃動;白色螢光燈讓曝光在明暗之間起伏;玻璃表面帶有環境反射;鏡頭靠近物體時會有對焦延遲。畫面不應像商業廣告那樣精緻有序——整體感覺應像真實的紀錄片式隨手捕捉,彷彿你深夜偶然闖入,追逐某種奇異、夢境般的幻象時順手拍下。

Generated with MiniMax H3 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Generated with Wan-2.7 on Atlas Cloud

提示詞

第一人稱視角 · 視線高度 · 手持遊戲鏡頭 場景:鏡頭模擬玩家操作一款現代戰爭 FPS 遊戲,雙手持突擊步槍,沿著軍事基地外圍緩慢推進。玩家沿著掩體旁的道路向前移動,準星掃過前方通道;短暫停頓後,朝遠處目標射出幾發子彈,接著繼續向前推進——就像一般玩家的實際遊玩畫面。 光線:現代軍事基地的冷色調自然光,與煙霧和槍口火光交織。畫面寫實且清晰,金屬武器、戰場塵土與霧霾都具有 AAA 遊戲級質感。 運鏡:隨著玩家移動,鏡頭帶有輕微的手持晃動——先是緩慢前進,接著小幅左右掃視觀察,開火時有細微後座力震動,最後再穩定地繼續向前推進。

Generated with MiniMax H3 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Generated with Wan-2.7 on Atlas Cloud

為每份影片簡報選擇正確的 MiniMax H3 路線

使用 MiniMax H3 Fast 將 480P 草稿升級為 2K 行銷鏡頭,並透過 H3 Developer 製作支援音訊的概念內容;MiniMax H3 系列涵蓋產品動態、社群變體、固定角色,以及從文字、圖片或參考素材生成的分鏡預覽。

使用 MiniMax H3 Fast 製作社群草稿

MiniMax H3 Fast 可將文字提示轉換為時長 5 至 15 秒的 480P 影片片段。社群團隊可先測試行銷切入點、節奏與畫面比例,再投入高解析度製作。

從核准的靜態圖像製作產品動態

透過圖片端點將首幀製成動畫,並可選擇使用末幀引導結尾。行銷團隊可從核准的靜態圖像製作產品揭示、型錄動態與上市素材。

使用 MiniMax H3 製作 2K 行銷鏡頭

行銷活動需要高解析度輸出時,請選擇 2K MiniMax H3 路線。代理商可從文字或圖片製作精緻的主視覺鏡頭、電影感產品片段與高解析度社群素材。

根據參考素材建立固定角色

提供參考圖片以維持主體的辨識度,再透過提示詞引導生成新的影片片段。製作團隊可建立固定角色短片、連貫的宣傳內容與品牌產品場景,實現更一致的視覺效果。

多格式分鏡預覽

需要根據同一份簡報製作橫向、方形與直向預覽嗎?文字生成支援 16:9、1:1、9:16 或自適應構圖,協助創意團隊為多種版位準備分鏡方案,而無需更換系列。

使用 MiniMax H3 Developer 製作音訊概念

使用 MiniMax H3 Developer,透過文字提示或來源圖片生成含音訊的影片。創意團隊可規劃提案段落、角色片段與行銷概念,讓畫面與聲音在同一套工作流程中協同製作。

MiniMax H3 在影片 API 核心功能上的比較

比較 MiniMax H3 文字轉影片變體與其他 Atlas Cloud 模型在最高解析度、片段長度、長寬比和列示標準價格方面的差異。

模型最高解析度片段長度長寬比列示基準價格
MiniMax H3 Text-to-Video2K5 至 15 秒16:9、9:16、1:1、自適應每秒 $0.038
MiniMax H3 Fast Text-to-Video480P5 至 15 秒16:9、9:16、1:1、自適應每秒 $0.046
MiniMax H3 Max Text-to-Video768P5 至 15 秒16:9、9:16、1:1、自適應每秒 $0.05
MiniMax H3-Developer Text-to-Video2K-16:9、9:16、1:1每秒 $0.05
Kling V3.0 Turbo Text-to-Video1080p3 至 15 秒16:9、9:16、1:1$0.112
Veo 3.1 Lite Text-to-video1080p4、6 或 8 秒16:9、9:16$0.05

如何在 Atlas Cloud 上使用 MiniMax H3

幾分鐘即可上手 — 按照以下簡單步驟,透過 Atlas Cloud 平台整合和部署模型。

建立 Atlas Cloud 帳戶

在 atlascloud.ai 註冊並完成驗證。新用戶可獲得免費額度,用於探索平台和測試模型。

為何在 Atlas Cloud 使用 MiniMax H3

將先進的 MiniMax H3 模型與 Atlas Cloud 的 GPU 加速平台相結合,提供無與倫比的效能、可擴展性和開發體驗。

效能與靈活性

低延遲:
GPU 最佳化推理,實現即時回應。

統一 API:
一次整合,暢用 MiniMax H3、GPT、Gemini 和 DeepSeek。

透明定價:
按 Token 計費,支援 Serverless 模式。

企業與規模

開發者體驗:
SDK、資料分析、微調工具和模板一應俱全。

可靠性:
99.99% 可用性、RBAC 權限控制、合規日誌。

安全與合規:
SOC 2 Type II 認證、HIPAA 合規、美國資料主權。

MiniMax H3 API 模型、定價與設定

MiniMax H3 是 MiniMax 的影片模型系列,可根據文字、圖片與參考媒體生成影片片段。在 Atlas Cloud 上,此系列包含標準版 H3、H3 Fast、H3 Max 與 H3 Developer,支援文字轉影片、圖片轉影片,以及特定的參考內容轉影片路由。可用的輸出規格介於 480P 至 2K,視所選模型而定。

您可以從文字提示開始,使用可選的末幀讓首幀動起來,或透過支援的參考內容轉影片路由維持主體一致性。H3 Developer 還能在影片中生成音訊,而每個變體都有各自的路由、解析度與參數限制。

建立 Atlas Cloud 帳戶與 API 金鑰,然後選取確切的模型 ID,並查看該模型目前的參數結構描述。透過 Atlas Cloud OpenAI 相容 API 傳送請求,再在您的應用程式中處理返回的影片。今天就開始建置。

MiniMax H3 Fast 提供文字轉影片、圖片轉影片與參考內容轉影片路由,可生成長度 5 至 15 秒、解析度為 480P 的影片片段。標準價格為每生成 1 秒 $0.046,圖片路由接受首幀,並可選擇提供末幀。如果您的專案需要 480P 輸出,且符合這三種輸入工作流程,便適合使用 H3 Fast。

如果您的工作流程需要 2K 輸出,請選擇標準版 H3。若要使用 480P 的文字、圖片或參考輸入,請選擇 H3 Fast;若要生成 480P 或 768P 的文字與圖片內容,請選擇 H3 Max;若要使用可生成音訊的 480P、768P 或 2K 工作流程,請選擇 H3 Developer。

圖片轉影片路由接受首幀,也可以選擇使用末幀來引導結尾。標準版 H3、H3 Fast 與 H3 Developer 都提供參考內容轉影片功能,但支援的參考輸入會依 endpoint 而有所不同。目前 H3 Max 在 Atlas Cloud 上提供文字與圖片路由。

標準版 H3 可輸出長度 5 至 15 秒的 2K 影片片段;H3 Fast 支援相同長度範圍的 480P;H3 Max 則支援長度 5 至 15 秒的 480P 或 768P。對於文字轉影片,這三個變體提供 16:9、9:16、1:1 與自適應構圖;H3 Developer 支援 16:9、9:16 與 1:1。請查看所選 endpoint 的結構描述,因為圖片與參考路由可能提供不同的控制項。

計費依每個生成的秒數計算。標準價格為 H3 每秒 $0.038、H3 Fast 每秒 $0.046,以及 H3 Max 或 H3 Developer 每秒 $0.05。您可以將該路由的標準費率乘以所選輸出長度,來估算一次請求的費用。

不能。經驗證的 Atlas Cloud 設定檔明確列出 H3 Developer 的文字、圖片與參考路由支援生成音訊,但未說明標準版 H3、H3 Fast 或 H3 Max 支援音訊。如果音訊必須包含在文件所述的輸出中,請選擇 H3 Developer。

首先確認模型 ID 是否與預期的文字、圖片或參考路由相符。根據該 endpoint 目前的結構描述,驗證所有必要欄位,尤其是提示、媒體輸入、解析度、片段長度與長寬比。如果請求仍然失敗,請先檢查返回的錯誤,再進行重試,不要重新提交相同的無效負載。

探索更多系列

Seedance 2.5

Seedance 2.5 API 現已在 Atlas Cloud 上線!它為開發者提供了 ByteDance 最新的影片模型。該模型可透過文本、單張影像或多達 50 個多模態參考,一次性生成長達 30 秒的原生影片,並包含同步音訊和畫面內的多語言文本。在 Atlas Cloud 上,您可以透過單個金鑰存取它,其主體一致性和改進的物理特性可保持長鏡頭的連貫性。

檢視系列

Wan 3.0

Wan 3.0 API 是阿里巴巴 Wan 影片系列的下一代產品,旨在將長影片生成、多參考控制和影音品質推向新的高度。Atlas Cloud 已經代管了 Wan 2.7、2.6 和 2.5,而 Wan 3.0 透過相同的統一金鑰運行,無需額外設定。立即開始建置吧。向下捲動至展示區,查看 Wan 3.0 的創作能力。

檢視系列

MiniMax H3

MiniMax H3 是 MiniMax 的影片模型系列,支援文字、圖片與參考內容驅動的生成。建立 5 至 15 秒的影片片段,使用可選的最後一幀引導動態,保留參考圖片中的主體;若生成音訊符合工作流程,也可選擇 H3 Developer。Atlas Cloud 將 H3、H3 Fast、H3 Max 與 H3 Developer 整合至單一 API 工作流程,標準價格低至每秒 $0.038。立即開始建置。

檢視系列

Seedream 5.0 Pro

Seedream 5.0 Pro API 為開發者在 Atlas Cloud 上提供了字節跳動的可控圖像編輯模型。它透過錨點和座標精確定位編輯,將圖像分離為可編輯圖層,融合多個參考,並精準匹配顏色和材質,支援 2K 和 3K 解析度的多語言文本。在 Atlas Cloud 上,您只需一個金鑰即可存取!

檢視系列

Seedance 2.0

Seedance 2.0 API 為您提供 ByteDance 多模態影片模型的生產級存取權限——支援四模態輸入(文字、影像、影片、音訊),以及業界領先的「Universal Reference」(通用參考)系統,可在不同鏡頭間鎖定構圖、運鏡與角色動作。只需一次 API 呼叫即可整合導演級控制,固定費率為 $0.09/秒,即時取得金鑰,無需排隊——由企業級正常運行時間與合規性提供保障。Seedance 2.0 原生 4K 現已上線!

檢視系列

GPT Image 2.5

OpenAI 的 GPT Image 2.5 系列為開發者在生產影像工作流程中提供了 Flare 和 Sunburst 兩種選擇。支援高達 3840x2160 的任意解析度渲染,並可從包含 xhigh 和 max 在內的五個品質等級中進行選擇,以滿足特定的輸出需求。Atlas Cloud 提供即用型的 REST 推理服務,無冷啟動,標準定價為每次生成 0.004 美元起。立即開始建置吧。

檢視系列

GPT Image 2

GPT Image 2 API 為開發者提供了訪問 OpenAI 最新圖像模型的途徑,它是 GPT Image 1.5 的繼任者。該模型可生成和編輯圖像,能夠在拉丁和 CJK 文字上實現準確的文本渲染,並在海報、樣機和資訊圖表方面具備強大的排版能力。在 Atlas Cloud 上,您可以透過一個統一的 API 與 300 多個模型一起訪問它,並享受免費額度、99.99% 的正常運行時間,且無需 OpenAI 組織驗證。

檢視系列

Gemini Omni Flash

gemini omni API 將 Google DeepMind 原生多模態的 Gemini Omni Flash 系列(包括 Gemini Omni 1.1 Flash)帶給開發者。您可以建立具同步原生音訊的電影級影片、以精確的起始與結束影格控制讓靜態圖片動起來,或透過文字引導的編輯修改現有影片,同時保留未修改的內容。Atlas Cloud 提供單一 OpenAI 相容金鑰、統一存取,以及透明的隨用隨付定價。立即開始建置。

檢視系列

Grok Imagine

Grok Imagine API 涵蓋 xAI 的圖像、影片和語音模型,從 Image 2.0 到 Video 1.5 和 xAI TTS v1。在 14 種寬高比下生成 1K 或 2K 靜止畫面,將場景擴展為 15 秒的 1080p 動態影像,使用高達 7 張參考圖像操控鏡頭,或用 20 種語言配音。Atlas Cloud 在單一端點運行所有模式,按使用量付費定價,從每張圖像 $0.02 和每秒 $0.05 起。立即開始建置。

檢視系列

Google

Google最強大的創意模型現已在Atlas Cloud上全面可用。Veo 3.1提供電影等級的影片生成,Nano Banana 2支援高保真圖像建立,而Gemini為每個工作流程帶來多模態智慧。透過單一API key即可存取完整的Google模型套件,提供Day-0可用性和隨用隨付(pay-as-you-go)定價。

檢視系列

Seedance 2.0 Mini

Seedance 2.0 Mini 將 ByteDance 的多模態影片生成技術引入到對速度和成本要求極高的工作流程中。它以更輕量的佔用空間提供 Seedance 2.0 的核心能力——更快的生成速度、更低的單支影片成本,並且使用您現有的同款 API 整合。對於運行高吞吐量流水線或進行大規模原型設計的團隊來說,Mini 是最實用的預設選擇。

檢視系列

ByteDance

從電影級影片生成到高保真影像建立,ByteDance 最強大的模型現已在 Atlas Cloud 上線。以最低的推論定價和零基礎設施開銷,大規模執行 Seedance 和 Seedream。

檢視系列

一個 API,暢享全模態 AI。

探索全部模型