Hero background 1Hero background 2Hero background 3

HappyHorse 1.1 Multi Image Video Generation

HappyHorse 1.1 是阿里巴巴為開發者打造的影片生成系列,可從文字、來源畫格或視覺參考素材開始工作。它能將提示詞轉換為影片片段、搭配選定的首幀與可選的引導內容製作動畫,並可使用一至九張參考圖片,精準控制視覺方向。Atlas Cloud 將這些工作流程整合於單一介面,提供透明的隨用隨付定價。立即開始打造。

Happyhorse 1.1 由 Alibaba 開發。Atlas Cloud(由 Atlas Cloud AI LLC 營運)僅提供接取服務,並不擁有該模型。所有商標均歸其各自所有者所有。

探索領先模型

Atlas Cloud 為您提供最新的行業領先創意模型。

比較 HappyHorse 1.1 影片生成模式

根據您希望引導每部影片的方式,在文字、圖片與參考輸入之間進行選擇。

模態說明
HappyHorse 1.1 T2V API (Text to Video)將文字提示轉換為 480P、720P 或 1080P 影片,支援彈性的長寬比與 3 至 15 秒的影片時長。無需來源圖片,適合用於概念視覺化、社群內容與影片製作。
HappyHorse 1.1 I2V API (Image to Video)以首幀圖片為起點,生成 3 至 15 秒的影片,並可選擇提示引導及 480P、720P 或 1080P 輸出。適合用於產品動畫、角色動態,以及以既有構圖為基礎的視覺敘事。
HappyHorse 1.1 R2V API (Reference to Video)透過一至九張參考圖片搭配文字提示來引導影片生成,並可選擇 480P、720P 或 1080P 輸出、彈性的長寬比,以及 3 至 15 秒的影片時長。適合參考導向的場景、以角色為核心的片段,以及需要更強視覺指引的專案。

三種輸入,一套 HappyHorse 1.1 工具組

HappyHorse 1.1 可將提示詞、首幀或最多 9 張參考圖片轉換成 3 至 15 秒的影片,提供 480P、720P 和 1080P 輸出、文字與參考模式適用的 9 種比例、seed 控制,以及透過 Atlas Cloud 按用量計費的存取方式。

HappyHorse 1.1 文字轉影片

只需輸入最多 2,500 個字元的文字提示詞,即可在不使用圖片輸入的情況下生成完整片段。HappyHorse 1.1 支援 480P、720P 或 1080P 輸出,並可將影片時長設定為 3 至 15 秒。提供 9 種長寬比,可用於寬螢幕、直式、正方形、肖像或超寬螢幕內容。此工作流程適合概念視覺化、廣告和短篇敘事場景。

首幀動畫

將一張首幀圖片轉換成動態內容,並可選擇加入提示詞來引導動作、風格或場景細節。影像轉影片端點接受最大 20 MB 的 JPEG、JPG、PNG 或 WEBP 檔案,且圖片的兩個尺寸都必須至少為 300 像素。可選擇 480P、720P 或 1080P,以及 3 至 15 秒的影片時長。適合產品展示圖、肖像和分鏡關鍵幀。

HappyHorse 1.1 參考控制

搭配 1 至 9 張參考圖片和必填的文字提示詞,引導生成全新影片。每張 JPEG、JPG、PNG 或 WEBP 參考圖片大小上限為 20 MB,且短邊必須至少為 400 像素。可設定輸出的解析度、時長、長寬比和 seed。此模式為角色、產品及美術指導工作流程提供更多來源素材。

適用各種用途的格式

使用 9 種比例為文字或參考圖驅動的生成內容設定適合用途的畫面格式:16:9、9:16、1:1、4:3、3:4、4:5、5:4、9:21 和 21:9。解析度涵蓋 480P、720P 和 1080P,影片時長則介於 3 至 15 秒。結合這些控制項,即可產生適合行動版動態消息、網頁播放器、正方形版位、肖像或超寬螢幕構圖的片段,無需更換端點。

HappyHorse 1.1 Seed 控制

當你需要更精準地控制生成輸入時,可將 seed 參數與提示詞、解析度、比例和時長設定搭配使用。HappyHorse 1.1 接受 -1 至 2,147,483,647 的 seed 值,其中 -1 代表要求使用隨機 seed。反覆測試時,請明確指定其他設定。這種參數化工作流程有助於開發者整理創意測試,並以一致的請求結構比較不同變化。

一組金鑰,三種工作流程

透過 Atlas Cloud,使用一組相容於 OpenAI 的金鑰和按用量計費方案,即可存取全部 3 種 HappyHorse 1.1 工作流程。標準價格從每秒 $0.07 起,費用會依用量計算,而非採用訂閱制。你可以在文字轉影片、影像轉影片和參考圖轉影片的模型路徑之間切換,同時維持相同的整合模式。這種設定適合打造多模式影片產品、且不想分別管理不同供應商帳戶的開發者。

HappyHorse 1.1 三模型提示詞對決

看看 HappyHorse 1.1 與另外兩款可比擬的影片模型,如何詮釋相同提示詞,呈現電影感動作與風格化奇幻敘事。

提示詞

一段 8–10 秒、連續且具照片寫實感的動態美食電影場景,發生在一節穿越猛烈高山暴風雪、全速行駛中的餐車內。一名技術純熟的列車主廚隨著車廂劇烈的左右搖晃自然擺動,同時準備早餐:他單手將一張薄薄的金黃色可麗餅高高拋起,滑過狹窄走道,用空出的手接住一顆滾動中的橙子,接著以平底鍋邊緣擊中下落的可麗餅,讓它沿著乾淨且符合物理規律的弧線,穿過開啟的車廂連接門。從極近距離開始,鏡頭沿著轟鳴的爐火、滋滋作響的麵糊,以及飛濺到拋光鋼面上的熱奶油液滴橫向追蹤;接著快速繞行主廚半圈,捕捉他抵銷每次震動時的動作,外套與圍裙做出逼真的反應;然後精準穿過門口,以鎖定飛行中可麗餅的跟拍鏡頭衝入下一節車廂,掠過一名侍者,最後完美落在一位驚訝乘客的早餐盤中。就在落盤的精確瞬間,車外窗邊一場巨大的雪崩奔湧而過,而列車成功逃離,形成強烈的視覺高潮。溫暖的鎢絲燈與橙色火光,和穿透飄雪窗戶的冰藍色黎明相互交織;層次豐富的橙金色食物色調、銀灰色金屬與冰冷藍色的荒野;深邃狹窄的中央透視、門框套門框的重複構圖、強烈視差、細微手持震動;兩節車廂之間保持清晰的動態辨識度、無縫的主體連續性與空間一致性,並呈現逼真的平衡、流暢飛濺、布料慣性、碰撞與拋射物理效果。同步聲音設計:鐵軌喀噠聲與車廂呻吟建立節奏,平底鍋嘶嘶聲與奶油爆響加快節奏,橙子隨金屬碰撞聲同步滾動,鍋擊落下時形成明亮的打擊節拍,接著是柔和的餐盤拍擊聲與震耳欲聾的雪崩轟鳴;不要慢動作、不要靜態填充畫面、不要螢幕、介面、儀表板、進度條、圖表、說明文字、字幕、標誌或任何可見文字。高級電影感寫實風格、動態美食廣告、沉浸式一鏡到底幻覺、16:9 畫面比例。

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

提示詞

一段高飽和、圖像化 3D 動畫的 9 秒動作場景,發生在黃昏時分的貨櫃碼頭:一架珊瑚紅色三角鋼琴脫離控制,沿著鋼製裝卸坡道疾馳而下,小型腳輪在令人信服的重量作用下顫動並彈跳;一名身穿鈷藍色工作服的堆高機駕駛員緊追在後,在芥末黃色起重機與不斷升降、短暫形成變動緊急通道的貨櫃之間穿梭。從極低角度的追蹤鏡頭開始,距離旋轉的輪子與劇烈震動的鋼琴腳僅數英寸,火花與金屬撞擊聲和聲音完美同步;鏡頭快速升至俯視角度,揭示由珊瑚紅、鈷藍與芥末黃色色塊構成的幾何迷宮般追逐路線;接著快速搖攝並繞至高速堆高機前方,捕捉它逐漸縮短距離。抵達碼頭邊緣時,駕駛員將貨叉猛然伸入鋼琴下方,在最後一刻抬起沉重琴身,以一次強力旋轉完成轉向,並伴隨深沉且同步的金屬鏗鏘聲,將鋼琴穩穩放下。琴蓋因慣性猛然掀開;最後一拍,一隻海鷗落到琴鍵上,敲出清脆的最後一個音符。全程維持高密度動態、可信的物理動量、碰撞、懸吊彈跳、負載位移,以及穩定的角色與物體識別;硬朗陰影、大膽幾何構圖、風格化電影感 3D 動畫、銳利的黃昏輪廓光,以及由車輪喀噠聲、液壓嘶聲、貨櫃撞擊聲、引擎吃力聲、海鷗振翅聲與最後鋼琴音符構成的節奏感工業打擊樂。不要慢動作、不要閒置鏡頭、不要破壞空間連續性的剪接、不要螢幕、軟體介面、儀表板、進度條、圖表、說明文字、標籤、標誌、水印或解釋性文字。16:9 畫面比例。

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

HappyHorse 1.1 跨創意工作流程

從行銷活動概念與產品動畫,到參考圖像引導的品牌影片和開發者工具,HappyHorse 1.1 將提示詞與圖像轉化為可靈活運用的短影音內容。

HappyHorse 1.1 行銷活動概念

將文字概念轉化為 480P、720P 或 1080P 影片,並支援彈性長寬比。創意團隊無需原始素材或實際拍攝,即可製作行銷活動概念、社群貼文和故事提案。

讓靜態圖像動起來

從首幀圖像開始,再透過可選的提示詞引導其動畫效果,支援 3 至 15 秒的影片長度。產品行銷人員可以將靜態素材轉化為上市短片、展示影片或型錄動態內容。

參考圖像引導的品牌變體

使用一至九張參考圖像,模型可根據提供的視覺輸入塑造最高達 1080P 的影片。品牌團隊可以透過經核准的角色、產品或環境圖像,開發不同的行銷活動變體。

多格式內容流程

選擇彈性長寬比與三種解析度級別,透過單一生成工作流程,為不同版位準備影片片段。開發者可以在內容產品與行銷活動中支援直式、橫式及其他版面配置。

HappyHorse 1.1 影片片段規劃

需要快速的分鏡節拍,或較長的產品展示片段嗎?3 至 15 秒的影片長度,讓創意工具能在單一介面中支援快速概念、宣傳短片和精簡的視覺序列。

彈性的影片應用程式輸入

透過同一個模型系列,圍繞文字、首幀圖像和多重參考輸入建構影片應用程式。使用者可以針對每個工作流程,選擇最適合概念發想、動畫製作或品牌引導創作的起始素材。

HappyHorse 1.1 的影片生成效能比較

比較 HappyHorse 1.1 的生成模式與 Atlas Cloud 主要影片模型在支援輸入、片段長度、解析度、參考資料容量及列示基礎價格方面的差異。

模型支援的輸入輸出時長解析度參考影像上限列示基礎價格
HappyHorse-1.1 文字轉影片文字提示詞3 至 15 秒480P、720P、1080P-$0.07,未列出單位
HappyHorse-1.1 影像轉影片首幀影像與選用提示詞3 至 15 秒480P、720P、1080P-$0.07,未列出單位
HappyHorse-1.1 參考資料轉影片文字提示詞與參考影像3 至 15 秒480P、720P、1080P9$0.07,未列出單位
Wan-3.0 參考資料轉影片文字、影像、影片、音訊、文件或網頁參考資料2 至 30 秒,或智慧時長480P、720P、1080P10$0.05,未列出單位
Seedance 2.5 參考資料轉影片文字、影像、影片及音訊參考資料最長 30 秒-30$0.167,未列出單位
MiniMax H3 參考資料轉影片文字、影像、影片及音訊參考資料4 至 15 秒768p 預設,最高 2K9$0.038/秒

如何在 Atlas Cloud 上使用 Happyhorse 1.1

幾分鐘即可上手 — 按照以下簡單步驟,透過 Atlas Cloud 平台整合和部署模型。

建立 Atlas Cloud 帳戶

在 atlascloud.ai 註冊並完成驗證。新用戶可獲得免費額度,用於探索平台和測試模型。

為何在 Atlas Cloud 使用 Happyhorse 1.1

將先進的 Happyhorse 1.1 模型與 Atlas Cloud 的 GPU 加速平台相結合,提供無與倫比的效能、可擴展性和開發體驗。

效能與靈活性

低延遲:
GPU 最佳化推理,實現即時回應。

統一 API:
一次整合,暢用 Happyhorse 1.1、GPT、Gemini 和 DeepSeek。

透明定價:
按 Token 計費,支援 Serverless 模式。

企業與規模

開發者體驗:
SDK、資料分析、微調工具和模板一應俱全。

可靠性:
99.99% 可用性、RBAC 權限控制、合規日誌。

安全與合規:
SOC 2 Type II 認證、HIPAA 合規、美國資料主權。

使用 HappyHorse 1.1 開發:常見問題

HappyHorse 1.1 是 Alibaba 的影片生成模型,可在 Atlas Cloud 上將文字、首幀或參考圖片轉換成短片。此模型系列提供獨立的文字轉影片、圖片轉影片和參考圖轉影片 endpoint。

你可以根據文字提示生成場景、讓靜態圖片動起來,或使用多張視覺參考圖片引導生成新影片。這些工作流程涵蓋僅使用提示詞的影片、首幀動畫,以及參考圖片引導的內容。

建立 Atlas Cloud API 金鑰,並向 /api/v1/model/generateVideo 發送經過驗證的 POST 請求,同時提供所選的模型 ID 和必要輸入。回應會包含 task ID,你可以使用它檢查預測狀態,直到輸出準備完成。

使用 alibaba/happyhorse-1.1/text-to-video 進行提示詞生成、使用 alibaba/happyhorse-1.1/image-to-video 進行首幀動畫,或使用 alibaba/happyhorse-1.1/reference-to-video 透過多張圖片進行引導。每種模式都有自己的輸入 schema。

對於文字轉影片和參考圖轉影片,你可以選擇 480p、720p 或 1080p,時長為 3 到 15 秒,並從 9 種支援的長寬比中選擇一種。圖片轉影片提供相同的解析度和時長範圍,並將上傳的圖片作為首幀。

參考圖轉影片接受 1 到 9 個圖片 URL,以及一段描述圖片應如何引導結果的提示詞。支援 JPEG、JPG、PNG 和 WEBP 檔案,每張圖片上限為 20 MB,較短邊至少須為 400 pixels。

Atlas Cloud 列出的標準價格是 HappyHorse 1.1 三個 endpoint 均為每秒 $0.07。計費方式為隨用隨付,因此生成費用會隨要求的影片時長增加。

如果你想控制生成的隨機性,可以在文字轉影片或參考圖轉影片中使用 seed 參數。Atlas Cloud 接受明確的整數值;如果偏好使用隨機 seed,也可以指定 -1。

每個請求會生成一段 3 到 15 秒的影片。圖片轉影片使用 1 張首幀圖片,而參考圖轉影片最多接受 9 張參考圖片。

探索更多系列

Seedance 2.5

Seedance 2.5 API 現已在 Atlas Cloud 上線!它為開發者提供了 ByteDance 最新的影片模型。該模型可透過文本、單張影像或多達 50 個多模態參考,一次性生成長達 30 秒的原生影片,並包含同步音訊和畫面內的多語言文本。在 Atlas Cloud 上,您可以透過單個金鑰存取它,其主體一致性和改進的物理特性可保持長鏡頭的連貫性。

檢視系列

Wan 3.0

Wan 3.0 API 是阿里巴巴 Wan 影片系列的下一代產品,旨在將長影片生成、多參考控制和影音品質推向新的高度。Atlas Cloud 已經代管了 Wan 2.7、2.6 和 2.5,而 Wan 3.0 透過相同的統一金鑰運行,無需額外設定。立即開始建置吧。向下捲動至展示區,查看 Wan 3.0 的創作能力。

檢視系列

MiniMax H3

MiniMax H3 是 MiniMax 的多模態影片系列,支援文字、影像與參考素材引導創作。在支援的路由中,它能保留參考媒體中的主體、提供彈性的長寬比,並透過 H3 Developer 將生成的聲音與畫面配對;輸出設定檔則依端點選定。Atlas Cloud 以一組 OpenAI-compatible 金鑰統一整個系列,並提供透明的隨用隨付定價,標準費率為每秒 $0.038。立即開始打造。

檢視系列

Seedream 5.0 Pro

Seedream 5.0 Pro API 為開發者在 Atlas Cloud 上提供了字節跳動的可控圖像編輯模型。它透過錨點和座標精確定位編輯,將圖像分離為可編輯圖層,融合多個參考,並精準匹配顏色和材質,支援 2K 和 3K 解析度的多語言文本。在 Atlas Cloud 上,您只需一個金鑰即可存取!

檢視系列

Seedance 2.0

Seedance 2.0 是 ByteDance 為精準鏡頭創作打造的生產級影片模型。將提示詞轉換為影片、使用可選的末幀引導讓首幀圖片動起來,或搭配參考媒體與可選的網路搜尋塑造成果。Atlas Cloud 將這些工作流程整合至統一的 API,提供透明的按用量計費方案,以及一組相容於 OpenAI 的金鑰。立即開始打造。

檢視系列

GPT Image 2.5

OpenAI 的 gpt-image-2.5 系列讓開發者可在正式環境的影像工作流程中選擇 Flare 與 Sunburst。支援最高 3840x2160 的任意解析度渲染,並提供五個品質等級(包括 xhigh 與 max),滿足特定的輸出需求。Atlas Cloud 提供可立即使用的 REST 推論服務,無冷啟動問題,標準價格每次生成最低 $0.004。立即開始建構。

檢視系列

GPT Image 2

GPT Image 2 API 為開發者提供了訪問 OpenAI 最新圖像模型的途徑,它是 GPT Image 1.5 的繼任者。該模型可生成和編輯圖像,能夠在拉丁和 CJK 文字上實現準確的文本渲染,並在海報、樣機和資訊圖表方面具備強大的排版能力。在 Atlas Cloud 上,您可以透過一個統一的 API 與 300 多個模型一起訪問它,並享受免費額度、99.99% 的正常運行時間,且無需 OpenAI 組織驗證。

檢視系列

Gemini Omni Flash

Gemini Omni 是 Google DeepMind 原生多模態影片系列,支援透過提示詞引導進行創作與編輯。您可以從文字生成影片、讓靜態圖片動起來,或搭配選用的視覺參考修改現有影片,同時保留未變更的內容。彈性的解析度、長寬比與影片長度控制,能支援各種製作流程。Atlas Cloud 以透明的隨用隨付定價整合存取服務。立即開始打造。

檢視系列

Grok Imagine

Grok Imagine API 涵蓋 xAI 的圖像、影片和語音模型,從 Image 2.0 到 Video 1.5 和 xAI TTS v1。在 14 種寬高比下生成 1K 或 2K 靜止畫面,將場景擴展為 15 秒的 1080p 動態影像,使用高達 7 張參考圖像操控鏡頭,或用 20 種語言配音。Atlas Cloud 在單一端點運行所有模式,按使用量付費定價,從每張圖像 $0.02 和每秒 $0.05 起。立即開始建置。

檢視系列

Google

Google最強大的創意模型現已在Atlas Cloud上全面可用。Veo 3.1提供電影等級的影片生成,Nano Banana 2支援高保真圖像建立,而Gemini為每個工作流程帶來多模態智慧。透過單一API key即可存取完整的Google模型套件,提供Day-0可用性和隨用隨付(pay-as-you-go)定價。

檢視系列

Seedance 2.0 Mini

Seedance 2.0 Mini 將 ByteDance 的多模態影片生成技術引入到對速度和成本要求極高的工作流程中。它以更輕量的佔用空間提供 Seedance 2.0 的核心能力——更快的生成速度、更低的單支影片成本,並且使用您現有的同款 API 整合。對於運行高吞吐量流水線或進行大規模原型設計的團隊來說,Mini 是最實用的預設選擇。

檢視系列

ByteDance

從電影級影片生成到高保真影像建立,ByteDance 最強大的模型現已在 Atlas Cloud 上線。以最低的推論定價和零基礎設施開銷,大規模執行 Seedance 和 Seedream。

檢視系列

一個 API,暢享全模態 AI。

探索全部模型