




Youchuan API 現已涵蓋 V8.1 與 V8.2 兩個世代,支援靜態圖像與動態影像。由提示詞驅動的模式一次會傳回四種變化,圖像以原生 2K HD 算繪,無需額外升頻處理;混合功能可融合最多五個參考素材,單張靜態圖像則可動畫化為 480p 或 720p 的五秒短片。Atlas Cloud 透過單一 OpenAI-compatible key 提供服務,支援 Day-0 access,並採用每次呼叫最低 $0.086 起的計價。立即開始建置。
Atlas Cloud 為您提供最新的行業領先創意模型。
並列比較 Youchuan API 系列中的每種模態,在單一視圖中查看 V8.1 和 V8.2 端點、輸出數量、解析度,以及標準單次呼叫費率。
| 模態 | 說明 |
|---|---|
| Youchuan T2I API(文字轉圖片) | 輸入文字提示詞後,會傳回四張完成的圖片;每次執行都可選用原生 2K HD、風格參考,以及 aspect-ratio、stylize、chaos、weird 等控制項。V8.1 和 V8.2 端點每次呼叫皆為 $0.086,適合概念美術、行銷活動視覺,以及快速製作 moodboard。 |
| Youchuan I2I API(圖片轉圖片) | 已經有一張值得延伸的畫面了嗎?此端點會在文字提示詞的引導下重新詮釋輸入圖片,並傳回四個變體,同時保留原生 2K HD、風格參考,以及相同的 stylize、chaos、weird 控制項。V8.1 和 V8.2 每次呼叫皆定價 $0.086,因此迭代版面或測試不同美術方向都能維持低成本。 |
| Youchuan I2V API(圖片轉影片) | 一張靜態圖片可動畫化為四支五秒影片,解析度可選 480p 或 720p。每次執行提供四個版本,讓你保留真正符合鏡頭需求的動態效果;適用於社群循環短片、電影預視化,以及為靜態主視覺加入動感。兩個版本每次呼叫皆為 $0.086。 |
| Youchuan Blend API(多圖片融合) | 提供二到五張來源圖片,模型會以原生 2K HD 融合成四個合成結果,並可選擇加入提示詞來引導混合方向。無論是合成、氛圍混搭,或把分散的參考素材整合進同一個畫面,都適合使用此端點;V8.1 和 V8.2 每次呼叫同樣為 $0.086。 |
| Youchuan Style Transfer API(圖片重新材質化) | Retexture 會在維持輸入圖片構圖不變的前提下,重寫其藝術風格,並傳回四個重新風格化的變體。任一版本每次呼叫為 $0.129,適合品牌重塑流程、美術指導測試,以及讓混合來源的照片集具備一致視覺風格。 |
| Youchuan Remove Background API(背景移除) | 背景移除是這個系列中最直接的呼叫,可將任何輸入圖片轉換為單一結果,並把主體隔離在透明背景上。產品刊登、行銷版面與合成管線都能直接使用該輸出;V8.1 和 V8.2 每次呼叫皆定價 $0.086。 |
文字轉圖像、圖像轉圖像、混合、重塑材質、移除背景,以及五秒動畫,全都透過同一組 Youchuan API key 執行;現已涵蓋 V8.1 與 V8.2 checkpoints,提供原生 2K HD、九種長寬比,以及 stylize、chaos、weird 控制,並按呼叫次數計費。
每個最長 1024 個字元的提示詞,都會在一次呼叫中回傳四張渲染圖,並保有此系列標誌性的飽和色彩與戲劇化構圖。藝術總監可先比較多個強烈方向,再鎖定最終畫面。
stylize 範圍為 0 到 1000,chaos 最高可達 100,weird 可提升至 3000,quality 可在 1 與 4 之間切換,並可鎖定 seeds 以確保可重現性。品牌安全輸出與大膽實驗,都來自同一個 endpoint。
開啟 HD flag 後,Youchuan API 會以基礎費率的 1.5x,在從 1:1 到 21:9 的九種長寬比中渲染原生 2K。全程不經插值處理,因此細緻紋理在大尺寸印刷中依然能完整保留。
Blend 可將二到五張來源圖像融合為四個一致協調的結果,支援原生 2K,並可選擇加入提示詞來引導色彩、光線與主體的結合方式。概念團隊能把分散的參考素材收斂成一張符合品牌調性的畫面。
retexture 會鎖定構圖,將圖像重新設計為四種變化,只改變色彩、材質與氛圍,以符合提示詞。每次呼叫 $0.129,一個核准版面即可延伸出多種行銷活動主題。
一張靜態圖像加上一段簡短動態提示詞,即可產生四支五秒短片,解析度為 480p 或 720p,動態強度可設為低或高。靜態主視覺能快速轉換成社群預告或短鏡頭預覽。
以下每組比較都會透過 Youchuan API 以及 Atlas Cloud 上另外兩款可用的 image-to-video 模型,執行同一個 prompt,因此動態、場景連貫性與視覺風格的差異會直接呈現在影片畫面中,而不是只停留在規格表上。
一名騎著 fixed-gear 的單車快遞員穿梭在雨水浸濕的香港夜市,霓虹招牌的光暈在潮濕柏油路上蔓延。他擦撞到水果攤,橘子四處散落彈跳,攤販舉起雙手驚呼;快遞員側滑、單腳踩地、用力蹬出,在兩輛駛過的電車之間鑽過狹窄縫隙,身後鐵軌拖出一串火花。開場以低角度跟拍鏡頭追逐後輪穿過水窪,快速甩鏡捕捉橘子在半空翻滾,接著切到無人機鏡頭,從市場屋頂上方升起,拍下單車從另一端衝出、進入空蕩道路。體積霓虹光、每個水窪中的鏡面反射、淺景深、粗礪的電影寫實感。環境音包含市場人聲、電車鈴聲,以及在逃脫瞬間逐漸高漲的強勁 synth pulse。16:9 aspect ratio。
Generated with Youchuan V8.2 on Atlas Cloud
Generated with Kling v3.0 Pro on Atlas Cloud
Generated with seedance 2.0 Mini on Atlas Cloud
一名年輕的天空水手緊抓著小型木製飛船的索具,在黃金時刻俯衝穿越漂浮島嶼形成的峽谷。一群水晶翅膀的鳥在船首前方四散飛開,接著其中一隻折返,直接從她手中叼走黃銅羅盤。她沿著吊桿猛撲上前,抓住那隻鳥的一根尾羽,兩者一起翻滾著摔出甲板,直到她的滑翔翼啪地展開,她急轉繞過一道傾瀉進開闊天空的瀑布。開場以環繞飛船的壯闊運鏡展開,切到她沿吊桿撲下時的第一人稱 POV,接著降到低角度仰拍,捕捉滑翔翼在太陽前展開。手繪 cel shading 的繪製 anime 風格,搭配濃郁的水彩天空。呼嘯風聲、木材吱嘎聲,以及滑翔翼展開瞬間高昂壯闊的管弦樂。16:9 aspect ratio。
Generated with Youchuan V8.2 on Atlas Cloud
Generated with Seedance 2.0 Mini on Atlas Cloud
Generated with Grok Imagine Video on Atlas Cloud
無論是從零開始下提示詞,還是讓已核准的靜態圖動起來,活動主視覺、商品去背圖、預視化影格、風格重塑素材,以及五秒社群短片,都能透過同一個 Youchuan API 產出。
一次提示詞會回傳四張渲染圖,而 HD 旗標可將它們提升至原生 2K;stylize、chaos 與 aspect ratio 則用來控制整體氛圍。行銷團隊進評審會時,不再只有單一方向,而是能帶著多個方案討論。
當商品照需要放在任何背景上時,Remove Background 會以每次呼叫 $0.086 的價格,將主體分離到透明背景上。店面與 marketplace 動態商品資料流無需手動遮罩,就能取得一致的去背圖。
將二到五張參考圖輸入 Blend,模型會在可選提示詞的引導下,將它們融合成四張風格一致的 2K 影格。美術團隊能在任何內容實際搭建前,先提案出完整世界觀。
Style Transfer 會以每次呼叫 $0.129 的價格,將已核准影像重繪成四種變體,同時保持構圖不變。這讓同一份素材能套用夏季風格、節慶風格,以及介於其間的各種版本。
為什麼要從頭重做一個已經接近可用的版面?Image-to-Image 會透過文字提示詞與可選的風格參考,將草稿轉成四個更精緻的變體,讓設計師保留有效元素,同時探索不同方向。
任何靜態圖都能變成四支五秒短片,解析度可選 480p 或 720p,動態幅度可設為低或高,並用簡短提示詞描述鏡頭運動。社群團隊可持續產出更容易因動態而獲得回饋的內容。
將 Youchuan API 與 Kling、Seedance、Veo 和 Grok Imagine 並排比較可接受輸入、解析度、片段長度、音訊與牌價,然後選擇符合你所需鏡頭的端點。
| 模型 | 可接受輸入 | 解析度 | 片段長度 | 原生音訊 | Atlas Cloud 牌價 |
|---|---|---|---|---|---|
| Youchuan V8.2 Image-to-Video | 一張起始圖片,加上選用的動態提示,例如攝影機運鏡 | 480p 或 720p,其中 720p 費用為 480p 費率的 3x | 單次呼叫會回傳四段 5 秒片段 | - | $0.086 |
| Youchuan V8.1 Image-to-Video | 與 V8.2 相同,使用起始圖片搭配選用提示 | 480p 或 720p,較高階層同樣採 3x 費率比例 | 每次請求同樣提供四個版本,每段 5 秒 | - | $0.086 |
| Kling V3.0 Turbo Image-to-Video | 一張最高 10MB 的 JPG 或 PNG 起始影格,並由正向提示引導 | 720p 或 1080p,預設為 1080p | 3 到 15 秒不等 | - | $0.112 |
| Seedance 2.0 Fast Image-to-Video | 第一個影格、選用的最後一個影格,以及動態提示 | 480p 與 720p,可提升至 720p-SR、1080p-SR 和 1440p-SR | 4 到 15 秒,或設為 -1 讓模型自行選擇 | √ | $0.09 |
| Veo3.1 Fast Image-to-video | 起始圖片、選用的結束影格、提示與負向提示 | 720p、1080p 或 4K 輸出 | 4、6 或 8 秒,但 1080p 與 4K 需要 8 秒 | √ | $0.08 |
| Grok Imagine Video v1.5 Image-to-Video | 起始影格 HTTPS URL 或 data URI,搭配自然語言提示 | 480p、720p 或 1080p | 1 到 15 秒,預設為 8 秒 | - | $0.08 |
幾分鐘即可上手 — 按照以下簡單步驟,透過 Atlas Cloud 平台整合和部署模型。
在 atlascloud.ai 註冊並完成驗證。新用戶可獲得免費額度,用於探索平台和測試模型。
將先進的 Youchuan 模型與 Atlas Cloud 的 GPU 加速平台相結合,提供無與倫比的效能、可擴展性和開發體驗。
低延遲:
GPU 最佳化推理,實現即時回應。
統一 API:
一次整合,暢用 Youchuan、GPT、Gemini 和 DeepSeek。
透明定價:
按 Token 計費,支援 Serverless 模式。
開發者體驗:
SDK、資料分析、微調工具和模板一應俱全。
可靠性:
99.99% 可用性、RBAC 權限控制、合規日誌。
安全與合規:
SOC 2 Type II 認證、HIPAA 合規、美國資料主權。
Youchuan API 讓開發者透過單一 Atlas Cloud 金鑰,以程式化方式存取 Youchuan——Midjourney 的官方中國平台。它涵蓋兩個模型世代 V8.1 與 V8.2 的六種生成模式,包括 text-to-image、image-to-image、image-to-video、多圖混合、風格轉換與背景移除。計費採用按次呼叫付費,因此在送出第一個請求前不需要先簽訂訂閱方案。
此系列提供六種模式,且每一種都可在 V8.1 與 V8.2 上使用。Text-to-image、image-to-image 與 blend 每次執行會回傳四個候選結果;style transfer 會在保留輸入構圖的同時重新繪製影像;image-to-video 會將靜態影像動畫化為四段五秒短片;background removal 則會回傳一張透明背景的去背圖。Blend 可在單次呼叫中接受二到五張來源影像。
V8.1 於 2026 年 4 月 30 日推出,是當時產品線中速度最快的模型,約比先前版本快四到五倍,並透過 hd 旗標引入原生 2K 渲染。V8.2 隨後於 2026 年 7 月 27 日推出,著重於美感與影像品質提升:渲染結果更大膽、更精緻,低品質離群結果也明顯減少。兩個版本都仍可呼叫,因此你可以固定使用 V8.1 以維持既有作品的一致性,或改用 V8.2 取得更新的視覺風格。
建立 Atlas Cloud 帳號、產生一組 API key,接著送出請求並指定你想使用的模式與版本的 model ID,例如 youchuan/v8.2/text-to-image。費率透明且按次呼叫計費,Day-0 access 表示每個新版本一上線即可呼叫。今天就開始建置吧。
影像模式預設為 1:1,並支援九種 aspect ratio,從正方形到電影感的 21:9,以及直式的 9:21。將 hd 設為 true 會產生原生 2K 輸出,而不是經過放大處理,費用為基礎費率的 1.5x。動態方面,image-to-video 會回傳四段五秒短片,解析度可選 480p 或 720p,motion 可設為 low 或 high。
由 prompt 驅動的模式提供 Midjourney 使用者熟悉的控制項:aspect_ratio、0 到 1000 的 stylize、最高 100 的 chaos、最高 3000 的 weird,以及可設為 1 或 4 的 quality。Prompt 最多可接受 1024 個字元,選用的 sref image URL 可引導美感方向,而不會指定構圖。Style transfer 與 background removal 則刻意保持較簡化;前者需提供輸入影像加上目標風格 prompt。
生成是非同步進行的。你的呼叫會回傳 request_id,輪詢 prediction endpoint 會回報狀態為 created、processing、completed 或 failed;工作完成後,outputs 陣列會包含結果 URL。若你偏好直接在回應中取得內嵌 payload,而不是下載託管檔案,請將 enable_base64_output 設為 true。
Youchuan API 上多數模式每次呼叫為 $0.086,涵蓋 text-to-image、image-to-image、blend、background removal 與 image-to-video;style transfer 則為每次呼叫 $0.129。這些費率之上有兩個倍率:hd 影像按基礎費率的 1.5x 計費,720p 影片按 480p 費率的 3x 計費。所有項目都不綁入方案,因此你只需為實際發出的呼叫付費。
可以。將 seed 固定為特定整數,並使用相同 prompt 與相同設定,即可精確重現該次渲染;預設值 -1 則會讓每次執行都隨機化。若要在一個活動中維持一致視覺風格,請傳入一張 sref 參考影像,搭配固定的 stylize 值,並只變更 prompt。
輸出形態是固定的:短片長度為五秒,blend 最多接受五張影像,prompt 會在 1024 個字元處截斷。Style transfer 不提供 aspect ratio、hd 或 stylize 參數,因此解析度與構圖會跟隨輸入影像。由於工作是排隊後輪詢,而不是串流回傳,請在你的流程中建置狀態檢查與重試機制,不要預期會收到同步回應。
指南、教學與產品動態,助你充分發揮 Atlas Cloud 的價值。