





Qwen Image API 將 Alibaba 的 Tongyi Qianwen 圖像系列導入你的產品,涵蓋 Standard 與 Professional 文字轉圖像模型,以及以指令驅動的編輯功能。可提供忠實呈現的英文與中文文字、在密集版面中穩定可靠的構圖,並支援最高達 2K 的高解析度輸出。Atlas Cloud 透過單一統一 API 提供完整系列,採用透明的隨用隨付定價,每張圖像起價 $0.035,並可在 Day-0 取得新版本。立即開始建置。
Qwen Image 由 Alibaba 開發。Atlas Cloud(由 Atlas Cloud AI LLC 營運)僅提供接取服務,並不擁有該模型。所有商標均歸其各自所有者所有。
Atlas Cloud 為您提供最新的行業領先創意模型。
並排檢視完整的 Qwen Image API 系列,從次秒級的 Z-Image Turbo 生成,到 20B MMDiT 文生圖與多參考圖編輯,協助你將各端點的模態與優勢對應到工作負載。
| 模態 | 說明 |
|---|---|
| Qwen Image 2.0 API(文生圖) | 將最長 800 個字元的中文或英文提示詞,轉換為尺寸從 512px 到 2048px、最高可達 2K 輸出的細緻靜態影像。強化後的提示詞理解能力可讓構圖更貼合需求;標準價格為每張 $0.035,適合作為日常文生圖的預設選擇。 |
| Qwen Image 2.0 Edit API(圖像編輯) | 提供一到三張參考圖與一段指令,即可取得最高 2K 的編輯結果。更精準理解編輯指令,使其在修圖、物件替換與修改作業上更可靠;標準費率為每張 $0.035。 |
| Qwen Image 2.0 Pro API(文生圖) | 針對品質門檻嚴格的專案,Pro 方案可產出最高 2K 的文生圖結果,具備更出色的細節與進階提示詞遵循能力。適合高階品牌視覺、電影感主視覺等最終交付素材,標準價格為每張 $0.075。 |
| Qwen Image 2.0 Pro Edit API(圖像編輯) | 專業級編輯可將詳細指令套用到來源圖像,並回傳最高 2K 的精修結果。當客戶可用的編輯成果需要最乾淨的品質時,從廣告修圖到精緻製作素材都適用;標準價格為每張 $0.075。 |
| Z-Image Turbo API(文生圖) | 這個 6-billion-parameter 模型可根據單一提示詞,在次秒級時間內生成寫實影像,並支援選用提示詞改寫與 512px 到 2048px 的尺寸。這樣的速度搭配每張 $0.005 的標準價格,非常適合高流量與對延遲敏感的應用。 |
| Qwen-Image Edit Plus 20251215 API(圖像編輯) | 最多可提供三張輸入圖像,並在每次呼叫中取得最多六張編輯輸出,涵蓋圖中文字編輯、物件新增、移除或移動、動作變更、風格轉換與細節強化。這個固定於 2025 年 12 月的版本,為複雜的多參考圖編輯加入負向提示詞與提示詞改寫控制,標準計費為每張 $0.03。 |
| Qwen Image Edit API(20B,圖像編輯) | 此端點建構於 20B MMDiT 架構之上,可將單一來源圖像加上一段提示詞轉換為新一代編輯結果。適合通用型編輯情境,尤其是模型容量與指令遵循比多圖輸入更重要時;標準價格為每張 $0.045。 |
| Qwen-Image Max API(文生圖) | 通用型生成端點,擅長呈現複雜文字與多樣藝術風格,提供從 928×1664 到 1664×928 的固定預設尺寸,並支援負向提示詞。當需求以準確的圖中文字排版與風格範圍為優先時,選擇 Max;標準費率為每張 $0.075。 |
| Qwen-Image Plus API(文生圖) | Plus 方案承襲 Max 在複雜文字與多風格輸出上的優勢,保留相同尺寸預設,同時標準價格較低,為每張 $0.03。對於注重成本、但仍需要可靠圖中文字的批次生成而言,是務實的選擇。 |
| Qwen-Image Edit API(圖像編輯) | 此編輯器支援多張圖像輸入與輸出,可改寫圖中文字,並新增、移除或移動物件,同時變更主體動作與轉換風格。細節強化補足了一套靈活的修改工具組,標準價格為每張 $0.045。 |
| Qwen-Image Edit Plus API(圖像編輯) | 可接受一到三張參考圖,並在每次請求中產生最多六個輸出,涵蓋文字編輯、物件操作、動作變更與風格轉換,並提供負向提示詞控制。非常適合需要在多個參考之間反覆迭代的批次流程,標準價格為每張 $0.03。 |
| Qwen Image API(20B,文生圖) | 由 20B MMDiT backbone 驅動,這個旗艦端點可將文字提示詞轉換為 512px 到 2048px 的圖像,提供新一代品質。當原始模型容量與提示詞忠實度比預設尺寸便利性更重要時適用;標準價格為每張 $0.035。 |
橫跨文字轉圖像與編輯模型,Qwen Image API 將原生 2048 像素輸出,結合真正清晰可讀的中英文排版與語言驅動的編輯能力,並可透過 Atlas Cloud 上單一隨用隨付的 endpoint 存取。

此系列中的每個模型都能以最高 2048 x 2048 像素原生渲染。皮膚毛孔、編織布料、風化石材等細緻紋理,在放大檢視時依然清晰銳利,不會一檢查就變得模糊。這樣的解析度餘裕讓輸出可直接用於印刷版面、hero banners,以及需要審稿者仔細檢視細節的交付成果。

多數生成器會把非拉丁字元糊成一團,而 Qwen Image 能將準確的中文與英文文字直接放入構圖中。無論使用哪種語言,字型、字距調整與複雜的多行版面都能保持清晰可讀,不會崩解成裝飾性的雜訊。如果你的工作涉及海報、資訊圖表或包裝設計,這能讓排版從手動後製步驟,變成生成流程本身的一部分。

將一到三張參考圖提供給編輯模型,並用自然語言描述要進行的變更。模型可以新增或移除物件、移動元素、改變主體姿勢、轉換風格,並在保留未觸及區域完整的同時修飾細節。圖像中的文字也可以就地改寫。這讓反覆修改變得實用,不必每次都從零重建整個場景。

此系列分為 Standard 與 Professional 層級,讓你能依任務需求調整成本。Standard generation 每張圖像 $0.035,適合草稿與大量批次;Professional tier 每張圖像 $0.075,鎖定最終版與品質關鍵的渲染。先用 Standard 低成本原型製作,再把 model string 切換到 Pro 產出交付成果,其他部分無需變更。

想要可重現且可引導的輸出嗎?Prompts 支援最多 800 個中文或英文字元;可選的 prompt extension 能將簡短指令改寫成更豐富的細節;negative prompts 則可將不想要的元素排除在畫面之外。設定固定 seed 後,每次執行都會回傳相同圖像。這些控制項結合起來,能讓你在整個系列中鎖定一致的視覺風格。

Atlas Cloud 透過一組 OpenAI-compatible key 提供整個系列,因此在文字轉圖像、編輯與 Pro tiers 之間切換,只需要改一個字串。Requests 執行時沒有 cold starts,且編輯模型每次呼叫最多可回傳六張圖像,便於快速批次處理。Billing 依每次呼叫隨用隨付,無需訂閱,而且每個模型都會在 Day-0 上線。今天就開始建置。
將同一個 prompt 同時送進 Qwen Image API、一款領先競品與其前代版本,看看哪個引擎最能令人信服地呈現光線、質感與字體。
黃金晨光時分的一間斑駁街角麵包店,溫暖的側逆光勾勒出大理石檯面上一杯新鮮 espresso 冒出的蒸氣,一塊優雅的手寫粉筆菜單板以華麗的 serif 字體寫著「晨間烘焙」並映著光芒,一名 barista 定格在倒奶的瞬間,牛奶如緞帶般折入杯中,前景的 croissants 化成柔和散景,帶有酥脆片狀外皮質感,互補的琥珀與 teal 色調,淺景深,50mm 報導攝影,細緻 film grain,寬幅 16:9 aspect ratio,滿版橫向 landscape composition

Generated with Qwen Image 2.0 Pro on Atlas Cloud

Generated with Nano Banana 2 on Atlas Cloud

Generated with Qwen Image 2.0 on Atlas Cloud
赤腳的 Rajasthani 染布工在正午時分被捕捉於跨步瞬間,一段剛染好的 indigo cotton 濕布橫放在頭上保持平衡,水滴一路飛濺;他奮力穿過一條由數十條晾乾中的 saris 形成的狹窄通道——這是一個決定性的紀實瞬間,不是擺拍。他的重心移到踩在龜裂土地上的一隻腳上,布料被一陣熱風半吹鼓,水仍持續流下。穿透性的強烈逆光:殘酷的頂上烈日穿透薄棉布,使布料像 lightbox 一樣發光,顯露 woven warp-and-weft texture 與手工染色不均的斑塊,將人物壓成 rim-lit silhouette,肩膀與髮絲帶著金色邊緣。構圖建立在一排排重複垂掛的布面上,形成強烈而有節奏的 graphic beat,以及向深遠透視疾速收束的 converging leading lines;frame-within-a-frame 將男子釘在兩段懸掛布料之間。互補色衝突——大片深 indigo blue 與 terracotta-orange 的曝曬塵土和染布相撞,克制而絕不俗豔。陽光碎裂般的 red clay 地面在他腳下裂開,raw cotton 的紋理、閃光的水珠、空氣中細微的塵土顆粒。以 35mm 街頭報導 photojournalism 拍攝,擺動布料與跨步的腳帶有輕微 motion blur,真實 film grain、自然的不完美、誠實的 tonal contrast,沒有過度渲染。寬幅 16:9 aspect ratio,滿版橫向 landscape composition。

Generated with Qwen Image 2.0 Pro on Atlas Cloud

Generated with Nano Banana 2 on Atlas Cloud

Generated with Qwen Image 2.0 on Atlas Cloud
從文字密集的海報與雙語行銷活動,到依指令進行的編輯與多圖合成,Qwen Image API 涵蓋模型系列中從初稿到可投入製作視覺素材的完整流程。
Qwen Image API 可原生以 2K 解析度呈現複雜文字與密集版面。設計師只需一段提示詞,就能產出可直接印刷的海報、資訊圖表與 PPT 投影片,無需手動排放文字。
精準的中英文文字渲染可在單張圖片中處理複雜版面,甚至呈現古典字體。全球團隊能跨市場交付包裝、標示與促銷創意,不會出現其他模型常見的亂碼字元。
用白話描述想要的編輯,模型就能轉換風格、替換背景,或新增與移除物件。修圖師只靠指令即可精修特定區域並調整光線,取代數小時的手動遮罩作業。
可將多張參考圖片一起輸入 Qwen Image API,讓你移動物件並編輯圖片中的文字。這很適合產品模擬圖與行銷活動變體,將多個來源的元素合併到同一個場景中。
原生 2K 輸出能捕捉膚質、布料與細緻材質細節,何必滿足於扁平的渲染圖?工作室可製作時尚人像、數位分身與可直接交付的電商產品影像。
Qwen Image API 的 Standard 與 Professional 等級讓團隊能以低成本迭代,再以最高品質重新渲染最終版本。按用量付費的定價模式,讓大量廣告變體、社群貼文與縮圖在規模化製作時仍能維持可負擔的成本。
See how the Qwen Image API stacks up next to Seedream, Nano Banana, and MAI on output resolution, standout strengths, and transparent per-image pricing before you pick an endpoint.
| Model | Developer | Max Resolution | Standout Strength | Price per Image |
|---|---|---|---|---|
| Qwen Image 2.0 Text-to-image | Alibaba (Qwen) | Up to 2K (2048x2048) | Bilingual text rendering paired with strong prompt adherence | $0.035 / image |
| Qwen Image 2.0 Pro Text-to-image | Alibaba (Qwen) | Up to 2K (2048x2048) | Production-grade fidelity built for final deliverables | $0.075 / image |
| Seedream v5.0 Pro Text-to-Image | ByteDance | Up to 2K (2048x2048) | Spatial reasoning with multi-reference composition | $0.054 / image |
| Nano Banana 2 Text-to-Image | Up to 4K (native) | Native 4K output supporting up to 14 reference images | $0.08 / image | |
| MAI-Image-2.5 Text-to-image | Microsoft | Up to 1K (~1MP) | Sharp in-image text with commercial-ready polish | $0.05 / image |
幾分鐘即可上手 — 按照以下簡單步驟,透過 Atlas Cloud 平台整合和部署模型。
在 atlascloud.ai 註冊並完成驗證。新用戶可獲得免費額度,用於探索平台和測試模型。
將先進的 Qwen Image 模型與 Atlas Cloud 的 GPU 加速平台相結合,提供無與倫比的效能、可擴展性和開發體驗。
低延遲:
GPU 最佳化推理,實現即時回應。
統一 API:
一次整合,暢用 Qwen Image、GPT、Gemini 和 DeepSeek。
透明定價:
按 Token 計費,支援 Serverless 模式。
開發者體驗:
SDK、資料分析、微調工具和模板一應俱全。
可靠性:
99.99% 可用性、RBAC 權限控制、合規日誌。
安全與合規:
SOC 2 Type II 認證、HIPAA 合規、美國資料主權。
Qwen Image API 是 Atlas Cloud 為 Alibaba 的 Tongyi Qianwen(Qwen)圖像模型提供的統一端點,涵蓋文字生成圖像與基於指令的圖像編輯。開發者可透過一組 OpenAI-compatible key,在 Day-0 即時存取最新的 Qwen Image 2.0 版本,並享有透明的隨用隨付定價且無冷啟動。
此系列將 Alibaba 多個世代的 Qwen 圖像模型整合到單一平台上。它包含適用於文字生成圖像與編輯的 Qwen Image 2.0 Standard 與 Pro tiers,也包含較早的 Qwen-Image 生成與編輯變體,例如 Plus、Max 與 Edit-Plus 版本。所有模型共用相同的請求格式,因此在模型之間切換只需變更一個參數,而不必重寫整合。
Qwen Image 2.0 在單一模型中處理兩項任務:根據文字提示生成圖像,以及依照自然語言指令編輯既有圖像。其編輯能力涵蓋風格轉換、物件新增與移除、背景替換、局部修補,以及精準修改圖像中的文字。由於生成與編輯共用同一個模型,你可以從初稿一路調整到精修成果,而不必切換端點。
開始使用只需要三個步驟:建立 Atlas Cloud 帳號、產生 API key,並向 Qwen Image API 傳送第一個請求。此端點為 OpenAI-compatible,因此只要將多數現有 SDK 指向 Atlas base URL 並設定模型名稱即可使用。你可以先在 Playground 中互動式原型設計,再將呼叫串接到正式環境。立即開始建置。
計費採隨用隨付,提供透明的每張圖像費率,且無需訂閱。Qwen Image 2.0 的價格為 Standard tier 每張圖像 $0.035,Pro tier 每張圖像 $0.075;其他系列模型如 Plus 與 Edit 版本則有各自公開的每張圖像費率。你只需為實際生成的圖像付費。
輸出最高可達 2K 解析度,寬度與高度皆可在 512 到 2048 pixels 之間調整。這種獨立尺寸控制支援 1:1、16:9、9:16 等常見比例,也支援橫幅或直式社群格式的自訂尺寸。提示可達約 1,000 tokens,足以容納詳細的版面與風格指示。
文字呈現是這些模型最鮮明的強項之一,能在單張圖像中可靠輸出 English、Chinese 與混合語言內容。字型、版面與拼字在包含多個文字區塊的海報、資訊圖表與投影片中都能保持一致且清晰。如果你的工作仰賴可讀的圖中文字排版,Qwen models 在這方面領先許多通用型生成器。
Standard tier 適合日常內容製作、快速迭代,以及對成本敏感的批次工作。Pro tier 則針對品牌活動與電影感設計等最終交付成果,提供最高的視覺保真度。實務工作流程可先用 Standard 迭代,待構圖確定後,再用 Pro 輸出核准的畫面。
可以。透過平台產生的圖像可用於商業工作,但須遵守 Atlas Cloud 的服務條款,以及底層 Qwen models 所附的使用政策。若是高用量或受監管的部署,請在上線前確認適用條款。
指南、教學與產品動態,助你充分發揮 Atlas Cloud 的價值。