


Qwen Image 3.0 pro 是 Qwen 的影像生成與編輯模型系列,專為建構正式環境視覺工作流程的開發者打造。它可生成最高達 2048×2048 的影像,會自動改寫提示詞,根據提示詞意圖選擇解析度,並遵循自然語言編輯指示,同時保留臉部特徵與身分識別。透過 Atlas Cloud 搭配單一 OpenAI 相容金鑰,即可使用這兩個模型,並採用每次呼叫 $0.04 的標準隨用隨付定價。立即開始建構。
Qwen Image 3.0 Pro 由 Alibaba 開發。Atlas Cloud(由 Atlas Cloud AI LLC 營運)僅提供接取服務,並不擁有該模型。所有商標均歸其各自所有者所有。
Atlas Cloud 為您提供最新的行業領先創意模型。
比較 Qwen Image 3.0 pro 提供的文字轉圖像與以參考圖為基礎的編輯端點。
| 模態 | 描述 |
|---|---|
| Qwen Image 3.0 Pro API(文字轉圖像) | 將文字提示詞轉換為圖像,支援最高 2048×2048 的解析度,並提供自動提示詞改寫與提示詞導向的解析度選擇功能。強大的複雜文字呈現能力與精準的提示詞遵循能力,適用於海報、產品視覺、插圖及其他對構圖敏感的素材。 |
| Qwen Image 3.0 Pro API(圖像編輯) | 提供一至三張參考圖像,以及自然語言指令,以產生編輯後的圖像。在套用指定變更的同時,保留臉部特徵與身分等關鍵細節,適合用於人像精修、視覺變化及受控的素材更新。 |
Qwen Image 3.0 pro 結合複雜文字渲染、精準遵循提示詞、最高 2048 × 2048 的生成尺寸、自動提示詞改寫,以及透過 Atlas Cloud 統一的隨用隨付 API,利用一至三張參考圖進行保留身分特徵的編輯。

Qwen Image 3.0 pro 能遵循詳細提示詞,同時處理中英文複雜文字渲染。它可以組織密集的創意版面,而不必將文字與場景分離。在一次請求中指定文案、層級、構圖與視覺風格,發布前再校對名稱與數字。這讓它適合用於橫幅、編輯設計圖、包裝概念,以及資訊豐富的藝術作品。

當細緻紋理與清晰細節至關重要時,可生成最高 2048 × 2048 解析度的圖片。提示詞導向的尺寸選擇功能可以自動決定輸出解析度,而明確指定尺寸則能以已知畫布為目標。從產品攝影到編輯人像,額外的像素預算有助於近距離檢視、靈活裁切,以及製作精緻的生產素材。

生成前可自動擴充簡短提示詞,且改寫功能預設為啟用。在文字生成 endpoint 上,Direct 模式會執行單次改寫,而 Agent 模式則使用 agentic pipeline 豐富需求內容。探索概念時可保持改寫開啟;進入生產環境後,若更重視精確措辭與嚴格控制的指令,則可將其停用。

在編輯中加入一至三張參考圖片,並以自然語言描述變更內容。模型可以利用這些來源提供主體、情境或視覺指引,同時保留關鍵臉部特徵與身分。你可以要求更換環境、造型或構圖,而不必從頭重建已核准的主體。這適合用於行銷活動變體、角色連貫性,以及以參考圖為導向的產品場景。

需要可重複的實驗嗎?設定介於 0 至 2147483647 之間的固定 seed,加入 negative prompt,並在一次生成呼叫中要求最多四個輸出。這些控制項讓你更容易比較提示詞修訂版本、排除不想要的內容,並在一致條件下檢視少量選項。將它們用於結構化的創意測試,而不是一次性的猜測。
看看 Qwen Image 3.0 pro、另一款領先的外部競品,以及同系列的前代模型,如何解讀完全相同的提示詞,呈現充滿文字設計的視覺與紀實攝影。
正午時分,在熙來攘往的香料市集裡,捕捉一個果斷而幽默的瞬間:年輕男性攤販將一袋粗糙的黃麻藏紅花袋甩向空中,恰好一隻帶有動態模糊效果的鴿子擦過一堆薑黃,讓燦亮的金色粉末雲懸浮並散布於整個場景;受驚的顧客自然又滑稽地做出反應,其中一人明確地用雙手護住數顆光澤鮮明的紅色石榴,另一人則同時將摺疊好的紙製香料包緊抱在胸前;每一隻手臂、手掌、手指、物件與互動都必須符合人體結構、彼此清晰區分且易於辨識。透過層疊的石造拱廊框取市場,形成強烈的框中框構圖,採用略微俯視的荷蘭式傾斜角度;重複排列的深紅辣椒、深靛藍陶碗與鮮豔黃色薑黃堆,營造出嚴謹的紅、黃、藍三原色調,僅使用這三種顏色。正午強烈的定向天光,在攤位、臉部與磨損的鋪石路面上投射出俐落的幾何陰影。保留飛揚粉末顆粒、編織黃麻纖維、紙質藏紅花絲、積滿灰塵的香料堆、鍛打銅製秤具、上釉陶器、風化木紋、皺褶紙包裝、自然年輕的肌膚,以及細微類比膠片顆粒等觸感真實度。加入一面寬幅橫向手繪店面招牌,招牌上以大而完全清晰易讀的字母準確寫著「SPICE, SUN & SURPRISE」,並加入數張分開的手寫價格標籤,分別準確寫著「SAFFRON 12」、「TURMERIC 4」、「CHILIES 6」與「POMEGRANATES 3」;所有文字都必須拼寫正確、字形清楚,並自然融入攤位之中。1970 年代復古旅遊雜誌風格的紀實攝影,真誠自然的人情溫度,克制的寫實感,28mm 環境鏡頭,具有深度的分層對焦,前景邊緣帶有柔和遮擋,鴿子略帶動態模糊,臉部與手部清晰,曝光真實自然,不擺拍,不油膩過度渲染,不要 HDR 外觀,不要塑膠感肌膚,不要混濁色彩,不要過度光暈,不要奇幻史詩式光效,不要雜亂的彩虹色盤,不要畸形手部,不要多餘手指,不要重複人物,不要亂碼文字,不要邊框,不要樣機展示,寬幅橫向 16:9 長寬比,全出血。

Generated with Qwen Image 3.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Text-to-Image on Atlas Cloud
雨夜裡自助洗衣店內的電影感紀實照片,捕捉一個果斷的瞬間:一台前置式洗衣機突然湧出巨量白色泡沫;一名穿著亮黃色雨衣的年輕女子自然而然地笑著,用紅色塑膠洗衣盆接住溢出的泡沫,她的雙手自然抓住盆緣,手指符合人體結構;她的朋友站在起霧玻璃外,清楚地用手指寫下準確的鏡像反轉文字「LAST WASH 11:30」,從洗衣店內看去仍清晰可讀;就在同一瞬間,一隻濕襪子拍打並黏在玻璃上。成排的圓形洗衣機門形成醒目的重複幾何圖形,並以強烈的引導線將視線延伸至深處;窗上的層疊倒影同時展現室內嬉鬧的動作與外頭被雨水浸潤的霓虹街道,形成連貫的雙重敘事。定向的冷白色螢光頂燈,在臉部、雨衣、雙手、泡沫與鉻金屬表面勾勒出俐落輪廓與清晰線條;克制的洋紅色霓虹光透過窗戶滲入,並映照在路面水窪中,採用嚴謹的青藍、鮮黃與洋紅三色調。玻璃上的寫實水滴、半透明氣泡、潮濕的編織布料、拉絲金屬、橡膠門封、凝結水氣、水窪倒影、飛散泡沫中的細微動態模糊、柔和的高 ISO 膠片顆粒、自然年輕的肌膚質感、自發的表情,以及複雜但具空間一致性的倒影與透明表面。平視角度的環境報導攝影,35mm 鏡頭,中等景深,電影感寫實風格,保留細微瑕疵,不要刻意擺拍,不要油膩過度渲染,不要 HDR 外觀,不要塑膠感肌膚,不要混濁色彩,不要過度光暈,不要廉價的史詩式光效,寬幅橫向 16:9 長寬比,全出血。

Generated with Qwen Image 3.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Qwen Image 3.0 Text-to-Image on Atlas Cloud
Qwen Image 3.0 Pro 支援行銷活動圖像、產品視覺、介面概念、分鏡,以及透過精準提示詞遵循、複雜文字渲染、最高 2048×2048 輸出和一至三張參考圖片來保留身分特徵的編輯。
運用 Qwen 在複雜文字渲染和精準提示詞遵循方面的優勢,將高要求的提示詞轉化為行銷活動海報、橫幅和社群圖像。為新品上市、活動和促銷製作最高 2048×2048 的品牌素材。
從文字描述生成產品場景,同時透過自動提示詞改寫擴充簡短構想,並由提示詞引導的尺寸選擇功能挑選合適的畫布。成果適用於型錄圖片、電子商務促銷,以及小型團隊的快速概念測試。
透過自然語言編輯,在更換服裝、場景、光線或視覺風格的同時,保留臉部特徵與人物身分。人像工作室和創作者應用程式可使用一至三張參考圖片,製作具辨識度的行銷活動變體。
需要根據詳細指示製作資訊豐富的視覺內容嗎?運用精準提示詞遵循和複雜文字渲染,快速製作介面概念、教育圖表、附註式解說圖,以及供產品或學習團隊使用的簡報圖像原型。
在單一編輯要求中加入最多三張參考圖片,接著以自然語言指示變更,同時保留關鍵細節。這適合合成圖像、商品變體,以及以角色為核心的創意工作流程。
根據精心撰寫的提示詞描繪連續場景,讓提示詞遵循功能協助每個畫面符合指定的主體、場景和視覺方向。電影製作人、代理商和遊戲團隊可以將早期構想轉化為分鏡面板。
依據工作流程、最大輸出尺寸、參考圖片上限、提示詞工具與 Atlas Cloud 標準價格,比較 Qwen Image 3.0 pro、Seedream 和 Nano Banana 端點。
| 模型 | 工作流程 | 最大輸出尺寸 | 最大參考圖片數 | 提示詞工具 | 標準價格 |
|---|---|---|---|---|---|
| Qwen Image 3.0 Pro Text-to-Image | 文字生成圖像 | 2048×2048 | - | 自動提示詞改寫 | $0.04/張 |
| Qwen Image 3.0 Pro Edit | 圖像編輯 | 1440×1440 | 3 | 自動提示詞改寫 | $0.04/張 |
| Seedream v5.0 Pro Text-to-Image | 文字生成圖像 | 最高 4.19 MP | - | 思考與提示詞最佳化 | $0.045/張 |
| Seedream v5.0 Pro Edit | 圖像編輯 | 最高 4.19 MP | 10 | 思考與提示詞最佳化 | $0.045/張 |
| Nano Banana 2 Text-to-Image | 文字生成圖像 | 4K | - | 思考與搜尋接地 | $0.08/張 |
| Nano Banana 2 Edit | 圖像編輯 | 4K | 14 | 思考與搜尋接地 | $0.08/張 |
幾分鐘即可上手 — 按照以下簡單步驟,透過 Atlas Cloud 平台整合和部署模型。
在 atlascloud.ai 註冊並完成驗證。新用戶可獲得免費額度,用於探索平台和測試模型。
將先進的 Qwen Image 3.0 Pro 模型與 Atlas Cloud 的 GPU 加速平台相結合,提供無與倫比的效能、可擴展性和開發體驗。
低延遲:
GPU 最佳化推理,實現即時回應。
統一 API:
一次整合,暢用 Qwen Image 3.0 Pro、GPT、Gemini 和 DeepSeek。
透明定價:
按 Token 計費,支援 Serverless 模式。
開發者體驗:
SDK、資料分析、微調工具和模板一應俱全。
可靠性:
99.99% 可用性、RBAC 權限控制、合規日誌。
安全與合規:
SOC 2 Type II 認證、HIPAA 合規、美國資料主權。
Qwen Image 3.0 Pro 是 Alibaba 的影像生成與編輯模型,可根據文字生成影像,或透過自然語言指令修改現有視覺內容。在 Atlas Cloud 上,它支援最高 2048×2048 的輸出,以及使用 one to three 張參考影像進行編輯。
你可以使用它生成需要精準遵循提示、複雜文字渲染或高解析度輸出的影像。在編輯流程中,你可以透過自然語言指令修改影像,同時保留臉部特徵與身分等重要細節。
選擇 text-to-image 或 edit 路由,接著透過 Atlas Cloud 的 OpenAI-compatible API,使用相符的模型 ID 呼叫服務。建立並驗證請求時,請以連結的 Playground 參數 schema 作為唯一依據。
若要根據提示生成影像,請選擇 qwen-image-3.0-pro/text-to-image;若要修改參考影像,請選擇 qwen-image-3.0-pro/edit。兩個路由各自擁有獨立的 Playground schema,因此請使用與所選工作流程相對應的 schema。
Text-to-image 生成支援最高 2048×2048 的解析度。如果未手動選擇解析度,模型可以根據提示引導解析度選擇。
你可以搭配 one to three 張參考影像,並提供自然語言編輯指令。Edit 模型會利用這些輸入套用要求的變更,同時保留包括臉部特徵與身分在內的重要視覺細節。
會。Text-to-image 模型包含自動提示改寫功能,也支援由提示引導解析度選擇。如果精確措辭、版面配置或嵌入文字很重要,請將輸出結果與原始指令進行比對。
Atlas Cloud 列出的標準基本價格為每張影像 $0.04,text-to-image 與 edit 模型皆適用。計費採用隨用隨付模式,開發者無需訂閱承諾即可使用任一工作流程。
兩個版本都支援 text-to-image 生成與影像編輯。Alibaba 的官方概覽指出,標準模型在品質與速度之間取得平衡;但本文檢視的已驗證來源並未提供 Pro 的量化比較。在選定正式環境的預設模型前,請分別使用兩個版本執行具代表性的提示進行測試。
請先使用清晰的參考影像,並明確說明哪些臉部或身分細節必須保持不變。Edit endpoint 接受最高 3 張參考影像,設計上也會保留這些細節。如果身分漂移問題持續發生,請簡化要求的變換內容,並評估再次生成。
指南、教學與產品動態,助你充分發揮 Atlas Cloud 的價值。