


Qwen Image 2.0は、Alibaba CloudのQwenチームが開発した次世代画像モデルです。テキストと画像の入力に対応し、ネイティブ2K出力、より優れた意味理解、リアルなディテール、正確な指示追従を、画像の生成から編集まで幅広いワークフローで実現します。Atlas Cloudでは、両モード向けにコールドスタートなしで利用できる、すぐに使えるRESTエンドポイントを提供しています。標準価格は1画像あたり$0.035です。今すぐ開発を始めましょう。
Qwen Image 2.0 は Alibaba が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。
Atlas Cloudは、業界をリードする最新のクリエイティブモデルを提供します。
最大2Kの解像度で画像を作成・改善できる、2つのQwen Image 2.0エンドポイントを比較します。
| モダリティ | 説明 |
|---|---|
| Qwen Image 2.0 Text to Image API | テキストプロンプトを画像に変換します。最大2Kの解像度に対応し、プロンプトの理解力と画像品質が向上しています。コンセプトアート、商品画像、マーケティング素材など、プロンプトベースのビジュアルワークフローに適しています。 |
| Qwen Image 2.0 Edit API | 画像編集向けに設計されたエンドポイントです。既存のビジュアルに対してテキスト指示を適用し、最大2Kの解像度で結果を生成します。アセットの調整、クリエイティブなバリエーション作成、特定部分のビジュアル変更、反復的な制作ワークフローに適しています。 |
Qwen Image 2.0は、最大2Kの出力、強化されたプロンプト理解、バイリンガル文字レンダリング、参照画像に基づく編集、再現可能なシード、そして透明性の高い従量課金で利用できるAtlas Cloud RESTアクセスを提供します。

Qwen Image 2.0は、1辺512〜2048ピクセルのサイズで画像を生成でき、最大2Kの出力に対応します。強化された画質により、細かな質感、奥行きのある風景、画面全体に配置された小さな視覚的アクセントまで忠実に表現します。用途に合ったサイズを選択できるため、商品ビジュアル、エディトリアル写真、精密なコンセプトアートに適しています。

英語または中国語で最大800文字のプロンプトを使用できるため、構造化された指示も扱いやすくなります。被写体、照明、構図、素材、動作を1つの指示にまとめて記述し、再現性のある反復が必要な場合は固定シードを使用できます。強化されたプロンプト理解により、複数の指定要素間の関係を保ちやすくなっています。キャンペーン、建築シーン、意図を明確にしたクリエイティブワークフローでも、複雑なコンセプトをより予測どおりに表現できます。

密度が高く緻密に構成されたビジュアル内にも、読みやすい英語と中国語のテキストを配置できます。多言語レンダリングと安定した構図設計を組み合わせることで、ラベル、看板、見出し、補助グラフィックを周囲のシーンに自然に調和させます。バイリンガルの指示を別レイヤーのオーバーレイではなく、画像そのものの一部として扱えます。幅広いプロモーション用グラフィック、プレゼンテーション用ビジュアル、メニュー、情報量の多いアートワークなど、大幅な手作業による修正が必要だった用途に活用できます。

1〜3枚の参照画像を用意し、希望する編集内容を自然言語で記述します。編集エンドポイントは最大800文字の指示を受け付け、シードを使用した再現性のある実行で最大2Kの画像を返せます。この制御されたワークフローは、元の構図を最初から作り直すことなく、商品の修正、ビジュアルのスタイル変更、反復的なクリエイティブ開発に対応します。

出力サイズは1辺512〜2048ピクセルの範囲で指定でき、シードには0〜2147483647の値を使用できます。デフォルト値-1のランダムシードも利用可能です。正方形、横長、縦長などの用途に合わせてキャンバスを調整しながら、再現可能な開始点を維持できます。これらの制御機能により、複数の配置先に向けた体系的なテストと、一貫したアセット制作を簡素化できます。

Atlas Cloudは、標準価格$0.035/画像で、RESTエンドポイントを通じたテキストから画像への生成と画像編集を提供します。すぐに利用できる推論環境、コールドスタートなし、Day 0からのアクセスにより、モデルのホスティング作業が不要になります。さらに、統一されたAPIによってシリーズ全体で一貫した統合が可能です。透明性の高い従量課金により、プロトタイプ、プロダクションツール、スケーラブルな画像パイプラインを支援します。
Qwen Image 2.0と比較対象となる2つの画像モデルが、精密なグラフィックデザインとスピード感あふれるドキュメンタリー写真において、同一のプロンプトをどのように解釈するかをご覧ください。
決定的瞬間を捉えた、映画的な「卓上災害映画のメイキング」シーン。突然そびえ立つ波がクリームホワイトのティーカップから噴き上がり、横倒しになったミニチュアの灯台を支えようと、若い模型製作者のリアルな手が画面内へ伸びている。その周囲では、ネイビーブルーのカメラ、三脚、ケーブル、照明機材を抱えた小さな撮影クルーたちが、パニックになって逃げている。鮮明で読みやすいミニチュアのカチンコには、正確で綴り間違いのない文字で「THE LAST TEACUP」「TAKE 07」と書かれている。手作りのストップモーション・アニメーションの触感と、フォトリアルなマクロ写真を融合し、人間とミニチュアのスケールがユーモラスに衝突する様子を強調。卓上をかすめる低いカメラ位置。絡み合った電気ケーブルと輝く水の軌跡が、傾いた灯台とティーカップへ向かう強いリーディングラインを形成。ピントの外れた金属製のネジが極端な前景を部分的に覆い、重層的な奥行きとスケール感の混乱を生み出す。硬質な真昼の直射日光がブラインドの隙間から差し込み、セット全体にくっきりとしたストライプ状の影を落とす。空中に漂う水滴がきらめき、逃げるクルーには微細なモーションブラーがかかっている。クリームホワイト、ネイビーブルー、安全オレンジだけに厳密に限定したカラーパレット。説得力のある古い木目、濡れて膨れた紙パルプ、剥がれたミニチュア塗装、傷のついた金属、湿った布地、物理的に正確な屈折・表面張力・水しぶき・空間関係を備えた透明な水。中央の災害を取り囲む密度の高いアクションと、フレーム端付近の静かなネガティブスペースのバランス。手作りならではの不完全さ、控えめな微細フィルムグレイン、浅い被写界深度、マクロレンズ、近接フォーカス、自然な光学的減衰、ハイエンドな実写特撮写真。油っぽい過剰レンダリングなし、HDRのような画面全体を覆う過剰なディテールなし、プラスチックのような肌なし、濁った色や汚れた色かぶりなし、どこにでもあるようなグローなし、安っぽい壮大なファンタジー風ライティングなし、暗い水中や宇宙遺跡の美学なし、横長16:9アスペクト比、フルブリード。

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud
フィギュア製作者がその場を離れたまさに決定的な瞬間、作業台の上でミニチュアの脱獄劇が展開されている。塗装されていない白い粘土の小さなフィギュアたちが、細かく鮮明で完全に読みやすい「FINAL INSPECTION」という文字が記された紙の検査タグを巧みに折り、即席の熱気球に仕立てている。そのうちの1体が最後の係留線を切ったばかりで、紙の気球がモーションブラーをわずかに伴いながら勢いよく上昇し、仲間たちは身を引き、歓声を上げ、驚嘆しながら見上げている。倒れた絵の具瓶からウルトラマリンブルーの川が場面を蛇行しながら流れ出し、その縁には小さな朱色の足跡と、即席の橋がある。すべてのキャラクターが異なる行動を取る、精密なミニチュア空間の物語表現。木製の工具ラックが強いフレーム・イン・フレームを構成し、ピンセット、彫刻用ピック、クラフトナイフが、上昇する気球へ向かう放射状のリーディングラインを形成。右上には、すっきりとして遮るもののないネガティブスペースを保つ。左から斜めに差し込む窓からの指向性のある光が、柔らかなエッジの細長い影を生み出す。生の粘土に押し込まれた指紋、使い込まれた木目、折り畳まれた紙の繊維、傷のついた金属工具、半乾きの絵の具の粘着質な表面を照らし出す。粘土の白、ウルトラマリンブルー、朱色の赤だけを使った厳密な3色パレット。追加のアクセントカラーは使わず、自然な色調の変化は控えめにする。精緻なストップモーション・アニメーションとフォトリアルなマクロ撮影を融合し、手作りの触感的な不完全さ、選択的な浅い被写界深度、柔らかくぼけた前景の工具、シャープに描写された中央のアクション、控えめなアナログフィルムグレイン、100mmマクロレンズ、映画的でありながら親密な雰囲気、洗練された実写特撮のリアリズム。光沢のあるプラスチック表面なし、油っぽい過剰レンダリングなし、HDRなし、濁った色なし、全体を覆うグローなし、安っぽい壮大なファンタジー表現なし、暗い水中や宇宙遺跡の雰囲気なし、横長16:9構図、端まで広がるフルブリードフレーム。

Generated with Qwen Image 2.0 Text-to-image on Atlas Cloud

Generated with Seedream v4.7 Text-to-Image on Atlas Cloud

Generated with Wan-2.7 Text-to-image on Atlas Cloud
Qwen Image 2.0は、詳細なプロンプトや既存の画像から、プレゼンテーション用グラフィック、キャンペーン素材、プロダクトシーン、絵コンテ、ローカライズビジュアル、精密な編集画像を、最大2Kの解像度で生成します。
詳細なプロンプトから、構成の整ったレイアウトと画像内の読みやすいテキストを備えた、洗練されたプレゼンテーションビジュアルを作成できます。プロダクトチームは、最大2Kの解像度でコンセプトスライド、解説資料、社内向けピッチ素材を制作できます。
プロフェッショナルにレンダリングされたタイポグラフィにより、詳細なプロンプトから作成したポスター、ソーシャルグラフィック、キャンペーンコンセプトに明瞭さを加えられます。マーケティングチームは、すべての構図を手作業で作り直すことなく、ローンチ、プロモーション、ブランドコミュニケーションに対応した柔軟なビジュアル案を作成できます。
プロダクトシーンに細部が求められる場合も、説明的なプロンプトから最大2Kの解像度で生成できます。小売業者やクリエイティブスタジオは、明確な編集指示によって背景、周囲のオブジェクト、キャンペーンの文脈を調整し、さまざまな配置に対応できます。
既存のビジュアルを最初から作り直さずに変更したい場合は、編集エンドポイントに明確な指示を与えることで、テキスト、オブジェクト、ポーズ、スタイルを更新できます。クライアントからのフィードバックや、大規模な反復型の制作ワークフローにも対応します。
テキスト量の多いポスターやガイドに、ビジュアルストーリーテリングと多言語タイポグラフィを組み合わせられます。グローバルコンテンツチームは、ローカライズされた旅行資料、イベントグラフィック、地域別のキャンペーンコンセプトを、1枚のまとまりある画像として作成できます。
詳細なプロンプトによって、物語をコミック、カレンダー、構成の整ったストーリーボードパネルへ落とし込めます。クリエイターは、本格的な制作にリソースを投入する前に、シーケンス、教育向け解説資料、キャンペーンコンセプトを検討できます。
タスク、最大出力解像度、標準の画像あたり料金で、Qwen Image 2.0 のエンドポイントと Microsoft の代替サービスを比較します。
| モデル | タスク | 最大解像度 | 標準料金 |
|---|---|---|---|
| Qwen Image 2.0 Text-to-image | テキストから画像 | 2048 × 2048 | $0.035/画像 |
| Qwen Image 2.0 Edit | 画像編集 | 2048 × 2048 | $0.035/画像 |
| MAI-Image-2.6-Flash Text-to-image | テキストから画像 | 最大 2.36 MP、1536 × 1536 相当 | $0.044/画像 |
| MAI-Image-2.6-Flash Edit | 画像編集 | 最大 2.36 MP、1536 × 1536 相当 | $0.047/画像 |
数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。
atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。
高度なQwen Image 2.0モデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。
低レイテンシ:
リアルタイム推論のためのGPU最適化推論。
統合API:
1つの統合でQwen Image 2.0、GPT、Gemini、DeepSeekを実行。
透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。
開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。
信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。
セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。
Qwen Image 2.0は、AlibabaのQwenチームが開発した画像モデルで、テキストからビジュアルを生成したり、指示に従って既存の画像を編集したりできます。Atlas Cloudでは、これら両方のタスクに対応する専用のREST APIエンドポイントを提供しており、最大2Kの出力解像度に対応しています。
詳細な説明から画像を生成したり、自然言語による指示で既存のビジュアルを変更したりできます。プロンプト理解の向上により、マーケティング用グラフィック、コンセプトアート、商品画像、インフォグラフィック、ビジュアルデザインなどのワークフローに対応します。
はい。Atlas Cloudでは、画像内の読みやすいテキストと複雑なプロンプトへの対応を強みとしており、インフォグラフィック、ポスター、マーケティング資料、その他の構造化されたレイアウトに適しています。APIの800文字のプロンプト上限内で、文言やレイアウトに関する指示を明確に記述してください。
Atlas CloudのダッシュボードでAPIキーを作成し、生成用または編集用のモデルIDを選択して、RESTリクエストを送信します。ホスト型推論を利用するため、ローカルGPUの設定やモデルウェイトのデプロイは必要ありません。
モデルIDと入力内容をJSONボディに含め、認証済みのPOSTリクエストを https://api.atlascloud.ai/api/v1/model/generateImage に送信します。非同期リクエストは予測IDを返すため、処理が完了するまで予測エンドポイントをポーリングできます。
プロンプトから新しい画像を作成する場合は、qwen/qwen-image-2.0/text-to-imageを使用します。参照画像を指示に基づいて変更する場合は、qwen/qwen-image-2.0/editを選択してください。
テキスト生成にはpromptが必要で、sizeとseedを任意で指定できます。編集にはimages配列も必要ですが、sizeとseedは引き続き任意です。どちらのエンドポイントも、800文字以内の中国語および英語のプロンプトに対応しています。
編集エンドポイントでは、1~3個の参照画像URLを指定でき、各画像の各辺は384~3072ピクセルである必要があります。出力サイズは512~2048ピクセルの範囲で指定でき、モデルプロファイルでは最大2Kの解像度に対応しています。
Atlas Cloudでは、テキスト生成エンドポイントと編集エンドポイントのどちらも、標準の基本料金を1リクエストあたり$0.035としています。これは一時的な割引を除いた、通常の従量課金価格です。
再現性のあるテストが必要な場合は、seedに0~2147483647の特定の整数を設定してください。デフォルト値の-1ではランダムなseedが選択されます。出力を比較したり、予期しないばらつきの原因を切り分けたりする際は、モデルID、prompt、sizeを変更しないでください。
Atlas Cloud を最大限に活用するためのガイド、チュートリアル、製品アップデート。