Seedance 2.0 Mini & Fast APIを世界最安値で — 公式価格から最大68%オフ
Grok Imagine Image 2.0 Natural Language Image Editing

Grok Imagine Image 2.0 Natural Language Image Editing

xAIが開発したGrok Imagine Image 2.0は、高品質なテキストから画像への生成と、自然言語による編集機能を組み合わせ、参照画像を活用したワークフローを実現します。1Kまたは2Kの出力を生成し、プロンプトから完成したビジュアルへと仕上げたり、既存の画像を直接指示で調整したりできます。Atlas Cloudでは、対応するすべてのエンドポイントを1つのOpenAI互換APIキーで利用でき、透明性の高い従量課金制とシンプルな統合を提供します。今すぐ開発を始めましょう。

Grok Imagine Image 2.0 は xAI が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。

Grok Imagine Image 2.0 エンドポイントを比較

標準エンドポイントと開発者向けエンドポイントで、プロンプトベースの生成とリファレンス画像を使用した編集を比較できます。

モダリティ説明
Grok Imagine Image 2.0 Developer Edit API (Image Editing)自然言語による編集指示で、最大3枚のリファレンス画像を変換できます。1Kまたは2Kの解像度と、低または中の品質を選択でき、プロダクトのブラッシュアップ、クリエイティブなバリエーション作成、ビジュアルの反復的な更新に適しています。
Grok Imagine Image 2.0 Developer Text-to-Image API自然言語のプロンプトから、1Kまたは2Kの解像度で洗練された画像を生成できます。14種類のアスペクト比と低または中の品質レベルに対応し、マーケティング用グラフィック、コンセプトアート、ソーシャルコンテンツ、その他の形式に合わせたアセットの作成に活用できます。
Grok Imagine Image 2.0 Text-to-Image API自然言語のプロンプトから直接、1Kまたは2Kで洗練されたビジュアルを作成できます。14種類のアスペクト比と選択可能な低または中の品質レベルにより、キャンペーン、デザイン検討、イラスト、各プラットフォーム向けの画像に対応します。
Grok Imagine Image 2.0 Edit API (Image Editing)最大3枚のリファレンス画像をアップロードし、希望する変更を自然言語で説明すると、編集済みの画像を取得できます。1Kおよび2Kの解像度と低または中の品質に対応し、アセットの修正、ビジュアルの調整、コンテンツの反復制作に適しています。

Grok Imagine Image 2.0がすべてのフレームを形作る仕組み

Grok Imagine Image 2.0は、詳細なプロンプトと最大3枚の参照画像から、柔軟な構図、選択可能な品質ティア、生成と編集に対応する1つのAtlas Cloud APIを使って、洗練された1Kまたは2Kのビジュアルを作成します。

Grok Imagine Image 2.0のプロンプト制御

Grok Imagine Image 2.0のプロンプト制御

Grok Imagine Image 2.0は、自然言語のプロンプトを1Kまたは2K解像度の洗練されたビジュアルに変換します。詳細な指示によって、1回のリクエストで被写体、環境、構図、スタイル、タイポグラフィを調整できます。14種類のアスペクト比から選択でき、正方形の商品アートから超ワイドなキャンペーン素材まで、さまざまな構図に対応します。この制御性は、デザインツール、コンテンツパイプライン、プロンプト駆動型のクリエイティブ製品を開発するデベロッパーに適しています。

画像に組み込まれたタイポグラフィ

画像に組み込まれたタイポグラフィ

タイポグラフィを構図の一部として設計できるため、情報量の多い複雑なビジュアルでも統一感を保ち、小さな文字も鮮明に表示できます。1つのプロンプトで、文言、階層、画像、レイアウトを指定できます。2Kでは、細かな文字や素材の質感をより精細に表現できます。ワイドなキャンペーングラフィック、商品パッケージのコンセプト、エディトリアルレイアウト、インフォグラフィック風のアセットに活用できます。

3枚の参照画像編集

3枚の参照画像編集

最大3枚の参照画像を、自然言語の指示によって1回のリクエストで編集できます。各ソースを<IMAGE_0>、<IMAGE_1>、<IMAGE_2>として指定し、組み合わせたり変更したりする要素を説明します。出力は1Kまたは2Kで、低品質または中品質としてレンダリングできます。元画像の特徴を保つ必要がある商品バリエーション、アートディレクション、合成コンセプトに適したワークフローです。

Grok Imagine Image 2.0の品質管理

Grok Imagine Image 2.0の品質管理

素早く試行する場合は低品質、モデルの最良の出力を得る場合は中品質を選択し、リクエストごとに1Kまたは2Kの解像度を指定できます。生成と編集のどちらでも、同じ品質および解像度の制御を利用できます。プロンプトに別案が必要な場合は、最大4つの出力を生成できます。この柔軟性により、モデルを切り替えたり統合を作り直したりせずに、ドラフトから最終成果物までのワークフローに対応できます。

1つのAtlas Cloud Image API

1つのAtlas Cloud Image API

Atlas Cloudでは、テキスト生成と画像編集を1つの画像生成エンドポイントとAPIキーで利用できます。標準の従量課金は出力画像1枚あたり$0.04からで、各ソース画像には$0.01が課金されます。画像URLを返すことも、アプリケーションで直接処理するためにBase64出力をリクエストすることもできます。明確なコストと少ない統合数を求める本番パイプラインにとって、実用的な基盤となります。

Grok Imagine Image 2.0:1つのプロンプト、3つのビジョン

Grok Imagine Image 2.0とAtlas Cloudの2つの代替モデルが、同じプロンプトをエディトリアル写真と豊かな質感の静物写真でどのように解釈するかをご覧ください。

プロンプト

コバルトブルーの仕立ての良いスーツを着た若いファッションモデルが、陽光に照らされた地中海沿岸の駅を歩いている。出発する列車がばらばらの切符の半券を彼女の周囲に舞い上げ、彼女が風になびく髪を揺らしながらカメラの方を振り向く決定的瞬間を捉える。強いゴールデンアワーの斜め逆光が髪の輪郭に光るリムライトを生み、プラットフォーム全体に鋭い斜めの影を落とす。連続するアーチをフレーム・イン・フレームとして活用し、前景の荷物は柔らかくぼかし、列車へ向かって奥へ収束する強いリーディングラインを設ける。抑制の効いたブルーとアンバーの色調、自然な肌の質感、くっきりしたウール生地、風化した石、控えめなフィルムグレイン、エディトリアル・ファッション写真、85mmレンズ、舞い上がる紙にわずかなモーションブラー、横長16:9のアスペクト比、フルブリード

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud

プロンプト

午後のキャンパス屋上でリハーサルを行う高校生の吹奏楽団を捉えた、率直な青春ドキュメンタリー写真。突然の強風が楽譜の束全体を空中へ吹き飛ばす、まさにコミカルな瞬間を捉える。何十枚もの折り目のついた白いページが、驚いて飛び立つ鳥の群れのように画面を横切る。1人の女子生徒はつま先立ちになり、風に制服のスカートと髪を激しくなびかせながら、必死に1枚のページをつかもうと手を伸ばしている。その隣では、頬を膨らませた男子生徒が、真剣に集中した表情で演奏を続けている。彼の金管楽器の磨かれたベルは、逃げていく楽譜を追って駆け回る他の生徒たちをはっきりと反射している。複数の若い音楽家たちは、驚き、笑い、ぎこちない動きの途中の身振りを自然に見せる。楽器には、指の位置、バルブ、管、空間的な位置関係を含む、信頼できる機械的な複雑さを保たせる。日本の露出オーバーなアナログフィルム写真、 spontanéousな決定的瞬間の物語性、ややローアングルの横位置スナップ。屋上の手すりと張り詰めた物干しロープが、2本の強い収束するリーディングラインを形成する。さらに、近景を横切る大きくぼけた楽譜が、重層的な奥行きと部分的な遮蔽を生み出す。真昼の硬い指向性のある日差しが、コンクリートの上にくっきりとグラフィカルな影を落とす。空は大胆に露出オーバーした淡い色調で、ハイライトは明るく描く。色は澄んだ空のブルー、学校制服のホワイト、温かみのある真鍮のゴールドの厳格な3色パレットに限定する。小さな汗の粒、リアルな肌の質感、しわの寄ったコットンの制服、紙の繊維と折り目、風化した屋上のコンクリート、控えめなフィルムグレイン、穏やかなレンズブルーム、舞うページや髪、伸ばした手に抑制の効いたモーションブラーを残す。エネルギッシュで、混沌としていて、面白く、若々しく、観察的で、完全に演出されていない雰囲気。自然な肌、明瞭な色分離、脂っぽい過剰レンダリングなし、HDRなし、プラスチックのような肌なし、濁った色なし、人工的な光彩なし、映画的で壮大なエフェクトなし。35mmフィルムカメラ、28mm広角レンズ、選択的なモーションブラーを伴う高速のスナップシャッター、ハイキー露出、横長のランドスケープ構図、横長16:9のアスペクト比、フルブリード。

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image 2.0 Developer Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Seedream v5.0 Pro Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud

Generated with Grok Imagine Image Quality Text-to-Image on Atlas Cloud

クリエイティブワークフローを横断する Grok Imagine Image 2.0

キャンペーンの企画やプロダクトバリエーションから、エディトリアルアートやマルチフォーマット素材まで、Grok Imagine Image 2.0 は自然言語のプロンプトと最大3枚の参照画像から、14種類のアスペクト比に対応した高品質な1Kまたは2Kビジュアルを生成します。

Grok Imagine Image 2.0によるキャンペーンビジュアル

自然言語のプロンプトから、1Kまたは2K解像度の洗練されたキャンペーンビジュアルを生成します。14種類のアスペクト比から選択でき、さまざまな掲載枠向けのバナー、ランディングページ用アート、ソーシャル向けクリエイティブを用意できます。

商品カタログのバリエーション

自然言語の指示と最大3枚の参照画像を使って商品画像を編集します。カラーバリエーションや季節感のある背景、マーケットプレイス向けの構成を作成でき、ECチームや自動化されたカタログワークフローに活用できます。

Grok Imagine Image 2.0によるソーシャル素材

さまざまな画面形状に合わせたビジュアル素材を生成する際に、14種類のアスペクト比から選択できます。ソーシャルフィード、モバイルレイアウト、ディスプレイ広告枠、エディトリアル制作ワークフロー向けに、1Kのドラフトまたは2Kの納品用素材を作成できます。

エディトリアル向けコンセプトアート

text to image endpoint を通じて、文章で表現したコンセプトを洗練された1Kまたは2K画像に変換します。エディトリアルイラスト、提案用ビジュアル、ムードボード、プロダクトチームにおける初期段階のクリエイティブ検討をサポートします。

Grok Imagine Image 2.0による複数参照画像の編集

最大3枚の参照画像を入力し、必要な編集内容を自然言語で説明します。開発者は、クリエイター、マーチャンダイジングチーム、デザインレビュー、再利用可能なコンテンツパイプライン向けに、ガイド付き変換ツールを構築できます。

ドラフトから納品までのワークフロー

画像が検討段階から納品へ進むのに合わせて、低品質と中品質のティアを切り替えられます。どちらのティアでも1Kまたは2K出力と組み合わせることができ、プロトタイピング、レビューサイクル、実運用向け素材の作成に対応します。

現在の画像APIにおけるGrok Imagine Image 2.0

Grok Imagine Image 2.0とAtlas Cloudの3つの代替モデルを、プロバイダー、最大解像度、アスペクト比の制御、標準的な画像1枚あたりの料金で比較します。

モデルプロバイダー最大解像度アスペクト比の制御標準料金
Grok Imagine Image 2.0 Developer Text-to-ImagexAI2K14個のプリセット画像1枚あたり$0.04
Qwen Image 2.0 Text-to-imageQwen2048 × 20487個のプリセットとカスタムサイズ画像1枚あたり$0.035
Nano Banana 2 Lite Text-to-imageGoogle1K14個のプリセット画像1枚あたり$0.04
MAI-Image-2.5-Flash Text-to-imageMicrosoft各辺最大1360 pxカスタムサイズ$0.03 per image

Atlas Cloud で Grok Imagine Image 2.0 を使う方法

数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。

Atlas Cloud アカウントを作成

atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。

Atlas CloudでGrok Imagine Image 2.0を使用する理由

高度なGrok Imagine Image 2.0モデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。

パフォーマンスと柔軟性

低レイテンシ:
リアルタイム推論のためのGPU最適化推論。

統合API:
1つの統合でGrok Imagine Image 2.0、GPT、Gemini、DeepSeekを実行。

透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。

エンタープライズとスケール

開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。

信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。

セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。

Grok Imagine Image 2.0 APIに関するよくある質問

Grok Imagine Image 2.0は、自然言語によるビジュアルの生成・編集に対応したxAIの画像モデルです。Atlas Cloudでは、text to imageと編集用のエンドポイントを個別に提供しており、1Kまたは2Kの出力解像度と、lowまたはmediumの品質を選択できます。

テキストプロンプトから完成度の高いビジュアルを生成したり、自然言語による指示で既存の画像を変更したりできます。text to image生成では14種類のアスペクト比を利用でき、編集ワークフローでは最大3枚の参照画像を使用できます。

新しいビジュアルを生成する場合はtext to image endpointを、参照画像を使って作業する場合はedit endpointを選択します。対応するAtlas Cloudスキーマで定義された解像度、品質、アスペクト比の設定を指定し、プロンプトを送信してください。

どちらのワークフローも、1Kおよび2Kの解像度と、lowまたはmediumの品質レベルに対応しています。text to image endpointでは14種類のアスペクト比を利用でき、正方形、ポートレート、横長など、さまざまなレイアウトを生成できます。

edit endpointでは、1回のリクエストで最大3枚の参照画像を受け付けます。各参照画像の役割を説明し、どのビジュアル要素を変更し、どの要素を一貫して維持するかを明記してください。

Atlas Cloudでは、利用可能な生成・編集用エンドポイントの標準基本料金を、画像1枚あたり$0.04と案内しています。料金は従量課金制で、リクエスト数に応じて増減します。

出力をプロンプトだけで生成する場合は、text to image endpointを使用してください。参照画像を変換、組み合わせ、または調整する場合は、edit endpointを選択します。

いいえ。このファミリーページで扱っているエンドポイントは画像を生成します。動画生成には、これらの画像用ルートではなく、別のGrok Imagine動画モデルが必要です。

変更したい内容と、変更せずに維持すべき要素を、それぞれ明確な個別の指示として記述してください。複数画像を編集する場合は、各参照画像が何に寄与するかを説明し、複数の変換を組み合わせる前に、まず主要な変更を1つだけテストしてください。

さらにファミリーを探索

Seedance 2.5

Seedance 2.5 APIがAtlas Cloudで利用可能になりました!これにより、開発者はByteDanceの最新の動画モデルを利用できます。テキスト、単一の画像、または最大50のマルチモーダルな参照から、同期されたオーディオとフレーム内の多言語テキストを含む最大30秒のネイティブ動画をシングルパスで生成します。Atlas Cloudでは1つのキーでアクセスでき、被写体の一貫性と改善された物理演算により、ロングショットの整合性が保たれます。

ファミリーを表示

Wan 3.0

Wan 3.0 APIは、AlibabaのWanビデオファミリーの次世代モデルであり、長尺動画生成、マルチリファレンス制御、およびオーディオビジュアル品質を新たな高みへと押し上げるために構築されました。Atlas CloudはすでにWan 2.7、2.6、2.5をホストしており、Wan 3.0は追加のセットアップなしで同じ統合キーで実行されます。今日から開発を始めましょう。Wan 3.0で何を作成できるかを確認するには、下のショーケースまでスクロールしてください。

ファミリーを表示

MiniMax H3

MiniMax H3は、テキスト、画像、リファレンスによる生成に対応したMiniMaxのマルチモーダル動画ファミリーです。対応するルート全体で参照メディアの被写体を保持し、柔軟なアスペクト比を提供します。また、H3 Developerを通じて生成音声と映像を組み合わせ、出力プロファイルはエンドポイントごとに選択されます。Atlas Cloudは、1つのOpenAI互換キーのもとでこのファミリーを統合し、標準料金である1秒あたり$0.038からの明瞭な従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

Seedance 2.0

Seedance 2.0は、正確なショット作成に対応したByteDanceの本番向け動画モデルです。プロンプトから動画を生成したり、オプションの最終フレームガイダンスを使って先頭フレームの画像をアニメーション化したり、参照メディアとオプションのウェブ検索で結果を形作ったりできます。Atlas Cloudは、これらのワークフローを透明性の高い従量課金と1つのOpenAI互換キーで、統合されたAPIにまとめます。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2.5

OpenAIのgpt-image-2.5ファミリーでは、本番の画像ワークフロー向けにFlareとSunburstを選択できます。最大3840x2160までの任意の解像度でレンダリングし、xhighやmaxを含む5段階の品質ティアから、具体的な出力要件に合ったものを選択できます。Atlas Cloudでは、コールドスタートなしですぐに使えるREST推論を、生成1回あたり$0.004からの標準料金で提供しています。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Gemini Omni Flash

Gemini Omni APIは、Gemini Omni 1.1 Flashを含む、Google DeepMindのネイティブマルチモーダルなGemini Omni Flashファミリーを開発者に提供します。ネイティブ音声を同期したシネマティックな動画の作成、正確な開始フレームと終了フレームの制御による静止画のアニメーション化、または変更していない部分を保持したテキスト指示による既存映像の編集が可能です。Atlas Cloudは、OpenAI互換のキー1つで、統合されたアクセスと透明性の高い従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Grok Imagine

Grok Imagine API は、Image 2.0 から Video 1.5 および xAI TTS v1 まで、xAI の画像、ビデオ、音声モデルをカバーしています。1K または 2K の静止画を 14 のアスペクト比でレンダリング、シーンを 15 秒の 1080p モーション映像に変換、最大 7 つの参照画像でショットを操作、または 20 言語でナレーション可能です。Atlas Cloud はすべてのモードを 1 つのエンドポイント上で実行でき、画像あたり $0.02、秒あたり $0.05 からの従量課金制です。今すぐビルドを開始してください。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索