2週間限定 | Seedream 5.0 Pro が20%OFF!

xAI Models on Atlas Cloud | Grok Imagine Models

Atlas Cloud 上で xAI API を使用して、完全な画像および動画パイプラインを構築します。2K解像度での生成、参照画像を使用した編集、そして画像を音声同期クリップへとアニメーション化することが可能です。

AI Video Models by xAI

Atlas Cloud の最新 AI 動画生成モデルで、テキストと画像からシネマティックで高精細な動画を生成しましょう。

すべてのモデルを見る

AI Image Models by xAI

Atlas Cloud の最先端 AI 画像生成モデルを使い、プロンプトと参照画像から、そのまま実用できる息をのむようなビジュアルを生み出します。

すべてのモデルを見る

Large Language Models by xAI

Atlas Cloud では、業界をリードする大規模言語モデルを高速かつ低コストで提供し、チャット・推論・エージェントを大規模に支えます。

すべてのモデルを見る

xAI Models API Pricing Details

Compare standard vs. our pricing across every xAI model.

ModelStandard Price (USD)Our Price (USD)Discount
xAI TTS v1$0.015/K chars
Start from$0.015/K chars
View
Grok Imagine Video v1.5 Image-to-Video$0.08
Start from$0.08/s video
View
Grok Imagine Image Quality Text-to-Image$0.05/pic
Start from$0.05/pic
View
Grok Imagine Image Quality Edit$0.05/pic
Start from$0.05/pic
View
Grok Imagine Video Text-to-Video$0.05
Start from$0.05/s video
View
Grok Imagine Video Image-to-Video$0.05
Start from$0.05/s video
View

Explore models from other providers

Instantly explore and experiment with 400+ production-ready models in the Atlas Playground. Start customizing with one click.

Atlas Cloud で構築できる xAI API のユースケース

Grok Imagineの画像および動画エンドポイントは、単一のAPIから生成、編集、アニメーションを処理します。チームはこれらを使用して、静的アセットを音声付き動画コンテンツに変換し、以前は現実的ではなかったペースとコストで視覚的なクリエイティブを制作しています。

自動化されたEC商品動画

Eコマースチームは、Grok Imagine Video v1.5を使用して製品画像を短いビデオクリップにアニメーション化するパイプラインを構築し、同じコールで環境音と製品コンテキストのオーディオを生成します。1枚の製品写真が、ビデオ撮影やオーディオ編集なしで、広告や製品ページですぐに使える音声付きクリップになります。Atlas Cloudでは1秒あたり0.096ドルで、10秒の製品ビデオのコストは1ドル未満です。

静的アセットからのブランド広告クリエイティブ

ブランドチームは Grok Imagine Video v1.5 を使用して、承認済みのキャンペーン写真をネイティブ生成された音声付きのアニメーションソーシャル広告に変換します。オーディオトークンとビデオトークンは同じ推論パスで生成されるため、セリフ、効果音、環境音楽がポストプロダクション作業なしで映像と同期します。これにより、広告制作のワークフローから音声制作のプロセスが完全に排除されます。

映画プリプロダクション絵コンテ制作

監督や撮影監督は Grok Imagine Image を使用して、制作開始前にショットの構図、カメラアングル、照明を示す視覚的な絵コンテを作成します。2K解像度の出力は、各シーンの視覚的な指示書としてスタッフと共有するのに十分な詳細さを備えています。1画像あたり0.06ドルで、複数のショットの選択肢を繰り返し検討しても、そのコストは制作時間のわずか1時間分にも満たないものです。

不動産ライフスタイル動画

不動産開発業者は、建築レンダリングや室内写真から映画のようなライフスタイルクリップを生成するために Grok Imagine Video v1.5 を使用しています。バルコニーのレンダリングは環境音付きの夕景クリップになり、キッチンの写真は自然音付きの朝の風景になります。これにより、物件情報やプレセールスのマーケティング資料のための高価なライフスタイル写真撮影を代替できます。

マルチリファレンス画像合成

クリエイティブチームは、Grok Imagine Image Editの3ソース入力を使用して、複数の参照画像からの要素を1つの出力に合成します。つまり、商品画像、背景、および照明の参照画像を1回のAPIコールで組み合わせます。これにより、異なるシーン設定にわたってブランドの一貫性を維持するキャンペーンバリエーションを実用的に制作できるようになります。Atlas Cloudでの合成画像1枚あたりの料金は0.06ドルです。

インディーゲームのコンセプトアートとトレーラー

小規模なゲームスタジオは、プリプロダクション中に Grok Imagine Image を使用してコンセプトアートを生成し、そのキーフレームを Grok Imagine Video v1.5 に渡してアニメーションの予告編シーケンスを制作します。ビデオ拡張機能を使用すると、チームは単一の開始フレームからクリップを連結し、1回の呼び出しあたり15秒の制限を超えて、より長いシネマティックなシーケンスを構築できます。このワークフローは、初期段階のマーケティングコンテンツを制作するための外部のアニメーション請負業者に代わるものです。

Atlas Cloud AI

営業に問い合わせる

Xaiモデルに関するよくある質問

xAIはAtlas Cloud上で2つの画像エンドポイントを提供しています。テキストから画像を生成するGrok Imagine Image Qualityと、既存の画像を編集するGrok Imagine Image Quality Editです。どちらも最大2Kの解像度で出力し、価格は1画像あたり0.06ドルです。すべてのエンドポイントは、単一のAPIキーによる従量課金制(pay-as-you-go)で利用可能です。

はい。Atlas Cloudは4つのxAIビデオエンドポイントをホストしています。テキストからビデオ、画像からビデオ、リファレンスからビデオ、そしてネイティブオーディオ付きの画像からビデオを生成する新しいGrok Imagine Video v1.5です。すべての標準ビデオエンドポイントの価格は1秒あたり0.06ドルです。Video v1.5の価格は1秒あたり0.096ドルです。

はい、Grok Imagine Video v1.5 は同じ推論パスで音声と動画を生成します。セリフ、リップシンク、効果音、環境音楽は、後処理で追加されるのではなく、動画フレームと共同で生成されます。つまり、個別の位置合わせステップなしで、音声と視覚のイベントが同期されます。

はい。Grok Imagine Image Quality Edit エンドポイントは、既存の画像とテキスト指示を受け取り、変更されたバージョンを生成します。マルチリファレンス編集用に、1回の呼び出しにつき最大3枚のソース画像を提供できます。Atlas Cloud での価格は、画像1枚あたり0.06ドルです。

Grok Imagine Image は 1K および 2K の解像度出力に対応しています。2K オプションはスタジオ品質の画像を提供し、1枚あたり0.06ドルという同じ料金で利用できます。解像度は各 API 呼び出しのパラメータとして設定されます。

各リクエストでは、最大15秒のクリップが生成されます。より長いシーケンスを作成する場合は、動画拡張機能を使用して、前のクリップの最後のフレームから新しいクリップを継続して生成し、ショットをつなぎ合わせることができます。これにより、単一クリップの制限を超えたマルチショットシーケンスが可能になります。

はい。Grok Imagine Image は、複数の言語においてクラス最高のテキストレンダリングを備えていると Atlas Cloud によって説明されています。プロンプトに英語以外のテキストを含めて、生成された画像内に正確にレンダリングさせることができます。特定の言語カバレッジの詳細は、Atlas Cloud Grok Imagine モデルページでご確認いただけます。

画像生成と画像編集はどちらも1画像あたり0.06ドルです。標準的な動画生成は1秒あたり0.06ドルとなります。ネイティブオーディオ対応の Grok Imagine Video v1.5 は、1秒あたり0.096ドルです。すべてのモデルは従量課金制で、月額の最低利用料金はありません。

さらにファミリーを探索

Seedance 2.0

Seedance 2.0 APIは、ByteDanceのマルチモーダルビデオモデルへのプロダクションアクセスを提供します。これには、クアッドモーダル入力(テキスト、画像、ビデオ、オーディオ)と、ショット間で構図、カメラワーク、キャラクターのアクションを固定する業界最高水準の「Universal Reference」システムが含まれます。1回のAPIコールでディレクターレベルの制御を統合でき、一律$0.09/秒、即時キー発行、順番待ちリストなしで利用可能です。これらはエンタープライズクラスの稼働率とコンプライアンスによって裏付けられています。Seedance 2.0 Native 4Kが提供開始されました!

ファミリーを表示

Grok Imagine

Grok Imagine API は、開発者に xAI の画像、動画、音声生成を1つのスイートで提供します。多言語テキストレンダリングを備えた最大 2K の画像に加え、ネイティブで同期された音声とリファレンスベースの編集を備えた最大15秒の動画を生成します。Atlas Cloud 上では、1つのキーで Grok Imagine のすべてのモードを実行できるため、個別の設定なしで画像、動画、音声の間を移行できます。料金は画像1枚あたり0.02ドル、1秒あたり0.05ドルからです。

ファミリーを表示

Gemini Omni Flash

Gemini Omni API は、Google I/O 2026 で発表された Google DeepMind のマルチモーダル動画生成・編集モデルを、あなたのスタックで利用可能にします。Gemini Omni は Gemini の推論エンジンと生成メディアを融合し、テキスト・画像・動画・音声を自由に組み合わせた入力から、一貫性があり知識に裏付けられた出力を生成します。自然な対話で結果を磨き上げましょう。オブジェクトの差し替え、シーンの書き換え、スタイルの変更を行っても、物理法則、キャラクター、連続性はそのまま保たれます。Atlas Cloud は、テキストからの動画生成、最大 7 枚の参照画像に対応した画像からの動画生成、そして参照ベースの動画生成という Gemini Omni Flash の全ラインアップを、単一の統合 API で提供します。料金は $0.112 からの秒単位の透明な従量課金で、サブスクリプションは不要です。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

Alibaba

Atlas Cloudは、Alibabaの全モデルラインナップを単一のAPIに統合します。言語および画像タスク用のQwen、最大1080pの動画生成用のWanが利用可能です。すべてのモデルはサブスクリプション不要の従量課金制(pay-as-you-go)でアクセスできます。Alibaba APIは、既存のOpenAI互換クライアントを使用し、単一のベースURLを介して利用可能です。

ファミリーを表示

OpenAI

Atlas Cloudは、画像生成用のGPT Image 2から動画用のSora 2まで、OpenAI APIの全ラインナップへのアクセスを提供します。すべてのモデルは、月額の固定コミットメントなしの従量課金制でご利用いただけます。OpenAI互換APIを使用し、ベースURLを一つ変更するだけで簡単に組み込むことができます。

ファミリーを表示

xAI

Atlas Cloud 上で xAI API を使用して、完全な画像および動画パイプラインを構築します。2K解像度での生成、参照画像を使用した編集、そして画像を音声同期クリップへとアニメーション化することが可能です。

ファミリーを表示

Kwaivgi

Kwaivgi APIを標準価格より15%オフで提供。Atlas Cloudは、新しいKlingリリースへのDay-0アクセスを、従量課金制(Pay-as-you-go)およびシート数無制限で提供します。1つのアカウント、1つのキーで、スタンダードからマスター階層まで、すべてのKlingモデルをご利用いただけます。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

おすすめ記事

Atlas Cloud を最大限に活用するためのガイド、チュートリアル、製品アップデート。