Seedance 2.5 が提供開始 — Atlas Cloud で先行リリース
Hero background 1Hero background 2Hero background 3
Grok Imagine API for 15 Second Video

Grok Imagine API for 15 Second Video

Grok Imagine API は、Image 2.0 から Video 1.5 および xAI TTS v1 まで、xAI の画像、ビデオ、音声モデルをカバーしています。1K または 2K の静止画を 14 のアスペクト比でレンダリング、シーンを 15 秒の 1080p モーション映像に変換、最大 7 つの参照画像でショットを操作、または 20 言語でナレーション可能です。Atlas Cloud はすべてのモードを 1 つのエンドポイント上で実行でき、画像あたり $0.02、秒あたり $0.05 からの従量課金制です。今すぐビルドを開始してください。

Grok Imagine は xAI が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。

主要モデルを探索

Atlas Cloudは、業界をリードする最新のクリエイティブモデルを提供します。

静止画から音声まで、すべての Grok Imagine API エンドポイント

入力タイプ、出力長、解像度、呼び出しごとの価格に応じて適切な Grok Imagine API モデルを選択してください。

モダリティ説明
Grok Imagine Image 2.0 T2I API (Text to Image)最大8,000文字のプロンプトを入力すると、このエンドポイントは1K または 2K 解像度で1~4枚の画像を返します。低品質または中品質の階層により、レンダリング処理と処理時間をトレードオフできます。画像あたり $0.04 の価格設定です。コンセプト検討、ソーシャルメディア向けクリエイティブ、大量生産が必要なビジュアル制作に適しています。
Grok Imagine Image 2.0 Edit API (Image to Image)最大3枚の参照画像と自然言語の指示をエンドポイントに渡すと、編集結果が1K または 2K で、指定したアスペクト比または自動比率で返ります。同じ低品質および中品質の階層が適用され、画像あたり $0.04 です。製品のリスタイリング、背景の変更、デザインバリエーション生成がすべて1回の呼び出しで実行できます。
Grok Imagine Image Quality T2I API (Text to Image)より細かなディテールが重要な場合、このエンドポイントはテキストプロンプトを1K または 2K の洗練された静止画に変換し、リクエストあたり最大4つのバリエーションを画像あたり $0.05 で返します。アスペクト比は正方形、ポートレート、ランドスケープ、ウルトラワイドフォーマットに対応しています。ヒーロー画像、広告向けクリエイティブ、ブランドグレードの製品レンダリングに最適です。
Grok Imagine Image Quality Edit API (Image to Image)1~8枚のソース画像と編集指示を入力すると、修正版が1K または 2K で画像あたり $0.05 で返ります。複数画像の参照は <IMAGE_0> および <IMAGE_1> としてインラインで指定され、被写体とスタイルを1つの指示で組み合わせることができます。キャンペーンのリフレッシュ、スタイル変換、合成編集が主な用途です。
Grok Imagine Image T2I API (Text to Image)元々のテキストから画像へのエンドポイントは1K および 2K 出力と4画像バッチ処理を保ちながら、ファミリー内で最も低い画像あたり $0.02 の価格を実現しています。これにより、大量処理パイプライン、サムネイル生成、迅速なプロンプトテストに実用的なデフォルトとなります。
Grok Imagine Image Edit API (Image to Image)大規模な軽量編集が必要ですか?このエンドポイントは1~8枚の画像とテキスト指示を受け付け、1K または 2K で最大4つの編集結果を画像あたり $0.02 で返します。カタログのクリーンアップ、季節ごとのバリエーション、反復的なデザイン調整が低コストで実現できます。
Grok Imagine Video v1.5 T2V API (Text to Video)プロンプトのみで、480p、720p、または 1080p で、7つのアスペクト比に対応した、ネイティブ同期オーディオ付きの1~15秒のビデオが生成されます。請求は出力1秒あたり $0.08 です。予告編、ソーシャルメディア向けスポット、サウンドが組み込まれたナレーティブシーンに最適です。
Grok Imagine Video v1.5 I2V API (Image to Video)開始フレームとモーションプロンプトを提供すると、v1.5 は最大15秒間のアニメーション化を行い、1080p に達する解像度で、同じパスで生成されたオーディオを含めます。コストは1秒あたり $0.08 です。製品スピン、ポートレートアニメーション、静止画の動画化キャンペーン素材に適しています。
Grok Imagine Video v1.5 R2V API (Reference to Video)1~7枚の参照画像が画面上のキャラクター、オブジェクト、スタイルをガイドし、26のプリセットから選択した最大3つの音声が音声を駆動します。出力は480p または 720p で15秒に達し、1秒あたり $0.08 です。キャラクターの一貫性を保つストーリーテリング、バーチャル試着、ブランドマスコットに最適です。
Grok Imagine Video T2V API (Text to Video)テキストプロンプトが480p または 720p で1~15秒のクリップになり、ランドスケープ、正方形、縦向き配信をカバーする7つのアスペクト比に対応しています。1秒あたり $0.05 で、ソーシャルコンテンツと迅速なコンセプトボード作成に最適な選択肢です。
Grok Imagine Video I2V API (Image to Video)静止画を最初のフレームとして固定し、希望するモーションを説明すると、クリップが480p または 720p で15秒に拡張されます。価格は1秒あたり $0.05 で、製品写真とポートレートの大量アニメーション化が手頃な価格で実現できます。
Grok Imagine Video R2V API (Reference to Video)1~7枚の参照画像が画面上の登場人物と物体を決定し、開始フレームを固定する必要がありません。クリップは480p または 720p で最大10秒に達し、1秒あたり $0.05 です。アイデンティティとスタイルがショットからショットへと一貫している必要がある場合に使用します。
Grok Imagine Video Extend API (Video Extension)2~15秒の既存 mp4 を、次に何が起こるかを指定するプロンプトでガイドして、さらに2~10秒の続きを生成できます。出力はソースビデオと一致し、720p にキャップされ、1秒あたり $0.07 で請求されます。短いカットを必要な広告長に延長するのに便利です。
Grok Imagine Video Edit API (Video to Video)自然言語の指示が既存の mp4 を書き換え、元のシーン、モーション、フレーミングは保持されます。出力はソース期間を保ちながら8.7秒にキャップされ、入力ビデオに従って1秒あたり $0.07 で請求されます。小道具の追加、衣装変更、リスタイリングが再撮影なしで実現できます。
xAI TTS v1 API (Text to Speech)最大15,000文字のテキストが20言語に対応し、自動言語検出機能付きで、サブ秒レイテンシーで自然な音声に変換されます。配信をカスタマイズできます:再生速度 0.7x~1.5x、mp3/wav/pcm コーデック、サンプリングレート最大48 kHz に対応。ボイスオーバー、IVR プロンプト、アプリ内ナレーションが自然な使用例です。

Grok Imagine APIによる画像・動画・音声の対応

Grok Imagine APIの各機能は異なる制作ニーズに応え、14アスペクト比の2K静止画、参照画像による編集、同期音声付き動画、20言語の音声をカバーします。

音と動きを一度の処理でレンダリング

音と動きを一度の処理でレンダリング

会話、環境音、音楽は動きと同じパスで生成されるため、最大15秒のクリップはすでに同期された状態で届きます。公開前に別々のスコアリングや吹き替え工程は不要です。

Grok Imagine APIにおける14アスペクト比の2Kディテール

Grok Imagine APIにおける14アスペクト比の2Kディテール

Grok Imagine Image 2.0は14アスペクト比で1Kまたは2Kのフォトリアルなテクスチャを保持し、低品質と中品質のティアは画像あたり$0.04です。1回の生成でヒーローバナー、印刷用トリミング、クローズアップをカバーします。

静止画から動くショットへ

静止画から動くショットへ

写真をフィードすると、Grok Imagine Video v1.5がそれをオープニングフレームとして固定し、最大1080pで動きを構築します。カタログショットやポートレートがリShootなしでショーリールになります。

Grok Imagine APIでのマルチ画像編集

Grok Imagine APIでのマルチ画像編集

最大3枚の参照画像を1Kまたは2Kで一緒に編集でき、平易な言語の指示で名前を指定した要素のみを変更できます。編集あたり$0.04で、デザイン反復やブランド一貫のバリアントセットを手頃なコストで維持できます。

フレームごとにアイデンティティを保持するキャラクター

フレームごとにアイデンティティを保持するキャラクター

1〜7枚の参照画像が、固定スタートフレームなしで最大15秒のクリップにキャラクター、小道具、スタイルを引き継ぎます。バーチャル試着、プロダクトプレイスメント、キャラクター駆動シリーズで一貫した認識可能な外見を維持します。

Grok Imagine APIによる20言語の表現的な音声

Grok Imagine APIによる20言語の表現的な音声

xAI TTS v1は同じスイートに同梱され、サブ秒のレイテンシで20言語の表現的な音声にテキストを変換します。生成動画と組み合わせて、解説ナレーション、ローカライズ広告、アプリ内アシスタントに使用できます。

音声の選択と配信調整

音声の選択と配信調整

ペース、強調、トーンの詳細な制御が各読みを形作り、サブ秒合成がセリフのオーディションをほぼ瞬時にします。80以上の音声にわたり、1つのエンジンがオーディオブック、吹き替え、キャラクターセリフをカバーします。

1つのプロンプト、3つのモデル:Grok Imagine API を並べて比較

各セクションで同一のプロンプトを Grok Imagine API と2つの競合モデルで Atlas Cloud 上で実行し、モーション、音声同期、ディテール、タイポグラフィを公平に比較できます。

プロンプト

実写映画のナイトマーケットシーン、約10秒。低いアングルで-tracking shot_、湯気を上げる屋台を滑るように通り過ぎながら始まる。水でびしょ濡れになったタンクトップを着た若いワックシェフが麺を湯切りし、ワックから炎が吹き上がり、彼の顔をオレンジ色に照らす。カメラが右へ Whip pan し、油で焼けて縮まるエビの接写マクロに入り、油滴が跳ね散らばる様子を捉えた後、カウンターの上へクレーンアップしながら引き、シェフが spinning ワックを捕えて一連の動作で皿に麺を盛る。最後の瞬間:ぼさぼさの市場猫がカウンターに飛び乗り、エビを奪って群衆へと逃げ去り、シェフが笑いに身をひるがえす。カメラは手ぶれした高速チェイスで猫の後を追う。赤いランタンの光を反射する濡れたアスファルト、漂う湯気、浅い被写界深度、微細な粒子感のある gritty なドキュメンタリーフィルム調。音声:ガスコンロの轟音、油の音、市場のざわめきとレードルの音、猫の跳躍に合わせて正確に決まる盛り上がっていくドラムパターン。16:9 アスペクト比。

Generated with Grok Imagine Video v1.5 on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Grok Imagine Video on Atlas Cloud

プロンプト

Extreme macro photograph shot at tabletop level, camera lens resting flat on the wooden desk surface at the eye height of a 1:64 scale figure, looking horizontally across a miniature modeling workbench in the exact instant the illusion of scale becomes real. In the mid-ground, a wave of blue-tinted epoxy resin has been frozen mid-curl, its surface just misted with a water sprayer so genuine droplets bead and cling to the glossy resin; three tiny hand-painted surfers in bright orange swim trunks ride down the face of the frozen wave, one crouched low with an arm dragging through the resin, and a spray of real water beads flings off the wave's lip, caught sharp in mid-air with tiny burst highlights on every droplet edge. Behind them, softly out of focus, the hand of a young woman modelmaker hovers in the air holding fine steel tweezers, suspended and enormous like a giant who has wandered into the world she built; only the lower half of her face is visible at the top of the frame, the corner of her mouth curved into a small delighted smile, all of it dissolved into creamy bokeh. Late-afternoon hard sunlight cuts through venetian blinds, painting a row of crisp diagonal light bars and clean shadows across the bare wood and over the resin sea, striping the surfers' shoulders. A single dropped, out-of-focus miniature part — a stray plastic sprue fragment — sits in the extreme foreground as a blurred occluding layer at the lower left, separating planes; strips of blue masking tape edge the resin sea, and negative space is left on the right side for the hovering tweezers. Complementary orange-and-blue palette: cool blue resin and blue tape against warm orange trunks, grounded by the warm honey tone of the oak desk. Shot on 100mm f/2.8 macro lens, ultra-shallow depth of field with buttery focus falloff, telephoto compression from an ultra-low camera position, visible fine film grain, true photographic realism, no illustration, no CGI look. Wide 16:9 aspect ratio, full-bleed horizontal composition.

Generated with Grok Imagine Image 2.0 on Atlas Cloud

Generated with Grok Imagine Image 2.0 on Atlas Cloud

Generated with Seedream v5.0 Pro on Atlas Cloud

Generated with Seedream v5.0 Pro on Atlas Cloud

Generated with Grok Imagine Image Quality on Atlas Cloud

Generated with Grok Imagine Image Quality on Atlas Cloud

Grok Imagine APIで画像・動画・音声を統合制作

以下のすべてのワークフローは1つのOpenAI互換キーで動作するため、チームはスタックを変更することなく、Grok Imagine APIの画像ドラフト、参照編集、同期音声付き動画、ローカライズ済みナレーションへとアイデアを進められます。

Grok Imagine APIによる迅速なコンセプト反復

Image 2.0は低品質ティアで約10秒以内に1K解像度のドラフトを返し、1回の呼び出しで最大4つのバリアントを生成します。デザインチームは初期段階で多くの方向性を素早く探索し、その後優勝案を2Kで再レンダリングします。

複数参照による製品合成

Grok Imagine Image 2.0 Editに最大3枚の参照画像を入力し、自然な言葉で変更内容を記述するだけです。ECチームは背景の差し替えやパッケージのスタイル変更を行い、カタログ全体で単一製品の一貫性を保てます。

多言語ボイスオーバーとナレーション

xAI TTS v1はサブ秒のレイテンシで20言語・80以上の音声を使い、スクリプトを表現豊かな音声に変換します。プロダクトチームはこれを生成動画と組み合わせ、ローカライズ済み広告、チュートリアル、アプリ内ナレーションを作成できます。

ネイティブ音声対応のGrok Imagine API Video

Grok Imagine Video v1.5は1080p・最大15秒のクリップで、画像に同期した音楽・効果音・セリフを同時に生成します。マーケターは別個のオーディオ作業なしで、ワンパスで完成したスポットを取得できます。

Grok Imagine APIでキャラクター一貫性のストーリーテリング

すべてのカットで同一キャラクターが必要ですか?Reference-to-videoは1〜7枚の参照画像とオプションの参照音声を受け付けるため、シリーズ制作者は15秒のクリップ全体でキャラクターのルックスと音声トーンを一貫させられます。

再撮影なしのポストプロダクション

既存の映像は自然言語による編集でスタイル変更したり、ソースにマッチした2〜10秒の拡張で継続できます。ポストプロダクションチームはセットに戻ることなく、小道具・衣装・ペースを修正できます。

モデル比較

異なるプロバイダーのモデルを比較 — パフォーマンス、料金、独自の強みを確認して最適な選択を。

モデル参照画像数上限出力数解像度アスペクト比
Grok Imagine Image Quality81~42K, 1KAuto, 1:1, 3:2, 2:3, 3:4, 4:3, 9:16, 16:9, 9:19.5, 19.5:9, 9:20, 20:9, 1:2, 2:1
Nano Banana 21414K, 2K, 1K1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9
Nano Banana Pro1014K, 2K, 1K1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9
Seedream 5.0 Lite141~152K~4K+1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9
Qwen-Image31~6512P~2KWidth[512, 2048]px, Height[512, 2048]px

Atlas Cloud で Grok Imagine を使う方法

数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。

Atlas Cloud アカウントを作成

atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。

Atlas CloudでGrok Imagineを使用する理由

高度なGrok ImagineモデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。

パフォーマンスと柔軟性

低レイテンシ:
リアルタイム推論のためのGPU最適化推論。

統合API:
1つの統合でGrok Imagine、GPT、Gemini、DeepSeekを実行。

透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。

エンタープライズとスケール

開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。

信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。

セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。

Grok Imagine API に関する開発者の質問

Grok Imagine API は、xAI の Grok Imagine 生成スタックへの Atlas Cloud の統一されたアクセスポイントであり、画像生成、画像編集、動画、音声をカバーします。1つのキーで、2026年8月7日にリリースされた最新の Grok Imagine Image 2.0 Text-to-Image および Grok Imagine Image 2.0 Edit モデルを含む全てのモードにアクセス可能です。課金は成功した生成ごとに従量制で、サブスクリプションなしで呼び出しごとに課金されます。

3つの画像生成が並んでいます:Grok Imagine Image は画像あたり $0.02、Grok Imagine Image Quality は $0.05、Grok Imagine Image 2.0 は $0.04 からで、それぞれ独自の編集エンドポイントがペアになっています。動画は Grok Imagine Video が秒あたり $0.05、Grok Imagine Video v1.5 が秒あたり $0.08 で、extend および edit エンドポイントが併設されています。xAI TTS v1 が 20言語80以上の音声でスイートを完成させます。

Image 2.0 はデザイナーのようにタイポグラフィとレイアウトを計画するため、密度の高い構成や小さなテキストもテクスチャに溶け込まずに可読性を保ちます。また、選択可能な品質ティアを公開しており、同じプロンプトでレンダリング時間と忠実度をトレードオフできます。これは以前の Image および Image Quality モデルでは提供されていません。Text-to-Image と Edit の両バリアントがその動作を共有します。

料金は成功した生成ごとで、最低利用額はありません。Grok Imagine Image 2.0 は、低品質・1K で画像あたり $0.04、低品質・2K または中品質・1K で $0.06、中品質・2K で $0.08 です。Edit エンドポイントの入力画像1枚あたり $0.01 が追加されます。他の画像モデルでは、Grok Imagine Image は画像あたり $0.02、Grok Imagine Image Quality は $0.05 で、動画は秒あたり $0.05 から始まります。

Atlas Cloud API キーを作成し、プロンプトと xai/grok-imagine-image-2.0/text-to-image のようなモデルIDを画像生成エンドポイントに投稿します。レンダリングは非同期なので、呼び出しはリクエストIDを返し、そのステータスが処理中から完了するまで予測エンドポイントでポーリングします。すべての Grok Imagine モデルが同じパターンに従うため、後で動画や音声を追加する場合は1つの文字列を変更するだけです。今日から構築を始めてください。

出力は 1K (1024x1024) または 2K (2048x2048) で、正方形 1:1、ワイドスクリーン 16:9、縦長 9:20、ウルトラワイド 20:9 バナー形状など14のアスペクト比でレンダリングされます。1回の呼び出しで最大4枚の画像を返し、プロンプトは最大8,000文字まで可能です。Edit エンドポイントではアスペクト比はデフォルトで auto になり、明示的に設定しない限り最初の入力画像に従います。

1リクエストあたり最大3枚のソース画像。公開URLまたはbase64データURIで提供されます。複数渡す場合は、プロンプトで <IMAGE_0>、<IMAGE_1>、<IMAGE_2> と引用し、モデルが各指示がどのアセットに適用されるか理解できるようにします。入力画像1枚あたり $0.01 が追加され、1回に1〜4枚の編集済みバリアントをリクエストできます。

はい。Grok Imagine Video v1.5 は、画像と同じパスでネイティブで同期された音声を生成するため、音楽、効果音、対話が動きに合わせて整い、第2のパイプラインを必要としません。リファレンス・トゥ・ビデオモードでは、1〜7枚のリファレンス画像とともにオプションのリファレンス音声を接受入します。クリップは最大15秒で、テキスト・トゥ・ビデオおよび画像・トゥ・ビデオで1080pに達します。

フレームにタイポグラフィ、レイアウト、または一体でなければならないマルチパートのディテールが含まれている場合、またはスピードと忠実度のトレードオフを直接制御したい場合は Image 2.0 を選択します。Grok Imagine Image Quality は、同じ 1K と 2K 出力、14 アスペクト比で、画像あたり $0.05 のシンプルな定額制です。細かなテキストよりも量重視の場合は、画像あたり $0.02 のオリジナル Grok Imagine Image が最も経済的な選択肢です。

Medium はデフォルトの品質ティアで、モデルの最良の出力を目標とするため、1K で約84秒かかります。品質を low に設定すると、1K 画像で $0.06 ではなく $0.04 で約10秒に短縮され、約8倍高速になります。低品質でドラフトと反復を行い、構成が決まったら winning prompts のみを medium と 2K で再実行します。

さらにファミリーを探索

Seedance 2.5

Seedance 2.5 APIがAtlas Cloudで利用可能になりました!これにより、開発者はByteDanceの最新の動画モデルを利用できます。テキスト、単一の画像、または最大50のマルチモーダルな参照から、同期されたオーディオとフレーム内の多言語テキストを含む最大30秒のネイティブ動画をシングルパスで生成します。Atlas Cloudでは1つのキーでアクセスでき、被写体の一貫性と改善された物理演算により、ロングショットの整合性が保たれます。

ファミリーを表示

MiniMax H3

MiniMax H3 API は、MiniMax の汎用マルチモーダル動画モデルを利用できる API です。テキスト、画像、動画、音声を個別のタスクとしてではなく、ひとつのコンテキストとして扱います。クリップは 24 FPS で 5〜15 秒、アスペクト比は 21:9 から 9:16 まで対応し、1 つのプロンプトでキャラクターの差し替え、背景の置換、台詞の書き換え、参照クリップからの音声クローン作成が可能です。Atlas Cloud は、これらすべてを 1 つの OpenAI-compatible endpoint 経由で提供します。今すぐ開発を始めましょう。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

Seedance 2.0

Seedance 2.0 APIは、ByteDanceのマルチモーダルビデオモデルへのプロダクションアクセスを提供します。これには、クアッドモーダル入力(テキスト、画像、ビデオ、オーディオ)と、ショット間で構図、カメラワーク、キャラクターのアクションを固定する業界最高水準の「Universal Reference」システムが含まれます。1回のAPIコールでディレクターレベルの制御を統合でき、一律$0.09/秒、即時キー発行、順番待ちリストなしで利用可能です。これらはエンタープライズクラスの稼働率とコンプライアンスによって裏付けられています。Seedance 2.0 Native 4Kが提供開始されました!

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Gemini Omni Flash

Gemini Omni API は、Google I/O 2026 で発表された Google DeepMind のマルチモーダル動画生成・編集モデルを、あなたのスタックで利用可能にします。Gemini Omni は Gemini の推論エンジンと生成メディアを融合し、テキスト・画像・動画・音声を自由に組み合わせた入力から、一貫性があり知識に裏付けられた出力を生成します。自然な対話で結果を磨き上げましょう。オブジェクトの差し替え、シーンの書き換え、スタイルの変更を行っても、物理法則、キャラクター、連続性はそのまま保たれます。Atlas Cloud は、テキストからの動画生成、最大 7 枚の参照画像に対応した画像からの動画生成、そして参照ベースの動画生成という Gemini Omni Flash の全ラインアップを、単一の統合 API で提供します。料金は $0.112 からの秒単位の透明な従量課金で、サブスクリプションは不要です。今すぐ開発を始めましょう。

ファミリーを表示

Grok Imagine

Grok Imagine API は、Image 2.0 から Video 1.5 および xAI TTS v1 まで、xAI の画像、ビデオ、音声モデルをカバーしています。1K または 2K の静止画を 14 のアスペクト比でレンダリング、シーンを 15 秒の 1080p モーション映像に変換、最大 7 つの参照画像でショットを操作、または 20 言語でナレーション可能です。Atlas Cloud はすべてのモードを 1 つのエンドポイント上で実行でき、画像あたり $0.02、秒あたり $0.05 からの従量課金制です。今すぐビルドを開始してください。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

Alibaba

Atlas Cloudは、Alibabaの全モデルラインナップを単一のAPIに統合します。言語および画像タスク用のQwen、最大1080pの動画生成用のWanが利用可能です。すべてのモデルはサブスクリプション不要の従量課金制(pay-as-you-go)でアクセスできます。Alibaba APIは、既存のOpenAI互換クライアントを使用し、単一のベースURLを介して利用可能です。

ファミリーを表示

OpenAI

Atlas Cloudは、画像生成用のGPT Image 2から動画用のSora 2まで、OpenAI APIの全ラインナップへのアクセスを提供します。すべてのモデルは、月額の固定コミットメントなしの従量課金制でご利用いただけます。OpenAI互換APIを使用し、ベースURLを一つ変更するだけで簡単に組み込むことができます。

ファミリーを表示

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索