Hero background 1Hero background 2Hero background 3

Gemini Omni 1.1 Flash Multimodal Video

Gemini Omni 1.1 Flashは、柔軟な制作ワークフローに対応するGoogle DeepMindのネイティブマルチモーダル動画ファミリーです。テキスト指示で既存の映像を編集したり、最大10枚の参照画像と3本の動画クリップでビジュアルの一貫性を維持したり、ショットを連結可能なセグメントとして拡張して最大40秒の映像を作成したりできます。OpenAI互換APIキー1つで、Atlas Cloud上のすべてのワークフローにアクセスできます。従量課金制で、Day-0から利用可能です。今すぐ開発を始めましょう。

Gemini Omni 1.1 Flash は Google が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。

主要モデルを探索

Atlas Cloudは、業界をリードする最新のクリエイティブモデルを提供します。

Gemini Omni 1.1 Flashの動画モード比較

5つのGemini Omni 1.1 Flashエンドポイントを、入力ワークフロー、出力機能、プロダクション用途の観点から比較します。

モダリティ説明
Gemini Omni 1.1 Flash Video Extend API既存のクリップを、自然につながる3〜10秒の拡張映像として継続し、ネイティブ音声も維持します。複数の拡張を連結して、合計最大40秒の一貫した1つのビデオショットを構成できます。
Gemini Omni 1.1 Flash Video Edit APIシーン全体を作り直さずに既存の映像を修正したい場合に適しています。テキスト指示を使って、ネイティブ音声を維持しながら動画要素の追加、削除、置換、スタイル変更を行えます。プロンプトで言及していない内容は保持されます。
Gemini Omni 1.1 Flash Reference-to-Video APIテキストプロンプトに最大10枚の参照画像と3本の参照動画クリップを指定し、ネイティブ音声付きのシネマティック動画を生成します。生成結果全体でキャラクター、製品、アートディレクションの一貫性が求められるプロジェクトに適しています。
Gemini Omni 1.1 Flash Image-to-Video API静止画を、テキストプロンプトで動きを指定したシネマティックな音声付きクリップへ変換します。オプションの最終フレームを指定することで、生成ショットの開始位置と終了位置を正確に制御できます。
Gemini Omni 1.1 Flash Text-to-Video API1つのテキストプロンプトを起点に、同期したネイティブ音声付きのシネマティック動画を生成します。高速な360pドラフトから4K出力まで、動画の長さ、アスペクト比、出力解像度を調整できます。

Gemini Omni 1.1 Flashビデオツールキットの全貌

Gemini Omni 1.1 Flashは、動画生成、ネイティブ音声、リファレンスベースの連続性、精密なフレーム制御、指示ベースの編集、連鎖可能な拡張を、柔軟なAtlas Cloudワークフローに統合します。

あらゆるプロンプトからネイティブサウンドを生成

テキストプロンプトから始めて、同期したネイティブ音声付きのシネマティックなクリップを生成できます。Gemini Omni 1.1 Flashでは、360pのドラフトから4Kまで、再生時間、アスペクト比、出力解像度を制御できます。動き、カメラの方向、セリフ、音楽、環境音を1つのリクエストで指定できます。映像と音声を一体で開発したい予告編、ソーシャル向け動画、ストーリービートに適したワークフローです。

Gemini Omni 1.1 Flashによるシーン拡張

既存のクリップにシームレスにマッチする3~10秒のセグメントを追加し、拡張を連鎖させて最大40秒まで延長できます。モデルは映像コンテキストとネイティブ音声を引き継ぐため、新しいアクションも同じショットの一部として自然につながります。物語にさらなる尺が必要なとき、シーケンスを最初から作り直すことなく、長い種明かし、チェイスシーン、プロダクトストーリーを構築できます。

リファレンスで導く映像の一貫性

テキストプロンプトに最大10枚のリファレンス画像と3本のリファレンス動画を追加し、ネイティブ音声付きの一貫した生成を導けます。画像はキャラクター、プロダクト、ロケーション、アートディレクションの基準として機能し、動画リファレンスは動きやショットの挙動を方向づけます。キャンペーン素材、エピソード形式のシーン、ブランドコンテンツ全体で、再現性のあるアイデンティティとビジュアル言語が重要な場合に適した方法です。

最初と最後のフレームを制御

開始画像を定義し、必要に応じて最後のフレームを指定して、ショットの着地点を制御できます。Gemini Omni 1.1 Flashは静止画をネイティブサウンド付きのシネマティックなクリップへアニメーション化し、指定した終点に向けて補間します。この開始と終了の構成は、プロダクトの登場演出、シームレスなトランジション、マッチカット、正確な構図で終える必要がある計画的なカメラワークに適しています。

ショットを作り直さずに編集

プロンプトで言及していない要素を維持したまま、直接テキストで指示して既存の動画を変更できます。要素の追加、削除、置換、スタイル変更ができ、編集後の結果にもネイティブ音声を保持できます。完成度の高いテイクに新しいオブジェクト、環境、ビジュアル処理だけを加えたい場合、この集中的なワークフローなら他の作業を維持しながら、シーンをゼロから作り直す手間を省けます。

1つのAPIで利用できるGemini Omni 1.1 Flash

Atlas Cloudの1つのAPIキーで、テキストから動画、画像から動画、リファレンス生成、編集、拡張を横断して利用できます。透明性の高い従量課金により、サブスクリプションや最低利用額を気にせず実験できます。開発者は360pでドラフトを作成し、最終的なディテールが重要な場合には最大4Kの出力をリクエストできます。この統合された経路により、モデルファミリー全体を本番ワークフローへ組み込みやすくなります。

Gemini Omni 1.1 Flash:1つのプロンプトによる動画対決

Gemini Omni 1.1 Flash、Seedance 2.5、そして旧Gemini Omni Flashが、同じ2つのシネマティックプロンプトをどのように解釈するかをご覧ください。

プロンプト

黒く煤けた職人の吹きガラス工房を舞台にした8–10秒のファンタジー・ミニフィルム。まず、吹き竿の先端で高速回転する燃えるように赤い溶融ガラスの塊へ、極端なマクロのプッシュイン。粘性のある表面が折り重なり、輝き、炉の炎を屈折させる中、粘土で造形された職人が吹き竿を絶えず転がし続ける。職人の動く前腕の周囲をタイトに旋回し、金属製のトングがリズムに合わせて打ち鳴らされ、溶融ガラスをつまむ。カットなしで、白熱した塊が伸び、冷え、燃えるような心臓を持つ透明なガラス製ハチドリへとシームレスに変形する。ハチドリが結晶質の翼を羽ばたかせ、開いた顔料瓶の上をかすめ、クジャクブルーとマゼンタの粉末を渦巻く軌跡として空中へ引き込む様子を、高速トラッキングショットへと一気にパンする。翼を打つたびに粒子が飛び散り、衝突し、渦を巻き、その屈折したシルエットの中で煌めく。鳥は浮遊するガラスの泡へ鋭くバンクし、最後の音楽の一撃と完全に同時にそれをついばむ。ドラマチックな真上からの視点へカットすると、泡が外側へ弾け、極薄の破片が絶えず柔らかな半透明の花びらへと変形しながら、工房全体を螺旋状に舞い渡る。洗練された粘土ストップモーションと、光を帯びた半透明のアートガラスの質感を融合。触感のある手作りの不完全さ、説得力のある反射・屈折・コースティクス、陽炎、ガラスの変形、粒子物理を表現する。支配的なキーライトはオレンジレッドの炉の光、リムライトは冷たいシアンの月光。冒頭は黒と金を押しつぶしたような色調で始まり、クライマックスで鮮やかなクジャクブルーとマゼンタへ爆発的に展開する。カメラは高速かつ流動的に動き、時間的・キャラクター的な一貫性を強く保つ。停止やスローモーションによる間延びは入れない。音声:炉の轟音、回転するガラスの唸り、つまむ動作と翼の羽ばたき一つひとつに同期したリズミカルな金属音、粉末が駆け抜ける音、衝突時の鋭いクリスタルチャイム、そしてガラスが花びらへ変わる明るく連続的なフィナーレ。画面、インターフェース、ダッシュボード、プログレスバー、チャート、キャプション、ロゴ、テキストは一切表示しない。16:9 aspect ratio。

Generated with Gemini Omni 1.1 Flash Text-to-Video on Atlas Cloud

Generated with Seedance 2.5 Text-to-Video on Atlas Cloud

Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud

プロンプト

干潮時の岩場の潮だまり洞窟を舞台にした、8–10秒の超写実的なマクロ自然ドキュメンタリー映像。鮮やかなコーラルオレンジのココナッツオクトパスが即興のパーカッションを奏でる。8本すべての腕が解剖学的な一貫性を保ちながら、独立して自然に動き、真珠のような貝殻、空洞のウニの殻、滑らかなシーグラスを次第に密度を増すリズムで叩く。変形、接触、反発、物体の重量を正確に表現する。水面の高さでのマクロ横方向トラッキングショットから始まり、質感のある皮膚に水滴がきらめき、一打ごとに冷たいシアンの海水へ小さな波紋が広がる様子をタコの横で滑るように捉える。動く腕と楽器の間を高速で縫うように進む、極端なローアングルカメラへカットし、四肢の連続性と現実的な遮蔽を明確に維持する。突然ヤドカリが走り込み、主役の貝殻をつかんで逃走する。素早く遊び心のある追跡へと一気にパンし、タコが滑らかで凹凸のある岩の上を跳び越え、流れるように進む。腕が説得力のある摩擦を伴って岩をつかみ、離し、押し進む一方、ヤドカリの脚が小石の上でカタカタと音を立てる。押し寄せる波が洞窟を満たす直前、タコが貝殻を奪い返し、しっかりと置いて、力強い最後の一打を打ち込む。素早くクレーンアップして真上からの俯瞰ショットへ移行すると、波がタコの周囲で弾け、放射状に広がる泡がほぼ完璧な円形の構図を形成する。砕けた日光による水中の踊るコースティクス。冷たいティールの水とコーラルオレンジの被写体を対比させ、結晶のような飛沫、気泡、浮遊する砂、濡れた岩の反射、浅いマクロ被写界深度、シネマティックHDR、極めて鮮明な自然の質感を表現する。流動的で途切れのない動き、高速カメラ遷移。スローモーションは使用しない。環境音のみを使用し、完全に同期させる。明瞭な貝殻のタップ音、空洞のウニ殻を叩く音、明るいガラスのクリック音、吸盤が離れる音、ヤドカリのハサミと脚が擦れる音、次第に高まる波音、そして最後の一撃と波の衝突を、正確なリズムで揃える。音楽、ナレーション、テキスト、キャプション、ロゴ、インターフェース、ダッシュボード、チャート、プログレスバー、分割画面、余分な腕、融合または重複した腕、歪んだ解剖学的形状、浮遊する物体、貫通や破綻した接触物理、ゴムのような動き、時間的なちらつき、ジャンプカット、位置が一貫しない貝殻、漫画調のスタイルは一切含めない。超写実的なシネマティック野生動物マクロドキュメンタリー、16:9 aspect ratio。

Generated with Gemini Omni 1.1 Flash Text-to-Video on Atlas Cloud

Generated with Seedance 2.5 Text-to-Video on Atlas Cloud

Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud

Gemini Omni 1.1 Flashで企画概要から完成シーンまで

Gemini Omni 1.1 Flashは、企画概要、静止画、参照メディア、既存クリップを、キャンペーン動画、一貫性のあるキャラクターストーリー、制御可能なトランジション、拡張シーン、ネイティブ音声付きのプロダクション投入可能なソーシャル向けアセットへと変換します。

Gemini Omni 1.1 Flashによるストーリー拡張

既存のクリップに、シームレスにつながる3〜10秒の続きの映像を追加でき、拡張を連結すれば40秒まで延長できます。映像制作者やシリーズコンテンツチームは、各シーンを作り直すことなく、一貫性のあるワンショットを拡張できます。

キャンペーンの精密な修正

新しい商品、背景、ビジュアルスタイルが必要ですか? テキストで指示した編集を適用し、指定されていない要素を維持できます。マーケティングチームは、元のクリップを毎回ゼロから作り直すことなく、狙いを定めたバリエーションを作成できます。

Gemini Omni 1.1 Flashによるブランドワールド

最大10枚の参照画像と3本の動画クリップを使うことで、モデルは生成をまたいでキャラクター、商品、アートディレクションを維持できます。ブランドスタジオは、より一貫したビジュアルアイデンティティで、関連性のあるローンチシーンを制作できます。

制御可能なキーフレームトランジション

1枚の静止画から開始し、必要に応じて最終フレームを指定することで、モデルに両方の構図の間をつなぐシネマティックな動きを生成させられます。デザイナーは、リビール、ループ、シーン転換における冒頭と終端を正確に制御できます。

プロンプトによるソーシャル動画制作

1つのテキスト概要から、同期したネイティブ音声付きのシネマティックなクリップを生成できます。尺、アスペクト比、出力解像度も選択可能です。クリエイターは、さまざまな公開フォーマットに合わせて広告やソーシャルストーリーを仕上げられます。

Gemini Omni 1.1 Flashによるプリビジュアライゼーション

ショットを検証する際は、まず360pでプロトタイプを作成し、有望な方向性を比較したうえで、選択したコンセプトを最大4K出力まで引き上げられます。監督やクリエイティブ開発者は、本番制作の前に動き、構図、音声、テンポを検証できます。

動画生成におけるGemini Omni 1.1 Flashの位置づけ

クリップの長さ、最大解像度、ネイティブ音声対応、出力フレームレートで、Gemini Omni 1.1 Flashと主要なtext-to-videoモデルを比較します。

モデル出力時間最大解像度ネイティブ音声フレームレート
Gemini Omni 1.1 Flash Text-to-Video3~10秒4K√24 FPS
MiniMax H3 Text-to-Video4~15秒2K√24 FPS
Wan-3.0 Text-to-video2~30秒1080P√30 FPS

Atlas Cloud で Gemini Omni 1.1 Flash を使う方法

数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。

Atlas Cloud アカウントを作成

atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。

Atlas CloudでGemini Omni 1.1 Flashを使用する理由

高度なGemini Omni 1.1 FlashモデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。

パフォーマンスと柔軟性

低レイテンシ:
リアルタイム推論のためのGPU最適化推論。

統合API:
1つの統合でGemini Omni 1.1 Flash、GPT、Gemini、DeepSeekを実行。

透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。

エンタープライズとスケール

開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。

信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。

セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。

Gemini Omni 1.1 Flash APIに関する質問と回答

Gemini Omni 1.1 Flashは、Google DeepMindが開発したネイティブマルチモーダルの動画生成・編集モデルです。Atlas Cloudでは、生成、参照ガイド付き作成、編集、延長をカバーする5つのタスク別ワークフローに対応しています。動画出力には、同期したネイティブ音声を含めることができます。

テキストからの動画生成、静止画のアニメーション化、視覚的な参照素材に基づく生成、テキスト指示による既存クリップの編集、シーンの継続が可能です。Image to Videoでは、指定した最後のフレームに向けて補間し、ショット間の遷移を細かく制御することもできます。

Atlas Cloud APIキーを作成し、ワークフローに合ったエンドポイントを選択します。そのエンドポイントのパラメータスキーマに従って、必要なソース画像、動画、参照メディアとともにプロンプトを送信してください。まずは内容を明確に記述した1つのショットから始め、結果を確認してから入力を調整するとよいでしょう。

プロンプトベースの生成にはText to Video、静止画のアニメーション化にはImage to Videoを選択してください。Reference to Videoは人物や製品のアイデンティティ、またはアートディレクションの誘導に適しています。既存映像の変更にはVideo Edit、既存ショットの継続にはVideo Extendを使用します。

Text to Videoでは、動画の長さ、アスペクト比、360pから4Kまでの出力解像度を指定できます。Image to Videoでは開始画像を指定でき、オプションで最後のフレームも使用できます。Reference to Videoでは、最大10枚の参照画像と3本の参照動画クリップに対応しています。

はい。Atlas Cloudの5つのワークフローはすべて、同期したネイティブ音声付きの動画を生成するよう設計されています。シーンに音声が重要な場合は、意図するセリフ、環境音、音楽、効果音をプロンプトに明確に記述してください。

Atlas Cloudでは従量課金で利用できます。標準基本料金はText to Video、Reference to Video、Video Edit、Video Extendが$0.041、Image to Videoが$0.043です。これらは一時的な割引料金ではなく、標準的なバックエンド料金です。

1回の延長で3〜10秒を追加でき、延長を連続して適用することで、1つの一貫したショットを合計40秒まで延長できます。モデルは既存のクリップをコンテキストとして使用し、映像とネイティブ音声の両方を継続します。

明確で互換性のある参照素材を用意し、最大10枚の画像と3本の動画クリップをReference to Videoで使用してください。画像をアニメーション化する場合は、質の高い開始フレームを用意し、遷移先を制御したいときはオプションで最後のフレームも指定します。生成結果には依然として揺らぎが生じる可能性があるため、生成や延長のたびに、アイデンティティ、照明、動き、音声を確認してください。

Googleの説明では、1080pと4Kはネイティブ生成解像度ではなく、アップスケール出力のオプションです。試作段階では360pを使用し、構図と動きが要件を満たした段階で、より高い解像度を選択してください。

さらにファミリーを探索

Seedance 2.5

Seedance 2.5 APIがAtlas Cloudで利用可能になりました!これにより、開発者はByteDanceの最新の動画モデルを利用できます。テキスト、単一の画像、または最大50のマルチモーダルな参照から、同期されたオーディオとフレーム内の多言語テキストを含む最大30秒のネイティブ動画をシングルパスで生成します。Atlas Cloudでは1つのキーでアクセスでき、被写体の一貫性と改善された物理演算により、ロングショットの整合性が保たれます。

ファミリーを表示

Wan 3.0

Wan 3.0 APIは、AlibabaのWanビデオファミリーの次世代モデルであり、長尺動画生成、マルチリファレンス制御、およびオーディオビジュアル品質を新たな高みへと押し上げるために構築されました。Atlas CloudはすでにWan 2.7、2.6、2.5をホストしており、Wan 3.0は追加のセットアップなしで同じ統合キーで実行されます。今日から開発を始めましょう。Wan 3.0で何を作成できるかを確認するには、下のショーケースまでスクロールしてください。

ファミリーを表示

MiniMax H3

MiniMax H3は、テキスト、画像、リファレンスによる生成に対応したMiniMaxのマルチモーダル動画ファミリーです。対応するルート全体で参照メディアの被写体を保持し、柔軟なアスペクト比を提供します。また、H3 Developerを通じて生成音声と映像を組み合わせ、出力プロファイルはエンドポイントごとに選択されます。Atlas Cloudは、1つのOpenAI互換キーのもとでこのファミリーを統合し、標準料金である1秒あたり$0.038からの明瞭な従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

Seedance 2.0

Seedance 2.0は、正確なショット作成に対応したByteDanceの本番向け動画モデルです。プロンプトから動画を生成したり、オプションの最終フレームガイダンスを使って先頭フレームの画像をアニメーション化したり、参照メディアとオプションのウェブ検索で結果を形作ったりできます。Atlas Cloudは、これらのワークフローを透明性の高い従量課金と1つのOpenAI互換キーで、統合されたAPIにまとめます。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2.5

OpenAIのgpt-image-2.5ファミリーでは、本番の画像ワークフロー向けにFlareとSunburstを選択できます。最大3840x2160までの任意の解像度でレンダリングし、xhighやmaxを含む5段階の品質ティアから、具体的な出力要件に合ったものを選択できます。Atlas Cloudでは、コールドスタートなしですぐに使えるREST推論を、生成1回あたり$0.004からの標準料金で提供しています。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Gemini Omni Flash

Gemini Omniは、Google DeepMindによるネイティブなマルチモーダル動画ファミリーです。プロンプトによる生成・編集に対応し、テキストからの生成、静止画のアニメーション化、任意のビジュアルリファレンスを使った既存映像の編集を、変更していない部分を保持しながら行えます。解像度、アスペクト比、動画の長さを柔軟に設定でき、さまざまな制作ワークフローに対応します。Atlas Cloudは、透明性の高い従量課金でアクセスを一元化します。今日から開発を始めましょう。

ファミリーを表示

Grok Imagine

Grok Imagine API は、Image 2.0 から Video 1.5 および xAI TTS v1 まで、xAI の画像、ビデオ、音声モデルをカバーしています。1K または 2K の静止画を 14 のアスペクト比でレンダリング、シーンを 15 秒の 1080p モーション映像に変換、最大 7 つの参照画像でショットを操作、または 20 言語でナレーション可能です。Atlas Cloud はすべてのモードを 1 つのエンドポイント上で実行でき、画像あたり $0.02、秒あたり $0.05 からの従量課金制です。今すぐビルドを開始してください。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索