


Gemini Omni 1.1 Flashは、柔軟な制作ワークフローに対応するGoogle DeepMindのネイティブマルチモーダル動画ファミリーです。テキスト指示で既存の映像を編集したり、最大10枚の参照画像と3本の動画クリップでビジュアルの一貫性を維持したり、ショットを連結可能なセグメントとして拡張して最大40秒の映像を作成したりできます。OpenAI互換APIキー1つで、Atlas Cloud上のすべてのワークフローにアクセスできます。従量課金制で、Day-0から利用可能です。今すぐ開発を始めましょう。
Gemini Omni 1.1 Flash は Google が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。
Atlas Cloudは、業界をリードする最新のクリエイティブモデルを提供します。
5つのGemini Omni 1.1 Flashエンドポイントを、入力ワークフロー、出力機能、プロダクション用途の観点から比較します。
| モダリティ | 説明 |
|---|---|
| Gemini Omni 1.1 Flash Video Extend API | 既存のクリップを、自然につながる3〜10秒の拡張映像として継続し、ネイティブ音声も維持します。複数の拡張を連結して、合計最大40秒の一貫した1つのビデオショットを構成できます。 |
| Gemini Omni 1.1 Flash Video Edit API | シーン全体を作り直さずに既存の映像を修正したい場合に適しています。テキスト指示を使って、ネイティブ音声を維持しながら動画要素の追加、削除、置換、スタイル変更を行えます。プロンプトで言及していない内容は保持されます。 |
| Gemini Omni 1.1 Flash Reference-to-Video API | テキストプロンプトに最大10枚の参照画像と3本の参照動画クリップを指定し、ネイティブ音声付きのシネマティック動画を生成します。生成結果全体でキャラクター、製品、アートディレクションの一貫性が求められるプロジェクトに適しています。 |
| Gemini Omni 1.1 Flash Image-to-Video API | 静止画を、テキストプロンプトで動きを指定したシネマティックな音声付きクリップへ変換します。オプションの最終フレームを指定することで、生成ショットの開始位置と終了位置を正確に制御できます。 |
| Gemini Omni 1.1 Flash Text-to-Video API | 1つのテキストプロンプトを起点に、同期したネイティブ音声付きのシネマティック動画を生成します。高速な360pドラフトから4K出力まで、動画の長さ、アスペクト比、出力解像度を調整できます。 |
Gemini Omni 1.1 Flashは、動画生成、ネイティブ音声、リファレンスベースの連続性、精密なフレーム制御、指示ベースの編集、連鎖可能な拡張を、柔軟なAtlas Cloudワークフローに統合します。
テキストプロンプトから始めて、同期したネイティブ音声付きのシネマティックなクリップを生成できます。Gemini Omni 1.1 Flashでは、360pのドラフトから4Kまで、再生時間、アスペクト比、出力解像度を制御できます。動き、カメラの方向、セリフ、音楽、環境音を1つのリクエストで指定できます。映像と音声を一体で開発したい予告編、ソーシャル向け動画、ストーリービートに適したワークフローです。
既存のクリップにシームレスにマッチする3~10秒のセグメントを追加し、拡張を連鎖させて最大40秒まで延長できます。モデルは映像コンテキストとネイティブ音声を引き継ぐため、新しいアクションも同じショットの一部として自然につながります。物語にさらなる尺が必要なとき、シーケンスを最初から作り直すことなく、長い種明かし、チェイスシーン、プロダクトストーリーを構築できます。
テキストプロンプトに最大10枚のリファレンス画像と3本のリファレンス動画を追加し、ネイティブ音声付きの一貫した生成を導けます。画像はキャラクター、プロダクト、ロケーション、アートディレクションの基準として機能し、動画リファレンスは動きやショットの挙動を方向づけます。キャンペーン素材、エピソード形式のシーン、ブランドコンテンツ全体で、再現性のあるアイデンティティとビジュアル言語が重要な場合に適した方法です。
開始画像を定義し、必要に応じて最後のフレームを指定して、ショットの着地点を制御できます。Gemini Omni 1.1 Flashは静止画をネイティブサウンド付きのシネマティックなクリップへアニメーション化し、指定した終点に向けて補間します。この開始と終了の構成は、プロダクトの登場演出、シームレスなトランジション、マッチカット、正確な構図で終える必要がある計画的なカメラワークに適しています。
プロンプトで言及していない要素を維持したまま、直接テキストで指示して既存の動画を変更できます。要素の追加、削除、置換、スタイル変更ができ、編集後の結果にもネイティブ音声を保持できます。完成度の高いテイクに新しいオブジェクト、環境、ビジュアル処理だけを加えたい場合、この集中的なワークフローなら他の作業を維持しながら、シーンをゼロから作り直す手間を省けます。
Atlas Cloudの1つのAPIキーで、テキストから動画、画像から動画、リファレンス生成、編集、拡張を横断して利用できます。透明性の高い従量課金により、サブスクリプションや最低利用額を気にせず実験できます。開発者は360pでドラフトを作成し、最終的なディテールが重要な場合には最大4Kの出力をリクエストできます。この統合された経路により、モデルファミリー全体を本番ワークフローへ組み込みやすくなります。
Gemini Omni 1.1 Flash、Seedance 2.5、そして旧Gemini Omni Flashが、同じ2つのシネマティックプロンプトをどのように解釈するかをご覧ください。
黒く煤けた職人の吹きガラス工房を舞台にした8–10秒のファンタジー・ミニフィルム。まず、吹き竿の先端で高速回転する燃えるように赤い溶融ガラスの塊へ、極端なマクロのプッシュイン。粘性のある表面が折り重なり、輝き、炉の炎を屈折させる中、粘土で造形された職人が吹き竿を絶えず転がし続ける。職人の動く前腕の周囲をタイトに旋回し、金属製のトングがリズムに合わせて打ち鳴らされ、溶融ガラスをつまむ。カットなしで、白熱した塊が伸び、冷え、燃えるような心臓を持つ透明なガラス製ハチドリへとシームレスに変形する。ハチドリが結晶質の翼を羽ばたかせ、開いた顔料瓶の上をかすめ、クジャクブルーとマゼンタの粉末を渦巻く軌跡として空中へ引き込む様子を、高速トラッキングショットへと一気にパンする。翼を打つたびに粒子が飛び散り、衝突し、渦を巻き、その屈折したシルエットの中で煌めく。鳥は浮遊するガラスの泡へ鋭くバンクし、最後の音楽の一撃と完全に同時にそれをついばむ。ドラマチックな真上からの視点へカットすると、泡が外側へ弾け、極薄の破片が絶えず柔らかな半透明の花びらへと変形しながら、工房全体を螺旋状に舞い渡る。洗練された粘土ストップモーションと、光を帯びた半透明のアートガラスの質感を融合。触感のある手作りの不完全さ、説得力のある反射・屈折・コースティクス、陽炎、ガラスの変形、粒子物理を表現する。支配的なキーライトはオレンジレッドの炉の光、リムライトは冷たいシアンの月光。冒頭は黒と金を押しつぶしたような色調で始まり、クライマックスで鮮やかなクジャクブルーとマゼンタへ爆発的に展開する。カメラは高速かつ流動的に動き、時間的・キャラクター的な一貫性を強く保つ。停止やスローモーションによる間延びは入れない。音声:炉の轟音、回転するガラスの唸り、つまむ動作と翼の羽ばたき一つひとつに同期したリズミカルな金属音、粉末が駆け抜ける音、衝突時の鋭いクリスタルチャイム、そしてガラスが花びらへ変わる明るく連続的なフィナーレ。画面、インターフェース、ダッシュボード、プログレスバー、チャート、キャプション、ロゴ、テキストは一切表示しない。16:9 aspect ratio。
Generated with Gemini Omni 1.1 Flash Text-to-Video on Atlas Cloud
Generated with Seedance 2.5 Text-to-Video on Atlas Cloud
Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud
干潮時の岩場の潮だまり洞窟を舞台にした、8–10秒の超写実的なマクロ自然ドキュメンタリー映像。鮮やかなコーラルオレンジのココナッツオクトパスが即興のパーカッションを奏でる。8本すべての腕が解剖学的な一貫性を保ちながら、独立して自然に動き、真珠のような貝殻、空洞のウニの殻、滑らかなシーグラスを次第に密度を増すリズムで叩く。変形、接触、反発、物体の重量を正確に表現する。水面の高さでのマクロ横方向トラッキングショットから始まり、質感のある皮膚に水滴がきらめき、一打ごとに冷たいシアンの海水へ小さな波紋が広がる様子をタコの横で滑るように捉える。動く腕と楽器の間を高速で縫うように進む、極端なローアングルカメラへカットし、四肢の連続性と現実的な遮蔽を明確に維持する。突然ヤドカリが走り込み、主役の貝殻をつかんで逃走する。素早く遊び心のある追跡へと一気にパンし、タコが滑らかで凹凸のある岩の上を跳び越え、流れるように進む。腕が説得力のある摩擦を伴って岩をつかみ、離し、押し進む一方、ヤドカリの脚が小石の上でカタカタと音を立てる。押し寄せる波が洞窟を満たす直前、タコが貝殻を奪い返し、しっかりと置いて、力強い最後の一打を打ち込む。素早くクレーンアップして真上からの俯瞰ショットへ移行すると、波がタコの周囲で弾け、放射状に広がる泡がほぼ完璧な円形の構図を形成する。砕けた日光による水中の踊るコースティクス。冷たいティールの水とコーラルオレンジの被写体を対比させ、結晶のような飛沫、気泡、浮遊する砂、濡れた岩の反射、浅いマクロ被写界深度、シネマティックHDR、極めて鮮明な自然の質感を表現する。流動的で途切れのない動き、高速カメラ遷移。スローモーションは使用しない。環境音のみを使用し、完全に同期させる。明瞭な貝殻のタップ音、空洞のウニ殻を叩く音、明るいガラスのクリック音、吸盤が離れる音、ヤドカリのハサミと脚が擦れる音、次第に高まる波音、そして最後の一撃と波の衝突を、正確なリズムで揃える。音楽、ナレーション、テキスト、キャプション、ロゴ、インターフェース、ダッシュボード、チャート、プログレスバー、分割画面、余分な腕、融合または重複した腕、歪んだ解剖学的形状、浮遊する物体、貫通や破綻した接触物理、ゴムのような動き、時間的なちらつき、ジャンプカット、位置が一貫しない貝殻、漫画調のスタイルは一切含めない。超写実的なシネマティック野生動物マクロドキュメンタリー、16:9 aspect ratio。
Generated with Gemini Omni 1.1 Flash Text-to-Video on Atlas Cloud
Generated with Seedance 2.5 Text-to-Video on Atlas Cloud
Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud
Gemini Omni 1.1 Flashは、企画概要、静止画、参照メディア、既存クリップを、キャンペーン動画、一貫性のあるキャラクターストーリー、制御可能なトランジション、拡張シーン、ネイティブ音声付きのプロダクション投入可能なソーシャル向けアセットへと変換します。
既存のクリップに、シームレスにつながる3〜10秒の続きの映像を追加でき、拡張を連結すれば40秒まで延長できます。映像制作者やシリーズコンテンツチームは、各シーンを作り直すことなく、一貫性のあるワンショットを拡張できます。
新しい商品、背景、ビジュアルスタイルが必要ですか? テキストで指示した編集を適用し、指定されていない要素を維持できます。マーケティングチームは、元のクリップを毎回ゼロから作り直すことなく、狙いを定めたバリエーションを作成できます。
最大10枚の参照画像と3本の動画クリップを使うことで、モデルは生成をまたいでキャラクター、商品、アートディレクションを維持できます。ブランドスタジオは、より一貫したビジュアルアイデンティティで、関連性のあるローンチシーンを制作できます。
1枚の静止画から開始し、必要に応じて最終フレームを指定することで、モデルに両方の構図の間をつなぐシネマティックな動きを生成させられます。デザイナーは、リビール、ループ、シーン転換における冒頭と終端を正確に制御できます。
1つのテキスト概要から、同期したネイティブ音声付きのシネマティックなクリップを生成できます。尺、アスペクト比、出力解像度も選択可能です。クリエイターは、さまざまな公開フォーマットに合わせて広告やソーシャルストーリーを仕上げられます。
ショットを検証する際は、まず360pでプロトタイプを作成し、有望な方向性を比較したうえで、選択したコンセプトを最大4K出力まで引き上げられます。監督やクリエイティブ開発者は、本番制作の前に動き、構図、音声、テンポを検証できます。
クリップの長さ、最大解像度、ネイティブ音声対応、出力フレームレートで、Gemini Omni 1.1 Flashと主要なtext-to-videoモデルを比較します。
| モデル | 出力時間 | 最大解像度 | ネイティブ音声 | フレームレート |
|---|---|---|---|---|
| Gemini Omni 1.1 Flash Text-to-Video | 3~10秒 | 4K | √ | 24 FPS |
| MiniMax H3 Text-to-Video | 4~15秒 | 2K | √ | 24 FPS |
| Wan-3.0 Text-to-video | 2~30秒 | 1080P | √ | 30 FPS |
数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。
atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。
高度なGemini Omni 1.1 FlashモデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。
低レイテンシ:
リアルタイム推論のためのGPU最適化推論。
統合API:
1つの統合でGemini Omni 1.1 Flash、GPT、Gemini、DeepSeekを実行。
透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。
開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。
信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。
セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。
Gemini Omni 1.1 Flashは、Google DeepMindが開発したネイティブマルチモーダルの動画生成・編集モデルです。Atlas Cloudでは、生成、参照ガイド付き作成、編集、延長をカバーする5つのタスク別ワークフローに対応しています。動画出力には、同期したネイティブ音声を含めることができます。
テキストからの動画生成、静止画のアニメーション化、視覚的な参照素材に基づく生成、テキスト指示による既存クリップの編集、シーンの継続が可能です。Image to Videoでは、指定した最後のフレームに向けて補間し、ショット間の遷移を細かく制御することもできます。
Atlas Cloud APIキーを作成し、ワークフローに合ったエンドポイントを選択します。そのエンドポイントのパラメータスキーマに従って、必要なソース画像、動画、参照メディアとともにプロンプトを送信してください。まずは内容を明確に記述した1つのショットから始め、結果を確認してから入力を調整するとよいでしょう。
プロンプトベースの生成にはText to Video、静止画のアニメーション化にはImage to Videoを選択してください。Reference to Videoは人物や製品のアイデンティティ、またはアートディレクションの誘導に適しています。既存映像の変更にはVideo Edit、既存ショットの継続にはVideo Extendを使用します。
Text to Videoでは、動画の長さ、アスペクト比、360pから4Kまでの出力解像度を指定できます。Image to Videoでは開始画像を指定でき、オプションで最後のフレームも使用できます。Reference to Videoでは、最大10枚の参照画像と3本の参照動画クリップに対応しています。
はい。Atlas Cloudの5つのワークフローはすべて、同期したネイティブ音声付きの動画を生成するよう設計されています。シーンに音声が重要な場合は、意図するセリフ、環境音、音楽、効果音をプロンプトに明確に記述してください。
Atlas Cloudでは従量課金で利用できます。標準基本料金はText to Video、Reference to Video、Video Edit、Video Extendが$0.041、Image to Videoが$0.043です。これらは一時的な割引料金ではなく、標準的なバックエンド料金です。
1回の延長で3〜10秒を追加でき、延長を連続して適用することで、1つの一貫したショットを合計40秒まで延長できます。モデルは既存のクリップをコンテキストとして使用し、映像とネイティブ音声の両方を継続します。
明確で互換性のある参照素材を用意し、最大10枚の画像と3本の動画クリップをReference to Videoで使用してください。画像をアニメーション化する場合は、質の高い開始フレームを用意し、遷移先を制御したいときはオプションで最後のフレームも指定します。生成結果には依然として揺らぎが生じる可能性があるため、生成や延長のたびに、アイデンティティ、照明、動き、音声を確認してください。
Googleの説明では、1080pと4Kはネイティブ生成解像度ではなく、アップスケール出力のオプションです。試作段階では360pを使用し、構図と動きが要件を満たした段階で、より高い解像度を選択してください。
Atlas Cloud を最大限に活用するためのガイド、チュートリアル、製品アップデート。