


Veo 3.1 Liteは、スケーラブルな本番パイプラインを構築する開発者向けのGoogleの動画モデルファミリーです。エンドポイントに応じて、柔軟な動画時間オプションの利用、指定した最初と最後のフレーム間に8秒のトランジションを作成、または一般的なアスペクト比での生成が可能です。Atlas Cloudでは、透明性の高い従量課金制とシンプルなAPIアクセスを備え、これらの機能を1つのOpenAI互換キーで利用できます。今すぐ開発を始めましょう。
Veo 3.1 Lite は Google が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。
Atlas Cloudは、業界をリードする最新のクリエイティブモデルを提供します。
入力素材、出力制御、制作ワークフローに合った Veo 3.1 Lite エンドポイントを選択してください。
| モダリティ | 説明 |
|---|---|
| Veo 3.1 Lite T2V API (Text to Video) | テキストプロンプトから、同期音声付きの720pまたは1080p動画を生成できます。柔軟な動画時間オプションに対応し、コスト効率を重視した大量生成向けに設計されています。自動コンテンツパイプライン、マーケティング素材、迅速なコンセプト制作に適したエンドポイントです。 |
| Veo 3.1 Lite Start-End Frame to Video API | 最初のフレームと最後のフレームを指定して、その間の動きと音声を含む8秒動画を生成できます。制御されたトランジション、製品のお披露目、ビジュアル変換、明確なシーン終了の作成に適した、開発者向けのエンドポイントです。 |
| Veo 3.1 Lite I2V API (Image to Video) | 入力画像を、同期音声付きの720pまたは1080p動画へアニメーション化できます。一般的なアスペクト比に対応し、コスト効率の高い処理により、大規模な画像アニメーション、ソーシャルコンテンツ、広告クリエイティブ、ビジュアルストーリーテリングのワークフローに適しています。 |
Veo 3.1 Liteは、テキスト、単一画像、最初と最後のフレームからの生成を1つのAtlas Cloud APIに統合し、同期音声、720pまたは1080p出力、柔軟なクリップ長、横長・縦長の画角、シード制御、透明性の高い従量課金を提供します。
自然言語のプロンプトから、Veo 3.1 Liteで完成した動画を生成します。720pで4秒、6秒、または8秒のクリップをレンダリングでき、8秒出力では1080pも利用できます。1つのプロンプトで、被写体、設定、アクション、カメラワーク、ライティング、サウンドを指定できます。この方法は、迅速なコンセプト映像、キャンペーン用バリエーション、大量のストーリーテリングワークフローに適しています。
最大8MBの単一画像から始め、720pで4秒、6秒、または8秒、あるいは1080pで8秒の動画へとアニメーション化します。モーションプロンプトで被写体の動き、カメラワーク、雰囲気、音声を指示し、画像を冒頭の構図の基準として使用します。商品写真、アートワーク、ポートレート、ストーリーボードのフレームをモーションアセットに変換する用途に利用できます。
それぞれ最大8MBの最初と最後のフレームを定義し、その間の動きをモデルに生成させます。720pでは4秒、6秒、または8秒、1080p出力では8秒を選択できます。プロンプトベースのアクションや音声キューを追加して、フレーム間のシーケンスを形作れます。変化の表現、ビフォーアフターの演出、ストーリーボード間のトランジションなど、制御性が求められる用途に適しています。
Veo 3.1 Liteは、テキスト、画像、開始・終了フレームの各ワークフローで、動画と同期した音声を生成します。セリフは引用符で囲み、効果音や環境音をプロンプト内に記述することで、サウンドトラックをシーンに合わせられます。追跡シーンに合った足音からキッチンで食材が焼ける音まで、音声が生成クリップの一部として出力されるため、より完成度の高いストーリーテリングを実現できます。
720pまたは1080pの出力、16:9または9:16の画角、4秒、6秒、または8秒の長さを選択できます。1080pでは長さを8秒に設定してください。4K出力と動画延長には対応していません。シードパラメータを使うと、同一結果が保証されるわけではありませんが、再現性のある試行に役立ち、プロトタイプ、ソーシャル向けアセット、制作候補のいずれに対しても、開発者が実用的な制御を行えます。
透明性の高い従量課金で、3つすべてのVeo 3.1 Lite生成モードをAtlas Cloud APIから利用できます。掲載されている各Liteエンドポイントには、確認済みの標準基本料金$0.05が設定されています。1つの統合環境内で、テキスト、単一画像、最初と最後のフレームのワークフローを切り替えられます。この構成により、スケーラブルな動画実験の予算管理と運用保守が容易になります。
Veo 3.1 LiteとAtlas Cloudの2つの代替モデルが、同じアクション満載の動画プロンプトを、動き、カメラ制御、映像の連続性、同期サウンドの観点からどのように解釈するかを比較します。
無重力の軌道温室を舞台にした、8–10秒の高精度なレトロSFアニメーション映画の一場面。銅製金具の付いたクリーム色の宇宙服を着た、外見の一貫したヴィンテージ宇宙飛行士が、透明な培養ポッドから逃げ出した発光する青い種を必死に追いかけている。浮遊する水滴の内部から始まる超マクロショット。震える曲面を通して、宇宙飛行士と種が鮮明に屈折して見える。彼が手を伸ばして水滴にぶつかると、素早く引いていき、水滴が物理的に正確な、きらめく数百個の粒へと弾け飛ぶ様子を捉える。動きを途切れさせず、360-degreeのダイナミックな旋回ワイドショットへ移行。彼は漂う葉や根の間を推進するが、生きた蔓が突然足首に絡み付き、彼を後方へ引き戻す。動きを止めることなく、回転する銅製手すりをつかみ、説得力のある無重力の運動量でその周囲を旋回し、蔓を蹴りほどいて観測窓へ飛び出す。滑らかに一人称のヘルメットPOVへ反転し、広大な青い地球を背景に、手袋をはめた両手が種を包み込む。すると種は瞬時に、小さく輝く青い花冠へと開花する。花の結晶質の花びらへ素早くプッシュインして終わる。曲面の地球が、絶妙な細部まで反射して見える。冷たいシアンの地球光と脈動する琥珀色の非常照明が交互に照らし、深いネイビーの影、銅と金の機器、蛍光ブルーの生物発光、緻密な流体力学、弾性のある蔓の動き、自然な慣性、高密度で途切れのないアクション、強い被写体と衣装の一貫性、ドラマチックな物語のひねり、手作り感のあるプレミアムなレトロフューチャー・アニメーション長編映画品質、鮮明な映画的ディテール、 subtleなフィルムグレイン。音声:こもった宇宙服の呼吸音、金属製手すりの振動音、柔らかな衝突音、ガラスに当たって音を奏でる散らばった水滴、上昇するアナログシンセのパルス、そして reveal の瞬間に響く繊細な結晶の開花音。画面、ソフトウェアインターフェース、ダッシュボード、計器、プログレスバー、グラフ、キャプション、テキスト、ロゴ、透かしは一切含めない。16:9 aspect ratio。
Generated with Veo 3.1 Lite Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud
ひと続きの8–10秒のシームレスなシーケンスで展開する、フォトリアルなレトロ・スラップスティック・チェイス。嵐の夜、使い込まれた1950年代の理髪店の店内で、表情豊かな理髪師が客の顔を濃いシェービングフォームで覆った直後、客の靴が誤って真ちゅう製の床ペダルを踏み、クローム仕上げの理髪椅子が高速回転を始め、開いたドアから外へ転がり出す。鮮やかな赤いケープが背後ではためき続け、映像全体をつなぐ視覚的な目印となる。雨粒の付いた鏡に映る、完全に一貫した二人の反射を通り抜けるタイトなプッシュインから始める。機構がカチリと作動した瞬間に素早くパンし、続いて地面すれすれのトラッキングショットへ移行。がたつくキャスターの横を追いながら、椅子が敷居を越え、ネオンに染まった狭い路地へ疾走する。理髪師は歩調を崩さずその後を走り、片手には安全に掲げた straight razor、もう一方には湯気の立つタオルを持つ。水たまり、木箱、揺れる看板をかわしながら、あらゆる衝撃から雨が自然に跳ね、濡れた赤いケープが説得力のある重さと空気の流れでねじれる。雷光が走る中、回転する椅子の周囲を高速で旋回するショットへ移行。理髪師はたわんだ物干し綱をつかみ、路地を横切って振り子のように移動し、客の横で手を離す。椅子の回転に合わせ、あごに残ったフォームの最後の細い полоскаを正確に剃り落とす。顔、衣装、反射、プロップの位置、空間の連続性、雨、布、車輪、運動量の物理表現が一貫した、息をのむようなコミカルなフィニッシュ。店内の暖かなタングステン・アンバーの光が、シアンブルーの雨とマゼンタのネオンにぶつかる。映画的なワイドスクリーン構図、豊かな質感の時代考証に基づく美術設計、 subtleなフィルムグレイン、鮮明な動き、スローモーションなし、キャプションなし、テキストなし、インターフェースなし、グラフィックなし。同期音声:ペダルのガタンという音、加速する車輪のがたつき、最後の一 stroke にタイミングを合わせた razor の擦過音、タオルのはためき、跳ねる足音、ネオンのブーンという音、そして着地を際立たせる鋭い雷鳴。遊び心のあるブラスとスネアのチェイス音楽が最後のビートに向かって高まる。16:9 aspect ratio。
Generated with Veo 3.1 Lite Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud
Veo 3.1 Liteは、プロンプト、静止画、ペアのキーフレームから音声同期付きの動画を生成します。ソーシャルキャンペーン、プロダクトビジュアル、ストーリープロトタイプ、大規模なコンテンツ制作に活用できます。
テキストプロンプトから、音声同期付きの720pまたは1080p動画を生成します。ソーシャル投稿カレンダー、クリエイターキャンペーン、複数チャネルで効率的に大規模出力する必要があるコンテンツチーム向けに、繰り返し使える短尺動画アセットを作成できます。
text to video endpointを使って、修正したプロンプトから新しい動画を生成し、尺を柔軟に選択できます。マーケティングチームは、有料・オーガニックキャンペーン向けのコンセプトを選定する前に、複数のクリエイティブ方針を検討できます。
商品画像をアニメーション化し、音声同期付きの720pまたは1080p動画にします。提供された画像を出発点として保持しながら、EC商品ページ、ローンチページ、ビジュアルキャンペーン向けのモーションアセットを作成できます。
最初と最後のフレームを定義すると、モデルが音声付きのつなぎの動きを生成します。このワークフローはeight secondsの尺で、アニマティクス、シーン遷移、モーションスタディ、始点と終点を制御した絵コンテシーケンスに適しています。
書かれたシーンから始め、1つのワークフローで音声同期付きの動画を生成します。監督、デザイナー、クリエイティブ開発者は、制作にリソースを投入する前に、テンポ、雰囲気、ビジュアルの方向性を検証できます。
承認済みの静止画がすでにある場合は、テキストから始めるのではなく、それを動画にアニメーション化します。編集チームやコンテンツ制作者は、キャンペーンアート、イラスト、キービジュアルを、繰り返し使える動画アセットに展開できます。
入力方式、クリップ長、解像度、同期音声、標準的な秒単価で Veo 3.1 Lite と他の動画 API を比較します。
| モデル | 入力方式 | 出力時間 | 解像度の選択肢 | 同期音声 | 標準価格 |
|---|---|---|---|---|---|
| Veo 3.1 Lite テキストから動画へ | テキスト | 4、6、または8秒 | 720p、1080p | √ | $0.05/sec |
| Veo 3.1 Lite 始点・終点フレームから動画へ | テキスト、最初のフレーム、最後のフレーム | 4、6、または8秒 | 720p、1080p | √ | $0.05/sec |
| Veo 3.1 Lite 画像から動画へ | テキスト、画像 | 4、6、または8秒 | 720p、1080p | √ | $0.05/sec |
| Seedance 2.0 Mini テキストから動画へ | テキスト | 4~15秒、または自動 | 480p、720p、最大1440p-SR | √ | $0.056/sec |
| Wan-3.0 テキストから動画へ | テキスト | 2~30秒、またはスマート尺 | 480p、720p、1080p、ESRは最大4K | √ | $0.05/sec |
| Kling V3.0 Turbo テキストから動画へ | テキスト | 3~15秒 | 720p、1080p | √ | $0.112/sec |
数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。
atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。
高度なVeo 3.1 LiteモデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。
低レイテンシ:
リアルタイム推論のためのGPU最適化推論。
統合API:
1つの統合でVeo 3.1 Lite、GPT、Gemini、DeepSeekを実行。
透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。
開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。
信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。
セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。
Veo 3.1 Liteは、コストを重視する大規模ワークフロー向けにGoogleが提供する、高効率な動画生成モデルです。テキストプロンプト、入力画像、または指定した開始・終了フレームから、音声と同期した動画を生成します。
プロンプトを使って生成するtext-to-video、静止画像を動画化するimage-to-video、2つのフレーム間の動きを指定するstart-end frame-to-videoから選択できます。Atlas Cloudでは、各ワークフロー専用のエンドポイントを提供しています。
Atlas Cloud APIキーを作成し、適切なmodel IDと必須入力を指定して、動画生成エンドポイントにPOSTリクエストを送信します。レスポンスにはprediction IDが含まれており、出力の準備が完了するまでポーリングできます。
はい。text-to-videoおよびimage-to-videoエンドポイントでは音声と同期した動画が生成され、start-end frameワークフローでは、指定したフレーム間に生成された動きに音声が追加されます。
検証済みの3つのエンドポイントはすべて、720pと1080pの出力に対応しています。このモデルファミリーでは4K生成には対応していません。
検証済みの標準基本料金は、Atlas Cloudの3つのエンドポイントすべてで1回あたり$0.05です。従量課金制であり、一時的なプロモーション料金ではなく標準料金です。
開始フレーム、終了フレーム、および両者の間で意図する動きを説明するプロンプトを指定します。検証済みのAtlas Cloudバックエンドプロファイルでは、音声付きで720pまたは1080pを出力する8秒のワークフローが定義されています。
Liteは、音声との同期や720p・1080p出力を維持しながら、スケーラブルな動画ワークロードにおける価格効率を優先しています。主な制限は、4K出力と動画Extensionに対応していないことです。
映像の基準となる要素が重要な場合は、テキストだけに頼らず、image-to-videoを使用するか、開始フレームと終了フレームの両方を指定してください。被写体の動き、カメラの挙動、シーンの変化、音声の手がかりを明確に記述し、リクエストにより具体的な制約を与えることが重要です。
まず、bearer認証、正確なmodel ID、必須のpromptまたはimageフィールド、対応する解像度設定を確認してください。predictionがfailedステータスになった場合は、ペイロードを変更したり別のリクエストを送信したりする前に、返されたエラーを確認してください。
Atlas Cloud を最大限に活用するためのガイド、チュートリアル、製品アップデート。