Hero background 1Hero background 2Hero background 3

Veo 3.1 Lite Video API from $0.05

Veo 3.1 Liteは、スケーラブルな本番パイプラインを構築する開発者向けのGoogleの動画モデルファミリーです。エンドポイントに応じて、柔軟な動画時間オプションの利用、指定した最初と最後のフレーム間に8秒のトランジションを作成、または一般的なアスペクト比での生成が可能です。Atlas Cloudでは、透明性の高い従量課金制とシンプルなAPIアクセスを備え、これらの機能を1つのOpenAI互換キーで利用できます。今すぐ開発を始めましょう。

Veo 3.1 Lite は Google が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。

主要モデルを探索

Atlas Cloudは、業界をリードする最新のクリエイティブモデルを提供します。

Veo 3.1 Lite 動画生成モダリティの比較

入力素材、出力制御、制作ワークフローに合った Veo 3.1 Lite エンドポイントを選択してください。

モダリティ説明
Veo 3.1 Lite T2V API (Text to Video)テキストプロンプトから、同期音声付きの720pまたは1080p動画を生成できます。柔軟な動画時間オプションに対応し、コスト効率を重視した大量生成向けに設計されています。自動コンテンツパイプライン、マーケティング素材、迅速なコンセプト制作に適したエンドポイントです。
Veo 3.1 Lite Start-End Frame to Video API最初のフレームと最後のフレームを指定して、その間の動きと音声を含む8秒動画を生成できます。制御されたトランジション、製品のお披露目、ビジュアル変換、明確なシーン終了の作成に適した、開発者向けのエンドポイントです。
Veo 3.1 Lite I2V API (Image to Video)入力画像を、同期音声付きの720pまたは1080p動画へアニメーション化できます。一般的なアスペクト比に対応し、コスト効率の高い処理により、大規模な画像アニメーション、ソーシャルコンテンツ、広告クリエイティブ、ビジュアルストーリーテリングのワークフローに適しています。

Veo 3.1 Lite:動画生成の3つの方法

Veo 3.1 Liteは、テキスト、単一画像、最初と最後のフレームからの生成を1つのAtlas Cloud APIに統合し、同期音声、720pまたは1080p出力、柔軟なクリップ長、横長・縦長の画角、シード制御、透明性の高い従量課金を提供します。

テキストからVeo 3.1 Liteで生成

自然言語のプロンプトから、Veo 3.1 Liteで完成した動画を生成します。720pで4秒、6秒、または8秒のクリップをレンダリングでき、8秒出力では1080pも利用できます。1つのプロンプトで、被写体、設定、アクション、カメラワーク、ライティング、サウンドを指定できます。この方法は、迅速なコンセプト映像、キャンペーン用バリエーション、大量のストーリーテリングワークフローに適しています。

画像駆動アニメーション

最大8MBの単一画像から始め、720pで4秒、6秒、または8秒、あるいは1080pで8秒の動画へとアニメーション化します。モーションプロンプトで被写体の動き、カメラワーク、雰囲気、音声を指示し、画像を冒頭の構図の基準として使用します。商品写真、アートワーク、ポートレート、ストーリーボードのフレームをモーションアセットに変換する用途に利用できます。

最初と最後のフレームを制御

それぞれ最大8MBの最初と最後のフレームを定義し、その間の動きをモデルに生成させます。720pでは4秒、6秒、または8秒、1080p出力では8秒を選択できます。プロンプトベースのアクションや音声キューを追加して、フレーム間のシーケンスを形作れます。変化の表現、ビフォーアフターの演出、ストーリーボード間のトランジションなど、制御性が求められる用途に適しています。

同期音声対応のVeo 3.1 Lite

Veo 3.1 Liteは、テキスト、画像、開始・終了フレームの各ワークフローで、動画と同期した音声を生成します。セリフは引用符で囲み、効果音や環境音をプロンプト内に記述することで、サウンドトラックをシーンに合わせられます。追跡シーンに合った足音からキッチンで食材が焼ける音まで、音声が生成クリップの一部として出力されるため、より完成度の高いストーリーテリングを実現できます。

柔軟なHD出力

720pまたは1080pの出力、16:9または9:16の画角、4秒、6秒、または8秒の長さを選択できます。1080pでは長さを8秒に設定してください。4K出力と動画延長には対応していません。シードパラメータを使うと、同一結果が保証されるわけではありませんが、再現性のある試行に役立ち、プロトタイプ、ソーシャル向けアセット、制作候補のいずれに対しても、開発者が実用的な制御を行えます。

従量課金による制作

透明性の高い従量課金で、3つすべてのVeo 3.1 Lite生成モードをAtlas Cloud APIから利用できます。掲載されている各Liteエンドポイントには、確認済みの標準基本料金$0.05が設定されています。1つの統合環境内で、テキスト、単一画像、最初と最後のフレームのワークフローを切り替えられます。この構成により、スケーラブルな動画実験の予算管理と運用保守が容易になります。

Veo 3.1 Lite:2つの物語、対決ごとに1つのプロンプト

Veo 3.1 LiteとAtlas Cloudの2つの代替モデルが、同じアクション満載の動画プロンプトを、動き、カメラ制御、映像の連続性、同期サウンドの観点からどのように解釈するかを比較します。

プロンプト

無重力の軌道温室を舞台にした、8–10秒の高精度なレトロSFアニメーション映画の一場面。銅製金具の付いたクリーム色の宇宙服を着た、外見の一貫したヴィンテージ宇宙飛行士が、透明な培養ポッドから逃げ出した発光する青い種を必死に追いかけている。浮遊する水滴の内部から始まる超マクロショット。震える曲面を通して、宇宙飛行士と種が鮮明に屈折して見える。彼が手を伸ばして水滴にぶつかると、素早く引いていき、水滴が物理的に正確な、きらめく数百個の粒へと弾け飛ぶ様子を捉える。動きを途切れさせず、360-degreeのダイナミックな旋回ワイドショットへ移行。彼は漂う葉や根の間を推進するが、生きた蔓が突然足首に絡み付き、彼を後方へ引き戻す。動きを止めることなく、回転する銅製手すりをつかみ、説得力のある無重力の運動量でその周囲を旋回し、蔓を蹴りほどいて観測窓へ飛び出す。滑らかに一人称のヘルメットPOVへ反転し、広大な青い地球を背景に、手袋をはめた両手が種を包み込む。すると種は瞬時に、小さく輝く青い花冠へと開花する。花の結晶質の花びらへ素早くプッシュインして終わる。曲面の地球が、絶妙な細部まで反射して見える。冷たいシアンの地球光と脈動する琥珀色の非常照明が交互に照らし、深いネイビーの影、銅と金の機器、蛍光ブルーの生物発光、緻密な流体力学、弾性のある蔓の動き、自然な慣性、高密度で途切れのないアクション、強い被写体と衣装の一貫性、ドラマチックな物語のひねり、手作り感のあるプレミアムなレトロフューチャー・アニメーション長編映画品質、鮮明な映画的ディテール、 subtleなフィルムグレイン。音声:こもった宇宙服の呼吸音、金属製手すりの振動音、柔らかな衝突音、ガラスに当たって音を奏でる散らばった水滴、上昇するアナログシンセのパルス、そして reveal の瞬間に響く繊細な結晶の開花音。画面、ソフトウェアインターフェース、ダッシュボード、計器、プログレスバー、グラフ、キャプション、テキスト、ロゴ、透かしは一切含めない。16:9 aspect ratio。

Generated with Veo 3.1 Lite Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud

プロンプト

ひと続きの8–10秒のシームレスなシーケンスで展開する、フォトリアルなレトロ・スラップスティック・チェイス。嵐の夜、使い込まれた1950年代の理髪店の店内で、表情豊かな理髪師が客の顔を濃いシェービングフォームで覆った直後、客の靴が誤って真ちゅう製の床ペダルを踏み、クローム仕上げの理髪椅子が高速回転を始め、開いたドアから外へ転がり出す。鮮やかな赤いケープが背後ではためき続け、映像全体をつなぐ視覚的な目印となる。雨粒の付いた鏡に映る、完全に一貫した二人の反射を通り抜けるタイトなプッシュインから始める。機構がカチリと作動した瞬間に素早くパンし、続いて地面すれすれのトラッキングショットへ移行。がたつくキャスターの横を追いながら、椅子が敷居を越え、ネオンに染まった狭い路地へ疾走する。理髪師は歩調を崩さずその後を走り、片手には安全に掲げた straight razor、もう一方には湯気の立つタオルを持つ。水たまり、木箱、揺れる看板をかわしながら、あらゆる衝撃から雨が自然に跳ね、濡れた赤いケープが説得力のある重さと空気の流れでねじれる。雷光が走る中、回転する椅子の周囲を高速で旋回するショットへ移行。理髪師はたわんだ物干し綱をつかみ、路地を横切って振り子のように移動し、客の横で手を離す。椅子の回転に合わせ、あごに残ったフォームの最後の細い полоскаを正確に剃り落とす。顔、衣装、反射、プロップの位置、空間の連続性、雨、布、車輪、運動量の物理表現が一貫した、息をのむようなコミカルなフィニッシュ。店内の暖かなタングステン・アンバーの光が、シアンブルーの雨とマゼンタのネオンにぶつかる。映画的なワイドスクリーン構図、豊かな質感の時代考証に基づく美術設計、 subtleなフィルムグレイン、鮮明な動き、スローモーションなし、キャプションなし、テキストなし、インターフェースなし、グラフィックなし。同期音声:ペダルのガタンという音、加速する車輪のがたつき、最後の一 stroke にタイミングを合わせた razor の擦過音、タオルのはためき、跳ねる足音、ネオンのブーンという音、そして着地を際立たせる鋭い雷鳴。遊び心のあるブラスとスネアのチェイス音楽が最後のビートに向かって高まる。16:9 aspect ratio。

Generated with Veo 3.1 Lite Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud

Veo 3.1 Liteで動画制作をスケール

Veo 3.1 Liteは、プロンプト、静止画、ペアのキーフレームから音声同期付きの動画を生成します。ソーシャルキャンペーン、プロダクトビジュアル、ストーリープロトタイプ、大規模なコンテンツ制作に活用できます。

Veo 3.1 Liteソーシャルクリップ

テキストプロンプトから、音声同期付きの720pまたは1080p動画を生成します。ソーシャル投稿カレンダー、クリエイターキャンペーン、複数チャネルで効率的に大規模出力する必要があるコンテンツチーム向けに、繰り返し使える短尺動画アセットを作成できます。

キャンペーン向けバリエーション制作

text to video endpointを使って、修正したプロンプトから新しい動画を生成し、尺を柔軟に選択できます。マーケティングチームは、有料・オーガニックキャンペーン向けのコンセプトを選定する前に、複数のクリエイティブ方針を検討できます。

Veo 3.1 Liteプロダクトモーション

商品画像をアニメーション化し、音声同期付きの720pまたは1080p動画にします。提供された画像を出発点として保持しながら、EC商品ページ、ローンチページ、ビジュアルキャンペーン向けのモーションアセットを作成できます。

キーフレームトランジション設計

最初と最後のフレームを定義すると、モデルが音声付きのつなぎの動きを生成します。このワークフローはeight secondsの尺で、アニマティクス、シーン遷移、モーションスタディ、始点と終点を制御した絵コンテシーケンスに適しています。

Veo 3.1 Liteストーリープロトタイプ

書かれたシーンから始め、1つのワークフローで音声同期付きの動画を生成します。監督、デザイナー、クリエイティブ開発者は、制作にリソースを投入する前に、テンポ、雰囲気、ビジュアルの方向性を検証できます。

静止画コンテンツシリーズ

承認済みの静止画がすでにある場合は、テキストから始めるのではなく、それを動画にアニメーション化します。編集チームやコンテンツ制作者は、キャンペーンアート、イラスト、キービジュアルを、繰り返し使える動画アセットに展開できます。

Veo 3.1 Lite と主要動画 API の比較

入力方式、クリップ長、解像度、同期音声、標準的な秒単価で Veo 3.1 Lite と他の動画 API を比較します。

モデル入力方式出力時間解像度の選択肢同期音声標準価格
Veo 3.1 Lite テキストから動画へテキスト4、6、または8秒720p、1080p√$0.05/sec
Veo 3.1 Lite 始点・終点フレームから動画へテキスト、最初のフレーム、最後のフレーム4、6、または8秒720p、1080p√$0.05/sec
Veo 3.1 Lite 画像から動画へテキスト、画像4、6、または8秒720p、1080p√$0.05/sec
Seedance 2.0 Mini テキストから動画へテキスト4~15秒、または自動480p、720p、最大1440p-SR√$0.056/sec
Wan-3.0 テキストから動画へテキスト2~30秒、またはスマート尺480p、720p、1080p、ESRは最大4K√$0.05/sec
Kling V3.0 Turbo テキストから動画へテキスト3~15秒720p、1080p√$0.112/sec

Atlas Cloud で Veo 3.1 Lite を使う方法

数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。

Atlas Cloud アカウントを作成

atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。

Atlas CloudでVeo 3.1 Liteを使用する理由

高度なVeo 3.1 LiteモデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。

パフォーマンスと柔軟性

低レイテンシ:
リアルタイム推論のためのGPU最適化推論。

統合API:
1つの統合でVeo 3.1 Lite、GPT、Gemini、DeepSeekを実行。

透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。

エンタープライズとスケール

開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。

信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。

セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。

Veo 3.1 Lite APIに関する質問への回答

Veo 3.1 Liteは、コストを重視する大規模ワークフロー向けにGoogleが提供する、高効率な動画生成モデルです。テキストプロンプト、入力画像、または指定した開始・終了フレームから、音声と同期した動画を生成します。

プロンプトを使って生成するtext-to-video、静止画像を動画化するimage-to-video、2つのフレーム間の動きを指定するstart-end frame-to-videoから選択できます。Atlas Cloudでは、各ワークフロー専用のエンドポイントを提供しています。

Atlas Cloud APIキーを作成し、適切なmodel IDと必須入力を指定して、動画生成エンドポイントにPOSTリクエストを送信します。レスポンスにはprediction IDが含まれており、出力の準備が完了するまでポーリングできます。

はい。text-to-videoおよびimage-to-videoエンドポイントでは音声と同期した動画が生成され、start-end frameワークフローでは、指定したフレーム間に生成された動きに音声が追加されます。

検証済みの3つのエンドポイントはすべて、720pと1080pの出力に対応しています。このモデルファミリーでは4K生成には対応していません。

検証済みの標準基本料金は、Atlas Cloudの3つのエンドポイントすべてで1回あたり$0.05です。従量課金制であり、一時的なプロモーション料金ではなく標準料金です。

開始フレーム、終了フレーム、および両者の間で意図する動きを説明するプロンプトを指定します。検証済みのAtlas Cloudバックエンドプロファイルでは、音声付きで720pまたは1080pを出力する8秒のワークフローが定義されています。

Liteは、音声との同期や720p・1080p出力を維持しながら、スケーラブルな動画ワークロードにおける価格効率を優先しています。主な制限は、4K出力と動画Extensionに対応していないことです。

映像の基準となる要素が重要な場合は、テキストだけに頼らず、image-to-videoを使用するか、開始フレームと終了フレームの両方を指定してください。被写体の動き、カメラの挙動、シーンの変化、音声の手がかりを明確に記述し、リクエストにより具体的な制約を与えることが重要です。

まず、bearer認証、正確なmodel ID、必須のpromptまたはimageフィールド、対応する解像度設定を確認してください。predictionがfailedステータスになった場合は、ペイロードを変更したり別のリクエストを送信したりする前に、返されたエラーを確認してください。

さらにファミリーを探索

Seedance 2.5

Seedance 2.5 APIがAtlas Cloudで利用可能になりました!これにより、開発者はByteDanceの最新の動画モデルを利用できます。テキスト、単一の画像、または最大50のマルチモーダルな参照から、同期されたオーディオとフレーム内の多言語テキストを含む最大30秒のネイティブ動画をシングルパスで生成します。Atlas Cloudでは1つのキーでアクセスでき、被写体の一貫性と改善された物理演算により、ロングショットの整合性が保たれます。

ファミリーを表示

Wan 3.0

Wan 3.0 APIは、AlibabaのWanビデオファミリーの次世代モデルであり、長尺動画生成、マルチリファレンス制御、およびオーディオビジュアル品質を新たな高みへと押し上げるために構築されました。Atlas CloudはすでにWan 2.7、2.6、2.5をホストしており、Wan 3.0は追加のセットアップなしで同じ統合キーで実行されます。今日から開発を始めましょう。Wan 3.0で何を作成できるかを確認するには、下のショーケースまでスクロールしてください。

ファミリーを表示

MiniMax H3

MiniMax H3は、テキスト、画像、リファレンスによる生成に対応したMiniMaxのマルチモーダル動画ファミリーです。対応するルート全体で参照メディアの被写体を保持し、柔軟なアスペクト比を提供します。また、H3 Developerを通じて生成音声と映像を組み合わせ、出力プロファイルはエンドポイントごとに選択されます。Atlas Cloudは、1つのOpenAI互換キーのもとでこのファミリーを統合し、標準料金である1秒あたり$0.038からの明瞭な従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

Seedance 2.0

Seedance 2.0は、正確なショット作成に対応したByteDanceの本番向け動画モデルです。プロンプトから動画を生成したり、オプションの最終フレームガイダンスを使って先頭フレームの画像をアニメーション化したり、参照メディアとオプションのウェブ検索で結果を形作ったりできます。Atlas Cloudは、これらのワークフローを透明性の高い従量課金と1つのOpenAI互換キーで、統合されたAPIにまとめます。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2.5

OpenAIのgpt-image-2.5ファミリーでは、本番の画像ワークフロー向けにFlareとSunburstを選択できます。最大3840x2160までの任意の解像度でレンダリングし、xhighやmaxを含む5段階の品質ティアから、具体的な出力要件に合ったものを選択できます。Atlas Cloudでは、コールドスタートなしですぐに使えるREST推論を、生成1回あたり$0.004からの標準料金で提供しています。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Gemini Omni Flash

Gemini Omniは、Google DeepMindによるネイティブなマルチモーダル動画ファミリーです。プロンプトによる生成・編集に対応し、テキストからの生成、静止画のアニメーション化、任意のビジュアルリファレンスを使った既存映像の編集を、変更していない部分を保持しながら行えます。解像度、アスペクト比、動画の長さを柔軟に設定でき、さまざまな制作ワークフローに対応します。Atlas Cloudは、透明性の高い従量課金でアクセスを一元化します。今日から開発を始めましょう。

ファミリーを表示

Grok Imagine

Grok Imagine API は、Image 2.0 から Video 1.5 および xAI TTS v1 まで、xAI の画像、ビデオ、音声モデルをカバーしています。1K または 2K の静止画を 14 のアスペクト比でレンダリング、シーンを 15 秒の 1080p モーション映像に変換、最大 7 つの参照画像でショットを操作、または 20 言語でナレーション可能です。Atlas Cloud はすべてのモードを 1 つのエンドポイント上で実行でき、画像あたり $0.02、秒あたり $0.05 からの従量課金制です。今すぐビルドを開始してください。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索