2週間限定 | Seedream 5.0 Pro が20%OFF!
LTX-2 API for Synchronized Audio and Video

LTX-2 API for Synchronized Audio and Video

LTX-2 API は、Lightricks のオープンウェイト動画モデルファミリーを本番環境で利用できるようにし、動画と同期済み音声を 1 回のパスで生成します。テキストからプロンプトを入力する、静止画像をアニメーション化する、既存のクリップを延長するなど、どの結果にも一致したリップシンク、フォーリー、環境音が含まれます。Atlas Cloud では、1 つの OpenAI 互換キーで利用でき、透明性の高い従量課金と Day-0 アクセスが提供されます。今すぐ構築を始めましょう。

主要モデルを探索

Atlas Cloudは、業界をリードする最新のクリエイティブモデルを提供します。

Ltx-2 API エンドポイント比較:テキスト、画像、動画延長

プロンプトによる生成から静止画のアニメーション化、既存クリップの継続まで、任意の同期音声付きで、すべての Ltx-2 API モダリティを一覧で比較できます。

モダリティ説明
Ltx-2 T2V API(テキストから動画)最大 2,000 文字のテキストプロンプトを入力すると、Ltx-2 API が完全にレンダリングされた動画を返します。generate_audio を有効にすると、任意で同期音声も生成できます。クリップの長さは 25〜257 フレームまで調整でき、6 種類の解像度プリセットで正方形、縦向き 9:16、横向き 16:9 の出力に対応します。このエンドポイントは、文章による説明だけで作成する広告コンセプト、SNS 向けショート動画、ストーリーボードのプレビューに適しており、標準の基本料金は $0.002 です。
Ltx-2 I2V API(画像から動画)jpg、png、webp、gif、avif の静止画像をモーションプロンプトとともに指定すると、このエンドポイントが任意の音声生成付きで動きのあるクリップにアニメーション化します。同じく 25〜257 フレームの範囲と 6 種類のアスペクト比プリセットに対応しているため、1 枚のソースフレームから横向きまたは縦向きの動画を作成できます。商品写真、キャラクターポートレート、コンセプトアートが自然な入力として適しており、いずれも標準の基本料金は $0.002 です。
Ltx-2 Extend Video API既存クリップの尺を延ばす必要がある場合、このエンドポイントは指定された mp4、mov、webm、m4v、gif ソースから前方向または後方向に動画を継続します。シーケンスを最大 481 フレームまで拡張でき、match_input_fps によって元のテンポを維持し、生成音声を重ねることもできます。b-roll の延長、シーンのループ化、カット間のつなぎに活用でき、料金は同じく基本料金 $0.002 です。

Ltx-2 APIで音声と動画を同時に生成

Ltx-2 APIは、text、image、extendの生成モードにネイティブな同期音声、制御可能なフレーム数、6種類のアスペクト比プリセットを組み合わせ、透明性の高い従量課金で、1つのOpenAI互換キーからすべて利用できます。

Ltx-2 APIでテキストから完成シーンへ

最大2,000文字でシーンを記述すると、Ltx-2 APIが参照アセットなしで純粋なテキストを、動きと音のあるクリップに変換します。プロンプトで被写体、動き、ライティング、カメラワークを制御し、任意のseedで結果を固定して再現可能な反復ができます。すべてが言語から始まるため、アイデアはあるが素材がまだない段階のストーリーボード、コンセプト提案、迅速なクリエイティブ探索に適しています。

あらゆる静止画に命を吹き込む

jpg、png、webp、gif、avifのいずれかの静止画1枚を入力すると、モデルがそれを一致する音声付きの動画へアニメーション化します。ゆっくりしたプッシュインから本格的なアクションの一瞬まで、プロンプトでフレームの動き方を指定でき、元の構図は保たれます。フォトグラファー、デザイナー、プロダクトチームは、再撮影なしで1枚のヒーロー画像を共有しやすいモーションコンテンツに変えるために活用できます。

Ltx-2 APIでクリップをシームレスに延長

既存のクリップをアップロードすると、Ltx-2 APIが前方向または後方向に続きを生成し、元のスタイルとテンポを引き継ぐ追加フレームを最大481フレーム生成します。match_input_fpsオプションにより、新しい映像をソースのフレームレートに固定できるため、つなぎ目は目立ちません。短いテイクを長尺シーケンスに伸ばしたり、あと少し早く終わってしまったシーンを救済したりできます。

フレーム数とアスペクト比を自由に制御

textモードとimageモードでは、フレーム数を25から257フレームまで完全に制御でき、クリーンなサンプリングのため常に8の倍数+1で指定します。解像度プリセットは6種類あり、1024×1024の正方形HD、512の正方形、縦向き3:4、縦向き9:16、横向き4:3、横向き16:9をカバーするため、1つのモデルで映画、ソーシャル、縦型フィードに対応できます。まず形状を選び、1回のリクエストで適切なクロップを返します。

Ltx-2 APIで1つのキーと再現可能な実行

すべてのリクエストはAtlas Cloud上の1つのOpenAI互換キーを通じて処理され、透明性の高い従量課金で、サブスクリプションは不要です。同じプロンプトに固定seedを渡すと、モデルは同じクリップを返すため、予測しにくい生成を、制御可能でバージョン管理しやすいステップに変えられます。Day-0アクセスにより、新しいLtx-2 APIリリースは出荷された瞬間から呼び出せるため、チームはGPUを管理することなく動画パイプラインを標準化し、スケールできます。

1つのプロンプト、3つのエンジン:Ltx-2 APIを直接比較

まったく同じ1つのプロンプトをLtx-2 APIと、Atlas Cloudで特に人気の高い2つの動画モデルに送信し、同一の指示から各モデルがモーション、同期音声、映画的ディテールをどう表現するかを比較します。

プロンプト

好奇心旺盛なマカクザルが、ゴールデンアワーの混み合うマラケシュのスパイス市場を駆け抜け、露店から商人の鮮やかな赤いフェズ帽をひったくる。サフランやパプリカの開いた麻袋の上を跳ね回り、渦巻くオレンジ色の粉塵を巻き上げたあと、天幕の支柱の上でぴたりと止まり、笑いながら追いかけてくる商人を振り返ってのぞき見る。冒頭は群衆の中をサルの背後から縫うように進むローアングルのトラッキングショット、続いて驚いた商人の顔へホイップパンし、その後、屋台のはるか上空へ舞い上がる壮大なクレーンショットへ移行し、温かな光の中で粉塵がきらめく。リアルで映画的なスタイル、浅い被写界深度、深みのあるアースカラーのカラーグレーディング。音声:活気ある市場のざわめき、真鍮の触れ合う音、追跡に合わせて盛り上がるリズミカルなハンドドラムのパーカッション。アスペクト比 16:9。

Generated with Ltx 2.3 Quality on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

プロンプト

流れるような深紅のマントをまとった若い空中配達人が、浮遊する石造りの神殿の縁から飛び出し、機械仕掛けの折り鶴に乗って峡谷の雲間を駆け抜け、漂う光るランタンの間を縫うように進む。彼女はギザギザの岩の尖塔を急旋回でかわし、空中に浮かぶきらめく手紙をつかみ取ると、背後の霧を突き破ってライバルのグライダーが迫る中、身を縮めて急降下に入る。冒頭は折り鶴が発進する瞬間を彼女の肩越しの一人称POVで捉え、急降下に並走するドローンショットへカットし、その後、彼女が降下から引き起こしてまばゆい日差しへ飛び込むところを、下から見上げるローアングルショットで描く。鮮やかなアニメスタイル、セルシェーディング、魔法のようなマジックアワーの発光感あるパレット。音声:吹き抜ける風、紙の翼がはためく音、引き起こしのタイミングに合わせて高揚するオーケストラのストリングス。アスペクト比 16:9。

Generated with Ltx 2.3 Quality on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Ltx-2 APIで本番向けの動画と音声を提供

テキストや画像プロンプトから長尺カット、同期したサウンドまで、Ltx-2 APIはマーケティング、eコマース、クリエイティブ制作における初稿から4K納品までの全工程をカバーします。

Ltx-2 APIによるプロンプトからの動画生成

1つの文章プロンプトだけで、Ltx-2 APIはインライン生成された音声付きのネイティブ4K動画を出力できます。スタジオや広告チームは、カメラ撮影や手作業の編集なしで、キャンペーンブリーフを完成済みのソーシャル向けスポットに変換できます。

静止画を動きのある映像に変換

1枚の静止画をアップロードすると、image-to-video生成によって、元の構図を保ちながら自然なカメラワークを加えて動きのある映像にできます。eコマース事業者やイラストレーターは、静的なカタログやポートフォリオを、スクロール中の目を引くフィード向けコンテンツとして生き生きと見せられます。

クリップを長いシーンへ拡張

より長いテイクが必要ですか?extend-videoエンドポイントは、既存のクリップに新しいフレームを追加しながら、モーション、スタイル、音声の連続性を保ちます。クリエイターは短い生成結果をつなぎ合わせ、1回のリクエストを超えるシームレスな物語を作れます。

Ltx-2 APIによる同期サウンド

音が重要な場面では、Ltx-2 APIが映像と同時に、動きに同期した会話、フォーリー、環境音をワンパスで合成します。解説動画、トレーラー、タイミングどおりのサウンドが必要なシーンに適しています。

Ltx-2 APIからの4Kマスター

最終納品向けに、Ltx-2 APIはアップスケールされたプレビューではなく、滑らかな動きとシャープな質感を備えたネイティブ4Kフレームをレンダリングします。代理店やスタジオは、放送品質のマスターをエンドポイントから直接、編集パイプラインへ書き出せます。

バッチ生成を手頃なコストでスケール

LTX-2は効率的なオープンモデルであるため、大量のジョブを透明性の高い従量課金で実行でき、リクエストごとにパフォーマンスモードを切り替えられます。プロダクトチームは低コストでプロトタイプを作成し、リリース時には品質を高められます。

他の本番向け動画モデルと比較した Ltx-2 API

Atlas Cloud 上の同等のテキスト/画像駆動型動画モデルと Ltx-2 API を、生成モード、解像度、ネイティブ音声、クリップ長、開始価格の観点で比較します。

Model生成モード最大解像度同期音声最大クリップ長開始価格
LTX-2.3 Quality Text-to-Videoテキストから動画生成1024×1024 プリセット(16:9 がデフォルト)√(任意の切り替え)最大257フレーム$0.002
LTX-2.3 Quality Image-to-Video画像から動画生成、延長1024×1024 プリセット(16:9 がデフォルト)√(任意の切り替え)最大257フレーム$0.002
Seedance 2.0 Text-to-Videoテキストから動画生成最大2K√ ネイティブ4〜15 s$0.112
Veo 3.1 Text-to-Videoテキストから動画生成最大4K√ ネイティブ8 s(延長可能)$0.2
Kling Video O3 4K Text-to-Videoテキストおよび画像から動画生成ネイティブ4K(3840×2160)√ ネイティブ3〜15 s$0.42

Atlas Cloud で Ltx-2 を使う方法

数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。

Atlas Cloud アカウントを作成

atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。

Atlas CloudでLtx-2を使用する理由

高度なLtx-2モデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。

パフォーマンスと柔軟性

低レイテンシ:
リアルタイム推論のためのGPU最適化推論。

統合API:
1つの統合でLtx-2、GPT、Gemini、DeepSeekを実行。

透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。

エンタープライズとスケール

開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。

信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。

セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。

Ltx-2 API:開発者からよくある質問への回答

Ltx-2 APIは、Lightricksのオープンウェイト音声・動画基盤モデルであるLTX-2に、開発者がプログラムからアクセスできるAPIです。テキストまたは画像プロンプトを、1回の生成パスで同期された動画と音声に変換します。Atlas Cloudでは、従量課金制でOpenAI互換の単一エンドポイントから利用できます。

LTX-2はtext-to-video、image-to-video、clip extensionに対応しているため、文章で書いたシーンを動きのある映像にしたり、静止画像をアニメーション化したり、既存のショットを延長したりできます。どのモードでも付随する音声をレンダリングできるため、短編映画、広告、製品デモ、ソーシャル向けコンテンツに適しています。

はい。音声と動画は後からつなぎ合わせるのではなく、1回の同期されたパスで生成されます。会話のリップシンク、効果音、環境音まで対応します。Atlas Cloudではgenerate_audioパラメータで有効化でき、デフォルトではオフです。

LTX-2モデルはネイティブで最大4K解像度、最大50 fpsに対応し、24、25、48、50の各フレームレートで最長20秒のクリップを生成できます。Atlas Cloudのqualityエンドポイントでは、アスペクト比を選択し、25〜257フレームのフレーム数でクリップ長を設定できます。

プロンプト、ltx-2.3-quality/text-to-videoなどのモデル、アスペクト比、フレーム数、再現可能な出力のための任意のseedを指定して、Atlas Cloudエンドポイントに標準リクエストを送信します。このエンドポイントはOpenAI互換のため、1つのキーでLtx-2 APIとプラットフォーム上の他のすべてのモデルを利用でき、通常は数分で統合できます。

もちろんです。ltx-2.3-quality/extend-videoモデルは、既存のLTX-2クリップを延長し、元の長さを超えても動きと音声の一貫性を保ちます。1回の生成ではシーンに必要な尺に足りない場合に役立ちます。

LTX-2はオープンウェイトで提供されており、コンシューマー向けGPUでも動作するほど効率的なため、セルフホストも現実的な選択肢です。GPUのプロビジョニング、キュー管理、スケーリングを避けたい場合は、ホスト型APIで同じモデルを利用でき、インフラを保守する必要はありません。

Atlas Cloudでは、Ltx-2 APIを従量課金制で提供しており、呼び出しごとの透明な料金設定で、サブスクリプションや最低利用契約は不要です。生成した分だけ支払えばよく、同じキーで新しいモデルリリースにDay-0アクセスできます。今すぐ開発を始めましょう。

LTX-2.3はLTX-2ファミリーの現在のイテレーションであり、Atlas Cloudがquality text-to-video、image-to-video、extend-videoエンドポイントを通じて提供しているバージョンです。同期された音声・動画という同じアプローチを維持しながら初期リリースを改良しているため、モデルの呼び出し方法を変えずに最新の品質を利用できます。

さらにファミリーを探索

Seedance 2.0

Seedance 2.0 APIは、ByteDanceのマルチモーダルビデオモデルへのプロダクションアクセスを提供します。これには、クアッドモーダル入力(テキスト、画像、ビデオ、オーディオ)と、ショット間で構図、カメラワーク、キャラクターのアクションを固定する業界最高水準の「Universal Reference」システムが含まれます。1回のAPIコールでディレクターレベルの制御を統合でき、一律$0.09/秒、即時キー発行、順番待ちリストなしで利用可能です。これらはエンタープライズクラスの稼働率とコンプライアンスによって裏付けられています。Seedance 2.0 Native 4Kが提供開始されました!

ファミリーを表示

Grok Imagine

Grok Imagine API は、開発者に xAI の画像、動画、音声生成を1つのスイートで提供します。多言語テキストレンダリングを備えた最大 2K の画像に加え、ネイティブで同期された音声とリファレンスベースの編集を備えた最大15秒の動画を生成します。Atlas Cloud 上では、1つのキーで Grok Imagine のすべてのモードを実行できるため、個別の設定なしで画像、動画、音声の間を移行できます。料金は画像1枚あたり0.02ドル、1秒あたり0.05ドルからです。

ファミリーを表示

Gemini Omni Flash

Gemini Omni API は、Google I/O 2026 で発表された Google DeepMind のマルチモーダル動画生成・編集モデルを、あなたのスタックで利用可能にします。Gemini Omni は Gemini の推論エンジンと生成メディアを融合し、テキスト・画像・動画・音声を自由に組み合わせた入力から、一貫性があり知識に裏付けられた出力を生成します。自然な対話で結果を磨き上げましょう。オブジェクトの差し替え、シーンの書き換え、スタイルの変更を行っても、物理法則、キャラクター、連続性はそのまま保たれます。Atlas Cloud は、テキストからの動画生成、最大 7 枚の参照画像に対応した画像からの動画生成、そして参照ベースの動画生成という Gemini Omni Flash の全ラインアップを、単一の統合 API で提供します。料金は $0.112 からの秒単位の透明な従量課金で、サブスクリプションは不要です。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

Alibaba

Atlas Cloudは、Alibabaの全モデルラインナップを単一のAPIに統合します。言語および画像タスク用のQwen、最大1080pの動画生成用のWanが利用可能です。すべてのモデルはサブスクリプション不要の従量課金制(pay-as-you-go)でアクセスできます。Alibaba APIは、既存のOpenAI互換クライアントを使用し、単一のベースURLを介して利用可能です。

ファミリーを表示

OpenAI

Atlas Cloudは、画像生成用のGPT Image 2から動画用のSora 2まで、OpenAI APIの全ラインナップへのアクセスを提供します。すべてのモデルは、月額の固定コミットメントなしの従量課金制でご利用いただけます。OpenAI互換APIを使用し、ベースURLを一つ変更するだけで簡単に組み込むことができます。

ファミリーを表示

xAI

Atlas Cloud 上で xAI API を使用して、完全な画像および動画パイプラインを構築します。2K解像度での生成、参照画像を使用した編集、そして画像を音声同期クリップへとアニメーション化することが可能です。

ファミリーを表示

Kwaivgi

Kwaivgi APIを標準価格より15%オフで提供。Atlas Cloudは、新しいKlingリリースへのDay-0アクセスを、従量課金制(Pay-as-you-go)およびシート数無制限で提供します。1つのアカウント、1つのキーで、スタンダードからマスター階層まで、すべてのKlingモデルをご利用いただけます。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索