Kling O1 Powered by MVL

Kling O1 Powered by MVL

Kling O1は、マルチモーダル・ビジュアル言語技術で構築されたKuaishouの動画モデルファミリーです。テキストから動画、画像から動画へのワークフローにより、プロンプトやソース画像から言語コンテキストと視覚コンテキストを結び付け、シームレスなシーン展開を生成できます。Atlas Cloudでは、コールドスタートなしのすぐに利用できるREST APIを通じて両方のモードを提供し、透明性の高い従量課金制の料金体系を採用しています。今日から開発を始めましょう。

Kling o1 は Kuaishou が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。

Kling O1 シネマティック動画制作のモダリティ

プロジェクトに適した動画生成エンドポイントを選べるよう、Kling O1 のテキストおよび画像ワークフローを比較します。

モダリティ説明
Kling O1 T2V API (Text To Video)Kling O1 Text to Video endpoint を使用して、テキストプロンプトをシネマティックな動画に変換します。MVL テクノロジーにより、正確な意味理解、一貫した被写体表現、自然な物理シミュレーションを実現します。ストーリーのコンセプト作成、プロダクトナラティブ、テキストで演出するシーンに適しています。
Kling O1 I2V API (Image To Video)静止画を起点に、Kling O1 Image to Video endpoint が動きのあるシネマティックな動画を生成します。被写体の一貫性を保ちながら、自然な動き、物理シミュレーション、シームレスなシーン展開を加えます。画像アニメーション、ビジュアルストーリーテリング、シネマティックなシーン開発に適したワークフローです。

Kling O1 モーションエンジンの内部

Kling O1 は、被写体の一貫性、自然な物理表現、精密なプロンプト理解、最初と最後のフレーム制御、柔軟な 5 秒/10 秒の長さ設定、3 種類のアスペクト比、そして透明性の高い従量課金で利用できる Atlas Cloud REST アクセスを備え、text-to-video と image-to-video の生成を組み合わせます。

Kling O1 マルチモーダル生成

Kling O1 は、Atlas Cloud の専用 text-to-video/image-to-video エンドポイントを通じて、テキストプロンプトまたは入力画像からシネマティックな動画を生成します。MVL アーキテクチャが、言語入力と視覚入力の両方からシーンの意図を解釈します。基盤となるモデルファミリーを変更せず、開始アセットに合ったモードを選択できます。この柔軟性は、初期コンセプトからアニメーション化されたキャンペーン映像やストーリーショットへ展開するチームに適しています。

動きの中でも保たれるアイデンティティ

カメラが動き、シーンが展開しても、アクションの進行中に被写体の認識性を維持します。image-to-video 生成では入力画像の視覚的アイデンティティを動きへ引き継ぎ、text-to-video ではプロンプトから一貫性のあるキャラクターを構築します。被写体が安定することで、フレーム間の気になる変化を抑えられます。キャラクター主導のストーリー、プロダクトショット、映像の連続性が重要なシーケンスに活用できます。

自然な動きと物理表現

自然な物理シミュレーションにより、動きに重みや慣性が加わり、周囲のシーンとの説得力のある相互作用を実現します。Kling O1 は、人や物、環境要素を、後付けのようではなく互いに結び付いたダイナミクスでアニメーション化します。プロンプトでは、具体的な動作指示とカメラワークを組み合わせてください。動きの質が映像の完成度を左右するスポーツ、料理、自然、アクション映像に適しています。

Kling O1 フレーム制御

1 枚の画像から開始することも、任意の最後の画像を指定して動きの終点を定義することもできます。Atlas Cloud の image-to-video スキーマは 5 秒または 10 秒のクリップに対応しており、短いビートから長めのトランジションまで、明確なテンポ設計が可能です。モデルはプロンプトの指示に従い、視覚的な状態の間をつなぐ動きを合成します。プロダクトのお披露目、変形、短い物語展開に適した制御機能です。

プロンプトレベルの演出指示

精密な意味理解により、Kling O1 は詳細なプロンプトを被写体、アクション、シーンの動き、シネマティックなカメラワークへ変換します。16:9、9:16、1:1 の出力から構図を設定し、自然言語で動きや雰囲気を記述できます。複雑な演出指示も、手作業によるアニメーションではなく、構造化された生成リクエストとして扱えます。ソーシャル向けクリップ、絵コンテ、完成度の高いビジュアルコンセプトに役立ちます。

Atlas Cloud 上の Kling O1 API

Atlas Cloud の統合 REST API を通じて、text-to-video と image-to-video の両方の生成を組み込めます。Atlas Cloud はコールドスタートなしを掲げており、生成時間に応じて出力 1 秒あたり標準料金 $0.112 が課金されます。プロンプト、入力フレーム、時間、アスペクト比を構造化パラメータとして送信できます。これにより、開発者は予測しやすいコストで、本番の動画ワークフローへ直接統合できます。

Kling O1、3モデル・同一プロンプト対決

Kling O1、Seedance 2.0、Kling V3.0 Turboが、シネマティックなリアリズム、動きの連続性、物理的なインタラクション、スタイライズされたストーリーテリングにおいて、同じ2つのプロンプトをどのように解釈するかを見てみましょう。

プロンプト

日の出の混雑した花市場を、ゴールデンレトリバーが花束をくわえて駆け抜ける10秒間の写実的なシネマティック動画を作成してください。濡れた石畳の上を犬が疾走し、花びらをまき散らしながら動く荷車の間を縫う様子を、ローアングルのトラッキングショットで始めます。ホイップパンで、後ろから追いかける花売りへと視点を移し、その後、犬が倒れた籠を飛び越えて自然に着地する様子を周回撮影します。最後は犬が子どものそばで立ち止まり、花束を差し出し、笑いながら追いついた花売りが受け取る瞬間へ素早くプッシュインして終えます。暖かな逆光、リアルな毛並み、布や花びらの物理表現、途切れのない躍動的な動き、16:9のアスペクト比。

Generated with Kling Video O1 Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Text-to-Video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

プロンプト

月明かりに照らされたベーカリーで、小さなキツネのシェフが魔法のペイストリーを作る8秒間のスタイライズされたクレイ・ストップモーション動画を作成してください。キツネが生地を回し、ベリーを放り投げ、跳ね回る調理器具をかわす様子を、俯瞰のクレーンショットで始めます。ペイストリーがオーブンへ駆け込み、光り始める様子をカウンタートップのトラッキングビューで捉えます。キツネの周囲を素早く回り込みながら、オーブンが勢いよく開き、小さなペイストリー・ドラゴンが飛び出して、舞い漂う小麦粉の中を旋回し、シェフの帽子に着地する様子を描きます。手作り感のある粘土の質感、表情豊かな動き、遊び心のある青とアンバーのライティング、シームレスなアクションの連続性、16:9のアスペクト比。

Generated with Kling Video O1 Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Text-to-Video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Kling O1のモーション活用:6つの制作パス

プロンプト駆動のシネマティックなコンセプトから、動きのある商品ビジュアルまで、Kling O1は映像制作者、マーケター、コマースチーム、アプリ開発者に、テキストや静止画から一貫性のある物理演算対応の動画を制作するための実践的な道筋を提供します。

シネマティックなコンセプト映像

詳細なプロンプトを、意味を正確に理解し自然な物理法則に基づいたシネマティックなシーケンスへと変換します。映像制作者やプリビジュアライゼーションチームは、高コストな実写制作にリソースを投じる前に、ムード、アクション、カメラワークのアイデアを検討できます。

Kling O1による商品画像のアニメーション化

静止した商品画像にシームレスなシーンの動きを加えながら、被写体の特徴を維持します。コマースチームは、カタログ画像をローンチ、オンラインストア、キャンペーン用クリエイティブに活用できる洗練されたモーションアセットへと変換できます。

Kling O1によるソーシャルキャンペーンのバリエーション制作

文章で書かれたコンセプトから始め、自然な物理法則に従う動きのシネマティックな動画を生成します。ソーシャルチームは、告知、季節キャンペーン、迅速なチャネル別クリエイティブテストに向けて、新しいビジュアルの方向性を生み出せます。

ストーリーボードから動くシーンへ

物語性のあるプロンプトを、意味を正確に理解し、一貫性のある動くシーンへと変換します。監督、エージェンシー、ゲームスタジオは、初期のクリエイティブ開発や企画段階で、キャラクターの動き、環境の動き、シネマティックな雰囲気を可視化できます。

ポートレートに命を吹き込む

Kling O1のimage modeが被写体の一貫性を保ちながら、静止したポートレートに自然な動きを加えます。クリエイターは、既存のアートワークから表情豊かなプロフィール動画、キャラクター紹介、ビジュアルストーリーテリング用アセットを制作できます。

アクションコンセプトに自然な動きを加える

プロンプトが複雑な動きを描写すると、Kling O1は自然な物理シミュレーションと正確な意味理解を適用します。アクションデザイナーやコンセプトチームは、制作開始前に、説得力のある動きを備えたダイナミックなシーンをプレビューできます。

Kling O1と動画生成の代替モデルの比較

プロバイダー、生成モード、モデルID、標準カタログ価格に基づいて、Kling O1と他のAtlas Cloud動画モデルを比較します。

モデルプロバイダー生成モードAtlasモデルID掲載基本価格
Kling Video O1 Text-to-videoKuaishouテキストから動画kwaivgi/kling-video-o1/text-to-video$0.112、単位の記載なし
Kling Video O1 Image-to-videoKuaishou画像から動画kwaivgi/kling-video-o1/image-to-video$0.112、単位の記載なし
Seedance 2.0 Text-to-VideoByteDanceテキストから動画bytedance/seedance-2.0/text-to-video$0.112、単位の記載なし
Wan-2.7 Image-to-videoQwen画像から動画alibaba/wan-2.7/image-to-video$0.10、単位の記載なし
Veo 3.1 Lite Text-to-videoGoogleテキストから動画google/veo3.1-lite/text-to-video$0.05、単位の記載なし
MiniMax H3 Image-to-VideoMiniMax画像から動画minimax/h3/image-to-video$0.038/秒

Atlas Cloud で Kling o1 を使う方法

数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。

Atlas Cloud アカウントを作成

atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。

Atlas CloudでKling o1を使用する理由

高度なKling o1モデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。

パフォーマンスと柔軟性

低レイテンシ:
リアルタイム推論のためのGPU最適化推論。

統合API:
1つの統合でKling o1、GPT、Gemini、DeepSeekを実行。

透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。

エンタープライズとスケール

開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。

信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。

セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。

Kling O1 APIに関する質問と回答

Kling O1は、マルチモーダル・ビジュアル・ランゲージ技術を用いてKuaishouが開発した、統合型マルチモーダル動画モデルです。Atlas Cloudでは、検証済みのファミリーとしてtext-to-videoとimage-to-videoのエンドポイントが提供されています。意味的なプロンプト理解、被写体の一貫性、自然な物理シミュレーションに重点を置いています。

text-to-videoを使うと、文章によるシーンの指示を映画的なクリップに変換できます。また、image-to-videoモードでは、元画像に動きを加えられます。どちらのエンドポイントも、一貫した被写体、制御された動き、リアルなシーンの動態を活かしたワークフローに対応しています。

プロジェクトが文章によるシーン説明から始まる場合はtext-to-videoを選択してください。既存の画像を被写体や構図、または最初のフレームの基準として使用してから動きを加える場合は、image-to-videoを選択してください。

選択したモデルIDと入力値を指定し、認証済みのPOSTリクエストをhttps://api.atlascloud.ai/api/v1/model/generateVideoに送信します。kwaivgi/kling-video-o1/text-to-videoまたはkwaivgi/kling-video-o1/image-to-videoを使用し、返されたprediction IDで結果を取得してください。

text-to-videoでは、promptを指定し、ドキュメントに記載されたアスペクト比と長さの設定を使用します。image-to-videoではpromptとimageが必須で、last_imageは任意です。検証済みのアスペクト比は16:9、9:16、1:1で、長さは5秒または10秒に対応しています。

Atlas Cloudでは、検証済みの両動画エンドポイントに標準価格として1秒あたり$0.112が設定されています。料金は指定した出力時間に応じて変動するため、標準料金では10秒の生成に5秒の生成の2倍の費用がかかります。

生成は、prediction IDと処理ステータスを返すPOSTリクエストから始まります。タスクが完了または失敗するまで、https://api.atlascloud.ai/api/v1/model/prediction/{prediction_id}をポーリングしてください。成功時のレスポンスでは、生成された動画URLがoutputs配列に格納されます。

被写体の一貫性は、利用可能な両モードで文書化されている機能です。image-to-videoでは、元のフレームを基準にして視覚的なアイデンティティと構図を維持します。ただし、結果は入力の品質やプロンプトの複雑さによって変わる可能性があるため、明瞭な元画像と具体的な動きの指示を用意することをおすすめします。

このファミリーページで検証済みのAtlas Cloudエンドポイントには含まれていません。現在の選択肢はtext-to-videoとimage-to-videoのみです。そのため、Atlas Cloudが互換性のあるエンドポイントとスキーマを公開しない限り、Elements、reference video、編集用パラメータは送信しないでください。

さらにファミリーを探索

Seedance 2.5

Seedance 2.5 APIがAtlas Cloudで利用可能になりました!これにより、開発者はByteDanceの最新の動画モデルを利用できます。テキスト、単一の画像、または最大50のマルチモーダルな参照から、同期されたオーディオとフレーム内の多言語テキストを含む最大30秒のネイティブ動画をシングルパスで生成します。Atlas Cloudでは1つのキーでアクセスでき、被写体の一貫性と改善された物理演算により、ロングショットの整合性が保たれます。

ファミリーを表示

Wan 3.0

Wan 3.0 APIは、AlibabaのWanビデオファミリーの次世代モデルであり、長尺動画生成、マルチリファレンス制御、およびオーディオビジュアル品質を新たな高みへと押し上げるために構築されました。Atlas CloudはすでにWan 2.7、2.6、2.5をホストしており、Wan 3.0は追加のセットアップなしで同じ統合キーで実行されます。今日から開発を始めましょう。Wan 3.0で何を作成できるかを確認するには、下のショーケースまでスクロールしてください。

ファミリーを表示

MiniMax H3

MiniMax H3は、テキスト、画像、リファレンスによる生成に対応したMiniMaxのマルチモーダル動画ファミリーです。対応するルート全体で参照メディアの被写体を保持し、柔軟なアスペクト比を提供します。また、H3 Developerを通じて生成音声と映像を組み合わせ、出力プロファイルはエンドポイントごとに選択されます。Atlas Cloudは、1つのOpenAI互換キーのもとでこのファミリーを統合し、標準料金である1秒あたり$0.038からの明瞭な従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

Seedance 2.0

Seedance 2.0は、正確なショット作成に対応したByteDanceの本番向け動画モデルです。プロンプトから動画を生成したり、オプションの最終フレームガイダンスを使って先頭フレームの画像をアニメーション化したり、参照メディアとオプションのウェブ検索で結果を形作ったりできます。Atlas Cloudは、これらのワークフローを透明性の高い従量課金と1つのOpenAI互換キーで、統合されたAPIにまとめます。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2.5

OpenAIのgpt-image-2.5ファミリーでは、本番の画像ワークフロー向けにFlareとSunburstを選択できます。最大3840x2160までの任意の解像度でレンダリングし、xhighやmaxを含む5段階の品質ティアから、具体的な出力要件に合ったものを選択できます。Atlas Cloudでは、コールドスタートなしですぐに使えるREST推論を、生成1回あたり$0.004からの標準料金で提供しています。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Gemini Omni Flash

Gemini Omni APIは、Gemini Omni 1.1 Flashを含む、Google DeepMindのネイティブマルチモーダルなGemini Omni Flashファミリーを開発者に提供します。ネイティブ音声を同期したシネマティックな動画の作成、正確な開始フレームと終了フレームの制御による静止画のアニメーション化、または変更していない部分を保持したテキスト指示による既存映像の編集が可能です。Atlas Cloudは、OpenAI互換のキー1つで、統合されたアクセスと透明性の高い従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Grok Imagine

Grok Imagine API は、Image 2.0 から Video 1.5 および xAI TTS v1 まで、xAI の画像、ビデオ、音声モデルをカバーしています。1K または 2K の静止画を 14 のアスペクト比でレンダリング、シーンを 15 秒の 1080p モーション映像に変換、最大 7 つの参照画像でショットを操作、または 20 言語でナレーション可能です。Atlas Cloud はすべてのモードを 1 つのエンドポイント上で実行でき、画像あたり $0.02、秒あたり $0.05 からの従量課金制です。今すぐビルドを開始してください。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索