Kling 2.0 Refined Camera Realism

Kling 2.0 Refined Camera Realism

Kling 2.0は、テキストから動画、画像から動画を生成するためのKuaishouの動画生成モデルファミリーです。Masterモデルは、高忠実度のビジュアルに洗練されたライティングとカメラ表現のリアリティを組み合わせ、プロンプトやソース画像から完成度の高いクリップを作成するための、目的に特化した2つのワークフローを開発者に提供します。Atlas Cloudでは、1つのOpenAI互換キーで両モデルにアクセスでき、Day-0から利用可能です。シンプルに統合して、今すぐ開発を始められます。

Kling 2.0 は Kuaishou が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。

Kling 2.0の動画生成モダリティを比較

ソース素材と制作目標に合ったKling 2.0エンドポイントを選択してください。

モダリティ説明
Kling 2.0 I2V Master API (Image To Video)ソース画像を、洗練されたライティング、リアルなカメラ挙動、フレーム間で一貫性のあるキャラクター表現を備えたシネマティックな1080p動画に変換します。キャラクター重視の広告、ブランドシーン、ソース画像の内容を維持する必要があるビジュアルナラティブに適したエンドポイントです。
Kling 2.0 T2V Master API (Text To Video)テキストプロンプトを起点に、Kling 2.0 T2V Masterは高忠実度のビジュアルとリアルな人物の動きを備えたシネマティック動画を生成します。初期画像を用意せずに、コンセプト映像、物語性のあるシーケンス、プロモーションコンテンツ、動き主体のシーンを作成できます。

Kling 2.0のモーション、フレーミング、シネマティック制御

Kling 2.0は、シネマティックな1080p出力、安定したキャラクターモーション、テキストと画像による生成パス、制御可能な開始フレームと終了フレーム、柔軟なクリップ設定、そしてAtlas Cloud上で統一された従量課金APIアクセスを提供します。

Kling 2.0のシネマティック1080p

Kling 2.0は、両方のファミリーモデルで、洗練されたライティングとリアルなカメラ表現を備えたシネマティックな1080pクリップを生成します。精細なディテールと高忠実度の映像により、クローズアップ、ワイドショット、照明の変化を含むシーンでも品質を維持できます。プロダクトフィルム、ナラティブプレビュー、ブランドシーケンスにおいて、クリエイティブレビューや最終編集に適した完成度の高い、スクリーンレディな仕上がりが求められる場合に活用できます。

自然なモーションとキャラクターの安定性

自然な人間の動きにより、キャラクターに説得力のある重心、タイミング、身体の流れを与えられます。フレーム間の安定性によって、クリップ中に表情、ジェスチャー、衣服、カメラアングルが変化しても、同じ被写体として認識し続けることができます。振り付け、パフォーマンス、アクション主体のストーリーテリングでは、シーンの始まりから終わりまで信頼感を保つ映像の連続性を損なわずに、躍動的な動きを表現できます。

テキストと画像による生成パス

シーンをアイデアから始める場合はテキストプロンプトを、既存の構図を起点にモーションを加える場合は画像を入力します。Kling 2.0 Masterの両方のエンドポイントは、Atlas Cloud上で同じ動画生成ワークフローを共有します。この2つのアクセス方法により、開発者はオリジナルショットのプロトタイプ作成、キャンペーンアートのアニメーション化、生成モード間の切り替えを、周辺のプロダクト体験を再構築することなく行えます。

Kling 2.0の開始フレームと終了フレーム制御

必須の最初のフレームと、モーションの到達点を定義する任意の終了フレームを使って、Kling 2.0の画像アニメーションをガイドできます。画像エンドポイントでは、5秒または10秒の長さに加え、プロンプトによる指示の強さを調整する0から1のガイダンススケールを指定できます。制御されたトランジションは、リビール、変形、マッチカット、計画した最終構図を持つビジュアルシーケンスに適しています。

柔軟なクリップとフレーミング制御

テキストから生成したクリップを、16:9、9:16、1:1のアスペクト比でワイドスクリーン、縦型、正方形向けにフレーミングできます。5秒または10秒の長さを選択し、ネガティブプロンプトで不要な映像要素の生成を抑制できます。これらの制御により、コアモデルを変更することなく、さまざまな公開形式に対応するシネマティックプレビュー、ソーシャル投稿、コンパクトなプロダクトストーリーを、1つの生成パスで実用的に作成できます。

1つのAtlas Cloud APIで利用できるKling 2.0

透明性の高い従量課金で、1つのAtlas Cloud APIからテキストモデルと画像モデルにアクセスできます。各エンドポイントには、確認済みの標準基本価格$0.28が設定されており、非同期の予測処理はアプリケーションバックエンドやキューに入れたメディアワークフローに適しています。プロダクトでプロンプト主導の動画とリファレンス主導のアニメーションの両方が必要な場合も、別々のプロバイダー統合を用意せず、1つのAtlas Cloud APIキーで構築できます。

Kling 2.0 ベンチマーク:1つのプロンプト、3つの動画モデル

同じアクション主導のプロンプトを、主要な動画モデルがどのように解釈するかを比較します。カメラワークや物理的な連続性から、キャラクターの一貫性、映画的な構図までを検証します。

プロンプト

雑然とした深夜の職人の作業台を舞台にした、8–10秒の小さな月面着陸アドベンチャー。親指ほどの大きさの真鍮製ぜんまい宇宙飛行士が自分のキーをひねると、突然動き出し、傷のついた木の上を止まることなく走り出す。宇宙飛行士が定規のシーソーを踏み鳴らし、鋼鉄のビー玉を正確な連鎖反応へと弾き飛ばす様子を、極端なマクロの横追跡ショットで捉える。絵の具瓶が触れ合って揺れ、緑青の歯車が回転し、コバルトブルーの折り紙トラックが転がるビー玉のすぐ前で展開する。ビー玉と並走する宇宙飛行士を捉えながら、素早いパンで俯瞰へ移行する。宇宙飛行士は揺れる絵筆をつかみ、空中へ跳び越え、小さな警告用の赤いストライプが描かれたマッチ箱の宇宙船に着地する。加速する宇宙船の周囲をシームレスに旋回しながら、宇宙船が虫眼鏡の中を通り抜ける。リアルな屈折によって作業場が広大で冷たい青色の月面の地平線へと歪み、ガラスと金属の表面を反射が波打つ。宇宙船が輝く満月へ向かって離陸したように見えた直後、最後の種明かしのために急速にドリーアウトする。「月」は実際にはテーブルの端の上に吊り下げられた丸いデスクランプであり、小さな宇宙飛行士は空中を飛ぶマッチ箱の中から誇らしげに敬礼している。手触りのあるヴィンテージのストップモーションアニメーションと融合した、実物のミニチュアによる撮影。ミニチュアのスケール感を一貫させ、複雑な物理衝突、躍動感のある連続動作、精密なフォーカス送りを伴う制御された浅い被写界深度を表現する。暖かな琥珀色の作業灯と冷たい青色の月明かりを対比させ、木の色合い、銅緑色のパティーナ、コバルトブルー、控えめな警告用の赤を用いる。鮮明で同期したサウンドデザイン。ぜんまいの刻み音、小さな金属製の足音、定規が弾ける音、ビー玉のクリック音、ガラスの触れ合う音、歯車のかちゃつく音、紙の擦れる音、筆が空を切る音、マッチ箱エンジンの唸り、そしてランプの電気音で終わる遊び心のあるオーケストラのクレッシェンド。画面、ソフトウェアインターフェース、ダッシュボード、プログレスバー、グラフ、キャプション、字幕、ロゴ、説明テキストは一切表示しない。16:9のアスペクト比。

Generated with Kling Video O3 4K Text-to-Video on Atlas Cloud

Generated with Seedance 2.5 Text-to-Video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

プロンプト

夕暮れの巨大な屋外洗濯物干し場を舞台にした、鮮やかな9秒の実写映画風コメディ。レモンイエローの長靴を履いた少年が、転がる籐製の洗濯かごの上でバランスを取りながら、くちばしに真っ赤な靴下を1枚くわえて逃げるダチョウを追いかける。ガタガタと音を立てるかごの車輪の横を、地面すれすれに追跡するショットから始める。少年が腕を振り、よろめきながら前へ進む。巨大な白いシーツが風で膨らみ、半透明のアーチ状の通路を形作る列の中を駆け抜ける。布がレンズの前を何度も横切り、自然でシームレスなワイプとなる一方、少年の服装、顔、長靴、かご、そして同じダチョウを一貫して維持する。素早いパンでダチョウの弾むような、物理的に正確な歩みへ移り、続いて2人のキャラクターの周囲を高速で旋回する。2人は縫うように走り、身をかがめ、柔らかく吊るされた布にぶつかりながら、動きを途切れさせず追跡を続ける。ダチョウが突然、鋭く方向転換して密集した物干しロープへ突っ込む。色とりどりのシャツ、ドレス、タオルがドミノのように順番に裏返り、巻き上がる。それぞれの布の衝突が、ロープに沿ってリアルに伝播する。コミカルなクライマックスで、赤い靴下が上空へ跳ね上がり、ダチョウの頭にきれいに着地する。ダチョウと少年はまったく同じ瞬間に立ち止まり、驚きの沈黙の中で互いを見つめる。突然、高所からのクレーンショットに切り替わり、絡み合った物干しロープが色鮮やかな渦のように2人の周囲を螺旋状に取り巻いている様子を映し出す。高彩度の実物を使った映画的リアリズム。遊び心のあるフィジカルコメディ、半透明の布の輪郭を縁取る暖かなオレンジレッドの逆光、深みのあるティールグリーンの影、躍動する風、鮮明な繊維のディテール、自然なモーションブラー、一貫した解剖学的表現、連続したアクション、リアルな布の物理挙動とオクルージョンの連続性。同期した音声。ガタガタ鳴るかごの車輪、力強い長靴の足音、ダチョウの足音、シーツがはためく音、連続して押し寄せる布のはためき。その後、突然音楽が止まり、乾いたコミカルな鳴き声が1つ響く。スローモーションなし、静止した埋め草なし、字幕、キャプション、ロゴ、ウォーターマーク、画面、ソフトウェアインターフェース、ダッシュボード、プログレスバー、グラフ、図、説明テキストは一切表示しない。16:9のアスペクト比。

Generated with Kling Video O3 4K Text-to-Video on Atlas Cloud

Generated with Seedance 2.5 Text-to-Video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

クリエイティブパイプライン全体で活用するKling 2.0

キャンペーンのコンセプトやプロダクトビジュアルからキャラクター主導の物語まで、Kling 2.0はテキストプロンプトや静止画を、リアルな動き、洗練されたライティング、フレーム間で安定したキャラクター表現を備えたシネマティックな1080pクリップに変換します。

Kling 2.0でストーリーボードを作成

文章で描いたシーンのアイデアを、高精細なビジュアルとリアルな人物の動きを備えたシネマティックなクリップに変換します。監督やクリエイティブチームは、制作前に構図や演技、ビジュアルの方向性を確認できます。

プロダクトキャンペーンのモーション化

プロダクト画像を、洗練されたライティングとリアルなカメラワークを備えた1080pクリップにアニメーション化します。マーケティングチームは、すべてのコンセプトを撮影することなく、ローンチやランディングページ、広告キャンペーンに使える完成度の高いビジュアルアセットを制作できます。

Kling 2.0でソーシャルクリップを作成

プロンプトや静止画から、フレーム間で安定したキャラクター表現を維持しながら、シネマティックな1080p動画を作成します。ソーシャルチームは、継続的なコンテンツカレンダーに向けて、完成度の高い投稿やキャンペーンティザー、各プラットフォームに対応したビジュアルストーリーを制作できます。

キャラクター主導の物語表現

リアルな人物の動きとフレーム間の一貫性を備えた、キャラクター中心のシーケンスを構築します。映像制作者やアニメーター、ゲームチームは、物語開発の初期段階でドラマチックな展開や動きの選択、印象的なシネマティックシーンを検討できます。

Kling 2.0でプリビジュアライゼーション

制作に着手する前に、高精細なビジュアル、洗練されたライティング、リアルなカメラ挙動を通じてシーンのコンセプトを検証します。クリエイティブチームはビジュアルの方向性を比較し、意図した雰囲気や動き、構図をより明確に共有できます。

アニメーション付きエディトリアルビジュアル

静止画のアートワークや写真に動きを加え、洗練されたライティングを備えたシネマティックな1080pクリップに仕上げます。出版社やデザイナー、メディアチームは、デジタル特集やポートフォリオ、ブランド性のあるエディトリアルパッケージに添えるビジュアルを制作できます。

主要動画生成モデルとの比較:Kling 2.0

Kling 2.0のエンドポイントを、入力ワークフロー、クリップ長、ネイティブ音声、標準価格の観点からSeedance 2.0およびWan 2.7と比較します。

モデル入力ワークフロークリップ長ネイティブ音声標準価格
kling v2.0 i2v Master画像、終了フレーム(任意)5 or 10 sec-$0.28/sec
Kling v2.0 t2v Masterテキスト5 or 10 sec-$0.28/sec
Seedance 2.0 Text-to-Videoテキストプロンプト4 to 15 sec√$0.112/sec
Seedance 2.0 Image-to-Video最初のフレーム、最後のフレーム(任意)4 to 15 sec√$0.112/sec
Wan-2.7 Text-to-videoテキストによる指示2 to 15 sec√$0.10/sec

Atlas Cloud で Kling 2.0 を使う方法

数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。

Atlas Cloud アカウントを作成

atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。

Atlas CloudでKling 2.0を使用する理由

高度なKling 2.0モデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。

パフォーマンスと柔軟性

低レイテンシ:
リアルタイム推論のためのGPU最適化推論。

統合API:
1つの統合でKling 2.0、GPT、Gemini、DeepSeekを実行。

透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。

エンタープライズとスケール

開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。

信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。

セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。

Kling 2.0 APIに関する開発者向け質問

Kling 2.0は、Kuaishouが開発した動画生成モデルファミリーです。Atlas Cloudでは、テキストプロンプトまたはソース画像からシネマティックな動画を生成する専用のMasterエンドポイントを提供しています。

T2V Masterを使用すると、記述したシーンの説明をシネマティックな動画に変換できます。また、I2V Masterを選択すると、ソース画像をアニメーション化できます。このファミリーは高精細な映像とリアルな動きに重点を置いており、I2V Masterでは1080p出力、洗練されたライティング、リアルなカメラ表現、フレーム間でのキャラクターの安定性を実現します。

入力内容に応じてT2V MasterまたはI2V Masterエンドポイントを選択し、1つのAtlas Cloud APIキーを使ってリクエストを送信します。現在のリクエスト構造とサポートされている値については、選択したモデルのplaygroundスキーマに従ってください。

シーンが文章による説明から始まり、モデルに映像を構成させたい場合はT2V Masterを選択してください。被写体、構図、またはビジュアルアイデンティティの指針となるソース画像がすでにある場合は、I2V Masterを選択してください。

T2V Masterはテキストプロンプトから開始します。一方、I2V Masterは、意図する動作やカメラワークを説明する指示とソース画像を組み合わせます。利用可能な制御項目と受け付けられる値はエンドポイントごとに異なるため、実装前に対応するAtlas Cloudのplaygroundスキーマを確認してください。

はい。I2V Masterエンドポイントに関して確認済みのAtlas Cloudプロファイルでは、洗練されたライティング、リアルなカメラ動作、フレーム間で安定したキャラクター表現を備えた、シネマティックな1080pクリップが指定されています。

標準の基本料金は、T2V MasterとI2V Masterのいずれのエンドポイントでも$0.28です。Atlas Cloudは従量課金制を採用しているため、開発者はサブスクリプション契約なしで、適切なワークフローを選択できます。

要素が多すぎるシーンを簡素化し、動作を明確な順序で説明して、意図するカメラの動きを直接記述してください。image to videoリクエストでは、まず鮮明なソース画像を用意し、発生させたい動きに焦点を絞ってプロンプトを作成してください。

さらにファミリーを探索

Seedance 2.5

Seedance 2.5 APIがAtlas Cloudで利用可能になりました!これにより、開発者はByteDanceの最新の動画モデルを利用できます。テキスト、単一の画像、または最大50のマルチモーダルな参照から、同期されたオーディオとフレーム内の多言語テキストを含む最大30秒のネイティブ動画をシングルパスで生成します。Atlas Cloudでは1つのキーでアクセスでき、被写体の一貫性と改善された物理演算により、ロングショットの整合性が保たれます。

ファミリーを表示

Wan 3.0

Wan 3.0 APIは、AlibabaのWanビデオファミリーの次世代モデルであり、長尺動画生成、マルチリファレンス制御、およびオーディオビジュアル品質を新たな高みへと押し上げるために構築されました。Atlas CloudはすでにWan 2.7、2.6、2.5をホストしており、Wan 3.0は追加のセットアップなしで同じ統合キーで実行されます。今日から開発を始めましょう。Wan 3.0で何を作成できるかを確認するには、下のショーケースまでスクロールしてください。

ファミリーを表示

MiniMax H3

MiniMax H3は、テキスト、画像、リファレンスによる生成に対応したMiniMaxのマルチモーダル動画ファミリーです。対応するルート全体で参照メディアの被写体を保持し、柔軟なアスペクト比を提供します。また、H3 Developerを通じて生成音声と映像を組み合わせ、出力プロファイルはエンドポイントごとに選択されます。Atlas Cloudは、1つのOpenAI互換キーのもとでこのファミリーを統合し、標準料金である1秒あたり$0.038からの明瞭な従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

Seedance 2.0

Seedance 2.0は、正確なショット作成に対応したByteDanceの本番向け動画モデルです。プロンプトから動画を生成したり、オプションの最終フレームガイダンスを使って先頭フレームの画像をアニメーション化したり、参照メディアとオプションのウェブ検索で結果を形作ったりできます。Atlas Cloudは、これらのワークフローを透明性の高い従量課金と1つのOpenAI互換キーで、統合されたAPIにまとめます。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2.5

OpenAIのgpt-image-2.5ファミリーでは、本番の画像ワークフロー向けにFlareとSunburstを選択できます。最大3840x2160までの任意の解像度でレンダリングし、xhighやmaxを含む5段階の品質ティアから、具体的な出力要件に合ったものを選択できます。Atlas Cloudでは、コールドスタートなしですぐに使えるREST推論を、生成1回あたり$0.004からの標準料金で提供しています。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Gemini Omni Flash

Gemini Omni APIは、Gemini Omni 1.1 Flashを含む、Google DeepMindのネイティブマルチモーダルなGemini Omni Flashファミリーを開発者に提供します。ネイティブ音声を同期したシネマティックな動画の作成、正確な開始フレームと終了フレームの制御による静止画のアニメーション化、または変更していない部分を保持したテキスト指示による既存映像の編集が可能です。Atlas Cloudは、OpenAI互換のキー1つで、統合されたアクセスと透明性の高い従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Grok Imagine

Grok Imagine API は、Image 2.0 から Video 1.5 および xAI TTS v1 まで、xAI の画像、ビデオ、音声モデルをカバーしています。1K または 2K の静止画を 14 のアスペクト比でレンダリング、シーンを 15 秒の 1080p モーション映像に変換、最大 7 つの参照画像でショットを操作、または 20 言語でナレーション可能です。Atlas Cloud はすべてのモードを 1 つのエンドポイント上で実行でき、画像あたり $0.02、秒あたり $0.05 からの従量課金制です。今すぐビルドを開始してください。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索