Kling 1.6 Multi-Image Subject Consistency

Kling 1.6 Multi-Image Subject Consistency

Kling 1.6は、プロンプトや参照画像から一貫性のある短編動画を生成するよう設計された、Kuaishouの動画生成モデルです。動き、時間的なアクション、カメラワークへの応答性を高めるとともに、被写体の一貫性、色の正確さ、照明の変化、詳細な描画品質を向上させています。Atlas Cloudでは、1つのOpenAI互換キーと透明性の高い従量課金で、このモデルファミリーを利用できます。今すぐ開発を始めましょう。

Kling 1.6 は Kuaishou が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。

ビデオモダリティ別 Kling 1.6 エンドポイント比較

各 Kling 1.6 エンドポイントがテキストまたは画像入力をどのように処理し、モーション、整合性、ディテール、効率性における検証済みの強みをどの用途に活かせるかを確認できます。

モダリティ説明
Kling 1.6 Multi I2V Pro API (Multi Image To Video)画像から、複数の被写体を含む動画を生成します。整合性が向上し、高精度なモーショントラッキングに対応しています。被写体の動きの連携や映像の一貫性が重要な複雑なシーンに適した Pro エンドポイントです。
Kling 1.6 Multi I2V Standard API (Multi Image To Video)複数の被写体を低コストで生成するためのエンドポイントです。速度とディテールのバランスを取りながら、画像を動画に変換します。基本的なシーンアニメーションや、複数の被写体を含む定型的なコンテンツ制作に適しています。
Kling 1.6 T2V Standard API (Text To Video)テキストプロンプトを、安定したモーションと信頼性の高いプロンプト整合性を備えた短編動画に変換します。コンセプトの可視化、ソーシャルコンテンツ、シンプルなプロンプト駆動シーケンスに適したエントリーレベルのエンドポイントです。
Kling 1.6 I2V Pro API (Image To Video)静止画像を起点に、より滑らかなモーション補間と向上したテクスチャのリアリティを備えた動画を生成します。洗練されたプロダクトビジュアル、キャラクターショット、映画的な画像アニメーションに適しています。
Kling 1.6 I2V Standard API (Image To Video)軽量なこのエンドポイントを使用すると、基本的な生成ワークフローで画像を動画に変換できます。低コスト設計のため、シンプルなアニメーション、初期段階のクリエイティブ検証、大量コンテンツの制作に適しています。

プロンプトからモーションへ、Kling 1.6を直接利用

Kling 1.6は、テキスト、単一画像、最大4枚の画像参照ワークフローを組み合わせ、5秒または10秒の出力、プロンプト準拠度の調整、任意のネガティブプロンプト、選択可能なアスペクト比を提供します。StandardまたはProに、1つのAtlas Cloud APIからアクセスできます。

テキストまたは画像からKling 1.6を生成

Kling 1.6は、専用バリアントによるテキストから動画、画像から動画への生成に対応しています。文章でシーンを指定するか、元画像をアニメーション化し、最大2,500文字のプロンプトで動きを指示できます。Standardモデルはコスト効率を重視し、Proの画像バリアントは、より滑らかなモーションブレンドとリアルなテクスチャを重視します。この幅広い選択肢は、コンセプト検証、ソーシャル向けクリップ、完成度の高いビジュアルシーケンスに適しています。

4枚の参照画像

Multi I2V StandardまたはProバリアントでは、1~4枚の参照画像をアップロードできます。モデルはそれらをビジュアル参照として使用し、プロンプトで被写体、動き、シーンの展開を指定します。Proは、複数の被写体の一貫性を高め、動きをより正確に追跡できるよう調整されています。キャラクター同士のやり取り、複数商品の組み合わせ、さまざまな視覚要素をまとめたシーンに適しています。

最初と最後のフレームを制御

I2V Proバリアントでは、開始位置と終了位置を形作るために、最初の画像と任意の終了画像を設定できます。各画像はJPG、JPEG、PNGに対応し、サイズは最大10 MB、解像度は300×300ピクセル以上です。2つのビジュアルアンカーの間にモーション指示を追加できます。計画的なトランジション、ポーズ変更、商品 revealに特に役立つ制御機能です。

方向性を持たせたKling 1.6のモーション

Proの画像バリアントは滑らかな動きを重視しており、Atlas Cloudのプロファイルには、強化されたブレンディングと改善されたテクスチャのリアリズムが記録されています。0~1のガイダンススケールでプロンプトへの準拠度を調整でき、ネガティブプロンプトによって不要な要素を抑えられます。これらの制御機能を使って、自然な動きと綿密に指示したアクションのバランスを調整できます。キャラクター、布地、カメラの動きが求められる用途に適した組み合わせです。

用途に合う長さとフォーマット

Kling 1.6ファミリーでは、5秒または10秒の出力を選択できます。テキストおよび複数画像バリアントでは、16:9、9:16、1:1のアスペクト比にも対応しているため、ワイドスクリーン、縦型、正方形の配置を1つのワークフローで対象にできます。プロンプトは最大2,500文字まで入力でき、被写体、アクション、照明、カメラの指示を十分に盛り込めます。モデルファミリーを変更せずに、プラットフォームごとのアセットを計画できます。

1つのAPIで利用できるKling 1.6のティア

一覧にあるKling 1.6のすべてのバリアントを、従量課金の1つのAtlas Cloud動画生成APIから実行できます。Standardバリアントの確認済みの元の基本価格は1回あたり$0.056、Proバリアントは1回あたり$0.098です。必要なコスト、ディテール、モーション品質のバランスに合わせてティアを選択できます。この構成により、個別のプロバイダー連携を用意せずに、迅速な実験から本番パイプラインまで対応できます。

Kling 1.6、1つのプロンプトで比較:3つの動画モデル

Kling 1.6と2つの代替動画モデルが、リアルなアクションとスタイライズされたストーリーテリングにおいて、同一のプロンプトをどのように解釈するかを比較します。

プロンプト

真夜中のガラス工房を舞台にした、映画的な8~10秒のミニチュア実写シーケンス。若い職人がブローパイプを絶えず回転させる中、白熱したガラスの気泡が急速に膨張し、その完璧な球形が画面構成の中心となる。回転する溶融ガラスの周囲を超マクロで周回するショットから始め、引き伸ばされる透明な琥珀色のフィラメント、粘性による表面張力、揺らめく陽炎、細かな火花、リアルな内部屈折を捉える。膨らんだ気泡が突然パイプから滑り落ち、銀灰色の金属テーブルに当たって勢いよく転がる。テーブルの高さまでカメラを落とし、気泡に並走する高速トラッキングショットへ移行する。気泡は揺れ、変形し、発光する糸状のガラスを散らしながら、炉のオレンジ色の光を背景にコバルトブルーの月光を反射する。素早いパンで、慌てた職人が作業台を横切って身を乗り出し、逃げるガラスを最後の瞬間に濡れた木製パドルで受け止める様子を映す。爆発的なシューッという音とともに、物理的に正確な蒸気が画面内を渦巻く。蒸気が晴れると、ガラスが小さく透明なフグへと奇跡的に凍結変形していることが明らかになる。繊細なガラスのヒレと一貫した内部気泡を備えたフグは、頬を一度だけ愛らしく膨らませ、遊び心のある最後の一拍を生む。シームレスで連続した動き、首尾一貫した被写体変形、リアルなガラスの粘性、衝突、熱の発光、火花、屈折、コースティクス、熱による歪み、蒸気の物理挙動。琥珀色、コバルトブルー、銀灰色を重ねたカラーパレット。炉のオレンジ色のキーライト、冷たい月光ブルーのリムライト、浅い被写界深度、触感のあるハイエンドな実物ミニチュア撮影、フォトリアルな映画的テクスチャ。スローモーション、静止した埋め草、画面、ソフトウェアインターフェース、ダッシュボード、プログレスバー、チャート、キャプション、テキスト、ロゴ、透かしは一切なし。同期音声:轟音を立てる炉、回転するパイプの擦過音、鋭い金属音、転がるガラスの rattling 音、切迫した足音、大きく湿ったシューッという音、続いて小さく結晶のようなパフ音。緊張感のあるパーカッシブなリズムが、遊び心のあるガラスチャイムで終わる。16:9のアスペクト比。

Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud

Generated with Seedance 2.0 Image-to-Video on Atlas Cloud

Generated with Kling v1.6 i2v Standard on Atlas Cloud

プロンプト

深夜営業の香港の麺店、その狭い裏キッチンを舞台にした緊張感のある9秒のマイクロストーリー。若い料理人がラーメンの注文を必死に救おうとし、正確で説得力のある手の振り付けを伴って、途切れることなく動き続ける。小麦粉の散ったまな板の上をかすめる、極端に低いアングルの横方向トラッキングショットから始める。料理人が手首を鋭く返し、長い麺の束を高く空中へ放り上げる。濃い蒸気の中でねじれる麺を追い、一本一本の麺がしなり、伸び、自然に料理人の手や吊り下げられた調理器具を遮る様子を映す。素早いパンでコンロ脇のタイトなアングルへ移行し、麺の束が舐めるように燃えるガス火へ落ちかける。最後の瞬間、料理人が前へ身を乗り出してワイヤースキマーで麺をきれいに受け止める。メッシュが重みでしなり、続いて一連の滑らかな動きで身体を返し、麺を激しく沸騰するスープへ投入する。リアルな水滴、気泡、油の波紋が鍋の中に広がる。すぐに真上からのオーバーヘッドショットへ切り替え、麺がスープの中で整った花開く螺旋状にほどけていく様子を映す。配膳口の向こうでは、待っていた客たちが身を乗り出し、喜びに沸いて拍手を始める。料理人は息を切らしながら笑顔を見せる。すべてのカットを通じて、同じ料理人、服装、調理器具、麺の束、キッチンの位置関係、動きの連続性を厳密に維持する。料理人、麺、炎、鍋、手前の調理器具を常に連携させる、奥行きのあるタイトなステージング。空中に舞う小麦粉、濡れたタイルの反射、きらめく油、結露、立ち上がる蒸気による触感豊かなレイヤー。フォトリアルな香港映画の美学、手持ち撮影による躍動感、鮮明で自然なモーションブラー。暖かなタングステンオレンジの実用照明と、冷たいシアン色のセラミックタイルが対比し、豊かなコントラスト、控えめな35mmフィルムグレイン、リアルな肌と料理の質感を備える。同期音声:包丁とまな板の打音、ガス火の轟音、勢いよく流れる蒸気、スキマーの金属音、沸騰するスープの水音、続いて鋭い拍手の爆発。会話はなく、速いパーカッシブなキッチンリズム。スローモーション、凍りついたポーズ、空虚な導入ショット、モンタージュによる空白、ぎこちない連続性、余分な指、崩れた手、重複した手足、壊れた調理器具、クリッピング、瞬間移動する麺、ゴムのような動き、不可能な液体挙動、宙に浮く物体、UI、画面、ダッシュボード、プログレスバー、チャート、キャプション、字幕、ロゴ、視認可能なテキストは一切なし。16:9のアスペクト比。

Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud

Generated with Seedance 2.0 Image-to-Video on Atlas Cloud

Generated with Kling v1.6 i2v Standard on Atlas Cloud

Kling 1.6でアイデアを動きに変える

Kling 1.6は、プロンプトと元画像から、ストーリーボード、製品キャンペーン、複数被写体のシーン、アニメーション作品、SNS向けバリエーション、キャラクターの物語に活用できる短編動画のコンセプトを作成します。

Kling 1.6によるストーリーボードのプロトタイプ

文章で書かれたコンセプトを、安定した動きと高いプロンプト整合性を備えた短編動画の下書きに変換します。監督、代理店、製品チームは、本制作に入る前にテンポ、アクション、ビジュアルの方向性を確認できます。

Kling 1.6で製品に動きを加える

製品の静止画に、より滑らかなモーションブレンディングとリアルな質感を加えます。マーケティングチームは、新たな撮影を手配することなく、カタログ画像から洗練されたローンチ動画、機能紹介、キャンペーン素材を作成できます。

複数被写体によるブランドストーリー

別々の画像に含まれる被写体を組み合わせながら、より高いシーンの一貫性を保ち、動きを正確に追跡します。ブランドコンテンツやSNSキャンペーン向けに、キャラクター同士の交流、複数人のシーン、ライフスタイルの物語を大規模に構築できます。

イラストレーションのアニメーション化

Proのimage-to-videoバリアントが備える、より滑らかなモーションブレンディングと向上した質感のリアリティで、静止画の作品に動きを加えます。アーティストやゲームチームは、既存のビジュアルからアニメーションコンセプト、キャラクターの演出、雰囲気のあるシーンスタディを作成できます。

Kling 1.6によるSNS動画のバリエーション

プロンプトまたは元画像から始めて、安定した動きや滑らかにブレンドされた動きを持つ短編動画のコンセプトを作成します。クリエイターは、SNS向けに複数の導入、ビジュアル表現、キャンペーンの方向性を展開できます。

キャラクターのインタラクションクリップ

複数の被写体を1つのシーンに登場させる必要がある場合、Multiバリアントは一貫性と高度なモーショントラッキングを優先します。画像をもとに、キャラクター同士の組み合わせ、ペットとの交流、グループシーン、物語の検証に活用できます。

Kling 1.6 モデルと競合製品の比較

Atlas Cloudで利用できる他の動画モデルとKling 1.6の各バリエーションを、入力ワークフロー、クリップ長、ネイティブ音声、標準価格の観点から比較します。

モデル入力ワークフロー出力時間ネイティブ音声標準価格
Kling v1.6 Multi i2v Proプロンプト + 1〜4枚の画像5秒または10秒-$0.098/run
Kling v1.6 Multi i2v Standardプロンプト + 1〜4枚の画像5秒または10秒-$0.056/run
Kling v1.6 t2v Standardテキストプロンプト5秒または10秒-$0.056/run
Kling v1.6 i2v Proプロンプト + 開始フレーム + 任意の終了フレーム5秒または10秒-$0.098/run
Kling v1.6 i2v Standardプロンプト + 開始フレーム5秒または10秒-$0.056/run
Wan-3.0 Image-to-videoプロンプト + 開始フレーム + 任意の終了フレーム2〜30秒√$0.05/second
MiniMax H3 Image-to-Videoプロンプト + 開始フレーム + 任意の終了フレーム4〜15秒√$0.038/second

Atlas Cloud で Kling 1.6 を使う方法

数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。

Atlas Cloud アカウントを作成

atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。

Atlas CloudでKling 1.6を使用する理由

高度なKling 1.6モデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。

パフォーマンスと柔軟性

低レイテンシ:
リアルタイム推論のためのGPU最適化推論。

統合API:
1つの統合でKling 1.6、GPT、Gemini、DeepSeekを実行。

透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。

エンタープライズとスケール

開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。

信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。

セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。

Kling 1.6 APIに関する開発者向け質問

Kling 1.6は、快手(Kuaishou)が開発した動画生成モデルファミリーです。Atlas Cloudでは、5つのStandardおよびProエンドポイントを通じて、テキストから動画、単一画像から動画、複数画像から動画に対応しています。各バリアントは、安定した動き、プロンプトとの整合性、より滑らかなモーションブレンディング、リアルなテクスチャ、複数の被写体の一貫性を提供します。

テキストプロンプトからオリジナルの動画シーンを生成したり、1枚の開始画像をアニメーション化したり、複数の参照画像を組み合わせて複数の被写体を含む構図を作成したりできます。エンドポイントによって、5秒または10秒のクリップを生成できます。

テキストベースの生成にはT2V Standard、1枚の画像からコスト効率よくアニメーションを生成するにはI2V Standardを選択してください。I2V Proは、より滑らかなモーションブレンディングと、よりリアルなテクスチャを重視します。複数の被写体や参照画像を扱う場合は、コストと一貫性に関する要件に応じてMulti I2V StandardまたはMulti I2V Proを選択してください。

Atlas CloudダッシュボードでAPIキーを作成し、Bearerトークンを使用してPOST /api/v1/model/generateVideoにJSONリクエストを送信します。正確なモデル識別子、プロンプト、画像ベースのエンドポイントで必要な画像を指定してください。返されたprediction IDを保存し、それを使って非同期処理の結果を取得します。

すべてのエンドポイントで、モデル識別子と最大2,500文字のプロンプトが必要です。テキストから動画ではアスペクト比、duration、guidance scale、negative promptに対応しています。一方、単一画像エンドポイントでは、開始画像としてJPG、JPEG、またはPNGが必要です。複数画像エンドポイントでは、1~4枚の参照画像を指定でき、duration、アスペクト比、negative promptも設定できます。

Atlas Cloudの5つのエンドポイントはすべて、5秒または10秒の生成に対応しており、ドキュメント上のデフォルトは5秒です。テキストから動画および複数画像エンドポイントでは、16:9、9:16、または1:1を指定できます。単一画像ワークフローでは、同じアスペクト比パラメータを指定する代わりに、入力したソース画像からフレーミングが決まります。

標準の公開価格では、T2V Standard、I2V Standard、Multi I2V Standardの各エンドポイントは、生成した動画1秒あたり$0.056です。I2V ProとMulti I2V Proは、生成した動画1秒あたり$0.098で、従量課金制です。

まず、Bearerトークン、正確なモデル識別子、必須のプロンプト、必要な画像フィールドを確認してください。無効なリクエストを再送信する前に、ドキュメントに記載されたプロンプトの長さ、画像形式、ファイルサイズ、解像度、duration、各パラメータの範囲を確認します。生成は非同期で行われるため、prediction IDを保持し、ステータスがprocessingの間は結果エンドポイントへの問い合わせを続けてください。

さらにファミリーを探索

Seedance 2.5

Seedance 2.5 APIがAtlas Cloudで利用可能になりました!これにより、開発者はByteDanceの最新の動画モデルを利用できます。テキスト、単一の画像、または最大50のマルチモーダルな参照から、同期されたオーディオとフレーム内の多言語テキストを含む最大30秒のネイティブ動画をシングルパスで生成します。Atlas Cloudでは1つのキーでアクセスでき、被写体の一貫性と改善された物理演算により、ロングショットの整合性が保たれます。

ファミリーを表示

Wan 3.0

Wan 3.0 APIは、AlibabaのWanビデオファミリーの次世代モデルであり、長尺動画生成、マルチリファレンス制御、およびオーディオビジュアル品質を新たな高みへと押し上げるために構築されました。Atlas CloudはすでにWan 2.7、2.6、2.5をホストしており、Wan 3.0は追加のセットアップなしで同じ統合キーで実行されます。今日から開発を始めましょう。Wan 3.0で何を作成できるかを確認するには、下のショーケースまでスクロールしてください。

ファミリーを表示

MiniMax H3

MiniMax H3は、テキスト、画像、リファレンスによる生成に対応したMiniMaxのマルチモーダル動画ファミリーです。対応するルート全体で参照メディアの被写体を保持し、柔軟なアスペクト比を提供します。また、H3 Developerを通じて生成音声と映像を組み合わせ、出力プロファイルはエンドポイントごとに選択されます。Atlas Cloudは、1つのOpenAI互換キーのもとでこのファミリーを統合し、標準料金である1秒あたり$0.038からの明瞭な従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

Seedance 2.0

Seedance 2.0は、正確なショット作成に対応したByteDanceの本番向け動画モデルです。プロンプトから動画を生成したり、オプションの最終フレームガイダンスを使って先頭フレームの画像をアニメーション化したり、参照メディアとオプションのウェブ検索で結果を形作ったりできます。Atlas Cloudは、これらのワークフローを透明性の高い従量課金と1つのOpenAI互換キーで、統合されたAPIにまとめます。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2.5

OpenAIのgpt-image-2.5ファミリーでは、本番の画像ワークフロー向けにFlareとSunburstを選択できます。最大3840x2160までの任意の解像度でレンダリングし、xhighやmaxを含む5段階の品質ティアから、具体的な出力要件に合ったものを選択できます。Atlas Cloudでは、コールドスタートなしですぐに使えるREST推論を、生成1回あたり$0.004からの標準料金で提供しています。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Gemini Omni Flash

Gemini Omni APIは、Gemini Omni 1.1 Flashを含む、Google DeepMindのネイティブマルチモーダルなGemini Omni Flashファミリーを開発者に提供します。ネイティブ音声を同期したシネマティックな動画の作成、正確な開始フレームと終了フレームの制御による静止画のアニメーション化、または変更していない部分を保持したテキスト指示による既存映像の編集が可能です。Atlas Cloudは、OpenAI互換のキー1つで、統合されたアクセスと透明性の高い従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Grok Imagine

Grok Imagine API は、Image 2.0 から Video 1.5 および xAI TTS v1 まで、xAI の画像、ビデオ、音声モデルをカバーしています。1K または 2K の静止画を 14 のアスペクト比でレンダリング、シーンを 15 秒の 1080p モーション映像に変換、最大 7 つの参照画像でショットを操作、または 20 言語でナレーション可能です。Atlas Cloud はすべてのモードを 1 つのエンドポイント上で実行でき、画像あたり $0.02、秒あたり $0.05 からの従量課金制です。今すぐビルドを開始してください。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索