Kling v2.6 Cinematic Video Creation

Kling v2.6 Cinematic Video Creation

Kling v2.6は、シネマティックなテキストから動画および画像から動画の生成、AIアバター、参照ベースのモーション転送に対応した、Kuaishouの動画モデルファミリーです。柔軟なアスペクト比、強化された動き、安定したアイデンティティ、各種ワークフローにおける時間的一貫性をサポートします。Atlas Cloudでは、一貫したエンドポイントを通じてProとStandardのオプションを提供し、透明性の高い従量課金制を採用しています。今すぐ開発を始めましょう。

Kling 2.6 は Kuaishou が開発したモデルです。Atlas Cloud(運営:Atlas Cloud AI LLC)は本モデルへのアクセスを提供するものであり、その所有者ではありません。すべての商標は各所有者に帰属します。

主要モデルを探索(6)

Kling v2.6 動画生成エンドポイントの比較

各 Kling v2.6 エンドポイントを、対応する入力ワークフロー、制作上の強み、想定される動画の用途に照らして比較します。

モダリティ説明
Kling v2.6 Pro Avatar API (Avatar To Video)高品質なアバター生成向けに設計されたこのエンドポイントは、細部まで鮮明で、動きが安定し、アイデンティティの一貫性に優れた動画を生成します。洗練されたプロフィール動画、自己紹介、ソーシャルコンテンツに適しています。
Kling v2.6 Std Avatar API (Avatar To Video)AIアバター動画を、鮮明なディテール、シネマティックな動き、安定したプロンプト追従性で作成するには、Standard Avatar エンドポイントを使用します。プロフィール、短い自己紹介、継続的なソーシャルメディア制作に適した機能を備えています。
Kling v2.6 Pro Motion Control API (Reference Motion To Video)ダンス、アクション、ジェスチャーなどの参照モーションをキャラクター画像や元動画に転送しながら、アイデンティティと時間的一貫性を維持します。記録された特定の動きに沿った、滑らかなキャラクターアニメーションの生成に使用できます。
Kling v2.6 Std Motion Control API (Image And Motion To Video)ダンス、アクション、ジェスチャーを含むモーションクリップを指定して、静止したキャラクター画像をアニメーション化します。エンドポイントが動きを抽出し、手軽なモーション転送ワークフロー向けに、滑らかでリアルな動画を生成します。
Kling v2.6 Pro API (Text To Video)この Kuaishou モデルでは、テキストプロンプトから、生成音声と柔軟なアスペクト比に対応したシネマティックな動画を作成できます。コンセプト開発、ナラティブシーン、広告、その他のプロンプト駆動型動画プロジェクトに対応します。
Kling v2.6 Pro API (Image To Video)画像を起点に、音声生成と強化された動きを備えたシネマティックな動画を作成します。映像の連続性を細かく制御したい場合に、商品ビジュアル、イラスト、クリエイティブな静止画に生命を吹き込めます。

Kling v2.6:サウンド、モーション、アイデンティティを横断

Kling v2.6 は、ネイティブな音声・映像生成、テキストおよび画像ワークフロー、参照ベースのモーション制御、音声駆動アバター、柔軟なパラメータ、Standard と Pro エンドポイント全体での従量課金アクセスを組み合わせています。

Kling v2.6 ネイティブ音声・映像生成

Kling v2.6 Pro は、テキストプロンプトまたはソース画像から、動画とサウンドを同時に生成できます。サウンドスイッチは、Atlas Cloud の text to video および image to video エンドポイントでデフォルト有効です。そのため、シーンの展開に合わせて会話、効果音、環境音を組み込めます。別途サウンド編集を行わずに一貫した音声・映像結果が必要な短編ナラティブクリップに適しています。

テキストおよび画像生成パス

Pro 生成エンドポイントでは、文章でシーンを指定することも、静止画像をアニメーション化することもできます。テキストプロンプトは 1:1、9:16、16:9 の出力に対応し、どちらのパスでも 5 秒または 10 秒の長さ、サウンドの切り替え、ネガティブプロンプト、0 から 1 までの CFG 制御を利用できます。画像入力は最大 10 MB の JPG、JPEG、PNG ファイルに対応しており、ソーシャル、プロダクト、シネマティック向けアセットを実用的に制御できます。

Kling v2.6 Motion Transfer Control

キャラクター画像と参照モーションクリップを Kling v2.6 Motion Control に入力すると、アイデンティティと時間的一貫性を維持しながら、全身のダンス、アクション、ジェスチャーのシーケンスを転送できます。参照動画は 3 秒から 30 秒まで指定できます。構図を画像に合わせるかモーション動画に合わせるかを選択し、ソース音声を保持するかどうかも決められます。連続したパフォーマンス、キャラクターアニメーション、アクション重視のキャンペーンに適しています。

音声駆動アバター動画

Standard および Pro Avatar エンドポイントでは、画像と音声トラックが必須入力で、任意のプロンプトによって結果を誘導できます。Pro は精細なディテール、安定したモーション、強いアイデンティティ一貫性を重視し、Standard はシネマティックなモーションと安定したプロンプト遵守を両立します。プロフィール動画、ブランド紹介、継続的なソーシャルコンテンツなど、認識可能な人物に用意した音声を話させたい場合に適しています。

従量課金によるモデル選択

ワークロードに応じて Standard または Pro エンドポイントを選択し、Atlas Cloud 経由で実行した呼び出し分だけを支払えます。Standard Avatar は 1 回あたり $0.056、Standard Motion Control は $0.07、Pro Text to Video および Image to Video は $0.07、Pro Avatar または Motion Control は $0.112 から利用できます。1 つのアカウントですべての 6 エンドポイントを利用できるため、サブスクリプション契約なしで、映像品質、モーション要件、制作コストのバランスを調整できます。

Kling v2.6にフォーカス:1つのプロンプト、3つの動画モデル

Kling v2.6とAtlas Cloudの2つの代替モデルが、同一のプロンプトをリアルなアクションとスタイライズされた物語表現でどのように解釈するかをご覧ください。

プロンプト

正午の広大な白い塩湖を舞台にした、8–10秒のハイパーリアルなファッション広告映像。虹色に輝く鏡面ケープをまとった6人の高速スケーターが、精密な幾何学的フォーメーションの「凧式塩採取チーム」を組み、それぞれが巨大なマンタ型凧につながった、コバルトブルーと蛍光オレンジの張り詰めたラインを引いている。同期した隊形が塩の地殻に鋭利なパターンを刻む様子を、垂直俯瞰のドローンショットで始める。ドローンは突然急降下し、地面から数インチの高さで水平飛行に移り、先頭を追って加速する。チームははためく旗門の間をスラロームし、ケープがはためき、ロープがリアルな張力でしなる。突然、彼らの脇につむじ風が巻き起こり、緩い塩の結晶を空中へ螺旋状に巻き上げた瞬間、素早い360度の旋回ショットへ急パンする。6人のライダーは完全に一体となって反応し、ラインを鋭く巻き取り、マンタ型凧はドラマチックなパワーダイブへ折りたたまれる。凧は結晶の渦を突き抜け、きらめく塩を疾走するチームの上にまばゆい雪のようにまき散らす。冒頭から最後まで途切れない協調アクション、すべてのショットで一貫した人物の同一性と隊形、説得力のある滑走の運動量、物理的に正確なロープの張力、空気力学に沿った布の動き、粒状の塩粒子、風の乱流、地面に落ちた自然な影。強烈な真上からの日差し、鮮明で高コントラストのトップライト、鏡面ケープと塩の表面に広がるプリズム状の虹色の反射、雪のような白、コバルトブルー、蛍光オレンジを重ねた構成、プレミアムでシュールなハイファッション広告の美学、切れ味の鋭い映画的ディテール、滑走の軌跡とカメラのトランジションすべてに同期する躍動的なパーカッション、疾走する風、刃が擦れる音、布がはためく音、ロープが締まる音、そしてフィナーレの明るく結晶のようなヒスノイズ。スローモーションなし、静的な埋め草ショットなし、空間的連続性を壊すカットなし、変形した身体なし、人物の重複なし、絡まったロープや接続の切れたロープなし、一貫性のない衣装なし、浮遊する物体なし、画面なし、ソフトウェアインターフェースなし、ダッシュボードなし、プログレスバーなし、グラフなし、キャプションなし、ロゴなし、透かしなし、読めるテキストなし。16:9のアスペクト比。

Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud

プロンプト

腐朽した難破船の大きく傾いた舞踏室内部で繰り広げられる、8–10秒の途切れない映画的な深海チェイス。割れたシャンデリアのクリスタル越しにきらめく半透明のミミックオクトパスの触手が、光る「真珠」をつかむ極端なマクロショットから始める。素早いドリーズームで後退し、オクトパスが腐食した手すりから、ひっくり返ったダイニングテーブルの上へぶら下がっている様子を映し出す。同時に、ウツボが椅子の間を縫ってオクトパスを追跡し、カトラリー、ガラス片、堆積物、泡の連なりが、説得力のある水中物理に従って上昇し衝突する。オクトパスがベルベットのカーテン、くすんだ真鍮、フジツボに覆われた木材に合わせて皮膚の質感と透明度を絶えず変化させる様子を、タイトな360度の旋回チェイスショットへつなぐ。続いて濃密な墨の雲を噴き出し、それが説得力のあるタコ形の囮へと渦巻く。ウツボが偽のシルエットに襲いかかる間に、本物のオクトパスはその脇をすり抜ける。急パンしながらカメラをロールさせ、劇的に傾いた俯瞰ショットへ移行する。盗まれた「真珠」が突然小さな目を開き、琥珀色の光が強まる。そして宴会用テーブルの下から、巨大なカモフラージュ柄のアンコウの顔が現れる――その真珠はアンコウの誘引器官だった。アンコウがカメラに向かって飛びかかる中、オクトパスはコミカルな一瞬だけ硬直する。フォトリアルな深海の映画的リアリズム、冷たいシアンの環境光と暖かな琥珀色の生物発光のコントラスト、ボリューム感のある水、漂う粒子、高密度で柔らかな触手の動き、流体シミュレーション、浮遊物同士の衝突、シームレスな被写体の連続性、物理的に説得力のある運動量、明瞭で読み取りやすいアクション、スローモーションなし。没入感のある同期音響:くぐもった船体の軋み、クリスタルの触れ合う音、押し寄せる泡、ウツボの噛みつく音、脈打つチェイス用パーカッション、湿ったインクの噴出音、そして正体が明らかになる瞬間の突然の低音。画面なし、インターフェースなし、ダッシュボードなし、プログレスバーなし、グラフなし、キャプションなし、字幕なし、ロゴなし、透かしなし、説明テキストなし。16:9のアスペクト比。

Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Text-to-Video on Atlas Cloud

Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud

Kling v2.6:ストーリー、キャラクター、モーションを横断

映画的なプロンプトやアニメーション広告用スチルから、一貫性のあるアバターやモーションで導くパフォーマンスまで、Kling v2.6は映画、広告、ソーシャルコンテンツ、ブランドキャラクターを制作する開発者を支援します。

Kling v2.6によるシネマティックなコンセプト

Kling v2.6 Pro Text to Videoを使い、柔軟なアスペクト比と生成音声に対応して、文章で書かれたコンセプトをシネマティックな動画に変換します。映画制作者は、1つのプロンプトから予告編、ドラマチックな展開、ビジュアルピッチのプロトタイプを作成できます。

アニメーションによる製品キャンペーン

製品画像やキャンペーン用スチルに命を吹き込み、強化された動きの表現力、シネマティックな品質、生成音声を加えます。マーケティングチームは、既存のアートワークからローンチティーザー、ビジュアルデモ、ソーシャルプロモーションを作成できます。

Kling v2.6 Avatarによるプレゼンター

Pro Avatarモデルを通じて、ディテールが明瞭で動きが安定し、アイデンティティの一貫性に優れた洗練されたアバター動画を作成します。プロフィール紹介、プレゼンターセグメント、継続的に登場するブランドのソーシャルパーソナリティに活用できます。

参照ベースの振り付け

キャラクター画像にダンス、アクション、ジェスチャーの映像をマッピングし、アイデンティティと時間的一貫性を維持します。クリエイターは、録画した動きから振り付けのテスト、アニメーションマスコット、パフォーマンス中心のソーシャルクリップを制作できます。

Kling v2.6によるキャラクターの再キャスティング

Pro Motion Controlを使い、キャラクター画像やソース動画に参照クリップの動きを付与します。制作チームは、別の演者候補、スタイライズされたアクションシーケンス、キャラクターの一貫したアニメーションを試せます。

ソーシャル動画パイプラインの自動化

テキストプロンプトから始め、柔軟なアスペクト比で音声付きのシネマティック動画を生成します。開発者は、開始画像を用意せずに、短いキャンペーンコンセプト、クリエイターコンテンツ、プラットフォーム固有のビジュアルを自動化できます。

Kling v2.6と実運用向け動画APIの比較

プロバイダー、クリップ長、ネイティブ音声、標準ベース価格の観点から、Kling v2.6を主要なテキストから動画を生成するモデルと比較します。

モデルプロバイダー出力時間ネイティブ音声標準ベース価格
Kling v2.6 Pro Text-to-VideoKuaishou5秒または10秒√$0.07/秒
Seedance 2.0 Text-to-VideoByteDance4〜15秒√$0.112/秒
Wan-2.7 Text-to-videoQwen2〜15秒√$0.10/秒
Veo 3.1 Lite Text-to-videoGoogle4秒、6秒、または8秒√$0.05/秒

Atlas Cloud で Kling 2.6 を使う方法

数分で始められます — 以下の簡単なステップに従って、Atlas Cloud プラットフォームでモデルを統合・デプロイしましょう。

Atlas Cloud アカウントを作成

atlascloud.ai でサインアップし、認証を完了します。新規ユーザーには無料クレジットが付与され、プラットフォームの探索やモデルのテストに使用できます。

Atlas CloudでKling 2.6を使用する理由

高度なKling 2.6モデルとAtlas CloudのGPU加速プラットフォームを組み合わせることで、比類のないパフォーマンス、スケーラビリティ、開発者エクスペリエンスを提供。

パフォーマンスと柔軟性

低レイテンシ:
リアルタイム推論のためのGPU最適化推論。

統合API:
1つの統合でKling 2.6、GPT、Gemini、DeepSeekを実行。

透明な料金:
サーバーレスオプション付きの予測可能なtoken単位の課金。

エンタープライズとスケール

開発者エクスペリエンス:
SDK、分析、ファインチューニングツール、テンプレート。

信頼性:
99.99%の稼働率、RBAC、コンプライアンス対応ロギング。

セキュリティとコンプライアンス:
SOC 2 Type II、HIPAA準拠、米国内のデータ主権。

Kling v2.6 開発者向け API 質問集

Kling v2.6 は、Atlas Cloud で利用できる Kuaishou の AI 動画モデルファミリーです。Pro Text-to-Video と Image-to-Video による生成に加え、アバターとモーション制御向けの Standard および Pro エンドポイントが含まれます。

プロンプトから動画を作成したり、元画像をアニメーション化したり、画像と音声からアバター動画を生成したり、参照クリップからダンス、アクション、ジェスチャーの動きを転送したりできます。Pro Text-to-Video と Image-to-Video エンドポイントでは、映像と同時に音声も生成できます。

プロンプトから開始する場合は Text-to-Video、静止画をアニメーション化する場合は Image-to-Video を選択します。Avatar エンドポイントでは画像と音声を組み合わせ、Motion Control では参照動画の動きをキャラクターに適用します。

Atlas Cloud API キー、正確なモデル ID、エンドポイント固有の入力値を指定して、`/api/v1/model/generateVideo` に POST リクエストを送信します。非同期レスポンスには prediction ID が含まれるため、タスクが完了するまで `/api/v1/model/prediction/{id}` でステータスを確認できます。

制御項目はエンドポイントによって異なります。Text-to-Video では、プロンプト、ネガティブプロンプト、1:1・9:16・16:9 のアスペクト比、5 秒または 10 秒の動画長、サウンド、guidance scale に対応しています。一方、その他のワークフローでは、必要に応じて画像、音声、モーション動画、向き、サウンド保持などの入力を追加できます。

Pro Text-to-Video と Image-to-Video では、`sound` パラメーターによって映像と同時に音声を生成するかどうかを制御します。Avatar モデルではキャラクター画像とともに音声入力が必要です。一方、Motion Control では参照動画の元の音声を保持できます。

Atlas Cloud の標準料金は、Pro Text-to-Video、Pro Image-to-Video、Standard Motion Control が 1 秒あたり $0.07 です。Standard Avatar は 1 秒あたり $0.056、Pro Avatar と Pro Motion Control は 1 秒あたり $0.112 です。これらはキャンペーン価格ではなく、通常料金に基づいています。

JPG、JPEG、または PNG 形式のキャラクター画像と、MP4 または MOV 形式のモーション動画を用意します。各ファイルは 10 MB 以下で、縦横の両方が 300 ピクセル以上、アスペクト比が 1:2.5 から 2.5:1 の範囲内である必要があります。

まず、モデル ID、Bearer 認証、必須フィールド、エンドポイント固有のメディア制約を確認してください。タスクが受け付けられている場合は、prediction ID を使って完了または失敗するまでポーリングし、返されたエラーを確認します。映像に一貫性がない場合は、シーンを簡略化し、明瞭な元メディアを使用してください。特に、顔の動きや複雑なオブジェクトとのインタラクションを転送する場合に有効です。

さらにファミリーを探索

Seedance 2.5

Seedance 2.5 APIがAtlas Cloudで利用可能になりました!これにより、開発者はByteDanceの最新の動画モデルを利用できます。テキスト、単一の画像、または最大50のマルチモーダルな参照から、同期されたオーディオとフレーム内の多言語テキストを含む最大30秒のネイティブ動画をシングルパスで生成します。Atlas Cloudでは1つのキーでアクセスでき、被写体の一貫性と改善された物理演算により、ロングショットの整合性が保たれます。

ファミリーを表示

Wan 3.0

Wan 3.0 APIは、AlibabaのWanビデオファミリーの次世代モデルであり、長尺動画生成、マルチリファレンス制御、およびオーディオビジュアル品質を新たな高みへと押し上げるために構築されました。Atlas CloudはすでにWan 2.7、2.6、2.5をホストしており、Wan 3.0は追加のセットアップなしで同じ統合キーで実行されます。今日から開発を始めましょう。Wan 3.0で何を作成できるかを確認するには、下のショーケースまでスクロールしてください。

ファミリーを表示

MiniMax H3

MiniMax H3は、テキスト、画像、リファレンスによる生成に対応したMiniMaxのマルチモーダル動画ファミリーです。対応するルート全体で参照メディアの被写体を保持し、柔軟なアスペクト比を提供します。また、H3 Developerを通じて生成音声と映像を組み合わせ、出力プロファイルはエンドポイントごとに選択されます。Atlas Cloudは、1つのOpenAI互換キーのもとでこのファミリーを統合し、標準料金である1秒あたり$0.038からの明瞭な従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Seedream 5.0 Pro

Seedream 5.0 Pro API は、開発者に Atlas Cloud 上で ByteDance の制御可能な画像編集モデルを提供します。アンカーと座標を使用して編集を正確に配置し、画像を編集可能なレイヤーに分離し、複数の参照を融合し、正確な色と素材を一致させ、2K および 3K での多言語テキストをサポートします。Atlas Cloud では、単一のキーでアクセスできます!

ファミリーを表示

Seedance 2.0

Seedance 2.0は、正確なショット作成に対応したByteDanceの本番向け動画モデルです。プロンプトから動画を生成したり、オプションの最終フレームガイダンスを使って先頭フレームの画像をアニメーション化したり、参照メディアとオプションのウェブ検索で結果を形作ったりできます。Atlas Cloudは、これらのワークフローを透明性の高い従量課金と1つのOpenAI互換キーで、統合されたAPIにまとめます。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2.5

OpenAIのgpt-image-2.5ファミリーでは、本番の画像ワークフロー向けにFlareとSunburstを選択できます。最大3840x2160までの任意の解像度でレンダリングし、xhighやmaxを含む5段階の品質ティアから、具体的な出力要件に合ったものを選択できます。Atlas Cloudでは、コールドスタートなしですぐに使えるREST推論を、生成1回あたり$0.004からの標準料金で提供しています。今すぐ開発を始めましょう。

ファミリーを表示

GPT Image 2

GPT Image 2 API は、GPT Image 1.5 の後継となる OpenAI の最新画像モデルへのアクセスを開発者に提供します。ラテン文字およびCJKスクリプト全体で正確なテキストレンダリングを使用して画像を生成および編集できるほか、ポスター、モックアップ、インフォグラフィック向けの強力なコンポジション(構図)機能を備えています。Atlas Cloud では、300以上のモデルと並んで1つの統合 API を通じてアクセスでき、無料クレジット、99.99% のアップタイムが提供され、OpenAI の組織検証は不要です。

ファミリーを表示

Gemini Omni Flash

Gemini Omni APIは、Gemini Omni 1.1 Flashを含む、Google DeepMindのネイティブマルチモーダルなGemini Omni Flashファミリーを開発者に提供します。ネイティブ音声を同期したシネマティックな動画の作成、正確な開始フレームと終了フレームの制御による静止画のアニメーション化、または変更していない部分を保持したテキスト指示による既存映像の編集が可能です。Atlas Cloudは、OpenAI互換のキー1つで、統合されたアクセスと透明性の高い従量課金制を提供します。今すぐ開発を始めましょう。

ファミリーを表示

Grok Imagine

Grok Imagine API は、Image 2.0 から Video 1.5 および xAI TTS v1 まで、xAI の画像、ビデオ、音声モデルをカバーしています。1K または 2K の静止画を 14 のアスペクト比でレンダリング、シーンを 15 秒の 1080p モーション映像に変換、最大 7 つの参照画像でショットを操作、または 20 言語でナレーション可能です。Atlas Cloud はすべてのモードを 1 つのエンドポイント上で実行でき、画像あたり $0.02、秒あたり $0.05 からの従量課金制です。今すぐビルドを開始してください。

ファミリーを表示

Google

Googleの最も強力なクリエイティブモデルはすべてAtlas Cloudで利用可能です。Veo 3.1はシネマティックな動画生成を実現し、Nano Banana 2は高忠実度な画像作成を強化し、Geminiはあらゆるワークフローにマルチモーダルなインテリジェンスをもたらします。Day-0の可用性と従量課金制(pay-as-you-go)の料金体系を備えた単一のAPI keyを通じて、Googleモデルスイート全体にアクセスできます。

ファミリーを表示

Seedance 2.0 Mini

Seedance 2.0 Mini は、速度とコストが最も重視されるワークフローに ByteDance のマルチモーダル動画生成をもたらします。より軽量なフットプリントで Seedance 2.0 のコア機能を提供し、より高速な生成、動画あたりのコスト削減、そしてすでに使用しているものと同じ API 統合を実現します。大容量のパイプラインを運用したり、大規模なプロトタイピングを行ったりするチームにとって、Mini は実用的なデフォルトの選択肢です。

ファミリーを表示

ByteDance

シネマティックな動画生成から高忠実度の画像作成まで、ByteDanceの最も強力なモデルがAtlas Cloudで利用可能になりました。最低水準の推論価格とゼロのインフラストラクチャオーバーヘッドで、SeedanceとSeedreamを大規模に実行できます。

ファミリーを表示

ひとつのAPIで、あらゆるメディアAIを。

すべてのモデルを探索