
Kling v2.6 est la famille de modèles vidéo de Kuaishou dédiée à la création cinématographique de vidéos à partir de texte et d’images, aux avatars IA et au transfert de mouvement guidé par des références. Elle prend en charge des formats d’image flexibles, une dynamique améliorée, une identité stable et une cohérence temporelle dans des flux de travail spécialisés. Atlas Cloud propose des options Pro et Standard via des endpoints cohérents, avec une tarification transparente à l’usage. Commencez à développer dès aujourd’hui.
Kling 2.6 est développé par Kuaishou. Atlas Cloud (exploité par Atlas Cloud AI LLC) en fournit l’accès mais n’en est pas propriétaire. Toutes les marques appartiennent à leurs détenteurs respectifs.
Associez chaque endpoint Kling v2.6 à son workflow d’entrée pris en charge, à ses atouts en production et à ses cas d’utilisation vidéo prévus.
| Modalité | Description |
|---|---|
| Kling v2.6 Pro Avatar API (Avatar To Video) | Conçu pour la génération d’avatars haut de gamme, cet endpoint produit des vidéos de grande qualité avec des détails nets, des mouvements stables et une forte cohérence d’identité. Il convient aux vidéos de profil soignées, aux présentations et aux contenus pour les réseaux sociaux. |
| Kling v2.6 Std Avatar API (Avatar To Video) | Choisissez l’endpoint Standard Avatar pour créer des vidéos d’avatars IA aux détails nets, aux mouvements cinématographiques et au respect fiable des prompts. Ses capacités conviennent aux profils, aux courtes présentations et à la production récurrente de contenus pour les réseaux sociaux. |
| Kling v2.6 Pro Motion Control API (Reference Motion To Video) | Les clips de mouvements de référence transfèrent une danse, une action ou des gestes à une image de personnage ou à une vidéo source, tout en préservant l’identité et la cohérence temporelle. Utilisez-le pour créer des animations fluides de personnages qui suivent des mouvements enregistrés spécifiques. |
| Kling v2.6 Std Motion Control API (Image And Motion To Video) | Animez une image fixe de personnage en fournissant un clip de mouvement contenant une danse, une action ou un geste. L’endpoint extrait ce mouvement et génère une vidéo fluide et réaliste pour des workflows accessibles de transfert de mouvements. |
| Kling v2.6 Pro API (Text To Video) | Grâce à ce modèle de Kuaishou, les prompts textuels deviennent des vidéos cinématographiques avec génération sonore et formats d’image flexibles. Il prend en charge le développement de concepts, les scènes narratives, les publicités et autres projets vidéo pilotés par des prompts. |
| Kling v2.6 Pro API (Image To Video) | À partir d’une image, cet endpoint crée une vidéo cinématographique avec génération sonore et une dynamique renforcée. Donnez vie à des visuels de produits, des illustrations ou des images fixes créatives lorsque la continuité visuelle contrôlée est essentielle. |
Kling v2.6 combine la génération audiovisuelle native, les workflows texte et image, le contrôle du mouvement piloté par référence, les avatars pilotés par l’audio, des paramètres flexibles et un accès à l’usage via les endpoints Standard et Pro d’Atlas Cloud.
Kling v2.6 Pro peut générer simultanément une vidéo et du son à partir d’un prompt textuel ou d’une image source. Le son est activé par défaut sur les endpoints Text to Video et Image to Video d’Atlas Cloud. Les dialogues, les effets et l’ambiance peuvent ainsi suivre le déroulement de la scène. Cette solution convient particulièrement aux clips narratifs courts qui nécessitent un résultat audiovisuel cohérent sans étape distincte de conception sonore.
Partez d’une scène écrite ou animez une image fixe avec les endpoints de génération Pro. Les prompts textuels prennent en charge les sorties 1:1, 9:16 et 16:9, tandis que les deux parcours proposent des durées de 5 ou 10 secondes, un réglage du son, des prompts négatifs et un contrôle CFG de 0 à 1. Les images d’entrée acceptent les fichiers JPG, JPEG ou PNG jusqu’à 10 MB, offrant aux développeurs un contrôle pratique sur les contenus destinés aux réseaux sociaux, aux produits et au cinéma.
Fournissez une image de personnage et un clip de mouvement de référence à Kling v2.6 Motion Control : il transfère des séquences complètes de danse, d’action ou de gestes tout en préservant l’identité et la cohérence temporelle. Les vidéos de référence peuvent durer de 3 à 30 secondes. Choisissez si la composition doit suivre l’image ou la vidéo de mouvement, et décidez s’il faut conserver l’audio source. Le résultat convient aux performances continues, à l’animation de personnages et aux campagnes axées sur l’action.
Une image et une piste audio sont les entrées requises par les endpoints Standard et Pro Avatar, avec un prompt facultatif pour orienter le résultat. Pro privilégie la netteté des détails, la stabilité des mouvements et une forte cohérence de l’identité, tandis que Standard associe un mouvement cinématographique à un respect fiable du prompt. Utilisez ce parcours lorsqu’un sujet reconnaissable doit diffuser un audio préparé dans des vidéos de présentation, des introductions de marque ou des contenus récurrents pour les réseaux sociaux.
Choisissez les endpoints Standard ou Pro selon votre charge de travail, puis payez uniquement les appels effectués via Atlas Cloud. Standard Avatar commence à $0.056 par appel, Standard Motion Control à $0.07, Pro Text to Video et Image to Video à $0.07, et Pro Avatar ou Motion Control à $0.112. Un seul compte couvre les six endpoints, ce qui aide les développeurs à équilibrer qualité visuelle, besoins en mouvement et coûts de production sans engagement d’abonnement.
Découvrez comment Kling v2.6 et deux alternatives d’Atlas Cloud interprètent des prompts identiques dans des scènes d’action réalistes et des récits stylisés.
Un film publicitaire de mode hyperréaliste de 8–10 secondes, tourné à midi sur un vaste lac de sel blanc : six patineurs à grande vitesse, vêtus de capes irisées réfléchissantes, forment une précise « équipe de récolte de sel en cerf-volant géométrique », chacun tirant des lignes bleu cobalt et orange fluorescent parfaitement tendues, reliées à un gigantesque cerf-volant en forme de raie manta. Ouvrir sur une prise de vue verticale en plongée, réalisée par un drone, tandis que la formation synchronisée trace des motifs d’une netteté tranchante dans la croûte de sel ; le drone plonge soudainement puis se stabilise à quelques centimètres du sol, accélérant derrière le meneur tandis que l’équipe slalome entre des portiques de fanions flottants, les capes claquant au vent et les cordes se tendant avec un réalisme convaincant. Effectuer un whip-pan vers une orbite rapide à 360 degrés lorsqu’un tourbillon de poussière surgit brusquement à leurs côtés, projetant dans les airs des cristaux de sel emportés ; les six patineurs réagissent à l’unisson, ramènent vivement leurs lignes et le cerf-volant en forme de raie manta se replie en un piqué spectaculaire, traversant violemment le vortex de cristaux et dispersant du sel scintillant comme une neige éblouissante au-dessus de l’équipe lancée à pleine vitesse. Action coordonnée et continue du début à la fin, identités et formation cohérentes sur chaque plan, élan de patinage convaincant, tension des cordes physiquement exacte, mouvement aérodynamique des tissus, particules de sel granulaires, turbulence du vent et ombres ancrées au sol. Lumière solaire zénithale brutale, éclairage supérieur net à fort contraste, reflets prismatiques arc-en-ciel sur les capes réfléchissantes et la surface salée, composition en couches de blanc neige, de bleu cobalt et d’orange fluorescent, esthétique publicitaire haut de gamme, surréaliste et haute couture, détails cinématographiques d’une netteté tranchante, percussions énergiques synchronisées avec chaque virage et chaque transition de caméra, vent grondant, lames raclant le sol, tissu claquant, cordes qui se resserrent, puis un sifflement cristallin et lumineux au dénouement. Pas de ralenti, pas de plans statiques de remplissage, pas de coupes rompant la continuité spatiale, pas de corps déformés, pas de personnes dupliquées, pas de cordes emmêlées ou déconnectées, pas de costumes incohérents, pas d’objets flottants, pas d’écrans, pas d’interfaces logicielles, pas de tableaux de bord, pas de barres de progression, pas de graphiques, pas de légendes, pas de logos, pas de filigranes, pas de texte lisible. Format d’image 16:9.
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
Une poursuite cinématographique continue de 8–10 secondes dans les profondeurs marines, à l’intérieur de la salle de bal fortement inclinée d’une épave en décomposition : commencer par un plan macro extrême d’un tentacule de poulpe mimétique semi-transparent, scintillant à travers les cristaux fissurés d’un lustre tandis qu’il s’empare d’une « perle » lumineuse ; effectuer rapidement un dolly-zoom arrière pour révéler le poulpe se balançant depuis une rambarde corrodée au-dessus de tables de salle à manger renversées, tandis que des murènes se faufilent entre les chaises et le poursuivent, avec des couverts, des éclats de verre, des sédiments et des chaînes de bulles qui montent et se heurtent selon une physique sous-marine crédible. Enchaîner avec une poursuite serrée en orbite à 360 degrés tandis que le poulpe modifie continuellement la texture et la translucidité de sa peau pour reproduire les rideaux de velours, le laiton terni et le bois couvert de balanes, puis projette un nuage d’encre dense qui se recourbe en un leurre convaincant en forme de poulpe ; les murènes frappent la fausse silhouette tandis que le véritable poulpe se glisse devant elles. Effectuer un whip-pan puis incliner la caméra en roulis vers une vue spectaculaire en plongée fortement oblique : la « perle » volée ouvre soudainement un minuscule œil, sa lueur ambrée s’intensifie et l’immense visage camouflé d’une baudroie surgit sous la table du banquet — la perle est son leurre ; le poulpe se fige pendant un bref instant comique alors que la baudroie se précipite vers la caméra. Réalisme cinématographique photoréaliste des grandes profondeurs, lumière ambiante cyan froide contrastant avec une bioluminescence ambrée chaude, eau volumétrique, particules en suspension, mouvement haute densité des tentacules en soft body, simulation des fluides, collisions entre objets flottants, continuité parfaite des sujets, élan physiquement crédible, action nette et lisible, pas de ralenti. Audio immersif synchronisé : gémissements étouffés de la coque, tintements de cristaux, bulles rugissantes, claquements de murènes, percussions de poursuite pulsées, jaillissement humide d’encre, puis brusque impact de basse lors de la révélation. Pas d’écrans, d’interfaces, de tableaux de bord, de barres de progression, de graphiques, de légendes, de sous-titres, de logos, de filigranes ni de texte explicatif. Format d’image 16:9.
Generated with Kling v2.6 Pro Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Seedance 2.0 Fast Text-to-Video on Atlas Cloud
Des prompts cinématographiques et visuels de campagne animés aux avatars cohérents et aux performances guidées par le mouvement, Kling v2.6 accompagne les développeurs qui créent des films, des publicités, du contenu pour les réseaux sociaux et des personnages de marque.
Transformez des concepts écrits en vidéos cinématographiques avec Kling v2.6 Pro Text to Video, en utilisant des formats d’image flexibles et une bande-son générée. Les cinéastes peuvent prototyper des bandes-annonces, des séquences dramatiques et des présentations visuelles à partir d’un seul prompt.
Donnez vie à une image produit ou à un visuel de campagne grâce à des mouvements plus dynamiques, une qualité cinématographique et une bande-son générée. Les équipes marketing peuvent créer des teasers de lancement, des démonstrations visuelles et des promotions pour les réseaux sociaux à partir de visuels existants.
Créez des vidéos d’avatars soignées, avec des détails nets, des mouvements stables et une forte cohérence de l’identité grâce au modèle Pro Avatar. Utilisez-les pour des présentations de profil, des séquences de présentation et des personnalités récurrentes de marque sur les réseaux sociaux.
Transposez des mouvements de danse, d’action ou de gestes sur l’image d’un personnage tout en préservant son identité et sa cohérence temporelle. Les créateurs peuvent produire des tests de chorégraphie, des mascottes animées et des clips sociaux axés sur la performance à partir de mouvements enregistrés.
Donnez à l’image d’un personnage ou à une vidéo source les mouvements d’un clip de référence grâce à Pro Motion Control. Les équipes de production peuvent explorer différents interprètes, des séquences d’action stylisées et une animation cohérente des personnages.
Commencez par un prompt textuel et générez une vidéo cinématographique avec du son, dans des formats d’image flexibles. Les développeurs peuvent automatiser des concepts de campagnes courtes, du contenu de créateurs et des visuels adaptés aux plateformes sans fournir d’image d’ouverture.
Comparez Kling v2.6 aux principaux modèles de conversion texte-vidéo selon le fournisseur, la durée des clips, l’audio natif et le tarif de base standard.
| Modèle | Fournisseur | Durée de sortie | Audio natif | Tarif de base standard |
|---|---|---|---|---|
| Kling v2.6 Pro Text-to-Video | Kuaishou | 5 ou 10 secondes | √ | $0.07/seconde |
| Seedance 2.0 Text-to-Video | ByteDance | 4 à 15 secondes | √ | $0.112/seconde |
| Wan-2.7 Text-to-video | Qwen | 2 à 15 secondes | √ | $0.10/seconde |
| Veo 3.1 Lite Text-to-video | 4, 6 ou 8 secondes | √ | $0.05/seconde |
Soyez opérationnel en quelques minutes — suivez ces étapes simples pour intégrer et déployer des modèles via la plateforme Atlas Cloud.
Inscrivez-vous sur atlascloud.ai et complétez la vérification. Les nouveaux utilisateurs reçoivent des crédits gratuits pour explorer la plateforme et tester les modèles.
Combiner les modèles Kling 2.6 avancés avec la plateforme accélérée par GPU d'Atlas Cloud offre des performances, une évolutivité et une expérience développeur inégalées.
Faible Latence :
Inférence optimisée par GPU pour un raisonnement en temps réel.
API Unifiée :
Exécutez Kling 2.6, GPT, Gemini et DeepSeek avec une seule intégration.
Tarification Transparente :
Facturation prévisible par token avec options serverless.
Expérience Développeur :
SDK, analytiques, outils de fine-tuning et modèles.
Fiabilité :
99,99% de disponibilité, RBAC et journalisation conforme.
Sécurité et Conformité :
SOC 2 Type II, alignement HIPAA, souveraineté des données aux États-Unis.
Kling v2.6 est une famille de modèles vidéo IA de Kuaishou disponible via Atlas Cloud. Elle inclut la génération Pro Text-to-Video et Image-to-Video, ainsi que des endpoints Standard et Pro pour les avatars et le contrôle des mouvements.
Créez des vidéos à partir de prompts, animez des images sources, produisez des vidéos d’avatar à partir d’une image et d’un fichier audio, ou transférez des séquences de danse, d’action et de gestes depuis des clips de référence. Les endpoints Pro Text-to-Video et Image-to-Video peuvent générer du son en même temps que les éléments visuels.
Choisissez Text-to-Video lorsque vous partez d’un prompt, et Image-to-Video lorsque vous animez une image fixe. Les endpoints Avatar associent une image à un fichier audio fourni, tandis que Motion Control applique à un personnage les mouvements d’une vidéo de référence.
Envoyez une requête POST à `/api/v1/model/generateVideo` avec votre clé API Atlas Cloud, l’ID exact du modèle et les paramètres propres à l’endpoint. La réponse asynchrone fournit un ID de prédiction que vous pouvez vérifier via `/api/v1/model/prediction/{id}` jusqu’à la fin de la tâche.
Les contrôles varient selon l’endpoint. Text-to-Video prend en charge les prompts, les prompts négatifs, les formats d’image 1:1, 9:16 et 16:9, des durées de 5 ou 10 secondes, le son et l’échelle de guidage, tandis que les autres workflows ajoutent, selon le cas, des paramètres d’image, d’audio, de vidéo de mouvement, d’orientation ou de conservation du son.
Pour Pro Text-to-Video et Image-to-Video, le paramètre `sound` contrôle la génération simultanée du son. Les modèles Avatar exigent au contraire une entrée audio avec l’image du personnage, tandis que Motion Control peut conserver le son original de la vidéo de référence.
Atlas Cloud indique des tarifs standard de $0.07 par seconde pour Pro Text-to-Video, Pro Image-to-Video et Standard Motion Control. Standard Avatar coûte $0.056 par seconde, tandis que Pro Avatar et Pro Motion Control coûtent $0.112 par seconde, selon les tarifs d’origine plutôt que les prix promotionnels.
Préparez une image de personnage au format JPG, JPEG ou PNG, ainsi qu’une vidéo de mouvement au format MP4 ou MOV. Chaque fichier ne doit pas dépasser 10 MB, mesurer au moins 300 pixels dans les deux dimensions et utiliser un format d’image compris entre 1:2.5 et 2.5:1.
Commencez par vérifier l’ID du modèle, l’authentification Bearer, les champs obligatoires et les contraintes multimédias propres à l’endpoint. Si la tâche a été acceptée, interrogez son ID de prédiction jusqu’à sa réussite ou son échec, puis examinez l’erreur renvoyée. En cas d’incohérences visuelles, simplifiez la scène et utilisez des médias sources clairs, en particulier lors du transfert de mouvements faciaux ou d’interactions avec des objets complexes.
Guides, tutoriels et actualités produit pour tirer le meilleur d'Atlas Cloud.