
Kling 1.6 est le modèle de génération vidéo de Kuaishou, conçu pour transformer des instructions et des images de référence en vidéos courtes cohérentes. Il améliore la réactivité aux mouvements, aux actions temporelles et aux déplacements de caméra, tout en renforçant la cohérence des sujets, la fidélité des couleurs, la dynamique de l’éclairage et le rendu détaillé. Accédez à cette famille de modèles via Atlas Cloud avec une seule clé compatible avec OpenAI et une tarification transparente à l’usage. Commencez à développer dès aujourd’hui.
Kling 1.6 est développé par Kuaishou. Atlas Cloud (exploité par Atlas Cloud AI LLC) en fournit l’accès mais n’en est pas propriétaire. Toutes les marques appartiennent à leurs détenteurs respectifs.
Découvrez comment chaque endpoint Kling 1.6 gère les entrées textuelles ou d’images, et identifiez les domaines où ses atouts vérifiés — mouvement, cohérence, niveau de détail et efficacité — sont les plus pertinents.
| Modalité | Description |
|---|---|
| Kling 1.6 Multi I2V Pro API (Multi Image To Video) | Convertissez des images en vidéos mettant en scène plusieurs sujets, avec une cohérence améliorée et une précision accrue du suivi des mouvements. Cet endpoint Pro convient aux scènes complexes où la coordination des mouvements des sujets et la cohérence visuelle sont essentielles. |
| Kling 1.6 Multi I2V Standard API (Multi Image To Video) | Pour générer plusieurs sujets à moindre coût, cet endpoint transforme des images en vidéos tout en équilibrant vitesse et niveau de détail. Il convient à l’animation de scènes simples et à la production courante de contenus avec plusieurs sujets. |
| Kling 1.6 T2V Standard API (Text To Video) | Les prompts textuels deviennent de courtes vidéos aux mouvements stables et à l’alignement fiable avec les instructions. Utilisez cet endpoint d’entrée de gamme pour visualiser des concepts, créer du contenu pour les réseaux sociaux et produire des séquences simples guidées par prompt. |
| Kling 1.6 I2V Pro API (Image To Video) | À partir d’une image fixe, l’endpoint Pro produit des vidéos avec une fusion des mouvements plus fluide et un rendu des textures plus réaliste. Il convient particulièrement aux visuels de produits soignés, aux plans de personnages et à l’animation cinématographique d’images. |
| Kling 1.6 I2V Standard API (Image To Video) | Choisissez cet endpoint léger pour transformer des images en vidéos grâce à un workflow de génération fondamental. Son positionnement à coût minimal le destine aux animations simples, aux premiers tests créatifs et à la production en plus grand volume. |
Kling 1.6 combine les workflows texte, image unique et jusqu’à quatre images de référence, avec des sorties de 5 ou 10 secondes, une adhérence au prompt réglable, des prompts négatifs facultatifs, plusieurs rapports d’aspect et un accès Standard ou Pro via une seule API Atlas Cloud.
Kling 1.6 prend en charge la génération de texte vers vidéo et d’image vers vidéo באמצעות des variantes dédiées. Commencez par décrire une scène ou animez une image source, puis guidez l’action avec des prompts allant jusqu’à 2 500 caractères. Les modèles Standard privilégient la maîtrise des coûts, tandis que la variante image Pro met l’accent sur des mouvements plus fluides et des textures plus réalistes. Cette gamme convient aux tests de concepts, aux clips pour les réseaux sociaux et aux séquences visuelles soignées.
Importez entre une et quatre images de référence avec la variante Multi I2V Standard ou Pro. Le modèle les utilise comme références visuelles, tandis qu’un prompt dirige les sujets, les mouvements et le développement de la scène. La version Pro est optimisée pour une meilleure cohérence entre plusieurs sujets et un suivi des mouvements plus précis. Elle convient aux interactions entre personnages, aux associations de produits et aux scènes réunissant plusieurs éléments visuels.
Définissez une première image et, facultativement, une image de fin avec la variante I2V Pro afin de façonner le début et l’aboutissement d’un clip. Chaque image peut être au format JPG, JPEG ou PNG, avec une taille maximale de 10 MB et une résolution minimale de 300 × 300 pixels. Ajoutez des instructions de mouvement entre ces deux repères visuels. Ce contrôle est particulièrement utile pour les transitions planifiées, les changements de pose et les révélations de produits.
La fluidité des mouvements est au cœur de la variante image Pro, qui propose un fondu amélioré et un réalisme accru des textures, comme indiqué dans son profil Atlas Cloud. Une échelle de guidage comprise entre 0 et 1 ajuste l’adhérence au prompt, tandis que les prompts négatifs aident à écarter les éléments indésirables. Utilisez ces contrôles pour équilibrer mouvements naturels et action étroitement dirigée. Cette combinaison convient aux mouvements exigeants de personnages, de tissus et de caméra.
Choisissez une sortie de 5 ou 10 secondes dans toute la famille Kling 1.6. Les variantes texte et multi-image proposent également les rapports d’aspect 16:9, 9:16 et 1:1, afin qu’un même workflow puisse cibler des formats panoramiques, verticaux ou carrés. La limite de 2 500 caractères pour les prompts laisse suffisamment de place pour décrire le sujet, l’action, l’éclairage et les mouvements de caméra. Ces options aident les équipes à planifier des contenus adaptés à chaque plateforme sans changer de famille de modèles.
Exécutez toutes les variantes Kling 1.6 répertoriées via une seule API de génération vidéo Atlas Cloud, avec une facturation à l’usage. Les variantes Standard utilisent un prix de base original vérifié de $0.056 par exécution, tandis que les variantes Pro utilisent $0.098 par exécution. Choisissez le niveau correspondant au compromis requis entre coût, détails et qualité des mouvements. Cette configuration prend en charge les expérimentations rapides et les pipelines de production sans intégrations distinctes avec plusieurs fournisseurs.
Découvrez comment Kling 1.6 et deux modèles vidéo alternatifs interprètent des prompts identiques dans des scènes d’action réalistes et des récits stylisés.
Une séquence cinématographique miniature de 8 à 10 secondes en prise de vues réelles, à l’intérieur d’un atelier de soufflage de verre à minuit : un jeune artisan fait tourner continuellement une canne à souffler tandis qu’une bulle de verre chauffée à blanc se dilate rapidement, sa forme parfaitement ronde structurant la composition. Commencer par une orbite macro extrême autour du verre en fusion qui tourne, en capturant les filaments ambrés transparents qui s’étirent, la tension superficielle visqueuse, les miroitements de chaleur, les minuscules étincelles et la réfraction interne réaliste. La bulle qui gonfle glisse soudain de la canne, heurte la table métallique gris argenté et roule rapidement ; passer à un travelling haute vitesse au niveau de la table, à ses côtés, tandis qu’elle oscille, se déforme, libère des filaments lumineux et reflète la lumière bleu cobalt de la lune sur la lueur orange du four. Effectuer un whip-pan vers l’artisan alarmé qui se précipite au-dessus de l’établi et rattrape le verre emballé avec une palette en bois mouillée au tout dernier instant — un sifflement explosif fait tourbillonner une vapeur physiquement réaliste dans le cadre. Lorsque la vapeur se dissipe, révéler que le verre s’est miraculeusement figé en un petit poisson-globe transparent, doté de délicates nageoires en verre et de bulles internes cohérentes ; il gonfle doucement les joues une fois, dans une dernière note espiègle. Mouvement continu et fluide, transformation cohérente du sujet, viscosité réaliste du verre, collisions, lueur thermique, étincelles, réfraction, caustiques, distorsion thermique et physique de la vapeur ; palette en couches d’ambre, de bleu cobalt et de gris argenté ; lumière principale orange du four, liseré froid bleu lunaire, faible profondeur de champ, réalisation pratique miniature haut de gamme et tactile, texture cinématographique photoréaliste, aucun ralenti, aucun remplissage statique, aucun écran, aucune interface logicielle, aucun tableau de bord, aucune barre de progression, aucun graphique, aucune légende, aucun texte, aucun logo ni filigrane. Audio synchronisé : rugissement du four, frottement de la canne en rotation, tintement métallique sec, cliquetis du verre qui roule, pas précipité, puissant sifflement humide, puis un minuscule souffle cristallin ; rythme percussif tendu se terminant sur un tintement de verre fantaisiste. Format d’image 16:9.
Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud
Generated with Seedance 2.0 Image-to-Video on Atlas Cloud
Generated with Kling v1.6 i2v Standard on Atlas Cloud
Une micro-histoire tendue de 9 secondes dans l’arrière-cuisine exiguë d’un restaurant de nouilles hongkongais ouvert tard dans la nuit : un jeune chef sauve en urgence une commande de ramen, avec des gestes des mains précis, crédibles et continus. Commencer par un travelling latéral en angle extrêmement bas, glissant au-dessus de la planche à découper saupoudrée de farine, tandis qu’il claque des poignets et projette en l’air un long paquet de nouilles ; suivre les brins qui se tordent à travers une vapeur dense, chaque nouille se pliant et s’étirant, masquant naturellement ses mains et les ustensiles suspendus. Effectuer un whip-pan vers un angle serré côté cuisinière, alors que le paquet de nouilles manque de tomber dans une flamme de gaz vacillante ; au tout dernier instant, il se penche brusquement et le rattrape proprement dans une écumoire métallique, dont le filet se courbe sous son poids, puis pivote d’un mouvement fluide et plonge les nouilles dans un bouillon en ébullition violente, projetant des gouttelettes réalistes, des bulles et des ondulations huileuses à la surface de la marmite. Passer à une vue plongeante parfaitement verticale tandis que les nouilles se déploient en une spirale florale nette dans la soupe ; à travers le passe-plat, les clients qui attendent se penchent et éclatent en applaudissements enthousiastes, tandis que le chef affiche un sourire essoufflé. Maintenir une continuité parfaite du même chef, de ses vêtements, des ustensiles, du paquet de nouilles, de la géographie de la cuisine et des mouvements à chaque coupe. Une mise en scène profonde et resserrée coordonne constamment le chef, les nouilles, les flammes, les casseroles et les ustensiles au premier plan ; couches tactiles de farine en suspension, reflets sur le carrelage mouillé, huile luisante, condensation et vapeur ondoyante. Esthétique photoréaliste du cinéma hongkongais, énergie cinétique de caméra portée, flou de mouvement naturel et net, lumières pratiques orange tungstène chaleureuses contrastant avec des carreaux de céramique cyan froids, contraste riche, grain de pellicule 35mm subtil, texture réaliste de la peau et des aliments. Son synchronisé : claquement du couteau sur la planche, rugissement de la flamme de gaz, vapeur qui siffle, tintement de l’écumoire, éclaboussure du bouillon en ébullition, puis brusque salve d’applaudissements ; rythme percussif de cuisine rapide, aucun dialogue. Aucun ralenti, aucune pose figée, aucun plan d’établissement vide, aucune rupture de montage, aucune continuité saccadée, aucun doigt supplémentaire, aucune main difforme, aucun membre dupliqué, aucun ustensile déformé, aucun clipping, aucune téléportation des nouilles, aucun mouvement caoutchouteux, aucun comportement impossible des fluides, aucun objet flottant, aucune interface utilisateur, aucun écran, aucun tableau de bord, aucune barre de progression, aucun graphique, aucune légende, aucun sous-titre, aucun logo ni texte visible. Format d’image 16:9.
Generated with Kling v1.6 Multi i2v Pro on Atlas Cloud
Generated with Seedance 2.0 Image-to-Video on Atlas Cloud
Generated with Kling v1.6 i2v Standard on Atlas Cloud
Kling 1.6 transforme les prompts et les images sources en concepts de vidéos courtes pour les storyboards, les campagnes produit, les scènes avec plusieurs sujets, les œuvres animées, les déclinaisons pour les réseaux sociaux et les récits centrés sur des personnages.
Transformez des concepts écrits en ébauches vidéo courtes, avec des mouvements stables et une bonne fidélité aux prompts. Les réalisateurs, les agences et les équipes produit peuvent prévisualiser le rythme, l’action et la direction visuelle avant de s’engager dans une production complète.
Animez des images fixes de produits avec des transitions de mouvement plus fluides et des textures plus réalistes. Les équipes marketing peuvent transformer des visuels de catalogue en clips de lancement soignés, en présentations de fonctionnalités et en éléments de campagne sans organiser une nouvelle séance photo.
Combinez des sujets issus d’images distinctes tout en préservant une meilleure cohérence de scène et en suivant précisément leurs mouvements. Créez à grande échelle des interactions entre personnages, des scènes de groupe ou des récits de style de vie pour des contenus de marque et des campagnes sur les réseaux sociaux.
Animez des œuvres statiques avec le mélange de mouvements plus fluide et le réalisme amélioré des textures de la variante Pro image-to-video. Les artistes et les équipes de jeu vidéo peuvent créer des concepts animés, des séquences de personnages ou des études d’ambiance à partir de visuels existants.
Commencez avec un prompt ou une image source pour produire des concepts de vidéos courtes avec des mouvements stables ou des transitions fluides. Les créateurs peuvent développer plusieurs accroches, traitements visuels et orientations de campagne pour les réseaux sociaux.
Lorsque plusieurs sujets doivent partager une même scène, les variantes Multi privilégient la cohérence et le suivi avancé des mouvements. Utilisez-les pour des duos de personnages, des interactions avec des animaux de compagnie, des scènes de groupe ou des tests narratifs créés à partir d’images.
Comparez les variantes de Kling 1.6 avec d’autres modèles vidéo disponibles sur Atlas Cloud selon les flux d’entrée, la durée des clips, l’audio natif et la tarification standard.
| Modèle | Flux d’entrée | Durée de sortie | Audio natif | Tarif standard |
|---|---|---|---|---|
| Kling v1.6 Multi i2v Pro | Prompt + 1 à 4 images | 5 ou 10 secondes | - | $0.098/exécution |
| Kling v1.6 Multi i2v Standard | Prompt + 1 à 4 images | 5 ou 10 secondes | - | $0.056/exécution |
| Kling v1.6 t2v Standard | Prompt textuel | 5 ou 10 secondes | - | $0.056/exécution |
| Kling v1.6 i2v Pro | Prompt + image de début + image de fin facultative | 5 ou 10 secondes | - | $0.098/exécution |
| Kling v1.6 i2v Standard | Prompt + image de début | 5 ou 10 secondes | - | $0.056/exécution |
| Wan-3.0 Image-to-video | Prompt + image de début + image de fin facultative | 2 à 30 secondes | √ | $0.05/seconde |
| MiniMax H3 Image-to-Video | Prompt + image de début + image de fin facultative | 4 à 15 secondes | √ | $0.038/seconde |
Soyez opérationnel en quelques minutes — suivez ces étapes simples pour intégrer et déployer des modèles via la plateforme Atlas Cloud.
Inscrivez-vous sur atlascloud.ai et complétez la vérification. Les nouveaux utilisateurs reçoivent des crédits gratuits pour explorer la plateforme et tester les modèles.
Combiner les modèles Kling 1.6 avancés avec la plateforme accélérée par GPU d'Atlas Cloud offre des performances, une évolutivité et une expérience développeur inégalées.
Faible Latence :
Inférence optimisée par GPU pour un raisonnement en temps réel.
API Unifiée :
Exécutez Kling 1.6, GPT, Gemini et DeepSeek avec une seule intégration.
Tarification Transparente :
Facturation prévisible par token avec options serverless.
Expérience Développeur :
SDK, analytiques, outils de fine-tuning et modèles.
Fiabilité :
99,99% de disponibilité, RBAC et journalisation conforme.
Sécurité et Conformité :
SOC 2 Type II, alignement HIPAA, souveraineté des données aux États-Unis.
Kling 1.6 est une famille de modèles de génération vidéo développée par Kuaishou. Sur Atlas Cloud, elle prend en charge la génération de texte vers vidéo, d’image unique vers vidéo et de plusieurs images vers vidéo via cinq endpoints Standard et Pro. Ses variantes offrent des mouvements stables, une bonne adéquation aux prompts, des transitions de mouvement plus fluides, un rendu des textures plus réaliste et une cohérence entre plusieurs sujets.
Transformez des prompts textuels en scènes vidéo originales, animez une image de départ unique ou combinez plusieurs images de référence dans une composition comportant plusieurs sujets. Selon l’endpoint, vous pouvez générer des clips de 5 ou 10 secondes.
Choisissez T2V Standard pour la génération à partir de texte et I2V Standard pour animer une image à moindre coût. I2V Pro privilégie des transitions de mouvement plus fluides et des textures plus réalistes. Pour plusieurs sujets ou images de référence, sélectionnez Multi I2V Standard ou Multi I2V Pro selon vos exigences de coût et de cohérence.
Créez une clé API dans le tableau de bord Atlas Cloud, puis envoyez une requête JSON à POST /api/v1/model/generateVideo avec votre jeton Bearer. Incluez l’identifiant exact du modèle, un prompt et l’image ou les images requises pour les endpoints fondés sur des images. Conservez l’ID de prédiction renvoyé et utilisez-le pour récupérer le résultat asynchrone.
Chaque endpoint requiert un identifiant de modèle et un prompt de 2 500 caractères maximum. La génération de texte vers vidéo prend en charge le format d’image, la durée, l’échelle de guidage et les prompts négatifs, tandis que les endpoints à image unique exigent une image de départ au format JPG, JPEG ou PNG. Les endpoints à plusieurs images acceptent une à quatre images de référence et proposent également des contrôles pour la durée, le format d’image et le prompt négatif.
Les cinq endpoints Atlas Cloud prennent en charge la génération de 5 ou 10 secondes, 5 secondes étant la valeur par défaut documentée. Les endpoints de texte vers vidéo et à plusieurs images acceptent les formats 16:9, 9:16 ou 1:1. Les workflows à image unique déduisent leur cadrage de l’image source fournie, au lieu d’exposer le même paramètre de format d’image.
Au tarif catalogue standard, les endpoints T2V Standard, I2V Standard et Multi I2V Standard coûtent 0,056 $ par seconde de vidéo générée. I2V Pro et Multi I2V Pro coûtent 0,098 $ par seconde de vidéo générée, avec une facturation à l’usage.
Vérifiez d’abord le jeton Bearer, l’identifiant exact du modèle, le prompt requis et les éventuels champs d’image obligatoires. Avant de renvoyer une requête non valide, contrôlez la longueur documentée du prompt, le format de l’image, la taille du fichier, la résolution, la durée et les plages de paramètres. Comme la génération est asynchrone, conservez l’ID de prédiction et continuez à interroger l’endpoint de résultat tant que son statut est processing.
Guides, tutoriels et actualités produit pour tirer le meilleur d'Atlas Cloud.