
Kling v2.1 est la famille de modèles vidéo IA de Kuaishou destinée aux développeurs qui créent des workflows vidéo prêts pour la production. Cette famille prend en charge la génération rapide de brouillons en 720p, l’animation d’images nette et fluide, une profondeur visuelle professionnelle, l’interprétation de prompts complexes, une logique de mouvement avancée et un rendu amélioré des mouvements de caméra dynamiques. Accédez à ces fonctionnalités via l’API unifiée d’Atlas Cloud avec une seule clé compatible avec OpenAI et une disponibilité des modèles dès le Day-0. Commencez à créer dès aujourd’hui.
Kling 2.1 est développé par Kuaishou. Atlas Cloud (exploité par Atlas Cloud AI LLC) en fournit l’accès mais n’en est pas propriétaire. Toutes les marques appartiennent à leurs détenteurs respectifs.
Choisissez l’endpoint Kling v2.1 adapté à votre source, à vos exigences en matière de mouvement et à votre flux de production.
| Modalité | Description |
|---|---|
| Kling v2.1 I2V Pro Start End Frame API | Fournissez les images de début et de fin pour générer une vidéo avec une continuité de mouvement maîtrisée entre les deux images. Des transitions de scène plus fluides rendent cet endpoint adapté aux changements de plan prévus, aux séquences visuelles et aux temps forts narratifs définis. |
| Kling v2.1 T2V Master API (Text To Video) | Des prompts textuels complexes sont transformés en vidéos grâce à une logique de mouvement avancée et à un rendu amélioré des mouvements de caméra dynamiques. Sélectionnez cet endpoint pour des indications de scène détaillées, des mouvements expressifs et des concepts reposant sur un comportement de caméra soigneusement défini. |
| Kling v2.1 I2V Master API (Image To Video) | Conçu pour la génération professionnelle de vidéos à partir d’images, cet endpoint anime une image source avec une continuité de mouvement précise et une profondeur visuelle accrue. Il convient aux créations soignées où la cohérence des mouvements et le rendu dimensionnel sont prioritaires. |
| Kling v2.1 I2V Pro API (Image To Video) | Trouvez le juste équilibre entre vitesse de génération et fidélité en transformant des images sources en vidéos nettes et fluides. Utilisez-le pour une production créative générale nécessitant une qualité visuelle fiable, sans dépendre de l’endpoint Master. |
| Kling v2.1 I2V Standard API (Image To Video) | Pour itérer rapidement, cet endpoint convertit les images sources en vidéos 720p fiables. Son profil axé sur la rapidité facilite la création de premières ébauches visuelles, les revues préliminaires de concepts et le prototypage vidéo efficace. |
Kling v2.1 combine la création de vidéos à partir de texte et d’images, le conditionnement par première et dernière image, des clips de 5 ou 10 secondes, un niveau de guidage réglable, ainsi que les niveaux Standard, Pro et Master via une seule API Atlas Cloud.
Kling v2.1 Pro accepte à la fois une première image et une image finale. Chaque image doit être au format JPEG ou PNG, ne pas dépasser 10 MB et mesurer au moins 300 × 300 pixels. Le modèle génère le mouvement entre ces deux repères tout en préservant la continuité de la transition. Choisissez une sortie de 5 ou 10 secondes pour structurer les apparitions, les transformations et les temps forts narratifs soigneusement dirigés.
Les variantes Master apportent une logique de mouvement avancée, un rendu de caméra dynamique, une continuité précise et une profondeur visuelle adaptées aux scènes exigeantes. Qu’il s’agisse d’une poursuite rapide, de mouvements de personnages superposés ou d’un vaste mouvement de caméra, le modèle est conçu pour maintenir une action cohérente. Choisissez Master lorsque vos projets professionnels d’image vers vidéo ou vos travaux complexes de texte vers vidéo nécessitent le niveau le plus performant de la famille.
Créez à partir de mots ou animez une image existante grâce à des modèles distincts de texte vers vidéo et d’image vers vidéo. La famille inclut des options Standard, Pro et Master basées sur l’image, tandis que Master prend également en charge les prompts textuels avec des formats 16:9, 9:16 ou 1:1 au choix. Cette gamme permet à une seule intégration de couvrir les brouillons rapides, la production créative courante et les concepts cinématographiques plus exigeants.
Configurez chaque modèle compatible pour produire un clip de 5 ou 10 secondes. Les séquences courtes conviennent aux tests visuels rapides, tandis que l’option plus longue laisse davantage de temps au mouvement, aux changements de caméra et aux transitions pour se développer, sans modifier l’endpoint de génération. Standard est optimisé pour produire rapidement des brouillons en 720p, ce qui en fait un point de départ pratique avant de passer un concept à Pro ou Master.
Façonnez les sorties de Kling v2.1 à l’aide d’un prompt positif obligatoire, d’un prompt négatif facultatif et d’un contrôle du guidage compris entre 0 et 1. Augmentez ou réduisez la valeur de guidage pour ajuster le respect du prompt, tandis que les prompts négatifs indiquent les éléments que vous souhaitez éviter. Ensemble, ces contrôles favorisent un langage de caméra plus précis, des compositions plus nettes et une itération reproductible entre les différentes variantes créatives.
Accédez aux cinq variantes via une seule API Atlas Cloud, avec des tarifs de base standard de $0.056 pour Standard, $0.098 pour chaque option Pro et $0.28 pour chaque option Master. Vous ne payez que les appels effectués et pouvez changer de niveau selon l’évolution de vos besoins de production. Une seule clé compatible OpenAI regroupe l’expérimentation et le déploiement au sein d’une même intégration.
Exécutez deux prompts cinématographiques identiques avec Kling v2.1, Seedance 2.0 et Kling V3.0 Turbo afin de comparer la continuité des mouvements, le respect du prompt, le contrôle de la caméra et la narration visuelle.
Une course-poursuite de sauvetage très énergique de 8–10 secondes, à midi, sur un vaste lac salé recouvert d’une eau aussi fine qu’un miroir : une adolescente en combinaison de course bleu cobalt pilote à toute vitesse un voilier terrestre à trois roues, à la poursuite d’un sac d’urgence rouge corail emporté par une violente rafale. Commencer par un plan macro extrême au ras du sol, montrant des cristaux de sel blanc argenté aux arêtes acérées, tandis que le pneu avant passe à toute vitesse en projetant une gerbe d’eau scintillante sur l’objectif ; accélérer vers un travelling latéral suivant le voilier à vive allure, tandis que sa voile en toile tendue claque dans le vent et que la jeune fille abaisse le mât pour passer sous une nuée de flamants roses prenant leur envol. Effectuer un whip-pan autour du véhicule, puis une orbite dynamique à 360 degrés, tandis qu’une roue latérale se soulève brièvement de l’eau sous l’effet réaliste de la force centrifuge ; elle se penche vers l’extérieur sans perdre le contrôle, accroche la sangle du sac d’une main et le ramène à bord. Terminer par une montée rapide de la caméra vers une vue aérienne élevée, révélant le long sillage incurvé du voilier — puis un bébé manchot trempé passe soudain la tête hors du sac ouvert et pépie, tandis que la jeune fille réagit avec une joie stupéfaite. Préserver une continuité parfaite du personnage, du véhicule, du sac et de l’espace à chaque transition de caméra ; représenter avec exactitude physique la tension de la voile, la dynamique des roues, les projections d’eau peu profonde, les reflets, l’évitement des flamants, la résistance au vent et l’élan. Lumière dure et nette du midi sur un arrière-plan de nuages orageux indigo lointains, palette maîtrisée de blanc argenté, bleu cobalt et rouge corail, cinéma publicitaire photoréaliste haut de gamme, détails tactiles, flou de mouvement naturel et net, action fluide et continue, sans ralenti ni plans d’établissement vides. Audio immersif synchronisé : vent rugissant, toile qui claque, pneus glissant sur l’eau, éclaboussures rythmiques, battements d’ailes, musique percussive montante et un pépiement de manchot parfaitement audible au moment de la révélation. Aucun écran, aucune interface logicielle, aucun tableau de bord, aucune barre de progression, aucun graphique, aucune légende, aucune étiquette, aucun logo, aucun filigrane ni texte à l’écran ; aucune erreur anatomique, aucun sujet dupliqué, aucune rupture de continuité, aucune déformation de la géométrie du véhicule, aucun objet flottant, aucune physique irréaliste ni tremblement de caméra. Format d’image 16:9.
Generated with Kling v2.1 t2v Master on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Une course-poursuite animée continue de 8–10 secondes sur des toits méditerranéens blancs balayés par le vent, au crépuscule cyan frais : une femme âgée en tablier indigo poursuit un unique long foulard écarlate éclatant, bondissant par-dessus des cordes à linge et glissant sur des tuiles en terre cuite inclinées tandis que le tissu claque, se tord et ondule naturellement sous l’effet d’un brusque vent marin. Commencer par un travelling bas et rapide longeant la fine arête du toit, au niveau de ses pieds en pleine course ; traverser des draps blancs qui claquent violemment pour créer une transition fluide par occultation, puis plonger depuis les airs dans une orbite serrée autour de la femme tandis que le foulard s’enroule autour d’une girouette et fait doucement basculer un chat roux surpris dans ses bras. Elle rattrape le chat sans ralentir ; la girouette tourne, le chat miaule et elle éclate de rire, tandis que la caméra recule brusquement pour révéler la ville côtière en terrasses qui descend en cascade vers la mer scintillante. Préserver une continuité exacte du personnage, des vêtements, du chat et des toits à travers chaque occultation et changement de caméra ; course, sauts, glissades et rattrapage parfaitement fluides et ininterrompus, physique complexe des tissus animés par le vent, parallaxe marquée de l’avant-plan à l’arrière-plan, animation celluloïd expressive dessinée à la main avec des arrière-plans délicats à l’aquarelle, crépuscule turquoise froid contrasté par la lumière ambrée et chaude des fenêtres, le foulard écarlate comme seul repère visuel hautement saturé dans toute la composition. Rafales rythmiques, linge qui claque, pas rapides sur les tuiles, rotation métallique douce de la girouette, un miaulement surpris, ressac lointain et cordes méditerranéennes enjouées montant jusqu’au rattrapage comique. Aucun ralenti, aucun plan statique, aucun texte, logo, bordure ni élément d’interface. Format d’image 16:9.
Generated with Kling v2.1 t2v Master on Atlas Cloud
Generated with Seedance 2.0 Text-to-Video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
À partir de concepts rédigés et d’images sources, Kling v2.1 prend en charge la prévisualisation cinématographique, le mouvement des produits, les transitions contrôlées entre images, les ébauches rapides pour les réseaux sociaux, l’animation d’illustrations et la planification de scènes de jeu dans ses variantes texte-vers-vidéo et image-vers-vidéo.
Kling v2.1 t2v Master interprète des prompts complexes grâce à une logique avancée des mouvements et à un rendu dynamique de la caméra. Les réalisateurs et les équipes créatives peuvent transformer des concepts écrits en ébauches de scènes cinématographiques avant d’engager des ressources dans la production.
Animez une image de produit avec des mouvements nets et fluides, tout en équilibrant vitesse de génération et fidélité grâce au point de terminaison Pro. Les équipes marketing peuvent produire des clips de lancement, des visuels pour boutiques en ligne et des déclinaisons de campagne à partir d’images fixes existantes.
Utilisez des images de début et de fin pour guider la continuité des mouvements et créer des transitions plus fluides entre deux états visuels. Cette approche prend en charge les comparatifs avant/après, les transitions entre scènes et les transformations planifiées avec des points de départ et d’arrivée définis.
Lorsque la vitesse est essentielle, le modèle Standard produit des ébauches fiables en 720p d’image-vers-vidéo pour itérer rapidement. Les équipes sociales et les créateurs indépendants peuvent tester des idées de mouvements, des accroches visuelles et différentes orientations de contenu avant de passer à une production à plus haute fidélité.
Donnez vie à des illustrations ou à des images fixes de personnages grâce à la continuité des mouvements et à la profondeur visuelle de i2v Master. Les artistes peuvent développer des séquences, des boucles atmosphériques ou des éléments de portfolio tout en préservant l’image source comme base visuelle.
Vous avez besoin d’animer une scène de jeu à partir d’un brief écrit ? Master texte-vers-vidéo gère les prompts complexes et le rendu dynamique de la caméra, aidant les développeurs à prévisualiser les environnements, les temps forts narratifs et les moments cinématographiques de leurs jeux.
Comparez les variantes de Kling v2.1 avec d’autres modèles vidéo disponibles sur Atlas Cloud selon le mode de génération, la durée du clip, le contrôle de l’image de fin et le prix de base standard.
| Modèle | Mode de génération | Durée du clip | Contrôle de l’image de fin | Prix de base standard |
|---|---|---|---|---|
| Kling v2.1 i2v Pro Start-end-frame | Images de début et de fin vers vidéo | 5 ou 10 sec | √ | $0.098 |
| Kling v2.1 t2v Master | Texte vers vidéo | 5 ou 10 sec | - | $0.28 |
| Kling v2.1 i2v Master | Image vers vidéo | 5 ou 10 sec | - | $0.28 |
| Kling v2.1 i2v Pro | Image vers vidéo | 5 ou 10 sec | - | $0.098 |
| Kling v2.1 i2v Standard | Image vers vidéo | 5 ou 10 sec | - | $0.056 |
| Veo 3.1 Lite Start-End Frame to Video | Images de début et de fin vers vidéo | 4, 6 ou 8 sec | √ | $0.05 |
| Seedance 2.0 Image-to-Video | Image vers vidéo | 4 à 15 sec ou auto | √ | $0.112 |
| Wan-2.7 Image-to-video | Image vers vidéo | 2 à 15 sec | √ | $0.10 |
Soyez opérationnel en quelques minutes — suivez ces étapes simples pour intégrer et déployer des modèles via la plateforme Atlas Cloud.
Inscrivez-vous sur atlascloud.ai et complétez la vérification. Les nouveaux utilisateurs reçoivent des crédits gratuits pour explorer la plateforme et tester les modèles.
Combiner les modèles Kling 2.1 avancés avec la plateforme accélérée par GPU d'Atlas Cloud offre des performances, une évolutivité et une expérience développeur inégalées.
Faible Latence :
Inférence optimisée par GPU pour un raisonnement en temps réel.
API Unifiée :
Exécutez Kling 2.1, GPT, Gemini et DeepSeek avec une seule intégration.
Tarification Transparente :
Facturation prévisible par token avec options serverless.
Expérience Développeur :
SDK, analytiques, outils de fine-tuning et modèles.
Fiabilité :
99,99% de disponibilité, RBAC et journalisation conforme.
Sécurité et Conformité :
SOC 2 Type II, alignement HIPAA, souveraineté des données aux États-Unis.
Kling v2.1 est une famille de modèles de génération vidéo de Kuaishou pour créer des vidéos à partir de texte et d’images. Atlas Cloud fournit des endpoints Standard, Pro, Master et start/end-frame pour répondre à différents besoins en matière de qualité et de contrôle.
Transformez des prompts textuels en vidéos avec T2V Master, ou animez des images sources avec les endpoints I2V Standard, Pro et Master. La variante start/end-frame permet de contrôler la continuité des mouvements et d’obtenir des transitions plus fluides entre deux images fournies.
Créez une clé API Atlas Cloud, conservez-la dans un environnement sécurisé côté serveur, puis envoyez une requête POST authentifiée à /api/v1/model/generateVideo. Utilisez l’ID de prédiction renvoyé pour suivre le traitement et récupérer l’URL de la vidéo dans outputs une fois la génération terminée.
Choisissez T2V Master lorsqu’un prompt textuel constitue votre entrée principale et que la gestion de mouvements complexes ou le rendu dynamique de la caméra sont importants. Pour l’animation d’images, Standard vise des brouillons rapides en 720p, Pro offre un équilibre entre rapidité et fidélité, Master privilégie la continuité des mouvements et la profondeur visuelle, tandis que start/end Pro contrôle les deux images limites.
Les contrôles disponibles incluent les prompts, les prompts négatifs, des durées de cinq ou dix secondes et l’échelle de guidage. T2V Master propose également les formats d’image 16:9, 9:16 et 1:1, tandis que les entrées image acceptent des fichiers JPG, JPEG ou PNG allant jusqu’à 10 MB, avec une résolution minimale de 300 par 300 pixels. L’endpoint start/end requiert en outre une image de fin.
Les tarifs de base standard vérifiés sont de $0.056 pour I2V Standard, de $0.098 pour I2V Pro et start/end Pro, et de $0.28 pour chacun des deux endpoints Master. Il s’agit des tarifs initialement publiés, et non de prix temporairement remisés ; vérifiez donc l’estimation actuelle de la requête avant de l’envoyer.
Envoyez d’abord la requête de génération : Atlas Cloud renverra un ID de prédiction au lieu de la vidéo finale. Interrogez /api/v1/model/prediction/{prediction_id} jusqu’à ce que le statut soit completed ou succeeded, puis lisez l’URL générée dans outputs.
Fournissez simultanément image et end_image à l’endpoint start/end-frame, avec un prompt. Ces images limites guident la continuité des mouvements et la transition au fil de la séquence générée. Chaque image doit respecter les exigences documentées en matière de format, de taille de fichier et de résolution.
Non. Considérez toute fonctionnalité affichée dans une application grand public Kling comme indisponible dans cette famille Atlas Cloud, sauf si elle apparaît dans le schéma de l’endpoint sélectionné. Par exemple, les schémas publiés pour ces cinq endpoints n’exposent pas de contrôles Multi-Elements.
Commencez par vérifier que l’ID du modèle, l’image source, le prompt, le prompt négatif, la durée, l’échelle de guidage et le format d’image, le cas échéant, correspondent. Les schémas Atlas Cloud publiés n’exposent aucun paramètre seed pour ces endpoints ; il n’est donc pas possible de configurer une reproduction déterministe exacte à l’aide des contrôles répertoriés.
Guides, tutoriels et actualités produit pour tirer le meilleur d'Atlas Cloud.