
L’API LTX-2 met en production la famille de modèles vidéo open-weight de Lightricks, en générant la vidéo et l’audio synchronisé en un seul passage. Générez à partir d’un texte, animez une image fixe ou prolongez un clip existant : chaque résultat est fourni avec une synchronisation labiale, des bruitages et un son d’ambiance parfaitement assortis. Sur Atlas Cloud, vous y accédez avec une seule clé compatible OpenAI, une tarification transparente à l’usage et un accès Day-0. Commencez à développer dès aujourd’hui.
Atlas Cloud vous offre les derniers modèles créatifs de pointe de l'industrie.
Comparez toutes les modalités de l’API Ltx-2 dans une seule vue, de la génération pilotée par prompt à l’animation d’images fixes et à la continuation de clips existants, chacune avec audio synchronisé en option.
| Modalité | Description |
|---|---|
| Ltx-2 T2V API (texte vers vidéo) | Fournissez un prompt textuel de jusqu’à 2,000 caractères, et l’API Ltx-2 renvoie une vidéo entièrement rendue, avec audio synchronisé en option lorsque generate_audio est activé. La durée du clip s’échelonne de 25 à 257 frames, et six préréglages de résolution couvrent les sorties carrées, portrait 9:16 et paysage 16:9. Ce point de terminaison convient aux concepts publicitaires, aux formats courts pour les réseaux sociaux et aux aperçus de storyboard créés entièrement à partir d’une description écrite, avec un tarif de base standard de $0.002. |
| Ltx-2 I2V API (image vers vidéo) | Fournissez une image fixe au format jpg, png, webp, gif ou avif avec un prompt de mouvement, et ce point de terminaison l’anime en un clip vidéo avec génération audio en option. La même plage de 25 à 257 frames et les six préréglages de ratio d’aspect s’appliquent, de sorte qu’une seule image source devient une vidéo paysage ou verticale. Les photos produit, portraits de personnages et concept arts sont des entrées naturelles, le tout au prix de base standard de $0.002. |
| Ltx-2 Extend Video API | Lorsqu’un clip existant doit être prolongé, ce point de terminaison le continue vers l’avant ou vers l’arrière à partir d’une source mp4, mov, webm, m4v ou gif fournie. Il étend les séquences jusqu’à 481 frames, conserve le rythme d’origine grâce à match_input_fps et peut ajouter une couche d’audio généré. Utilisez-le pour allonger du b-roll, boucler des scènes ou créer des transitions entre des coupes, facturé au même tarif de base de $0.002. |
L’API Ltx-2 associe les modes de génération à partir de texte, d’image et d’extension à un audio synchronisé natif, à un nombre d’images contrôlable et à six préréglages de format d’image, le tout accessible via une seule clé compatible OpenAI, avec une tarification transparente à l’usage.
Décrivez une scène en 2,000 caractères maximum et l’API Ltx-2 transforme du texte brut en un clip animé et sonorisé, sans ressource de référence requise. Votre prompt pilote le sujet, le mouvement, l’éclairage et le comportement de la caméra, tandis qu’une seed optionnelle verrouille le résultat pour permettre des itérations reproductibles. Comme tout part du langage, c’est idéal pour le storyboard, les présentations de concept et l’exploration créative rapide lorsque vous avez une idée, mais pas encore de footage.
Fournissez une seule image fixe en jpg, png, webp, gif ou avif, et le modèle l’anime en vidéo avec un audio assorti. Le prompt indique comment l’image doit se mettre en mouvement, d’un lent travelling avant à une véritable séquence d’action, tout en préservant la composition d’origine. Les photographes, designers et équipes produit s’en servent pour transformer une seule image hero en contenu animé partageable, sans rien retourner.
Téléversez un clip existant et l’API Ltx-2 le prolonge vers l’avant ou vers l’arrière, en générant jusqu’à 481 images supplémentaires qui héritent du style et du rythme d’origine. L’option match_input_fps maintient les nouvelles séquences verrouillées sur la fréquence d’images de la source, afin que les raccords restent invisibles. C’est ainsi que de courtes prises deviennent des séquences longues, et que vous sauvez une scène qui s’est terminée un temps trop tôt.
Le nombre d’images est entièrement contrôlable, de 25 à 257 images dans les modes texte et image, toujours défini en multiples de huit plus un pour un échantillonnage propre. Six préréglages de résolution couvrent le carré HD en 1024 par 1024, un carré 512, le portrait 3:4, le portrait 9:16, le paysage 4:3 et le paysage 16:9, afin qu’un seul modèle serve le cinéma, les réseaux sociaux et les flux verticaux. Choisissez d’abord le format, puis laissez une seule requête renvoyer le bon cadrage.
Chaque requête passe par une seule clé compatible OpenAI sur Atlas Cloud, avec une tarification transparente à l’usage et sans abonnement. Transmettez une seed fixe avec le même prompt, et le modèle renvoie le même clip, transformant une génération imprévisible en une étape contrôlable et versionnable. L’accès Day-0 signifie que les nouvelles versions de l’API Ltx-2 sont appelables dès leur sortie, afin que les équipes puissent standardiser un pipeline vidéo et le faire évoluer sans gérer de GPU.
Envoyez un même prompt identique à la Ltx-2 API et à deux des modèles vidéo les plus populaires sur Atlas Cloud, puis comparez la façon dont chacun gère le mouvement, l’audio synchronisé et les détails cinématographiques à partir exactement des mêmes instructions.
Un macaque curieux file à travers un marché aux épices bondé de Marrakech à l’heure dorée et arrache le fez rouge vif d’un marchand posé sur un étal. Il bondit par-dessus des sacs ouverts de safran et de paprika, soulevant des nuages tourbillonnants de poussière orange, puis se fige au sommet d’un mât de auvent et jette un regard en arrière au moment où le marchand hilare se lance à sa poursuite. Ouvrir sur un plan de suivi en contre-plongée se faufilant derrière le singe à travers la foule, enchaîner par un panoramique fouetté sur le visage stupéfait du marchand, puis s’élever dans un ample plan à la grue au-dessus des étals tandis que la poussière scintille dans la lumière chaude. Style cinématographique réaliste, faible profondeur de champ, étalonnage riche aux tons terreux. Audio : brouhaha animé du marché, tintements de laiton et percussions rythmiques au tambour à main qui montent en intensité avec la poursuite. 16:9 aspect ratio.
Generated with Ltx 2.3 Quality on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Seedance 2.0 on Atlas Cloud
Une jeune coursière du ciel vêtue d’une cape cramoisie fluide saute du bord d’un temple de pierre flottant et chevauche une grue en papier mécanique à travers les nuages d’un canyon, zigzaguant entre des lanternes lumineuses à la dérive. Elle vire brutalement autour d’une aiguille rocheuse déchiquetée, attrape au vol une lettre scintillante, puis se replie dans un piqué abrupt tandis qu’un rival en planeur surgit de la brume juste derrière elle. Commencer par un POV à la première personne par-dessus son épaule au lancement de la grue, couper vers un plan de drone filant aux côtés du piqué, puis passer à un plan en contre-plongée depuis le bas lorsqu’elle redresse sa trajectoire et émerge dans une lumière solaire aveuglante. Style anime vibrant, cel-shaded, palette lumineuse de magic hour. Audio : vent rugissant, ailes de papier qui claquent et envolée orchestrale de cordes synchronisée avec le redressement. 16:9 aspect ratio.
Generated with Ltx 2.3 Quality on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Seedance 2.0 on Atlas Cloud
Des prompts textuels et visuels aux montages étendus avec son synchronisé, l’API Ltx-2 couvre tout le parcours, du premier brouillon à la livraison en 4K pour le marketing, l’e-commerce et la production créative.
Un simple prompt écrit permet à l’API Ltx-2 de produire une vidéo 4K native avec audio généré directement. Les studios et équipes publicitaires transforment leurs briefs de campagne en spots sociaux finalisés, sans caméras ni montage manuel.
Importez une seule image fixe : la génération image-to-video la met en mouvement, en conservant la composition source tout en ajoutant des mouvements de caméra réalistes. Les vendeurs e-commerce et les illustrateurs donnent vie à des catalogues et portfolios statiques pour des fils d’actualité qui captent l’attention.
Besoin d’une prise plus longue ? L’endpoint extend-video ajoute de nouvelles images à un clip existant tout en préservant la continuité du mouvement, du style et de l’audio. Les créateurs assemblent de courtes générations en récits fluides qui dépassent les limites d’une seule requête.
Quand le son est essentiel, l’API Ltx-2 synthétise dialogues, bruitages et ambiance sonore en un seul passage avec les visuels, parfaitement calés sur le mouvement. Idéal pour les vidéos explicatives, les bandes-annonces et les scènes qui exigent un son au bon moment.
Pour la livraison finale, l’API Ltx-2 rend des images 4K natives avec des mouvements nets et des textures précises, plutôt que des aperçus upscalés. Les agences et studios exportent des masters prêts pour la diffusion directement depuis l’endpoint vers leurs pipelines de montage.
Comme LTX-2 est un modèle open source efficace, les tâches à fort volume s’exécutent avec une tarification transparente au paiement à l’usage, tandis que vous changez de mode de performance requête par requête. Les équipes produit prototypent à moindre coût, puis augmentent la fidélité pour la mise en production.
Comparez l’API Ltx-2 à des modèles vidéo comparables pilotés par texte et image sur Atlas Cloud, selon les modes de génération, la résolution, l’audio natif, la durée des clips et le prix de départ.
| Modèle | Modes de génération | Résolution maximale | Audio synchronisé | Durée maximale du clip | Prix de départ |
|---|---|---|---|---|---|
| LTX-2.3 Quality Text-to-Video | Texte vers vidéo | Préréglages 1024×1024 (16:9 par défaut) | √ (bascule facultative) | Jusqu’à 257 images | $0.002 |
| LTX-2.3 Quality Image-to-Video | Image vers vidéo, extension | Préréglages 1024×1024 (16:9 par défaut) | √ (bascule facultative) | Jusqu’à 257 images | $0.002 |
| Seedance 2.0 Text-to-Video | Texte vers vidéo | Jusqu’à 2K | √ natif | 4 à 15 s | $0.112 |
| Veo 3.1 Text-to-Video | Texte vers vidéo | Jusqu’à 4K | √ natif | 8 s (extensible) | $0.2 |
| Kling Video O3 4K Text-to-Video | Texte et image vers vidéo | 4K natif (3840×2160) | √ natif | 3 à 15 s | $0.42 |
Soyez opérationnel en quelques minutes — suivez ces étapes simples pour intégrer et déployer des modèles via la plateforme Atlas Cloud.
Inscrivez-vous sur atlascloud.ai et complétez la vérification. Les nouveaux utilisateurs reçoivent des crédits gratuits pour explorer la plateforme et tester les modèles.
Combiner les modèles Ltx-2 avancés avec la plateforme accélérée par GPU d'Atlas Cloud offre des performances, une évolutivité et une expérience développeur inégalées.
Faible Latence :
Inférence optimisée par GPU pour un raisonnement en temps réel.
API Unifiée :
Exécutez Ltx-2, GPT, Gemini et DeepSeek avec une seule intégration.
Tarification Transparente :
Facturation prévisible par token avec options serverless.
Expérience Développeur :
SDK, analytiques, outils de fine-tuning et modèles.
Fiabilité :
99,99% de disponibilité, RBAC et journalisation conforme.
Sécurité et Conformité :
SOC 2 Type II, alignement HIPAA, souveraineté des données aux États-Unis.
La Ltx-2 API donne aux développeurs un accès programmatique à LTX-2, le modèle fondation audio-vidéo à poids ouverts de Lightricks. Elle transforme des prompts textuels ou des images en vidéo et audio synchronisés en une seule passe de génération et, sur Atlas Cloud, vous y accédez via un endpoint compatible OpenAI, avec une tarification à l’usage.
LTX-2 couvre la génération text-to-video, image-to-video et l’extension de clips : vous pouvez donc transformer une scène écrite en séquence animée, animer une image fixe ou prolonger un plan existant. Chaque mode peut générer l’audio associé, ce qui en fait une solution adaptée aux courts métrages, publicités, démos produit et contenus pour les réseaux sociaux.
Oui. L’audio et la vidéo sont produits en une seule passe synchronisée, au lieu d’être assemblés après coup, avec prise en charge de la synchronisation labiale des dialogues, des effets sonores et de l’ambiance sonore. Sur Atlas Cloud, vous l’activez avec le paramètre generate_audio, désactivé par défaut.
Le modèle LTX-2 atteint nativement jusqu’à une résolution 4K à jusqu’à 50 fps, avec des clips pouvant durer jusqu’à 20 secondes à des fréquences d’images de 24, 25, 48 et 50. Sur Atlas Cloud, les endpoints quality vous permettent de choisir le format d’image et de définir la durée du clip via un nombre d’images compris entre 25 et 257 frames.
Envoyez une requête standard à l’endpoint Atlas Cloud avec votre prompt, un modèle comme ltx-2.3-quality/text-to-video, un format d’image, un nombre d’images et, facultativement, une seed pour obtenir un résultat reproductible. Comme l’endpoint est compatible OpenAI, une seule clé fonctionne avec la Ltx-2 API et tous les autres modèles de la plateforme ; l’intégration prend donc généralement quelques minutes.
Absolument. Le modèle ltx-2.3-quality/extend-video prolonge un clip LTX-2 existant tout en conservant la cohérence du mouvement et de l’audio au-delà de la durée initiale. C’est utile lorsqu’une génération unique est plus courte que la durée réellement nécessaire pour une scène.
LTX-2 est fourni avec des poids ouverts et est suffisamment efficace pour fonctionner sur des GPU grand public ; l’auto-hébergement est donc une véritable option. Si vous préférez éviter le provisionnement de GPU, la gestion des files d’attente et le passage à l’échelle, l’API hébergée fournit le même modèle sans infrastructure à maintenir.
Atlas Cloud facture la Ltx-2 API à l’usage, avec une tarification transparente par appel, sans abonnement ni engagement minimum. Vous ne payez que ce que vous générez, et la même clé vous donne un accès Day-0 aux nouvelles versions de modèles. Commencez à construire dès aujourd’hui.
LTX-2.3 est l’itération actuelle de la famille LTX-2 et la version servie par Atlas Cloud via ses endpoints quality text-to-video, image-to-video et extend-video. Elle améliore la version initiale tout en conservant la même approche audio-vidéo synchronisée, afin de vous offrir la meilleure qualité disponible sans modifier la façon dont vous appelez le modèle.