DEUX SEMAINES SEULEMENT | 20 % DE RÉDUCTION sur Seedream 5.0 Pro !
LTX-2 API for Synchronized Audio and Video

LTX-2 API for Synchronized Audio and Video

L’API LTX-2 met en production la famille de modèles vidéo open-weight de Lightricks, en générant la vidéo et l’audio synchronisé en un seul passage. Générez à partir d’un texte, animez une image fixe ou prolongez un clip existant : chaque résultat est fourni avec une synchronisation labiale, des bruitages et un son d’ambiance parfaitement assortis. Sur Atlas Cloud, vous y accédez avec une seule clé compatible OpenAI, une tarification transparente à l’usage et un accès Day-0. Commencez à développer dès aujourd’hui.

Explorez les Modèles Leaders

Atlas Cloud vous offre les derniers modèles créatifs de pointe de l'industrie.

Points de terminaison de l’API Ltx-2 côte à côte : texte, image et extension vidéo

Comparez toutes les modalités de l’API Ltx-2 dans une seule vue, de la génération pilotée par prompt à l’animation d’images fixes et à la continuation de clips existants, chacune avec audio synchronisé en option.

ModalitéDescription
Ltx-2 T2V API (texte vers vidéo)Fournissez un prompt textuel de jusqu’à 2,000 caractères, et l’API Ltx-2 renvoie une vidéo entièrement rendue, avec audio synchronisé en option lorsque generate_audio est activé. La durée du clip s’échelonne de 25 à 257 frames, et six préréglages de résolution couvrent les sorties carrées, portrait 9:16 et paysage 16:9. Ce point de terminaison convient aux concepts publicitaires, aux formats courts pour les réseaux sociaux et aux aperçus de storyboard créés entièrement à partir d’une description écrite, avec un tarif de base standard de $0.002.
Ltx-2 I2V API (image vers vidéo)Fournissez une image fixe au format jpg, png, webp, gif ou avif avec un prompt de mouvement, et ce point de terminaison l’anime en un clip vidéo avec génération audio en option. La même plage de 25 à 257 frames et les six préréglages de ratio d’aspect s’appliquent, de sorte qu’une seule image source devient une vidéo paysage ou verticale. Les photos produit, portraits de personnages et concept arts sont des entrées naturelles, le tout au prix de base standard de $0.002.
Ltx-2 Extend Video APILorsqu’un clip existant doit être prolongé, ce point de terminaison le continue vers l’avant ou vers l’arrière à partir d’une source mp4, mov, webm, m4v ou gif fournie. Il étend les séquences jusqu’à 481 frames, conserve le rythme d’origine grâce à match_input_fps et peut ajouter une couche d’audio généré. Utilisez-le pour allonger du b-roll, boucler des scènes ou créer des transitions entre des coupes, facturé au même tarif de base de $0.002.

Audio et vidéo générés ensemble par l’API Ltx-2

L’API Ltx-2 associe les modes de génération à partir de texte, d’image et d’extension à un audio synchronisé natif, à un nombre d’images contrôlable et à six préréglages de format d’image, le tout accessible via une seule clé compatible OpenAI, avec une tarification transparente à l’usage.

Du texte à une scène finalisée avec l’API Ltx-2

Décrivez une scène en 2,000 caractères maximum et l’API Ltx-2 transforme du texte brut en un clip animé et sonorisé, sans ressource de référence requise. Votre prompt pilote le sujet, le mouvement, l’éclairage et le comportement de la caméra, tandis qu’une seed optionnelle verrouille le résultat pour permettre des itérations reproductibles. Comme tout part du langage, c’est idéal pour le storyboard, les présentations de concept et l’exploration créative rapide lorsque vous avez une idée, mais pas encore de footage.

Donnez vie à n’importe quelle image fixe

Fournissez une seule image fixe en jpg, png, webp, gif ou avif, et le modèle l’anime en vidéo avec un audio assorti. Le prompt indique comment l’image doit se mettre en mouvement, d’un lent travelling avant à une véritable séquence d’action, tout en préservant la composition d’origine. Les photographes, designers et équipes produit s’en servent pour transformer une seule image hero en contenu animé partageable, sans rien retourner.

Prolongez vos clips de façon fluide avec l’API Ltx-2

Téléversez un clip existant et l’API Ltx-2 le prolonge vers l’avant ou vers l’arrière, en générant jusqu’à 481 images supplémentaires qui héritent du style et du rythme d’origine. L’option match_input_fps maintient les nouvelles séquences verrouillées sur la fréquence d’images de la source, afin que les raccords restent invisibles. C’est ainsi que de courtes prises deviennent des séquences longues, et que vous sauvez une scène qui s’est terminée un temps trop tôt.

Nombre d’images et formats d’image selon vos besoins

Le nombre d’images est entièrement contrôlable, de 25 à 257 images dans les modes texte et image, toujours défini en multiples de huit plus un pour un échantillonnage propre. Six préréglages de résolution couvrent le carré HD en 1024 par 1024, un carré 512, le portrait 3:4, le portrait 9:16, le paysage 4:3 et le paysage 16:9, afin qu’un seul modèle serve le cinéma, les réseaux sociaux et les flux verticaux. Choisissez d’abord le format, puis laissez une seule requête renvoyer le bon cadrage.

Une seule clé et des exécutions reproductibles avec l’API Ltx-2

Chaque requête passe par une seule clé compatible OpenAI sur Atlas Cloud, avec une tarification transparente à l’usage et sans abonnement. Transmettez une seed fixe avec le même prompt, et le modèle renvoie le même clip, transformant une génération imprévisible en une étape contrôlable et versionnable. L’accès Day-0 signifie que les nouvelles versions de l’API Ltx-2 sont appelables dès leur sortie, afin que les équipes puissent standardiser un pipeline vidéo et le faire évoluer sans gérer de GPU.

Un prompt, trois moteurs : mettez la Ltx-2 API face à face

Envoyez un même prompt identique à la Ltx-2 API et à deux des modèles vidéo les plus populaires sur Atlas Cloud, puis comparez la façon dont chacun gère le mouvement, l’audio synchronisé et les détails cinématographiques à partir exactement des mêmes instructions.

Prompt

Un macaque curieux file à travers un marché aux épices bondé de Marrakech à l’heure dorée et arrache le fez rouge vif d’un marchand posé sur un étal. Il bondit par-dessus des sacs ouverts de safran et de paprika, soulevant des nuages tourbillonnants de poussière orange, puis se fige au sommet d’un mât de auvent et jette un regard en arrière au moment où le marchand hilare se lance à sa poursuite. Ouvrir sur un plan de suivi en contre-plongée se faufilant derrière le singe à travers la foule, enchaîner par un panoramique fouetté sur le visage stupéfait du marchand, puis s’élever dans un ample plan à la grue au-dessus des étals tandis que la poussière scintille dans la lumière chaude. Style cinématographique réaliste, faible profondeur de champ, étalonnage riche aux tons terreux. Audio : brouhaha animé du marché, tintements de laiton et percussions rythmiques au tambour à main qui montent en intensité avec la poursuite. 16:9 aspect ratio.

Generated with Ltx 2.3 Quality on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Prompt

Une jeune coursière du ciel vêtue d’une cape cramoisie fluide saute du bord d’un temple de pierre flottant et chevauche une grue en papier mécanique à travers les nuages d’un canyon, zigzaguant entre des lanternes lumineuses à la dérive. Elle vire brutalement autour d’une aiguille rocheuse déchiquetée, attrape au vol une lettre scintillante, puis se replie dans un piqué abrupt tandis qu’un rival en planeur surgit de la brume juste derrière elle. Commencer par un POV à la première personne par-dessus son épaule au lancement de la grue, couper vers un plan de drone filant aux côtés du piqué, puis passer à un plan en contre-plongée depuis le bas lorsqu’elle redresse sa trajectoire et émerge dans une lumière solaire aveuglante. Style anime vibrant, cel-shaded, palette lumineuse de magic hour. Audio : vent rugissant, ailes de papier qui claquent et envolée orchestrale de cordes synchronisée avec le redressement. 16:9 aspect ratio.

Generated with Ltx 2.3 Quality on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Produire des vidéos et de l’audio prêts pour la production avec l’API Ltx-2

Des prompts textuels et visuels aux montages étendus avec son synchronisé, l’API Ltx-2 couvre tout le parcours, du premier brouillon à la livraison en 4K pour le marketing, l’e-commerce et la production créative.

Du prompt à la vidéo avec l’API Ltx-2

Un simple prompt écrit permet à l’API Ltx-2 de produire une vidéo 4K native avec audio généré directement. Les studios et équipes publicitaires transforment leurs briefs de campagne en spots sociaux finalisés, sans caméras ni montage manuel.

Animer des images fixes

Importez une seule image fixe : la génération image-to-video la met en mouvement, en conservant la composition source tout en ajoutant des mouvements de caméra réalistes. Les vendeurs e-commerce et les illustrateurs donnent vie à des catalogues et portfolios statiques pour des fils d’actualité qui captent l’attention.

Étendre des clips en scènes plus longues

Besoin d’une prise plus longue ? L’endpoint extend-video ajoute de nouvelles images à un clip existant tout en préservant la continuité du mouvement, du style et de l’audio. Les créateurs assemblent de courtes générations en récits fluides qui dépassent les limites d’une seule requête.

Son synchronisé via l’API Ltx-2

Quand le son est essentiel, l’API Ltx-2 synthétise dialogues, bruitages et ambiance sonore en un seul passage avec les visuels, parfaitement calés sur le mouvement. Idéal pour les vidéos explicatives, les bandes-annonces et les scènes qui exigent un son au bon moment.

Masters 4K depuis l’API Ltx-2

Pour la livraison finale, l’API Ltx-2 rend des images 4K natives avec des mouvements nets et des textures précises, plutôt que des aperçus upscalés. Les agences et studios exportent des masters prêts pour la diffusion directement depuis l’endpoint vers leurs pipelines de montage.

Génération par lots à grande échelle et à coût maîtrisé

Comme LTX-2 est un modèle open source efficace, les tâches à fort volume s’exécutent avec une tarification transparente au paiement à l’usage, tandis que vous changez de mode de performance requête par requête. Les équipes produit prototypent à moindre coût, puis augmentent la fidélité pour la mise en production.

L’API Ltx-2 face aux autres modèles vidéo de production

Comparez l’API Ltx-2 à des modèles vidéo comparables pilotés par texte et image sur Atlas Cloud, selon les modes de génération, la résolution, l’audio natif, la durée des clips et le prix de départ.

ModèleModes de générationRésolution maximaleAudio synchroniséDurée maximale du clipPrix de départ
LTX-2.3 Quality Text-to-VideoTexte vers vidéoPréréglages 1024×1024 (16:9 par défaut)√ (bascule facultative)Jusqu’à 257 images$0.002
LTX-2.3 Quality Image-to-VideoImage vers vidéo, extensionPréréglages 1024×1024 (16:9 par défaut)√ (bascule facultative)Jusqu’à 257 images$0.002
Seedance 2.0 Text-to-VideoTexte vers vidéoJusqu’à 2K√ natif4 à 15 s$0.112
Veo 3.1 Text-to-VideoTexte vers vidéoJusqu’à 4K√ natif8 s (extensible)$0.2
Kling Video O3 4K Text-to-VideoTexte et image vers vidéo4K natif (3840×2160)√ natif3 à 15 s$0.42

Comment utiliser Ltx-2 sur Atlas Cloud

Soyez opérationnel en quelques minutes — suivez ces étapes simples pour intégrer et déployer des modèles via la plateforme Atlas Cloud.

Créer un compte Atlas Cloud

Inscrivez-vous sur atlascloud.ai et complétez la vérification. Les nouveaux utilisateurs reçoivent des crédits gratuits pour explorer la plateforme et tester les modèles.

Pourquoi Utiliser Ltx-2 sur Atlas Cloud

Combiner les modèles Ltx-2 avancés avec la plateforme accélérée par GPU d'Atlas Cloud offre des performances, une évolutivité et une expérience développeur inégalées.

Performance et Flexibilité

Faible Latence :
Inférence optimisée par GPU pour un raisonnement en temps réel.

API Unifiée :
Exécutez Ltx-2, GPT, Gemini et DeepSeek avec une seule intégration.

Tarification Transparente :
Facturation prévisible par token avec options serverless.

Entreprise et Échelle

Expérience Développeur :
SDK, analytiques, outils de fine-tuning et modèles.

Fiabilité :
99,99% de disponibilité, RBAC et journalisation conforme.

Sécurité et Conformité :
SOC 2 Type II, alignement HIPAA, souveraineté des données aux États-Unis.

Ltx-2 API : réponses aux questions fréquentes des développeurs

La Ltx-2 API donne aux développeurs un accès programmatique à LTX-2, le modèle fondation audio-vidéo à poids ouverts de Lightricks. Elle transforme des prompts textuels ou des images en vidéo et audio synchronisés en une seule passe de génération et, sur Atlas Cloud, vous y accédez via un endpoint compatible OpenAI, avec une tarification à l’usage.

LTX-2 couvre la génération text-to-video, image-to-video et l’extension de clips : vous pouvez donc transformer une scène écrite en séquence animée, animer une image fixe ou prolonger un plan existant. Chaque mode peut générer l’audio associé, ce qui en fait une solution adaptée aux courts métrages, publicités, démos produit et contenus pour les réseaux sociaux.

Oui. L’audio et la vidéo sont produits en une seule passe synchronisée, au lieu d’être assemblés après coup, avec prise en charge de la synchronisation labiale des dialogues, des effets sonores et de l’ambiance sonore. Sur Atlas Cloud, vous l’activez avec le paramètre generate_audio, désactivé par défaut.

Le modèle LTX-2 atteint nativement jusqu’à une résolution 4K à jusqu’à 50 fps, avec des clips pouvant durer jusqu’à 20 secondes à des fréquences d’images de 24, 25, 48 et 50. Sur Atlas Cloud, les endpoints quality vous permettent de choisir le format d’image et de définir la durée du clip via un nombre d’images compris entre 25 et 257 frames.

Envoyez une requête standard à l’endpoint Atlas Cloud avec votre prompt, un modèle comme ltx-2.3-quality/text-to-video, un format d’image, un nombre d’images et, facultativement, une seed pour obtenir un résultat reproductible. Comme l’endpoint est compatible OpenAI, une seule clé fonctionne avec la Ltx-2 API et tous les autres modèles de la plateforme ; l’intégration prend donc généralement quelques minutes.

Absolument. Le modèle ltx-2.3-quality/extend-video prolonge un clip LTX-2 existant tout en conservant la cohérence du mouvement et de l’audio au-delà de la durée initiale. C’est utile lorsqu’une génération unique est plus courte que la durée réellement nécessaire pour une scène.

LTX-2 est fourni avec des poids ouverts et est suffisamment efficace pour fonctionner sur des GPU grand public ; l’auto-hébergement est donc une véritable option. Si vous préférez éviter le provisionnement de GPU, la gestion des files d’attente et le passage à l’échelle, l’API hébergée fournit le même modèle sans infrastructure à maintenir.

Atlas Cloud facture la Ltx-2 API à l’usage, avec une tarification transparente par appel, sans abonnement ni engagement minimum. Vous ne payez que ce que vous générez, et la même clé vous donne un accès Day-0 aux nouvelles versions de modèles. Commencez à construire dès aujourd’hui.

LTX-2.3 est l’itération actuelle de la famille LTX-2 et la version servie par Atlas Cloud via ses endpoints quality text-to-video, image-to-video et extend-video. Elle améliore la version initiale tout en conservant la même approche audio-vidéo synchronisée, afin de vous offrir la meilleure qualité disponible sans modifier la façon dont vous appelez le modèle.

Explorer Plus de Familles

Seedance 2.0

L'API Seedance 2.0 vous donne un accès en production au modèle vidéo multimodal de ByteDance — des entrées quadrimodales (texte, image, vidéo, audio) et un système « Universal Reference » leader du secteur qui verrouille la composition, les mouvements de caméra et les actions des personnages à travers les plans. Intégrez un contrôle de niveau réalisateur avec un seul appel d'API, un tarif fixe de 0,09 $/s, une clé instantanée et aucune liste d'attente — le tout soutenu par une disponibilité et une conformité de niveau entreprise. Seedance 2.0 Native 4K est désormais disponible !

Voir la Famille

Grok Imagine

La Grok Imagine API offre aux développeurs la génération d'images, de vidéos et d'audio de xAI dans une seule suite. Elle produit des images jusqu'à 2K avec un rendu de texte multilingue, ainsi que des vidéos allant jusqu'à 15 secondes avec un audio natif synchronisé et une édition basée sur des références. Sur Atlas Cloud, une seule clé exécute chaque mode Grok Imagine, ce qui vous permet de passer d'une image, d'une vidéo et d'un audio à l'autre sans configuration distincte, à partir de 0,02 $ par image et 0,05 $ par seconde.

Voir la Famille

Gemini Omni Flash

La Gemini Omni API apporte à votre stack le modèle multimodal de génération et d'édition vidéo de Google DeepMind, présenté à Google I/O 2026. Gemini Omni fusionne le moteur de raisonnement de Gemini avec les médias génératifs : il accepte n'importe quelle combinaison de texte, d'images, de vidéo et d'audio pour produire des résultats cohérents et ancrés dans la connaissance. Affinez vos résultats par simple conversation — remplacez des objets, réécrivez des scènes, changez de style — tandis que la physique, les personnages et la continuité restent intacts. Atlas Cloud propose toute la gamme Gemini Omni Flash — texte vers vidéo, image vers vidéo avec jusqu'à 7 images de référence, et référence vers vidéo — via une API unifiée, avec une tarification transparente à la seconde à partir de $0.112 et sans abonnement. Commencez à développer dès aujourd'hui.

Voir la Famille

GPT Image 2

L'API GPT Image 2 offre aux développeurs un accès au dernier modèle d'image d'OpenAI, le successeur de GPT Image 1.5. Elle génère et modifie des images avec un rendu de texte précis pour les caractères latins et CJK, ainsi qu'une composition solide pour les affiches, les maquettes et les infographies. Sur Atlas Cloud, vous y accédez via une API unifiée aux côtés de plus de 300 modèles, avec des crédits gratuits, une disponibilité de 99,99 % et sans aucune vérification d'organisation OpenAI requise.

Voir la Famille

Google

Les modèles créatifs les plus puissants de Google sont tous disponibles sur Atlas Cloud. Veo 3.1 offre une génération de vidéos cinématographiques, Nano Banana 2 permet de créer des images haute fidélité, et Gemini apporte une intelligence multimodale à chaque flux de travail. Accédez à la suite complète de modèles Google via une seule API key avec une disponibilité Day-0 et une tarification à l'usage (pay-as-you-go).

Voir la Famille

Seedance 2.0 Mini

Seedance 2.0 Mini apporte la génération de vidéos multimodale de ByteDance aux flux de travail où la vitesse et les coûts sont primordiaux. Il offre les capacités de base de Seedance 2.0 avec une empreinte plus légère — une génération plus rapide, un coût par vidéo réduit et la même intégration API que celle que vous utilisez déjà. Pour les équipes qui gèrent des pipelines à haut volume ou du prototypage à grande échelle, Mini est le choix par défaut pratique.

Voir la Famille

ByteDance

De la génération de vidéos cinématiques à la création d'images haute fidélité, les modèles les plus puissants de ByteDance sont disponibles sur Atlas Cloud. Exécutez Seedance et Seedream à grande échelle avec les prix d'inférence les plus bas et aucune surcharge d'infrastructure.

Voir la Famille

Alibaba

Atlas Cloud rassemble l'ensemble de la gamme de modèles d'Alibaba sous une seule API : Qwen pour les tâches linguistiques et d'imagerie, et Wan pour la génération de vidéos jusqu'en 1080p. Accédez à chaque modèle avec une tarification à l'usage (pay-as-you-go) sans abonnement. L'API Alibaba est disponible via une URL de base unique en utilisant votre client existant compatible avec OpenAI.

Voir la Famille

OpenAI

Atlas Cloud vous donne accès à l'ensemble de la gamme de l'API OpenAI, de GPT Image 2 pour la génération d'images à Sora 2 pour la vidéo. Chaque modèle est disponible en paiement à l'usage sans engagement mensuel. Intégrez-le en remplaçant simplement l'URL de base à l'aide de l'API compatible OpenAI.

Voir la Famille

xAI

Créez des pipelines complets d'images et de vidéos en utilisant la xAI API sur Atlas Cloud. Générez en 2K, éditez avec des images de référence et animez des images en clips synchronisés avec l'audio.

Voir la Famille

Kwaivgi

L'API Kwaivgi à 15 % en dessous du tarif standard. Atlas Cloud offre un accès Day-0 aux nouvelles versions de Kling avec une tarification à l'usage et sans limite de postes. Un seul compte, une seule clé, tous les modèles Kling du niveau standard au niveau master.

Voir la Famille

Seedream 5.0 Pro

L'API Seedream 5.0 Pro offre aux développeurs le modèle d'édition d'images contrôlable de ByteDance sur Atlas Cloud. Elle positionne les modifications avec précision à l'aide d'ancrages et de coordonnées, sépare les images en calques modifiables, fusionne de multiples références et fait correspondre les couleurs et matériaux exacts, avec du texte multilingue en 2K et 3K. Sur Atlas Cloud, vous y accédez via une seule clé !

Voir la Famille

Une seule API pour toute l'IA multimédia.

Explorer tous les modèles