Seedance 2.5 est maintenant en ligne — En avant-première sur Atlas Cloud
Hero background 1Hero background 2Hero background 3

FLUX 3 API: 20-Second Video With Native Audio

L’API FLUX 3 apporte à votre stack le tout nouveau modèle de base de Black Forest Labs, une architecture Self-Flow unique entraînée conjointement sur des images, de la vidéo et de l’audio. Générez en un seul passage des clips allant jusqu’à 20 secondes avec dialogues multilingues, effets sonores et ambiance, ou produisez des rendus texte vers image avec une typographie précise. Atlas Cloud le propose avec une seule clé compatible OpenAI, une tarification à l’appel au fil de l’eau et un accès dès le premier jour.

Explorez les Modèles Leaders

Atlas Cloud vous offre les derniers modèles créatifs de pointe de l'industrie.

Tous les endpoints de l’API FLUX 3, modalité par modalité

Cinq endpoints vidéo sont regroupés derrière une seule surface d’API FLUX 3, et le tableau ci-dessous indique ce que chacun reçoit, ce qu’il renvoie et son coût par seconde.

ModalitéDescription
FLUX 3 T2V API (texte vers vidéo)Les prompts textuels deviennent des clips de 5 à 20 secondes avec de l’audio généré lors du même passage, puisque generate_audio est activé par défaut. La sortie est en 720p ou 1080p, avec sept formats d’image fixes de 21:9 à 9:16, plus une option auto, et une valeur de seed permet de reproduire n’importe quel résultat. Le tarif est de $0.17 par seconde de vidéo générée.
FLUX 3 I2V API (image vers vidéo)Fournissez une seule image PNG, JPEG ou WebP, et le modèle l’anime à partir de cette frame, en reprenant le mouvement et le rythme indiqués par le prompt. La durée est sélectionnable de 5 à 20 secondes, ce qui convient aux visuels produit, aux introductions de personnages et aux versions courtes pour les réseaux sociaux créées à partir d’illustrations que vous possédez déjà. La facturation est de $0.17 par seconde de vidéo générée.
FLUX 3 Keyframes API (images clés vers vidéo)Quand un plan doit respecter des moments précis, jusqu’à 10 images clés peuvent être ancrées à des positions de frame exactes sur une timeline à 24 fps. Chaque frame_index doit rester dans la limite de duration multipliée par 24, ce qui donne aux équipes de storyboard et de previz un contrôle direct sur ce qui apparaît et à quel moment. Le tarif est identique à celui des autres endpoints de génération : $0.17 par seconde de vidéo générée.
FLUX 3 FLF API (première et dernière frame vers vidéo)Besoin qu’un clip se termine sur une image finale exacte ? En passant start_image_url et end_image_url, vous verrouillez les deux extrémités du plan tandis que le modèle génère le mouvement entre les deux. Les révélations de logo, les séquences de transformation et les transitions de scène qui doivent correspondre aux plans environnants conviennent toutes à cet usage, à $0.17 par seconde de vidéo générée.
FLUX 3 Extend API (extension vidéo)Avec cet endpoint, une séquence existante prolonge l’histoire : un MP4 de moins de 50 MB et d’une durée inférieure à 15 secondes est continué à partir de ses dernières frames selon le prompt. L’audio continue d’être généré en même temps que l’image, et la même sortie en 720p ou 1080p ainsi que la plage de 5 à 20 secondes restent applicables. L’extension est facturée $0.41 par seconde de vidéo générée.

Vidéo, audio et direction dans un seul appel API FLUX 3

Conçu par Black Forest Labs sur un seul socle multimodal, l'API FLUX 3 renvoie jusqu'à vingt secondes de vidéo HD ou Full HD avec dialogue, effets sonores et ambiance générés dans le même passage, tout en acceptant des consignes sur les plans, les keyframes, les langues et le texte à l'écran au fil du processus.

Vingt secondes d'image et de son en un seul passage

Un seul appel renvoie de 5 à 20 secondes de vidéo avec l'audio généré dans le même passage, jamais ajouté en post-synchronisation. Le dialogue, les effets sonores et les nappes d'ambiance tombent sur l'image exacte où l'événement se produit, et la sortie arrive en 720p HD ou 1080p Full HD. C'est cette précision qui fait qu'une flamme dans un wok ou une porte qui claque paraissent filmées plutôt qu'assemblées.

Changements de scène et de caméra au sein d'une seule génération

Demandez une coupe et le modèle l'exécute. Les scènes et les angles de caméra changent au cours d'une même génération, tandis que le même personnage, la même garde-robe et la même logique d'éclairage se retrouvent dans chaque plan. Les formats plus longs reposent sur l'enchaînement agentique de clips, qui relie des générations distinctes en séquences d'une durée de plusieurs minutes. Les storyboards qui nécessitaient quatre rendus et un monteur reviennent désormais comme une pièce continue.

Cinq points d'entrée vers l'API FLUX 3

Du texte seul, une image fixe, une paire de première et dernière images, des keyframes placées sur la timeline, ou un clip existant à poursuivre : les cinq points d'entrée sont pris en charge. Les keyframes fixent ce qui se passe et à quel moment, tandis que la continuation repart d'un métrage que vous avez déjà en main. Les studios qui disposent de visuels de marque ou de montages à moitié finalisés peuvent partir de ces assets plutôt que de décrire chaque plan depuis zéro.

Des dialogues calés dans treize langues

Le dialogue natif couvre les dialectes de l'anglais, le chinois, l'espagnol, le français, l'allemand, le japonais, le portugais, le russe, l'italien, l'indonésien, le turc, l'hindi, le pendjabi et bien d'autres, avec des mouvements des lèvres adaptés à la langue demandée. La typographie est rendue directement dans la scène aussi, de sorte que les enseignes et les titres restent dans le cadre au lieu d'être composités plus tard. Une seule consigne peut donc livrer un spot localisé avec son lettrage déjà en place.

L'API FLUX 3 derrière une seule clé Atlas Cloud

Atlas Cloud expose FLUX 3 via le même endpoint unifié qui sert d'entrée au reste de son catalogue, de sorte qu'une seule clé donne accès aux modèles vidéo, image et langage sans deuxième intégration. La facturation reste en pay as you go, sans abonnement ni frais par siège, et vous ne payez que les générations que vous lancez réellement. Changer de modèle revient à modifier une chaîne. Commencez à construire dès aujourd'hui.

Un prompt, trois modèles : FLUX 3 API côte à côte

Chaque ligne ci-dessous exécute un prompt strictement identique via la FLUX 3 API et deux autres modèles vidéo sur Atlas Cloud, afin d’évaluer la continuité du mouvement, les changements de plan et l’audio natif sur le même brief plutôt que sur des démos triées sur le volet.

Prompt

Action réelle cinématographique, ruelle tokyoïte luisante de pluie la nuit. Un Shiba Inu portant un minuscule imperméable jaune descend l’allée en skateboard, slalomant entre les flaques et les bouches de vapeur. Ouvrir sur un travelling en contre-plongée rasant le bitume mouillé juste derrière la planche, avec les reflets de néons qui filent de part et d’autre. Le chien accroche une pile de lanternes en papier, qui s’envolent dans les airs, puis un panoramique fouetté suit l’une des lanternes en rotation alors qu’elle dégringole vers un stand de ramen. Couper sur un plan de drone qui monte et recule pendant que le Shiba abat une patte, fait pivoter la planche pour s’arrêter net, puis aboie une fois vers le chef ramen hilare, qui lui lance d’une pichenette une tranche de chashu que le chien attrape en plein vol. Lumière chaude du stand contre néons froids, projections d’eau rétroéclairées. Audio : pluie qui siffle, roues en uréthane grondant sur la pierre, wok qui grésille, un aboiement sec, un train qui passe quelque part au-dessus. Format 16:9.

Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud

Generated with Veo3.1 on Atlas Cloud

Generated with Kling v3.0 on Atlas Cloud

Prompt

Style anime peint à la main, midi éclatant au-dessus d’une mer de nuages infinie. Une adolescente pêcheuse du ciel se cale sur le pont d’un navire aérien en bois et lance une longue ligne vers la mer de nuages. Commencer par un POV à la première personne par-dessus la rambarde tandis que la ligne claque dans l’air et disparaît dans le blanc. La canne se tend brusquement, puis la caméra coupe sur une orbite rapide autour du pont pendant qu’elle est traînée sur les planches, la corde fumant à travers ses gants, une botte accrochée à une boucle de gréement. Elle plante un pied sur la rambarde et tire de toutes ses forces au moment où un koi de la taille d’une baleine jaillit des nuages derrière elle, ses écailles projetant une lumière arc-en-ciel sur les voiles. Terminer sur un plan héroïque en contre-plongée tandis que l’équipage explose de joie et que des embruns de nuage traversent le cadre. Cel shading pictural, lumière de contour chaude, texture de pinceau visible. Audio : vent qui s’engouffre, corde qui grince, montée orchestrale grandissante, grondement aquatique profond au moment du surgissement. Format 16:9.

Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud

Generated with Seedance 2.0 on Atlas Cloud

Generated with Kling v3.0 on Atlas Cloud

Là où les équipes mettent l’API FLUX 3 à contribution

Qu’il s’agisse d’un clip social de 20 secondes avec audio natif, d’un storyboard avec images clés, d’une déclinaison publicitaire localisée ou d’une passe d’ébauche rapide avant le rendu final, l’API FLUX 3 le prend en charge sur Atlas Cloud, avec une tarification à l’usage et un accès Day-0.

Des clips sociaux livrés avec leur propre son

Générez jusqu’à 20 secondes de vidéo à partir d’un simple prompt texte, avec voix, effets et ambiance produits en même temps que les images. Les équipes social media obtiennent un clip finalisé sans passe audio séparée.

Storyboards multi-plans via l’API FLUX 3

Des images clés ordonnées permettent à l’API FLUX 3 de faire évoluer une scène à travers des moments définis, en modifiant les angles de caméra et les décors au sein d’une même génération. Les storyboarders peuvent prévisualiser une séquence complète avant même de planifier un tournage.

Typographie et texte dans l’image

La typographie est rendue avec précision dans les scènes générées, et la gestion du texte multilingue s’améliore par rapport aux générations FLUX précédentes. Maquettes de packaging, cartons-titres et bannières localisées sortent d’un seul appel, prêtes à être relues.

Déclinaisons publicitaires localisées avec l’API FLUX 3

Besoin du même spot sur six marchés ? L’API FLUX 3 génère des dialogues multilingues synchronisés avec la vidéo, afin que chaque version dispose de sa propre piste voix localisée sans étape de doublage.

Une seconde vie pour les séquences existantes

Les séquences existantes peuvent être transposées dans de nouveaux contextes, prolongées avec un audio cohérent ou remodelées tout en conservant leurs éléments centraux. Les agences réactivent d’anciens assets de campagne au lieu de commander un nouveau tournage.

Passes d’ébauche économiques sur l’API FLUX 3

Le mode draft renvoie rapidement un aperçu HD à moindre coût, puis les plans approuvés peuvent être rendus à nouveau en HD ou FHD via l’API FLUX 3. L’itération reste abordable lorsqu’un concept nécessite vingt essais.

FLUX 3 API côte à côte avec d’autres modèles vidéo sur Atlas Cloud

Comparez la durée des clips, la résolution de sortie, l’audio natif et le coût par seconde pour voir où FLUX 3 API prend l’avantage et où un autre modèle Atlas Cloud peut mieux convenir à votre pipeline.

ModèleDurée maximale du clipRésolution de sortie maximaleAudio natifPrix par seconde
FLUX 3 Video (Text-to-Video)20 sFHD, jusqu’à 2 MP par image√ dialogues, SFX, ambiance$0.17 HD / $0.29 FHD
FLUX 3 Video (Video-to-Video)20 sFHD, jusqu’à 2 MP par image√ dialogues, SFX, ambiance$0.41 HD / $0.53 FHD
Seedance 2.0 Text-to-Video15 s4K (3840 x 2160)√ activé par défaut$0.112
Kling V3.0 Turbo Text-to-Video15 s1080p√ optionnel, désactivé par défaut$0.112
Wan-2.7 Text-to-video15 s1080p natif, 1440p-SR√ SFX, musique, ambiance$0.10
Veo3.1 Text-to-video8 s1080p√ audio synchronisé$0.20

Comment utiliser FLUX 3 sur Atlas Cloud

Soyez opérationnel en quelques minutes — suivez ces étapes simples pour intégrer et déployer des modèles via la plateforme Atlas Cloud.

Créer un compte Atlas Cloud

Inscrivez-vous sur atlascloud.ai et complétez la vérification. Les nouveaux utilisateurs reçoivent des crédits gratuits pour explorer la plateforme et tester les modèles.

Pourquoi Utiliser FLUX 3 sur Atlas Cloud

Combiner les modèles FLUX 3 avancés avec la plateforme accélérée par GPU d'Atlas Cloud offre des performances, une évolutivité et une expérience développeur inégalées.

Performance et Flexibilité

Faible Latence :
Inférence optimisée par GPU pour un raisonnement en temps réel.

API Unifiée :
Exécutez FLUX 3, GPT, Gemini et DeepSeek avec une seule intégration.

Tarification Transparente :
Facturation prévisible par token avec options serverless.

Entreprise et Échelle

Expérience Développeur :
SDK, analytiques, outils de fine-tuning et modèles.

Fiabilité :
99,99% de disponibilité, RBAC et journalisation conforme.

Sécurité et Conformité :
SOC 2 Type II, alignement HIPAA, souveraineté des données aux États-Unis.

Questions sur l'API FLUX 3, avec réponses pour les développeurs

FLUX 3 est le modèle fondation multimodal de Black Forest Labs, entraîné conjointement sur l'image, la vidéo, l'audio et la prédiction d'actions, au lieu d'être assemblé à partir de systèmes séparés. L'API FLUX 3 expose ce modèle via Atlas Cloud, de sorte qu'une seule requête renvoie une vidéo avec audio synchronisé. Une seule clé compatible OpenAI couvre ce modèle, ainsi que tous les autres du catalogue, avec une facturation à l'usage.

La vidéo est la capacité généralement disponible, avec le passage du texte à la vidéo, de l'image à la vidéo, des plans guidés par keyframes et de la continuité d'un clip existant, chacun avec audio natif en option. Black Forest Labs déploie la famille par phases, donc FLUX 3 Image et FLUX 3 Action arrivent après les endpoints vidéo, et non en même temps.

Créez un compte, générez une clé API, puis pointez votre client existant vers l'endpoint de l'API FLUX 3. Les requêtes suivent le même schéma compatible OpenAI utilisé dans tout le catalogue Atlas Cloud, donc il n'y a ni SDK séparé à apprendre, ni verrouillage fournisseur à défaire plus tard. La facturation se fait à l'utilisation, à la génération, sans abonnement à souscrire au préalable. Commencez à construire dès aujourd'hui.

Oui, et cela se fait dans le même passage de génération plutôt qu'au moyen d'un second modèle, ce qui maintient les dialogues, les effets sonores et l'ambiance en phase avec l'image. FLUX 3 gère la parole avec synchronisation labiale dans plus d'une douzaine de langues, dont l'anglais, le chinois, l'espagnol, le japonais et l'hindi. L'audio peut être désactivé par requête lorsque des images muettes suffisent.

Les générations vont de 5 à 20 secondes, avec une sortie en HD 720p et du Full HD 1080p disponible quand le niveau de détail compte plus que le coût. Les formats paysage, carré et vertical sont tous pris en charge, donc le même prompt peut viser une accroche de page d'accueil ou un fil mobile. Les récits plus longs sont mieux construits à partir de plusieurs clips maîtrisés plutôt que d'une seule requête trop volumineuse.

Fournissez une image de départ et le modèle l'anime, ou verrouillez des keyframes lorsqu'un plan doit atteindre des moments précis dans un ordre défini. Des images existantes peuvent aussi être prolongées, avec le mouvement et le cadrage repris de la fin du clip d'entrée. Enchaînez les prolongations avec parcimonie, car la cohérence visuelle dérive à mesure que chaque extension s'appuie sur la précédente.

Le mode Draft renvoie un aperçu HD à moindre coût, afin que la composition, le rythme et l'audio puissent être évalués avant de payer le rendu final. Itérez sur les prompts à ce stade, puis relancez le prompt gagnant en HD standard ou en Full HD sans modifier la structure de la requête. Les équipes qui publient de nombreuses variantes en tirent le plus de valeur.

La vidéo est facturée à la seconde de sortie, donc un clip court coûte une fraction d'un long clip et vous ne payez que ce que vous générez réellement. La résolution détermine le tarif, avec Full HD au-dessus de la HD standard et le mode Draft en dessous des deux. Atlas Cloud n'ajoute ni abonnement, ni frais par siège, ni minimum de dépense. Commencez aujourd'hui.

Pas encore. FLUX 3 Video est la partie de la famille déjà publiée, tandis que FLUX 3 Image est en déploiement progressif et qu'une variante open weights de FLUX 3 Dev a été annoncée pour plus tard. Atlas Cloud ajoute chaque nouvel endpoint FLUX 3 au fur et à mesure de sa disponibilité, donc la même clé continue de fonctionner quand la génération d'images arrive.

Un modèle joint supprime l'étape d'assemblage : il n'y a pas de second passage pour synchroniser la voix avec le mouvement des lèvres ou pour superposer l'ambiance sur un montage finalisé. C'est particulièrement important pour les scènes dialoguées, où les écarts entre les pistes sont immédiatement visibles pour les spectateurs. Les pipelines passent de plusieurs services à un seul appel, ce qui fait moins de points de défaillance à surveiller.

Explorer Plus de Familles

Seedance 2.5

L'API Seedance 2.5 est désormais disponible sur Atlas Cloud ! Elle offre aux développeurs le tout dernier modèle vidéo de ByteDance. Il génère jusqu'à 30 secondes de vidéo native en un seul passage à partir de texte, d'une seule image ou de jusqu'à 50 références multimodales, avec un son synchronisé et du texte multilingue dans le cadre. Sur Atlas Cloud, vous y accédez via une clé unique, la cohérence du sujet et la physique améliorée maintenant la fluidité des plans longs.

Voir la Famille

MiniMax H3

L’API MiniMax H3 donne accès au modèle vidéo multimodal généraliste de MiniMax, qui traite le texte, les images, la vidéo et l’audio comme un seul contexte plutôt que comme des tâches séparées. Les clips durent de 5 à 15 secondes à 24 FPS, dans des formats allant de 21:9 à 9:16, et une seule invite peut remplacer des personnages, changer des arrière-plans, réécrire des dialogues ou cloner une voix à partir d’un clip de référence. Atlas Cloud fournit le tout via un endpoint unique compatible OpenAI. Commencez à développer dès aujourd’hui.

Voir la Famille

Seedream 5.0 Pro

L'API Seedream 5.0 Pro offre aux développeurs le modèle d'édition d'images contrôlable de ByteDance sur Atlas Cloud. Elle positionne les modifications avec précision à l'aide d'ancrages et de coordonnées, sépare les images en calques modifiables, fusionne de multiples références et fait correspondre les couleurs et matériaux exacts, avec du texte multilingue en 2K et 3K. Sur Atlas Cloud, vous y accédez via une seule clé !

Voir la Famille

Seedance 2.0

L'API Seedance 2.0 vous donne un accès en production au modèle vidéo multimodal de ByteDance — des entrées quadrimodales (texte, image, vidéo, audio) et un système « Universal Reference » leader du secteur qui verrouille la composition, les mouvements de caméra et les actions des personnages à travers les plans. Intégrez un contrôle de niveau réalisateur avec un seul appel d'API, un tarif fixe de 0,09 $/s, une clé instantanée et aucune liste d'attente — le tout soutenu par une disponibilité et une conformité de niveau entreprise. Seedance 2.0 Native 4K est désormais disponible !

Voir la Famille

GPT Image 2

L'API GPT Image 2 offre aux développeurs un accès au dernier modèle d'image d'OpenAI, le successeur de GPT Image 1.5. Elle génère et modifie des images avec un rendu de texte précis pour les caractères latins et CJK, ainsi qu'une composition solide pour les affiches, les maquettes et les infographies. Sur Atlas Cloud, vous y accédez via une API unifiée aux côtés de plus de 300 modèles, avec des crédits gratuits, une disponibilité de 99,99 % et sans aucune vérification d'organisation OpenAI requise.

Voir la Famille

Gemini Omni Flash

La Gemini Omni API apporte à votre stack le modèle multimodal de génération et d'édition vidéo de Google DeepMind, présenté à Google I/O 2026. Gemini Omni fusionne le moteur de raisonnement de Gemini avec les médias génératifs : il accepte n'importe quelle combinaison de texte, d'images, de vidéo et d'audio pour produire des résultats cohérents et ancrés dans la connaissance. Affinez vos résultats par simple conversation — remplacez des objets, réécrivez des scènes, changez de style — tandis que la physique, les personnages et la continuité restent intacts. Atlas Cloud propose toute la gamme Gemini Omni Flash — texte vers vidéo, image vers vidéo avec jusqu'à 7 images de référence, et référence vers vidéo — via une API unifiée, avec une tarification transparente à la seconde à partir de $0.112 et sans abonnement. Commencez à développer dès aujourd'hui.

Voir la Famille

Grok Imagine

L'API Grok Imagine couvre les modèles d'image, vidéo et parole d'xAI, de Image 2.0 à Video 1.5 et xAI TTS v1. Générez des images statiques en 1K ou 2K selon 14 rapports d'aspect, créez une vidéo de 15 secondes en 1080p, guidez les plans avec jusqu'à 7 images de référence, ou narrez-les dans 20 langues. Atlas Cloud exécute chaque mode sur un seul point de terminaison, avec un tarif à l'utilisation à partir de $0.02 par image et $0.05 par seconde. Commencez à créer aujourd'hui.

Voir la Famille

Google

Les modèles créatifs les plus puissants de Google sont tous disponibles sur Atlas Cloud. Veo 3.1 offre une génération de vidéos cinématographiques, Nano Banana 2 permet de créer des images haute fidélité, et Gemini apporte une intelligence multimodale à chaque flux de travail. Accédez à la suite complète de modèles Google via une seule API key avec une disponibilité Day-0 et une tarification à l'usage (pay-as-you-go).

Voir la Famille

Seedance 2.0 Mini

Seedance 2.0 Mini apporte la génération de vidéos multimodale de ByteDance aux flux de travail où la vitesse et les coûts sont primordiaux. Il offre les capacités de base de Seedance 2.0 avec une empreinte plus légère — une génération plus rapide, un coût par vidéo réduit et la même intégration API que celle que vous utilisez déjà. Pour les équipes qui gèrent des pipelines à haut volume ou du prototypage à grande échelle, Mini est le choix par défaut pratique.

Voir la Famille

ByteDance

De la génération de vidéos cinématiques à la création d'images haute fidélité, les modèles les plus puissants de ByteDance sont disponibles sur Atlas Cloud. Exécutez Seedance et Seedream à grande échelle avec les prix d'inférence les plus bas et aucune surcharge d'infrastructure.

Voir la Famille

Alibaba

Atlas Cloud rassemble l'ensemble de la gamme de modèles d'Alibaba sous une seule API : Qwen pour les tâches linguistiques et d'imagerie, et Wan pour la génération de vidéos jusqu'en 1080p. Accédez à chaque modèle avec une tarification à l'usage (pay-as-you-go) sans abonnement. L'API Alibaba est disponible via une URL de base unique en utilisant votre client existant compatible avec OpenAI.

Voir la Famille

OpenAI

Atlas Cloud vous donne accès à l'ensemble de la gamme de l'API OpenAI, de GPT Image 2 pour la génération d'images à Sora 2 pour la vidéo. Chaque modèle est disponible en paiement à l'usage sans engagement mensuel. Intégrez-le en remplaçant simplement l'URL de base à l'aide de l'API compatible OpenAI.

Voir la Famille

Une seule API pour toute l'IA multimédia.

Explorer tous les modèles