


L’API FLUX 3 apporte à votre stack le tout nouveau modèle de base de Black Forest Labs, une architecture Self-Flow unique entraînée conjointement sur des images, de la vidéo et de l’audio. Générez en un seul passage des clips allant jusqu’à 20 secondes avec dialogues multilingues, effets sonores et ambiance, ou produisez des rendus texte vers image avec une typographie précise. Atlas Cloud le propose avec une seule clé compatible OpenAI, une tarification à l’appel au fil de l’eau et un accès dès le premier jour.
Atlas Cloud vous offre les derniers modèles créatifs de pointe de l'industrie.
Cinq endpoints vidéo sont regroupés derrière une seule surface d’API FLUX 3, et le tableau ci-dessous indique ce que chacun reçoit, ce qu’il renvoie et son coût par seconde.
| Modalité | Description |
|---|---|
| FLUX 3 T2V API (texte vers vidéo) | Les prompts textuels deviennent des clips de 5 à 20 secondes avec de l’audio généré lors du même passage, puisque generate_audio est activé par défaut. La sortie est en 720p ou 1080p, avec sept formats d’image fixes de 21:9 à 9:16, plus une option auto, et une valeur de seed permet de reproduire n’importe quel résultat. Le tarif est de $0.17 par seconde de vidéo générée. |
| FLUX 3 I2V API (image vers vidéo) | Fournissez une seule image PNG, JPEG ou WebP, et le modèle l’anime à partir de cette frame, en reprenant le mouvement et le rythme indiqués par le prompt. La durée est sélectionnable de 5 à 20 secondes, ce qui convient aux visuels produit, aux introductions de personnages et aux versions courtes pour les réseaux sociaux créées à partir d’illustrations que vous possédez déjà. La facturation est de $0.17 par seconde de vidéo générée. |
| FLUX 3 Keyframes API (images clés vers vidéo) | Quand un plan doit respecter des moments précis, jusqu’à 10 images clés peuvent être ancrées à des positions de frame exactes sur une timeline à 24 fps. Chaque frame_index doit rester dans la limite de duration multipliée par 24, ce qui donne aux équipes de storyboard et de previz un contrôle direct sur ce qui apparaît et à quel moment. Le tarif est identique à celui des autres endpoints de génération : $0.17 par seconde de vidéo générée. |
| FLUX 3 FLF API (première et dernière frame vers vidéo) | Besoin qu’un clip se termine sur une image finale exacte ? En passant start_image_url et end_image_url, vous verrouillez les deux extrémités du plan tandis que le modèle génère le mouvement entre les deux. Les révélations de logo, les séquences de transformation et les transitions de scène qui doivent correspondre aux plans environnants conviennent toutes à cet usage, à $0.17 par seconde de vidéo générée. |
| FLUX 3 Extend API (extension vidéo) | Avec cet endpoint, une séquence existante prolonge l’histoire : un MP4 de moins de 50 MB et d’une durée inférieure à 15 secondes est continué à partir de ses dernières frames selon le prompt. L’audio continue d’être généré en même temps que l’image, et la même sortie en 720p ou 1080p ainsi que la plage de 5 à 20 secondes restent applicables. L’extension est facturée $0.41 par seconde de vidéo générée. |
Conçu par Black Forest Labs sur un seul socle multimodal, l'API FLUX 3 renvoie jusqu'à vingt secondes de vidéo HD ou Full HD avec dialogue, effets sonores et ambiance générés dans le même passage, tout en acceptant des consignes sur les plans, les keyframes, les langues et le texte à l'écran au fil du processus.
Un seul appel renvoie de 5 à 20 secondes de vidéo avec l'audio généré dans le même passage, jamais ajouté en post-synchronisation. Le dialogue, les effets sonores et les nappes d'ambiance tombent sur l'image exacte où l'événement se produit, et la sortie arrive en 720p HD ou 1080p Full HD. C'est cette précision qui fait qu'une flamme dans un wok ou une porte qui claque paraissent filmées plutôt qu'assemblées.
Demandez une coupe et le modèle l'exécute. Les scènes et les angles de caméra changent au cours d'une même génération, tandis que le même personnage, la même garde-robe et la même logique d'éclairage se retrouvent dans chaque plan. Les formats plus longs reposent sur l'enchaînement agentique de clips, qui relie des générations distinctes en séquences d'une durée de plusieurs minutes. Les storyboards qui nécessitaient quatre rendus et un monteur reviennent désormais comme une pièce continue.
Du texte seul, une image fixe, une paire de première et dernière images, des keyframes placées sur la timeline, ou un clip existant à poursuivre : les cinq points d'entrée sont pris en charge. Les keyframes fixent ce qui se passe et à quel moment, tandis que la continuation repart d'un métrage que vous avez déjà en main. Les studios qui disposent de visuels de marque ou de montages à moitié finalisés peuvent partir de ces assets plutôt que de décrire chaque plan depuis zéro.
Le dialogue natif couvre les dialectes de l'anglais, le chinois, l'espagnol, le français, l'allemand, le japonais, le portugais, le russe, l'italien, l'indonésien, le turc, l'hindi, le pendjabi et bien d'autres, avec des mouvements des lèvres adaptés à la langue demandée. La typographie est rendue directement dans la scène aussi, de sorte que les enseignes et les titres restent dans le cadre au lieu d'être composités plus tard. Une seule consigne peut donc livrer un spot localisé avec son lettrage déjà en place.
Atlas Cloud expose FLUX 3 via le même endpoint unifié qui sert d'entrée au reste de son catalogue, de sorte qu'une seule clé donne accès aux modèles vidéo, image et langage sans deuxième intégration. La facturation reste en pay as you go, sans abonnement ni frais par siège, et vous ne payez que les générations que vous lancez réellement. Changer de modèle revient à modifier une chaîne. Commencez à construire dès aujourd'hui.
Chaque ligne ci-dessous exécute un prompt strictement identique via la FLUX 3 API et deux autres modèles vidéo sur Atlas Cloud, afin d’évaluer la continuité du mouvement, les changements de plan et l’audio natif sur le même brief plutôt que sur des démos triées sur le volet.
Action réelle cinématographique, ruelle tokyoïte luisante de pluie la nuit. Un Shiba Inu portant un minuscule imperméable jaune descend l’allée en skateboard, slalomant entre les flaques et les bouches de vapeur. Ouvrir sur un travelling en contre-plongée rasant le bitume mouillé juste derrière la planche, avec les reflets de néons qui filent de part et d’autre. Le chien accroche une pile de lanternes en papier, qui s’envolent dans les airs, puis un panoramique fouetté suit l’une des lanternes en rotation alors qu’elle dégringole vers un stand de ramen. Couper sur un plan de drone qui monte et recule pendant que le Shiba abat une patte, fait pivoter la planche pour s’arrêter net, puis aboie une fois vers le chef ramen hilare, qui lui lance d’une pichenette une tranche de chashu que le chien attrape en plein vol. Lumière chaude du stand contre néons froids, projections d’eau rétroéclairées. Audio : pluie qui siffle, roues en uréthane grondant sur la pierre, wok qui grésille, un aboiement sec, un train qui passe quelque part au-dessus. Format 16:9.
Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud
Generated with Veo3.1 on Atlas Cloud
Generated with Kling v3.0 on Atlas Cloud
Style anime peint à la main, midi éclatant au-dessus d’une mer de nuages infinie. Une adolescente pêcheuse du ciel se cale sur le pont d’un navire aérien en bois et lance une longue ligne vers la mer de nuages. Commencer par un POV à la première personne par-dessus la rambarde tandis que la ligne claque dans l’air et disparaît dans le blanc. La canne se tend brusquement, puis la caméra coupe sur une orbite rapide autour du pont pendant qu’elle est traînée sur les planches, la corde fumant à travers ses gants, une botte accrochée à une boucle de gréement. Elle plante un pied sur la rambarde et tire de toutes ses forces au moment où un koi de la taille d’une baleine jaillit des nuages derrière elle, ses écailles projetant une lumière arc-en-ciel sur les voiles. Terminer sur un plan héroïque en contre-plongée tandis que l’équipage explose de joie et que des embruns de nuage traversent le cadre. Cel shading pictural, lumière de contour chaude, texture de pinceau visible. Audio : vent qui s’engouffre, corde qui grince, montée orchestrale grandissante, grondement aquatique profond au moment du surgissement. Format 16:9.
Generated with BLACKFORESTLABS FLUX 3 on Atlas Cloud
Generated with Seedance 2.0 on Atlas Cloud
Generated with Kling v3.0 on Atlas Cloud
Qu’il s’agisse d’un clip social de 20 secondes avec audio natif, d’un storyboard avec images clés, d’une déclinaison publicitaire localisée ou d’une passe d’ébauche rapide avant le rendu final, l’API FLUX 3 le prend en charge sur Atlas Cloud, avec une tarification à l’usage et un accès Day-0.
Générez jusqu’à 20 secondes de vidéo à partir d’un simple prompt texte, avec voix, effets et ambiance produits en même temps que les images. Les équipes social media obtiennent un clip finalisé sans passe audio séparée.
Des images clés ordonnées permettent à l’API FLUX 3 de faire évoluer une scène à travers des moments définis, en modifiant les angles de caméra et les décors au sein d’une même génération. Les storyboarders peuvent prévisualiser une séquence complète avant même de planifier un tournage.
La typographie est rendue avec précision dans les scènes générées, et la gestion du texte multilingue s’améliore par rapport aux générations FLUX précédentes. Maquettes de packaging, cartons-titres et bannières localisées sortent d’un seul appel, prêtes à être relues.
Besoin du même spot sur six marchés ? L’API FLUX 3 génère des dialogues multilingues synchronisés avec la vidéo, afin que chaque version dispose de sa propre piste voix localisée sans étape de doublage.
Les séquences existantes peuvent être transposées dans de nouveaux contextes, prolongées avec un audio cohérent ou remodelées tout en conservant leurs éléments centraux. Les agences réactivent d’anciens assets de campagne au lieu de commander un nouveau tournage.
Le mode draft renvoie rapidement un aperçu HD à moindre coût, puis les plans approuvés peuvent être rendus à nouveau en HD ou FHD via l’API FLUX 3. L’itération reste abordable lorsqu’un concept nécessite vingt essais.
Comparez la durée des clips, la résolution de sortie, l’audio natif et le coût par seconde pour voir où FLUX 3 API prend l’avantage et où un autre modèle Atlas Cloud peut mieux convenir à votre pipeline.
| Modèle | Durée maximale du clip | Résolution de sortie maximale | Audio natif | Prix par seconde |
|---|---|---|---|---|
| FLUX 3 Video (Text-to-Video) | 20 s | FHD, jusqu’à 2 MP par image | √ dialogues, SFX, ambiance | $0.17 HD / $0.29 FHD |
| FLUX 3 Video (Video-to-Video) | 20 s | FHD, jusqu’à 2 MP par image | √ dialogues, SFX, ambiance | $0.41 HD / $0.53 FHD |
| Seedance 2.0 Text-to-Video | 15 s | 4K (3840 x 2160) | √ activé par défaut | $0.112 |
| Kling V3.0 Turbo Text-to-Video | 15 s | 1080p | √ optionnel, désactivé par défaut | $0.112 |
| Wan-2.7 Text-to-video | 15 s | 1080p natif, 1440p-SR | √ SFX, musique, ambiance | $0.10 |
| Veo3.1 Text-to-video | 8 s | 1080p | √ audio synchronisé | $0.20 |
Soyez opérationnel en quelques minutes — suivez ces étapes simples pour intégrer et déployer des modèles via la plateforme Atlas Cloud.
Inscrivez-vous sur atlascloud.ai et complétez la vérification. Les nouveaux utilisateurs reçoivent des crédits gratuits pour explorer la plateforme et tester les modèles.
Combiner les modèles FLUX 3 avancés avec la plateforme accélérée par GPU d'Atlas Cloud offre des performances, une évolutivité et une expérience développeur inégalées.
Faible Latence :
Inférence optimisée par GPU pour un raisonnement en temps réel.
API Unifiée :
Exécutez FLUX 3, GPT, Gemini et DeepSeek avec une seule intégration.
Tarification Transparente :
Facturation prévisible par token avec options serverless.
Expérience Développeur :
SDK, analytiques, outils de fine-tuning et modèles.
Fiabilité :
99,99% de disponibilité, RBAC et journalisation conforme.
Sécurité et Conformité :
SOC 2 Type II, alignement HIPAA, souveraineté des données aux États-Unis.
FLUX 3 est le modèle fondation multimodal de Black Forest Labs, entraîné conjointement sur l'image, la vidéo, l'audio et la prédiction d'actions, au lieu d'être assemblé à partir de systèmes séparés. L'API FLUX 3 expose ce modèle via Atlas Cloud, de sorte qu'une seule requête renvoie une vidéo avec audio synchronisé. Une seule clé compatible OpenAI couvre ce modèle, ainsi que tous les autres du catalogue, avec une facturation à l'usage.
La vidéo est la capacité généralement disponible, avec le passage du texte à la vidéo, de l'image à la vidéo, des plans guidés par keyframes et de la continuité d'un clip existant, chacun avec audio natif en option. Black Forest Labs déploie la famille par phases, donc FLUX 3 Image et FLUX 3 Action arrivent après les endpoints vidéo, et non en même temps.
Créez un compte, générez une clé API, puis pointez votre client existant vers l'endpoint de l'API FLUX 3. Les requêtes suivent le même schéma compatible OpenAI utilisé dans tout le catalogue Atlas Cloud, donc il n'y a ni SDK séparé à apprendre, ni verrouillage fournisseur à défaire plus tard. La facturation se fait à l'utilisation, à la génération, sans abonnement à souscrire au préalable. Commencez à construire dès aujourd'hui.
Oui, et cela se fait dans le même passage de génération plutôt qu'au moyen d'un second modèle, ce qui maintient les dialogues, les effets sonores et l'ambiance en phase avec l'image. FLUX 3 gère la parole avec synchronisation labiale dans plus d'une douzaine de langues, dont l'anglais, le chinois, l'espagnol, le japonais et l'hindi. L'audio peut être désactivé par requête lorsque des images muettes suffisent.
Les générations vont de 5 à 20 secondes, avec une sortie en HD 720p et du Full HD 1080p disponible quand le niveau de détail compte plus que le coût. Les formats paysage, carré et vertical sont tous pris en charge, donc le même prompt peut viser une accroche de page d'accueil ou un fil mobile. Les récits plus longs sont mieux construits à partir de plusieurs clips maîtrisés plutôt que d'une seule requête trop volumineuse.
Fournissez une image de départ et le modèle l'anime, ou verrouillez des keyframes lorsqu'un plan doit atteindre des moments précis dans un ordre défini. Des images existantes peuvent aussi être prolongées, avec le mouvement et le cadrage repris de la fin du clip d'entrée. Enchaînez les prolongations avec parcimonie, car la cohérence visuelle dérive à mesure que chaque extension s'appuie sur la précédente.
Le mode Draft renvoie un aperçu HD à moindre coût, afin que la composition, le rythme et l'audio puissent être évalués avant de payer le rendu final. Itérez sur les prompts à ce stade, puis relancez le prompt gagnant en HD standard ou en Full HD sans modifier la structure de la requête. Les équipes qui publient de nombreuses variantes en tirent le plus de valeur.
La vidéo est facturée à la seconde de sortie, donc un clip court coûte une fraction d'un long clip et vous ne payez que ce que vous générez réellement. La résolution détermine le tarif, avec Full HD au-dessus de la HD standard et le mode Draft en dessous des deux. Atlas Cloud n'ajoute ni abonnement, ni frais par siège, ni minimum de dépense. Commencez aujourd'hui.
Pas encore. FLUX 3 Video est la partie de la famille déjà publiée, tandis que FLUX 3 Image est en déploiement progressif et qu'une variante open weights de FLUX 3 Dev a été annoncée pour plus tard. Atlas Cloud ajoute chaque nouvel endpoint FLUX 3 au fur et à mesure de sa disponibilité, donc la même clé continue de fonctionner quand la génération d'images arrive.
Un modèle joint supprime l'étape d'assemblage : il n'y a pas de second passage pour synchroniser la voix avec le mouvement des lèvres ou pour superposer l'ambiance sur un montage finalisé. C'est particulièrement important pour les scènes dialoguées, où les écarts entre les pistes sont immédiatement visibles pour les spectateurs. Les pipelines passent de plusieurs services à un seul appel, ce qui fait moins de points de défaillance à surveiller.
Guides, tutoriels et actualités produit pour tirer le meilleur d'Atlas Cloud.