


Gemini Omni 1.1 Flash est la famille vidéo nativement multimodale de Google DeepMind, conçue pour des workflows de production flexibles. Modifiez des séquences existantes à l’aide d’instructions textuelles, préservez la cohérence visuelle avec jusqu’à 10 images de référence et 3 clips vidéo, ou prolongez un plan par segments enchaînables jusqu’à 40 secondes. Accédez à tous les workflows sur Atlas Cloud avec une seule clé API compatible OpenAI, une tarification à l’usage et une disponibilité dès le Day-0. Commencez à développer dès aujourd’hui.
Gemini Omni 1.1 Flash est développé par Google. Atlas Cloud (exploité par Atlas Cloud AI LLC) en fournit l’accès mais n’en est pas propriétaire. Toutes les marques appartiennent à leurs détenteurs respectifs.
Atlas Cloud vous offre les derniers modèles créatifs de pointe de l'industrie.
Comparez cinq endpoints Gemini Omni 1.1 Flash selon le workflow d’entrée, les capacités de sortie et le cas d’usage en production.
| Modalité | Description |
|---|---|
| Gemini Omni 1.1 Flash Video Extend API | Prolongez un clip existant avec une extension parfaitement raccordée de 3 à 10 secondes, en conservant l’audio natif. Enchaînez plusieurs extensions pour créer un plan vidéo cohérent d’une durée totale maximale de 40 secondes. |
| Gemini Omni 1.1 Flash Video Edit API | Besoin de modifier une séquence existante sans reconstruire toute la scène ? Utilisez des instructions textuelles pour ajouter, supprimer, remplacer ou restyler des éléments vidéo avec l’audio natif, tout en préservant le contenu que le prompt ne mentionne pas. |
| Gemini Omni 1.1 Flash Reference-to-Video API | Fournissez un prompt textuel accompagné de 10 images de référence et de 3 clips vidéo de référence maximum pour générer une vidéo cinématographique avec son natif. Cet endpoint convient aux projets qui nécessitent une cohérence des personnages, des produits ou de la direction artistique entre les générations. |
| Gemini Omni 1.1 Flash Image-to-Video API | Animez une image fixe pour créer un clip cinématographique avec son, guidé par un prompt textuel. Une image finale facultative permet de contrôler précisément le début et la fin du plan généré. |
| Gemini Omni 1.1 Flash Text-to-Video API | À partir d’un prompt textuel, cet endpoint produit une vidéo cinématographique avec un audio natif synchronisé. Ajustez la durée, le format d’image et la résolution de sortie, d’un brouillon rapide en 360p jusqu’à un résultat en 4K. |
Gemini Omni 1.1 Flash combine la génération vidéo, l’audio natif, la continuité guidée par références, le contrôle précis des images, le montage à partir d’instructions et l’extension en chaîne dans un workflow flexible d’Atlas Cloud.
Commencez avec un prompt textuel et générez un clip cinématographique avec un audio natif synchronisé. Gemini Omni 1.1 Flash vous permet de contrôler la durée, le format d’image et la résolution de sortie, des brouillons en 360p jusqu’à la 4K. Décrivez le mouvement, la direction de la caméra, les dialogues, la musique et l’ambiance dans une seule requête. Ce workflow convient aux bandes-annonces, aux contenus pour les réseaux sociaux et aux séquences narratives qui nécessitent de développer l’image et le son ensemble.
Poursuivez un clip existant avec un segment de 3 à 10 secondes parfaitement raccordé, puis enchaînez les extensions pour atteindre jusqu’à 40 secondes. Le modèle conserve le contexte visuel et l’audio natif afin que la nouvelle action appartienne au même plan. Créez des révélations, des poursuites ou des histoires de produit plus longues sans recommencer la séquence lorsque le récit nécessite davantage d’espace.
Fournissez un prompt textuel accompagné de jusqu’à 10 images de référence et de 3 clips vidéo de référence pour guider une génération cohérente avec audio natif. Les images peuvent définir un personnage, un produit, un lieu ou une direction artistique, tandis que les références vidéo orientent les mouvements et le comportement du plan. Utilisez cette approche lorsque la cohérence de l’identité et du langage visuel est essentielle entre les contenus d’une campagne, les scènes épisodiques ou les contenus de marque.
Définissez l’image d’ouverture, puis fournissez éventuellement une dernière image pour contrôler le point d’arrivée du plan. Gemini Omni 1.1 Flash anime l’image fixe pour créer un clip cinématographique avec son natif et effectue une interpolation vers le point final fourni. Cette structure de début et de fin convient aux révélations de produits, aux transitions fluides, aux raccords et aux mouvements de caméra planifiés qui doivent aboutir à une composition précise.
Modifiez une vidéo existante à l’aide d’une instruction textuelle directe tout en conservant tout ce que le prompt ne mentionne pas. Ajoutez, supprimez, remplacez ou restylez des éléments, et conservez l’audio natif dans le résultat modifié. Lorsqu’une prise réussie nécessite seulement un nouvel objet, environnement ou traitement visuel, ce workflow ciblé préserve le reste du travail et évite de reconstruire la scène depuis zéro.
Passez de la génération de texte en vidéo à la génération d’image en vidéo, à la génération guidée par références, au montage et à l’extension via Atlas Cloud avec une seule clé API. La facturation transparente à l’usage permet de séparer les expérimentations des abonnements ou des engagements minimums. Les développeurs peuvent préparer des brouillons en 360p et demander des sorties jusqu’en 4K lorsque le niveau de détail final est important. Cette approche unifiée facilite l’intégration de toute la famille de modèles dans les workflows de production.
Découvrez comment Gemini Omni 1.1 Flash, Seedance 2.5 et l’ancien Gemini Omni Flash interprètent les mêmes deux prompts cinématographiques.
Un micro-film fantastique de 8 à 10 secondes, se déroulant dans un atelier artisanal de soufflage de verre noirci : commencer par un travelling macro en très gros plan vers une boule rouge incandescent de verre en fusion, tournant rapidement au bout d’une canne à souffler, sa surface visqueuse se plissant, rayonnant et réfractant le feu du four tandis qu’un artisan façonné en argile fait tourner la canne sans interruption ; orbiter au plus près autour de l’avant-bras en mouvement de l’artisan, tandis que des pinces métalliques frappent en rythme et pincent le verre en fusion — sans coupe, la masse incandescente s’étire, refroidit et se transforme sans transition en un colibri de verre transparent au cœur ardent. Effectuer un panoramique brusque vers un plan de suivi à grande vitesse tandis que le colibri bat ses ailes cristallines, file au-dessus de pots de pigments ouverts et entraîne dans l’air des traînées turbulentes de poudre bleu paon et magenta ; chaque battement d’ailes disperse des particules qui entrent en collision, tourbillonnent et scintillent à travers sa silhouette réfractée. L’oiseau vire brusquement vers une bulle de verre flottante et la picore exactement sur le dernier temps musical ; couper vers une vue spectaculaire en plongée verticale tandis que la bulle éclate vers l’extérieur, ses éclats ultrafins se métamorphosant continuellement en pétales de fleurs translucides et doux qui tourbillonnent à travers l’atelier. Animation en volume raffinée en argile, fusionnée avec des textures de verre d’art lumineuses et semi-transparentes, des imperfections tactiles faites main, des réflexions, réfractions et caustiques convaincantes, une distorsion thermique, une déformation du verre et une physique réaliste des particules ; lumière orange-rouge du four comme éclairage principal, liseré de lumière lunaire cyan froide, palette de noir et or profonds à l’ouverture, explosant en bleu paon et magenta saturés au point culminant. Mouvements de caméra rapides et fluides, forte cohérence temporelle et des personnages, sans pauses ni remplissage au ralenti. Audio : grondement du four, ronronnement du verre en rotation, frappes métalliques rythmiques synchronisées avec chaque pincement et chaque battement d’ailes, souffle de la poudre, tintement cristallin aigu à l’impact, puis finale lumineuse en cascade où le verre se transforme en pétales ; aucun écran, aucune interface, aucun tableau de bord, aucune barre de progression, aucun graphique, aucune légende, aucun logo ni texte. Format d’image 16:9.
Generated with Gemini Omni 1.1 Flash Text-to-Video on Atlas Cloud
Generated with Seedance 2.5 Text-to-Video on Atlas Cloud
Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud
Une séquence macro de documentaire animalier ultra-photoréaliste de 8 à 10 secondes, à l’intérieur d’une grotte rocheuse formant une mare littorale à marée basse : un poulpe noix de coco d’un orange corail éclatant improvise une percussion, ses huit bras anatomiquement cohérents bougeant indépendamment mais naturellement tandis que ses ventouses frappent des coquillages nacrés, des tests creux d’oursins et du verre poli par la mer selon un rythme de plus en plus dense, avec une déformation, un contact, un rebond et un poids des objets précis. Commencer par un travelling latéral macro au niveau de la ligne d’eau, glissant à côté du poulpe tandis que des gouttelettes scintillent sur sa peau texturée et que chaque impact envoie de minuscules ondulations dans l’eau de mer cyan froide ; couper vers une caméra en angle extrêmement bas qui se faufile rapidement entre les bras et les instruments en mouvement, tout en maintenant une continuité claire des membres et des occlusions réalistes. Un bernard-l’ermite entre soudainement en scène, saisit le coquillage principal et s’enfuit ; effectuer un panoramique brusque vers une poursuite rapide et ludique tandis que le poulpe bondit et glisse sur une roche lisse et irrégulière, ses bras agrippant, relâchant et poussant avec une friction convaincante tandis que les pattes du crabe cliquettent sur les galets. Juste avant qu’une vague montante n’inonde la grotte, le poulpe récupère le coquillage, le pose fermement et porte un dernier coup appuyé ; effectuer rapidement un mouvement de grue vers le haut pour aboutir à une vue aérienne en plongée verticale tandis que la vague éclate autour du poulpe et que l’écume rayonnante forme une composition presque parfaitement circulaire. Caustiques sous-marines dansantes produites par la lumière solaire brisée, eau turquoise froide contrastant avec le sujet orange corail, embruns cristallins, bulles, sable en suspension, reflets sur la roche mouillée, faible profondeur de champ macro, HDR cinématographique, textures naturelles d’une netteté extrême, mouvement continu et fluide, transitions de caméra à grande vitesse sans ralenti. Audio diégétique uniquement, parfaitement synchronisé : frappes distinctes sur les coquillages, coups sourds sur les coquilles d’oursin, tintements brillants du verre, relâchements des ventouses, frottements des pinces et des pattes du bernard-l’ermite, ressac montant, puis le coup final et le fracas de la vague en parfaite synchronisation rythmique ; aucune musique, aucune narration, aucun texte, aucune légende, aucun logo, aucune interface, aucun tableau de bord, aucun graphique, aucune barre de progression, aucun écran partagé, aucun membre supplémentaire, aucun bras fusionné ou dupliqué, aucune anatomie déformée, aucun objet flottant, aucune pénétration ni rupture de la physique des contacts, aucun mouvement caoutchouteux, aucun scintillement temporel, aucune coupe franche, aucune position incohérente des coquillages, aucun style cartoon. Documentaire animalier macro cinématographique ultra-photoréaliste, format d’image 16:9.
Generated with Gemini Omni 1.1 Flash Text-to-Video on Atlas Cloud
Generated with Seedance 2.5 Text-to-Video on Atlas Cloud
Generated with Gemini Omni Flash Text-to-Video on Atlas Cloud
Gemini Omni 1.1 Flash transforme les briefs, images fixes, médias de référence et clips existants en vidéos de campagne, histoires cohérentes avec des personnages récurrents, transitions maîtrisées, scènes prolongées et contenus sociaux prêts pour la production, avec audio natif.
Les clips existants bénéficient d’une continuation de trois à dix secondes, parfaitement raccordée, et les extensions enchaînées peuvent atteindre quarante secondes. Les cinéastes et équipes de contenus en série peuvent développer des plans-séquences cohérents sans reconstruire chaque scène.
Besoin d’un nouveau produit, arrière-plan ou style visuel ? Appliquez une modification décrite en langage naturel tout en préservant les éléments non mentionnés, afin de fournir aux équipes marketing des variantes ciblées sans recréer le clip source à chaque fois.
Avec jusqu’à dix images de référence et trois clips vidéo, le modèle peut conserver un personnage, un produit ou une direction artistique d’une génération à l’autre. Les studios de marque obtiennent des scènes de lancement cohérentes, avec une identité visuelle mieux harmonisée.
Commencez par une image fixe et fournissez éventuellement la dernière image, afin de laisser le modèle animer une trajectoire cinématographique entre les deux compositions. Les designers bénéficient d’un contrôle précis sur l’ouverture et la conclusion des révélations, boucles et changements de scène.
Un simple brief textuel devient un clip cinématographique avec audio natif synchronisé, tandis que la durée, le format d’image et la résolution de sortie restent sélectionnables. Les créateurs peuvent concevoir des publicités et des récits sociaux adaptés à différents formats de diffusion.
Lors des tests d’un plan, prototypez en 360p, comparez les directions prometteuses, puis faites passer les concepts retenus à une sortie en 4K. Les réalisateurs et développeurs créatifs peuvent valider le mouvement, le cadrage, le son et le rythme avant la production finale.
Comparez Gemini Omni 1.1 Flash aux principaux modèles de génération de texte vers vidéo selon la durée des clips, la résolution maximale, la prise en charge audio native et la fréquence d’images de sortie.
| Modèle | Durée de sortie | Résolution max | Audio natif | Fréquence d’images |
|---|---|---|---|---|
| Gemini Omni 1.1 Flash Text-to-Video | 3–10 secondes | 4K | √ | 24 FPS |
| MiniMax H3 Text-to-Video | 4–15 secondes | 2K | √ | 24 FPS |
| Wan-3.0 Text-to-video | 2–30 secondes | 1080P | √ | 30 FPS |
Soyez opérationnel en quelques minutes — suivez ces étapes simples pour intégrer et déployer des modèles via la plateforme Atlas Cloud.
Inscrivez-vous sur atlascloud.ai et complétez la vérification. Les nouveaux utilisateurs reçoivent des crédits gratuits pour explorer la plateforme et tester les modèles.
Combiner les modèles Gemini Omni 1.1 Flash avancés avec la plateforme accélérée par GPU d'Atlas Cloud offre des performances, une évolutivité et une expérience développeur inégalées.
Faible Latence :
Inférence optimisée par GPU pour un raisonnement en temps réel.
API Unifiée :
Exécutez Gemini Omni 1.1 Flash, GPT, Gemini et DeepSeek avec une seule intégration.
Tarification Transparente :
Facturation prévisible par token avec options serverless.
Expérience Développeur :
SDK, analytiques, outils de fine-tuning et modèles.
Fiabilité :
99,99% de disponibilité, RBAC et journalisation conforme.
Sécurité et Conformité :
SOC 2 Type II, alignement HIPAA, souveraineté des données aux États-Unis.
Gemini Omni 1.1 Flash est un modèle nativement multimodal de génération et de montage vidéo développé par Google DeepMind. Sur Atlas Cloud, il prend en charge cinq workflows spécialisés couvrant la génération, la création guidée par références, le montage et l’extension. Ses sorties vidéo peuvent inclure un audio natif synchronisé.
Il peut générer une vidéo à partir de texte, animer une image fixe, suivre des références visuelles, modifier un clip existant à partir d’une instruction textuelle ou prolonger une scène. Image to Video peut également interpoler vers une dernière image fournie pour contrôler les transitions entre les plans.
Créez une clé API Atlas Cloud et sélectionnez l’endpoint correspondant à votre workflow. Envoyez un prompt avec les images, vidéos ou médias de référence requis, conformément au schéma de paramètres de cet endpoint. Commencez par un plan clairement décrit, puis affinez vos entrées après avoir examiné le résultat.
Choisissez Text to Video pour la génération à partir d’un prompt et Image to Video pour animer une image fixe. Reference to Video aide à orienter l’identité ou la direction artistique, tandis que Video Edit modifie des séquences existantes et Video Extend prolonge un plan établi.
Text to Video propose des contrôles pour la durée, le format d’image et la résolution de sortie, de 360p à 4K. Image to Video accepte une image de départ et peut utiliser une dernière image facultative. Reference to Video prend en charge jusqu’à 10 images de référence et 3 clips vidéo de référence.
Oui, les cinq workflows Atlas Cloud sont conçus pour produire des vidéos avec un audio natif synchronisé. Décrivez clairement dans votre prompt les dialogues, l’ambiance, la musique ou les effets sonores souhaités lorsque l’audio est important pour la scène.
Atlas Cloud propose un accès facturé à l’usage. Le tarif de base standard est de $0.041 pour Text to Video, Reference to Video, Video Edit et Video Extend, tandis que le tarif de base standard d’Image to Video est de $0.043. Ces montants correspondent aux tarifs backend standard et non à des tarifs promotionnels temporaires.
Chaque extension peut ajouter entre 3 et 10 secondes, et les extensions peuvent être enchaînées jusqu’à ce qu’un même plan cohérent atteigne une durée totale de 40 secondes. Le modèle utilise le clip existant comme contexte pour poursuivre les éléments visuels ainsi que l’audio natif.
Utilisez Reference to Video avec des références claires et compatibles, notamment jusqu’à 10 images et 3 clips vidéo. Pour animer une image, fournissez une image de départ solide et une dernière image facultative lorsque vous avez besoin de contrôler le point d’arrivée. Les sorties génératives peuvent malgré tout présenter des variations : vérifiez donc l’identité, l’éclairage, les mouvements et l’audio après chaque génération ou extension.
Google présente le 1080p et le 4K comme des options de sortie avec mise à l’échelle plutôt que comme des résolutions de génération natives. Utilisez le 360p pour les itérations de brouillon, puis sélectionnez une résolution supérieure lorsque la composition et les mouvements répondent à vos exigences.
Guides, tutoriels et actualités produit pour tirer le meilleur d'Atlas Cloud.