Hero background 1Hero background 2Hero background 3

HappyHorse 1.1 Multi Image Video Generation

HappyHorse 1.1 est la gamme de génération vidéo d’Alibaba destinée aux développeurs travaillant à partir de texte, d’images sources ou de références visuelles. Elle transforme les prompts en clips, anime une première image choisie avec un guidage facultatif et peut utiliser de une à neuf images de référence pour orienter précisément le rendu visuel. Atlas Cloud réunit ces workflows au sein d’une seule intégration, avec une tarification transparente à l’usage. Commencez à développer dès aujourd’hui.

Happyhorse 1.1 est développé par Alibaba. Atlas Cloud (exploité par Atlas Cloud AI LLC) en fournit l’accès mais n’en est pas propriétaire. Toutes les marques appartiennent à leurs détenteurs respectifs.

Explorez les Modèles Leaders

Atlas Cloud vous offre les derniers modèles créatifs de pointe de l'industrie.

Comparer les modes de génération vidéo de HappyHorse 1.1

Choisissez entre des entrées textuelles, des images ou des références selon la manière dont vous souhaitez guider chaque vidéo.

ModalitéDescription
HappyHorse 1.1 T2V API (Text to Video)Transformez des prompts textuels en vidéos en 480P, 720P ou 1080P, avec des rapports d’aspect flexibles et des durées de 3 à 15 secondes. Utilisez cet endpoint pour visualiser des concepts, créer du contenu pour les réseaux sociaux et produire des vidéos sans image source.
HappyHorse 1.1 I2V API (Image to Video)À partir d’une image comme première frame, cet endpoint crée une vidéo de 3 à 15 secondes, avec un guidage facultatif par prompt et une sortie en 480P, 720P ou 1080P. Il convient à l’animation de produits, aux mouvements de personnages et à la narration visuelle construite à partir d’une composition existante.
HappyHorse 1.1 R2V API (Reference to Video)Guidez la génération vidéo à l’aide d’une à neuf images de référence et d’un prompt textuel, en sélectionnant une sortie en 480P, 720P ou 1080P, des rapports d’aspect flexibles et une durée de 3 à 15 secondes. Choisissez ce mode pour les scènes guidées par des références, les clips centrés sur des personnages et les projets nécessitant une direction visuelle plus marquée.

Trois entrées, une boîte à outils HappyHorse 1.1

HappyHorse 1.1 transforme des prompts, des premières images ou jusqu’à neuf images de référence en vidéos de 3 à 15 secondes, avec une sortie en 480P, 720P ou 1080P, neuf ratios pour les modes texte et référence, le contrôle de la seed et un accès à la carte via Atlas Cloud.

HappyHorse 1.1 : texte vers vidéo

Commencez par un prompt textuel de 2 500 caractères maximum et générez un clip complet sans image d’entrée. HappyHorse 1.1 prend en charge les sorties en 480P, 720P ou 1080P et permet de définir une durée de 3 à 15 secondes. Choisissez parmi neuf ratios pour une diffusion en écran large, verticale, carrée, portrait ou ultralarge. Ce workflow convient à la visualisation de concepts, aux publicités et aux courtes scènes narratives.

Animation à partir de la première image

Transformez une image de première frame en mouvement, avec un prompt facultatif pour guider l’action, le style ou les détails de la scène. L’endpoint image-to-video accepte les fichiers JPEG, JPG, PNG ou WEBP jusqu’à 20 MB, avec des dimensions d’au moins 300 pixels chacune. Sélectionnez 480P, 720P ou 1080P ainsi qu’une durée de 3 à 15 secondes. Ce mode convient aux prises de vue produit, aux portraits et aux images clés de storyboard.

Contrôle par références HappyHorse 1.1

Guidez une nouvelle vidéo avec une à neuf images de référence et un prompt textuel obligatoire. Chaque référence JPEG, JPG, PNG ou WEBP peut atteindre 20 MB, et son côté le plus court doit mesurer au moins 400 pixels. Définissez la résolution, la durée, le ratio et la seed de la sortie. Ce mode fournit davantage de contenu source aux workflows de direction artistique, de création de personnages et de présentation de produits.

Des formats pour chaque destination

Cadrez chaque génération pilotée par du texte ou des références selon sa destination grâce à neuf ratios : 16:9, 9:16, 1:1, 4:3, 3:4, 4:5, 5:4, 9:21 et 21:9. La résolution s’étend de 480P à 1080P, tandis que la durée varie de 3 à 15 secondes. Combinez ces réglages pour produire des clips destinés aux fils mobiles, aux lecteurs web, aux formats carrés, aux portraits ou aux compositions ultralarges, sans changer d’endpoint.

Contrôle de la seed HappyHorse 1.1

Utilisez le paramètre seed avec les réglages du prompt, de la résolution, du ratio et de la durée lorsque vous avez besoin d’un contrôle plus précis des entrées de génération. HappyHorse 1.1 accepte les valeurs de seed de -1 à 2,147,483,647, -1 demandant une seed aléatoire. Gardez les autres réglages explicites pendant vos itérations. Ce workflow paramétré aide les développeurs à organiser les tests créatifs et à comparer les variantes avec une structure de requête cohérente.

Une clé, trois workflows

Accédez aux trois workflows HappyHorse 1.1 via Atlas Cloud avec une seule clé compatible OpenAI et une facturation à l’usage. Le tarif standard commence à $0.07 par seconde, et la facturation évolue selon l’utilisation plutôt que selon un abonnement. Passez du texte vers vidéo à l’image vers vidéo et aux modèles de référence vers vidéo tout en conservant le même schéma d’intégration. Cette configuration convient aux développeurs qui créent des produits vidéo multimodes sans comptes fournisseurs distincts.

HappyHorse 1.1 dans un duel de prompts entre trois modèles

Découvrez comment HappyHorse 1.1 et deux modèles vidéo comparables interprètent les mêmes prompts, entre action cinématographique et narration fantasy stylisée.

Prompt

Une séquence continue de 8 à 10 secondes, photoréaliste et cinétique, de cinéma culinaire à bord d’une voiture-restaurant traversant à toute vitesse une violente tempête de neige alpine. Un chef de train expérimenté se balance naturellement au rythme des brutales embardées latérales de la voiture tout en préparant le petit-déjeuner : il fait sauter d’une main une fine crêpe dorée très haut, glisse dans l’allée étroite pour rattraper de l’autre main une orange qui roule, puis frappe la crêpe en train de redescendre avec le bord de sa poêle, la lançant selon une trajectoire nette et physiquement réaliste à travers une porte inter-voitures ouverte. Commencer par un très gros plan en travelling latéral, au ras des flammes rugissantes de la cuisinière, de la pâte grésillante et des gouttelettes de beurre chaud éclaboussant l’acier poli ; effectuer un demi-orbite rapide autour du chef tandis qu’il compense chaque secousse, son manteau et son tablier réagissant de manière réaliste ; puis foncer à travers l’embrasure dans un travelling de suivi précis verrouillé sur la crêpe en plein vol, qui traverse le soufflet flexible vers la voiture suivante, évite de justesse un serveur et atterrit parfaitement dans l’assiette de petit-déjeuner d’un passager surpris. Au moment exact de l’atterrissage, une immense avalanche déferle devant les fenêtres tandis que le train lui échappe, créant un climax visuel saisissant. Des lampes au tungstène chaleureuses et la lumière orange du feu s’opposent à l’aube bleu glacé visible à travers les fenêtres striées de neige ; palette de tons alimentaires orange et or, métal gris argenté et nature sauvage bleu froid ; perspective centrale profonde et étroite, encadrements de portes répétés les uns dans les autres, parallaxe marquée, légères vibrations de caméra portée, netteté cristalline des mouvements, continuité fluide du sujet et cohérence spatiale parfaite dans les deux voitures, équilibre réaliste, éclaboussures fluides, inertie des tissus, collisions et physique réaliste des projectiles. Design sonore synchronisé : le martèlement des rails et les gémissements de la voiture établissent le rythme, le sifflement de la poêle et les crépitements du beurre l’accélèrent, l’orange roule en synchronisation avec les cliquetis métalliques, le coup de poêle tombe comme un accent percussif éclatant, suivi d’un doux claquement dans l’assiette et du grondement assourdissant de l’avalanche ; aucun ralenti, aucun plan statique de remplissage, aucun écran, aucune interface, aucun tableau de bord, aucune barre de progression, aucun graphique, aucune légende, aucun sous-titre, aucun logo ni texte visible. Réalisme cinématographique haut de gamme, publicité culinaire dynamique, illusion immersive de plan-séquence, format d’image 16:9.

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

Prompt

Une séquence d’action animée en 3D graphique et très saturée de 9 secondes, dans un terminal à conteneurs au crépuscule : un piano à queue rouge corail se détache et dévale une rampe de chargement en acier, ses petites roulettes de transport cliquetant et rebondissant sous l’effet d’un poids convaincant, tandis qu’un conducteur de chariot élévateur en combinaison bleu cobalt le poursuit à toute vitesse, se faufilant entre des grues jaune moutarde et des conteneurs maritimes qui montent et descendent sans cesse, formant brièvement un couloir d’urgence mouvant. Commencer par un travelling en très forte contre-plongée, à quelques centimètres de la roue en rotation et du pied de piano violemment secoué, avec des étincelles et des impacts métalliques parfaitement synchronisés avec le son ; s’élever rapidement en grue jusqu’à une vue plongeante révélant l’itinéraire de la poursuite comme un labyrinthe géométrique de blocs corail, bleu cobalt et jaune moutarde ; puis effectuer un whip-pan et une orbite vers l’avant du chariot élévateur lancé à pleine vitesse tandis qu’il rattrape son retard. Au bord du quai, le conducteur engage les fourches sous le piano, soulève son lourd corps au dernier instant, pivote d’une rotation énergique et le dépose en toute sécurité dans un profond clang synchronisé. Le couvercle s’ouvre brusquement sous l’effet de l’inertie ; sur le dernier temps, une mouette se pose sur les touches et joue une ultime note nette. Mouvement continu à haute densité, élan physiquement crédible, collisions, rebonds de suspension, charges qui se déplacent et identité stable des personnages et des objets pendant toute la séquence ; ombres aux contours nets, composition géométrique audacieuse, animation 3D cinématographique stylisée, lumière rasante vive du crépuscule, percussion industrielle rythmée composée du cliquetis des roues, des sifflements hydrauliques, des chocs de conteneurs, de l’effort du moteur, des battements d’ailes de la mouette et de la note finale du piano. Aucun ralenti, aucun plan d’attente, aucune coupe rompant la continuité spatiale, aucun écran, aucune interface logicielle, aucun tableau de bord, aucune barre de progression, aucun graphique, aucune légende, aucune étiquette, aucun logo, aucun filigrane ni texte explicatif. Format d’image 16:9.

Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud

Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud

Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud

HappyHorse 1.1 dans les workflows créatifs

Des concepts de campagne et de l’animation produit aux vidéos de marque guidées par des références et aux outils pour développeurs, HappyHorse 1.1 transforme les prompts et les images en contenus vidéo courts et adaptables.

Concepts de campagne avec HappyHorse 1.1

Transformez des concepts écrits en vidéos en 480P, 720P ou 1080P, avec des formats d’image flexibles. Les équipes créatives peuvent produire des concepts de campagne, des publications pour les réseaux sociaux et des propositions narratives sans séquences sources ni tournage.

Donner vie aux images fixes

Commencez par une image de première frame, puis guidez son animation à l’aide d’un prompt facultatif sur une durée de 3 à 15 secondes. Les équipes marketing produit peuvent transformer des visuels fixes en clips de lancement, vidéos d’affichage ou animations de catalogue.

Variantes de marque guidées par des références

À partir d’une à neuf images de référence, le modèle façonne des vidéos autour des éléments visuels fournis, jusqu’en 1080P. Les équipes de marque peuvent développer des variantes de campagne guidées par des visuels approuvés de personnages, de produits ou d’environnements.

Pipelines de contenu multi-formats

Choisissez des formats d’image flexibles et trois niveaux de résolution pour préparer des clips destinés à différents emplacements depuis un workflow de génération unique. Les développeurs peuvent proposer des mises en page verticales, horizontales et autres dans les produits de contenu et les campagnes.

Planification de clips avec HappyHorse 1.1

Besoin d’une séquence rapide pour un storyboard ou d’un moment produit plus long ? Des durées de 3 à 15 secondes permettent aux outils créatifs de prendre en charge les concepts rapides, les clips promotionnels et les séquences visuelles concises au sein d’une seule interface.

Entrées flexibles pour les applications vidéo

Créez des applications vidéo autour de textes, d’images de première frame et d’entrées multi-références au sein d’une même famille de modèles. Les utilisateurs peuvent choisir le support de départ le mieux adapté à l’idéation, à l’animation ou à la création guidée par la marque pour chaque workflow.

Comparaison des performances de HappyHorse 1.1 pour la génération vidéo

Comparez les modes de génération de HappyHorse 1.1 avec les principaux modèles vidéo d’Atlas Cloud selon les entrées prises en charge, la durée des clips, la résolution, le nombre de références et le prix de base indiqué.

ModèleEntrées prises en chargeDurée de sortieRésolutionNombre maximal d’images de référencePrix de base indiqué
HappyHorse-1.1 Text-to-videoPrompt textuel3 à 15 secondes480P, 720P, 1080P-$0.07, unité non indiquée
HappyHorse-1.1 Image-to-videoImage de la première frame et prompt facultatif3 à 15 secondes480P, 720P, 1080P-$0.07, unité non indiquée
HappyHorse-1.1 Reference-to-videoPrompt textuel et images de référence3 à 15 secondes480P, 720P, 1080P9$0.07, unité non indiquée
Wan-3.0 Reference-to-videoRéférences textuelles, image, vidéo, audio, document ou page web2 à 30 secondes ou durée intelligente480P, 720P, 1080P10$0.05, unité non indiquée
Seedance 2.5 Reference-to-VideoRéférences textuelles, image, vidéo et audioJusqu’à 30 secondes-30$0.167, unité non indiquée
MiniMax H3 Reference-to-VideoRéférences textuelles, image, vidéo et audio4 à 15 secondes768p par défaut, jusqu’à 2K9$0.038/seconde

Comment utiliser Happyhorse 1.1 sur Atlas Cloud

Soyez opérationnel en quelques minutes — suivez ces étapes simples pour intégrer et déployer des modèles via la plateforme Atlas Cloud.

Créer un compte Atlas Cloud

Inscrivez-vous sur atlascloud.ai et complétez la vérification. Les nouveaux utilisateurs reçoivent des crédits gratuits pour explorer la plateforme et tester les modèles.

Pourquoi Utiliser Happyhorse 1.1 sur Atlas Cloud

Combiner les modèles Happyhorse 1.1 avancés avec la plateforme accélérée par GPU d'Atlas Cloud offre des performances, une évolutivité et une expérience développeur inégalées.

Performance et Flexibilité

Faible Latence :
Inférence optimisée par GPU pour un raisonnement en temps réel.

API Unifiée :
Exécutez Happyhorse 1.1, GPT, Gemini et DeepSeek avec une seule intégration.

Tarification Transparente :
Facturation prévisible par token avec options serverless.

Entreprise et Échelle

Expérience Développeur :
SDK, analytiques, outils de fine-tuning et modèles.

Fiabilité :
99,99% de disponibilité, RBAC et journalisation conforme.

Sécurité et Conformité :
SOC 2 Type II, alignement HIPAA, souveraineté des données aux États-Unis.

Créer avec HappyHorse 1.1 : questions fréquentes

HappyHorse 1.1 est un modèle de génération vidéo d’Alibaba disponible sur Atlas Cloud, qui permet de transformer du texte, une première image ou des images de référence en courts clips vidéo. Cette famille fournit des endpoints distincts de conversion texte-vidéo, image-vidéo et référence-vidéo.

Vous pouvez générer une scène à partir d’un prompt textuel, animer une image fixe ou guider un nouveau clip avec plusieurs références visuelles. Ces flux de travail couvrent les vidéos générées uniquement à partir d’un prompt, les animations de première image et les contenus guidés par des références.

Créez une clé API Atlas Cloud, puis envoyez une requête POST authentifiée à /api/v1/model/generateVideo avec l’ID du modèle choisi et les entrées requises. La réponse inclut un ID de tâche que vous pouvez utiliser pour vérifier l’état de la prédiction jusqu’à ce que le résultat soit prêt.

Sélectionnez alibaba/happyhorse-1.1/text-to-video pour une génération basée sur un prompt, alibaba/happyhorse-1.1/image-to-video pour l’animation d’une première image ou alibaba/happyhorse-1.1/reference-to-video pour un guidage par plusieurs images. Chaque mode possède son propre schéma d’entrée.

Pour text-to-video et reference-to-video, choisissez 480p, 720p ou 1080p, une durée de 3 à 15 secondes et l’une des neuf proportions prises en charge. Image-to-video propose les mêmes plages de résolution et de durée, tout en utilisant l’image téléversée comme première image.

Reference-to-video accepte de une à neuf URL d’images ainsi qu’un prompt décrivant comment les images doivent guider le résultat. Les fichiers JPEG, JPG, PNG et WEBP sont pris en charge, avec une limite de 20 MB par image et un côté le plus court d’au moins 400 pixels.

Atlas Cloud indique un tarif standard de $0.07 par seconde pour chacun des trois endpoints HappyHorse 1.1. La facturation est à l’usage : le coût de génération évolue donc en fonction de la durée du clip demandée.

Utilisez le paramètre seed avec text-to-video ou reference-to-video lorsque vous souhaitez contrôler l’aléatoire de la génération. Atlas Cloud accepte des valeurs entières explicites ou -1 lorsqu’une seed aléatoire est souhaitée.

Chaque requête produit un clip d’une durée comprise entre 3 et 15 secondes. Image-to-video utilise une seule image de première frame, tandis que reference-to-video accepte au maximum neuf images de référence.

Explorer Plus de Familles

Seedance 2.5

L'API Seedance 2.5 est désormais disponible sur Atlas Cloud ! Elle offre aux développeurs le tout dernier modèle vidéo de ByteDance. Il génère jusqu'à 30 secondes de vidéo native en un seul passage à partir de texte, d'une seule image ou de jusqu'à 50 références multimodales, avec un son synchronisé et du texte multilingue dans le cadre. Sur Atlas Cloud, vous y accédez via une clé unique, la cohérence du sujet et la physique améliorée maintenant la fluidité des plans longs.

Voir la Famille

Wan 3.0

L'API Wan 3.0 est la nouvelle génération de la famille vidéo Wan d'Alibaba, conçue pour repousser les limites de la génération de formats longs, du contrôle multi-références et de la qualité audiovisuelle à de nouveaux sommets. Atlas Cloud héberge déjà Wan 2.7, 2.6 et 2.5, et Wan 3.0 fonctionne sur la même clé unifiée sans configuration distincte. Commencez à créer dès aujourd'hui. Faites défiler vers le bas jusqu'à la vitrine pour découvrir ce que Wan 3.0 peut créer.

Voir la Famille

MiniMax H3

MiniMax H3 est la famille vidéo multimodale de MiniMax, conçue pour la création guidée par du texte, des images et des références. Sur les routes prises en charge, elle préserve les sujets des médias de référence, offre des rapports d’aspect flexibles et associe un son généré aux visuels via H3 Developer, avec des profils de sortie sélectionnés par endpoint. Atlas Cloud unifie cette famille derrière une seule clé compatible avec OpenAI, avec une tarification transparente à l’usage à partir du tarif standard de 0,038 $ par seconde. Commencez à développer dès aujourd’hui.

Voir la Famille

Seedream 5.0 Pro

L'API Seedream 5.0 Pro offre aux développeurs le modèle d'édition d'images contrôlable de ByteDance sur Atlas Cloud. Elle positionne les modifications avec précision à l'aide d'ancrages et de coordonnées, sépare les images en calques modifiables, fusionne de multiples références et fait correspondre les couleurs et matériaux exacts, avec du texte multilingue en 2K et 3K. Sur Atlas Cloud, vous y accédez via une seule clé !

Voir la Famille

Seedance 2.0

Seedance 2.0 est le modèle vidéo de production de ByteDance pour créer des plans avec précision. Transformez vos prompts en vidéos, animez une image de première image avec un guidage facultatif par la dernière image, ou façonnez vos résultats à l’aide de médias de référence et d’une recherche web facultative. Atlas Cloud regroupe ces workflows dans une API unifiée, avec une tarification transparente à l’usage et une clé compatible avec OpenAI. Commencez à développer dès aujourd’hui.

Voir la Famille

GPT Image 2.5

La famille gpt-image-2.5 d’OpenAI offre aux développeurs le choix entre Flare et Sunburst pour leurs workflows de génération d’images en production. Générez des images à des résolutions arbitraires allant jusqu’à 3840x2160 et choisissez parmi cinq niveaux de qualité, dont xhigh et max, pour répondre à des exigences de sortie spécifiques. Atlas Cloud fournit une inférence REST prête à l’emploi, sans démarrage à froid, avec une tarification standard à partir de $0.004 par génération. Commencez à développer dès aujourd’hui.

Voir la Famille

GPT Image 2

L'API GPT Image 2 offre aux développeurs un accès au dernier modèle d'image d'OpenAI, le successeur de GPT Image 1.5. Elle génère et modifie des images avec un rendu de texte précis pour les caractères latins et CJK, ainsi qu'une composition solide pour les affiches, les maquettes et les infographies. Sur Atlas Cloud, vous y accédez via une API unifiée aux côtés de plus de 300 modèles, avec des crédits gratuits, une disponibilité de 99,99 % et sans aucune vérification d'organisation OpenAI requise.

Voir la Famille

Gemini Omni Flash

Gemini Omni est la famille vidéo nativement multimodale de Google DeepMind, conçue pour la création et le montage guidés par des prompts. Générez des vidéos à partir de texte, animez des images fixes ou modifiez des séquences existantes avec des références visuelles facultatives, tout en préservant le contenu non modifié. Des paramètres flexibles de résolution, de format d’image et de durée prennent en charge une grande variété de workflows de production. Atlas Cloud unifie l’accès grâce à une tarification transparente à l’usage. Commencez à créer dès aujourd’hui.

Voir la Famille

Grok Imagine

L'API Grok Imagine couvre les modèles d'image, vidéo et parole d'xAI, de Image 2.0 à Video 1.5 et xAI TTS v1. Générez des images statiques en 1K ou 2K selon 14 rapports d'aspect, créez une vidéo de 15 secondes en 1080p, guidez les plans avec jusqu'à 7 images de référence, ou narrez-les dans 20 langues. Atlas Cloud exécute chaque mode sur un seul point de terminaison, avec un tarif à l'utilisation à partir de $0.02 par image et $0.05 par seconde. Commencez à créer aujourd'hui.

Voir la Famille

Google

Les modèles créatifs les plus puissants de Google sont tous disponibles sur Atlas Cloud. Veo 3.1 offre une génération de vidéos cinématographiques, Nano Banana 2 permet de créer des images haute fidélité, et Gemini apporte une intelligence multimodale à chaque flux de travail. Accédez à la suite complète de modèles Google via une seule API key avec une disponibilité Day-0 et une tarification à l'usage (pay-as-you-go).

Voir la Famille

Seedance 2.0 Mini

Seedance 2.0 Mini apporte la génération de vidéos multimodale de ByteDance aux flux de travail où la vitesse et les coûts sont primordiaux. Il offre les capacités de base de Seedance 2.0 avec une empreinte plus légère — une génération plus rapide, un coût par vidéo réduit et la même intégration API que celle que vous utilisez déjà. Pour les équipes qui gèrent des pipelines à haut volume ou du prototypage à grande échelle, Mini est le choix par défaut pratique.

Voir la Famille

ByteDance

De la génération de vidéos cinématiques à la création d'images haute fidélité, les modèles les plus puissants de ByteDance sont disponibles sur Atlas Cloud. Exécutez Seedance et Seedream à grande échelle avec les prix d'inférence les plus bas et aucune surcharge d'infrastructure.

Voir la Famille

Une seule API pour toute l'IA multimédia.

Explorer tous les modèles