


HappyHorse 1.1 est la gamme de génération vidéo d’Alibaba destinée aux développeurs travaillant à partir de texte, d’images sources ou de références visuelles. Elle transforme les prompts en clips, anime une première image choisie avec un guidage facultatif et peut utiliser de une à neuf images de référence pour orienter précisément le rendu visuel. Atlas Cloud réunit ces workflows au sein d’une seule intégration, avec une tarification transparente à l’usage. Commencez à développer dès aujourd’hui.
Happyhorse 1.1 est développé par Alibaba. Atlas Cloud (exploité par Atlas Cloud AI LLC) en fournit l’accès mais n’en est pas propriétaire. Toutes les marques appartiennent à leurs détenteurs respectifs.
Atlas Cloud vous offre les derniers modèles créatifs de pointe de l'industrie.
Choisissez entre des entrées textuelles, des images ou des références selon la manière dont vous souhaitez guider chaque vidéo.
| Modalité | Description |
|---|---|
| HappyHorse 1.1 T2V API (Text to Video) | Transformez des prompts textuels en vidéos en 480P, 720P ou 1080P, avec des rapports d’aspect flexibles et des durées de 3 à 15 secondes. Utilisez cet endpoint pour visualiser des concepts, créer du contenu pour les réseaux sociaux et produire des vidéos sans image source. |
| HappyHorse 1.1 I2V API (Image to Video) | À partir d’une image comme première frame, cet endpoint crée une vidéo de 3 à 15 secondes, avec un guidage facultatif par prompt et une sortie en 480P, 720P ou 1080P. Il convient à l’animation de produits, aux mouvements de personnages et à la narration visuelle construite à partir d’une composition existante. |
| HappyHorse 1.1 R2V API (Reference to Video) | Guidez la génération vidéo à l’aide d’une à neuf images de référence et d’un prompt textuel, en sélectionnant une sortie en 480P, 720P ou 1080P, des rapports d’aspect flexibles et une durée de 3 à 15 secondes. Choisissez ce mode pour les scènes guidées par des références, les clips centrés sur des personnages et les projets nécessitant une direction visuelle plus marquée. |
HappyHorse 1.1 transforme des prompts, des premières images ou jusqu’à neuf images de référence en vidéos de 3 à 15 secondes, avec une sortie en 480P, 720P ou 1080P, neuf ratios pour les modes texte et référence, le contrôle de la seed et un accès à la carte via Atlas Cloud.
Commencez par un prompt textuel de 2 500 caractères maximum et générez un clip complet sans image d’entrée. HappyHorse 1.1 prend en charge les sorties en 480P, 720P ou 1080P et permet de définir une durée de 3 à 15 secondes. Choisissez parmi neuf ratios pour une diffusion en écran large, verticale, carrée, portrait ou ultralarge. Ce workflow convient à la visualisation de concepts, aux publicités et aux courtes scènes narratives.
Transformez une image de première frame en mouvement, avec un prompt facultatif pour guider l’action, le style ou les détails de la scène. L’endpoint image-to-video accepte les fichiers JPEG, JPG, PNG ou WEBP jusqu’à 20 MB, avec des dimensions d’au moins 300 pixels chacune. Sélectionnez 480P, 720P ou 1080P ainsi qu’une durée de 3 à 15 secondes. Ce mode convient aux prises de vue produit, aux portraits et aux images clés de storyboard.
Guidez une nouvelle vidéo avec une à neuf images de référence et un prompt textuel obligatoire. Chaque référence JPEG, JPG, PNG ou WEBP peut atteindre 20 MB, et son côté le plus court doit mesurer au moins 400 pixels. Définissez la résolution, la durée, le ratio et la seed de la sortie. Ce mode fournit davantage de contenu source aux workflows de direction artistique, de création de personnages et de présentation de produits.
Cadrez chaque génération pilotée par du texte ou des références selon sa destination grâce à neuf ratios : 16:9, 9:16, 1:1, 4:3, 3:4, 4:5, 5:4, 9:21 et 21:9. La résolution s’étend de 480P à 1080P, tandis que la durée varie de 3 à 15 secondes. Combinez ces réglages pour produire des clips destinés aux fils mobiles, aux lecteurs web, aux formats carrés, aux portraits ou aux compositions ultralarges, sans changer d’endpoint.
Utilisez le paramètre seed avec les réglages du prompt, de la résolution, du ratio et de la durée lorsque vous avez besoin d’un contrôle plus précis des entrées de génération. HappyHorse 1.1 accepte les valeurs de seed de -1 à 2,147,483,647, -1 demandant une seed aléatoire. Gardez les autres réglages explicites pendant vos itérations. Ce workflow paramétré aide les développeurs à organiser les tests créatifs et à comparer les variantes avec une structure de requête cohérente.
Accédez aux trois workflows HappyHorse 1.1 via Atlas Cloud avec une seule clé compatible OpenAI et une facturation à l’usage. Le tarif standard commence à $0.07 par seconde, et la facturation évolue selon l’utilisation plutôt que selon un abonnement. Passez du texte vers vidéo à l’image vers vidéo et aux modèles de référence vers vidéo tout en conservant le même schéma d’intégration. Cette configuration convient aux développeurs qui créent des produits vidéo multimodes sans comptes fournisseurs distincts.
Découvrez comment HappyHorse 1.1 et deux modèles vidéo comparables interprètent les mêmes prompts, entre action cinématographique et narration fantasy stylisée.
Une séquence continue de 8 à 10 secondes, photoréaliste et cinétique, de cinéma culinaire à bord d’une voiture-restaurant traversant à toute vitesse une violente tempête de neige alpine. Un chef de train expérimenté se balance naturellement au rythme des brutales embardées latérales de la voiture tout en préparant le petit-déjeuner : il fait sauter d’une main une fine crêpe dorée très haut, glisse dans l’allée étroite pour rattraper de l’autre main une orange qui roule, puis frappe la crêpe en train de redescendre avec le bord de sa poêle, la lançant selon une trajectoire nette et physiquement réaliste à travers une porte inter-voitures ouverte. Commencer par un très gros plan en travelling latéral, au ras des flammes rugissantes de la cuisinière, de la pâte grésillante et des gouttelettes de beurre chaud éclaboussant l’acier poli ; effectuer un demi-orbite rapide autour du chef tandis qu’il compense chaque secousse, son manteau et son tablier réagissant de manière réaliste ; puis foncer à travers l’embrasure dans un travelling de suivi précis verrouillé sur la crêpe en plein vol, qui traverse le soufflet flexible vers la voiture suivante, évite de justesse un serveur et atterrit parfaitement dans l’assiette de petit-déjeuner d’un passager surpris. Au moment exact de l’atterrissage, une immense avalanche déferle devant les fenêtres tandis que le train lui échappe, créant un climax visuel saisissant. Des lampes au tungstène chaleureuses et la lumière orange du feu s’opposent à l’aube bleu glacé visible à travers les fenêtres striées de neige ; palette de tons alimentaires orange et or, métal gris argenté et nature sauvage bleu froid ; perspective centrale profonde et étroite, encadrements de portes répétés les uns dans les autres, parallaxe marquée, légères vibrations de caméra portée, netteté cristalline des mouvements, continuité fluide du sujet et cohérence spatiale parfaite dans les deux voitures, équilibre réaliste, éclaboussures fluides, inertie des tissus, collisions et physique réaliste des projectiles. Design sonore synchronisé : le martèlement des rails et les gémissements de la voiture établissent le rythme, le sifflement de la poêle et les crépitements du beurre l’accélèrent, l’orange roule en synchronisation avec les cliquetis métalliques, le coup de poêle tombe comme un accent percussif éclatant, suivi d’un doux claquement dans l’assiette et du grondement assourdissant de l’avalanche ; aucun ralenti, aucun plan statique de remplissage, aucun écran, aucune interface, aucun tableau de bord, aucune barre de progression, aucun graphique, aucune légende, aucun sous-titre, aucun logo ni texte visible. Réalisme cinématographique haut de gamme, publicité culinaire dynamique, illusion immersive de plan-séquence, format d’image 16:9.
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
Une séquence d’action animée en 3D graphique et très saturée de 9 secondes, dans un terminal à conteneurs au crépuscule : un piano à queue rouge corail se détache et dévale une rampe de chargement en acier, ses petites roulettes de transport cliquetant et rebondissant sous l’effet d’un poids convaincant, tandis qu’un conducteur de chariot élévateur en combinaison bleu cobalt le poursuit à toute vitesse, se faufilant entre des grues jaune moutarde et des conteneurs maritimes qui montent et descendent sans cesse, formant brièvement un couloir d’urgence mouvant. Commencer par un travelling en très forte contre-plongée, à quelques centimètres de la roue en rotation et du pied de piano violemment secoué, avec des étincelles et des impacts métalliques parfaitement synchronisés avec le son ; s’élever rapidement en grue jusqu’à une vue plongeante révélant l’itinéraire de la poursuite comme un labyrinthe géométrique de blocs corail, bleu cobalt et jaune moutarde ; puis effectuer un whip-pan et une orbite vers l’avant du chariot élévateur lancé à pleine vitesse tandis qu’il rattrape son retard. Au bord du quai, le conducteur engage les fourches sous le piano, soulève son lourd corps au dernier instant, pivote d’une rotation énergique et le dépose en toute sécurité dans un profond clang synchronisé. Le couvercle s’ouvre brusquement sous l’effet de l’inertie ; sur le dernier temps, une mouette se pose sur les touches et joue une ultime note nette. Mouvement continu à haute densité, élan physiquement crédible, collisions, rebonds de suspension, charges qui se déplacent et identité stable des personnages et des objets pendant toute la séquence ; ombres aux contours nets, composition géométrique audacieuse, animation 3D cinématographique stylisée, lumière rasante vive du crépuscule, percussion industrielle rythmée composée du cliquetis des roues, des sifflements hydrauliques, des chocs de conteneurs, de l’effort du moteur, des battements d’ailes de la mouette et de la note finale du piano. Aucun ralenti, aucun plan d’attente, aucune coupe rompant la continuité spatiale, aucun écran, aucune interface logicielle, aucun tableau de bord, aucune barre de progression, aucun graphique, aucune légende, aucune étiquette, aucun logo, aucun filigrane ni texte explicatif. Format d’image 16:9.
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
Des concepts de campagne et de l’animation produit aux vidéos de marque guidées par des références et aux outils pour développeurs, HappyHorse 1.1 transforme les prompts et les images en contenus vidéo courts et adaptables.
Transformez des concepts écrits en vidéos en 480P, 720P ou 1080P, avec des formats d’image flexibles. Les équipes créatives peuvent produire des concepts de campagne, des publications pour les réseaux sociaux et des propositions narratives sans séquences sources ni tournage.
Commencez par une image de première frame, puis guidez son animation à l’aide d’un prompt facultatif sur une durée de 3 à 15 secondes. Les équipes marketing produit peuvent transformer des visuels fixes en clips de lancement, vidéos d’affichage ou animations de catalogue.
À partir d’une à neuf images de référence, le modèle façonne des vidéos autour des éléments visuels fournis, jusqu’en 1080P. Les équipes de marque peuvent développer des variantes de campagne guidées par des visuels approuvés de personnages, de produits ou d’environnements.
Choisissez des formats d’image flexibles et trois niveaux de résolution pour préparer des clips destinés à différents emplacements depuis un workflow de génération unique. Les développeurs peuvent proposer des mises en page verticales, horizontales et autres dans les produits de contenu et les campagnes.
Besoin d’une séquence rapide pour un storyboard ou d’un moment produit plus long ? Des durées de 3 à 15 secondes permettent aux outils créatifs de prendre en charge les concepts rapides, les clips promotionnels et les séquences visuelles concises au sein d’une seule interface.
Créez des applications vidéo autour de textes, d’images de première frame et d’entrées multi-références au sein d’une même famille de modèles. Les utilisateurs peuvent choisir le support de départ le mieux adapté à l’idéation, à l’animation ou à la création guidée par la marque pour chaque workflow.
Comparez les modes de génération de HappyHorse 1.1 avec les principaux modèles vidéo d’Atlas Cloud selon les entrées prises en charge, la durée des clips, la résolution, le nombre de références et le prix de base indiqué.
| Modèle | Entrées prises en charge | Durée de sortie | Résolution | Nombre maximal d’images de référence | Prix de base indiqué |
|---|---|---|---|---|---|
| HappyHorse-1.1 Text-to-video | Prompt textuel | 3 à 15 secondes | 480P, 720P, 1080P | - | $0.07, unité non indiquée |
| HappyHorse-1.1 Image-to-video | Image de la première frame et prompt facultatif | 3 à 15 secondes | 480P, 720P, 1080P | - | $0.07, unité non indiquée |
| HappyHorse-1.1 Reference-to-video | Prompt textuel et images de référence | 3 à 15 secondes | 480P, 720P, 1080P | 9 | $0.07, unité non indiquée |
| Wan-3.0 Reference-to-video | Références textuelles, image, vidéo, audio, document ou page web | 2 à 30 secondes ou durée intelligente | 480P, 720P, 1080P | 10 | $0.05, unité non indiquée |
| Seedance 2.5 Reference-to-Video | Références textuelles, image, vidéo et audio | Jusqu’à 30 secondes | - | 30 | $0.167, unité non indiquée |
| MiniMax H3 Reference-to-Video | Références textuelles, image, vidéo et audio | 4 à 15 secondes | 768p par défaut, jusqu’à 2K | 9 | $0.038/seconde |
Soyez opérationnel en quelques minutes — suivez ces étapes simples pour intégrer et déployer des modèles via la plateforme Atlas Cloud.
Inscrivez-vous sur atlascloud.ai et complétez la vérification. Les nouveaux utilisateurs reçoivent des crédits gratuits pour explorer la plateforme et tester les modèles.
Combiner les modèles Happyhorse 1.1 avancés avec la plateforme accélérée par GPU d'Atlas Cloud offre des performances, une évolutivité et une expérience développeur inégalées.
Faible Latence :
Inférence optimisée par GPU pour un raisonnement en temps réel.
API Unifiée :
Exécutez Happyhorse 1.1, GPT, Gemini et DeepSeek avec une seule intégration.
Tarification Transparente :
Facturation prévisible par token avec options serverless.
Expérience Développeur :
SDK, analytiques, outils de fine-tuning et modèles.
Fiabilité :
99,99% de disponibilité, RBAC et journalisation conforme.
Sécurité et Conformité :
SOC 2 Type II, alignement HIPAA, souveraineté des données aux États-Unis.
HappyHorse 1.1 est un modèle de génération vidéo d’Alibaba disponible sur Atlas Cloud, qui permet de transformer du texte, une première image ou des images de référence en courts clips vidéo. Cette famille fournit des endpoints distincts de conversion texte-vidéo, image-vidéo et référence-vidéo.
Vous pouvez générer une scène à partir d’un prompt textuel, animer une image fixe ou guider un nouveau clip avec plusieurs références visuelles. Ces flux de travail couvrent les vidéos générées uniquement à partir d’un prompt, les animations de première image et les contenus guidés par des références.
Créez une clé API Atlas Cloud, puis envoyez une requête POST authentifiée à /api/v1/model/generateVideo avec l’ID du modèle choisi et les entrées requises. La réponse inclut un ID de tâche que vous pouvez utiliser pour vérifier l’état de la prédiction jusqu’à ce que le résultat soit prêt.
Sélectionnez alibaba/happyhorse-1.1/text-to-video pour une génération basée sur un prompt, alibaba/happyhorse-1.1/image-to-video pour l’animation d’une première image ou alibaba/happyhorse-1.1/reference-to-video pour un guidage par plusieurs images. Chaque mode possède son propre schéma d’entrée.
Pour text-to-video et reference-to-video, choisissez 480p, 720p ou 1080p, une durée de 3 à 15 secondes et l’une des neuf proportions prises en charge. Image-to-video propose les mêmes plages de résolution et de durée, tout en utilisant l’image téléversée comme première image.
Reference-to-video accepte de une à neuf URL d’images ainsi qu’un prompt décrivant comment les images doivent guider le résultat. Les fichiers JPEG, JPG, PNG et WEBP sont pris en charge, avec une limite de 20 MB par image et un côté le plus court d’au moins 400 pixels.
Atlas Cloud indique un tarif standard de $0.07 par seconde pour chacun des trois endpoints HappyHorse 1.1. La facturation est à l’usage : le coût de génération évolue donc en fonction de la durée du clip demandée.
Utilisez le paramètre seed avec text-to-video ou reference-to-video lorsque vous souhaitez contrôler l’aléatoire de la génération. Atlas Cloud accepte des valeurs entières explicites ou -1 lorsqu’une seed aléatoire est souhaitée.
Chaque requête produit un clip d’une durée comprise entre 3 et 15 secondes. Image-to-video utilise une seule image de première frame, tandis que reference-to-video accepte au maximum neuf images de référence.
Guides, tutoriels et actualités produit pour tirer le meilleur d'Atlas Cloud.