


HappyHorse 1.1 ist Alibabas Videogenerierungsfamilie für Entwickler, die mit Texten, Ausgangsframes oder visuellen Referenzen arbeiten. Sie verwandelt Prompts in Clips, animiert ein ausgewähltes erstes Frame mit optionalen Vorgaben und kann ein bis neun Referenzbilder für eine präzise visuelle Steuerung verwenden. Atlas Cloud bündelt diese Workflows in einer einzigen Integration mit transparenter nutzungsbasierter Preisgestaltung. Beginnen Sie noch heute mit der Entwicklung.
Happyhorse 1.1 wurde von Alibaba entwickelt. Atlas Cloud (betrieben von Atlas Cloud AI LLC) stellt lediglich den Zugang bereit und ist nicht Eigentümerin des Modells. Alle Marken sind Eigentum ihrer jeweiligen Inhaber.
Atlas Cloud bietet Ihnen die neuesten branchenführenden kreativen Modelle.
Wählen Sie je nach gewünschter Steuerung des Videos zwischen Text-, Bild- und Referenzeingaben.
| Modalität | Beschreibung |
|---|---|
| HappyHorse 1.1 T2V API (Text to Video) | Wandeln Sie Text-Prompts in Videos mit 480P, 720P oder 1080P um – mit flexiblen Seitenverhältnissen und einer Dauer von 3 bis 15 Sekunden. Verwenden Sie diesen Endpoint für die Visualisierung von Konzepten, Social-Media-Inhalte und die Videoproduktion ohne Quellbild. |
| HappyHorse 1.1 I2V API (Image to Video) | Ausgehend von einem Bild für das erste Frame erstellt dieser Endpoint ein 3 bis 15 Sekunden langes Video mit optionaler Prompt-Steuerung und einer Ausgabe in 480P, 720P oder 1080P. Er eignet sich für Produktanimationen, die Bewegung von Figuren und visuelles Storytelling auf Basis einer bestehenden Komposition. |
| HappyHorse 1.1 R2V API (Reference to Video) | Steuern Sie die Videogenerierung mit einem bis neun Referenzbildern und einem Text-Prompt. Wählen Sie eine Ausgabe in 480P, 720P oder 1080P, flexible Seitenverhältnisse und eine Dauer von 3 bis 15 Sekunden. Nutzen Sie diesen Modus für referenzbasierte Szenen, figurenorientierte Clips und Projekte, die eine stärkere visuelle Steuerung erfordern. |
HappyHorse 1.1 verwandelt Prompts, erste Frames oder bis zu neun Referenzbilder in 3 bis 15 Sekunden lange Videos mit 480P-, 720P- und 1080P-Ausgabe, neun Seitenverhältnissen für Text- und Referenzmodi, Seed-Steuerung und nutzungsbasierter Abrechnung über Atlas Cloud.
Beginnen Sie mit einem Textprompt von bis zu 2.500 Zeichen und erstellen Sie einen vollständigen Clip ohne Bildeingabe. HappyHorse 1.1 unterstützt eine Ausgabe in 480P, 720P oder 1080P und ermöglicht eine Dauer von 3 bis 15 Sekunden. Wählen Sie aus neun Seitenverhältnissen für Breitbild-, Hochformat-, quadratische, Porträt- oder Ultrawide-Ausgaben. Dieser Workflow eignet sich für Konzeptvisualisierungen, Werbeanzeigen und kurze narrative Szenen.
Verwandeln Sie ein Bild des ersten Frames in Bewegung – optional ergänzt durch einen Prompt, der Handlung, Stil oder Szenendetails vorgibt. Der image-to-video-Endpunkt akzeptiert JPEG-, JPG-, PNG- oder WEBP-Dateien bis 20 MB, wobei beide Abmessungen mindestens 300 Pixel betragen müssen. Wählen Sie 480P, 720P oder 1080P sowie eine Dauer von 3 bis 15 Sekunden. Dieser Modus eignet sich für Produktaufnahmen, Porträts und Storyboard-Keyframes.
Steuern Sie ein neues Video mit einem bis neun Referenzbildern sowie einem erforderlichen Textprompt. Jede JPEG-, JPG-, PNG- oder WEBP-Referenz darf bis zu 20 MB groß sein; ihre kürzere Seite muss mindestens 400 Pixel messen. Legen Sie Auflösung, Dauer, Seitenverhältnis und Seed für die Ausgabe fest. Dieser Modus bietet Workflows für Charakter-, Produkt- und Art-Direction mehr Ausgangsmaterial.
Richten Sie jede text- oder referenzbasierte Generierung mit neun Seitenverhältnissen auf ihr Ziel aus: 16:9, 9:16, 1:1, 4:3, 3:4, 4:5, 5:4, 9:21 und 21:9. Die Auflösung reicht von 480P bis 1080P, während die Dauer zwischen 3 und 15 Sekunden liegt. Kombinieren Sie diese Einstellungen, um Clips für mobile Feeds, Webplayer, quadratische Platzierungen, Porträts oder Ultrawide-Kompositionen zu erstellen, ohne die Endpunkte zu wechseln.
Verwenden Sie den Seed-Parameter zusammen mit den Einstellungen für Prompt, Auflösung, Seitenverhältnis und Dauer, wenn Sie die Generierungseingaben präziser steuern müssen. HappyHorse 1.1 akzeptiert Seed-Werte von -1 bis 2.147.483.647, wobei -1 einen zufälligen Seed anfordert. Halten Sie die übrigen Einstellungen bei Ihren Iterationen explizit fest. Dieser parametrisierte Workflow hilft Entwicklern, kreative Tests zu organisieren und Varianten anhand einer konsistenten Anforderungsstruktur zu vergleichen.
Greifen Sie über Atlas Cloud mit einem OpenAI-kompatiblen Schlüssel und nutzungsbasierter Abrechnung auf alle drei HappyHorse 1.1-Workflows zu. Die Standardpreise beginnen bei 0,07 $ pro Sekunde, und die Abrechnung richtet sich nach der Nutzung statt nach einem Abonnement. Wechseln Sie zwischen den Modellpfaden text-to-video, image-to-video und reference-to-video, während das Integrationsmuster gleich bleibt. Diese Einrichtung eignet sich für Entwickler, die Video-Produkte mit mehreren Modi erstellen, ohne separate Provider-Konten zu benötigen.
Sehen Sie, wie HappyHorse 1.1 und zwei vergleichbare Videomodelle dieselben Prompts in filmischer Action und stilisiertem Fantasy-Storytelling interpretieren.
Eine 8–10 Sekunden lange, durchgehende, fotorealistische kinetische Food-Cinema-Sequenz in einem Speisewagen, der durch einen heftigen alpinen Schneesturm rast. Ein talentierter Zugkoch bewegt sich durch das brutale seitliche Schwanken des Wagens ganz natürlich, während er Frühstück zubereitet: Mit einer Hand wirft er einen dünnen goldbraunen Crêpe hoch, gleitet über den schmalen Gang, um mit der freien Hand eine rollende Orange aufzufangen, und schlägt dann den herabsinkenden Crêpe mit dem Rand seiner Pfanne, sodass er in einem sauberen, physikalisch korrekten Bogen durch eine geöffnete Übergangstür zwischen den Wagen fliegt. Beginne mit einer extremen Nahaufnahme, die seitlich neben lodernden Herdflammen, brutzelndem Teig und Tropfen heißer Butter entlangfährt, die auf polierten Stahl spritzen; schwenke in eine schnelle Halbkreisbewegung um den Koch, während er jeden Ruck ausgleicht und Mantel sowie Schürze realistisch reagieren; stürze anschließend in einer präzisen Verfolgeraufnahme durch die Tür, die auf den fliegenden Crêpe fixiert bleibt, während er den sich bewegenden Übergang in den nächsten Wagen überquert, knapp an einem Kellner vorbeifliegt und perfekt auf dem Frühstücksteller eines überraschten Fahrgasts landet. Im exakt gleichen Moment wie die Landung rast draußen eine gewaltige Lawine an den Fenstern vorbei, während der Zug ihr entkommt, und erzeugt so einen scharfen visuellen Höhepunkt. Warme Wolfram-Lampen und orangefarbenes Feuerlicht treffen auf eisig-blaues Morgenlicht, das durch schneeverwehte Fenster dringt; geschichtete orange-goldene Lebensmitteltöne, silbergraues Metall und eine kalte blaue Wildnis; tiefe, enge Zentralperspektive, wiederholte Türrahmen in Türrahmen, starke Parallaxe, subtile Handkamera-Vibration, gestochen scharfe Bewegungsdarstellung, nahtlose Kontinuität der Motive und räumliche Kohärenz über beide Wagen hinweg, realistische Balance, fließende Spritzer, Stoffträgheit, Kollisionen und physikalisch korrekte Flugbahnen. Synchronisiertes Sounddesign: Schienenklappern und das Ächzen des Wagens geben den Rhythmus vor, das Zischen der Pfanne und platzende Butter beschleunigen ihn, die Orange rollt synchron zu metallischen Klicks, der Pfannenschlag setzt einen hellen perkussiven Akzent, gefolgt von einem sanften Aufschlag auf dem Teller und dem donnernden Dröhnen der Lawine; keine Zeitlupe, kein statisches Füllmaterial, keine Bildschirme, Benutzeroberflächen, Dashboards, Fortschrittsbalken, Diagramme, Bildunterschriften, Untertitel, Logos oder sichtbarer Text. Hochwertiger filmischer Realismus, dynamischer Food-Werbespot, immersive Illusion einer einzigen Einstellung, Seitenverhältnis 16:9.
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
Eine hochgesättigte, grafische 3D-animierte 9-Sekunden-Actionsequenz in einem Containerterminal bei Dämmerung: Ein korallenroter Flügel löst sich und rast eine stählerne Laderampe hinunter, wobei seine kleinen Laufrollen unter dem überzeugenden Gewicht klappern und springen, während ein Gabelstaplerfahrer in kobaltblauer Arbeitskleidung hinterherjagt, sich durch senfgelbe Kräne schlängelt und ständig angehobene sowie abgesenkte Schiffscontainer passiert, die kurzzeitig einen sich verändernden Notkorridor bilden. Beginne mit einer extremen Untersicht-Trackingaufnahme, nur wenige Zentimeter vom rotierenden Rad und dem heftig ruckenden Klavierbein entfernt; Funken und metallische Einschläge sind perfekt mit dem Ton synchronisiert. Steige rasch in eine Draufsicht auf, die die Verfolgungsroute als geometrisches Labyrinth aus korallenroten, kobaltblauen und senfgelben Farbblöcken enthüllt; führe anschließend einen schnellen Schwenk und eine Orbitbewegung zur Vorderseite des heranrasenden Gabelstaplers aus, während dieser den Abstand verringert. Am Rand des Docks stößt der Fahrer die Gabeln unter das Klavier, hebt dessen schweren Korpus im letzten Augenblick an, dreht sich in einer kraftvollen Rotation und setzt es mit einem tiefen, synchronisierten metallischen Krachen sicher ab. Der Deckel springt durch die Trägheit auf; im letzten Takt landet eine Möwe auf den Tasten und schlägt einen einzigen klaren Schlusston an. Durchgehend hochverdichtete Bewegung, physikalisch glaubwürdiger Impuls, Kollisionen, Federungsbewegungen, sich verlagernde Lasten sowie eine stabile Identität von Figuren und Objekten während der gesamten Sequenz; kantige Schatten, kühne geometrische Komposition, stilisierte filmische 3D-Animation, scharfes Konturenlicht der Dämmerung, rhythmische Industrieperkussion aus Radklappern, Hydraulikzischen, Containeraufprällen, Motorbelastung, Möwenflügelschlägen und dem abschließenden Klavierton. Keine Zeitlupe, keine Leerlaufaufnahmen, keine Schnitte, die die räumliche Kontinuität unterbrechen, keine Bildschirme, Software-Benutzeroberflächen, Dashboards, Fortschrittsbalken, Diagramme, Bildunterschriften, Beschriftungen, Logos, Wasserzeichen oder erklärender Text. Seitenverhältnis 16:9.
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
Von Kampagnenkonzepten und Produktanimationen über referenzgesteuerte Markenvideos bis hin zu Entwicklertools verwandelt HappyHorse 1.1 Prompts und Bilder in anpassbare Kurzvideoinhalte.
Verwandeln Sie schriftliche Konzepte mit flexiblen Seitenverhältnissen in Videos mit 480P, 720P oder 1080P. Kreativteams können Kampagnenkonzepte, Social-Media-Posts und Story-Pitches erstellen, ohne Ausgangsmaterial oder Dreharbeiten.
Beginnen Sie mit einem Bild für das erste Frame und steuern Sie dessen Animation mit einem optionalen Prompt über 3 bis 15 Sekunden. Produktmarketing-Teams können statische Assets in Launch-Clips, Präsentationsvideos oder animierte Kataloginhalte verwandeln.
Mithilfe von ein bis neun Referenzbildern richtet das Modell Videos an bereitgestellten visuellen Eingaben mit bis zu 1080P aus. Markenteams können Kampagnenvarianten auf Basis freigegebener Bilder von Figuren, Produkten oder Umgebungen entwickeln.
Wählen Sie flexible Seitenverhältnisse und drei Auflösungsstufen, um Clips für unterschiedliche Platzierungen aus einem einzigen Generierungsworkflow vorzubereiten. Entwickler können Hochformat-, Querformat- und andere Layouts in Content-Produkten und Kampagnen bereitstellen.
Brauchen Sie eine schnelle Storyboard-Sequenz oder einen längeren Produktmoment? Mit Laufzeiten von 3 bis 15 Sekunden können Kreativtools schnelle Konzepte, Werbeclips und kompakte visuelle Sequenzen in einer einzigen Oberfläche unterstützen.
Erstellen Sie Videoanwendungen rund um Text-, Erstbild- und Mehrfachreferenz-Eingaben innerhalb einer einzigen Modellfamilie. Nutzer können für jeden Workflow das Ausgangsmaterial wählen, das sich am besten für Ideenfindung, Animation oder markengeleitete Erstellung eignet.
Vergleichen Sie die Generierungsmodi von HappyHorse 1.1 mit führenden Atlas Cloud-Videomodellen anhand unterstützter Eingaben, Clipdauer, Auflösung, Referenzkapazität und angegebenem Basispreis.
| Modell | Unterstützte Eingaben | Ausgabedauer | Auflösung | Max. Referenzbilder | Angegebener Basispreis |
|---|---|---|---|---|---|
| HappyHorse-1.1 Text-to-video | Text-Prompt | 3 bis 15 Sekunden | 480P, 720P, 1080P | - | $0.07, Einheit nicht angegeben |
| HappyHorse-1.1 Image-to-video | Erstbild und optionaler Prompt | 3 bis 15 Sekunden | 480P, 720P, 1080P | - | $0.07, Einheit nicht angegeben |
| HappyHorse-1.1 Reference-to-video | Text-Prompt und Referenzbilder | 3 bis 15 Sekunden | 480P, 720P, 1080P | 9 | $0.07, Einheit nicht angegeben |
| Wan-3.0 Reference-to-video | Text-, Bild-, Video-, Audio-, Dokument- oder Webseitenreferenzen | 2 bis 30 Sekunden oder intelligente Dauer | 480P, 720P, 1080P | 10 | $0.05, Einheit nicht angegeben |
| Seedance 2.5 Reference-to-Video | Text-, Bild-, Video- und Audioreferenzen | Bis zu 30 Sekunden | - | 30 | $0.167, Einheit nicht angegeben |
| MiniMax H3 Reference-to-Video | Text-, Bild-, Video- und Audioreferenzen | 4 bis 15 Sekunden | 768p standardmäßig, bis zu 2K | 9 | $0.038/Sekunde |
In wenigen Minuten startklar — folgen Sie diesen einfachen Schritten, um Modelle über die Plattform von Atlas Cloud zu integrieren und bereitzustellen.
Registrieren Sie sich auf atlascloud.ai und schließen Sie die Verifizierung ab. Neue Nutzer erhalten kostenlose Credits zum Erkunden der Plattform und Testen von Modellen.
Die Kombination der fortschrittlichen Happyhorse 1.1-Modelle mit der GPU-beschleunigten Plattform von Atlas Cloud bietet unübertroffene Leistung, Skalierbarkeit und Entwicklererfahrung.
Niedrige Latenz:
GPU-optimierte Inferenz für Echtzeit-Reasoning.
Einheitliche API:
Führen Sie Happyhorse 1.1, GPT, Gemini und DeepSeek mit einer Integration aus.
Transparente Preisgestaltung:
Vorhersehbare Token-basierte Abrechnung mit serverlosen Optionen.
Entwicklererfahrung:
SDKs, Analysen, Fine-Tuning-Tools und Vorlagen.
Zuverlässigkeit:
99,99% Verfügbarkeit, RBAC und compliance-bereite Protokollierung.
Sicherheit & Compliance:
SOC 2 Type II, HIPAA-Ausrichtung, Datensouveränität in den USA.
HappyHorse 1.1 ist ein Videogenerierungsmodell von Alibaba, das auf Atlas Cloud verfügbar ist und Text, ein erstes Bild oder Referenzbilder in kurze Videoclips umwandelt. Die Modellfamilie bietet separate Endpoints für Text-zu-Video, Bild-zu-Video und Referenz-zu-Video.
Du kannst anhand eines Text-Prompts eine Szene generieren, ein statisches Bild animieren oder einen neuen Clip mithilfe mehrerer visueller Referenzen steuern. Diese Workflows umfassen Videos nur auf Prompt-Basis, Animationen des ersten Bildes und referenzgesteuerte Inhalte.
Erstelle einen Atlas Cloud API-Key und sende eine authentifizierte POST-Anfrage an /api/v1/model/generateVideo, einschließlich der ausgewählten Modell-ID und der erforderlichen Eingaben. Die Antwort enthält eine Task-ID, mit der du den Vorhersagestatus abfragen kannst, bis die Ausgabe bereitsteht.
Wähle alibaba/happyhorse-1.1/text-to-video für die promptbasierte Generierung, alibaba/happyhorse-1.1/image-to-video für die Animation des ersten Bildes oder alibaba/happyhorse-1.1/reference-to-video für die Steuerung mit mehreren Bildern. Jeder Modus verfügt über ein eigenes Eingabeschema.
Für Text-zu-Video und Referenz-zu-Video kannst du 480p, 720p oder 1080p, eine Dauer von 3 bis 15 Sekunden und eines von neun unterstützten Seitenverhältnissen auswählen. Bild-zu-Video bietet dieselben Bereiche für Auflösung und Dauer und verwendet das hochgeladene Bild als erstes Bild.
Referenz-zu-Video akzeptiert eine bis neun Bild-URLs sowie einen Prompt, der beschreibt, wie die Bilder das Ergebnis beeinflussen sollen. Unterstützt werden JPEG-, JPG-, PNG- und WEBP-Dateien mit einem Limit von 20 MB pro Bild und einer Mindestlänge der kürzeren Seite von 400 Pixeln.
Atlas Cloud gibt für jeden der drei HappyHorse 1.1 Endpoints einen Standardpreis von 0,07 $ pro Sekunde an. Die Abrechnung erfolgt nutzungsabhängig, daher steigen die Generierungskosten mit der angeforderten Clipdauer.
Verwende den Parameter seed bei Text-zu-Video oder Referenz-zu-Video, wenn du die Zufälligkeit der Generierung steuern möchtest. Atlas Cloud akzeptiert explizite Ganzzahlwerte oder -1, wenn ein zufälliger Seed verwendet werden soll.
Jede Anfrage erzeugt einen Clip mit einer Länge zwischen 3 und 15 Sekunden. Bild-zu-Video verwendet ein einziges erstes Bild, während Referenz-zu-Video höchstens neun Referenzbilder akzeptiert.
Anleitungen, Tutorials und Produkt-Updates, mit denen Sie das Beste aus Atlas Cloud herausholen.