


HappyHorse 1.1 to rodzina modeli Alibaba do generowania wideo dla deweloperów pracujących z tekstem, klatkami źródłowymi lub odniesieniami wizualnymi. Zamienia prompty na klipy, animuje wybraną pierwszą klatkę z opcjonalnymi wskazówkami i umożliwia użycie od jednej do dziewięciu obrazów referencyjnych w celu precyzyjnego określenia kierunku wizualnego. Atlas Cloud łączy te procesy w ramach jednej integracji z przejrzystym rozliczaniem pay-as-you-go. Zacznij tworzyć już dziś.
Happyhorse 1.1 został opracowany przez Alibaba. Atlas Cloud (prowadzona przez Atlas Cloud AI LLC) zapewnia dostęp do modelu, ale nie jest jego właścicielem. Wszystkie znaki towarowe należą do ich odpowiednich właścicieli.
Atlas Cloud zapewnia najnowsze, wiodące w branży modele kreatywne.
Wybierz dane wejściowe w postaci tekstu, obrazu lub materiałów referencyjnych zależnie od tego, jak chcesz sterować generowaniem każdego wideo.
| Modalność | Opis |
|---|---|
| HappyHorse 1.1 T2V API (Text to Video) | Przekształcaj prompty tekstowe w wideo w rozdzielczości 480P, 720P lub 1080P, z elastycznymi proporcjami obrazu i długością od 3 do 15 sekund. Użyj tego endpointu do wizualizacji koncepcji, tworzenia treści do mediów społecznościowych i produkcji wideo bez obrazu źródłowego. |
| HappyHorse 1.1 I2V API (Image to Video) | Na podstawie obrazu pierwszej klatki ten endpoint tworzy wideo o długości od 3 do 15 sekund, z opcjonalnymi wskazówkami w promptcie oraz wyjściem w rozdzielczości 480P, 720P lub 1080P. Sprawdza się w animowaniu produktów, nadawaniu ruchu postaciom i tworzeniu narracji wizualnych na bazie istniejącej kompozycji. |
| HappyHorse 1.1 R2V API (Reference to Video) | Steruj generowaniem wideo za pomocą od jednego do dziewięciu obrazów referencyjnych oraz promptu tekstowego, wybierając wyjście w rozdzielczości 480P, 720P lub 1080P, elastyczne proporcje obrazu i długość od 3 do 15 sekund. Wybierz ten endpoint do scen opartych na materiałach referencyjnych, klipów skupionych na postaciach i projektów wymagających precyzyjniejszego kierunku wizualnego. |
HappyHorse 1.1 przekształca prompty, obrazy pierwszej klatki lub maksymalnie dziewięć obrazów referencyjnych w filmy trwające od 3 do 15 sekund, z wyjściem w rozdzielczości 480P, 720P lub 1080P, dziewięcioma proporcjami obrazu dla trybów tekstowych i referencyjnych, kontrolą parametru seed oraz dostępem w modelu pay-as-you-go przez Atlas Cloud.
Rozpocznij od promptu tekstowego o długości do 2,500 znaków i wygeneruj kompletny klip bez obrazu wejściowego. HappyHorse 1.1 obsługuje wyjście w rozdzielczości 480P, 720P lub 1080P oraz pozwala ustawić czas trwania od 3 do 15 sekund. Wybierz jedną z dziewięciu proporcji obrazu dla materiałów szerokoekranowych, pionowych, kwadratowych, portretowych lub ultrapanoramicznych. Ten workflow sprawdza się przy wizualizacji koncepcji, reklamach i krótkich scenach narracyjnych.
Przekształć pojedynczy obraz pierwszej klatki w ruch, opcjonalnie dodając prompt opisujący działanie, styl lub szczegóły sceny. Endpoint image-to-video akceptuje pliki JPEG, JPG, PNG lub WEBP o rozmiarze do 20 MB, przy czym oba wymiary muszą mieć co najmniej 300 pikseli. Wybierz rozdzielczość 480P, 720P lub 1080P oraz czas trwania od 3 do 15 sekund. Ten tryb nadaje się do ujęć produktowych, portretów i kluczowych klatek storyboardów.
Pokieruj generowaniem nowego filmu za pomocą od 1 do 9 obrazów referencyjnych oraz wymaganego promptu tekstowego. Każdy obraz referencyjny JPEG, JPG, PNG lub WEBP może mieć rozmiar do 20 MB, a jego krótszy bok musi mieć co najmniej 400 pikseli. Ustaw rozdzielczość, czas trwania, proporcje obrazu i parametr seed wyjścia. Ten tryb zapewnia workflowom związanym z postaciami, produktami i kierunkiem artystycznym więcej materiału źródłowego do wykorzystania.
Dopasuj każde generowanie oparte na tekście lub obrazach referencyjnych do miejsca docelowego, korzystając z dziewięciu proporcji obrazu: 16:9, 9:16, 1:1, 4:3, 3:4, 4:5, 5:4, 9:21 i 21:9. Rozdzielczość obejmuje 480P, 720P i 1080P, a czas trwania wynosi od 3 do 15 sekund. Połącz te ustawienia, aby tworzyć klipy do kanałów mobilnych, odtwarzaczy internetowych, kwadratowych formatów, portretów lub kompozycji ultrapanoramicznych bez zmiany endpointów.
Używaj parametru seed razem z ustawieniami promptu, rozdzielczości, proporcji obrazu i czasu trwania, gdy potrzebujesz większej kontroli nad parametrami generowania. HappyHorse 1.1 akceptuje wartości seed od -1 do 2,147,483,647, przy czym -1 oznacza żądanie losowego seeda. Podczas iteracji pozostaw pozostałe ustawienia jawnie określone. Ten sparametryzowany workflow pomaga deweloperom porządkować testy kreatywne i porównywać warianty przy zachowaniu spójnej struktury żądania.
Uzyskaj dostęp do wszystkich trzech workflowów HappyHorse 1.1 przez Atlas Cloud, korzystając z jednego klucza zgodnego z OpenAI i rozliczania pay-as-you-go. Standardowe ceny zaczynają się od $0.07 za sekundę, a opłaty rosną wraz z użyciem zamiast wymagać subskrypcji. Przełączaj się między ścieżkami modeli tekst na wideo, obraz na wideo i referencja na wideo, zachowując ten sam schemat integracji. Taka konfiguracja odpowiada deweloperom tworzącym wielotrybowe produkty wideo bez konieczności zakładania osobnych kont u dostawców.
Zobacz, jak HappyHorse 1.1 i dwa porównywalne modele wideo interpretują te same prompty w scenach kinetycznej akcji i stylizowanej opowieści fantasy.
Trwająca 8–10 sekund, ciągła, fotorealistyczna, kinetyczna sekwencja kulinarno-filmowa w wagonie restauracyjnym pędzącym przez gwałtowną alpejską zamieć. Doświadczony kucharz kolejowy naturalnie kołysze się wraz z brutalnymi ruchami wagonu na boki, przygotowując śniadanie: jedną ręką podrzuca wysoko cienki, złocisty naleśnik, przesuwa się wąskim przejściem, by wolną ręką złapać toczącą się pomarańczę, a następnie uderza opadający naleśnik brzegiem patelni, posyłając go czystym, fizycznie wiarygodnym łukiem przez otwarte drzwi między wagonami. Rozpocznij od ekstremalnego zbliżenia śledzącego ruch z boku, tuż obok ryczących płomieni kuchenki, skwierczącego ciasta i kropli gorącego masła rozpryskujących się na polerowanej stali; przejdź w szybkie półokrążenie wokół kucharza, gdy równoważy każdy wstrząs, a jego kurtka i fartuch realistycznie reagują na ruch; następnie przemknij przez drzwi w precyzyjnym ujęciu śledzącym lecący naleśnik, gdy przechodzi przez elastyczne połączenie do następnego wagonu, ledwo omijając kelnera, i idealnie ląduje na talerzu śniadaniowym zaskoczonego pasażera. Dokładnie w chwili lądowania za oknami przechodzi potężna lawina, gdy pociąg przed nią ucieka, tworząc wyrazisty wizualny punkt kulminacyjny. Ciepłe lampy wolframowe i pomarańczowe światło ognia zderzają się z lodowatym błękitem świtu wpadającym przez okna pokryte smugami śniegu; warstwowe pomarańczowo-złote odcienie jedzenia, srebrzystoszary metal i zimne błękity dzikiej przyrody; głęboka, wąska perspektywa centralna, powtarzające się ościeżnice drzwi widoczne jedna w drugiej, silny paralaksa, subtelne drżenie kamery z ręki, wyraźna czytelność ruchu, płynna ciągłość obiektu i spójność przestrzenna w obu wagonach, realistyczna równowaga, płynne rozpryski, bezwładność tkanin, kolizje i fizyka pocisków. Zsynchronizowana warstwa dźwiękowa: stukot kół na szynach i jęki wagonu wyznaczają rytm, syk patelni i trzaski masła go przyspieszają, pomarańcza toczy się w synchronii z metalicznymi kliknięciami, uderzenie patelni przypada na jasny, perkusyjny akcent, po którym następuje miękkie klaśnięcie talerza i ogłuszający ryk lawiny; bez zwolnionego tempa, bez statycznych wypełniaczy, bez ekranów, interfejsów, pulpitów, pasków postępu, wykresów, podpisów, napisów, logotypów ani widocznego tekstu. Kinowy realizm klasy premium, dynamiczna reklama kulinarna, immersyjna iluzja jednego ujęcia, proporcje obrazu 16:9.
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
Wysokonasycona, graficzna, animowana sekwencja akcji 3D trwająca 9 sekund, rozgrywająca się o zmierzchu w terminalu kontenerowym: koralowoczerwony fortepian koncertowy zrywa się i pędzi w dół stalowej rampy załadunkowej, a jego małe kółka transportowe grzechoczą i podskakują pod wpływem wiarygodnego ciężaru, podczas gdy kierowca wózka widłowego w kobaltowoniebieskim kombinezonie ściga go, lawirując między musztardowożółtymi suwnicami i nieustannie podnoszonymi oraz opuszczanymi kontenerami, które na krótko tworzą zmieniający się korytarz awaryjny. Rozpocznij od ekstremalnie niskiego ujęcia śledzącego, kilka centymetrów od wirującego kółka i gwałtownie podskakującej nogi fortepianu, z iskrami i metalicznymi uderzeniami idealnie zsynchronizowanymi z dźwiękiem; szybko wznieś kamerę do widoku z góry, ukazując trasę pościgu jako geometryczny labirynt koralowoczerwonych, kobaltowoniebieskich i musztardowożółtych bloków kolorów; następnie wykonaj gwałtowne panoramowanie i okrążenie do przodu rozpędzonego wózka widłowego, gdy ten zmniejsza dystans. Na krawędzi nabrzeża kierowca wsunie widły pod fortepian, uniesie jego ciężki korpus w ostatniej chwili, obróci się w jednym zdecydowanym ruchu i bezpiecznie odstawi go z głębokim, zsynchronizowanym metalicznym brzękiem. Pokrywa otworzy się gwałtownie pod wpływem bezwładności; w ostatnim rytmie mewa siada na klawiszach i wydobywa jeden czysty, końcowy dźwięk. Ciągły ruch o wysokiej gęstości, fizycznie wiarygodny pęd, kolizje, ugięcia zawieszenia, przemieszczające się ładunki oraz stabilna tożsamość postaci i obiektów przez cały czas; ostre cienie, odważna geometryczna kompozycja, stylizowana kinowa animacja 3D, wyraźne konturowe światło zmierzchu, rytmiczna industrialna perkusja zbudowana z grzechotu kół, syknięć hydrauliki, uderzeń kontenerów, wysiłku silnika, trzepotu skrzydeł mewy i końcowego dźwięku fortepianu. Bez zwolnionego tempa, bez ujęć oczekiwania, bez cięć zrywających ciągłość przestrzenną, bez ekranów, interfejsów oprogramowania, pulpitów, pasków postępu, wykresów, podpisów, etykiet, logotypów, znaków wodnych ani tekstu objaśniającego. Proporcje obrazu 16:9.
Generated with HappyHorse-1.1 Text-to-video on Atlas Cloud
Generated with Kling V3.0 Turbo Text-to-Video on Atlas Cloud
Generated with HappyHorse-1.0 Text-to-video on Atlas Cloud
Od koncepcji kampanii i animacji produktów po filmy marki oparte na materiałach referencyjnych oraz narzędzia dla deweloperów — HappyHorse 1.1 przekształca prompty i obrazy w elastyczne krótkie materiały wideo.
Przekształcaj koncepcje opisane tekstem w filmy w rozdzielczości 480P, 720P lub 1080P, korzystając z elastycznych proporcji obrazu. Zespoły kreatywne mogą tworzyć koncepcje kampanii, posty do mediów społecznościowych i zarysy historii bez materiałów źródłowych ani filmowania.
Rozpocznij od obrazu pierwszej klatki, a następnie pokieruj jego animacją za pomocą opcjonalnego promptu, wybierając długość od 3 do 15 sekund. Marketerzy produktowi mogą przekształcać statyczne materiały w klipy premierowe, filmy ekspozycyjne lub animowane katalogi.
Model wykorzystuje od jednego do dziewięciu obrazów referencyjnych, aby tworzyć filmy na podstawie dostarczonych materiałów wizualnych w rozdzielczości do 1080P. Zespoły ds. marki mogą opracowywać warianty kampanii inspirowane zatwierdzonymi obrazami postaci, produktów lub otoczenia.
Wybierz elastyczne proporcje obrazu i jeden z trzech poziomów rozdzielczości, aby przygotować klipy do różnych miejsc publikacji w ramach jednego procesu generowania. Deweloperzy mogą obsługiwać układy pionowe, poziome i inne w produktach oraz kampaniach opartych na treściach.
Potrzebujesz szybkiego ujęcia do storyboardu czy dłuższego momentu prezentującego produkt? Długość od 3 do 15 sekund pozwala narzędziom kreatywnym obsługiwać szybkie koncepcje, klipy promocyjne i krótkie sekwencje wizualne w jednym interfejsie.
Twórz aplikacje wideo oparte na tekście, obrazie pierwszej klatki i wielu materiałach referencyjnych, korzystając z jednej rodziny modeli. Użytkownicy mogą wybrać materiał początkowy najlepiej dopasowany do ideacji, animacji lub tworzenia treści zgodnych z identyfikacją marki w każdym procesie.
Porównaj tryby generowania HappyHorse 1.1 z wiodącymi modelami wideo Atlas Cloud pod względem obsługiwanych danych wejściowych, długości klipu, rozdzielczości, liczby obrazów referencyjnych i podanej ceny bazowej.
| Model | Obsługiwane dane wejściowe | Czas trwania wyjścia | Rozdzielczość | Maks. liczba obrazów referencyjnych | Podana cena bazowa |
|---|---|---|---|---|---|
| HappyHorse-1.1 tekst-do-wideo | Prompt tekstowy | od 3 do 15 sekund | 480P, 720P, 1080P | - | $0.07, jednostka niepodana |
| HappyHorse-1.1 obraz-do-wideo | Obraz pierwszej klatki i opcjonalny prompt | od 3 do 15 sekund | 480P, 720P, 1080P | - | $0.07, jednostka niepodana |
| HappyHorse-1.1 referencja-do-wideo | Prompt tekstowy i obrazy referencyjne | od 3 do 15 sekund | 480P, 720P, 1080P | 9 | $0.07, jednostka niepodana |
| Wan-3.0 referencja-do-wideo | Referencje tekstowe, obrazowe, wideo, audio, dokumentowe lub ze stron internetowych | od 2 do 30 sekund lub inteligentny czas trwania | 480P, 720P, 1080P | 10 | $0.05, jednostka niepodana |
| Seedance 2.5 referencja-do-wideo | Referencje tekstowe, obrazowe, wideo i audio | Do 30 sekund | - | 30 | $0.167, jednostka niepodana |
| MiniMax H3 referencja-do-wideo | Referencje tekstowe, obrazowe, wideo i audio | od 4 do 15 sekund | Domyślnie 768p, do 2K | 9 | $0.038/sekundę |
Zacznij w kilka minut — wykonaj te proste kroki, aby zintegrować i wdrożyć modele za pośrednictwem platformy Atlas Cloud.
Zarejestruj się na atlascloud.ai i ukończ weryfikację. Nowi użytkownicy otrzymują bezpłatne kredyty do eksploracji platformy i testowania modeli.
Połączenie zaawansowanych modeli Happyhorse 1.1 z platformą GPU-akcelerowaną Atlas Cloud zapewnia niezrównaną wydajność, skalowalność i doświadczenie deweloperskie.
Niska Latencja:
Inferencja zoptymalizowana pod GPU dla rozumowania w czasie rzeczywistym.
Zunifikowane API:
Uruchamiaj Happyhorse 1.1, GPT, Gemini i DeepSeek za pomocą jednej integracji.
Przejrzysta Wycena:
Przewidywalne rozliczenia za token z opcjami serverless.
Doświadczenie Dewelopera:
SDK, analityka, narzędzia dostrajania i szablony.
Niezawodność:
99,99% dostępności, RBAC i logowanie gotowe na zgodność.
Bezpieczeństwo i Zgodność:
SOC 2 Type II, zgodność z HIPAA, suwerenność danych w USA.
HappyHorse 1.1 to model Alibaba do generowania wideo, dostępny w Atlas Cloud, który przekształca tekst, pierwszą klatkę lub obrazy referencyjne w krótkie klipy wideo. Rodzina obejmuje osobne endpointy text-to-video, image-to-video i reference-to-video.
Możesz wygenerować scenę na podstawie promptu tekstowego, animować statyczny obraz lub pokierować tworzeniem nowego klipu za pomocą wielu odniesień wizualnych. Te przepływy obejmują filmy tworzone wyłącznie na podstawie promptu, animacje pierwszej klatki oraz treści sterowane obrazami referencyjnymi.
Utwórz klucz API Atlas Cloud i wyślij uwierzytelnione żądanie POST do /api/v1/model/generateVideo, podając wybrany identyfikator modelu oraz wymagane dane wejściowe. Odpowiedź zawiera identyfikator zadania, którego możesz używać do sprawdzania statusu predykcji do momentu przygotowania wyniku.
Wybierz alibaba/happyhorse-1.1/text-to-video do generowania na podstawie promptu, alibaba/happyhorse-1.1/image-to-video do animacji pierwszej klatki lub alibaba/happyhorse-1.1/reference-to-video do sterowania za pomocą wielu obrazów. Każdy tryb ma własny schemat danych wejściowych.
W trybach text-to-video i reference-to-video możesz wybrać 480p, 720p lub 1080p, czas trwania od 3 do 15 sekund oraz jedną z dziewięciu obsługiwanych proporcji obrazu. Image-to-video oferuje takie same zakresy rozdzielczości i czasu trwania, wykorzystując przesłany obraz jako pierwszą klatkę.
Reference-to-video przyjmuje od jednego do dziewięciu adresów URL obrazów oraz prompt opisujący, jak obrazy powinny wpłynąć na wynik. Obsługiwane są pliki JPEG, JPG, PNG i WEBP, przy limicie 20 MB na obraz oraz minimalnym krótszym boku o długości 400 pikseli.
Atlas Cloud podaje standardową cenę $0.07 za sekundę dla każdego z trzech endpointów HappyHorse 1.1. Rozliczenie odbywa się zgodnie z rzeczywistym użyciem, więc koszt generowania rośnie wraz z żądanym czasem trwania klipu.
Użyj parametru seed w trybie text-to-video lub reference-to-video, jeśli chcesz kontrolować losowość generowania. Atlas Cloud akceptuje jawne wartości całkowite lub -1, gdy preferowane jest losowe ziarno.
Każde żądanie generuje klip o długości od 3 do 15 sekund. Image-to-video wykorzystuje jeden obraz pierwszej klatki, natomiast reference-to-video przyjmuje maksymalnie dziewięć obrazów referencyjnych.
Poradniki, samouczki i nowości produktowe, dzięki którym w pełni wykorzystasz Atlas Cloud.