




Youchuan API obejmuje teraz generacje V8.1 i V8.2, zarówno obrazy statyczne, jak i ruch. Tryby sterowane promptami zwracają jednocześnie cztery warianty, obrazy renderują się natywnie w 2K HD bez etapu upscalingu, funkcje blend łączą do pięciu referencji, a pojedynczy obraz statyczny animuje się w pięciosekundowe klipy w 480p lub 720p. Atlas Cloud udostępnia to przez jeden klucz zgodny z OpenAI, z dostępem Day-0 i cenami za wywołanie od $0.086. Zacznij budować już dziś.
Atlas Cloud zapewnia najnowsze, wiodące w branży modele kreatywne.
Porównaj obok siebie wszystkie modalności w ofercie Youchuan API — z endpointami V8.1 i V8.2, liczbą wyników, rozdzielczościami oraz standardowymi stawkami za wywołanie w jednym widoku.
| Modalność | Opis |
|---|---|
| Youchuan T2I API (tekst na obraz) | Wprowadzasz prompty tekstowe, a w odpowiedzi otrzymujesz cztery gotowe obrazy — z opcjonalnym natywnym 2K HD, referencją stylu oraz kontrolami proporcji obrazu, stylize, chaos i weird przy każdym uruchomieniu. Endpointy V8.1 i V8.2 kosztują po $0.086 za wywołanie, co dobrze sprawdza się przy concept arcie, materiałach kampanijnych i szybkich moodboardach. |
| Youchuan I2I API (obraz na obraz) | Masz już kadr, na którym warto budować? Ten endpoint na nowo interpretuje obraz wejściowy pod kierunkiem promptu tekstowego i zwraca cztery warianty, zachowując natywne 2K HD, referencję stylu oraz te same kontrolki stylize, chaos i weird. V8.1 i V8.2 kosztują po $0.086 za wywołanie, więc iterowanie nad układem lub testowanie alternatywnych kierunków artystycznych pozostaje tanie. |
| Youchuan I2V API (obraz na wideo) | Jeden statyczny obraz zamienia się w cztery pięciosekundowe filmy w 480p albo 720p. Cztery podejścia na jedno uruchomienie pozwalają wybrać ruch, który naprawdę pasuje do ujęcia — przydatne w pętlach do social mediów, prewizualizacji filmowej i dodawaniu ruchu do statycznych key artów. Obie wersje działają w cenie $0.086 za wywołanie. |
| Youchuan Blend API (fuzja wielu obrazów) | Przekaż od dwóch do pięciu obrazów źródłowych, a model połączy je w cztery wspólne wyniki w natywnym 2K HD, z opcjonalnym promptem sterującym kierunkiem miksu. To właściwe miejsce na kompozycje, mieszanie nastrojów i składanie rozproszonych referencji w jeden kadr — w cenie $0.086 za wywołanie zarówno w V8.1, jak i V8.2. |
| Youchuan Style Transfer API (reteksturyzacja obrazu) | Retexture zmienia styl artystyczny obrazu wejściowego, zachowując jego kompozycję, i zwraca cztery warianty w nowej stylistyce. W cenie $0.129 za wywołanie w obu wersjach sprawdza się przy iteracjach rebrandingu, testach kierunku artystycznego i nadawaniu mieszanemu zestawowi zdjęć spójnego wyglądu. |
| Youchuan Remove Background API (usuwanie tła) | Usuwanie tła to najbardziej bezpośrednie wywołanie w tej rodzinie: zamienia dowolny obraz wejściowy w pojedynczy wynik z obiektem odizolowanym na przezroczystości. Listingi produktowe, layouty marketingowe i pipeline’y compositingowe mogą użyć tego wyjścia bezpośrednio; cena wynosi $0.086 za wywołanie zarówno w V8.1, jak i V8.2. |
Text-to-image, image-to-image, blending, retexture, background removal oraz pięciosekundowa animacja działają z jednym kluczem Youchuan API, teraz obejmując checkpointy V8.1 i V8.2, z natywnym 2K HD, dziewięcioma proporcjami obrazu oraz kontrolami stylize, chaos i weird rozliczanymi za każde wywołanie.
Każdy prompt o długości do 1024 znaków zwraca cztery rendery w jednym wywołaniu, wszystkie z charakterystycznymi dla tej rodziny nasyconymi kolorami i dramatyczną kompozycją. Dyrektorzy artystyczni mogą porównać kilka mocnych kierunków, zanim zatwierdzą finalny kadr.
Stylize obejmuje zakres od 0 do 1000, chaos sięga 100, weird rośnie do 3000, a quality przełącza się między 1 a 4, z zablokowanymi seedami dla powtarzalności. Brand-safe output i odważne eksperymenty pochodzą z tego samego endpointu.
Włącz flagę HD, a Youchuan API wyrenderuje natywne 2K przy stawce 1.5x względem bazowej, w dziewięciu proporcjach obrazu od 1:1 do 21:9. Nic nie jest interpolowane, więc drobne tekstury zachowują jakość w druku wielkoformatowym.
Blend łączy od dwóch do pięciu obrazów źródłowych w cztery spójne wyniki w natywnym 2K, z opcjonalnym promptem sterującym tym, jak łączą się kolor, oświetlenie i obiekty. Zespoły koncepcyjne zamieniają rozproszone referencje w jeden kadr zgodny z marką.
Kompozycja pozostaje zablokowana, podczas gdy retexture zmienia styl obrazu na cztery warianty, modyfikując wyłącznie kolor, teksturę i nastrój zgodnie z promptem. Przy $0.129 za wywołanie jeden zatwierdzony układ może obsłużyć kilka motywów kampanii.
Jeden obraz statyczny i krótki prompt ruchu generują cztery pięciosekundowe klipy w 480p lub 720p, z ruchem ustawionym na low albo high. Statyczny key art zmienia się w teasery do social mediów lub szybkie podglądy ujęć.
Każde z poniższych porównań uruchamia ten sam prompt przez Youchuan API oraz dwa inne modele image-to-video dostępne w Atlas Cloud, dzięki czemu różnice w ruchu, spójności sceny i stylu wizualnym widać w samym materiale, a nie na karcie specyfikacji.
Kurier rowerowy na ostrym kole przeciska się przez zalany deszczem nocny targ w Hongkongu, a neony rozlewają się po mokrym asfalcie. Zahacza o stragan z owocami; pomarańcze rozsypują się i odbijają we wszystkie strony, gdy sprzedawca bezradnie unosi ręce. Kurier wpada w boczny poślizg, podpiera się stopą, mocno się odpycha i wystrzeliwuje przez wąską lukę między dwoma mijającymi go tramwajami, podczas gdy za nim z szyn sypią się iskry. Zacznij od niskiego ujęcia śledzącego tylne koło przez kałuże, wykonaj gwałtowny whip pan, aby uchwycić pomarańcze koziołkujące w powietrzu, a potem przejdź do ujęcia z drona, który wznosi się nad dachami targu, gdy rower wypada drugim końcem na pustą drogę. Wolumetryczne światło neonów, lustrzane odbicia w każdej kałuży, płytka głębia ostrości, surowy realizm filmowy. Gwar targu w tle, dzwonki tramwajów i napędzający puls syntezatora narastający w chwili ucieczki. Proporcje obrazu 16:9.
Generated with Youchuan V8.2 on Atlas Cloud
Generated with Kling v3.0 Pro on Atlas Cloud
Generated with seedance 2.0 Mini on Atlas Cloud
Młoda żeglarka nieba kurczowo trzyma się takielunku małego drewnianego sterowca, gdy ten nurkuje przez kanion unoszących się wysp o złotej godzinie. Stado ptaków o kryształowych skrzydłach rozpierzcha się przed dziobem, po czym jeden ptak zawraca i wyrywa jej z dłoni mosiężny kompas. Dziewczyna rzuca się wzdłuż bomu, chwyta ptaka za pióro w ogonie i oboje koziołkują za burtę, zanim jej szybowiec rozkłada się z trzaskiem, a ona ostrym skrętem omija wodospad spadający w otwarte niebo. Zacznij od szerokiego ujęcia okrążającego sterowiec, przejdź do perspektywy pierwszej osoby, gdy rzuca się w dół bomu, a następnie opuść kamerę do niskiego ujęcia ku górze, gdy szybowiec rozpościera się na tle słońca. Malarski styl anime z ręcznie rysowanym cel shading i bujnymi akwarelowymi niebami. Świst wiatru, skrzypienie drewna i wznoszące się orkiestrowe crescendo w chwili, gdy szybowiec się otwiera. Proporcje obrazu 16:9.
Generated with Youchuan V8.2 on Atlas Cloud
Generated with Seedance 2.0 Mini on Atlas Cloud
Generated with Grok Imagine Video on Atlas Cloud
Kluczowe grafiki kampanii, wycięcia produktów, kadry prewizualizacyjne, przestylizowane zasoby i pięciosekundowe klipy do social mediów powstają w tym samym Youchuan API — niezależnie od tego, czy tworzysz od zera na podstawie promptu, czy animujesz zatwierdzony kadr statyczny.
Jeden prompt zwraca cztery rendery, a flaga HD podbija je do natywnego 2K, podczas gdy stylize, chaos i aspect ratio sterują klimatem. Zespoły marketingowe wchodzą na przeglądy z kilkoma kierunkami zamiast jednego.
Gdy zdjęcie produktu musi działać na dowolnym tle, Remove Background izoluje obiekt na przezroczystości za $0.086 za wywołanie. Sklepy i feedy marketplace otrzymują spójne wycięcia bez ręcznego maskowania.
Przekaż od dwóch do pięciu obrazów referencyjnych do Blend, a model połączy je w cztery spójne kadry 2K, kierując się opcjonalnym promptem. Działy artystyczne mogą zaprezentować cały świat, zanim cokolwiek zostanie zbudowane.
Style Transfer przemalowuje zatwierdzony obraz na cztery warianty za $0.129 za wywołanie, pozostawiając jego kompozycję bez zmian. Dzięki temu jeden zasób może zyskać letni wygląd, świąteczny wygląd i wszystko pomiędzy.
Po co zaczynać układ od nowa, jeśli prawie działa? Image-to-Image przekształca szkic w cztery dopracowane warianty, sterowane promptem tekstowym i opcjonalną referencją stylu, dzięki czemu projektanci eksplorują kierunki, zachowując to, co już działa.
Dowolny kadr statyczny może stać się czterema pięciosekundowymi klipami w 480p lub 720p, z ruchem ustawionym na niski lub wysoki oraz krótkim promptem opisującym ruch kamery. Zespoły social media zapełniają feedy, które premiują ruch.
Porównaj Youchuan API z Kling, Seedance, Veo i Grok Imagine pod kątem obsługiwanych wejść, rozdzielczości, długości klipu, audio i ceny katalogowej, a następnie wybierz endpoint pasujący do ujęcia, którego potrzebujesz.
| Model | Obsługiwane wejścia | Rozdzielczość | Długość klipu | Natywne audio | Cena katalogowa Atlas Cloud |
|---|---|---|---|---|---|
| Youchuan V8.2 Image-to-Video | Obraz początkowy oraz opcjonalny prompt ruchu, np. ruch kamery | 480p lub 720p, przy czym 720p kosztuje 3x stawkę za 480p | Jedno wywołanie zwraca cztery 5-sekundowe klipy | - | $0.086 |
| Youchuan V8.1 Image-to-Video | Takie samo połączenie obrazu początkowego i opcjonalnego promptu jak w V8.2 | 480p lub 720p z identycznym współczynnikiem 3x dla wyższego poziomu | Również cztery ujęcia po 5 sekund na żądanie | - | $0.086 |
| Kling V3.0 Turbo Image-to-Video | Jedna klatka początkowa JPG lub PNG do 10MB, sterowana promptem pozytywnym | 720p lub 1080p, z domyślnym 1080p | Od 3 do 15 sekund | - | $0.112 |
| Seedance 2.0 Fast Image-to-Video | Pierwsza klatka, opcjonalna ostatnia klatka oraz prompt ruchu | 480p i 720p, z możliwością przejścia do 720p-SR, 1080p-SR i 1440p-SR | Od 4 do 15 sekund albo -1, aby model wybrał sam | √ | $0.09 |
| Veo3.1 Fast Image-to-video | Obraz początkowy, opcjonalna klatka końcowa, prompt i prompt negatywny | Wyjście 720p, 1080p lub 4K | 4, 6 lub 8 sekund, choć 1080p i 4K wymagają 8 | √ | $0.08 |
| Grok Imagine Video v1.5 Image-to-Video | URL HTTPS klatki początkowej lub data URI z promptem w języku naturalnym | 480p, 720p lub 1080p | Od 1 do 15 sekund, domyślnie 8 | - | $0.08 |
Zacznij w kilka minut — wykonaj te proste kroki, aby zintegrować i wdrożyć modele za pośrednictwem platformy Atlas Cloud.
Zarejestruj się na atlascloud.ai i ukończ weryfikację. Nowi użytkownicy otrzymują bezpłatne kredyty do eksploracji platformy i testowania modeli.
Połączenie zaawansowanych modeli Youchuan z platformą GPU-akcelerowaną Atlas Cloud zapewnia niezrównaną wydajność, skalowalność i doświadczenie deweloperskie.
Niska Latencja:
Inferencja zoptymalizowana pod GPU dla rozumowania w czasie rzeczywistym.
Zunifikowane API:
Uruchamiaj Youchuan, GPT, Gemini i DeepSeek za pomocą jednej integracji.
Przejrzysta Wycena:
Przewidywalne rozliczenia za token z opcjami serverless.
Doświadczenie Dewelopera:
SDK, analityka, narzędzia dostrajania i szablony.
Niezawodność:
99,99% dostępności, RBAC i logowanie gotowe na zgodność.
Bezpieczeństwo i Zgodność:
SOC 2 Type II, zgodność z HIPAA, suwerenność danych w USA.
Youchuan API daje deweloperom programowy dostęp do Youchuan, oficjalnej chińskiej platformy Midjourney, za pomocą jednego klucza Atlas Cloud. Obejmuje sześć trybów generowania w dwóch generacjach modeli, V8.1 i V8.2: text-to-image, image-to-image, image-to-video, multi-image blending, style transfer oraz background removal. Rozliczenie działa w modelu pay-as-you-go za wywołanie, więc przed pierwszym żądaniem nie trzeba podpisywać subskrypcji.
Rodzina udostępnia sześć trybów, a każdy z nich jest dostępny zarówno w V8.1, jak i V8.2. Text-to-image, image-to-image i blend zwracają po cztery propozycje na uruchomienie, style transfer przemalowuje obraz wejściowy przy zachowaniu jego kompozycji, image-to-video animuje statyczny obraz do czterech pięciosekundowych klipów, a background removal zwraca jedno przezroczyste wycięcie. Blend przyjmuje od dwóch do pięciu obrazów źródłowych w jednym wywołaniu.
V8.1 została udostępniona 30 kwietnia 2026 r. jako najszybszy model w ofercie, mniej więcej cztery do pięciu razy szybszy od wcześniejszych wersji, i wprowadziła natywne renderowanie 2K za pomocą flagi hd. V8.2 pojawiła się 27 lipca 2026 r. z ulepszeniami estetyki i jakości obrazu: rendery są bardziej wyraziste i dopracowane, a słabe jakościowo odstępstwa występują znacznie rzadziej. Obie wersje nadal można wywoływać, więc możesz przypiąć V8.1 dla spójności z istniejącymi pracami albo przejść na V8.2, aby uzyskać nowszy wygląd.
Utwórz konto Atlas Cloud, wygeneruj jeden klucz API, a następnie wyślij żądanie z identyfikatorem modelu dla wybranego trybu i wersji, na przykład youchuan/v8.2/text-to-image. Stawki są przejrzyste i naliczane za wywołanie, a dostęp Day-0 oznacza, że każdą nową wersję można wywołać od razu po jej udostępnieniu. Zacznij budować już dziś.
Tryby obrazów domyślnie używają proporcji 1:1 i obsługują dziewięć formatów, od kwadratu po kinowe 21:9 i pionowe 9:21. Ustawienie hd na true generuje natywny wynik 2K zamiast przepuszczania przez upscaling, rozliczany po 1.5x stawki bazowej. Po stronie ruchu image-to-video zwraca cztery pięciosekundowe klipy w 480p albo 720p, z motion ustawionym na low lub high.
Tryby sterowane promptem udostępniają ustawienia dobrze znane użytkownikom Midjourney: aspect_ratio, stylize od 0 do 1000, chaos do 100, weird do 3000 oraz quality ustawione na 1 albo 4. Prompty mogą mieć do 1024 znaków, a opcjonalny adres URL obrazu sref kieruje estetyką bez narzucania kompozycji. Style transfer i background removal są celowo prostsze: pierwszy przyjmuje obraz wejściowy oraz prompt stylu docelowego.
Generowanie jest asynchroniczne. Wywołanie zwraca request_id, a odpytywanie endpointu prediction zgłasza status jako created, processing, completed albo failed; po zakończeniu zadania tablica outputs zawiera adresy URL wyników. Ustaw enable_base64_output na true, jeśli wolisz otrzymać payload bezpośrednio w odpowiedzi zamiast pobierać hostowane pliki.
Większość trybów w Youchuan API kosztuje $0.086 za wywołanie, w tym text-to-image, image-to-image, blend, background removal i image-to-video, natomiast style transfer kosztuje $0.129 za wywołanie. Do tych stawek dochodzą dwa mnożniki: obrazy hd są rozliczane po 1.5x stawki bazowej, a wideo 720p po 3x stawki za 480p. Nic nie jest pakietowane w plan, więc płacisz tylko za wykonane wywołania.
Tak. Ustaw seed na konkretną liczbę całkowitą, a ten sam prompt z tymi samymi ustawieniami odtworzy dokładnie ten render; domyślna wartość -1 losuje każde uruchomienie. Aby uzyskać spójny wygląd w kampanii, przekaż jeden obraz referencyjny sref ze stałą wartością stylize i zmieniaj tylko prompt.
Kształty wyników są stałe: klipy trwają pięć sekund, blend przyjmuje maksymalnie pięć obrazów, a prompty są obcinane po 1024 znakach. Style transfer nie udostępnia parametrów aspect ratio, hd ani stylize, więc rozdzielczość i kadrowanie wynikają z obrazu wejściowego. Ponieważ zadania są kolejkowane i odpytywane, a nie streamowane, dodaj do pipeline’u sprawdzanie statusu i ponowienia zamiast oczekiwać odpowiedzi synchronicznej.
Poradniki, samouczki i nowości produktowe, dzięki którym w pełni wykorzystasz Atlas Cloud.