Seedance 2.5 już dostępne — Jako pierwsze na Atlas Cloud

Wan 3.0 API is Coming to Atlas Cloud Soon

Wan 3.0 API to kolejna generacja rodziny wideo Wan od Alibaba, stworzona w celu podniesienia generowania długich form, kontroli wielu punktów odniesienia oraz jakości audiowizualnej na nowe wyżyny. Atlas Cloud hostuje już Wan 2.7, 2.6 i 2.5, więc Wan 3.0 będzie korzystać z tego samego zunifikowanego klucza i działać bez oddzielnej konfiguracji. Uzyskaj wczesny dostęp w dniu premiery. Przewiń w dół do sekcji demonstracyjnej, aby wcześnie przyjrzeć się temu, co potrafi stworzyć Wan 3.0.

Wan 3.0 został opracowany przez Alibaba. Atlas Cloud (prowadzona przez Atlas Cloud AI LLC) zapewnia dostęp do modelu, ale nie jest jego właścicielem. Wszystkie znaki towarowe należą do ich odpowiednich właścicieli.

Wkrótce

Modele Wkrótce Dostępne

Kończymy pracę nad tą kolekcją — w międzyczasie zapoznaj się z podobnymi kolekcjami poniżej.

Poznaj Więcej Rodzin

Seedance 2.5

API Seedance 2.5 jest już dostępne w Atlas Cloud! Zapewnia deweloperom najnowszy model wideo od ByteDance. Generuje do 30 sekund natywnego wideo w jednym przebiegu z tekstu, pojedynczego obrazu lub nawet 50 wielomodalnych odniesień, z zsynchronizowanym dźwiękiem i wielojęzycznym tekstem w kadrze. W Atlas Cloud można uzyskać do niego dostęp za pomocą jednego klucza, a spójność obiektu i ulepszona fizyka zachowują spójność długich ujęć.

Zobacz Rodzinę

MiniMax H3

MiniMax H3 API udostępnia ogólnego zastosowania multimodalny model wideo MiniMax, który odczytuje tekst, obrazy, wideo i audio jako jeden kontekst, zamiast przetwarzać po jednym zadaniu naraz. Klipy trwają od 5 do 15 sekund przy 24 FPS w proporcjach obrazu od 21:9 do 9:16, a jeden prompt może podmieniać postacie, zastępować tła, przepisywać dialogi lub klonować głos na podstawie klipu referencyjnego. Atlas Cloud udostępnia to wszystko przez jeden endpoint zgodny z OpenAI. Zacznij tworzyć już dziś.

Zobacz Rodzinę

Seedream 5.0 Pro

Seedream 5.0 Pro API udostępnia programistom sterowalny model edycji obrazów firmy ByteDance w Atlas Cloud. Precyzyjnie rozmieszcza edycje za pomocą kotwic i współrzędnych, dzieli obrazy na edytowalne warstwy, łączy wiele odniesień oraz dopasowuje dokładne kolory i materiały, z wielojęzycznym tekstem w rozdzielczościach 2K i 3K. W Atlas Cloud można uzyskać do niego dostęp za pomocą jednego klucza!

Zobacz Rodzinę

Seedance 2.0

API Seedance 2.0 zapewnia produkcyjny dostęp do multimodalnego modelu wideo ByteDance — czteromodalne dane wejściowe (tekst, obraz, wideo, dźwięk) oraz wiodący w branży system „Universal Reference”, który blokuje kompozycję, ruchy kamery i działania postaci w różnych ujęciach. Zintegruj kontrolę na poziomie reżysera za pomocą jednego wywołania API, stałej stawki 0,09 USD/s, natychmiastowego klucza i braku listy oczekujących — wszystko to przy wsparciu czasu sprawności i zgodności klasy korporacyjnej. Seedance 2.0 Native 4K jest już dostępne!

Zobacz Rodzinę

GPT Image 2

API GPT Image 2 daje programistom dostęp do najnowszego modelu obrazów firmy OpenAI, następcy GPT Image 1.5. Generuje i edytuje on obrazy z dokładnym renderowaniem tekstu w skryptach łacińskich i CJK, a także zapewnia silną kompozycję dla plakatów, makiet i infografik. W Atlas Cloud można uzyskać do niego dostęp za pośrednictwem jednego zunifikowanego API wraz z ponad 300 modelami, z darmowymi kredytami, gwarantowanym czasem pracy (uptime) na poziomie 99,99% i bez wymogu weryfikacji organizacji OpenAI.

Zobacz Rodzinę

Gemini Omni Flash

Gemini Omni API wprowadza do Twojego stacku multimodalny model generowania i edycji wideo od Google DeepMind, zaprezentowany na Google I/O 2026. Gemini Omni łączy silnik rozumowania Gemini z mediami generatywnymi, przyjmując dowolną kombinację tekstu, obrazów, wideo i dźwięku, aby tworzyć spójne, oparte na wiedzy wyniki. Dopracowuj rezultaty w naturalnej rozmowie — podmieniaj obiekty, przepisuj sceny i zmieniaj style, podczas gdy fizyka, postacie i ciągłość pozostają nienaruszone. Atlas Cloud udostępnia pełną gamę Gemini Omni Flash — tekst na wideo, obraz na wideo z maksymalnie 7 obrazami referencyjnymi oraz referencję na wideo — poprzez jedno ujednolicone API z przejrzystym rozliczaniem za sekundę już od $0.112 i bez subskrypcji. Zacznij tworzyć już dziś.

Zobacz Rodzinę

Grok Imagine

Grok Imagine API obejmuje modele obrazu, wideo i mowy xAI, od Image 2.0 do Video 1.5 i xAI TTS v1. Renderuj statyczne obrazy w rozdzielczości 1K lub 2K w 14 proporcjach, przesuń scenę do 15 sekund ruchu w 1080p, steruj zdjęciami za pomocą do 7 obrazów referencyjnych lub narruj je w 20 językach. Atlas Cloud uruchamia każdy tryb na jednym endpoincie, wyceniony na zasadzie płatności za użycie od $0.02 za obraz i $0.05 za sekundę. Zacznij budować dzisiaj.

Zobacz Rodzinę

Google

Najpotężniejsze modele kreatywne Google są w pełni dostępne na platformie Atlas Cloud. Veo 3.1 zapewnia kinową generację wideo, Nano Banana 2 umożliwia tworzenie obrazów o wysokiej wierności, a Gemini wprowadza wielomodalną inteligencję do każdego przepływu pracy. Uzyskaj dostęp do pełnego pakietu modeli Google za pomocą jednego klucza API key z dostępnością Day-0 i cennikiem pay-as-you-go.

Zobacz Rodzinę

Seedance 2.0 Mini

Seedance 2.0 Mini wprowadza multimodalne generowanie wideo firmy ByteDance do przepływów pracy, w których szybkość i koszty mają największe znaczenie. Zapewnia podstawowe możliwości Seedance 2.0 przy mniejszym zużyciu zasobów — szybsze generowanie, niższy koszt na wideo i tę samą integrację API, z której już korzystasz. Dla zespołów obsługujących potoki o dużej objętości lub tworzących prototypy na dużą skalę, Mini jest praktycznym wyborem domyślnym.

Zobacz Rodzinę

ByteDance

Od generowania kinowych filmów po tworzenie obrazów o wysokiej wierności, najpotężniejsze modele ByteDance są dostępne w Atlas Cloud. Uruchamiaj Seedance i Seedream na dużą skalę z najniższymi cenami wnioskowania i zerowymi kosztami ogólnymi infrastruktury.

Zobacz Rodzinę

Alibaba

Atlas Cloud łączy pełną gamę modeli Alibaba w ramach jednego API: Qwen do zadań związanych z językiem i obrazem oraz Wan do generowania wideo w rozdzielczości do 1080p. Uzyskaj dostęp do każdego modelu w modelu płatności zgodnie z rzeczywistym użyciem (pay-as-you-go) bez subskrypcji. Alibaba API jest dostępne poprzez pojedynczy bazowy adres URL (base URL) przy użyciu istniejącego klienta kompatybilnego z OpenAI.

Zobacz Rodzinę

OpenAI

Atlas Cloud zapewnia dostęp do pełnej linii API OpenAI, od GPT Image 2 do generowania obrazów po Sora 2 do wideo. Każdy model jest dostępny w modelu płatności za użycie (pay-as-you-go) bez miesięcznych zobowiązań. Zintegruj się za pomocą jednej zmiany bazowego adresu URL, korzystając z API kompatybilnego z OpenAI.

Zobacz Rodzinę

Wan 3.0 w akcji

6 kluczowych możliwości, które pokazują, co może wygenerować jedno zapytanie Wan 3.0, od filmów promujących markę opartych na wielu referencjach po 30-sekundowe pojedyncze ujęcia.

Multireferencyjne filmy marki

Tryb Omni przetwarza do 20 materiałów referencyjnych, 10 obrazów, 5 klipów i 5 ścieżek dźwiękowych, a także jeden dokument źródłowy lub stronę internetową, dzięki czemu pełny zestaw marki staje się jednym wideo zgodnym z marką w jednym przebiegu.

30-sekundowe historie na jednym ujęciu

Natywne, 30-sekundowe wyjście daje narracji przestrzeń do rozwoju, obsługując ciągłe ruchy kamery i sekwencje typu mastershot, których krótsze klipy nie są w stanie pomieścić. Inteligentne zarządzanie czasem trwania pozwala modelowi na samodzielne nadawanie tempa każdej scenie.

Spójność Odniesienia na Poziomie Pikseli

Twarze, produkty i drobne szczegóły są odwzorowywane z dokładnością co do piksela w każdej klatce. Zespoły produkcyjne zyskują pewność dostawy, jakiej wymagają powtarzające się postacie i precyzyjne zasoby marki.

Immersyjny Dźwięk i Realizm

Realizm, tekstura obrazu i natywne audio rozwijają się jednocześnie, dzięki czemu wygenerowana scena pojawia się z dopasowanym dźwiękiem zamiast niemego materiału. Rezultat przynosi prawdziwy wpływ audiowizualny.

Edycja instrukcji i referencji

Precyzyjna edycja przerabia istniejący materiał filmowy na podstawie pisemnej instrukcji lub klipu referencyjnego, zmieniając obiekt, styl lub moment bez ponownego generowania całego wideo.

Dokumenty i strony internetowe na wideo

Poza tekstem, obrazem, dźwiękiem i wideo, Wan 3.0 odczytuje pliki doc, xls, ppt, pdf i md, a także aktywne strony internetowe, przekształcając raport lub prezentację bezpośrednio w gotowy klip.

Porównania wideo w tym samym prompcie

Zobacz prezentację wideo wygenerowaną przez modele Wan 3.0, Seedance 2.5 i Wan 2.7.

Prompt

Generating a 30-second, 16:9 widescreen adult sci-fi war animated short film. Visual style: Ultra-photorealistic CGI Biomechanical structures Fusion of gray-white bone and black metal Insect-like joints Extremely fine bone texturing Dried blood streaks, ceramic cracks, and industrial oil grime Abandoned futuristic city Cold gray skylight Sparse toxic-green organisms High-contrast cinematic lighting Low-saturation cool color palette Minimal orange-red used only for flames and alarms Realistic physical destruction Oppressive, heavy, unheroic tone Characters no longer have complete flesh bodies. They are composed primarily of: Human spine Ribs Skull Black hydraulic muscle Metal joints Neural fiber optics Weapon interface ports The skeletons are not zombies — they are "legacy hardware" still being operated by military-industrial systems. Narrative & Dynamic Timeline 0–4 sec | Still Fighting After Death The shot opens on a soldier's dog tag lying in a pool of standing water. Want me to continue translating the rest of the timeline if you have more seconds/beats written out? This looks like it's cut off after the 0-4 second beat.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

Prompt

Generating a 15-second, 16:9 ultra-widescreen plush-universe adventure clip. A spaceship made of plush fabric, buttons, zippers, and stuffing cotton is fleeing at high speed through a universe made of giant yarn planets, fuzzy nebulae, and rag-doll megafauna. The ship is piloted by three small plush animals: a rabbit, a fox, and a crow. A giant interstellar whale-beast covered in deep-blue long plush fur, with eyes like two glass buttons, chases the ship out of the nebula. Overall style: ultra-fine plush textures, cinematic space scale, a strong contrast between cute appearance and intense action, exaggerated FPV camera work, and realistic soft-body physics. **15-Second Dynamic Timeline** **0–3 sec | Zipper Ship Ejection Launch** The shot is inside the plush ship, with a cockpit made of stitching, buttons, and fabric instrument panels. A red warning button flashes rapidly. The rabbit pulls down a giant zipper-lever control, and the ship's forward hatch splits open like a cloth sack. The camera pulls back rapidly from the cockpit, passes through the zipper hatch, and emerges outside the ship. The ship ejects and launches out of the knitted crater of a yarn planet. **3–6 sec | High-Speed Orbit Skimming the Yarn Planet** The camera hugs the ship's tail, flying low over the planet's surface. The ground is woven from giant strands of yarn: - Knitted mountain ranges streak past below at high speed - Loose thread-ends sway like a forest - The ship dodges sharply left and right - The camera continuously banks and rolls - The thrusters emit a trailing wake of white cotton fluff **6–8.5 sec | The Giant Plush Whale Appears** The fuzzy nebula suddenly parts to either side as a giant deep-blue plush whale bursts out from behind. The long fur on the whale's body is blown backward by the high-speed airflow, and its glass-button eyes reflect the planet's light. The camera whips halfway around the ship, switching to a rear-facing (reverse) view, so the whale continuously grows larger in the frame behind the ship.

Generated by Wan 3.0

Generated by Seedance 2.5 on Altas Cloud

Generated by Wan 2.7 on Altas Cloud

Wan 3.0 API - Stworzone dla rzeczywistych kreatywnych przepływów pracy

Aktualizacje Wan 3.0 wywodzą się z rzeczywistych potrzeb branży, integrując się bezpośrednio z poniższymi przepływami pracy produkcyjnej, od krótkich dramatów po filmy korporacyjne.

Film, TV, Krótkie Dramy i MV

Natywne, 30-sekundowe ujęcia i rekonstrukcja rzeczywistych scen pozwalają filmom, krótkim dramatom i teledyskom muzycznym AI pominąć dużą część fizycznego planu zdjęciowego. Spójność pikseli utrzymuje powracających głównych bohaterów, a natywny dźwięk jest idealnie dopasowany do każdego cięcia.

Animacja, Marka i IP

Pełna kontrola nad stylem przechodzi od realizmu do anime w ramach jednego modelu, a spójność pikseli blokuje maskotkę, logo lub postać IP na każdej klatce. Pełne animacje marki są renderowane bez żmudnego łańcucha produkcyjnego.

Reklama i Promocja Korporacyjna

Tworzenie Omni (Omni creation) przekracza granice tekstu i obrazu dla marek sprzętu AGD, kosmetyków, branży motoryzacyjnej, FMCG i odzieżowej. Wprowadź bezpośrednio stronę produktu lub raport firmy, aby stworzyć wszystko, od wersji demonstracyjnych produktów po korporacyjne filmy wizerunkowe.

Projektowanie Oprogramowania i Produktów

Wprowadź prezentację interfejsu użytkownika produktu, animację funkcji lub wizualizację danych, a Wan 3.0 zachowa oryginalną estetykę, przekształcając je w narracyjne dzieło animowane. Znika żmudny etap animacji.

Edukacja

Wprowadzanie dokumentów bezpośrednio odczytuje plik PDF, PPT lub stronę internetową, dzięki czemu lekcja lub raport z badań staje się wyraźnym filmem instruktażowym bez oddzielnego scenariusza. Złożony materiał staje się wizualny w jednym kroku.

Turystyka Kulturowa

Rekonstrukcja rzeczywistych scen odtwarza krajobrazy, obiekty dziedzictwa kulturowego i lokalną kuchnię bez konieczności kręcenia na dużą skalę, dzięki czemu filmy miejskie i cyfryzacja kultury mogą być realizowane niskim kosztem. Odległe miejsca pojawiają się tuż przed oczami widzów.

Jak używać Wan 3.0 na Atlas Cloud

Zacznij w kilka minut — wykonaj te proste kroki, aby zintegrować i wdrożyć modele za pośrednictwem platformy Atlas Cloud.

Utwórz konto Atlas Cloud

Zarejestruj się na atlascloud.ai i ukończ weryfikację. Nowi użytkownicy otrzymują bezpłatne kredyty do eksploracji platformy i testowania modeli.

Dlaczego Używać Wan 3.0 na Atlas Cloud

Połączenie zaawansowanych modeli Wan 3.0 z platformą GPU-akcelerowaną Atlas Cloud zapewnia niezrównaną wydajność, skalowalność i doświadczenie deweloperskie.

Wydajność i Elastyczność

Niska Latencja:
Inferencja zoptymalizowana pod GPU dla rozumowania w czasie rzeczywistym.

Zunifikowane API:
Uruchamiaj Wan 3.0, GPT, Gemini i DeepSeek za pomocą jednej integracji.

Przejrzysta Wycena:
Przewidywalne rozliczenia za token z opcjami serverless.

Przedsiębiorstwo i Skala

Doświadczenie Dewelopera:
SDK, analityka, narzędzia dostrajania i szablony.

Niezawodność:
99,99% dostępności, RBAC i logowanie gotowe na zgodność.

Bezpieczeństwo i Zgodność:
SOC 2 Type II, zgodność z HIPAA, suwerenność danych w USA.

FAQ dotyczące API Wan 3.0

Wan 3.0 to wielofunkcyjny model wideo nowej generacji od Alibaba, obecnie w publicznej fazie beta. Jedno żądanie może przekształcić tekst, obrazy, wideo, dźwięk, dokumenty lub strony internetowe w wideo o długości do 30 sekund, a model łączy tak szerokie dane wejściowe ze spójnością na poziomie pikseli, precyzyjną edycją i natywnie wygenerowanym dźwiękiem.

Atlas Cloud planuje dodać Wan 3.0 API, gdy tylko Alibaba je wyda, a celem jest zapewnienie dostępu Day-0. Zarejestruj się i otrzymaj powiadomienie w dniu premiery.

Wan 3.0 to najszersze wydanie w tej serii. Zwiększa natywny czas trwania do 30 sekund, akceptuje do 20 mieszanych materiałów referencyjnych oraz dokumenty i strony internetowe w trybie omni-reference, dodaje tryb pierwszej i ostatniej klatki oraz dąży do spójności na poziomie pikseli z natywnym dźwiękiem. Wcześniejsze wersje Wan w Atlas Cloud pozostają mocnymi wyborami do krótszych, bardziej skoncentrowanych prac typu text-to-video i image-to-video.

Wan 3.0 traktuje jako materiał źródłowy znacznie więcej niż tylko prompt. Jedno żądanie może wykorzystywać do 20 mieszanych referencji, 10 obrazów, 5 klipów wideo o łącznej długości 15 sekund oraz 5 klipów audio o łącznej długości 15 sekund, wraz z pojedynczym dokumentem (doc, xls, ppt, pdf lub md) lub stroną internetową, przy czym sam prompt tekstowy może liczyć do 20 000 znaków.

Klipy trwają natywnie do 30 sekund. Żądanie oparte na tekście lub obrazie może trwać od 2 do 30 sekund, podczas gdy żądanie zawierające wideo utrzymuje wejście i wyjście w łącznym czasie 30 sekund, a inteligentny czas trwania może automatycznie ustawić długość. Rozdzielczość obejmuje 480p, 720p i 1080p, z dostępnymi proporcjami 16:9, 9:16, 4:3, 3:4, 1:1 oraz proporcjami inteligentnymi.

Spójność jest zarządzana na poziomie pikseli, dzięki czemu twarz, strój, produkt lub drobny szczegół referencyjny zachowuje swój wygląd podczas zmian scen i ruchu obiektów. W przypadku cykli produkcyjnych, które ponownie wykorzystują tę samą postać lub dokładny zasób marki, ta stabilność sprawia, że każda dostawa jest przewidywalna.

Tak, zarówno poprzez instrukcje, jak i referencje. Pisemna notatka lub przykładowy klip mogą zmienić styl obiektu, zmodyfikować oświetlenie lub zastąpić pojedynczy segment, a elementy, które chcesz pozostawić bez zmian, pozostają na swoim miejscu przez cały proces edycji.

Tak. Atlas Cloud już obsługuje Wan 2.7, 2.6 i 2.5 w ramach jednego zunifikowanego klucza, a Wan 3.0 dołączy do tego samego klucza bez konieczności zakładania nowego konta, zmiany punktów końcowych (endpoints) i bez oddzielnej konfiguracji. Zespoły, które już wysyłają zapytania do rodziny Wan, będą mogły uzyskać dostęp do Wan 3.0, po prostu zmieniając nazwę modelu, gdy tylko zostanie on udostępniony.

Jedno API do całej multimedialnej AI.

Przeglądaj wszystkie modele