
Najnowsza aktualizacja: Wan 3.0 jest już dostępny od 24 sierpnia 2026 roku.
Dwa monitory w studiu montażowym obok siebie, lewy pokazuje potwora morskiego wynurzającego się z burzy, prawy tę samą burzę przerwaną
Odtwórz 30-sekundowy klip o potworze morskim, który Alibaba dostarczył z betą Wan 3.0. Trawler rybacki, ulewny deszcz, błyskawice, a potem ocean wybucha w górę. Dziesięć wyraźnych ujęć. Żadnego cięcia. Towarzysząca mu orkiestrowa ścieżka dźwiękowa została napisana przez model.
Twoją pierwszą reakcją nie jest „wow”. To: „czego dokładnie brakuje mojemu Wan 2.7?”
Więc poszedłem szukać odpowiedzi, a pierwszą rzeczą, którą znalazłem, było to, że większość internetu odpowiada źle. Wyszukaj wan 3.0 vs wan 2.7 a najwyższe wyniki z pewnością twierdzą, że Wan 3.0 renderuje natywne 4K, a wagi są na Hugging Face. Żadne z tych stwierdzeń nie jest prawdziwe. Wyciągnąłem oficjalne pliki demonstracyjne na laptopa i odczytałem je za pomocą ffmpeg, a następnie sprawdziłem rejestry modeli oraz opublikowane cenniki. Prawdziwe ulepszenie jest duże. Po prostu nie jest to ulepszenie, które ludzie opisują.
Wan 3.0 vs Wan 2.7: najważniejsze wnioski
- Czas trwania to główna nowość. Wan 3.0 generuje 30 sekund w jednym przebiegu z automatycznym zaleceniem „inteligentnego czasu trwania”. Wan 2.7 ma limit 15 sekund dla tekstu na wideo i obrazu na wideo oraz 10 sekund dla odniesienia na wideo i edycji wideo.
- Odniesienia skaczą z garstki do tłumu. Wan 2.7 akceptuje do 5 elementów odniesienia. Wan 3.0 akceptuje do 20, a po raz pierwszy przyjmuje pliki doc, xls, ppt, pdf i md, a także strony internetowe, jako dane wejściowe do generowania.
- Nie ma 4K. Własny cennik API Alibaby ma dokładnie trzy poziomy: 480P, 720P i 1080P. Na Atlas Cloud, Wan 2.7 oferuje wyższy sufit dzięki opcjom superrozdzielczości 1080P-SR i 1440P-SR.
- Wagi nie są otwarte. Organizacja Wan-AI na Hugging Face wciąż kończy na Wan 2.2. Nie ma repozytorium 3.0, 2.7 ani 2.5.
- Wan 3.0 jest dostępny tylko w wersji beta i tylko przez pierwsze strony. Działa na Alibaba Cloud Bailian, stronie Wanxiang, desktopowej aplikacji Qianwen creation i kilku pokrewnych produktach. Jeśli potrzebujesz API, które możesz wywołać w produkcji w tym tygodniu, Wan 2.7 jest wciąż generacją, która odpowiada.
- Chcesz zobaczyć format, zanim nauczysz się gramatyki promptów? Atlas Cloud ma darmowy generator AI reklam skeczowych, który zamienia jeden opis produktu w 15-sekundową komediową reklamę z dwiema postaciami i mówionym dialogiem. Jedno darmowe generowanie, bez znaku wodnego.
Pełna 30-sekundowa sekwencja kaiju, wygenerowana przez Alibabę na Wan 3.0 podczas publicznej bety i opublikowana w oficjalnym podręczniku twórcy Wan 3.0. Nie wygenerowaliśmy tego klipu. Włącz dźwięk: ścieżka dźwiękowa jest częścią wyniku, a nie dodanym później podkładem muzycznym. Plik dostarczony: 1920x1072, 24fps, 30.07s, 44.1kHz stereo AAC.
Oto pierwsza rzecz, którą pomijają arkusze specyfikacji. Ten plik ma 1920x1072, a nie 1920x1080. Każde demo „1080p” w oficjalnym podręczniku ląduje na wysokości 1072 pikseli, a kilka innych opublikowanych demonstracji ma zwykłe 1280x720. Dwanaście z dziewiętnastu klipów w podręczniku trwa od 30.05 do 30.07 sekund, co mówi nam, że 30-sekundowy sufit jest rzeczywistym, twardym ograniczeniem, a nie marketingową zaokrągloną liczbą.
Dlaczego pytanie Wan 3.0 vs Wan 2.7 jest trudniejsze, niż się wydaje
Szczera odpowiedź brzmi: prawie nikt nie uruchomił obu modeli na tym samym prompcie, ponieważ prawie nikt nie może. Wan 3.0 został otwarty do publicznej bety 6 sierpnia 2026 roku i żyje na własnych powierzchniach Alibaby (QbitAI, sierpień 2026). Platformy wnioskowania stron trzecich go nie przejęły. Zatem istniejące treści porównawcze to arkusz specyfikacji do arkusza specyfikacji, a arkusze specyfikacji były kopiowane na boki, aż błędy się skostniały.
Trzy „fakty" o Wan 3.0 vs Wan 2.7, które są po prostu błędne
„Wan 3.0 to natywne 4K." Nie jest. Opublikowany cennik API zawiera 480P, 720P i 1080P w cenie ¥0,3, ¥0,6 i ¥1,2 za sekundę. Trzy poziomy, żadnego czwartego. Tymczasem Atlas Cloud udostępnia 1080P-SR i 1440P-SR na Wan 2.7, więc na czystym suficie pikseli starsza generacja obecnie wygrywa.
„Wagi Wan 3.0 są otwarte." Nie są. Przejdź do Hugging Face a najnowsza wydana rodzina organizacji Wan-AI to Wan 2.2, w tym warianty Animate i S2V. Główna linia wideo nie wysyłała wag od 2.2. Jeśli chcesz czegoś do lokalnego grafu ComfyUI, 2.1 i 2.2 to twoje opcje i to się nie zmieniło.
„Gramatyka promptów przenosi się wprost." To jest w połowie prawdziwe w sposób, który cię spali. Słowa się przenoszą. Struktura nie. Oficjalne prompty Wan 3.0 to scenariusze z wieloma ujęciami oznaczonymi znacznikami czasu: prompt kaiju to dziesięć ponumerowanych ujęć, prompt billboardu to cztery oznaczone bity z wyraźnymi zakresami sekund. Wklejenie dziesięcioujęciowego scenariusza do 15-sekundowego modelu nie powoduje wdzięcznego wybrania sześciu ujęć. Kompresuje.
Dlaczego nie możesz po prostu zamieniać promptów między Wan 3.0 a Wan 2.7
Pod tym kryje się druga pułapka i to jest powód, dla którego „po prostu zszyj dwa klipy" cię nie ratuje.
Wan 2.7 ma tryb kontynuacji wideo. Wygląda jak droga do 30 sekund. Nie jest. Źródłowy klip, który mu podajesz, musi mieć od 2 do 10 sekund, więc 15-sekundowa generacja nie może być ziarnem. Wynik ponownie koduje źródło, co obcina ogon wprowadzonego klipu. A łączenie kontynuacji ma tendencję do dryfowania z powrotem w kierunku otwierającego bitu, zamiast przesuwania historii do przodu. Piętnaście sekund to twardy sufit dla jednego ciągłego pliku Wan 2.7. Wszystko dłuższe to edycja, a nie generacja.
To jest prawdziwy koszt migracji między tymi dwiema generacjami i żadna tabela porównawcza ci go nie pokaże.
Arkusz specyfikacji Wan 3.0 vs Wan 2.7 i gdzie go faktycznie uruchomić
Aby przetestować cokolwiek z tego, potrzebujesz miejsca, które uruchamia tekst na wideo, odniesienie na wideo i edycję wideo na tym samym koncie, z rozliczeniem za sekundę, aby nieudane ujęcie kosztowało cię sekundy, a nie subskrypcję. Wszystko po stronie Wan 2.7 w tym artykule działa na Atlas Cloud, który hostuje cztery punkty końcowe Wan 2.7 i model obrazu używany w teście odniesienia. Wan 3.0 nie jest jeszcze na Atlas Cloud ani żadnej innej platformie trzeciej strony, co jest dokładnie powodem, dla którego materiał Wan 3.0 w tym artykule pochodzi z własnych publikacji beta Alibaby.
Tabela 1: Wan 3.0 vs Wan 2.7, generacja do generacji
| Wan 3.0 (publiczna beta) | Wan 2.7 (produkcja) | |
|---|---|---|
| Maks. czas trwania, jeden przebieg | 30s, z inteligentnym czasem trwania | 15s (t2v, i2v), 10s (r2v, edycja wideo) |
| Elementy odniesienia | Do 20 | Do 5 (1 obraz na temat, do 3 filmów) |
| Modalności wejściowe | Tekst, obraz, wideo, audio, doc/xls/ppt/pdf/md, strony internetowe | Tekst, obraz, wideo, audio |
| Wprowadzanie dokumentu | Pojedynczy plik lub link, do 100MB i 50 stron | Nieobsługiwane |
| Poziomy rozdzielczości | 480P / 720P / 1080P | 720P / 1080P / 1080P-SR / 1440P-SR |
| Natywne audio | Tak | Tak |
| Edycja wideo | Edycja instrukcji i odniesienia | Dedykowany punkt końcowy edycji wideo |
| Otwarte wagi | Nie | Nie |
| Gdzie możesz go uruchomić | Tylko własne powierzchnie Alibaby | API stron trzecich, w tym Atlas Cloud |
| Podana cena | ¥0,3 / ¥0,6 / ¥1,2 za sekundę według poziomu | $0,1 za sekundę, poziom 720P |
Tabela 2: punkty końcowe Wan 2.7 używane w tym artykule
| Punkt końcowy | Maks. czas trwania | Rozdzielczości | Limit odniesienia | Podana cena |
|---|---|---|---|---|
| Tekst na wideo | 2-15s | 720P, 1080P, 1080P-SR, 1440P-SR | n/d | $0,1 / sek |
| Odniesienie na wideo | 2-10s | 720P, 1080P, 1080P-SR, 1440P-SR | 5 elementów | $0,1 / sek |
| Obraz na wideo | 2-15s | 720P, 1080P, 1080P-SR, 1440P-SR | klip źródłowy 2-10s | $0,1 / sek |
| Edycja wideo | 2-10s na wyjściu, 2-10s na wejściu | 720P (1,0x), 1080P (1,5x) | 3 obrazy | $0,1 / sek |
Jeden szczegół dotyczący ceny, który warto zinternalizować przed uruchomieniem czegokolwiek: nagłówek „$0,1 za sekundę" to poziom bazowy 720P. Strona edycji wideo dokumentuje mnożnik 1,5x dla 1080P wprost, a przycisk Uruchom podaje rzeczywistą liczbę dla wybranego poziomu. Przeczytaj przycisk, a nie nagłówek.
Aby uzyskać aktualne hostowane uruchomienie, otwórz Wan 3.0 na Atlas Cloud i przetestuj prompt taki jak poniżej, zanim opublikujesz przepływ pracy.

Zrzut ekranu promptu Wan 3.0 do wyniku: porównanie dopasowanych modeli.
Wykonaj test Wan 3.0 vs Wan 2.7 samodzielnie
Cztery kroki. Dwa z nich wykorzystują opublikowany materiał Alibaby jako stały punkt odniesienia, dwa to uruchomienia, które wykonujesz samodzielnie. Nic tutaj nie wymaga dostępu do bety Wan 3.0.
Krok 1: Pobierz klip Wan 3.0 i jego oryginalny prompt
Strona Wan 3.0 w tym teście nie jest czymś, co generujesz. To jest coś, co czytasz. Pełny prompt kaiju jest opublikowany w oficjalnym podręczniku twórcy Wan 3.0, wraz z gotowym klipem, w przykładzie „灾难电影". Jest to chiński scenariusz z dziesięcioma ponumerowanymi ujęciami i osobnym akapitem opisującym ścieżkę dźwiękową.
Przeczytaj go raz, zanim zrobisz cokolwiek innego. Struktura jest lekcją: dziesięć ujęć, każde z własnym aparatem, tematem i notatką o oświetleniu, kończące się briefem dotyczącym ścieżki dźwiękowej. Tak wygląda prompt do 30-sekundowej generacji w jednym przebiegu.
Krok 2: Uruchom ten sam prompt przez Wan 2.7 tekst na wideo
Otwórz plac zabaw Wan 2.7 tekst na wideo i wklej angielskie tłumaczenie tego samego scenariusza. Nie skracaj go jeszcze. Chcesz zobaczyć, co model robi, gdy intencja przekracza sufit.
Plain130-sekundowa, fotorealistyczna sekwencja filmowa: głębinowy kaiju wyłania się w nocy podczas szalejącej burzy. Otwarcie na małym, zniszczonym trawlerze rybackim z białymi literami „WAN" na kadłubie, walczącym z ogromnymi falami w ulewnym deszczu; błyskawica na chwilę oświetla cały ocean. Przejście do średniego zbliżenia na pokładzie: fale rozbijają się o dziób, liny, sieci i metalowe barierki trzepoczą na wietrze, deszcz smuga po obiektywie. Następnie morze przed nimi pęcznieje nienaturalnie, tworzy się ogromny wir, a ogromny ciemny kształt przepływa pod łodzią, unosząc ją. Członek załogi w mokrej kurtce przeciwdeszczowej chwyta się poręczy, przerażony, i odwraca się w stronę wody. Wreszcie powierzchnia wybucha w górę i wynurza się kolosalny potwór morski w stylu Pacyficznego Pierścienia: mokra, bliznowata, żebrowana skóra, ogromne szczęki, dziesiątki metrów rozprysku. Zbliżenie na jego głowę ryczącą w błyskawicy. Trawler jest prawie pochłonięty. Zakończenie na szerokim ujęciu: kaiju górujący nad wzburzonym morzem, łódka malutka na pierwszym planie, ostatnia błyskawica. Muzyka w stylu hollywoodzkiego filmu katastroficznego: niski, basowy pomruk i rzadkie smyczki, przechodzące w blaszane instrumenty i ciężką perkusję w momencie wynurzenia, kończące się na przytłaczającym, przedłużonym niskim akordzie. Fotorealistyczna skala, objętościowa woda, wysokokontrastowe oświetlenie burzowe. 2
Ustawienia: Rozdzielczość 1080P, Czas trwania 15s (maksimum), Proporcje 16:9, audio włączone, aby model sam je tworzył. Pozostaw puste miejsce na audio odniesienia.

Plac zabaw Wan 2.7 tekst na wideo na Atlas Cloud z załadowanym promptem kaiju i gotowym 15-sekundowym klipem w panelu WYJŚCIE
Wan 2.7 tekst na wideo na Atlas Cloud, wklejony prompt, wybrane 1080P i 16:9. Przycisk Uruchom podaje $0,75 za ten krótki test, co daje $0,15 za sekundę: mnożnik 1,5x dla 1080P w pełni widoczny, na stronie modelu, której nagłówek to $0,1.
Następnie uruchom go ponownie z jednym wierszem dodanym do promptu:
Plain1Pojedyncze, ciągłe ujęcie, bez cięć. Priorytetowo potraktuj moment wynurzenia; skompresuj przygotowanie. 2
Ten pojedynczy wiersz to praca migracyjna w miniaturze. 30-sekundowy scenariusz musi zostać ponownie napisany jako 15-sekundowa intencja, a to ty decydujesz, które siedem ujęć ginie.
Po lewej: oficjalny wynik Wan 3.0, 30 sekund. Po prawej: Wan 2.7 na Atlas Cloud uruchomiony na tym samym prompcie, zatrzymujący się na swoim 15-sekundowym suficie.
Krok 3: Zbuduj obrazy odniesienia do testu tożsamości Wan 3.0 vs Wan 2.7
Czas trwania to głośne ulepszenie. Spójność na poziomie pikseli to ta, która faktycznie zmienia pracę produkcyjną, i możesz ją przetestować za pomocą dwóch kotów.
Podręcznik Alibaby zawiera pastisz Wesa Andersona, w którym ten sam kot ragdoll i ten sam czarny kot muszą przetrwać pięć zupełnie różnych środowisk: symetryczny korytarz hotelowy, widok z boku w przekroju, bęben pralki, taśmę bagażową na lotnisku i czerwoną budkę telefoniczną. Oba koty są przypięte znacznikami odniesienia @Image1 i @Image2.
Najpierw wygeneruj własne dwa odniesienia. Użyj GPT Image 2 z jakością ustawioną na wysoką i ramką 16:9, i uruchom go dwukrotnie.
Plain1Portret studyjny puszystego kota ragdoll z niebieskimi oczami i ciemną maską, siedzącego wyprostowanego twarzą do aparatu, równomiernie oświetlonego na jednolitym, bladoróżowym tle, ostre detale futra, widoczne całe ciało, czyste kadrowanie arkusza odniesienia. 2
Plain1Portret studyjny małego, smukłego czarnego kota z jasnymi bursztynowymi oczami, stojącego w profilu zwróconego w prawo, równomiernie oświetlonego na jednolitym, bladoróżowym tle, ostre detale futra, widoczne całe ciało, czyste kadrowanie arkusza odniesienia. 2

Plac zabaw GPT Image 2 na Atlas Cloud z jakością ustawioną na wysoką i arkuszem odniesienia kota ragdoll wyrenderowanym w panelu WYJŚCIE
GPT Image 2 przy jakości wysokiej, 16:9. Uruchom drugi prompt w ten sam sposób, aby uzyskać czarnego kota.
Krok 4: Wykonaj test tożsamości na Wan 2.7 odniesienie na wideo
Prześlij oba koty do punktu końcowego Wan 2.7 odniesienie na wideo. Rozdzielczość 1080P, proporcje 16:9, czas trwania 10 sekund, co jest maksimum dla tego punktu końcowego. Poniższy prompt to lista ujęć z podręcznika skompresowana z pięciu bitów do trzech, ponieważ dziesięć sekund nie pomieści pięciu.
Plain1Styl Wesa Andersona, idealnie symetryczne, płaskie frontalne kompozycje, pastelowa paleta. Obraz odniesienia 1 to kot ragdoll, obraz odniesienia 2 to czarny kot; zachowaj oba koty identyczne w każdym ujęciu. Ujęcie 1: nieskończony symetryczny korytarz hotelowy, kot ragdoll biegnący prosto w stronę kamery z uroczystym wyrazem twarzy, czarny kot uciekający w tle z głową odwróconą o 180 stopni. Ujęcie 2: widok z boku w przekroju korytarza, różowa tapeta w wzory i złote ramy, ragdoll idący z lewej do prawej, a czarny kot przechodzący z prawej do lewej. Ujęcie 3: frontalne makro na miętowo-zielone, zabytkowe drzwi pralki, oba koty sztywno unoszące się w bębnie wśród piany, puste spojrzenia, ustawione za nimi butelki detergentów w kolorach tęczy. Sztywne poziomy i piony, bez przechylenia kamery, groteskowy humor z pokerową twarzą. 2

Plac zabaw Wan 2.7 odniesienie na wideo na Atlas Cloud z załadowanymi oboma odniesieniami kotów i gotowym klipem w panelu WYJŚCIE
Wan 2.7 odniesienie na wideo: oba koty załadowane do slotów obrazu odniesienia, rozdzielczość ustawiona na 1080P, a przycisk Uruchom podaje koszt ujęcia przed rozpoczęciem. Dwa odniesienia to już znaczący udział w tym, co akceptuje ten punkt końcowy. Wan 3.0 przyjmuje 20 elementów odniesienia.
Teraz umieść je obok siebie.

Oficjalny klip blokady tożsamości Wan 3.0: ten sam kot ragdoll i czarny kot utrzymane spójnie w korytarzu hotelowym, ścianie w przekroju, bębnie pralki, taśmie bagażowej i czerwonej budce telefonicznej
Wygenerowane przez Alibabę na Wan 3.0 podczas publicznej bety i opublikowane w oficjalnym podręczniku twórcy. Pięć środowisk, 19,9 sekundy, oba koty przypięte znacznikiem odniesienia. Pokazane jako cichy GIF; dostarczony plik zawiera audio stereo 44,1 kHz.

Wynik Wan 2.7 odniesienie na wideo dla tego samego briefu, trzy ujęcia w 10-sekundowym suficie
Wan 2.7 odniesienie na wideo na Atlas Cloud, te same dwa odniesienia, pokazane jako cichy GIF. To jest domyślne 5-sekundowe ujęcie tego punktu końcowego, a nie pełne 10: warto wiedzieć, że kontrola czasu trwania nie zawsze dokonuje tego, co ustawisz, więc przeczytaj wycenę przycisku Uruchom przed naciśnięciem. Zwróć uwagę na oznaczenia kotów i maskę ragdolla; to jest wymiar, o którym mówi roszczenie „spójności na poziomie pikseli".
Cztery kolejne prompty Wan 3.0 vs Wan 2.7 warte ponownego uruchomienia
Klip kaiju kładzie nacisk na czas trwania i fizykę. Te trzy kładą nacisk na różne rzeczy, a każdy zderza się z innym limitem Wan 2.7. Wszystkie trzy to własne wyniki beta Alibaby z oficjalnego podręcznika.
Wan 3.0, oficjalny wynik beta: pojedyncze 30-sekundowe odsunięcie w dół fluorescencyjnie oświetlonego korytarza szpitalnego, bladozielona monochromatyczna gradacja, z aktorką krzyczącą o pomoc. Włącz dźwięk. Występ, kroki i szum sprzętu są generowane przez model.
Tabela 3: czego wymaga każdy prompt i gdzie Wan 2.7 go ogranicza
| Prompt | O co pyta scenariusz | Opublikowany limit Wan 2.7 | Testowany wymiar |
|---|---|---|---|
| Wynurzenie kaiju | 10 ponumerowanych ujęć w ciągu 30s, plus brief dotyczący ścieżki dźwiękowej | 15s maks. w tekście na wideo | Czas trwania i narracja wieloujęciowa |
| Korytarz szpitalny | Jedno 30s ciągłe ujęcie z mówionym dialogiem | 15s maks., dostępne natywne audio | Występ i dialog w długich ujęciach |
| Kowbojka na stacji benzynowej | 30s łuk komediowy w czterech aktach z czasem | 15s maks., więc dwa akty muszą odejść | Czas komediowy wymagający czasu działania |
| Jedno ujęcie billboardu | Cztery bity z wyraźnymi zakresami sekund, bez cięć | 15s maks., więc zakresy wymagają przepisania | Fizyka kamery w długim ruchu |
| Dwa koty, pięć pokoi | 2 oznaczone tematy utrzymane w 5 środowiskach | 10s maks., 5 slotów odniesienia | Spójność tożsamości |
Darmowa 15-sekundowa wersja tego samego pomysłu
Spójrz ponownie na klip ze stacji benzynowej. Ten format, krótki komediowy skecz z dwiema postaciami, zwrotem akcji i puentą, to miejsce, w którym dodatkowy czas działania Wan 3.0 opłaca się najbardziej. Jest to również format, który najprawdopodobniej coś sprzeda.
Haczyk tkwi w prompcie. Przykłady komediowe w podręczniku mają 800 słów z wyraźnymi znacznikami czasu i blokowaniem. To prawdziwa umiejętność i zajmuje weekend, aby się jej nauczyć.
Jeśli chcesz po prostu dowiedzieć się, czy format działa dla twojego produktu, zanim zainwestujesz ten weekend, Atlas Cloud ma darmowe narzędzie, które całkowicie pomija inżynierię promptów. Opisujesz produkt, opcjonalnie przesyłasz do czterech zdjęć produktu po 8MB każde, wybierasz jeden z sześciu tonów (zabawny mem, zwrot akcji, sitcom, rozgrzewający serce, luksusowy lub agresywna sprzedaż), a narzędzie pisze scenariusz z dwiema postaciami, obsadza głosy, generuje dialog i efekty dźwiękowe, a następnie zwraca gotową 15-sekundową reklamę jako jedną ciągłą scenę. Pobieranie jest czyste, bez znaku wodnego. Musisz być zalogowany, a dostajesz jedno darmowe generowanie, zanim doładujesz kredyty.

Jedna linia kopii produktu wejściowa, gotowa 15-sekundowa reklama komediowa na wyjściu: darmowy generator AI reklam skeczowych Atlas Cloud
Darmowy generator AI reklam skeczowych: jeden opis produktu wejściowy, jedna 15-sekundowa reklama z dwiema postaciami na wyjściu.

Prawdziwy wynik z darmowego generatora. Włącz dźwięk: scenariusz, dwa głosy i efekty dźwiękowe pochodzą z jednego uruchomienia.
Ile kosztuje uruchomienie porównania Wan 3.0 vs Wan 2.7
Za sekundę, dwie generacje są w podobnej okolicy na poziomie 720P. Różnica w kosztach jest strukturalna: klip, który kiedyś miał 15 sekund, teraz ma 30, więc gotowy utwór mniej więcej się podwaja.
Tabela 4: ta sama sekwencja kaiju, na cztery sposoby
| Uruchomienie | Stawka | Suma |
|---|---|---|
| Wan 3.0, 30s przy 720P | ¥0,6 / sek | ¥18, około $2,50 |
| Wan 3.0, 30s przy 1080P | ¥1,2 / sek | ¥36, około $5,00 |
| Wan 2.7, 15s przy 720P | $0,10 / sek | $1,50 |
| Wan 2.7, 15s przy 1080P | $0,10 / sek z mnożnikiem poziomu 1,5x | $2,25 |
| Wan 2.7, 15s przy 1440P-SR | wycena na żywo na przycisku Uruchom | wycena na żywo |
| Darmowa reklama AI skeczowa, 15s | darmowa, 1 generacja na konto | $0,00 |
Dwa zastrzeżenia. Ceny wersji beta nie są cenami ogólnej dostępności, a Alibaba powiedział, że API wkrótce otworzy się szerzej, więc traktuj wartości ¥ jako migawkę publicznej bety, a nie ustaloną stawkę. A po stronie Atlas Cloud zawsze czytaj wycenę na żywo na przycisku Uruchom przed zatwierdzeniem, ponieważ mnożnik rozdzielczości jest tam stosowany, a nie w cenie nagłówkowej.
Alibaba był również niezwykle bezpośredni w kwestii tego, gdzie Wan 3.0 jest wciąż słaby, mówiąc, że model „wciąż ma pole do poprawy w jakości dźwięku i dokładności tekstu." To pasuje do tego, co pokazują pliki: audio w oficjalnych demach to 44,1 kHz stereo, ale zakodowane przy skromnym 32 kb/s, co jest w porządku dla podglądu i cienkie dla mastera dostawy.
Licencjonowanie Wan 3.0 vs Wan 2.7: co możesz faktycznie wysłać
Krótka wersja i proszę, zweryfikuj to samodzielnie z aktualnymi warunkami, zanim przedstawisz cokolwiek klientowi.
Wan 3.0 jest w publicznej becie, a jego warunki handlowe nie są ustalone. Ponieważ wagi nie zostały wydane, nie ma w ogóle ścieżki samodzielnego hostingu; wszystko, co stworzysz, przechodzi przez API Alibaby lub jej powierzchnie konsumenckie i jesteś związany tym, co te warunki mówią w dniu generowania. Wan 2.7 to ta sama historia z wagami, ale jest w produkcji wystarczająco długo, aby warunki API platformy były stabilne. Jeśli uruchamiasz go za pośrednictwem platformy trzeciej strony, twoje prawa handlowe pochodzą z warunków korzystania z tej platformy, więc przeczytaj te, które faktycznie dotyczą twojego konta. Żaden z tych akapitów nie jest poradą prawną.
FAQ Wan 3.0 vs Wan 2.7
Czy Wan 3.0 jest open source? Czy mogę go uruchomić w ComfyUI?
Nie. Od sierpnia 2026 roku nie ma repozytorium Wan 3.0 w organizacji Wan-AI na Hugging Face i żadnego na GitHubie Wan-Video. Najnowsza rodzina Wan z wydanymi wagami to Wan 2.2, w tym warianty Animate i S2V. Do lokalnego grafu ComfyUI nadal jesteś na 2.1 lub 2.2. Wan 3.0 jest dostępny tylko przez API i stronę internetową.
Rozdzielczość Wan 3.0 vs Wan 2.7: czy Wan 3.0 naprawdę generuje 4K?
Nie. Opublikowany cennik API ma trzy poziomy rozdzielczości: 480P, 720P i 1080P. Kilka szeroko udostępnianych postów porównawczych twierdzi, że natywne 4K i są błędne. Na surowym suficie wyjściowym, Wan 2.7 na Atlas Cloud faktycznie idzie wyżej dzięki opcjom superrozdzielczości 1080P-SR i 1440P-SR.
Czy mogę uzyskać 30 sekund z Wan 2.7 poprzez rozszerzanie klipów?
Nie jako jeden ciągły plik. Tryb kontynuacji wymaga klipu źródłowego o długości od 2 do 10 sekund, więc pełna 15-sekundowa generacja nie może go zasiać. Wynik ponownie koduje i przycina ogon tego, co podasz, a łączone kontynuacje mają tendencję do zapętlania się z powrotem w kierunku otwierającego bitu. Po 15 sekundach edytujesz, a nie generujesz.
Wan 3.0 vs Wan 2.7: gdzie mogę faktycznie uruchomić każdy z nich dzisiaj?
Wan 3.0 jest w publicznej becie na własnych powierzchniach Alibaby: Alibaba Cloud Bailian, Wanjing Yike, strona Wanxiang, desktopowy klient Qianwen creation, IF STUDIO i Duiyou, z dostępem w skali szarości w aplikacji Qianwen. Żadna platforma wnioskowania stron trzecich jeszcze go nie hostuje. Wan 2.7 to generacja, którą nadal możesz wywoływać bezpośrednio, poprzez punkty końcowe tekst na wideo, obraz na wideo, odniesienie na wideo i edycja wideo.
Ceny Wan 3.0 vs Wan 2.7: który kosztuje więcej za gotowy klip?
Za sekundę na poziomie 720P są zbliżone. Za gotowy klip spodziewaj się mniej więcej podwójnej kwoty, ponieważ naturalna długość wyjściowa wzrosła z 15 sekund do 30. Budżetuj na zmianę czasu działania, a nie na zmianę stawki i pamiętaj, że ceny wersji beta mogą nie przetrwać ogólnej dostępności.
Czy muszę przepisać moje prompty Wan 2.7 dla Wan 3.0?
Tak, a przepisanie ma charakter strukturalny, a nie leksykalny. Prompty Wan 2.7 opisują jedno ciągłe ujęcie w bogatych szczegółach. Prompty Wan 3.0 to listy ujęć z znacznikami czasu, czasami z osobnym akapitem dotyczącym ścieżki dźwiękowej, a model odczyta również plik pdf lub prezentację jako dane wejściowe. Zasada kciuka: dla Wan 2.7 napisz jeden akapit o jednym ujęciu; dla Wan 3.0 napisz ponumerowany podział scen z zakresami sekund.






