Większość wczesnych opinii o Wan 3.0 opiera się na pojedynczych, wyselekcjonowanych klipach. To jest inny rodzaj recenzji: 49 przypadków konwersji obrazu na wideo w 10 wymiarach możliwości, każdy przypadek uruchomiony z ustalonym ziarnem (seed), w 720p, a następnie ponownie uruchomiony na Seedance 2.0 i Wan 2.7 z tym samym pierwszym kadrem, tym samym promptem i tym samym ziarnem. Każde stwierdzenie poniżej ma za sobą klip, a te najważniejsze są osadzone, abyś mógł się ze mną nie zgodzić kadr po kadrze.
Werdyt w jednym akapicie: Wan 3.0 to szeroki, widoczny krok naprzód względem Wan 2.7, a w porównaniu z Seedance 2.0 plasuje się w tej samej lidze z wyraźnym podziałem osobowości. Wan 3.0 wygrywa w wierności i stabilności, czyli wierności pierwszemu kadrowi, spójności tożsamości podczas ruchu, fizyce i ekskluzywnym 30-sekundowym czasie trwania. Seedance 2.0 wygrywa w wyobraźni, czyli scenach z wieloma obiektami, surrealistycznych instrukcjach i stylizowanych treściach. Jeden błąd pojawia się na tyle często, by trafić do nagłówka sekcji o ryzyku: Wan 3.0 ciągle przechodzi do nowej, nienakazanej perspektywy kamery.
Kluczowe wnioski
- Wierny vs. odważny – to prawdziwy podział. W przypadku promptu, który jest sprzeczny z obrazem wejściowym, Wan 3.0 chroni obraz i tonuje instrukcję; Seedance 2.0 wykonuje instrukcję i odbudowuje obraz wokół niej. Wybierz w zależności od tego, które niepowodzenie możesz zaakceptować.
- Fizyka to najmocniejsza strona Wan 3.0: rozbijające się szkło i uderzenie bilardowe biją zarówno Wan 2.7, jak i Seedance 2.0 na tym samym ziarnie, z czystszymi wzorami pęknięć i przeniesieniem pędu.
- Tożsamość jest zachowana. We wszystkich dziewięciu 30-sekundowych przebiegach żadna postać nie zmieniła twarzy, stroju ani planu. Spójność podczas ruchu również pokonała Seedance 2.0 w bezpośrednim porównaniu.
- Wada w blokowaniu to niekontrolowane cięcia kamery: ostre, niezamówione zmiany ujęcia, czasami z efektem ducha (ghosting), powtórzone w standardowych przebiegach i wielokrotnie w 30-sekundowych klipach.
- 30 sekund w jednej generacji jest obecnie ekskluzywne w tym zestawieniu. Zarówno Seedance 2.0, jak i Wan 2.7 zatrzymują się na 15.
Jak powstała ta recenzja Wan 3.0: To samo ziarno, ten sam kadr, ten sam prompt
Porównania między modelami wideo zwykle kończą się fiaskiem, zanim się zaczną, ponieważ każdy model otrzymuje inny obraz początkowy, przepisany prompt lub szczęśliwą drugą próbę. Ten test eliminuje wszystkie trzy zmienne. Każdy z 49 przypadków ustala jeden pierwszy kadr, jeden prompt i jedno ziarno, a ta dokładna trójka jest uruchamiana na wszystkich trzech modelach. Nikt nie dostaje drugiej szansy. Tym, co zmienia się między klipami, jest model, i nic więcej.
10 wymiarów obejmuje ruch obiektu, ruchy kamery, fizykę, interakcje wielu obiektów, zmiany otoczenia, statyczne ujęcia, tekst i interfejs na ekranie, treści stylizowane, konflikty obraz-prompt oraz długie, 30-sekundowe generacje. Wyniki zostały ocenione przez człowieka na podstawie każdego klipu, a nie przez metrykę.
Oto przedsmak. Szklanka wody spada ze stołu. Ten sam kadr, to samo ziarno 3001, trzy modele:

Porównanie trzech modeli w teście spadającej szklanki: Wan 2.7 po lewej, Wan 3.0 na środku, Seedance 2.0 po prawej, ten sam pierwszy kadr, prompt i ziarno
Prompt: szklanka spada z krawędzi stołu, woda się rozlewa, szklanka rozbija się na podłodze. Od lewej do prawej: Wan 2.7, Wan 3.0, Seedance 2.0. Zwróć uwagę na łuk upadku i pęknięcie: rozbicie w Wan 3.0 wygląda jak szkło, a nie jak zamiana tekstury.
Ten klip zawiera całą recenzję w miniaturze. Wan 2.7 jest wyraźnie o generację w tyle. Wan 3.0 i Seedance 2.0 wymieniają ciosy na tym samym poziomie, a to, który jest „lepszy”, zależy wyłącznie od tego, w jakim wymiarze znajduje się twoje ujęcie.
Gdzie Wan 3.0 wygrywa w recenzji: Tożsamość, fizyka i obiekt zablokowany względem kamery
Tożsamość podczas ruchu. W teście z gazetą (ziarno 1004) starszy mężczyzna opuszcza gazetę, podnosi wzrok, uśmiecha się i macha. Proste, z tym że ciągły ruch człowieka jest dokładnie tym, w czym modele wideo po cichu zamieniają twarze. Wan 3.0 utrzymuje twarz mężczyzny, jego ubranie i szczegóły pomieszczenia zablokowane przez cały łańcuch gestów. Seedance 2.0, na identycznych danych wejściowych, pozwala obiektowi dryfować.

Porównanie obok siebie testu z gazetą i machaniem, Wan 3.0 po lewej utrzymuje tożsamość, Seedance 2.0 po prawej dryfuje
Ziarno 1004, 5 sekund: mężczyzna opuszcza gazetę, uśmiecha się, macha. Po lewej Wan 3.0, po prawej Seedance 2.0. Sprawdź twarz przed i po machnięciu.
Logika ruchu względem poprzedniej generacji. Test baletowy (ziarno 1005) wymaga jednego eleganckiego obrotu w miejscu z powiewającą spódniczką. Wan 3.0 wykonuje obrót jako jeden ciągły, fizycznie spójny ruch, a tancerka to ta sama osoba po obu stronach obrotu. Próba Wan 2.7 uwidacznia ulepszenie.

Porównanie piruetu baletowego ułożone pionowo, Wan 3.0 u góry wykonuje czysty obrót, Wan 2.7 poniżej gubi ruch
Ziarno 1005, 5 sekund: jeden obrót, spódnica powiewa. Na górze Wan 3.0, na dole Wan 2.7. To jest praktyczne znaczenie „logiki ruchu”.
Zmiana otoczenia bez naruszania obiektu. Test zorzy polarnej (ziarno 5004) wymaga, aby niebo tańczyło od zieleni do fioletu nad ośnieżoną górą. Pułapka polega na tym, że większość modeli pozwala, aby góra kołysała się razem z niebem. Wan 3.0 utrzymuje górę nieruchomo, podczas gdy zorza się animuje; góra w Seedance 2.0 wyraźnie się przesuwa. Jeśli twoja praca obejmuje zdjęcia produktów, nieruchomości lub jakiekolwiek sceny z zablokowanym obiektem, to jest wymiar, na który warto zwrócić uwagę.

Zorza polarna nad ośnieżoną górą, Wan 3.0 po lewej z zablokowaną górą, Seedance 2.0 po prawej z dryfem obiektu
Ziarno 5004, 6 sekund: zorza zmienia kolor z zielonego na fioletowy, góra nie może się poruszyć. Po lewej Wan 3.0, po prawej Seedance 2.0.
Fizykę widzieliście już w porównaniu trzech modeli z upadkiem szklanki. Przypadek uderzenia bilardowego (ziarno 3003) powtarza wzór: biała bila uderza, kolorowe bile rozpraszają się z wiarygodnym przeniesieniem pędu i nadal się odbijają od siebie, a obaj konkurenci pozostają w tyle na tych samych danych wejściowych.
Gdzie Wan 3.0 przegrywa: Niekontrolowane cięcia i nieśmiały surrealizm
Uczciwa recenzja Wan 3.0 musi poświęcić temu czas, ponieważ obie słabości mają charakter strukturalny, a nie kosmetyczny.
Kamera sama się przestawia. Poproś o jeden ciągły ruch kamery, a Wan 3.0 ma zwyczaj wstawiania ostrej, niezamówionej zmiany ujęcia. Test wieży (ziarno 2004) wymaga powolnego najazdu od podstawy do szczytu, a następnie oddalenia do pełnego widoku. Po około 3,5 sekundy model po prostu przechodzi do innego ujęcia, z widocznym skokiem gradacji kolorów w poprzek cięcia.

Test wieży Wan 3.0 pokazujący niekontrolowane, ostre cięcie około 3,5 sekundy zamiast ciągłego najazdu
Ziarno 2004, 8 sekund, prompt wymaga jednego ciągłego najazdu i odkrycia. Obserwuj 3,5 s: to cięcie nigdy nie było zamówione.
Gwoli uczciwości, kontrola kamery jest obecnie słabym punktem całej dziedziny: Seedance 2.0 również nie zdołał wykonać pełnego orbity w tym teście, a Wan 2.7 nie oferuje żadnej przewagi. To, co czyni sytuację gorszą w Wan 3.0, to fakt, że to samo zachowanie cięcia powtarza się w 30-sekundowych przebiegach, czyli dokładnie tam, gdzie najbardziej liczy się jedno nieprzerwane ujęcie. Więcej na ten temat poniżej.
Surrealistyczne instrukcje są negocjowane w dół. Wymiar konfliktu podaje modelowi prompt, który jest sprzeczny z obrazem wejściowym – to podstawa każdego surrealistycznego konceptu reklamowego. Wejście: normalny salon. Prompt: w pomieszczeniu zaczyna padać ulewny deszcz, mocząc meble.

Klatka wejściowa do testu konfliktu z deszczem w pomieszczeniu: zwykłe wnętrze salonu
Klatka wejściowa, którą otrzymały oba modele. Prompt wymaga wewnętrznego deszczu na tej scenie, ziarno 10001.

Test konfliktu z deszczem w pomieszczeniu, Wan 3.0 po lewej ledwie zmienia pomieszczenie, Seedance 2.0 po prawej w pełni oddaje opady deszczu w środku
Po lewej Wan 3.0: zmiana oświetlenia i lokalny spray przy roślinie, brak deszczu. Po prawej Seedance 2.0: rzeczywisty deszcz w pomieszczeniu, spójnie zintegrowany. To była największa różnica w całym teście.
Wan 3.0 odpowiada zmianą oświetlenia i symbolicznym pluskiem w pobliżu rośliny doniczkowej. Seedance 2.0 angażuje się: prawdziwy deszcz w pomieszczeniu, a pokój pozostaje spójny, podczas gdy jest mokry. Drugi przypadek konfliktu, wieloryb szybujący nad salą konferencyjną (ziarno 10003), zawodzi inaczej, ale z tego samego powodu: Wan 3.0 zabarwia całe biuro na niebiesko zamiast zintegrować wieloryba. Wzór jest spójny: gdy obraz i prompt są ze sobą sprzeczne, Wan 3.0 staje po stronie obrazu. W przypadku wiernej pracy z produktem ten instynkt jest zaletą. W przypadku briefów napędzanych wyobraźnią jest to powód, aby użyć czegoś innego.
30-sekundowy ekskluzywny Wan 3.0 i cięcie, które go podważa
Trzydzieści sekund w jednej generacji to flagowa możliwość Wan 3.0 i w tym zestawieniu nic innego nie jest w stanie tego osiągnąć: Seedance 2.0 i Wan 2.7 kończą na 15. Test obejmował sześć dedykowanych przypadków plus drabiny czasu trwania, a główne ryzyko długich generacji – załamanie tożsamości – nie wystąpiło. We wszystkich dziewięciu 30-sekundowych klipach nikt nie zamienił się w inną osobę, a żaden plan nie przekształcił się po cichu w inny pokój.
Wykonywanie instrukcji w długim horyzoncie czasowym również się sprawdziło. Przypadek piłkarski (ziarno 11006) opisuje cztery sekwencyjne punkty: jedno dziecko cofa się, aby zwiększyć dystans, dwójka podaje sobie trzy razy, jedno strzela długo, drugie cieszy się. Wszystkie cztery lądują w odpowiedniej kolejności:
Ziarno 11006, 30 sekund, jedna generacja: cofnięcie, trzy podania, długi strzał, radość. Wieloetapowa scena w jednym prompcie, wykonana sekwencyjnie.
Następnie ta sama wada z sekcji o kamerze powraca. Przypadek z tablicą (ziarno 11004) wymaga niezwykle powolnego najazdu i oddalenia, przy czym tekst na tablicy musi pozostać czytelny. Około 4 do 5 sekund klip rozpuszcza się poprzez zwielokrotnioną ekspozycję (ghosting) do innej kompozycji:
Ziarno 11004, 30 sekund: prompt wymaga jednego ciągłego najazdu i oddalenia na tablicę. Obserwuj 4 do 5 sekund: niekontrolowane rozpuszczenie, z przejściowym efektem ducha, w nowe kadrowanie.
Trzeci długi przypadek, 30-sekundowy portret mówiący (ziarno 11002), powtarza to około 15 do 17 sekund z rozpuszczeniem plus zmianą postawy i kadrowania. Model zachowuje się tak, jakby reżyserował wieloujęciowy film krótkometrażowy, podczas gdy brief dotyczył pojedynczego ujęcia. Im dłuższy klip, tym więcej okazji do cięć. Dopóki to nie zostanie opanowane, traktuj 30-sekundowe wyjście jako sekwencję, którą być może trzeba będzie przyciąć, a nie jako jedno gwarantowane, nieprzerwane ujęcie, i miej na uwadze ekskluzywność: jest realna, utrzymuje tożsamość i obecnie jest dostarczana z wbudowanym, niezatrudnionym przez Ciebie redaktorem.
Wan 3.0 vs Seedance 2.0: Który model do jakiego zadania
Pełna 10-wymiarowa tabela wyników w skrócie. „Remis” oznacza, że żadna ze stron nie miała powtarzalnej przewagi w tym teście.
| Wymiar | vs Wan 2.7 | vs Seedance 2.0 |
|---|---|---|
| Ruch obiektu | Lepsza logika ruchu | Wan 3.0 lepiej utrzymuje tożsamość |
| Ruchy kamery | Remis, oba słabe | Remis, oba słabe, Wan 3.0 dodaje niekontrolowane cięcia |
| Fizyka | Duży krok naprzód | Wan 3.0 przoduje, bardziej wierny pierwszemu kadrowi |
| Interakcja wielu obiektów | Remis | Seedance 2.0 wyraźnie przoduje |
| Zmiana otoczenia | Przoduje | Przoduje, obiekt pozostaje zablokowany |
| Statyczne ujęcie | Przoduje | Rekwizyty sceny nieco słabiej, ludzie na żywo lepiej |
| Tekst i interfejs | Przoduje | Podzielone, interakcja UI słaba u obu |
| Treści stylizowane | Przoduje | Seedance 2.0 wyraźnie przoduje w semantyce stylu |
| Konflikt obraz-prompt | Remis | Seedance 2.0 daleko przoduje, największa różnica w teście |
| 30-sekundowa generacja | Ekskluzywna | Ekskluzywna, Seedance 2.0 kończy na 15s |
Logika wyboru w dwóch linijkach. Ścisła wierność konwersji obrazu na wideo, zablokowane obiekty, zdarzenia fizyczne, materiał z prawdziwymi ludźmi lub cokolwiek dłuższego niż 15 sekund: Wan 3.0. Sceny z wieloma postaciami, surrealistyczne lub oparte na konflikcie kreacje, stylizowane formaty: Seedance 2.0.
Możesz przetestować połowę tej tabeli już dziś, na nic nie czekając. Seedance 2.0 image-to-video i Wan 2.7 image-to-video są dostępne na Atlas Cloud na jednym kluczu, a koszt pojedynczego uruchomienia widnieje na przycisku, zanim podejmiesz decyzję. Ustaw własne ziarno, użyj ponownie jednego pierwszego kadru i uruchom dosłownie prompt z upadkiem szklanki lub deszczem w pomieszczeniu z tego artykułu. Gdy Wan 3.0 pojawi się – a ta rodzina ma historię pojawiania się na Atlas w dniu 0 – twój test pozostanie niezmieniony, a twoje prompty będą już skalibrowane. Jeśli potrzebujesz strony promptowej tych przygotowań, przewodnik po promptach Wan 3.0 rozbija strukturę oficjalnego podręcznika przypadek po przypadku.
Często zadawane pytania
Czy Wan 3.0 jest lepszy od Seedance 2.0?
Żaden nie dominuje; dzielą się temperamentem w teście na tym samym ziarnie. Wan 3.0 wygrywa wiernością: tożsamość podczas ruchu, fizyka, separacja obiekt-otoczenie, wierność pierwszemu kadrowi, plus ekskluzywne 30-sekundowe wyjście. Seedance 2.0 wygrywa wyobraźnią: interakcje wielu obiektów, surrealistyczne wykonywanie instrukcji i stylizowane treści, przy czym wymiar konfliktu jest jego największym zwycięstwem. Wybieraj na ujęcie, a nie na markę.
Jaki jest największy problem w tej recenzji Wan 3.0?
Niekontrolowane cięcia kamery. Prompty wymagające jednego ciągłego ruchu wielokrotnie otrzymywały ostrą, niezamówioną zmianę ujęcia, czasami z efektem ducha: na 3,5 s w 8-sekundowym najeździe (ziarno 2004), na 4 do 5 s i 15 do 17 s w 30-sekundowych przebiegach (ziarna 11004, 11002). Powtarza się to łatwo i bezpośrednio ogranicza użyteczność pojedynczego ujęcia.
Czy Wan 3.0 naprawdę generuje 30-sekundowe filmy?
Tak, w jednej generacji, a tożsamość została zachowana we wszystkich dziewięciu 30-sekundowych przebiegach testowych, z czteropunktową sceną sekwencyjną (ziarno 11006) wykonaną w odpowiedniej kolejności. Zastrzeżenie jest takie samo jak w przypadku wady cięcia: długie przebiegi zwykle zawierają co najmniej jedno niekontrolowane rozpuszczenie lub zmianę ujęcia, więc zaplanuj przycięcie, zamiast oczekiwać jednego gwarantowanego, nieprzerwanego ujęcia.
Jak przetestowano tę recenzję Wan 3.0?
49 przypadków konwersji obrazu na wideo w 10 wymiarach, każdy przypadek w 720p z ustalonym ziarnem, a identyczny pierwszy kadr, prompt i ziarno uruchomiono ponownie na Seedance 2.0 i Wan 2.7. Wszystkie wyniki zostały sprawdzone przez człowieka, klip po klipie, bez żadnych ponownych prób dla żadnego modelu. Osadzone klipy to rzeczywiste wyniki testów, z dołączonymi ziarnami, więc porównania można sprawdzić bezpośrednio.
Czy mogę odtworzyć ten test przed premierą Wan 3.0?
Metoda jest dostępna już dziś: ustal ziarno, zablokuj jeden pierwszy kadr i prompt, i uruchom tę samą trójkę na dostępnych modelach. Seedance 2.0 i cała rodzina Wan 2.7 są teraz dostępne na Atlas Cloud, który ma również zwyczaj dostępu w dniu 0, gdy ta rodzina modeli się aktualizuje, więc ten sam test powinien działać na Wan 3.0 w dniu jego premiery.
Podsumowanie
Wan 3.0 sprawia wrażenie modelu zbudowanego przez ludzi, którzy cenią obraz wejściowy: to, co mu dasz, chroni, poprzez ruch, fizykę i przez pełne 30 sekund. Ta dyscyplina jest dokładnie tym, czego potrzebuje wierna, komercyjna konwersja obrazu na wideo, i jest też powodem, dla którego model wzdraga się przed promptami, które proszą obraz, aby stał się czymś, czym nie jest. Połącz go z odważnym, wyobraźniowym modelem, a nie zastępuj jednym, i obserwuj jedną liczbę, gdy zostanie publicznie udostępniony: czy wskaźnik niekontrolowanych cięć spadnie. Ta jedna naprawa zdecyduje, czy 30-sekundowy ekskluzywny jest nagłówkiem, czy zastrzeżeniem.






