
Dwa monitory studyjne obok siebie, lewy pokazuje wynurzającego się potwora morskiego podczas burzy, prawy pokazuje tę samą burzę, ale przerwaną w pół
Odtwórz 30-sekundowy klip z potworem morskim, który Alibaba dołączył do wersji beta Wan 3.0. Trawler rybacki, ulewny deszcz, błyskawice, a potem ocean eksploduje ku górze. Dziesięć wyraźnych ujęć. Żadnego cięcia. Towarzysząca mu orkiestrowa ścieżka dźwiękowa została napisana przez model.
Twoją pierwszą reakcją nie jest „łał”. To: „czego dokładnie brakuje mojemu Wan 2.7?”
Więc poszedłem szukać odpowiedzi i pierwszą rzeczą, jaką znalazłem, było to, że większość internetu odpowiada błędnie. Wyszukaj wan 3.0 vs wan 2.7, a wyniki na górze pewnym tonem informują, że Wan 3.0 renderuje natywne 4K, a wagi są na Hugging Face. Żadne z tych stwierdzeń nie jest prawdą. Pobrałem oficjalne pliki demonstracyjne na laptopa, odczytałem je ffmpegiem, a następnie sprawdziłem rejestry modeli i opublikowane cenniki. Prawdziwa aktualizacja jest duża. Tyle że nie jest to aktualizacja, którą opisują ludzie.
Wan 3.0 vs Wan 2.7: kluczowe wnioski
- Czas trwania to główna zmiana. Wan 3.0 generuje 30 sekund w jednym przebiegu z automatyczną rekomendacją „inteligentnego czasu trwania”. Wan 2.7 ma limit 15 sekund dla tekstu na wideo i obrazu na wideo oraz 10 sekund dla referencji na wideo i edycji wideo.
- Referencje skaczą z garstki do tłumu. Wan 2.7 akceptuje do 5 elementów referencyjnych. Wan 3.0 akceptuje do 20, a po raz pierwszy przyjmuje jako dane wejściowe do generacji pliki doc, xls, ppt, pdf i md, a także strony internetowe.
- Nie ma 4K. Własny cennik API Alibaby ma dokładnie trzy poziomy: 480P, 720P i 1080P. W Atlas Cloud Wan 2.7 oferuje wyższy sufit dzięki opcjom superrozdzielczości 1080P-SR i 1440P-SR.
- Wagi nie są otwarte. Organizacja Wan-AI na Hugging Face wciąż kończy się na Wan 2.2. Nie ma repozytorium 3.0, 2.7 ani 2.5.
- Wan 3.0 jest dostępny tylko w wersji beta i tylko u producenta. Działa na Alibaba Cloud Bailian, stronie Wanxiang, desktopowej aplikacji Qianwen i kilku pokrewnych produktach. Jeśli potrzebujesz API, które możesz wywołać w produkcji w tym tygodniu, Wan 2.7 jest wciąż generacją, która odpowiada.
- Chcesz zobaczyć format, zanim nauczysz się gramatyki promptów? Atlas Cloud ma darmowy generator skeczy reklamowych AI, który zamienia jeden opis produktu w 15-sekundową komediową reklamę z dwiema postaciami i mówionym dialogiem. Jedno darmowe wygenerowanie, bez znaku wodnego.
Pełna, 30-sekundowa sekwencja kaiju, wygenerowana przez Alibabę na Wan 3.0 podczas publicznej bety i opublikowana w oficjalnym podręczniku twórcy Wan 3.0. Nie wygenerowaliśmy tego klipu. Włącz dźwięk: ścieżka dźwiękowa jest częścią wyniku, a nie dodanym później podkładem muzycznym. Plik w dostarczonej postaci: 1920x1072, 24 kl./s, 30,07 s, stereo AAC 44,1 kHz.
Oto pierwsza rzecz, której brakuje w arkuszach specyfikacji. Ten plik ma rozdzielczość 1920x1072, a nie 1920x1080. Każde demo „1080p” w oficjalnym podręczniku ląduje na wysokości 1072 pikseli, a kilka innych opublikowanych dem ma zwykłe 1280x720. Dwanaście z dziewiętnastu klipów w podręczniku trwa od 30,05 do 30,07 sekundy, co mówi, że limit 30 sekund to rzeczywiste twarde ograniczenie, a nie marketingowa zaokrąglona liczba.
Dlaczego pytanie Wan 3.0 vs Wan 2.7 jest trudniejsze, niż się wydaje
Szczera odpowiedź brzmi: prawie nikt nie uruchomił obu modeli na tym samym prompcie, ponieważ prawie nikt nie może. Wan 3.0 został udostępniony w publicznej becie 6 sierpnia 2026 roku i działa na własnych powierzchniach Alibaby (QbitAI, sierpień 2026). Zewnętrzne platformy inferencyjne go nie przejęły. Więc istniejące treści porównawcze opierają się na arkuszach specyfikacji, a arkusze były kopiowane na boki, aż błędy skostniały.
Trzy „fakty” o Wan 3.0 vs Wan 2.7, które są po prostu błędne
„Wan 3.0 działa w natywnym 4K.” Nie. Opublikowany cennik API ma poziomy 480P, 720P i 1080P w cenach ¥0,3, ¥0,6 i ¥1,2 za sekundę. Trzy poziomy, żadnego czwartego. Tymczasem Atlas Cloud udostępnia 1080P-SR i 1440P-SR na Wan 2.7, więc na czystym suficie pikseli starsza generacja obecnie wygrywa.
„Wagi Wan 3.0 są otwarte.” Nie są. Przejdź na Hugging Face, a najnowszą opublikowaną rodziną organizacji Wan-AI jest Wan 2.2, w tym warianty Animate i S2V. Główna linia wideo nie wypuściła wag od czasu 2.2. Jeśli chcesz czegoś do lokalnego grafu ComfyUI, 2.1 i 2.2 to twoje opcje i to się nie zmieniło.
„Gramatyka promptów przenosi się wprost.” To jest w połowie prawdą w sposób, który cię spali. Słowa się przenoszą. Struktura nie. Oficjalne prompty Wan 3.0 to z znacznikami czasu skrypty wieloujęciowe: prompt kaiju to dziesięć ponumerowanych ujęć, prompt billboardu to cztery oznaczone fragmenty z wyraźnymi przedziałami sekund. Wklejenie dziesięcioujęciowego skryptu do modelu 15-sekundowego nie spowoduje eleganckiego wybrania sześciu ujęć. Spowoduje kompresję.
Dlaczego nie możesz po prostu wymieniać promptów między Wan 3.0 a Wan 2.7
Pod tym kryje się druga pułapka i to jest powód, dla którego „po prostu sklej dwa klipy” cię nie uratuje.
Wan 2.7 ma tryb kontynuacji wideo. Wygląda jak ścieżka do 30 sekund. Nie jest. Źródłowy klip, który mu podajesz, musi mieć od 2 do 10 sekund, więc 15-sekundowa generacja nie może być ziarnem. Wynik ponownie koduje źródło, co obcina ogon podanego klipu. A łączenie kontynuacji ma tendencję do dryfowania z powrotem w kierunku początkowego uderzenia, zamiast przesuwać historię do przodu. Piętnaście sekund to twardy sufit dla jednego ciągłego pliku Wan 2.7. Wszystko dłuższe to edycja, a nie generacja.
To jest prawdziwy koszt migracji między tymi dwiema generacjami i żadna tabela porównawcza ci go nie pokaże.
Arkusz specyfikacji Wan 3.0 vs Wan 2.7 i gdzie go faktycznie uruchomić
Aby to przetestować, potrzebujesz miejsca, które uruchamia tekst na wideo, referencję na wideo i edycję wideo na tym samym koncie, z rozliczeniem za sekundę, aby nieudane ujęcie kosztowało cię sekundy, a nie subskrypcję. Wszystko po stronie Wan 2.7 w tym artykule działa na Atlas Cloud, który hostuje cztery punkty końcowe Wan 2.7 i model obrazu użyty do testu referencji. Wan 3.0 nie jest jeszcze dostępny w Atlas Cloud ani na żadnej innej platformie zewnętrznej, co jest dokładnie powodem, dla którego materiał o Wan 3.0 w tym artykule pochodzi z własnych publikacji beta Alibaby.
Tabela 1: Wan 3.0 vs Wan 2.7, generacja do generacji
| Wan 3.0 (publiczna beta) | Wan 2.7 (produkcja) | |
|---|---|---|
| Maks. czas trwania, jeden przebieg | 30 s, z inteligentnym czasem trwania | 15 s (t2v, i2v), 10 s (r2v, edycja wideo) |
| Liczba elementów referencyjnych | Do 20 | Do 5 (1 obraz na temat, do 3 filmów) |
| Tryby wejściowe | Tekst, obraz, wideo, audio, doc/xls/ppt/pdf/md, strony internetowe | Tekst, obraz, wideo, audio |
| Wejście dokumentu | Pojedynczy plik lub link, do 100 MB i 50 stron | Nieobsługiwane |
| Poziomy rozdzielczości | 480P / 720P / 1080P | 720P / 1080P / 1080P-SR / 1440P-SR |
| Natywne audio | Tak | Tak |
| Edycja wideo | Edycja na podstawie instrukcji i referencji | Dedicated video-edit endpoint |
| Otwarte wagi | Nie | Nie |
| Gdzie można uruchomić | Tylko własne powierzchnie Alibaby | API stron trzecich, w tym Atlas Cloud |
| Podana cena | ¥0,3 / ¥0,6 / ¥1,2 za sekundę według poziomu | 0,10 $ za sekundę, poziom 720P |
Tabela 2: punkty końcowe Wan 2.7 użyte w tym artykule
| Endpoint | Maks. czas trwania | Rozdzielczości | Limit referencji | Podana cena |
|---|---|---|---|---|
| Tekst na wideo | 2-15 s | 720P, 1080P, 1080P-SR, 1440P-SR | n/d | 0,10 $/s |
| Referencja na wideo | 2-10 s | 720P, 1080P, 1080P-SR, 1440P-SR | 5 elementów | 0,10 $/s |
| Obraz na wideo | 2-15 s | 720P, 1080P, 1080P-SR, 1440P-SR | klip źródłowy 2-10 s | 0,10 $/s |
| Edycja wideo | 2-10 s wyj., 2-10 s wej. | 720P (1,0x), 1080P (1,5x) | 3 obrazy | 0,10 $/s |
Jeden szczegół cenowy, który warto zapamiętać przed uruchomieniem czegokolwiek: nagłówek „0,10 $ za sekundę” to poziom bazowy 720P. Strona edycji wideo dokumentuje mnożnik 1,5x dla 1080P bezpośrednio, a przycisk Uruchom podaje rzeczywistą liczbę dla wybranego poziomu. Czytaj przycisk, a nie nagłówek.
Wykonaj samodzielnie test Wan 3.0 vs Wan 2.7
Cztery kroki. Dwa z nich wykorzystują opublikowany materiał Alibaby jako stały punkt odniesienia, dwa to własne uruchomienia. Nic tutaj nie wymaga dostępu do bety Wan 3.0.
Krok 1: Pobierz klip Wan 3.0 i jego oryginalny prompt
Strona Wan 3.0 w tym teście nie jest czymś, co generujesz. To coś, co czytasz. Pełny prompt kaiju jest opublikowany w oficjalnym podręczniku twórcy Wan 3.0, wraz z gotowym klipem, w przykładzie „灾难电影”. Jest to chiński scenariusz z dziesięcioma ponumerowanymi ujęciami i osobnym akapitem opisującym ścieżkę dźwiękową.
Przeczytaj go raz, zanim zrobisz cokolwiek innego. Struktura jest lekcją: dziesięć ujęć, każde z własną kamerą, tematem i notatką o oświetleniu, kończące się krótkim opisem muzyki. Tak wygląda prompt do 30-sekundowej generacji w jednym przebiegu.
Krok 2: Uruchom ten sam prompt przez Wan 2.7 tekst na wideo
Otwórz playground Wan 2.7 tekst na wideo i wklej angielskie tłumaczenie tego samego skryptu. Na razie go nie skracaj. Chcesz zobaczyć, co model robi, gdy intencja przekracza sufit.
Plain1A 30-second, photoreal cinematic sequence: a deep-sea kaiju emerges at night in a raging storm. Open on a small, battered fishing trawler with the white letters "WAN" on its hull, fighting through enormous waves under torrential rain; lightning briefly lights the whole ocean. Push to a mid-close shot on the deck: waves smash over the bow, ropes, nets and metal railings whip in the wind, rain streaks the lens. Then the sea ahead swells unnaturally, an enormous vortex forms, and a vast dark shape passes beneath the boat, lifting it. A crewman in a soaked rain jacket grips the rail, terrified, and turns toward the water. Finally the surface explodes upward and a colossal Pacific-Rim-style sea monster breaches: wet, scarred, ridged skin, huge jaws, tens of meters of spray. Close on its head roaring in the lightning. The trawler is nearly swallowed. End on a wide shot: the kaiju towering over the churning sea, the boat tiny in the foreground, one final lightning strike. Hollywood disaster-movie scoring: low sub-bass rumble and sparse strings building to brass and heavy percussion at the breach, ending on an oppressive sustained low chord. Photoreal scale, volumetric water, high-contrast storm lighting.
Ustawienia: Rozdzielczość 1080P, Czas trwania 15 s (maksymalny), Proporcje 16:9, audio włączone, aby model sam je skomponował. Pole referencyjne audio pozostaw puste.

Playground Wan 2.7 tekst na wideo w Atlas Cloud z załadowanym promptem kaiju i gotowym 15-sekundowym klipem w panelu WYJŚCIE
Playground Wan 2.7 tekst na wideo w Atlas Cloud, prompt wklejony, wybrano 1080P i 16:9. Przycisk Uruchom podaje 0,75 $ za ten krótki test, co daje 0,15 $ za sekundę: mnożnik 1,5x dla 1080P w pełni widoczny, na stronie modelu, której nagłówek wynosi 0,10 $.
Następnie uruchom go drugi raz z dołączoną jedną linią do promptu:
Plain1Single continuous take, no cuts. Prioritize the breach moment; compress the setup.
Ta pojedyncza linia to migracja w miniaturze. 30-sekundowy skrypt musi zostać napisany na nowo jako 15-sekundowa intencja, a to ty decydujesz, które siedem ujęć zginie.
Po lewej: oficjalny wynik Wan 3.0, 30 sekund. Po prawej: Wan 2.7 w Atlas Cloud uruchomiony na tym samym prompcie, zatrzymujący się na 15-sekundowym limicie.
Krok 3: Zbuduj obrazy referencyjne do testu identyczności Wan 3.0 vs Wan 2.7
Czas trwania to głośna aktualizacja. Spójność na poziomie pikseli to ta, która faktycznie zmienia pracę produkcyjną, i możesz ją przetestować z dwoma kotami.
Podręcznik Alibaby zawiera pastisz Wesa Andersona, w którym ten sam kot ragdoll i ten sam czarny kot muszą przetrwać pięć zupełnie różnych środowisk: symetryczny korytarz hotelowy, widok z boku w przekroju, bęben pralki, taśmę bagażową na lotnisku i czerwoną budkę telefoniczną. Oba koty są oznaczone tagami referencyjnymi @Image1 i @Image2.
Najpierw wygeneruj własne dwie referencje. Użyj GPT Image 2 z ustawioną jakością na wysoką i ramką 16:9, i uruchom go dwukrotnie.
Plain1A studio portrait of a fluffy ragdoll cat with blue eyes and a dark mask, sitting upright facing the camera, evenly lit against a plain pale pink background, sharp fur detail, full body visible, clean reference-sheet framing.
Plain1A studio portrait of a small sleek black cat with bright amber eyes, standing in profile facing right, evenly lit against a plain pale pink background, sharp fur detail, full body visible, clean reference-sheet framing.

Playground GPT Image 2 w Atlas Cloud z ustawioną jakością na wysoką i wyrenderowanym w panelu WYJŚCIE obrazem referencyjnym kota ragdoll
GPT Image 2 z jakością wysoką, 16:9. Uruchom drugi prompt w ten sam sposób, aby uzyskać czarnego kota.
Krok 4: Wykonaj test identyczności na punkcie końcowym Wan 2.7 referencja na wideo
Prześlij oba koty do punktu końcowego Wan 2.7 referencja na wideo. Rozdzielczość 1080P, proporcje 16:9, czas trwania 10 sekund, co jest maksimum dla tego punktu końcowego. Poniższy prompt to lista ujęć z podręcznika skompresowana z pięciu fragmentów do trzech, ponieważ dziesięć sekund nie pomieści pięciu.
Plain1Wes Anderson style, perfectly symmetrical, flat frontal compositions, pastel palette. Reference image 1 is the ragdoll cat, reference image 2 is the black cat; keep both cats identical in every shot. Shot 1: an endless symmetrical hotel corridor, the ragdoll cat running straight toward the camera with a solemn expression, the black cat sprinting away in the background with its head twisted back 180 degrees. Shot 2: a cutaway side view of the corridor, pink patterned wallpaper and gold picture frames, the ragdoll walking left to right and the black cat crossing right to left. Shot 3: frontal macro on a mint-green vintage washing machine door, both cats floating stiffly inside the drum among suds, eyes blank, rainbow-ordered detergent bottles lined up behind. Rigid horizontals and verticals, no camera tilt, deadpan absurd humor.

Playground Wan 2.7 referencja na wideo w Atlas Cloud z załadowanymi obiema referencjami kotów i gotowym klipem w panelu WYJŚCIE
Playground Wan 2.7 referencja na wideo: oba koty załadowane do slotów referencyjnych obrazu, rozdzielczość ustawiona na 1080P, a przycisk Uruchom podaje koszt przed rozpoczęciem. Dwie referencje to już znacząca część tego, co ten punkt końcowy akceptuje. Wan 3.0 przyjmuje 20 elementów referencyjnych.
Teraz umieść je obok siebie.

Oficjalny klip z blokadą identyczności Wan 3.0: ten sam ragdoll i czarny kot utrzymane spójnie w korytarzu hotelowym, ścianie przekroju, bębnie pralki, taśmie bagażowej i czerwonej budce telefonicznej
Wygenerowane przez Alibabę na Wan 3.0 podczas publicznej bety i opublikowane w oficjalnym podręczniku twórcy. Pięć środowisk, 19,9 sekundy, oba koty przypięte tagiem referencyjnym. Pokazane jako cichy GIF; dostarczony plik zawiera audio stereo 44,1 kHz.

Wynik Wan 2.7 referencja na wideo na to samo zlecenie, trzy ujęcia w 10-sekundowym limicie
Wan 2.7 referencja na wideo w Atlas Cloud, te same dwie referencje, pokazane jako cichy GIF. To jest domyślne 5-sekundowe ujęcie punktu końcowego, a nie pełne 10: warto wiedzieć, że kontrola czasu trwania nie zawsze realizuje to, co ustawisz, więc przeczytaj wycenę przycisku Uruchom przed naciśnięciem. Zwróć uwagę na oznaczenia kotów i maskę ragdolla; to jest wymiar, którego dotyczy twierdzenie o „spójności na poziomie pikseli”.
Cztery kolejne prompty Wan 3.0 vs Wan 2.7 warte ponownego uruchomienia
Klip kaiju obciąża czas trwania i fizykę. Te trzy obciążają różne rzeczy, a każdy zderza się z innym limitem Wan 2.7. Wszystkie trzy to oficjalne wyniki beta Alibaby z oficjalnego podręcznika.
Wan 3.0, oficjalny wynik beta: pojedyncze 30-sekundowe odsunięcie w dół fluorescencyjnie oświetlonego korytarza szpitalnego, bladozielona monochromatyczna kolorystyka, z aktorką krzyczącą o pomoc. Włącz dźwięk. Występ, kroki i szum sprzętu są generowane przez model.
Tabela 3: czego wymaga każdy prompt i gdzie Wan 2.7 go ogranicza
| Prompt | Czego wymaga skrypt | Opublikowany limit Wan 2.7 | Testowany wymiar |
|---|---|---|---|
| Wynurzenie kaiju | 10 ponumerowanych ujęć w ciągu 30 s plus krótki opis muzyki | Maks. 15 s w tekście na wideo | Czas trwania i narracja wieloujęciowa |
| Korytarz szpitalny | Jedno 30-sekundowe ciągłe ujęcie z mówionym dialogiem | Maks. 15 s, dostępne natywne audio | Występ i dialog w długich ujęciach |
| Kowbojka na stacji benzynowej | 30-sekundowy łuk komediowy w czterech aktach z timed acts | Maks. 15 s, więc dwa akty muszą odejść | Komediowy timing wymagający czasu trwania |
| Billbord w jednym ujęciu | Cztery fragmenty z wyraźnymi przedziałami sekund, bez cięć | Maks. 15 s, więc przedziały wymagają przepisania | Fizyka kamery podczas długiego ruchu |
| Dwa koty, pięć pokoi | 2 oznaczone tematy utrzymane w 5 środowiskach | Maks. 10 s, 5 slotów referencyjnych | Spójność identyczności |
Darmowa 15-sekundowa wersja tego samego pomysłu
Spójrz jeszcze raz na klip ze stacji benzynowej. Ten format, krótki skecz komediowy z dwiema postaciami, zwrotem akcji i puentą, to miejsce, w którym dodatkowy czas trwania Wan 3.0 zwraca się najhojniej. Jest to również format, który najprawdopodobniej coś sprzeda.
Haczyk tkwi w prompcie. Komediowe przykłady z podręcznika mają 800 słów z wyraźnymi znacznikami czasu i blokowaniem. To prawdziwa umiejętność, która wymaga weekendu, aby się jej nauczyć.
Jeśli chcesz tylko dowiedzieć się, czy format działa dla twojego produktu, zanim zainwestujesz ten weekend, Atlas Cloud ma darmowe narzędzie, które całkowicie pomija inżynierię promptów. Opisujesz produkt, opcjonalnie przesyłasz do czterech zdjęć produktu po 8 MB każde, wybierasz jeden z sześciu tonów (zabawny mem, zwrot akcji, sitcom, wzruszający, luksusowy lub twarda sprzedaż), a narzędzie pisze dwuosobowy scenariusz, dobiera głosy, generuje dialog i efekty dźwiękowe i zwraca gotową 15-sekundową reklamę jako jedną ciągłą scenę. Pobieranie jest czyste, bez znaku wodnego. Musisz być zalogowany i otrzymujesz jedną darmową generację, zanim doładujesz kredyty.

Jedna linia tekstu produktu na wejściu, gotowa 15-sekundowa reklama komediowa na wyjściu: darmowy generator skeczy reklamowych AI Atlas Cloud
Darmowy generator skeczy reklamowych AI: jeden opis produktu na wejściu, jedna 15-sekundowa reklama z dwiema postaciami na wyjściu.

Prawdziwy wynik z darmowego generatora. Włącz dźwięk: scenariusz, dwa głosy i efekty dźwiękowe pochodzą z jednego uruchomienia.
Ile kosztuje porównanie Wan 3.0 vs Wan 2.7
Za sekundę, dwie generacje są w podobnym przedziale cenowym na poziomie 720P. Różnica w kosztach ma charakter strukturalny: klip, który kiedyś trwał 15 sekund, teraz ma 30, więc gotowy kawałek mniej więcej się podwaja.
Tabela 4: ta sama sekwencja kaiju, na cztery sposoby
| Uruchomienie | Stawka | Razem |
|---|---|---|
| Wan 3.0, 30 s przy 720P | ¥0,6 / s | ¥18, około 2,50 $ |
| Wan 3.0, 30 s przy 1080P | ¥1,2 / s | ¥36, około 5,00 $ |
| Wan 2.7, 15 s przy 720P | 0,10 $ / s | 1,50 $ |
| Wan 2.7, 15 s przy 1080P | 0,10 $ / s z mnożnikiem poziomu 1,5x | 2,25 $ |
| Wan 2.7, 15 s przy 1440P-SR | wycena na żywo w przycisku Uruchom | wycena na żywo |
| Darmowy skecz reklamowy AI, 15 s | darmowy, 1 generacja na konto | 0,00 $ |
Dwa zastrzeżenia. Ceny wersji beta nie są cenami ogólnej dostępności, a Alibaba powiedziała, że API wkrótce zostanie szerzej otwarte, więc traktuj kwoty ¥ jako migawkę publicznej bety, a nie ostateczną stawkę. A po stronie Atlas Cloud zawsze czytaj wycenę na żywo na przycisku Uruchom przed zatwierdzeniem, ponieważ mnożnik rozdzielczości jest stosowany tam, a nie w cenie nagłówkowej.
Alibaba był również niezwykle bezpośredni w kwestii tego, gdzie Wan 3.0 wciąż jest słaby, mówiąc, że model „wciąż ma pole do poprawy w zakresie jakości dźwięku i dokładności tekstu”. To pasuje do tego, co pokazują pliki: audio w oficjalnych demach jest stereo 44,1 kHz, ale zakodowane przy skromnym 32 kb/s, co jest w porządku do podglądu, ale cienkie do mastera.
Licencjonowanie Wan 3.0 vs Wan 2.7: co możesz faktycznie dostarczyć
Krótka wersja i proszę zweryfikuj ją samodzielnie z aktualnymi warunkami, zanim cokolwiek pokażesz klientowi.
Wan 3.0 jest w publicznej becie, a jego warunki komercyjne nie są ustalone. Ponieważ wagi nie zostały wydane, nie ma w ogóle ścieżki samodzielnego hostingu; wszystko, co stworzysz, przechodzi przez API Alibaby lub jej powierzchnie konsumenckie i jesteś związany tym, co te warunki mówią w dniu generowania. Wan 2.7 to ta sama historia z wagami, ale jest w produkcji wystarczająco długo, aby warunki API platformy były stabilne. Jeśli uruchamiasz go przez platformę zewnętrzną, twoje prawa komercyjne wynikają z warunków korzystania z tej platformy, więc przeczytaj te, które faktycznie dotyczą twojego konta. Żaden z tych akapitów nie jest poradą prawną.
FAQ Wan 3.0 vs Wan 2.7
Czy Wan 3.0 jest open source? Czy mogę go uruchomić w ComfyUI?
Nie. Od sierpnia 2026 r. nie ma repozytorium Wan 3.0 w organizacji Wan-AI na Hugging Face ani w GitHub Wan-Video. Najnowsza rodzina Wan z wydanymi wagami to Wan 2.2, w tym warianty Animate i S2V. Do lokalnego grafu ComfyUI nadal jesteś na 2.1 lub 2.2. Wan 3.0 jest dostępny tylko przez API i stronę internetową.
Rozdzielczość Wan 3.0 vs Wan 2.7: czy Wan 3.0 naprawdę generuje 4K?
Nie. Opublikowany cennik API ma trzy poziomy rozdzielczości: 480P, 720P i 1080P. Kilka szeroko udostępnianych postów porównawczych twierdzi, że natywne 4K i są w błędzie. Na surowym suficie wyjściowym Wan 2.7 w Atlas Cloud faktycznie idzie wyżej dzięki opcjom superrozdzielczości 1080P-SR i 1440P-SR.
Czy mogę uzyskać 30 sekund z Wan 2.7 przez rozszerzanie klipów?
Nie jako jeden ciągły plik. Tryb kontynuacji wymaga klipu źródłowego o długości 2 do 10 sekund, więc pełna 15-sekundowa generacja nie może być ziarnem. Wynik ponownie koduje i przycina ogon tego, co podajesz, a łańcuchowe kontynuacje mają tendencję do zapętlania się z powrotem w kierunku początkowego uderzenia. Po 15 sekundach edytujesz, a nie generujesz.
Wan 3.0 vs Wan 2.7: gdzie mogę faktycznie uruchomić każdy z nich dzisiaj?
Wan 3.0 jest w publicznej becie na własnych powierzchniach Alibaby: Alibaba Cloud Bailian, Wanjing Yike, strona Wanxiang, klient desktopowy Qianwen, IF STUDIO i Duiyou, z dostępem w skali szarości w aplikacji Qianwen. Żadna zewnętrzna platforma inferencyjna go jeszcze nie hostuje. Wan 2.7 to generacja, którą wciąż możesz wywoływać bezpośrednio, przez punkty końcowe tekst na wideo, obraz na wideo, referencja na wideo i edycja wideo.
Ceny Wan 3.0 vs Wan 2.7: który kosztuje więcej za gotowy klip?
Za sekundę na poziomie 720P są blisko. Za gotowy klip spodziewaj się mniej więcej podwójnej ceny, ponieważ naturalna długość wyjściowa wzrosła z 15 do 30 sekund. Zaplanuj budżet na zmianę czasu trwania, a nie na zmianę stawki, i pamiętaj, że ceny wersji beta mogą nie przetrwać ogólnej dostępności.
Czy muszę przepisać moje prompty Wan 2.7 dla Wan 3.0?
Tak, a przepisanie ma charakter strukturalny, a nie leksykalny. Prompty Wan 2.7 opisują jedno ciągłe ujęcie w bogatych szczegółach. Prompty Wan 3.0 to listy ujęć z znacznikami czasu, czasami z osobnym akapitem opisującym muzykę, a model może również odczytać plik PDF lub prezentację jako dane wejściowe. Zasada kciuka: dla Wan 2.7 napisz jeden akapit o jednym ujęciu; dla Wan 3.0 napisz ponumerowany podział scen z przedziałami sekund.






