Seedance 2.5 już dostępne — Jako pierwsze na Atlas Cloud

Wan 3.0 vs Wan 2.7: Otworzyłem własne pliki demonstracyjne Alibaby. Trzy specyfikacje, które wszyscy skopiowali, są błędne.

Wan 3.0 vs Wan 2.7: 30-sekundowe klipy, 20 slotów referencyjnych, brak 4K, brak otwartych wag. Otworzyliśmy własne pliki demo Alibaby i odtworzyliśmy test, który możesz uruchomić już dziś.

Konsola do kolorowania z monitorami wyświetlającymi scenę z gigantycznym potworem morskim

Dwa monitory studyjne obok siebie, lewy pokazuje wynurzającego się potwora morskiego podczas burzy, prawy pokazuje tę samą burzę, ale przerwaną w pół

Odtwórz 30-sekundowy klip z potworem morskim, który Alibaba dołączył do wersji beta Wan 3.0. Trawler rybacki, ulewny deszcz, błyskawice, a potem ocean eksploduje ku górze. Dziesięć wyraźnych ujęć. Żadnego cięcia. Towarzysząca mu orkiestrowa ścieżka dźwiękowa została napisana przez model.

Twoją pierwszą reakcją nie jest „łał”. To: „czego dokładnie brakuje mojemu Wan 2.7?”

Więc poszedłem szukać odpowiedzi i pierwszą rzeczą, jaką znalazłem, było to, że większość internetu odpowiada błędnie. Wyszukaj wan 3.0 vs wan 2.7, a wyniki na górze pewnym tonem informują, że Wan 3.0 renderuje natywne 4K, a wagi są na Hugging Face. Żadne z tych stwierdzeń nie jest prawdą. Pobrałem oficjalne pliki demonstracyjne na laptopa, odczytałem je ffmpegiem, a następnie sprawdziłem rejestry modeli i opublikowane cenniki. Prawdziwa aktualizacja jest duża. Tyle że nie jest to aktualizacja, którą opisują ludzie.

Wan 3.0 vs Wan 2.7: kluczowe wnioski

  • Czas trwania to główna zmiana. Wan 3.0 generuje 30 sekund w jednym przebiegu z automatyczną rekomendacją „inteligentnego czasu trwania”. Wan 2.7 ma limit 15 sekund dla tekstu na wideo i obrazu na wideo oraz 10 sekund dla referencji na wideo i edycji wideo.
  • Referencje skaczą z garstki do tłumu. Wan 2.7 akceptuje do 5 elementów referencyjnych. Wan 3.0 akceptuje do 20, a po raz pierwszy przyjmuje jako dane wejściowe do generacji pliki doc, xls, ppt, pdf i md, a także strony internetowe.
  • Nie ma 4K. Własny cennik API Alibaby ma dokładnie trzy poziomy: 480P, 720P i 1080P. W Atlas Cloud Wan 2.7 oferuje wyższy sufit dzięki opcjom superrozdzielczości 1080P-SR i 1440P-SR.
  • Wagi nie są otwarte. Organizacja Wan-AI na Hugging Face wciąż kończy się na Wan 2.2. Nie ma repozytorium 3.0, 2.7 ani 2.5.
  • Wan 3.0 jest dostępny tylko w wersji beta i tylko u producenta. Działa na Alibaba Cloud Bailian, stronie Wanxiang, desktopowej aplikacji Qianwen i kilku pokrewnych produktach. Jeśli potrzebujesz API, które możesz wywołać w produkcji w tym tygodniu, Wan 2.7 jest wciąż generacją, która odpowiada.
  • Chcesz zobaczyć format, zanim nauczysz się gramatyki promptów? Atlas Cloud ma darmowy generator skeczy reklamowych AI, który zamienia jeden opis produktu w 15-sekundową komediową reklamę z dwiema postaciami i mówionym dialogiem. Jedno darmowe wygenerowanie, bez znaku wodnego.

Pełna, 30-sekundowa sekwencja kaiju, wygenerowana przez Alibabę na Wan 3.0 podczas publicznej bety i opublikowana w oficjalnym podręczniku twórcy Wan 3.0. Nie wygenerowaliśmy tego klipu. Włącz dźwięk: ścieżka dźwiękowa jest częścią wyniku, a nie dodanym później podkładem muzycznym. Plik w dostarczonej postaci: 1920x1072, 24 kl./s, 30,07 s, stereo AAC 44,1 kHz.

Oto pierwsza rzecz, której brakuje w arkuszach specyfikacji. Ten plik ma rozdzielczość 1920x1072, a nie 1920x1080. Każde demo „1080p” w oficjalnym podręczniku ląduje na wysokości 1072 pikseli, a kilka innych opublikowanych dem ma zwykłe 1280x720. Dwanaście z dziewiętnastu klipów w podręczniku trwa od 30,05 do 30,07 sekundy, co mówi, że limit 30 sekund to rzeczywiste twarde ograniczenie, a nie marketingowa zaokrąglona liczba.

Dlaczego pytanie Wan 3.0 vs Wan 2.7 jest trudniejsze, niż się wydaje

Szczera odpowiedź brzmi: prawie nikt nie uruchomił obu modeli na tym samym prompcie, ponieważ prawie nikt nie może. Wan 3.0 został udostępniony w publicznej becie 6 sierpnia 2026 roku i działa na własnych powierzchniach Alibaby (QbitAI, sierpień 2026). Zewnętrzne platformy inferencyjne go nie przejęły. Więc istniejące treści porównawcze opierają się na arkuszach specyfikacji, a arkusze były kopiowane na boki, aż błędy skostniały.

Trzy „fakty” o Wan 3.0 vs Wan 2.7, które są po prostu błędne

„Wan 3.0 działa w natywnym 4K.” Nie. Opublikowany cennik API ma poziomy 480P, 720P i 1080P w cenach ¥0,3, ¥0,6 i ¥1,2 za sekundę. Trzy poziomy, żadnego czwartego. Tymczasem Atlas Cloud udostępnia 1080P-SR i 1440P-SR na Wan 2.7, więc na czystym suficie pikseli starsza generacja obecnie wygrywa.

„Wagi Wan 3.0 są otwarte.” Nie są. Przejdź na Hugging Face, a najnowszą opublikowaną rodziną organizacji Wan-AI jest Wan 2.2, w tym warianty Animate i S2V. Główna linia wideo nie wypuściła wag od czasu 2.2. Jeśli chcesz czegoś do lokalnego grafu ComfyUI, 2.1 i 2.2 to twoje opcje i to się nie zmieniło.

„Gramatyka promptów przenosi się wprost.” To jest w połowie prawdą w sposób, który cię spali. Słowa się przenoszą. Struktura nie. Oficjalne prompty Wan 3.0 to z znacznikami czasu skrypty wieloujęciowe: prompt kaiju to dziesięć ponumerowanych ujęć, prompt billboardu to cztery oznaczone fragmenty z wyraźnymi przedziałami sekund. Wklejenie dziesięcioujęciowego skryptu do modelu 15-sekundowego nie spowoduje eleganckiego wybrania sześciu ujęć. Spowoduje kompresję.

Dlaczego nie możesz po prostu wymieniać promptów między Wan 3.0 a Wan 2.7

Pod tym kryje się druga pułapka i to jest powód, dla którego „po prostu sklej dwa klipy” cię nie uratuje.

Wan 2.7 ma tryb kontynuacji wideo. Wygląda jak ścieżka do 30 sekund. Nie jest. Źródłowy klip, który mu podajesz, musi mieć od 2 do 10 sekund, więc 15-sekundowa generacja nie może być ziarnem. Wynik ponownie koduje źródło, co obcina ogon podanego klipu. A łączenie kontynuacji ma tendencję do dryfowania z powrotem w kierunku początkowego uderzenia, zamiast przesuwać historię do przodu. Piętnaście sekund to twardy sufit dla jednego ciągłego pliku Wan 2.7. Wszystko dłuższe to edycja, a nie generacja.

To jest prawdziwy koszt migracji między tymi dwiema generacjami i żadna tabela porównawcza ci go nie pokaże.

Arkusz specyfikacji Wan 3.0 vs Wan 2.7 i gdzie go faktycznie uruchomić

Aby to przetestować, potrzebujesz miejsca, które uruchamia tekst na wideo, referencję na wideo i edycję wideo na tym samym koncie, z rozliczeniem za sekundę, aby nieudane ujęcie kosztowało cię sekundy, a nie subskrypcję. Wszystko po stronie Wan 2.7 w tym artykule działa na Atlas Cloud, który hostuje cztery punkty końcowe Wan 2.7 i model obrazu użyty do testu referencji. Wan 3.0 nie jest jeszcze dostępny w Atlas Cloud ani na żadnej innej platformie zewnętrznej, co jest dokładnie powodem, dla którego materiał o Wan 3.0 w tym artykule pochodzi z własnych publikacji beta Alibaby.

Tabela 1: Wan 3.0 vs Wan 2.7, generacja do generacji

Wan 3.0 (publiczna beta)Wan 2.7 (produkcja)
Maks. czas trwania, jeden przebieg30 s, z inteligentnym czasem trwania15 s (t2v, i2v), 10 s (r2v, edycja wideo)
Liczba elementów referencyjnychDo 20Do 5 (1 obraz na temat, do 3 filmów)
Tryby wejścioweTekst, obraz, wideo, audio, doc/xls/ppt/pdf/md, strony internetoweTekst, obraz, wideo, audio
Wejście dokumentuPojedynczy plik lub link, do 100 MB i 50 stronNieobsługiwane
Poziomy rozdzielczości480P / 720P / 1080P720P / 1080P / 1080P-SR / 1440P-SR
Natywne audioTakTak
Edycja wideoEdycja na podstawie instrukcji i referencjiDedicated video-edit endpoint
Otwarte wagiNieNie
Gdzie można uruchomićTylko własne powierzchnie AlibabyAPI stron trzecich, w tym Atlas Cloud
Podana cena¥0,3 / ¥0,6 / ¥1,2 za sekundę według poziomu0,10 $ za sekundę, poziom 720P

Tabela 2: punkty końcowe Wan 2.7 użyte w tym artykule

EndpointMaks. czas trwaniaRozdzielczościLimit referencjiPodana cena
Tekst na wideo2-15 s720P, 1080P, 1080P-SR, 1440P-SRn/d0,10 $/s
Referencja na wideo2-10 s720P, 1080P, 1080P-SR, 1440P-SR5 elementów0,10 $/s
Obraz na wideo2-15 s720P, 1080P, 1080P-SR, 1440P-SRklip źródłowy 2-10 s0,10 $/s
Edycja wideo2-10 s wyj., 2-10 s wej.720P (1,0x), 1080P (1,5x)3 obrazy0,10 $/s

Jeden szczegół cenowy, który warto zapamiętać przed uruchomieniem czegokolwiek: nagłówek „0,10 $ za sekundę” to poziom bazowy 720P. Strona edycji wideo dokumentuje mnożnik 1,5x dla 1080P bezpośrednio, a przycisk Uruchom podaje rzeczywistą liczbę dla wybranego poziomu. Czytaj przycisk, a nie nagłówek.

Wykonaj samodzielnie test Wan 3.0 vs Wan 2.7

Cztery kroki. Dwa z nich wykorzystują opublikowany materiał Alibaby jako stały punkt odniesienia, dwa to własne uruchomienia. Nic tutaj nie wymaga dostępu do bety Wan 3.0.

Krok 1: Pobierz klip Wan 3.0 i jego oryginalny prompt

Strona Wan 3.0 w tym teście nie jest czymś, co generujesz. To coś, co czytasz. Pełny prompt kaiju jest opublikowany w oficjalnym podręczniku twórcy Wan 3.0, wraz z gotowym klipem, w przykładzie „灾难电影”. Jest to chiński scenariusz z dziesięcioma ponumerowanymi ujęciami i osobnym akapitem opisującym ścieżkę dźwiękową.

Przeczytaj go raz, zanim zrobisz cokolwiek innego. Struktura jest lekcją: dziesięć ujęć, każde z własną kamerą, tematem i notatką o oświetleniu, kończące się krótkim opisem muzyki. Tak wygląda prompt do 30-sekundowej generacji w jednym przebiegu.

Krok 2: Uruchom ten sam prompt przez Wan 2.7 tekst na wideo

Otwórz playground Wan 2.7 tekst na wideo i wklej angielskie tłumaczenie tego samego skryptu. Na razie go nie skracaj. Chcesz zobaczyć, co model robi, gdy intencja przekracza sufit.

Plain
1A 30-second, photoreal cinematic sequence: a deep-sea kaiju emerges at night in a raging storm. Open on a small, battered fishing trawler with the white letters "WAN" on its hull, fighting through enormous waves under torrential rain; lightning briefly lights the whole ocean. Push to a mid-close shot on the deck: waves smash over the bow, ropes, nets and metal railings whip in the wind, rain streaks the lens. Then the sea ahead swells unnaturally, an enormous vortex forms, and a vast dark shape passes beneath the boat, lifting it. A crewman in a soaked rain jacket grips the rail, terrified, and turns toward the water. Finally the surface explodes upward and a colossal Pacific-Rim-style sea monster breaches: wet, scarred, ridged skin, huge jaws, tens of meters of spray. Close on its head roaring in the lightning. The trawler is nearly swallowed. End on a wide shot: the kaiju towering over the churning sea, the boat tiny in the foreground, one final lightning strike. Hollywood disaster-movie scoring: low sub-bass rumble and sparse strings building to brass and heavy percussion at the breach, ending on an oppressive sustained low chord. Photoreal scale, volumetric water, high-contrast storm lighting.

Ustawienia: Rozdzielczość 1080P, Czas trwania 15 s (maksymalny), Proporcje 16:9, audio włączone, aby model sam je skomponował. Pole referencyjne audio pozostaw puste.

Interfejs generatora wideo AI z ponumerowanymi krokami i wygenerowanym wideo

Playground Wan 2.7 tekst na wideo w Atlas Cloud z załadowanym promptem kaiju i gotowym 15-sekundowym klipem w panelu WYJŚCIE

Playground Wan 2.7 tekst na wideo w Atlas Cloud, prompt wklejony, wybrano 1080P i 16:9. Przycisk Uruchom podaje 0,75 $ za ten krótki test, co daje 0,15 $ za sekundę: mnożnik 1,5x dla 1080P w pełni widoczny, na stronie modelu, której nagłówek wynosi 0,10 $.

Następnie uruchom go drugi raz z dołączoną jedną linią do promptu:

Plain
1Single continuous take, no cuts. Prioritize the breach moment; compress the setup.

Ta pojedyncza linia to migracja w miniaturze. 30-sekundowy skrypt musi zostać napisany na nowo jako 15-sekundowa intencja, a to ty decydujesz, które siedem ujęć zginie.

Po lewej: oficjalny wynik Wan 3.0, 30 sekund. Po prawej: Wan 2.7 w Atlas Cloud uruchomiony na tym samym prompcie, zatrzymujący się na 15-sekundowym limicie.

Krok 3: Zbuduj obrazy referencyjne do testu identyczności Wan 3.0 vs Wan 2.7

Czas trwania to głośna aktualizacja. Spójność na poziomie pikseli to ta, która faktycznie zmienia pracę produkcyjną, i możesz ją przetestować z dwoma kotami.

Podręcznik Alibaby zawiera pastisz Wesa Andersona, w którym ten sam kot ragdoll i ten sam czarny kot muszą przetrwać pięć zupełnie różnych środowisk: symetryczny korytarz hotelowy, widok z boku w przekroju, bęben pralki, taśmę bagażową na lotnisku i czerwoną budkę telefoniczną. Oba koty są oznaczone tagami referencyjnymi @Image1 i @Image2.

Najpierw wygeneruj własne dwie referencje. Użyj GPT Image 2 z ustawioną jakością na wysoką i ramką 16:9, i uruchom go dwukrotnie.

Plain
1A studio portrait of a fluffy ragdoll cat with blue eyes and a dark mask, sitting upright facing the camera, evenly lit against a plain pale pink background, sharp fur detail, full body visible, clean reference-sheet framing.
Plain
1A studio portrait of a small sleek black cat with bright amber eyes, standing in profile facing right, evenly lit against a plain pale pink background, sharp fur detail, full body visible, clean reference-sheet framing.

Interfejs generatora obrazów AI pokazujący ustawienia wejściowe i wygenerowanego kota

Playground GPT Image 2 w Atlas Cloud z ustawioną jakością na wysoką i wyrenderowanym w panelu WYJŚCIE obrazem referencyjnym kota ragdoll

GPT Image 2 z jakością wysoką, 16:9. Uruchom drugi prompt w ten sam sposób, aby uzyskać czarnego kota.

Krok 4: Wykonaj test identyczności na punkcie końcowym Wan 2.7 referencja na wideo

Prześlij oba koty do punktu końcowego Wan 2.7 referencja na wideo. Rozdzielczość 1080P, proporcje 16:9, czas trwania 10 sekund, co jest maksimum dla tego punktu końcowego. Poniższy prompt to lista ujęć z podręcznika skompresowana z pięciu fragmentów do trzech, ponieważ dziesięć sekund nie pomieści pięciu.

Plain
1Wes Anderson style, perfectly symmetrical, flat frontal compositions, pastel palette. Reference image 1 is the ragdoll cat, reference image 2 is the black cat; keep both cats identical in every shot. Shot 1: an endless symmetrical hotel corridor, the ragdoll cat running straight toward the camera with a solemn expression, the black cat sprinting away in the background with its head twisted back 180 degrees. Shot 2: a cutaway side view of the corridor, pink patterned wallpaper and gold picture frames, the ragdoll walking left to right and the black cat crossing right to left. Shot 3: frontal macro on a mint-green vintage washing machine door, both cats floating stiffly inside the drum among suds, eyes blank, rainbow-ordered detergent bottles lined up behind. Rigid horizontals and verticals, no camera tilt, deadpan absurd humor.

Interfejs generatora wideo AI z promptem tekstowym i wygenerowanym wideo z kotami

Playground Wan 2.7 referencja na wideo w Atlas Cloud z załadowanymi obiema referencjami kotów i gotowym klipem w panelu WYJŚCIE

Playground Wan 2.7 referencja na wideo: oba koty załadowane do slotów referencyjnych obrazu, rozdzielczość ustawiona na 1080P, a przycisk Uruchom podaje koszt przed rozpoczęciem. Dwie referencje to już znacząca część tego, co ten punkt końcowy akceptuje. Wan 3.0 przyjmuje 20 elementów referencyjnych.

Teraz umieść je obok siebie.

Puszysty kot stojący wyprostowany obok czarnego kota w wielkim korytarzu

Oficjalny klip z blokadą identyczności Wan 3.0: ten sam ragdoll i czarny kot utrzymane spójnie w korytarzu hotelowym, ścianie przekroju, bębnie pralki, taśmie bagażowej i czerwonej budce telefonicznej

Wygenerowane przez Alibabę na Wan 3.0 podczas publicznej bety i opublikowane w oficjalnym podręczniku twórcy. Pięć środowisk, 19,9 sekundy, oba koty przypięte tagiem referencyjnym. Pokazane jako cichy GIF; dostarczony plik zawiera audio stereo 44,1 kHz.

Dwa koty idące długim różowym korytarzem

Wynik Wan 2.7 referencja na wideo na to samo zlecenie, trzy ujęcia w 10-sekundowym limicie

Wan 2.7 referencja na wideo w Atlas Cloud, te same dwie referencje, pokazane jako cichy GIF. To jest domyślne 5-sekundowe ujęcie punktu końcowego, a nie pełne 10: warto wiedzieć, że kontrola czasu trwania nie zawsze realizuje to, co ustawisz, więc przeczytaj wycenę przycisku Uruchom przed naciśnięciem. Zwróć uwagę na oznaczenia kotów i maskę ragdolla; to jest wymiar, którego dotyczy twierdzenie o „spójności na poziomie pikseli”.

Cztery kolejne prompty Wan 3.0 vs Wan 2.7 warte ponownego uruchomienia

Klip kaiju obciąża czas trwania i fizykę. Te trzy obciążają różne rzeczy, a każdy zderza się z innym limitem Wan 2.7. Wszystkie trzy to oficjalne wyniki beta Alibaby z oficjalnego podręcznika.

Wan 3.0, oficjalny wynik beta: pojedyncze 30-sekundowe odsunięcie w dół fluorescencyjnie oświetlonego korytarza szpitalnego, bladozielona monochromatyczna kolorystyka, z aktorką krzyczącą o pomoc. Włącz dźwięk. Występ, kroki i szum sprzętu są generowane przez model.

Tabela 3: czego wymaga każdy prompt i gdzie Wan 2.7 go ogranicza

PromptCzego wymaga skryptOpublikowany limit Wan 2.7Testowany wymiar
Wynurzenie kaiju10 ponumerowanych ujęć w ciągu 30 s plus krótki opis muzykiMaks. 15 s w tekście na wideoCzas trwania i narracja wieloujęciowa
Korytarz szpitalnyJedno 30-sekundowe ciągłe ujęcie z mówionym dialogiemMaks. 15 s, dostępne natywne audioWystęp i dialog w długich ujęciach
Kowbojka na stacji benzynowej30-sekundowy łuk komediowy w czterech aktach z timed actsMaks. 15 s, więc dwa akty muszą odejśćKomediowy timing wymagający czasu trwania
Billbord w jednym ujęciuCztery fragmenty z wyraźnymi przedziałami sekund, bez cięćMaks. 15 s, więc przedziały wymagają przepisaniaFizyka kamery podczas długiego ruchu
Dwa koty, pięć pokoi2 oznaczone tematy utrzymane w 5 środowiskachMaks. 10 s, 5 slotów referencyjnychSpójność identyczności

Darmowa 15-sekundowa wersja tego samego pomysłu

Spójrz jeszcze raz na klip ze stacji benzynowej. Ten format, krótki skecz komediowy z dwiema postaciami, zwrotem akcji i puentą, to miejsce, w którym dodatkowy czas trwania Wan 3.0 zwraca się najhojniej. Jest to również format, który najprawdopodobniej coś sprzeda.

Haczyk tkwi w prompcie. Komediowe przykłady z podręcznika mają 800 słów z wyraźnymi znacznikami czasu i blokowaniem. To prawdziwa umiejętność, która wymaga weekendu, aby się jej nauczyć.

Jeśli chcesz tylko dowiedzieć się, czy format działa dla twojego produktu, zanim zainwestujesz ten weekend, Atlas Cloud ma darmowe narzędzie, które całkowicie pomija inżynierię promptów. Opisujesz produkt, opcjonalnie przesyłasz do czterech zdjęć produktu po 8 MB każde, wybierasz jeden z sześciu tonów (zabawny mem, zwrot akcji, sitcom, wzruszający, luksusowy lub twarda sprzedaż), a narzędzie pisze dwuosobowy scenariusz, dobiera głosy, generuje dialog i efekty dźwiękowe i zwraca gotową 15-sekundową reklamę jako jedną ciągłą scenę. Pobieranie jest czyste, bez znaku wodnego. Musisz być zalogowany i otrzymujesz jedną darmową generację, zanim doładujesz kredyty.

Diagram przedstawiający transformację tekstu wejściowego w reklamę wideo AI

Jedna linia tekstu produktu na wejściu, gotowa 15-sekundowa reklama komediowa na wyjściu: darmowy generator skeczy reklamowych AI Atlas Cloud

Darmowy generator skeczy reklamowych AI: jeden opis produktu na wejściu, jedna 15-sekundowa reklama z dwiema postaciami na wyjściu.

Podekscytowany młody mężczyzna zaglądający do czarnego plecaka w parku

Prawdziwy wynik z darmowego generatora. Włącz dźwięk: scenariusz, dwa głosy i efekty dźwiękowe pochodzą z jednego uruchomienia.

Ile kosztuje porównanie Wan 3.0 vs Wan 2.7

Za sekundę, dwie generacje są w podobnym przedziale cenowym na poziomie 720P. Różnica w kosztach ma charakter strukturalny: klip, który kiedyś trwał 15 sekund, teraz ma 30, więc gotowy kawałek mniej więcej się podwaja.

Tabela 4: ta sama sekwencja kaiju, na cztery sposoby

UruchomienieStawkaRazem
Wan 3.0, 30 s przy 720P¥0,6 / s¥18, około 2,50 $
Wan 3.0, 30 s przy 1080P¥1,2 / s¥36, około 5,00 $
Wan 2.7, 15 s przy 720P0,10 $ / s1,50 $
Wan 2.7, 15 s przy 1080P0,10 $ / s z mnożnikiem poziomu 1,5x2,25 $
Wan 2.7, 15 s przy 1440P-SRwycena na żywo w przycisku Uruchomwycena na żywo
Darmowy skecz reklamowy AI, 15 sdarmowy, 1 generacja na konto0,00 $

Dwa zastrzeżenia. Ceny wersji beta nie są cenami ogólnej dostępności, a Alibaba powiedziała, że API wkrótce zostanie szerzej otwarte, więc traktuj kwoty ¥ jako migawkę publicznej bety, a nie ostateczną stawkę. A po stronie Atlas Cloud zawsze czytaj wycenę na żywo na przycisku Uruchom przed zatwierdzeniem, ponieważ mnożnik rozdzielczości jest stosowany tam, a nie w cenie nagłówkowej.

Alibaba był również niezwykle bezpośredni w kwestii tego, gdzie Wan 3.0 wciąż jest słaby, mówiąc, że model „wciąż ma pole do poprawy w zakresie jakości dźwięku i dokładności tekstu”. To pasuje do tego, co pokazują pliki: audio w oficjalnych demach jest stereo 44,1 kHz, ale zakodowane przy skromnym 32 kb/s, co jest w porządku do podglądu, ale cienkie do mastera.

Licencjonowanie Wan 3.0 vs Wan 2.7: co możesz faktycznie dostarczyć

Krótka wersja i proszę zweryfikuj ją samodzielnie z aktualnymi warunkami, zanim cokolwiek pokażesz klientowi.

Wan 3.0 jest w publicznej becie, a jego warunki komercyjne nie są ustalone. Ponieważ wagi nie zostały wydane, nie ma w ogóle ścieżki samodzielnego hostingu; wszystko, co stworzysz, przechodzi przez API Alibaby lub jej powierzchnie konsumenckie i jesteś związany tym, co te warunki mówią w dniu generowania. Wan 2.7 to ta sama historia z wagami, ale jest w produkcji wystarczająco długo, aby warunki API platformy były stabilne. Jeśli uruchamiasz go przez platformę zewnętrzną, twoje prawa komercyjne wynikają z warunków korzystania z tej platformy, więc przeczytaj te, które faktycznie dotyczą twojego konta. Żaden z tych akapitów nie jest poradą prawną.

FAQ Wan 3.0 vs Wan 2.7

Czy Wan 3.0 jest open source? Czy mogę go uruchomić w ComfyUI?

Nie. Od sierpnia 2026 r. nie ma repozytorium Wan 3.0 w organizacji Wan-AI na Hugging Face ani w GitHub Wan-Video. Najnowsza rodzina Wan z wydanymi wagami to Wan 2.2, w tym warianty Animate i S2V. Do lokalnego grafu ComfyUI nadal jesteś na 2.1 lub 2.2. Wan 3.0 jest dostępny tylko przez API i stronę internetową.

Rozdzielczość Wan 3.0 vs Wan 2.7: czy Wan 3.0 naprawdę generuje 4K?

Nie. Opublikowany cennik API ma trzy poziomy rozdzielczości: 480P, 720P i 1080P. Kilka szeroko udostępnianych postów porównawczych twierdzi, że natywne 4K i są w błędzie. Na surowym suficie wyjściowym Wan 2.7 w Atlas Cloud faktycznie idzie wyżej dzięki opcjom superrozdzielczości 1080P-SR i 1440P-SR.

Czy mogę uzyskać 30 sekund z Wan 2.7 przez rozszerzanie klipów?

Nie jako jeden ciągły plik. Tryb kontynuacji wymaga klipu źródłowego o długości 2 do 10 sekund, więc pełna 15-sekundowa generacja nie może być ziarnem. Wynik ponownie koduje i przycina ogon tego, co podajesz, a łańcuchowe kontynuacje mają tendencję do zapętlania się z powrotem w kierunku początkowego uderzenia. Po 15 sekundach edytujesz, a nie generujesz.

Wan 3.0 vs Wan 2.7: gdzie mogę faktycznie uruchomić każdy z nich dzisiaj?

Wan 3.0 jest w publicznej becie na własnych powierzchniach Alibaby: Alibaba Cloud Bailian, Wanjing Yike, strona Wanxiang, klient desktopowy Qianwen, IF STUDIO i Duiyou, z dostępem w skali szarości w aplikacji Qianwen. Żadna zewnętrzna platforma inferencyjna go jeszcze nie hostuje. Wan 2.7 to generacja, którą wciąż możesz wywoływać bezpośrednio, przez punkty końcowe tekst na wideo, obraz na wideo, referencja na wideo i edycja wideo.

Ceny Wan 3.0 vs Wan 2.7: który kosztuje więcej za gotowy klip?

Za sekundę na poziomie 720P są blisko. Za gotowy klip spodziewaj się mniej więcej podwójnej ceny, ponieważ naturalna długość wyjściowa wzrosła z 15 do 30 sekund. Zaplanuj budżet na zmianę czasu trwania, a nie na zmianę stawki, i pamiętaj, że ceny wersji beta mogą nie przetrwać ogólnej dostępności.

Czy muszę przepisać moje prompty Wan 2.7 dla Wan 3.0?

Tak, a przepisanie ma charakter strukturalny, a nie leksykalny. Prompty Wan 2.7 opisują jedno ciągłe ujęcie w bogatych szczegółach. Prompty Wan 3.0 to listy ujęć z znacznikami czasu, czasami z osobnym akapitem opisującym muzykę, a model może również odczytać plik PDF lub prezentację jako dane wejściowe. Zasada kciuka: dla Wan 2.7 napisz jeden akapit o jednym ujęciu; dla Wan 3.0 napisz ponumerowany podział scen z przedziałami sekund.

Najnowsze modele

Jedno API do całej multimedialnej AI.

Przeglądaj wszystkie modele