Seedance 2.0 Mini & Fast API till världens lägsta priser — upp till 68 % rabatt på det officiella priset

Wan 3.0 Preview är live: Ingen 4K, inga öppna vikter, och 15-sekundersväggen jag stötte på när jag försökte fejka det

Wan 3.0 Preview gick in i offentlig beta den 6 augusti 2026. Varje specifikation kontrollerad mot Alibabas egna dokument, plus den 15-sekunders vägg jag stötte på när jag försökte fejka dess one-take.

En videoredigerare vid en kontrollkonsol med flera skärmar

Senaste uppdatering: Wan 3.0 är live från och med 24 augusti 2026.

En färggraderingssvit med vägg som visar samma regniga takvy vid tidskoder från 00:00 till 00:30

30 sekunder av en enda kontinuerlig tagning, utlagd på en tidslinje. Att komma dit är hela historien.

Dagen då Wan 3.0 Preview gick i offentlig beta letade jag efter dess specifikationsblad. Första sidan med resultat berättade att den gör native 4K, att den släpps under Apache 2.0 och att den har ett "sexkamera AI-direktörsläge". Sex olika sajter, samma påståenden, och inte en enda länkade till en primärkälla.

Så jag öppnade Alibabas egen modellsida. 480P, 720P, 1080P. Ingen 4K. Sedan slog jag direkt mot Hugging Face API och drog in alla repositories under Wan-AI-organisationen. Den nyaste är Wan2.2-Animate-2, publicerad samma dag som Wan 3.0 lanserades. Det finns inget 3.0 alls.

Sedan gjorde jag det som ingen annan gör. Wan 3.0s rubrik är 30 sekunder kontinuerlig video i en enda passning, och jag har inte tillgång till det, så jag försökte återskapa det resultatet med modellerna jag faktiskt kan anropa idag. Jag misslyckades. Sättet jag misslyckades på visade sig vara det mest användbara i den här artikeln.

Viktiga slutsatser

  • Wan 3.0 Preview gick i offentlig beta den 6 augusti 2026. Modell-ID wan3.0-video, bakom en ansökan på Alibaba Cloud Model Studio och Qwen Cloud. Det är inte öppen registrering.
  • De verkliga specifikationerna: upp till 30 sekunder i en enda passning, 480P/720P/1080P, till $0,05/$0,10/$0,20 per utmatad sekund.
  • Det finns ingen 4K och inga öppna vikter. Jag frågade Hugging Face API för varje repo under Wan-AI. Inget över Wan 2.2 finns som nedladdning.
  • Rate limits är den verkliga flaskhalsen: 2 samtidiga förfrågningar, 30 RPM, 50 köade asynkrona uppgifter.
  • Du kan inte fejka 30-sekunders en-tagning med Wan 2.7. Tre odokumenterade gränsar begränsar den längsta verkligt kontinuerliga klippet till 15 sekunder, och att kedja en andra fortsättning får modellen att loopa bakåt istället för framåt.

15-sekundersväggen: Vad Wan 3.0 Preview verkligen säljer

Här är det bästa resultatet jag kunde få. 15 oavbrutna sekunder i 1080P: en push in på en neonskylt, en försäljare som stänger ett takkaffé i regnet, sedan en kran ner till den våta gatan och en taxi. En kontinuerlig genererad fil, ingen redigering, genererat ljud.

Glödande rosa och blå neonskylt med kinesiska tecken och SHENZHEN

15 sekunder kontinuerlig Wan 2.7-video: neonskylt, takförsäljare, kran ner till en regnig gata och en taxi

Det längsta verkligt kontinuerliga klippet som Wan 2.7-familjen producerade för mig: 15 sekunder, 1080P, en fil. Visas här som en tyst GIF; den levererade filen har 44,1 kHz stereoljud.

Det är bra. Det är också exakt hälften av vad Wan 3.0 påstår sig göra i ett anrop, och 15 sekunder är där taket är svetsat. Allt nedanför är hur jag hittade svetsfogen.

Varför varje Wan 3.0 Preview-specifikationsblad du läser förmodligen är fel

Två saker gör denna lansering ovanligt brusig. För det första är 30 sekunder i en enda generationspassning en genuin första för familjen. Wan2.7-Video toppar på 15 sekunder och de flesta mainstream-videomodeller ligger mellan 5 och 15 (TNGlobal, augusti 2026). För det andra tar Wan 3.0 emot referensinmatningar som ingen annan gör: vid sidan av text, bild, ljud och video accepterar den doc, xls, ppt, pdf och md-filer plus webbsidor, så en bildspelspresentation blir en video (AlphaSignal, augusti 2026).

Den kombinationen producerade en enorm mängd täckning från sajter som aldrig öppnade dokumentationen. Här är varje allmänt spridd påstående, kontrollerad mot primärkällan.

Tabell A: Wan 3.0 Preview-specifikationskontroll

Cirkulerande påståendeVad primärkällan sägerDom
30 sekunder i en generationspassningBekräftad, jämfört med 2 till 15 s i Wan 2.7✅ Verklig
Native 4K-utmatningOfficiella upplösningar är endast 480P, 720P och 1080P❌ Falsk
Apache 2.0 öppna vikterInget Wan 3.0-repo finns under Wan-AI på Hugging Face❌ Falsk
Dokument-till-video (PDF, PPT, XLS)Bekräftad som en referensinmatningstyp✅ Verklig
"Sexkamera AI-direktörsläge"Förekommer inte i Alibabas dokumentation❌ Stöds inte
"12-språkig läppsynk med identitetslås"Förekommer inte i Alibabas dokumentation❌ Stöds inte
$0,05 / $0,10 / $0,20 per sekundBekräftad för 480P / 720P / 1080P✅ Verklig
Öppet för allaAnsökningsgräns på Model Studio och Qwen Cloud⚠️ Beta, inbjudan krävs

Priserna och rate limits kommer direkt från modellsidan: 2 samtidiga förfrågningar, 30 förfrågningar per minut och en 50-uppgifts asynkron kö (QwenCloud, augusti 2026). Det samtidighetsnumret får nästan ingen täckning och det är den viktigaste raden på sidan. Två parallella jobb, var och en tar minuter, är okej för en lanseringsdemo. Det är inte en pipeline.

Nu frågan som open source-gemenskapen faktiskt bryr sig om. Wan 2.1 och Wan 2.2 levererade nedladdningsbara checkpoints. Wan 2.5 lovade vikter som aldrig kom, Wan 2.6 var helt stängd, och Wan 2.7 förblev endast API. Jag kollade om 3.0 bryter mönstret genom att fråga Hugging Face API för varje modell under Wan-AI-organisationen, sorterad efter skapelsedatum. De tre nyaste repositories är alla Wan2.2-Animate-2-varianter skapade den 6 augusti 2026, samma dag som Wan 3.0 lanserades. Det mest nedladdade repot är fortfarande Wan2.2-TI2V-5B-Diffusers med cirka 179 000 nedladdningar de senaste 30 dagarna (Hugging Face, augusti 2026).

Så svaret är nej, och Wan 2.2 förblir open weight-taket. Om din plan involverade att köra detta lokalt eller finjustera det, finns det inget att köra.

Prova livemodellen på Atlas Cloud: öppna Wan 3.0 Text-to-Video på Atlas Cloud.

Skärmdump av en text-till-video-generator som visar en guldfiskvideo

En verklig Atlas Cloud Wan 3.0 Text-to-Video-lekplatskörning: prompten visas till vänster, och det färdiga genererade klippet visas till höger.

Wan 3.0 Preview-stacken: Vad du faktiskt kan köra idag

Situationen delar sig rent. Wan 3.0 ligger bakom en ansökningsblankett med ett tak på två jobb samtidigt. Allt före det, Wan 2.7 tillbaka till 2.2, är anropsbart omedelbart på en API-nyckel, tillsammans med Seedance och Kling för jämförelse mellan modeller. Allt i den här artikeln kördes på det sättet, i en webbläsarflik.

Priserna nedan kommer från Atlas Cloud-modellkatalogen den 10 augusti 2026, inte från något blogginlägg.

Tabell B: Wan 3.0 Preview jämfört med vad som finns på hyllan

ModellLängsta enkla passningUpplösningarÅtkomstSamtidighetAngivet pris per sekund
Wan 3.0 Preview30s480P / 720P / 1080PAnsökan krävs2$0,05 / $0,10 / $0,20
Wan 2.7 text-to-video15s720P / 1080P / 1080P-SR / 1440P-SRÖppenStandardfrån $0,10
Wan 2.7 image-to-video15s720P / 1080PÖppenStandardfrån $0,10
Wan 2.6 text-to-video15s720p / 1080pÖppenStandard$0,07 (30% rabatt på $0,10)
Wan 2.5 text-to-video10s720p / 1080pÖppenStandard$0,035 (30% rabatt på $0,05)
Wan 2.2 image-to-video10s480p / 720pÖppen, vikter nedladdningsbaraStandard$0,03
Seedance 2.5 text-to-video30s480p / 720pÖppenStandardfrån $0,134
Kling v3.0 Pro text-to-video15sModellstandardÖppenStandard$0,095 (15% rabatt på $0,112)

Rabatter är live från och med augusti 2026 och tidsbegränsade, så kontrollera modellsidan innan du budgeterar mot dem.

Två saker faller ut ur den tabellen. Wan 3.0s 30-sekunders enkla passning är inte längre unik: Seedance 2.5 accepterar redan en varaktighet på 4 till 30 sekunder i ett anrop, bara begränsad till 720p. Och Wan 2.7 är den enda raden som erbjuder 1440P-SR, en superupplösningsnivå som faktureras till 80% av native 1080P enligt dess eget schema, vilket Wan 3.0 inte har.

Vad Wan 3.0 har som inget annat har är 30 sekunder i 1080P i en passning, plus dokumentreferensinmatningar. Wan 3.0 har en platshållarsida på Atlas Cloud märkt Coming Soon, så den landar på samma nyckel när den levereras. Fram till dess är här exakt hur långt de äldre modellerna tar dig.

Wan 3.0 Preview Tutorial Steg 1: Skriv briefen för en-tagning

Briefen överförs mellan generationer, så skriv den en gång. Wan 3.0 belönar långa, tidskodade bildbeskrivningar, och Wan 2.7 accepterar samma struktur inom en 5 000-teckens promptgräns.

Mallen som fungerar: Bild [tidskod] + subjekthandling + kamerarörelse + ljus + omgivningsljud. Förklara att tagningen är kontinuerlig på första raden, och beskriv ljudbädden explicit, eftersom Wan 2.7 genererar ljud nativt och kommer att hitta på något ohjälpsamt om du lämnar det tomt.

Jag valde en regnig natt-takkaffé med flit. Det stresstestar fyra saker som vanligtvis går sönder samtidigt: ihållande kamerarörelse, ansiktskonsistens över tid, våta neonreflektioner och en kontinuerlig omgivningsljudbädd.

textCopy

text
11BEAT 1 (0-10s): Slow dolly-in from a flickering pink-and-cyan neon sign toward a
22young female vendor wiping down a steel counter on a rooftop coffee stall.
33BEAT 2 (10-15s): The camera cranes down over the rooftop edge to the wet street
44below, gliding toward a taxi idling at the curb.
55Constant: heavy rain, neon palette, 35mm anamorphic, film grain, no cuts.
66

Det är planen, inte prompten. Promptarna du klistrar in finns nedan.

Steg 2: Generera öppningen i 1080P

Öppna Wan 2.7 text-to-video-sidan och klistra in Beat 1, utskrivet i sin helhet.

textCopy

text
11Continuous single take, no cuts. A rainy night rooftop coffee stall in Shenzhen.
22Shot [0-4s]: Slow dolly-in from a flickering pink-and-cyan neon sign toward a
33young female vendor wiping down a steel counter, rain streaking through the neon
44glow, steam rising from a kettle.
55Shot [4-10s]: The camera settles at chest height as she looks up and half-smiles,
66shallow depth of field, wet reflections on the counter, raindrops visible against
77the dark sky behind her.
88Audio: steady rain, distant traffic hum, the clink of a ceramic cup.
99Cinematic, anamorphic, 35mm, high dynamic range, fine film grain.
1010

Inställningar: Upplösning 1080P, Bildförhållande 16:9, Varaktighet 10, Prompt extend AV.

Prompt extend är på som standard och den skriver om din prompt före generering, vilket tyst förstör tidskodad bildkontroll. Stäng av den när bildindelningen är poängen.

Ställ in varaktighet till 10 snarare än max 15 sekunder. Det är inte ett kostnadsbeslut, och anledningen blir synlig först i Steg 3.

Ett AI-videogeneratorsgränssnitt som visar en textprompt och färdig videoutmatning

Wan 2.7 text-to-video på Atlas Cloud, körning slutförd, 1080P-utmatning synlig i OUTPUT-panelen

Steg 2 i lekplatsen: prompt inklistrad, 1080P, 16:9, körning slutförd med resultatet till höger. Notera Run-knappens citat på $0,75 för ett femsekunders 1080P-jobb, vilket blir $0,15 per sekund snarare än katalogens "från $0,10".

Steg 3: Fortsätt det, och se var det går sönder

Wan 2.7s image-to-video-endpoint har ett videofortsättningsläge som tar ett befintligt klipp och fortsätter filma. Ta din Step 2-utdata-URL, lägg den i fältet video, ställ in Varaktighet till 15, och klistra in Beat 2:

textCopy

text
11Continue the same unbroken take with identical camera language and lighting.
22The crane-down continues past the rooftop edge to street level, the camera
33gliding forward through the rain toward a taxi idling at the curb, wipers
44sweeping. Keep the rain intensity, neon colour palette, film grain and ambient
55audio identical to the source clip. No cut, no fade, no scene change.
66

Det producerar 15-sekundersklippet högst upp i den här artikeln. Nu de tre gränserna jag träffade, varav ingen finns i dokumentationen.

En: källklippet måste vara 2 till 10 sekunder. Det är därför Steg 2 är begränsat till 10. Generera en 15-sekunders öppning och du kan inte förlänga den alls, eftersom en 15-sekundersfil inte är en giltig inmatning.

Två: den begärda varaktigheten måste överstiga källans varaktighet. Mata in ett 10-sekundersklipp och be om 10 sekunder och API:t avvisar det direkt: first_clip duration (10s after trim) must be less than the requested duration (10s). Så utmatningen innehåller källan, och det mesta du kan vinna i en passning är 5 sekunder.

Tre: det bevarar inte ditt källklipp. Detta är den som spelar roll. Nedan är den översta raden det ursprungliga 10-sekundersklippet vid 5s och 9,9s. Den nedersta raden är fortsättningsutmatningen vid samma två tidskoder.

Kvinna som torkar en bänk och en taxi som kör på en våt gata

Fyra bildrutor som jämför källklippet och fortsättningsutmatningen vid 5 sekunder och 9,9 sekunder

Övre raden: källklippet vid 5s och 9,9s. Nedre raden: fortsättningsutmatningen vid samma tidskoder. Vid 5s matchar de. Vid 9,9s är källan fortfarande på försäljaren medan fortsättningen redan har klippt till gatan, eftersom den komprimerade om källan till ungefär sina första sex sekunder och spenderade resten på nytt material.

Så fortsättning är inte sammanfogning. Den renderar om ditt klipp snabbare för att ge plats, och de sista sekunderna av din ursprungliga prestation är helt enkelt borta.

Vilket väcker den uppenbara idén: kedja det. Mata in 15-sekundersresultatet igen och be om ytterligare 15. Jag försökte. Här är vad som kom tillbaka.

En kvinna torkar en våt metallbänk på natten

En kedjad andra fortsättning som driver tillbaka till takförsäljaren istället för att föra scenen framåt

Andra fortsättningspassningen. Den spelar upp gatan och taxin igen, loopar sedan tillbaka till takförsäljaren från början av sekvensen istället för att gå framåt. Kedjning ackumuleras inte.

Det är väggen. Utmatningsgränsen är 15 sekunder, inmatningsgränsen är 10, och den andra länken i kedjan går bakåt. Femton sekunder av verkligt kontinuerligt material är taket för denna modellfamilj. Något längre är en klippning, inte en tagning, och klippningar är precis vad en 30-sekunders enkelt passning är till för att eliminera.

En avslöjande: lekplatsinspelningen för detta fortsättningssteg misslyckades tre gånger eftersom sidans förinställda referensbild fortsatte att kapa körningen, så Steg 3 utfördes via API:t snarare än lekplatsgränssnittet. Prompten, inställningarna och utmatningarna ovan är alla från den verkliga körningen.

Vad 30 sekunder av Wan 3.0 Preview faktiskt kostar

Run-knappen i Steg 2 citerade $0,75 för ett femsekunders 1080P-jobb. Det är $0,15 per sekund, inte $0,10 som katalogen listar, eftersom den listade siffran är ett golv och fakturering skalar med upplösning. Lita alltid på citatet framför kortet.

Till den verkliga taxan kostade mina 15 sekunder kontinuerligt material $1,50 för 10-sekundersöppningen plus $2,25 för fortsättningen, så $3,75 för 15 levererade sekunder.

Tabell C: Vad 30 sekunder kostar, fem sätt

VägBeräkningSummaVad du faktiskt får
Wan 3.0 Preview, 1080P$0,20 × 30$6,0030s kontinuerligt, en passning, inga sömmar
Wan 3.0 Preview, 720P$0,10 × 30$3,0030s kontinuerligt i 720P
Wan 3.0 Preview, 480P$0,05 × 30$1,5030s kontinuerligt i 480P
Wan 2.7, öppning plus fortsättning$0,15 × 25 fakturerade$3,75Endast 15s. Kan inte nå 30.
Seedance 2.5, 480pfrån $0,134 × 30~$4,0530s kontinuerligt, begränsat till 720p

Läs den fjärde raden igen. Att producera 15 kontinuerliga sekunder på Wan 2.7 kostade mer än Wan 3.0 tar för 30 kontinuerliga sekunder i 720P. Arbetsomvägen är inte det billiga alternativet, det är det dyra som inte heller fungerar.

En varning för Seedance-raden: dess listade taxa är 480p-golvet och modellen fakturerar per pixelarea, så 720p kostar i praktiken ungefär 2,25 gånger det numret.

När det gäller licensiering, var försiktig. Wan 3.0 är i beta, så kommersiella villkor kommer från Alibaba Cloud-tjänsteavtalet du accepterar vid ansökningstillfället snarare än någon modelllicens, och de kan ändras före allmän tillgänglighet. Utan publicerade vikter är lokal distribution och finjustering inte alternativ. Bekräfta attributions- och vattenmärkningskrav mot dina egna kontovillkor innan du levererar kundarbete.

Vanliga frågor

Är Wan 3.0 Preview tillgänglig för alla än?

Nej. Den gick i offentlig beta den 6 augusti 2026, men åtkomst är ansökningsgränsad via Alibaba Cloud Model Studio och Qwen Cloud. Godkända konton får 2 samtidiga förfrågningar, 30 RPM och en 50-uppgifts asynkron kö, vilket är dimensionerat för utvärdering snarare än produktion.

Är Wan 3.0 Preview open source, och var finns vikterna?

Det finns inga. Att fråga Hugging Face API för alla repositories under Wan-AI-organisationen returnerar inget över Wan 2.2. De tre nyaste repositories, alla Wan2.2-Animate-2-varianter, skapades samma dag som Wan 3.0 lanserades. Wan 2.2 förblir open weight-taket.

Gör Wan 3.0 Preview verkligen native 4K?

Nej. Den officiella dokumentationen listar 480P, 720P och 1080P. 4K-påståendet kommer från aggregatorsajter som citerar varandra snarare än primärkällan, och det motsäger Alibabas egen pristabell, som har exakt tre upplösningsnivåer.

Hur mycket kostar en 30-sekunders Wan 3.0 Preview-video?

I 1080P ger $0,20 per utmatad sekund $6,00 för 30 sekunder. I 720P är det $3,00 och i 480P är det $1,50. Som jämförelse kostade 15 kontinuerliga sekunder på Wan 2.7 i 1080P mig $3,75 till den verkliga fakturerade taxan.

Kan jag generera en 30-sekunders en-tagning idag utan Wan 3.0 Preview-åtkomst?

Inte med Wan 2.7. Dess fortsättningsläge begränsar utmatningen till 15 sekunder, accepterar endast källklipp på 10 sekunder eller mindre, och loopar bakåt när det kedjas. Seedance 2.5 gör 4 till 30 sekunder i en enda passning, men bara upp till 720p.

Wan 3.0 Preview jämfört med Wan 2.7: är det värt att vänta på?

Om du behöver en kontinuerlig tagning längre än 15 sekunder, eller dokument- och webbsidereferensinmatningar, ja, och det finns ingen arbetsomväg. För allt på 15 sekunder eller under är Wan 2.7 mer praktiskt just nu, eftersom ett tak på 2 samtidiga förfrågningar gör batcharbete långsammare på 3.0 än på modellen den ersätter.

Senaste modellerna

Ett API för all media-AI.

Utforska alla modeller