Seedance 2.5 è ora live — In anteprima su Atlas Cloud

Wan 3.0 vs Wan 2.7: Ho aperto i file demo originali di Alibaba. Tre specifiche che tutti hanno copiato sono sbagliate.

Wan 3.0 vs Wan 2.7: clip da 30 secondi, 20 slot di riferimento, niente 4K, niente pesi aperti. Abbiamo aperto i file demo di Alibaba e ricostruito il test che puoi eseguire oggi.

Console di color grading con monitor che mostrano una scena con un mostro marino gigante

Ultimo aggiornamento: Wan 3.0 è ora disponibile dal 24 agosto 2026.

Due monitor di montaggio affiancati, il sinistro mostra un mostro marino che emerge da una tempesta, il destro mostra la stessa tempesta interrotta bruscamente

Riproduci il clip di 30 secondi del mostro marino che Alibaba ha distribuito con la beta di Wan 3.0. Peschereccio, pioggia torrenziale, fulmini, poi l'oceano esplode verso l'alto. Dieci inquadrature distinte. Nessun taglio. La colonna sonora orchestrale sottostante è stata scritta dal modello.

La tua prima reazione non è "wow". È "cosa mi manca esattamente in Wan 2.7?"

Così sono andato a cercare la risposta, e la prima cosa che ho scoperto è che la maggior parte di internet sta rispondendo in modo sbagliato. Cerca wan 3.0 vs wan 2.7 e i risultati migliori ti dicono con sicurezza che Wan 3.0 renderizza in 4K nativo e che i pesi sono su Hugging Face. Nessuna delle due è vera. Ho scaricato i file demo ufficiali su un laptop e li ho letti con ffmpeg, poi ho controllato i registri dei modelli e i livelli di prezzo pubblicati. Il vero aggiornamento è grande. Solo che non è l'aggiornamento che la gente descrive.

Wan 3.0 vs Wan 2.7: punti chiave

  • La durata è il titolo. Wan 3.0 genera 30 secondi in un unico passaggio con una raccomandazione automatica di "durata intelligente". Wan 2.7 si ferma a 15 secondi per text-to-video e image-to-video, e a 10 secondi per reference-to-video e video editing.
  • I riferimenti passano da una manciata a una folla. Wan 2.7 accetta fino a 5 elementi di riferimento. Wan 3.0 ne accetta fino a 20 e, per la prima volta, accetta file doc, xls, ppt, pdf e md, oltre a pagine web, come input di generazione.
  • Non c'è il 4K. La lista dei prezzi API di Alibaba ha esattamente tre livelli: 480P, 720P e 1080P. Su Atlas Cloud, Wan 2.7 offre in realtà un tetto più alto grazie alle opzioni di super-risoluzione 1080P-SR e 1440P-SR.
  • I pesi non sono aperti. L'organizzazione Wan-AI su Hugging Face arriva ancora al massimo a Wan 2.2. Non esiste un repository per 3.0, né per 2.7, né per 2.5.
  • Wan 3.0 è solo in beta e solo di prima parte. Funziona su Alibaba Cloud Bailian, sul sito Wanxiang, sull'app desktop Qianwen creation e su alcuni prodotti affini. Se hai bisogno di un'API da chiamare in produzione questa settimana, Wan 2.7 è ancora la generazione che risponde.
  • Vuoi vedere il formato prima di imparare la grammatica dei prompt? Atlas Cloud ha un generatore gratuito di spot pubblicitari AI che trasforma una descrizione del prodotto in uno spot comico di 15 secondi con due personaggi e dialoghi parlati. Una generazione gratuita, senza filigrana.

La sequenza completa del kaiju di 30 secondi, generata da Alibaba su Wan 3.0 durante la beta pubblica e pubblicata nel manuale ufficiale del creatore Wan 3.0. Non abbiamo generato questo clip. Attiva l'audio: la colonna sonora fa parte dell'output, non è una base musicale aggiunta dopo. File come consegnato: 1920x1072, 24fps, 30.07s, 44.1kHz stereo AAC.

Ecco la prima cosa che le schede tecniche tralasciano. Quel file è 1920x1072, non 1920x1080. Ogni demo "1080p" nel manuale ufficiale arriva a 1072 pixel di altezza, e molte delle altre demo pubblicate sono semplicemente 1280x720. Dodici dei diciannove clip nel manuale durano da 30.05 a 30.07 secondi, il che indica che il limite di 30 secondi è un vero e proprio blocco rigido e non un numero tondo di marketing.

Perché la domanda Wan 3.0 vs Wan 2.7 è più difficile di quanto sembri

La risposta onesta è che quasi nessuno ha eseguito entrambi i modelli sullo stesso prompt, perché quasi nessuno può farlo. Wan 3.0 è stato aperto per la beta pubblica il 6 agosto 2026 e vive sulle superfici di Alibaba (QbitAI, agosto 2026). Le piattaforme di inferenza di terze parti non lo hanno ancora adottato. Quindi i contenuti di confronto che esistono sono da scheda tecnica a scheda tecnica, e le schede tecniche sono state copiate lateralmente fino a quando gli errori non si sono calcificati.

Tre "fatti" su Wan 3.0 vs Wan 2.7 che sono semplicemente sbagliati

"Wan 3.0 è 4K nativo." Non lo è. La lista dei prezzi API pubblicata prevede 480P, 720P e 1080P a ¥0.3, ¥0.6 e ¥1.2 al secondo. Tre livelli, nessun quarto. Nel frattempo, Atlas Cloud espone 1080P-SR e 1440P-SR su Wan 2.7, quindi in termini di puro tetto di pixel, la generazione precedente vince attualmente.

"I pesi di Wan 3.0 sono aperti." Non lo sono. Sfoglia Hugging Face e la famiglia più recente rilasciata dall'organizzazione Wan-AI è Wan 2.2, incluse le varianti Animate e S2V. La linea video principale non ha rilasciato pesi dalla 2.2. Se vuoi qualcosa per un grafico ComfyUI locale, 2.1 e 2.2 sono le tue opzioni e questo non è cambiato.

"La grammatica dei prompt si trasferisce direttamente." Questa è mezza verità in un modo che ti brucerà. Le parole si trasferiscono. La struttura no. I prompt ufficiali di Wan 3.0 sono sceneggiature multi-inquadratura con timestamp: il prompt del kaiju è dieci inquadrature numerate, il prompt del cartellone pubblicitario è quattro battute etichettate con intervalli di secondi espliciti. Incolla una sceneggiatura di dieci inquadrature in un modello da 15 secondi e non seleziona con grazia sei inquadrature. Comprime.

Perché non puoi semplicemente scambiare i prompt tra Wan 3.0 e Wan 2.7

C'è una seconda trappola sotto quella, ed è il motivo per cui "basta unire due clip" non ti salva.

Wan 2.7 ha una modalità di continuazione video. Sembra una strada verso i 30 secondi. Non lo è. Il clip sorgente che gli dai deve essere da 2 a 10 secondi, quindi una generazione di 15 secondi non può essere il seme. L'output ricodifica la sorgente, il che mangia la coda del clip che hai inserito. E concatenare le continuazioni tende a tornare indietro verso la battuta di apertura piuttosto che spostare la storia in avanti. Quindici secondi è il tetto massimo per un file Wan 2.7 continuo. Qualsiasi cosa più lunga è un montaggio, non una generazione.

Questo è il vero costo di migrazione tra queste due generazioni, e nessuna tabella di confronto te lo mostrerà.

Wan 3.0 vs Wan 2.7: scheda tecnica e dove eseguirlo effettivamente

Per testare qualsiasi cosa, hai bisogno di un posto che esegua text-to-video, reference-to-video e video editing sullo stesso account, con fatturazione al secondo in modo che una ripresa fallita ti costi secondi invece di un abbonamento. Tutto sul lato Wan 2.7 di questo articolo viene eseguito su Atlas Cloud, che ospita i quattro endpoint Wan 2.7 e il modello immagine utilizzato per il test di riferimento. Wan 3.0 non è su Atlas Cloud né su nessun'altra piattaforma di terze parti per ora, il che è esattamente il motivo per cui il materiale Wan 3.0 in questo articolo proviene dalle pubblicazioni beta di Alibaba.

Tabella 1: Wan 3.0 vs Wan 2.7, generazione per generazione

Wan 3.0 (beta pubblica)Wan 2.7 (produzione)
Durata max, un passaggio30s, con durata intelligente15s (t2v, i2v), 10s (r2v, video edit)
Elementi di riferimentoFino a 20Fino a 5 (1 immagine per soggetto, fino a 3 video)
Modalità di inputTesto, immagine, video, audio, doc/xls/ppt/pdf/md, pagine webTesto, immagine, video, audio
Input documentiFile singolo o link, fino a 100MB e 50 pagineNon supportato
Livelli di risoluzione480P / 720P / 1080P720P / 1080P / 1080P-SR / 1440P-SR
Audio nativo
Video editingMontaggio per istruzione e riferimentoEndpoint dedicato per video edit
Pesi apertiNoNo
Dove eseguirloSolo superfici di prima parte di AlibabaAPI di terze parti, inclusa Atlas Cloud
Prezzo indicato¥0.3 / ¥0.6 / ¥1.2 al secondo per livello$0.1 al secondo, base 720P

Tabella 2: gli endpoint Wan 2.7 utilizzati in questo articolo

EndpointDurata maxRisoluzioniLimite riferimentiPrezzo indicato
Text-to-video2-15s720P, 1080P, 1080P-SR, 1440P-SRn/a$0.1 / sec
Reference-to-video2-10s720P, 1080P, 1080P-SR, 1440P-SR5 elementi$0.1 / sec
Image-to-video2-15s720P, 1080P, 1080P-SR, 1440P-SRclip sorgente 2-10s$0.1 / sec
Video-edit2-10s out, 2-10s in720P (1.0x), 1080P (1.5x)3 immagini$0.1 / sec

Un dettaglio di prezzo da interiorizzare prima di eseguire qualsiasi cosa: il titolo "$0.1 al secondo" è la base 720P. La pagina di video-edit documenta un moltiplicatore 1.5x per 1080P direttamente, e il pulsante Esegui cita il numero reale per il livello che hai selezionato. Leggi il pulsante, non l'intestazione.

Per un'esecuzione ospitata corrente, apri Wan 3.0 su Atlas Cloud e testa un prompt come quello qui sotto prima di pubblicare il flusso di lavoro.

Screenshot di prompt e effetto generato di Wan 3.0 per wan-3.0-vs-wan-2.7

Screenshot prompt-to-risultato di Wan 3.0: confronto modelli abbinati.

Esegui tu stesso il test Wan 3.0 vs Wan 2.7

Quattro passaggi. Due usano il materiale pubblicato da Alibaba come punto di riferimento fisso, due sono esecuzioni che fai tu stesso. Niente qui richiede l'accesso alla beta di Wan 3.0.

Passaggio 1: prendi il clip Wan 3.0 e il suo prompt originale

Il lato Wan 3.0 di questo test non è qualcosa che generi. È qualcosa che leggi. Il prompt completo del kaiju è pubblicato nel manuale ufficiale del creatore Wan 3.0, insieme al clip finito, sotto l'esempio "灾难电影". È una sceneggiatura in cinese con dieci inquadrature numerate e un paragrafo separato che descrive la colonna sonora.

Leggilo una volta prima di fare qualsiasi altra cosa. La struttura è la lezione: dieci inquadrature, ciascuna con la propria telecamera, soggetto e nota di illuminazione, che terminano con un briefing per la colonna sonora. Ecco come appare un prompt di generazione a passaggio singolo di 30 secondi.

Passaggio 2: esegui lo stesso prompt tramite Wan 2.7 text-to-video

Apri il playground di Wan 2.7 text-to-video e incolla la traduzione in inglese della stessa sceneggiatura. Non accorciarla ancora. Vuoi vedere cosa fa il modello quando l'intento supera il limite.

Plain
1A 30-second, photoreal cinematic sequence: a deep-sea kaiju emerges at night in a raging storm. Open on a small, battered fishing trawler with the white letters "WAN" on its hull, fighting through enormous waves under torrential rain; lightning briefly lights the whole ocean. Push to a mid-close shot on the deck: waves smash over the bow, ropes, nets and metal railings whip in the wind, rain streaks the lens. Then the sea ahead swells unnaturally, an enormous vortex forms, and a vast dark shape passes beneath the boat, lifting it. A crewman in a soaked rain jacket grips the rail, terrified, and turns toward the water. Finally the surface explodes upward and a colossal Pacific-Rim-style sea monster breaches: wet, scarred, ridged skin, huge jaws, tens of meters of spray. Close on its head roaring in the lightning. The trawler is nearly swallowed. End on a wide shot: the kaiju towering over the churning sea, the boat tiny in the foreground, one final lightning strike. Hollywood disaster-movie scoring: low sub-bass rumble and sparse strings building to brass and heavy percussion at the breach, ending on an oppressive sustained low chord. Photoreal scale, volumetric water, high-contrast storm lighting.
2

Impostazioni: Risoluzione 1080P, Durata 15s (il massimo), Aspect ratio 16:9, audio lasciato acceso così il modello lo compone da solo. Lascia vuoto lo slot per l'audio di riferimento.

Interfaccia del generatore video AI con passaggi numerati e un video generato

Playground di Wan 2.7 text-to-video su Atlas Cloud con il prompt del kaiju caricato e il clip finito di 15 secondi nel pannello OUTPUT

Playground di Wan 2.7 text-to-video su Atlas Cloud, prompt incollato, selezionati 1080P e 16:9. Il pulsante Esegui quota $0.75 per questa breve ripresa di prova, che equivale a $0.15 al secondo: il moltiplicatore 1.5x per 1080P in piena vista, su una pagina modello il cui numero di intestazione è $0.1.

Quindi eseguilo una seconda volta con una riga aggiunta al prompt:

Plain
1Single continuous take, no cuts. Prioritize the breach moment; compress the setup.
2

Quella singola riga è il lavoro di migrazione in miniatura. Una sceneggiatura di 30 secondi deve essere riscritta come un intento di 15 secondi, e sei tu a decidere quali sette inquadrature muoiono.

Sinistra: l'output ufficiale di Wan 3.0, 30 secondi. Destra: Wan 2.7 su Atlas Cloud che esegue lo stesso prompt, fermandosi al suo limite di 15 secondi.

Passaggio 3: crea le immagini di riferimento per il test di identità Wan 3.0 vs Wan 2.7

La durata è l'aggiornamento più rumoroso. La coerenza a livello di pixel è quella che cambia effettivamente il lavoro di produzione, e puoi testarla con due gatti.

Il manuale di Alibaba include un pastiche di Wes Anderson in cui lo stesso gatto ragdoll e lo stesso gatto nero devono sopravvivere a cinque ambienti molto diversi: un corridoio simmetrico dell'hotel, una vista laterale in sezione, un cestello di lavatrice, un nastro bagagli dell'aeroporto e una cabina telefonica rossa. Entrambi i gatti sono fissati con tag di riferimento @Image1 e @Image2.

Genera prima i tuoi due riferimenti. Usa GPT Image 2 con qualità impostata su alta e un fotogramma 16:9, ed eseguilo due volte.

Plain
1A studio portrait of a fluffy ragdoll cat with blue eyes and a dark mask, sitting upright facing the camera, evenly lit against a plain pale pink background, sharp fur detail, full body visible, clean reference-sheet framing.
2
Plain
1A studio portrait of a small sleek black cat with bright amber eyes, standing in profile facing right, evenly lit against a plain pale pink background, sharp fur detail, full body visible, clean reference-sheet framing.
2

Interfaccia del generatore di immagini AI che mostra le impostazioni di input e un gatto generato

Playground di GPT Image 2 su Atlas Cloud con qualità impostata su alta e il foglio di riferimento del gatto ragdoll renderizzato nel pannello OUTPUT

GPT Image 2 con qualità alta, 16:9. Esegui il secondo prompt allo stesso modo per ottenere il gatto nero.

Passaggio 4: esegui il test di identità su Wan 2.7 reference-to-video

Carica entrambi i gatti nell'endpoint Wan 2.7 reference-to-video. Risoluzione 1080P, aspect ratio 16:9, durata 10 secondi, che è il massimo per questo endpoint. Il prompt seguente è l'elenco delle inquadrature del manuale compresso da cinque a tre battute, perché dieci secondi non contengono cinque.

Plain
1Wes Anderson style, perfectly symmetrical, flat frontal compositions, pastel palette. Reference image 1 is the ragdoll cat, reference image 2 is the black cat; keep both cats identical in every shot. Shot 1: an endless symmetrical hotel corridor, the ragdoll cat running straight toward the camera with a solemn expression, the black cat sprinting away in the background with its head twisted back 180 degrees. Shot 2: a cutaway side view of the corridor, pink patterned wallpaper and gold picture frames, the ragdoll walking left to right and the black cat crossing right to left. Shot 3: frontal macro on a mint-green vintage washing machine door, both cats floating stiffly inside the drum among suds, eyes blank, rainbow-ordered detergent bottles lined up behind. Rigid horizontals and verticals, no camera tilt, deadpan absurd humor.
2

Interfaccia del generatore video AI con prompt testuale e video di gatti generato

Playground di Wan 2.7 reference-to-video su Atlas Cloud con entrambi i riferimenti dei gatti caricati e il clip finito nel pannello OUTPUT

Playground di Wan 2.7 reference-to-video: entrambi i gatti caricati negli slot delle immagini di riferimento, risoluzione impostata su 1080P e il pulsante Esegui che quota la ripresa prima che inizi. Due riferimenti sono già una parte significativa di ciò che questo endpoint accetta. Wan 3.0 accetta 20 elementi di riferimento.

Ora mettili fianco a fianco.

Un gatto soffice in piedi accanto a un gatto nero in un grande corridoio

Il clip ufficiale di blocco dell'identità di Wan 3.0: lo stesso ragdoll e gatto nero mantenuti coerenti in un corridoio d'albergo, una parete in sezione, un cestello di lavatrice, un nastro bagagli e una cabina telefonica rossa

Generato da Alibaba su Wan 3.0 durante la beta pubblica e pubblicato nel manuale ufficiale del creatore. Cinque ambienti, 19.9 secondi, entrambi i gatti fissati dal tag di riferimento. Mostrato qui come GIF silenziosa; il file consegnato trasporta audio stereo 44.1kHz.

Due gatti che camminano in un lungo corridoio rosa

Il risultato di Wan 2.7 reference-to-video sulla stessa richiesta, tre inquadrature entro il limite di 10 secondi

Wan 2.7 reference-to-video su Atlas Cloud, gli stessi due riferimenti, mostrato qui come GIF silenziosa. Questa è la ripresa predefinita di 5 secondi dell'endpoint piuttosto che i 10 secondi completi: vale la pena sapere che il controllo della durata non sempre impegna ciò che imposti, quindi leggi la citazione del pulsante Esegui prima di premerlo. Osserva le marcature dei gatti e la maschera del ragdoll; questa è la dimensione a cui si riferisce l'affermazione "coerenza a livello di pixel".

Altri quattro prompt Wan 3.0 vs Wan 2.7 degni di essere ri-eseguiti

Il clip del kaiju mette in risalto la durata e la fisica. Questi tre mettono in risalto cose diverse, e ciascuno si scontra con un limite diverso di Wan 2.7. Tutti e tre sono output beta ufficiali di Alibaba tratti dal manuale ufficiale.

Wan 3.0, output beta ufficiale: un unico movimento continuo di 30 secondi all'indietro lungo un corridoio d'ospedale illuminato da neon, con gradazione monocromatica verde pallido, e l'attrice che grida aiuto. Audio attivo. La performance, i passi e il ronzio delle attrezzature sono tutti generati dal modello.

Tabella 3: cosa richiede ogni prompt e dove Wan 2.7 lo limita

PromptCosa chiede la sceneggiaturaLimite pubblicato di Wan 2.7La dimensione testata
Breccia del kaiju10 inquadrature numerate in 30s, più un briefing per la colonna sonora15s max su text-to-videoDurata e narrazione multi-inquadratura
Corridoio d'ospedaleUn'unica ripresa continua di 30s con dialogo parlato15s max, audio nativo disponibilePerformance e dialogo su lunghe riprese
Cowgirl della stazione di servizioArco comico di 30s in quattro atti temporizzati15s max, quindi due atti devono andareTempismo comico che richiede durata
Cartellone pubblicitario in un'unica ripresaQuattro battute con intervalli di secondi espliciti, nessun taglio15s max, quindi gli intervalli devono essere riscrittiFisica della telecamera su un movimento lungo
Due gatti, cinque stanze2 soggetti con tag mantenuti in 5 ambienti10s max, 5 slot di riferimentoCoerenza dell'identità

Una versione gratuita di 15 secondi della stessa idea

Guarda di nuovo il clip della stazione di servizio. Quel formato, un breve sketch comico con due personaggi, un colpo di scena e una battuta finale, è dove il tempo di esecuzione extra di Wan 3.0 paga di più. È anche il formato più probabile per vendere qualcosa.

Il problema è il prompt. Gli esempi comici del manuale arrivano a 800 parole con timestamp e blocking espliciti. È una vera abilità e ci vuole un fine settimana per impararla.

Se vuoi solo scoprire se il formato funziona per il tuo prodotto prima di investire quel fine settimana, Atlas Cloud ha uno strumento gratuito che salta del tutto l'ingegneria dei prompt. Descrivi il prodotto, carica facoltativamente fino a quattro foto del prodotto da 8MB ciascuna, scegli uno di sei toni (meme divertente, colpo di scena, sitcom, commovente, lusso o vendita dura), e scrive la sceneggiatura per due personaggi, assegna le voci, genera i dialoghi e gli effetti sonori e restituisce uno spot pubblicitario finito di 15 secondi come una scena continua. I download sono puliti, senza filigrana. Devi aver effettuato l'accesso e ottieni una generazione gratuita prima di ricaricare i crediti.

Diagramma che mostra l'input di testo che si trasforma in uno spot video AI

Una riga di copy del prodotto in entrata, uno spot comico finito di 15 secondi in uscita: il generatore gratuito di spot pubblicitari AI di Atlas Cloud

Il Generatore gratuito di spot pubblicitari AI : una descrizione del prodotto in entrata, uno spot di 15 secondi con due personaggi in uscita.

Giovane entusiasta che guarda dentro uno zaino nero in un parco

Un output reale dal generatore gratuito. Audio attivo: la sceneggiatura, le due voci e gli effetti sonori provengono tutti da una singola esecuzione.

Quanto costa eseguire un confronto Wan 3.0 vs Wan 2.7

Al secondo, le due generazioni sono nello stesso quartiere al livello 720P. La differenza di costo è strutturale: un clip che prima era di 15 secondi ora è di 30, quindi un pezzo finito costa circa il doppio.

Tabella 4: la stessa sequenza del kaiju, quattro modi

EsecuzioneTariffaTotale
Wan 3.0, 30s a 720P¥0.6 / sec¥18, circa $2.50
Wan 3.0, 30s a 1080P¥1.2 / sec¥36, circa $5.00
Wan 2.7, 15s a 720P$0.10 / sec$1.50
Wan 2.7, 15s a 1080P$0.10 / sec con il moltiplicatore di livello 1.5x$2.25
Wan 2.7, 15s a 1440P-SRquotato live sul pulsante Eseguiquotato live
Spot pubblicitario AI gratuito, 15sgratuito, 1 generazione per account$0.00

Due avvertenze. Il prezzo beta non è il prezzo di disponibilità generale, e Alibaba ha detto che l'API si aprirà più ampiamente presto, quindi considera le cifre in ¥ come un'istantanea della beta pubblica piuttosto che una tariffa impegnata. E sul lato Atlas Cloud, leggi sempre la quotazione in tempo reale sul pulsante Esegui prima di impegnarti, perché il moltiplicatore di risoluzione viene applicato lì e non nel prezzo di intestazione.

Alibaba è stato anche insolitamente diretto su dove Wan 3.0 è ancora debole, affermando che il modello "ha ancora margini di miglioramento nella qualità audio e nella precisione del testo". Questo corrisponde a ciò che mostrano i file: l'audio sulle demo ufficiali è stereo 44.1kHz ma codificato a una modesta 32 kb/s, che va bene per un'anteprima ed è sottile per un master di consegna.

Wan 3.0 vs Wan 2.7: licenze, cosa puoi effettivamente spedire

Versione breve, e verifica tu stesso rispetto ai termini attuali prima di mettere qualsiasi cosa davanti a un cliente.

Wan 3.0 è in beta pubblica e i suoi termini commerciali non sono definitivi. Poiché i pesi non sono rilasciati, non esiste alcun percorso self-hosted; qualsiasi cosa tu crei passa attraverso l'API di Alibaba o le sue superfici consumer, e sei vincolato da qualunque termine dicano in quel giorno in cui generi. Wan 2.7 è la stessa storia per quanto riguarda i pesi, ma è stato in produzione abbastanza a lungo che i termini dell'API della piattaforma sono stabili. Se lo stai eseguendo tramite una piattaforma di terze parti, i tuoi diritti commerciali provengono dai termini di servizio di quella piattaforma, quindi leggi quelli che si applicano effettivamente al tuo account. Nessuno di questi paragrafi è un consiglio legale.

Wan 3.0 vs Wan 2.7: FAQ

Wan 3.0 è open source? Posso eseguirlo in ComfyUI?

No. Ad agosto 2026 non esiste un repository Wan 3.0 sotto l'organizzazione Wan-AI su Hugging Face, e nemmeno su Wan-Video GitHub. La famiglia Wan più recente con pesi rilasciati è Wan 2.2, incluse le varianti Animate e S2V. Per un grafico ComfyUI locale sei ancora su 2.1 o 2.2. Wan 3.0 è solo API e web.

Wan 3.0 vs Wan 2.7 risoluzione: Wan 3.0 genera davvero 4K?

No. La lista dei prezzi API pubblicata ha tre livelli di risoluzione: 480P, 720P e 1080P. Diversi post di confronto ampiamente condivisi affermano 4K nativo e hanno torto. In termini di tetto di output grezzo, Wan 2.7 su Atlas Cloud arriva effettivamente più in alto attraverso le sue opzioni di super-risoluzione 1080P-SR e 1440P-SR.

Posso ottenere 30 secondi da Wan 2.7 estendendo i clip?

Non come un singolo file continuo. La modalità di continuazione richiede un clip sorgente da 2 a 10 secondi, quindi una generazione completa di 15 secondi non può fungere da seme. L'output ricodifica e taglia la coda di qualsiasi cosa gli dai, e le continuazioni concatenate tendono a tornare indietro verso la battuta di apertura. Oltre i 15 secondi stai montando, non generando.

Wan 3.0 vs Wan 2.7: dove posso eseguire ciascuno oggi?

Wan 3.0 è in beta pubblica sulle superfici di Alibaba: Alibaba Cloud Bailian, Wanjing Yike, il sito Wanxiang, il client desktop Qianwen creation, IF STUDIO e Duiyou, con accesso in scala di grigi nell'app Qianwen. Nessuna piattaforma di inferenza di terze parti lo ospita ancora. Wan 2.7 è la generazione che puoi ancora chiamare direttamente, attraverso gli endpoint text-to-video, image-to-video, reference-to-video e video-edit.

Wan 3.0 vs Wan 2.7 prezzi: quale costa di più per clip finito?

Al secondo al livello 720P sono vicini. Per clip finito, aspettati circa il doppio, perché la lunghezza naturale dell'output è passata da 15 secondi a 30. Fai un budget per il cambiamento del tempo di esecuzione piuttosto che per il cambiamento della tariffa, e ricorda che i prezzi beta potrebbero non sopravvivere alla disponibilità generale.

Devo riscrivere i miei prompt Wan 2.7 per Wan 3.0?

Sì, e la riscrittura è strutturale piuttosto che lessicale. I prompt Wan 2.7 descrivono una singola ripresa continua in dettaglio ricco. I prompt Wan 3.0 sono elenchi di inquadrature con timestamp, a volte con un paragrafo di colonna sonora separato, e il modello leggerà anche un pdf o una presentazione come input. Regola pratica: per Wan 2.7 scrivi un paragrafo su una singola inquadratura; per Wan 3.0 scrivi una ripartizione di scena numerata con intervalli di secondi.

Modelli recenti

Un'unica API per tutta l'IA multimediale.

Esplora tutti i modelli