
Deux moniteurs de montage côte à côte : à gauche, un monstre marin émergeant d'une tempête ; à droite, la même tempête écourtée.
Lancez le clip de 30 secondes du monstre marin livré avec la bêta de Wan 3.0 par Alibaba. Chalutier, pluie torrentielle, éclairs, puis l'océan explose vers le haut. Dix plans distincts. Pas un seul cut. La musique orchestrale qui l'accompagne a été écrite par le modèle.
Votre première réaction n'est pas « waouh ». Elle est : « qu'est-ce qui manque exactement à mon Wan 2.7 ? »
Je suis donc parti chercher la réponse, et la première chose que j'ai découverte, c'est que la majorité d'Internet se trompe. Cherchez wan 3.0 vs wan 2.7 et les premiers résultats vous affirment avec assurance que Wan 3.0 génère en 4K natif et que les poids sont sur Hugging Face. Ni l'un ni l'autre n'est vrai. J'ai téléchargé les fichiers de démonstration officiels sur un ordinateur portable, je les ai lus avec ffmpeg, puis j'ai vérifié les registres des modèles et les grilles tarifaires publiées. La vraie mise à niveau est importante. Simplement, ce n'est pas celle que les gens décrivent.
Wan 3.0 vs Wan 2.7 : points clés
- La durée est le maître-mot. Wan 3.0 génère 30 secondes en un seul passage avec une recommandation automatique de « durée intelligente ». Wan 2.7 est limité à 15 secondes pour le texte-vers-vidéo et l'image-vers-vidéo, et à 10 secondes pour la référence-vers-vidéo et le montage vidéo.
- Les références passent d'une poignée à une foule. Wan 2.7 accepte jusqu'à 5 éléments de référence. Wan 3.0 en accepte jusqu'à 20 et, pour la première fois, accepte les fichiers doc, xls, ppt, pdf et md, ainsi que les pages web, comme entrées de génération.
- Il n'y a pas de 4K. La propre grille tarifaire de l'API d'Alibaba comporte exactement trois niveaux : 480P, 720P et 1080P. Sur Atlas Cloud, Wan 2.7 offre en fait un plafond plus élevé grâce à ses options de super-résolution 1080P-SR et 1440P-SR.
- Les poids ne sont pas ouverts. L'organisation Wan-AI sur Hugging Face s'arrête toujours à Wan 2.2. Il n'y a pas de dépôt 3.0, ni de dépôt 2.7, ni de dépôt 2.5.
- Wan 3.0 est exclusivement en bêta et propriétaire. Il fonctionne sur Alibaba Cloud Bailian, le site Wanxiang, l'application de bureau Qianwen Creation et quelques produits dérivés. Si vous avez besoin d'une API que vous pouvez appeler en production cette semaine, Wan 2.7 est toujours la génération qui répond.
- Vous voulez voir le format avant d'apprendre la grammaire des prompts ? Atlas Cloud dispose d'un générateur gratuit de sketchs publicitaires IA qui transforme une description de produit en une publicité comique de 15 secondes avec deux personnages et des dialogues parlés. Une génération gratuite, sans filigrane.
La séquence complète de kaiju de 30 secondes, générée par Alibaba sur Wan 3.0 pendant la bêta publique et publiée dans le manuel officiel du créateur Wan 3.0. Nous n'avons pas généré ce clip. Activez le son : la partition fait partie de la sortie, pas un fond musical ajouté après coup. Fichier tel que livré : 1920x1072, 24 ips, 30,07 s, AAC stéréo 44,1 kHz.
Voici la première chose que les fiches techniques oublient. Ce fichier fait 1920x1072, pas 1920x1080. Chaque démo « 1080p » du manuel officiel arrive à 1072 pixels de hauteur, et plusieurs autres démos publiées sont en simple 1280x720. Douze des dix-neuf clips du manuel durent de 30,05 à 30,07 secondes, ce qui vous indique que le plafond de 30 secondes est un véritable arrêt brutal et non un chiffre rond marketing.
Pourquoi la question Wan 3.0 vs Wan 2.7 est plus difficile qu'il n'y paraît
La réponse honnête est que presque personne n'a exécuté les deux modèles avec le même prompt, car presque personne ne le peut. Wan 3.0 a ouvert sa bêta publique le 6 août 2026 et vit sur les surfaces propres d'Alibaba (QbitAI, août 2026). Les plateformes d'inférence tierces ne l'ont pas encore repris. Ainsi, le contenu de comparaison existant se résume à une fiche technique contre une autre, et les fiches techniques ont été copiées de travers jusqu'à ce que les erreurs se soient figées.
Trois « faits » Wan 3.0 vs Wan 2.7 qui sont tout simplement faux
« Wan 3.0 est en 4K natif. » Ce n'est pas le cas. La grille tarifaire de l'API publiée propose 480P, 720P et 1080P à ¥0,3, ¥0,6 et ¥1,2 par seconde. Trois niveaux, pas de quatrième. Pendant ce temps, Atlas Cloud expose 1080P-SR et 1440P-SR sur Wan 2.7, donc en termes de plafond de pixels purs, l'ancienne génération gagne actuellement.
« Les poids de Wan 3.0 sont ouverts. » Ils ne le sont pas. Parcourez Hugging Face et la famille la plus récente publiée par l'organisation Wan-AI est Wan 2.2, y compris les variantes Animate et S2V. La ligne vidéo de base n'a pas livré de poids depuis la 2.2. Si vous voulez quelque chose pour un graphe ComfyUI local, vos options sont 2.1 et 2.2 et cela n'a pas changé.
« La grammaire des prompts s'applique directement. » C'est à moitié vrai, d'une manière qui va vous brûler. Les mots s'appliquent. La structure, non. Les prompts officiels de Wan 3.0 sont des scripts multi-plans horodatés : le prompt kaiju contient dix plans numérotés, le prompt panneau publicitaire contient quatre temps marqués avec des plages de secondes explicites. Collez un script de dix plans dans un modèle de 15 secondes et il ne choisira pas gracieusement six plans. Il compresse.
Pourquoi vous ne pouvez pas simplement échanger les prompts entre Wan 3.0 et Wan 2.7
Il y a un deuxième piège en dessous de celui-ci, et c'est la raison pour laquelle « assembler deux clips » ne vous sauve pas.
Wan 2.7 dispose d'un mode de continuation vidéo. Il ressemble à un chemin vers 30 secondes. Ce n'est pas le cas. Le clip source que vous lui fournissez doit durer de 2 à 10 secondes, donc une génération de 15 secondes ne peut pas servir de graine. La sortie ré-encode la source, ce qui mange la fin du clip que vous avez fourni. Et enchaîner les continuations a tendance à dériver vers le retour au plan d'ouverture plutôt qu'à faire avancer l'histoire. Quinze secondes est le plafond dur pour un fichier Wan 2.7 continu. Tout ce qui est plus long est un montage, pas une génération.
C'est le véritable coût de migration entre ces deux générations, et aucun tableau comparatif ne vous le montrera.
Wan 3.0 vs Wan 2.7 : fiche technique et où l'exécuter réellement
Pour tester tout cela, vous avez besoin d'un endroit qui exécute le texte-vers-vidéo, la référence-vers-vidéo et le montage vidéo sur le même compte, avec une facturation à la seconde afin qu'une prise ratée vous coûte des secondes au lieu d'un abonnement. Tout ce qui se trouve du côté Wan 2.7 de cet article fonctionne sur Atlas Cloud, qui héberge les quatre points de terminaison Wan 2.7 et le modèle d'image utilisé pour le test de référence. Wan 3.0 n'est pas encore sur Atlas Cloud ni sur aucune autre plateforme tierce, ce qui explique exactement pourquoi le matériel Wan 3.0 de cet article provient des propres publications bêta d'Alibaba.
Tableau 1 : Wan 3.0 vs Wan 2.7, génération par génération
| Wan 3.0 (bêta publique) | Wan 2.7 (production) | |
|---|---|---|
| Durée max, un passage | 30 s, avec durée intelligente | 15 s (t2v, i2v), 10 s (r2v, montage vidéo) |
| Éléments de référence | Jusqu'à 20 | Jusqu'à 5 (1 image par sujet, jusqu'à 3 vidéos) |
| Modalités d'entrée | Texte, image, vidéo, audio, doc/xls/ppt/pdf/md, pages web | Texte, image, vidéo, audio |
| Entrée document | Fichier unique ou lien, jusqu'à 100 Mo et 50 pages | Non pris en charge |
| Niveaux de résolution | 480P / 720P / 1080P | 720P / 1080P / 1080P-SR / 1440P-SR |
| Audio natif | Oui | Oui |
| Montage vidéo | Montage par instruction et par référence | Point de terminaison dédié au montage vidéo |
| Poids ouverts | Non | Non |
| Où l'exécuter | Surfaces propriétaires Alibaba uniquement | API tierces, y compris Atlas Cloud |
| Prix indiqué | ¥0,3 / ¥0,6 / ¥1,2 par seconde selon le niveau | 0,10 $ par seconde, base 720P |
Tableau 2 : les points de terminaison Wan 2.7 utilisés dans cet article
| Point de terminaison | Durée max | Résolutions | Limite de référence | Prix indiqué |
|---|---|---|---|---|
| Texte-vers-vidéo | 2-15 s | 720P, 1080P, 1080P-SR, 1440P-SR | n/a | 0,10 $ / sec |
| Référence-vers-vidéo | 2-10 s | 720P, 1080P, 1080P-SR, 1440P-SR | 5 éléments | 0,10 $ / sec |
| Image-vers-vidéo | 2-15 s | 720P, 1080P, 1080P-SR, 1440P-SR | clip source 2-10 s | 0,10 $ / sec |
| Montage vidéo | 2-10 s sortie, 2-10 s entrée | 720P (1,0x), 1080P (1,5x) | 3 images | 0,10 $ / sec |
Un détail de prix à intégrer avant d'exécuter quoi que ce soit : le titre « 0,10 $ par seconde » est la base 720P. La page de montage vidéo documente un multiplicateur de 1,5x pour le 1080P pur, et le bouton Run affiche le montant réel pour le niveau que vous avez sélectionné. Lisez le bouton, pas l'en-tête.
Réalisez vous-même le test Wan 3.0 vs Wan 2.7
Quatre étapes. Deux d'entre elles utilisent le matériel publié par Alibaba comme point de référence fixe, les deux autres sont des exécutions que vous faites vous-même. Rien ici ne nécessite l'accès à la bêta de Wan 3.0.
Étape 1 : Récupérez le clip Wan 3.0 et son prompt original
Le côté Wan 3.0 de ce test n'est pas quelque chose que vous générez. C'est quelque chose que vous lisez. Le prompt complet du kaiju est publié dans le manuel officiel du créateur Wan 3.0, ainsi que le clip finalisé, sous l'exemple « 灾难电影 ». Il s'agit d'un script en chinois avec dix plans numérotés et un paragraphe séparé décrivant la partition.
Lisez-le une fois avant de faire quoi que ce soit d'autre. La structure est la leçon : dix plans, chacun avec sa propre caméra, son sujet et sa note d'éclairage, se terminant par un brief de composition. Voilà à quoi ressemble un prompt de génération en un seul passage de 30 secondes.
Étape 2 : Exécutez le même prompt via Wan 2.7 texte-vers-vidéo
Ouvrez le playground texte-vers-vidéo Wan 2.7 et collez le rendu en anglais de ce même script. Ne le raccourcissez pas encore. Vous voulez voir ce que fait le modèle lorsque l'intention dépasse le plafond.
Plain1A 30-second, photoreal cinematic sequence: a deep-sea kaiju emerges at night in a raging storm. Open on a small, battered fishing trawler with the white letters "WAN" on its hull, fighting through enormous waves under torrential rain; lightning briefly lights the whole ocean. Push to a mid-close shot on the deck: waves smash over the bow, ropes, nets and metal railings whip in the wind, rain streaks the lens. Then the sea ahead swells unnaturally, an enormous vortex forms, and a vast dark shape passes beneath the boat, lifting it. A crewman in a soaked rain jacket grips the rail, terrified, and turns toward the water. Finally the surface explodes upward and a colossal Pacific-Rim-style sea monster breaches: wet, scarred, ridged skin, huge jaws, tens of meters of spray. Close on its head roaring in the lightning. The trawler is nearly swallowed. End on a wide shot: the kaiju towering over the churning sea, the boat tiny in the foreground, one final lightning strike. Hollywood disaster-movie scoring: low sub-bass rumble and sparse strings building to brass and heavy percussion at the breach, ending on an oppressive sustained low chord. Photoreal scale, volumetric water, high-contrast storm lighting.
Paramètres : Résolution 1080P, Durée 15 s (le maximum), Rapport hauteur/largeur 16:9, audio activé pour que le modèle le compose lui-même. Laissez le champ de référence audio vide.

Playground texte-vers-vidéo Wan 2.7 sur Atlas Cloud avec le prompt kaiju chargé et le clip de 15 secondes terminé dans le panneau OUTPUT
Playground texte-vers-vidéo Wan 2.7 sur Atlas Cloud, prompt collé, 1080P et 16:9 sélectionnés. Le bouton Run affiche 0,75 $ pour cette courte prise de test, ce qui équivaut à 0,15 $ par seconde : le multiplicateur 1,5x pour le 1080P en évidence, sur une page de modèle dont le prix d'en-tête est de 0,10 $.
Exécutez-le ensuite une deuxième fois avec une ligne ajoutée au prompt :
Plain1Single continuous take, no cuts. Prioritize the breach moment; compress the setup.
Cette seule ligne est le travail de migration en miniature. Un script de 30 secondes doit être réécrit comme une intention de 15 secondes, et c'est vous qui décidez quels sept plans mourront.
À gauche : la sortie officielle Wan 3.0, 30 secondes. À droite : Wan 2.7 sur Atlas Cloud exécutant le même prompt, s'arrêtant à son plafond de 15 secondes.
Étape 3 : Construisez les images de référence pour le test d'identité Wan 3.0 vs Wan 2.7
La durée est la mise à niveau la plus évidente. La cohérence au niveau du pixel est celle qui change réellement le travail de production, et vous pouvez la tester avec deux chats.
Le manuel d'Alibaba inclut un pastiche de Wes Anderson dans lequel le même chat ragdoll et le même chat noir doivent survivre à cinq environnements radicalement différents : un couloir d'hôtel symétrique, une vue latérale en coupe, un tambour de machine à laver, un tapis roulant d'aéroport et une cabine téléphonique rouge. Les deux chats sont liés par des balises de référence @Image1 et @Image2.
Générez d'abord vos propres deux références. Utilisez GPT Image 2 avec la qualité réglée sur élevée et un cadre 16:9, et exécutez-le deux fois.
Plain1A studio portrait of a fluffy ragdoll cat with blue eyes and a dark mask, sitting upright facing the camera, evenly lit against a plain pale pink background, sharp fur detail, full body visible, clean reference-sheet framing.
Plain1A studio portrait of a small sleek black cat with bright amber eyes, standing in profile facing right, evenly lit against a plain pale pink background, sharp fur detail, full body visible, clean reference-sheet framing.

Playground GPT Image 2 sur Atlas Cloud avec la qualité réglée sur élevée et la feuille de référence du chat ragdoll rendue dans le panneau OUTPUT
GPT Image 2 en qualité élevée, 16:9. Exécutez le deuxième prompt de la même manière pour obtenir le chat noir.
Étape 4 : Exécutez le test d'identité sur Wan 2.7 référence-vers-vidéo
Téléchargez les deux chats sur le point de terminaison référence-vers-vidéo Wan 2.7. Résolution 1080P, rapport hauteur/largeur 16:9, durée 10 secondes, ce qui est le maximum pour ce point de terminaison. Le prompt ci-dessous est la liste de plans du manuel compressée de cinq temps à trois, car dix secondes ne contiennent pas cinq temps.
Plain1Wes Anderson style, perfectly symmetrical, flat frontal compositions, pastel palette. Reference image 1 is the ragdoll cat, reference image 2 is the black cat; keep both cats identical in every shot. Shot 1: an endless symmetrical hotel corridor, the ragdoll cat running straight toward the camera with a solemn expression, the black cat sprinting away in the background with its head twisted back 180 degrees. Shot 2: a cutaway side view of the corridor, pink patterned wallpaper and gold picture frames, the ragdoll walking left to right and the black cat crossing right to left. Shot 3: frontal macro on a mint-green vintage washing machine door, both cats floating stiffly inside the drum among suds, eyes blank, rainbow-ordered detergent bottles lined up behind. Rigid horizontals and verticals, no camera tilt, deadpan absurd humor.

Playground référence-vers-vidéo Wan 2.7 sur Atlas Cloud avec les deux références de chat chargées et le clip terminé dans le panneau OUTPUT
Playground référence-vers-vidéo Wan 2.7 : les deux chats chargés dans les emplacements de référence d'image, la résolution réglée sur 1080P, et le bouton Run affichant le prix de la prise avant qu'elle ne commence. Deux références représentent déjà une part significative de ce que ce point de terminaison accepte. Wan 3.0 prend 20 éléments de référence.
Maintenant, mettez les deux côte à côte.

Le clip officiel de verrouillage d'identité Wan 3.0 : le même ragdoll et le même chat noir conservés de manière cohérente dans un couloir d'hôtel, un mur en coupe, un tambour de machine à laver, un tapis roulant et une cabine téléphonique rouge
Généré par Alibaba sur Wan 3.0 pendant la bêta publique et publié dans le manuel officiel du créateur. Cinq environnements, 19,9 secondes, les deux chats liés par balise de référence. Montré ici sous forme de GIF silencieux ; le fichier livré transporte un audio stéréo 44,1 kHz.

Le résultat de la référence-vers-vidéo Wan 2.7 sur le même brief, trois plans dans le plafond de 10 secondes
Référence-vers-vidéo Wan 2.7 sur Atlas Cloud, les deux mêmes références, montré ici sous forme de GIF silencieux. Il s'agit de la prise par défaut de 5 secondes de ce point de terminaison plutôt que des 10 secondes complètes : il est bon de savoir que le contrôle de durée ne respecte pas toujours ce que vous définissez, alors lisez le devis du bouton Run avant d'appuyer. Observez les marques des chats et le masque du ragdoll ; c'est la dimension sur laquelle porte l'affirmation de « cohérence au niveau du pixel ».
Quatre autres prompts Wan 3.0 vs Wan 2.7 qui valent la peine d'être réexécutés
Le clip kaiju met l'accent sur la durée et la physique. Ceux-ci mettent l'accent sur des choses différentes, et chacun entre en collision avec une limite différente de Wan 2.7. Les trois proviennent des sorties bêta officielles d'Alibaba issues du manuel officiel.
Sortie bêta officielle Wan 3.0 : un seul plan-séquence de 30 secondes reculant dans un couloir d'hôpital éclairé au néon, teinte vert pâle monochrome, avec l'actrice criant à l'aide. Son activé. La performance, les pas et le bourdonnement des équipements sont tous générés par le modèle.
Tableau 3 : ce que chaque prompt exige et où Wan 2.7 le limite
| Prompt | Ce que le script demande | Limite publiée de Wan 2.7 | La dimension testée |
|---|---|---|---|
| Éruption du kaiju | 10 plans numérotés sur 30 s, plus un brief de composition | 15 s max sur texte-vers-vidéo | Durée et narration multi-plans |
| Couloir d'hôpital | Un plan-séquence continu de 30 s avec dialogue parlé | 15 s max, audio natif disponible | Performance et dialogue sur longs plans |
| Cowgirl de station-service | Arc comique de 30 s en quatre actes chronométrés | 15 s max, donc deux actes doivent disparaître | Timing comique nécessitant du temps d'écran |
| Panneau publicitaire plan-séquence | Quatre temps avec plages de secondes explicites, sans cut | 15 s max, donc les plages doivent être réécrites | Physique de caméra sur un long mouvement |
| Deux chats, cinq pièces | 2 sujets marqués maintenus sur 5 environnements | 10 s max, 5 emplacements de référence | Cohérence d'identité |
Une version gratuite de 15 secondes de la même idée
Regardez à nouveau le clip de la station-service. Ce format, un court sketch comique avec deux personnages, un renversement et une chute, est celui où le temps d'exécution supplémentaire de Wan 3.0 est le plus rentable. C'est aussi le format le plus susceptible de vendre quelque chose.
Le piège, c'est le prompt. Les exemples comiques du manuel font 800 mots avec des horodatages explicites et un blocage. C'est une vraie compétence qui prend un week-end à apprendre.
Si vous voulez simplement savoir si le format fonctionne pour votre produit avant d'investir ce week-end, Atlas Cloud dispose d'un outil gratuit qui contourne entièrement l'ingénierie des prompts. Vous décrivez le produit, vous pouvez éventuellement télécharger jusqu'à quatre photos du produit de 8 Mo chacune, choisir l'un des six tons (mème drôle, rebondissement, sitcom, réconfortant, luxe ou vente agressive), et il écrit le script à deux personnages, distribue les voix, génère les dialogues et les effets sonores, et renvoie une publicité finie de 15 secondes comme une scène continue. Les téléchargements sont propres, sans filigrane. Vous devez être connecté, et vous bénéficiez d'une génération gratuite avant de recharger des crédits.

Une ligne de copie de produit en entrée, une publicité comique de 15 secondes terminée en sortie : le générateur gratuit de sketchs publicitaires IA d'Atlas Cloud
Le Générateur gratuit de sketchs publicitaires IA : une description de produit en entrée, une publicité de 15 secondes à deux personnages en sortie.

Une sortie réelle du générateur gratuit. Son activé : le script, les deux voix et les effets sonores proviennent tous d'une seule exécution.
Combien coûte une comparaison Wan 3.0 vs Wan 2.7
Par seconde, les deux générations sont dans la même fourchette au niveau 720P. La différence de coût est structurelle : un clip qui durait 15 secondes en fait maintenant 30, donc un produit fini double à peu près.
Tableau 4 : la même séquence kaiju, quatre façons
| Exécution | Tarif | Total |
|---|---|---|
| Wan 3.0, 30 s en 720P | ¥0,6 / sec | ¥18, environ 2,50 $ |
| Wan 3.0, 30 s en 1080P | ¥1,2 / sec | ¥36, environ 5,00 $ |
| Wan 2.7, 15 s en 720P | 0,10 $ / sec | 1,50 $ |
| Wan 2.7, 15 s en 1080P | 0,10 $ / sec avec le multiplicateur de niveau 1,5x | 2,25 $ |
| Wan 2.7, 15 s en 1440P-SR | devis en direct sur le bouton Run | devis en direct |
| Sketch publicitaire IA gratuit, 15 s | gratuit, 1 génération par compte | 0,00 $ |
Deux mises en garde. Les prix de la bêta ne sont pas les prix de la disponibilité générale, et Alibaba a déclaré que l'API s'ouvrira plus largement bientôt, alors considérez les chiffres en ¥ comme un instantané de la bêta publique plutôt qu'un tarif ferme. Et du côté d'Atlas Cloud, lisez toujours le devis en direct sur le bouton Run avant de vous engager, car le multiplicateur de résolution y est appliqué et non dans le prix d'en-tête.
Alibaba a également été inhabituellement direct sur les points faibles de Wan 3.0, déclarant que le modèle « a encore des progrès à faire en matière de qualité sonore et de précision du texte ». Cela correspond à ce que montrent les fichiers : l'audio des démos officielles est en stéréo 44,1 kHz mais encodé à un modeste 32 kb/s, ce qui est correct pour un aperçu mais léger pour un master de livraison.
Wan 3.0 vs Wan 2.7 : licence, ce que vous pouvez réellement livrer
Version courte, et veuillez la vérifier par rapport aux conditions actuelles avant de présenter quoi que ce soit à un client.
Wan 3.0 est en bêta publique et ses conditions commerciales ne sont pas fixées. Comme les poids ne sont pas publiés, il n'y a aucun chemin d'auto-hébergement du tout ; tout ce que vous créez passe par l'API d'Alibaba ou ses surfaces grand public, et vous êtes lié par ce que ces conditions disent le jour où vous générez. Wan 2.7 est la même histoire pour les poids, mais il est en production depuis assez longtemps pour que les conditions de l'API de la plateforme soient stables. Si vous l'exécutez via une plateforme tierce, vos droits commerciaux proviennent des conditions d'utilisation de cette plateforme, alors lisez celles qui s'appliquent réellement à votre compte. Aucun de ces paragraphes ne constitue un avis juridique.
FAQ Wan 3.0 vs Wan 2.7
Wan 3.0 est-il open source ? Puis-je l'exécuter dans ComfyUI ?
Non. En août 2026, il n'y a aucun dépôt Wan 3.0 sous l'organisation Wan-AI sur Hugging Face, et aucun non plus sur le GitHub Wan-Video. La famille Wan la plus récente avec des poids publiés est Wan 2.2, y compris les variantes Animate et S2V. Pour un graphe ComfyUI local, vous êtes toujours sur 2.1 ou 2.2. Wan 3.0 est uniquement API et web.
Wan 3.0 vs Wan 2.7 résolution : Wan 3.0 génère-t-il vraiment du 4K ?
Non. La grille tarifaire de l'API publiée comporte trois niveaux de résolution : 480P, 720P et 1080P. Plusieurs articles de comparaison largement partagés prétendent un 4K natif et ils ont tort. En termes de plafond de sortie brute, Wan 2.7 sur Atlas Cloud va en fait plus haut grâce à ses options de super-résolution 1080P-SR et 1440P-SR.
Puis-je obtenir 30 secondes avec Wan 2.7 en prolongeant des clips ?
Pas en un seul fichier continu. Le mode de continuation nécessite un clip source de 2 à 10 secondes, donc une génération complète de 15 secondes ne peut pas servir de graine. La sortie ré-encode et rogne la fin de ce que vous fournissez, et les continuations en chaîne ont tendance à boucler vers le plan d'ouverture. Au-delà de 15 secondes, vous faites du montage, pas de la génération.
Wan 3.0 vs Wan 2.7 : où puis-je exécuter chacun aujourd'hui ?
Wan 3.0 est en bêta publique sur les surfaces propres d'Alibaba : Alibaba Cloud Bailian, Wanjing Yike, le site Wanxiang, le client de bureau Qianwen Creation, IF STUDIO et Duiyou, avec un accès progressif dans l'application Qianwen. Aucune plateforme d'inférence tierce ne l'héberge encore. Wan 2.7 est la génération que vous pouvez toujours appeler directement, via les points de terminaison texte-vers-vidéo, image-vers-vidéo, référence-vers-vidéo et montage vidéo.
Wan 3.0 vs Wan 2.7 tarifs : lequel coûte le plus cher par clip fini ?
Par seconde au niveau 720P, ils sont proches. Par clip fini, attendez-vous à environ le double, car la longueur de sortie naturelle est passée de 15 à 30 secondes. Prévoyez le changement de temps d'exécution plutôt que le changement de tarif, et rappelez-vous que les prix de la bêta peuvent ne pas survivre à la disponibilité générale.
Dois-je réécrire mes prompts Wan 2.7 pour Wan 3.0 ?
Oui, et la réécriture est structurelle plutôt que lexicale. Les prompts Wan 2.7 décrivent un plan continu unique en détail riche. Les prompts Wan 3.0 sont des listes de plans horodatées, parfois avec un paragraphe de composition séparé, et le modèle lira également un pdf ou un diaporama comme entrée. Règle générale : pour Wan 2.7, écrivez un paragraphe sur un seul plan ; pour Wan 3.0, écrivez un découpage de scène numéroté avec des plages de secondes.






