Seedance 2.0 Mini & Fast API aux prix les plus bas au monde — jusqu'à 68 % de réduction sur le tarif officiel

L'aperçu Wan 3.0 est en ligne : pas de 4K, pas de poids ouverts, et le mur des 15 secondes que j'ai heurté en essayant de le simuler.

Wan 3.0 Preview est entré en bêta publique le 6 août 2026. Chaque spécification vérifiée par rapport à la documentation d'Alibaba, plus le mur de 15 secondes que j'ai rencontré en essayant de simuler son plan-séquence.

Un monteur vidéo devant une console de contrôle avec plusieurs écrans

Dernière mise à jour : Wan 3.0 est désormais en ligne depuis le 24 août 2026.

Un mur d'étalonnage couleur montrant le même plan de toit sous la pluie à des timecodes de 00:00 à 00:30

Trente secondes d'un seul plan continu, déroulé sur une timeline. Y arriver est toute l'histoire.

Le jour où Wan 3.0 Preview est entré en bêta publique, je suis parti à la recherche de sa fiche technique. La première page de résultats m'a appris qu'il fait du 4K natif, qu'il est sous licence Apache 2.0, et qu'il a un « mode réalisateur IA à six caméras ». Six sites différents, mêmes affirmations, et aucun ne pointait vers une source primaire.

J'ai donc ouvert la page de modèle d'Alibaba. 480P, 720P, 1080P. Pas de 4K. Puis j'ai interrogé directement l'API Hugging Face et récupéré tous les dépôts sous l'organisation Wan-AI. Le plus récent est Wan2.2-Animate-2, poussé le même jour que le lancement de Wan 3.0. Il n'y a rien du tout en 3.0.

Ensuite, j'ai fait ce que personne d'autre ne fait. Le titre de Wan 3.0, c'est 30 secondes de vidéo continue en un seul passage, et je n'y ai pas accès, alors j'ai essayé de reproduire ce résultat avec les modèles auxquels je peux vraiment accéder aujourd'hui. J'ai échoué. La manière dont j'ai échoué s'est avérée être la chose la plus utile de cet article.

Points clés

  • Wan 3.0 Preview est entré en bêta publique le 6 août 2026. ID de modèle wan3.0-video, verrouillé derrière une demande d'accès sur Alibaba Cloud Model Studio et Qwen Cloud. Ce n'est pas une inscription ouverte.
  • Les vraies spécifications : jusqu'à 30 secondes en un seul passage, 480P/720P/1080P, à 0,05 $/0,10 $/0,20 $ par seconde de sortie.
  • Il n'y a pas de 4K et il n'y a pas de poids ouverts. J'ai interrogé l'API Hugging Face pour chaque dépôt sous Wan-AI. Rien au-dessus de Wan 2.2 n'existe en téléchargement.
  • Les limites de débit sont le vrai goulot d'étranglement : 2 requêtes simultanées, 30 requêtes par minute, 50 tâches asynchrones en file d'attente.
  • Vous ne pouvez pas simuler le plan unique de 30 secondes avec Wan 2.7. Trois limites non documentées plafonnent le clip vraiment continu le plus long à 15 secondes, et enchaîner une deuxième continuation fait boucler le modèle en arrière au lieu d'avancer.

Le mur des 15 secondes : ce que Wan 3.0 Preview vend vraiment

Voici le meilleur résultat que j'ai pu obtenir. Quinze secondes ininterrompues en 1080P : un zoom avant sur une enseigne au néon, un vendeur fermant un stand de café sur un toit sous la pluie, puis une grue descendant vers la rue mouillée et un taxi. Un seul fichier généré en continu, sans montage, avec audio généré.

Enseigne lumineuse rose et bleu avec caractères chinois et SHENZHEN

Quinze secondes de vidéo Wan 2.7 continue : enseigne au néon, vendeur sur le toit, grue descendant vers une rue pluvieuse et un taxi

Le clip vraiment continu le plus long que la famille Wan 2.7 a produit pour moi : 15 secondes, 1080P, un seul fichier. Montré ici sous forme de GIF silencieux ; le fichier livré contient un audio stéréo 44,1 kHz.

C'est bon. C'est aussi exactement la moitié de ce que Wan 3.0 prétend faire en un seul appel, et 15 secondes, c'est là où le plafond est soudé. Tout ce qui suit montre comment j'ai trouvé la soudure.

Pourquoi chaque fiche technique de Wan 3.0 Preview que vous lisez est probablement erronée

Deux choses rendent ce lancement inhabituellement bruyant. Premièrement, 30 secondes en un seul passage de génération est une véritable première pour la famille. Wan2.7-Video plafonne à 15 secondes et la plupart des modèles vidéo grand public se situent entre 5 et 15 (TNGlobal, août 2026). Deuxièmement, Wan 3.0 accepte des entrées de référence que personne d'autre n'accepte : en plus du texte, de l'image, de l'audio et de la vidéo, il accepte les fichiers doc, xls, ppt, pdf et md ainsi que les pages web, donc un diaporama devient une vidéo (AlphaSignal, août 2026).

Cette combinaison a produit une énorme couverture de la part de sites qui n'ont jamais ouvert la documentation. Voici chaque affirmation largement répandue, vérifiée par rapport à la source primaire.

Tableau A : Vérification des spécifications de Wan 3.0 Preview

Affirmation circulanteCe que dit la source primaireVerdict
30 secondes en un seul passage de générationConfirmé, contre 2 à 15s pour Wan 2.7✅ Réel
Sortie 4K nativeLes résolutions officielles sont 480P, 720P et 1080P uniquement❌ Faux
Poids ouverts sous Apache 2.0Aucun dépôt Wan 3.0 n'existe sous Wan-AI sur Hugging Face❌ Faux
Document vers vidéo (PDF, PPT, XLS)Confirmé comme type d'entrée de référence✅ Réel
« Mode réalisateur IA à six caméras »N'apparaît dans aucune documentation d'Alibaba❌ Non pris en charge
« Synchronisation labiale en 12 langues avec verrouillage d'identité »N'apparaît dans aucune documentation d'Alibaba❌ Non pris en charge
0,05 $ / 0,10 $ / 0,20 $ par secondeConfirmé pour 480P / 720P / 1080P✅ Réel
Ouvert à tousAccès sur demande sur Model Studio et Qwen Cloud⚠️ Bêta, invitation requise

Les prix et les limites de débit proviennent directement de la page du modèle : 2 requêtes simultanées, 30 requêtes par minute, et une file d'attente asynchrone de 50 tâches (QwenCloud, août 2026). Ce nombre de simultanéité n'est presque jamais mentionné et c'est la ligne la plus importante de la page. Deux travaux parallèles, chacun prenant des minutes, c'est bien pour une démo de lancement. Ce n'est pas un pipeline.

Maintenant, la question qui intéresse vraiment la communauté open source. Wan 2.1 et Wan 2.2 ont livré des checkpoints téléchargeables. Wan 2.5 a promis des poids qui ne sont jamais arrivés, Wan 2.6 était complètement fermé, et Wan 2.7 est resté uniquement API. J'ai vérifié si 3.0 brise la tendance en interrogeant l'API Hugging Face pour chaque modèle sous l'organisation Wan-AI, triés par date de création. Les trois dépôts les plus récents sont tous des variantes de Wan2.2-Animate-2 créées le 6 août 2026, le même jour que le lancement de Wan 3.0. Le dépôt le plus téléchargé est toujours Wan2.2-TI2V-5B-Diffusers avec environ 179 000 téléchargements au cours des 30 derniers jours (Hugging Face, août 2026).

Donc la réponse est non, et Wan 2.2 reste le plafond des poids ouverts. Si votre plan impliquait d'exécuter ce modèle localement ou de l'affiner, il n'y a rien à exécuter.

Essayez le modèle en direct sur Atlas Cloud : ouvrez Wan 3.0 Text-to-Video sur Atlas Cloud.

Capture d'écran d'un générateur texte vers vidéo montrant une vidéo de poisson rouge

Un véritable exécution dans le playground Wan 3.0 Text-to-Video d'Atlas Cloud : le prompt est affiché à gauche, et le clip généré terminé apparaît à droite.

La pile Wan 3.0 Preview : ce que vous pouvez réellement exécuter aujourd'hui

La situation se divise clairement. Wan 3.0 se trouve derrière un formulaire de demande avec un plafond de deux travaux simultanés. Tout ce qui le précède, de Wan 2.7 en remontant jusqu'à 2.2, est appelable immédiatement avec une seule clé API, aux côtés de Seedance et Kling pour une comparaison entre modèles. Tout dans cet article a été exécuté de cette façon, dans un seul onglet de navigateur.

Les prix ci-dessous proviennent du catalogue de modèles Atlas Cloud du 10 août 2026, et non d'aucun article de blog.

Tableau B : Wan 3.0 Preview par rapport à ce qui est disponible

ModèlePlus long passage uniqueRésolutionsAccèsSimultanéitéPrix par seconde listé
Wan 3.0 Preview30s480P / 720P / 1080PDemande requise20,05 $ / 0,10 $ / 0,20 $
Wan 2.7 text-to-video15s720P / 1080P / 1080P-SR / 1440P-SROuvertStandardà partir de 0,10 $
Wan 2.7 image-to-video15s720P / 1080POuvertStandardà partir de 0,10 $
Wan 2.6 text-to-video15s720p / 1080pOuvertStandard0,07 $ (30 % de réduction sur 0,10 $)
Wan 2.5 text-to-video10s720p / 1080pOuvertStandard0,035 $ (30 % de réduction sur 0,05 $)
Wan 2.2 image-to-video10s480p / 720pOuvert, poids téléchargeablesStandard0,03 $
Seedance 2.5 text-to-video30s480p / 720pOuvertStandardà partir de 0,134 $
Kling v3.0 Pro text-to-video15sPar défaut du modèleOuvertStandard0,095 $ (15 % de réduction sur 0,112 $)

Les réductions sont en vigueur depuis août 2026 et limitées dans le temps, alors vérifiez la page du modèle avant de budgétiser en fonction de celles-ci.

Deux choses ressortent de ce tableau. Le passage unique de 30 secondes de Wan 3.0 n'est plus unique : Seedance 2.5 accepte déjà une durée de 4 à 30 secondes en un seul appel, juste plafonné à 720p. Et Wan 2.7 est la seule ligne offrant du 1440P-SR, un palier de super-résolution facturé à 80 % du 1080P natif selon son propre schéma, ce que Wan 3.0 n'a pas.

Ce que Wan 3.0 a que rien d'autre n'a, ce sont 30 secondes en 1080P en un seul passage, plus les entrées de référence de documents. Wan 3.0 a une page placeholder sur Atlas Cloud marquée « Coming Soon », donc il atterrit sur la même clé quand il sera disponible. En attendant, voici exactement jusqu'où les anciens modèles vous emmènent.

Tutoriel Wan 3.0 Preview Étape 1 : Rédiger le brief du plan unique

Le brief se réutilise d'une génération à l'autre, alors écrivez-le une fois. Wan 3.0 récompense les descriptions de plans longues avec timecodes, et Wan 2.7 accepte la même structure dans une limite de prompt de 5 000 caractères.

Le modèle qui fonctionne : Plan [timecode] + action du sujet + mouvement de caméra + lumière + ambiance audio. Déclarez que le plan est continu dans la première ligne, et décrivez explicitement le fond sonore, car Wan 2.7 génère de l'audio nativement et inventera quelque chose d'inutile si vous laissez le champ vide.

J'ai choisi un stand de café sur un toit par une nuit pluvieuse exprès. Cela met à l'épreuve quatre choses qui cassent souvent en même temps : un mouvement de caméra soutenu, la cohérence des visages dans le temps, les reflets humides au néon, et un fond sonore ambiant continu.

textCopy

text
11BEAT 1 (0-10s) : Lent travelling avant depuis une enseigne au néon rose et cyan
22clignotante vers une jeune vendeuse essuyant un comptoir en acier sur un stand de
33café sur un toit.
44BEAT 2 (10-15s) : La caméra descend par-dessus le bord du toit vers la rue
55mouillée en dessous, glissant vers un taxi à l'arrêt au bord du trottoir.
66Constant : forte pluie, palette de néons, 35mm anamorphique, grain de film, pas de
77coupure.

C'est le plan, pas le prompt. Les prompts que vous collez sont ci-dessous.

Étape 2 : Générer l'ouverture en 1080P

Ouvrez la page Wan 2.7 text-to-video et collez le Beat 1, écrit en entier.

textCopy

text
11Plan unique continu, sans coupure. Un stand de café sur un toit par une nuit
22pluvieuse à Shenzhen.
33Plan [0-4s] : Lent travelling avant depuis une enseigne au néon rose et cyan
44clignotante vers une jeune vendeuse essuyant un comptoir en acier, la pluie
55traversant la lueur du néon, de la vapeur s'élevant d'une bouilloire.
66Plan [4-10s] : La caméra s'arrête à hauteur de poitrine alors qu'elle lève les
77yeux et esquisse un demi-sourire, faible profondeur de champ, reflets mouillés
88sur le comptoir, gouttes de pluie visibles contre le ciel sombre derrière elle.
99Audio : pluie régulière, bourdonnement lointain de la circulation, tintement
1010d'une tasse en céramique.
1111Cinématographique, anamorphique, 35mm, plage dynamique élevée, grain de film fin.

Paramètres : Résolution 1080P, Ratio d'aspect 16:9, Durée 10, Extension de prompt OFF.

L'extension de prompt est activée par défaut et elle réécrit votre prompt avant la génération, ce qui détruit silencieusement le contrôle des plans par timecode. Désactivez-la dès que le découpage des plans est important.

Réglez la durée sur 10 plutôt que le maximum de 15 secondes. Ce n'est pas une décision de coût, et la raison n'est visible qu'à l'étape 3.

Interface d'un générateur vidéo IA montrant un prompt textuel et une sortie vidéo terminée

Wan 2.7 text-to-video sur Atlas Cloud, exécution terminée, sortie 1080P visible dans le panneau OUTPUT

Étape 2 dans le playground : prompt collé, 1080P, 16:9, exécution terminée avec le résultat à droite. Notez le devis du bouton Run de 0,75 $ pour un travail de cinq secondes en 1080P, ce qui revient à 0,15 $ par seconde plutôt que le « à partir de 0,10 $ » du catalogue.

Étape 3 : Continuer, et observer où ça casse

Le point de terminaison image-à-vidéo de Wan 2.7 a un mode de continuation vidéo qui prend un clip existant et continue le tournage. Prenez l'URL de sortie de l'étape 2, mettez-la dans le champ video, réglez la Durée sur 15, et collez le Beat 2 :

textCopy

text
11Continuer le même plan ininterrompu avec un langage de caméra et un éclairage
22identiques. La descente en grue continue au-delà du bord du toit jusqu'au niveau
33de la rue, la caméra glissant vers l'avant à travers la pluie vers un taxi à
44l'arrêt au bord du trottoir, les essuie-glaces balayant. Conserver l'intensité
55de la pluie, la palette de couleurs des néons, le grain de film et l'audio
66ambiant identiques au clip source. Pas de coupure, pas de fondu, pas de
77changement de scène.

Cela produit le clip de 15 secondes en haut de cet article. Maintenant, les trois limites que j'ai rencontrées, dont aucune n'est dans la documentation.

Un : le clip source doit durer entre 2 et 10 secondes. C'est pourquoi l'étape 2 est plafonnée à 10. Générez une ouverture de 15 secondes et vous ne pouvez pas du tout l'étendre, car un fichier de 15 secondes n'est pas une entrée valide.

Deux : la durée demandée doit dépasser la durée source. Si vous fournissez un clip de 10 secondes et demandez 10 secondes, l'API le rejette catégoriquement : first_clip duration (10s after trim) must be less than the requested duration (10s). Ainsi, la sortie contient la source, et le maximum que vous pouvez gagner en un seul passage est de 5 secondes.

Trois : elle ne préserve pas votre clip source. C'est celui qui compte. Ci-dessous, la ligne du haut est le clip original de 10 secondes à 5s et 9,9s. La ligne du bas est la sortie de la continuation à ces deux mêmes timecodes.

Femme essuyant un comptoir et taxi roulant dans une rue mouillée

Quatre images comparant le clip source et la sortie de la continuation à 5 secondes et 9,9 secondes

Ligne du haut : le clip source à 5s et 9,9s. Ligne du bas : la sortie de la continuation aux mêmes timecodes. À 5s, ils correspondent. À 9,9s, la source est toujours sur le vendeur tandis que la continuation est déjà passée à la rue, car elle a recompressé la source dans ses six premières secondes environ et a passé le reste sur du nouveau contenu.

Donc la continuation n'est pas une concaténation. Elle réinterprète votre clip plus rapidement pour faire de la place, et les dernières secondes de votre performance originale sont tout simplement perdues.

Ce qui soulève l'idée évidente : enchaîner. Reprenez le résultat de 15 secondes et demandez encore 15 secondes. J'ai essayé. Voici ce qui est revenu.

Une femme essuie un plan de travail en métal mouillé la nuit

Une deuxième continuation enchaînée qui dérive en arrière vers le vendeur sur le toit au lieu de faire avancer la scène

La deuxième passe de continuation. Elle rejoue la rue et le taxi, puis boucle en arrière vers le vendeur sur le toit depuis le tout début de la séquence au lieu d'avancer. L'enchaînement ne s'accumule pas.

C'est le mur. Le plafond de sortie est de 15 secondes, le plafond d'entrée est de 10, et le deuxième maillon de la chaîne tourne en arrière. Quinze secondes de séquence vraiment continue est le plafond pour cette famille de modèles. Tout ce qui est plus long est une coupure, pas un plan, et les coupures sont exactement ce qu'un passage unique de 30 secondes est censé éliminer.

Une divulgation : la capture dans le playground pour cette étape de continuation a échoué trois fois car l'image de référence prédéfinie de la page ne cessait de détourner l'exécution, donc l'étape 3 a été exécutée via l'API plutôt que via l'interface du playground. Le prompt, les paramètres et les sorties ci-dessus proviennent tous de cette véritable exécution.

Ce que coûtent réellement 30 secondes de Wan 3.0 Preview

Le bouton Run à l'étape 2 a indiqué 0,75 $ pour un travail de cinq secondes en 1080P. Cela fait 0,15 $ par seconde, et non les 0,10 $ listés dans le catalogue, car le chiffre listé est un plancher et la facturation évolue avec la résolution. Faites toujours confiance au devis plutôt qu'à la carte.

À ce taux réel, mes 15 secondes de séquence continue ont coûté 1,50 $ pour l'ouverture de 10 secondes plus 2,25 $ pour la continuation, soit 3,75 $ pour 15 secondes livrées.

Tableau C : ce que coûtent 30 secondes, cinq façons

CheminCalculTotalCe que vous obtenez réellement
Wan 3.0 Preview, 1080P0,20 $ × 306,00 $30s continues, un passage, sans raccords
Wan 3.0 Preview, 720P0,10 $ × 303,00 $30s continues en 720P
Wan 3.0 Preview, 480P0,05 $ × 301,50 $30s continues en 480P
Wan 2.7, ouverture plus continuation0,15 $ × 25 facturé3,75 $15s seulement. Impossible d'atteindre 30.
Seedance 2.5, 480pà partir de 0,134 $ × 30~4,05 $30s continues, plafonné à 720p

Relisez la quatrième ligne. Produire 15 secondes continues sur Wan 2.7 a coûté plus cher que ce que Wan 3.0 facture pour 30 secondes continues en 720P. La solution de contournement n'est pas l'option bon marché, c'est l'option coûteuse qui en plus ne fonctionne pas.

Une mise en garde concernant la ligne Seedance : son taux listé est le plancher 480p et le modèle facture par zone de pixel, donc le 720p revient en pratique à environ 2,25 fois ce nombre.

En ce qui concerne les licences, soyez prudent. Wan 3.0 est en bêta, donc les conditions commerciales proviennent du contrat de service Alibaba Cloud que vous acceptez lors de la demande plutôt que d'une licence de modèle, et elles peuvent changer avant la disponibilité générale. Sans poids publiés, le déploiement local et le réglage fin ne sont pas des options. Confirmez les exigences d'attribution et de filigrane par rapport aux conditions de votre propre compte avant d'expédier un travail client.

Foire aux questions

Wan 3.0 Preview est-il déjà disponible pour tout le monde ?

Non. Il est entré en bêta publique le 6 août 2026, mais l'accès est soumis à une demande via Alibaba Cloud Model Studio et Qwen Cloud. Les comptes approuvés obtiennent 2 requêtes simultanées, 30 requêtes par minute et une file d'attente asynchrone de 50 tâches, ce qui est dimensionné pour l'évaluation plutôt que la production.

Wan 3.0 Preview est-il open source, et où sont les poids ?

Il n'y en a pas. L'interrogation de l'API Hugging Face pour chaque dépôt sous l'organisation Wan-AI ne renvoie rien au-dessus de Wan 2.2. Les trois dépôts les plus récents, tous des variantes de Wan2.2-Animate-2, ont été créés le même jour que le lancement de Wan 3.0. Wan 2.2 reste le plafond des poids ouverts.

Wan 3.0 Preview fait-il vraiment du 4K natif ?

Non. La documentation officielle liste 480P, 720P et 1080P. L'affirmation 4K provient de sites agrégateurs qui se citent les uns les autres plutôt que la source primaire, et elle contredit le propre tableau de prix d'Alibaba, qui a exactement trois paliers de résolution.

Combien coûte une vidéo de 30 secondes avec Wan 3.0 Preview ?

En 1080P, 0,20 $ par seconde de sortie donne 6,00 $ pour 30 secondes. En 720P, c'est 3,00 $ et en 480P, c'est 1,50 $. À titre de comparaison, 15 secondes continues sur Wan 2.7 en 1080P m'ont coûté 3,75 $ au taux réel facturé.

Puis-je générer un plan unique de 30 secondes aujourd'hui sans accès à Wan 3.0 Preview ?

Pas avec Wan 2.7. Son mode de continuation plafonne la sortie à 15 secondes, n'accepte que des clips sources de 10 secondes ou moins, et boucle en arrière lorsqu'on l'enchaîne. Seedance 2.5 fera 4 à 30 secondes en un seul passage, mais seulement jusqu'à 720p.

Wan 3.0 Preview contre Wan 2.7 : vaut-il la peine d'attendre ?

Si vous avez besoin d'un seul plan continu de plus de 15 secondes, ou d'entrées de référence de documents et de pages web, oui, et il n'y a pas de solution de contournement. Pour tout ce qui dure 15 secondes ou moins, Wan 2.7 est plus pratique pour le moment, car un plafond de simultanéité de 2 requêtes rend le travail par lots plus lent sur 3.0 que sur le modèle qu'il remplace.

Modèles récents

Une seule API pour toute l'IA multimédia.

Explorer tous les modèles