
Wan 2.5 Video Extend API by Alibaba
Extend your videos with Alibaba WAN 2.5 video extender model with audio.
Wan 2.5 - Le choix des créateurs vidéo avisés
POPULAIREGénération audio-vidéo synchronisée tout-en-un
Wan 2.5 est un modèle d'IA révolutionnaire de génération vidéo qui crée du contenu audio-vidéo synchronisé en une seule étape. Plus besoin d'enregistrer la voix séparément ni d'aligner les lèvres manuellement : il suffit de fournir un prompt clair et structuré pour générer instantanément des vidéos complètes avec audio/voix off et synchronisation labiale.
Pourquoi choisir Wan 2.5 ?
Plus abordable
Malgré les récentes baisses de prix de Google, Veo 3 reste globalement onéreux. Wan 2.5 est léger et économique, offrant aux créateurs davantage d'options tout en réduisant considérablement les coûts de production.
Génération en une étape, synchronisation de bout en bout
Avec Wan 2.5, inutile d'enregistrer la voix séparément ou d'aligner manuellement les lèvres. Fournissez simplement un prompt clair et structuré pour générer en une seule fois des vidéos complètes avec audio/voix off et synchronisation labiale — plus rapide et plus simple.
Multilingue et accessible
Lorsque les prompts sont en chinois, Wan 2.5 génère de manière fiable des vidéos audio-visuelles synchronisées. En revanche, Veo 3 affiche souvent « langue inconnue » pour les prompts en chinois.
Recréation précise des personnages
Wan 2.5 excelle dans la restitution des traits des personnages, en reproduisant fidèlement leur apparence, leurs expressions et leurs styles de mouvement, rendant les personnages générés plus reconnaissables et personnalisés pour une narration et une immersion renforcées.
Rendu de style artistique
Prend en charge le rendu de style Studio Ghibli, créant des textures aquarelles peintes à la main et des effets d'animation. Offre des expériences visuelles chaleureuses et oniriques qui renforcent l'attrait artistique et la profondeur narrative.
Qui peut en bénéficier ?
Équipes marketing
Qu'il s'agisse de lancements de produits, de campagnes promotionnelles ou de marketing de marque, Wan 2.5 vous aide à générer rapidement des vidéos de haute qualité, rendant la création simple et efficace.
- Démonstrations produits et tutoriels sans tracas de coordination
- Marketing sur les réseaux sociaux avec sous-titres multilingues et synchronisation labiale
- Le contenu généré par IA libère les équipes pour se concentrer sur la stratégie et la créativité
Entreprises mondiales
Fournit des solutions idéales de localisation de contenu pour les multinationales, rendant la création plus facile et plus efficace.
- Support vidéo multilingue avec reconnaissance des prompts
- Génération en un clic de sous-titres et voix off synchronisés
- Localisation rapide du contenu pour les marchés mondiaux
Créateurs de contenu / YouTubers
Les créateurs peuvent tirer parti de Wan 2.5 pour améliorer leur efficacité de production vidéo tout en garantissant une sortie de haute qualité.
- Narration immersive avec des actions et expressions précises des personnages
- Meilleure efficacité de publication avec moins de montage et de post-production
- Contenus variés, des courtes vidéos aux segments de récits animés
Équipes de formation en entreprise
Wan 2.5 rend la formation en entreprise plus efficace et engageante.
- Des vidéos professionnelles remplacent les documents texte ennuyeux
- Création rapide de démonstrations opérationnelles et de tutoriels de formation
- Style cohérent et production standardisée pour un déploiement mondial
Créatifs indépendants / Petits studios
Wan 2.5 libère la créativité sans équipement coûteux ni acteurs — l'IA génère tout efficacement.
- Explorez des œuvres variées, des courts métrages aux contenus pour les réseaux sociaux
- De l'inspiration à l'achèvement grâce à la « génération en un clic »
- Contenu de haute qualité sans équipement coûteux ni acteurs professionnels
Établissements d'enseignement / Créateurs de cours en ligne
Transformez la créativité en réalité sans coûts élevés — Wan 2.5 rend la production de contenu de qualité simple et économique.
- Explorez divers styles, des courts métrages aux vidéos promotionnelles
- Meilleure efficacité de production, du concept au produit fini
- Contenu de qualité sans équipement coûteux ni talents professionnels
Capacités Principales
Génération A/V en une étape
Générez des vidéos complètes avec audio synchronisé, voix off et synchronisation labiale en un seul processus
Synchronisation de deux personnages
Prend en charge la génération simultanée de deux personnages avec actions, expressions et synchronisation labiale coordonnées pour des interactions naturelles
Qualité professionnelle
Sortie vidéo haute qualité avec des expressions réalistes des personnages et une synchronisation labiale précise
Support multilingue
Excellent support des prompts en chinois et génération fiable de contenu multilingue
Rapport qualité-prix
Coûts considérablement inférieurs à ceux des concurrents tout en maintenant une qualité professionnelle
Restitution des traits des personnages
Recrée avec précision l'apparence, les expressions et les styles de mouvement des personnages avec une haute fidélité et personnalité
Rendu de style artistique
Prend en charge divers styles artistiques, notamment les textures aquarelles peintes à la main d'inspiration Studio Ghibli
Scènes immersives
Idéal pour les scènes de dialogue, interviews ou courts métrages à deux personnages avec une cohérence audio-visuelle naturelle
Wan 2.5 Prompt Showcase
Discover the power of Wan 2.5 through these curated examples. From digital human lip-sync to dual character scenes, artistic rendering to character restoration - experience the possibilities.
Study Room Scholar
Middle-aged man reading with perfect lip-sync in a warm study environmentA middle-aged man sitting at a wooden desk in a cozy study room, surrounded by bookshelves and a warm lamp glow. He opens an old book and reads aloud with a calm, deep voice: 'History teaches us more than just facts… it shows us who we are.' The room has subtle background sounds: pages turning, the faint ticking of a clock, and distant rain against the window.
Park Sunset Romance
Couple interaction with synchronized dual character actions and expressionsA young couple sitting on a park bench during sunset. The woman leans her head on the man's shoulder. He whispers softly: 'No matter where we go, I'll always be here with you.' The sound includes the rustling of leaves, distant laughter of children playing, and the gentle hum of cicadas in the evening air.
Ballet Performance Art
Precise character trait restoration with artistic movement and expressionA graceful ballerina with her hair in a messy bun, performing a powerful and emotional contemporary ballet routine. She is in a minimalist, dark art studio. Abstract patterns of light and shadow, projected from a hidden source, dance across her body and the surrounding walls, constantly shifting with her movements. The camera focuses on the tension in her muscles and the expressive gestures of her hands. A single, dramatic slow-motion shot captures her mid-air leap, with the light patterns swirling around her like a galaxy. Moody, artistic, high contrast.
Ghibli Forest Magic
Studio Ghibli-inspired animation with hand-painted watercolor textureStudio Ghibli-inspired anime style. A young girl with a straw hat lies peacefully in a sun-dappled magical forest, surrounded by friendly, glowing forest spirits (Kodama). A gentle breeze rustles the leaves of the giant, ancient trees. The air is filled with sparkling dust motes, illuminated by shafts of sunlight. The art style is soft, with a hand-painted watercolor texture. The scene feels serene, magical, and heartwarming.
Parfait Pour
Spécifications Techniques
Découvrez Wan 2.5 - Votre révolution dans la création vidéo
Rejoignez les milliers de créateurs et d'entreprises qui transforment leur création de contenu vidéo grâce à la génération audio-vidéo synchronisée.
Wan 2.5: A next-generation AI video generation model developed by Alibaba Wanxiang.
Model Card Overview
| Field | Description |
|---|---|
| Model Name | Wan 2.5 |
| Developed By | Alibaba Group |
| Release Date | September 24, 2025 |
| Model Type | Generative AI, Video Foundation Model |
| Related Links | Official Website: https://wan.video/, Hugging Face: https://huggingface.co/Wan-AI, Technical Paper (Wan Series): https://arxiv.org/abs/2503.20314 |
Introduction
Wan 2.5 is a state-of-the-art, open-source video foundation model developed by Alibaba's Wan AI team. It is designed to generate high-quality, cinematic videos complete with synchronized audio directly from text or image prompts. The model represents a significant advancement in the field of generative AI, aiming to lower the barrier for creative video production. Its core contribution lies in its ability to produce coherent, dynamic, and narratively consistent video clips with a high degree of realism and integrated audio-visual elements, such as lip-sync and sound effects, in a single, streamlined process.
Key Features & Innovations
Wan 2.5 introduces several key features that distinguish it from previous models and competitors:
- Unified Audio-Visual Synthesis: Unlike many models that require separate steps for video and audio generation, Wan 2.5 creates video with natively synchronized audio, including voice, sound effects, and lip-sync, in one step.
- High-Fidelity, High-Resolution Output: The model is capable of generating videos in multiple resolutions, including 480p, 720p, and full 1080p HD, with significant improvements in visual quality and frame-to-frame stability over its predecessors.
- Extended Video Duration: Wan 2.5 can generate video clips up to 10 seconds in length, offering more creative flexibility for storytelling compared to other models in its class.
- Advanced Cinematic Control: The model demonstrates a sophisticated understanding of cinematic language, allowing for precise control over camera movement, shot composition, and character consistency within scenes.
- Open-Source Commitment: Following the precedent set by earlier versions, the Wan series of models, including Wan 2.5, are open-sourced to encourage research, development, and innovation within the broader AI community.
Model Architecture & Technical Details
Wan 2.5 is built upon the Diffusion Transformer (DiT) paradigm, which has become a mainstream approach for high-quality generative tasks. The technical report for the Wan model series outlines a suite of innovations that contribute to its performance.
The architecture includes a novel Variational Autoencoder (VAE) designed for high-efficiency video compression, enabling the model to handle high-resolution video data effectively. The Wan series is available in multiple sizes to balance performance and computational requirements, such as the 1.3B and 14B parameter models detailed for Wan 2.2. The model was trained on a massive, curated dataset comprising billions of images and videos, which enhances its ability to generalize across a wide range of motions, semantics, and aesthetic styles.
Intended Use & Applications
Wan 2.5 is designed for a wide array of applications in creative and commercial fields. Its intended uses include:
- Content Creation: Generating short-form videos for social media, marketing campaigns, and digital advertising.
- Storytelling and Filmmaking: Creating cinematic scenes, character animations, and narrative sequences for short films and conceptual art.
- Prototyping: Rapidly visualizing scripts and storyboards for film, television, and game development.
- Personalized Media: Enabling users to create unique, personalized video content from their own ideas and images.
Performance
Wan 2.5 has demonstrated significant performance improvements over previous versions and holds a competitive position against other leading video generation models. Independent reviews and benchmarks provide insight into its capabilities.
Benchmark Scores
A review conducted by Curious Refuge Labs™ evaluated the model's visual generation capabilities across several metrics.
| Metric | Score (out of 10) |
|---|---|
| Prompt Adherence | 7.0 |
| Temporal Consistency | 6.6 |
| Visual Fidelity | 6.5 |
| Motion Quality | 5.9 |
| Style & Cinematic Realism | 5.7 |
| Overall Score | 6.3 |
These scores indicate strong prompt understanding and a notable improvement in visual quality from Wan 2.2, although it still shows limitations in complex motion and realism compared to top-tier commercial models.


















