Un extrait de 30 secondes donne à votre prompt trente occasions de s'effondrer. Seedance 2.5 officiellement lancé le 31 juillet 2026, déployé d'abord via Jimeng AI et le niveau professionnel Doubao, avec un accès API sur Volcano Ark à suivre. Longueur de sortie doublée, un plafond de 50 actifs de référence, et un contrôle d'édition plus fin récompensent une compétence par-dessus tout : écrire des prompts comme une liste de plans, chaque fichier de référence ayant un rôle nommé.

La bonne nouvelle pour ceux qui ont appris Seedance 2.0 : la grammaire n'a pas changé. Seedance 2.5 conserve la même division en trois tâches (référence, édition, extension) qui définissait Seedance 2.0. Ce qui a changé, c'est la quantité de matière que vous pouvez lui fournir, et combien de temps le modèle doit rester cohérent. Ce guide vous accompagne dans les deux.
Points clés
- Seedance 2.5 génère jusqu'à 30 secondes en un seul passage et accepte jusqu'à 50 actifs de référence par tâche : 30 images, 10 clips vidéo, 10 clips audio.
- La structure de base du prompt est reprise de Seedance 2.0 : définir les sujets, écrire des plans numérotés, mettre le dialogue entre {}, terminer par des mots de qualité et de contrainte.
- Les prompts d'édition suivent une règle stricte : dire "reference @video1" uniquement pour emprunter des traits. Pour les éditions, nommez la vidéo simplement, sinon le modèle peut interpréter votre édition comme une tâche de référence.
- Seedance 2.5 n'était pas encore listé sur Atlas Cloud au lancement. La même grammaire de référence fonctionne aujourd'hui sur la famille Seedance 2.0, à partir d'environ 0,09 $ par seconde avec la remise de 20 % en vigueur au 31 juillet 2026.
Ce que Seedance 2.5 change pour les rédacteurs de prompts
Quatre améliorations comptent au clavier. La sortie en un seul passage passe de 15 à 30 secondes. Le plafond de référence triple pour atteindre 50 actifs. L'édition devient une tâche de prompt de première classe avec sa propre grammaire, couverte dans sa propre section de ce guide. Et la génération de dialogue fonctionne désormais nativement dans plus de dix langues.

ByteDance qualifie la sortie de 30 secondes et le plafond de 50 actifs de premières mondiales. Considérez cela comme un argumentaire du fournisseur plutôt qu'un benchmark établi. Ce qui compte vraiment pour la qualité de sortie, c'est la direction : l'éclairage, les mouvements de caméra, le jeu d'acteur et la lisibilité émotionnelle se sont tous améliorés au point que l'entreprise propose désormais un travail de plan digne du cinéma, avec moins de ce vernis IA reconnaissable.
Une habitude à conserver néanmoins : tout ce qui est en dessous du plafond de 30 secondes se comporte toujours mieux lorsque le prompt est structuré. Un canevas plus long amplifie la dérive au lieu de la cacher.
Où s'entraîner : Exécuter des prompts Seedance sur Atlas Cloud
Au 31 juillet, Seedance 2.5 n'avait pas atteint les plateformes tierces ; l'accès API et le playground Ark devraient ouvrir complètement le 7 août 2026. La démarche pratique cette semaine : répéter exactement la même grammaire de référence sur la famille Seedance 2.0, qu'Atlas Cloud sert via sa famille de modèles Seedance avec text-to-video, image-to-video, et le playground multimodal reference-to-video. La syntaxe @ sujet, les emplacements de référence, les verbes d'édition : tout cela est transférable.
La tarification sur le point de terminaison de référence est basée sur les tokens, et la page du modèle indique les tarifs en vigueur clairement : la sortie 720p facture 0,2419 $ par seconde, et les tâches incluant une entrée vidéo descendent à 0,1486 $ par seconde en 720p. Les prix d'entrée dans la famille commencent plus bas. Les cartes text-to-video listent à partir d'environ 0,112 $ par seconde, soit environ 0,09 $ avec la remise de 20 % en vigueur au 31 juillet 2026. Seedance 2.0 Fast commence à environ 0,072 $ par seconde avec remise, et la variante légère Mini à environ 0,045 $. La remise est accompagnée d'un compte à rebours, donc vérifiez les chiffres actuels sur la page du modèle avant de budgétiser un projet.
Méthode 1 : Le playground Seedance sur Atlas Cloud
Connectez-vous, ouvrez le playground reference-to-video, et vous pouvez exécuter tous les modèles de cet article sans écrire de code. Téléchargez les fichiers de référence à gauche, puis tapez @ dans la zone de prompt pour lier un sujet à une image, une vidéo ou un slot audio spécifique.

L'exemple par défaut sur cette page vaut la peine d'être lu comme modèle. Chaque nom important est ancré à une @image, de sorte que le modèle ne devine jamais quelle ville ou quel robot vous voulez dire.
Méthode 2 : Prompts Seedance via l'API Atlas Cloud
Étape 1 : Obtenir une clé API. Créez-en une dans la console Atlas Cloud et copiez-la.


Étape 2 : Consultez la documentation API. Les points de terminaison, paramètres et authentification se trouvent dans la documentation API.
Étape 3 : Effectuez votre première requête. Le point de terminaison de référence prend le prompt plus des tableaux parallèles pour chaque type de référence :
plaintext1curl -X POST https://api.atlascloud.ai/api/v1/model/generateVideo \ 2 -H "Content-Type: application/json" \ 3 -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \ 4 -d '{ 5 "model": "bytedance/seedance-2.0/reference-to-video", 6 "prompt": "Define the woman in @image1 as Mara. Shot 1: medium tracking shot, Mara walks through the night market @image2, neon reflections on wet pavement. <sizzling from food stalls>", 7 "reference_images": ["https://your-cdn/mara-face-closeup.jpg", "https://your-cdn/night-market.jpg"], 8 "reference_videos": [], 9 "reference_audios": [], 10 "duration": -1, 11 "resolution": "720p", 12 "ratio": "16:9", 13 "generate_audio": true 14 }'
Définir duration à -1 laisse le modèle choisir une longueur naturelle dans la plage de 4 à 15 secondes de ce point de terminaison. Interrogez l'ID de prédiction retourné jusqu'à ce qu'il soit terminé :
plaintext1curl https://api.atlascloud.ai/api/v1/model/prediction/<prediction_id> \ 2 -H "Authorization: Bearer $ATLASCLOUD_API_KEY"
La réponse terminée contient l'URL de la vidéo hébergée. Comme Atlas Cloud exécute une API sur toute la plateforme, tout nouveau point de terminaison Seedance qui arrive devient un changement de ligne unique dans la chaîne du modèle. Vos tableaux de référence, votre boucle d'interrogation et vos fichiers de prompt restent intacts.
La formule du prompt Seedance 2.5, reprise de Seedance 2.0
Considérez le modèle comme un réalisateur multimodal qui lit votre texte, images, vidéo et audio, puis divise le travail en une couche spatiale (ce qui est dans le cadre) et une couche temporelle (comment cela change avec le temps). Cela se traduit par une formule à six emplacements, tout ce qui suit les deux premiers étant optionnel :
sujet + action ou événement + scène et environnement + style visuel + travail de caméra + son
L'expansion de l'ère Seedance 2.0 (mots d'éclairage, mots de qualité, une queue de contrainte comme "no subtitles, no watermark") s'intègre toujours dans ces emplacements, donc rien de ce que vous avez appris n'est perdu. Une règle à noter : les paramètres de génération tels que la durée et la résolution restent en dehors du prompt ; ils appartiennent à la page ou aux paramètres API.
En pratique, les six emplacements se réduisent à quatre lignes rédactionnelles. Voici l'exemple du modèle de base, traduit :

Les sujets viennent en premier car les références sont inutiles tant que le modèle ne sait pas quel visage vous voulez dire. Définissez chaque sujet une fois, avec deux ou trois caractéristiques stables, puis réutilisez l'étiquette partout.
- Définir la femme dans @image1 (robe rouge, chapeau de paille) comme Mara.
- Mara marche le long de la jetée au crépuscule...

Trois règles empêchent les définitions de fuiter. Donnez à chaque @ référence une description de tâche immédiate, y compris ce que le modèle doit ignorer : "dans le style de '@image1 pour les traits de la potière, les cheveux et le tablier vert, pas l'arrière-plan de l'image." Utilisez un gros plan serré du visage comme sa propre image, séparée des plans en pied, une astuce de l'ère Seedance 2.0 contre la dérive d'identité qui reste tout aussi efficace maintenant. Et gérez les vues multi-angles avec soin : avec cinq sujets ou moins, les images mono ou multi-vues fonctionnent toutes les deux, mais au-delà de cinq, il est préférable de s'en tenir aux vues uniques, de diviser les feuilles d'angles en images séparées et de les déclarer explicitement ("ces quatre images définissent la même lampe pliante ; une seule lampe apparaît dans la vidéo").
Le son et le texte ont chacun leur propre wrapper afin que le modèle ne confonde jamais le dialogue avec une légende :
| Type d'information | Wrapper | Exemple |
|---|---|---|
| Dialogue | { } | Elle sourit et dit {On peut certainement le faire} |
| Musique | ( ) | (musique rock entraînante en fond) |
| Effet sonore | < > | |
| Légende à l'écran | 【 】 | 【Chapitre Un : Le Départ】 |
Gardez chaque ligne de dialogue dans une langue, et nommez la langue avant les accolades. Pour le contrôle de l'accent, il y a un modèle dédié : langue, variante régionale, délivrance, locuteur, puis la ligne, comme dans "Dialogue language: natural, conversational American English. The girl says: {I thought you weren't coming.}"
Utiliser 50 emplacements de référence dans un prompt Seedance 2.5
Cinquante emplacements se décomposent en 30 images, 10 clips vidéo et 10 clips audio. Le temps vidéo et audio sont budgétés séparément : jusqu'à 30 secondes de références vidéo et 30 secondes d'audio, chaque clip durant entre 2 et 30 secondes. Les images vont jusqu'à 4K et 30 Mo chacune, les vidéos jusqu'à 4K et 200 Mo, l'audio 15 Mo en mp3 ou wav. La référence audio seule fonctionne aussi : vous pouvez ne donner au modèle qu'une piste audio et un prompt textuel. Le nombre d'emplacements triple par rapport à Seedance 2.0 et les images de référence doublent, et la pire chose que vous puissiez faire avec l'espace est de le remplir.

Gardez les références audio ou vidéo de sujet à cinq ou moins (six à dix si la tâche l'exige), et les images de sujet à huit ou moins (neuf à douze maximum). Les clips individuels fonctionnent mieux à 5 à 10 secondes : plus court qu'environ 2 secondes porte trop peu d'identité pour s'y accrocher, tandis qu'une référence complète de 30 secondes dilue les caractéristiques que vous souhaitez copier. Quand la pile grandit quand même, l'ordre de coupe recommandé est d'abord les personnages principaux, puis les produits ou accessoires clés, puis la scène, puis le style général.
Alors, à quoi sert la marge supplémentaire ? Les scènes d'ensemble. Un exemple phare précoce est une fête au palais de 30 secondes construite à partir de 20 images numérotées de personnages et d'accessoires plus trois échantillons vocaux, chaque invité ancré à une référence @. Sa liste de démonstration fonctionne de la même manière : scènes de groupe multi-personnages, une séquence wuxia de 32 références, et un transfert de mouvement sur un gorille grimpant s'appuient tous sur des références empilées en modalité complète.
Les listes de plans maintiennent la cohérence des prompts Seedance 2.5 de 30 secondes
L'habitude la plus efficace à conserver : arrêtez d'écrire du texte d'ambiance, commencez à écrire des plans numérotés. "Un homme court dans la rue, très cinématographique" ne donne rien à planifier à la couche temporelle. Une liste de plans le fait :
plaintext1Définir la fille dans @image1 comme Lin. @image2 définit la scène du dortoir. Référence @video1 pour le mouvement de caméra. 2Plan 1 : plan moyen en travelling, début de soirée. Lin marche jusqu'à la porte du dortoir, s'arrête, prend une respiration lente, légèrement nerveuse. Lumière chaude de la fenêtre du couloir. 3Plan 2 : coupe sur un plan moyen intérieur. Lin pousse la porte. Les colocataires lèvent les yeux de leurs bureaux. L'une demande {Alors ? Tu as réussi ?}. Lents demi-corps entre les visages. 4Plan 3 : gros plan sur Lin. Elle baisse la tête, puis éclate de rire et dit {Je vous ai tous eus}. Les colocataires la poursuivent dans la pièce. La caméra recule vers un plan large de la pièce. 5Réalisme documentaire, tons chauds, lumière douce. Les visages restent stables. Pas de sous-titres, pas de filigrane.

Cet exemple illustre bien le modèle. Chaque plan répond aux quatre mêmes questions :
| Ligne dans le plan | Quoi écrire | Exemple de formulation |
|---|---|---|
| Caméra | un mouvement par plan pour commencer, termes standards | "lent push-in", "caméra fixe", "coupe au gros plan" |
| Action | partie du corps plus vitesse ou force | "lève lentement la main", "serre la sangle fort" |
| Espace | où se trouve le sujet maintenant | "à la porte du dortoir", "traversant le toit" |
| Audio | dialogue, effets ou musique pour ce plan | {ligne}, , (musique) |
Deux règles d'écriture font le gros du travail. Quantifiez le mouvement (lentement, brusquement, légèrement) et nommez le membre qui le fait. Et externalisez l'émotion au lieu de l'étiqueter : "tête baissée, épaules légèrement tremblantes, doigts tordant l'ourlet de sa veste" anime, tandis que "elle est triste" ne le fait pas. Une règle de l'ère Seedance 2.0 s'est assouplie : la version précédente limitait chaque plan à un seul mouvement de caméra, tandis que Seedance 2.5 gère les mouvements combinés (suivi plus grue plus rotation en un seul plan-séquence d'entrée d'athlète) de manière stable. Commencez simple, combinez quand le plan le mérite.
Le timing est l'endroit où Seedance 2.5 rompt avec son prédécesseur. Les repères à la seconde près... déstabilisaient les générations dans Seedance 2.0. Cette limitation a disparu : les prompts Seedance 2.5 sont chronométrés partout : une séquence wuxia écrite en segments [0-3s], [3-5s], [5-10s], un explicatif de formation lunaire scripté seconde par seconde contre sa narration. L'ordre des plans porte toujours l'histoire ; les plages de secondes permettent désormais de fixer où un temps fort tombe dans la durée de 30 secondes. Voici comment ce prompt wuxia utilise son chronologie :

Prompts d'édition Seedance 2.5 : changer une chose, garder le reste
L'édition est l'endroit où le wording est le moins indulgent, car un verbe décide du type de tâche. La règle est explicite : écrivez "reference @video1" uniquement lorsque vous voulez emprunter des traits dans une nouvelle vidéo. Lorsque vous voulez modifier le clip lui-même, nommez-le simplement ("@video1", "strictly edit @video1"), sinon le modèle peut interpréter la tâche comme une tâche de référence et régénérer toute la scène.
Les bons prompts d'édition se compriment en trois mouvements : pointer vers la source avec @video1, délimiter exactement ce qui change (ajouter une image de référence si un sujet est remplacé), et fermer avec une ligne de verrouillage comme "everything else stays unchanged" pour que le modèle ne repeigne pas ce que vous n'avez jamais mentionné. Deux paramètres échappent à votre contrôle ici : un clip édité conserve le rapport d'aspect de la source et approximativement sa durée. Les extensions héritent également du rapport, mais leur longueur ajoutée est à vous de définir dans le prompt ("extend by 6 seconds").
| Opération | Modèle de phrase | Le reste reste stable ? |
|---|---|---|
| Ajouter | décrire le nouvel élément, quand il apparaît, où il apparaît | oui, les parties non mentionnées restent inchangées par défaut |
| Remplacer | "Strictly edit @video1, change [ancienne caractéristique] to [nouvelle caractéristique]" | oui, mais énoncez explicitement les éléments importants à conserver |
| Supprimer | nommer l'élément à supprimer, puis nommer ce qui doit rester | renforcer les éléments conservés aide sensiblement |
| Étendre | "Extend @video1 backward/forward: [ce qui se passe ensuite]" | le style, les sujets, l'histoire doivent être nommés comme constants |
| Re-sonoriser | "Keep @video1's picture and camera unchanged, replace the background music with @audio1" | les éditions audio laissent chaque image inchangée |
| Pont | "@video1, [description de la transition], then @video2" | Seedance 2.0 limite les entrées vidéo à 3 clips, 15 secondes au total ; le plafond de Seedance 2.5 monte à 10 clips, 30 secondes |
Le ciblage par horodatage et les éditions guidées par référence sont tous deux pris en charge ("replace the scene from 0:02 to 0:05 in @video1, keep the action and pacing") ; ainsi que les échanges sur fond vert et les changements de perspective de caméra en plus. La démonstration va plus loin que la plupart des gens n'iront : rééclairer une scène finie ("change @video1's light from harsh noon top-light to sunset side-light"), vieillir une actrice de la vingtaine à soixante ans en un seul plan continu, faire défiler un clip à travers les styles manga, anime et lavis d'encre, et remplacer en lot une bouteille de boisson sur trois couleurs de SKU, le tout classé sous édition, sans régénération complète.
Deux astuces de réparation de l'ère Seedance 2.0 restent bonnes à connaître en attendant que Seedance 2.5 se stabilise. Si un clip étendu saute à la jointure, rognez six images de la fin du premier segment et une du début du second avant d'assembler. Et si des passes d'extension répétées dégradent la qualité d'image, une solution de contournement consiste à convertir la source en un rendu de modèle 3D blanc d'abord, puis à étendre à partir de cette base propre.
Ce que Seedance 2.5 peut faire dans tous les secteurs
Ce qui a émergé est une galerie de cas d'utilisation claire : cinq secteurs croisés avec les quatre capacités principales, chaque cellule soutenue par un prompt travaillé et un clip fini. La carte, condensée :
| Domaine | Travaux emblématiques |
|---|---|
| Cinéma | un rythme narratif complet en une seule prise de 30 secondes, scènes d'ensemble à partir d'actifs d'acteurs empilés, suppression de bug de câble, un montage maître ré-oralisé dans plusieurs langues |
| Publicité, e-commerce | narration TVC en un seul plan, verrouillage du produit contre les actifs de marque, réécriture des étiquettes de prix, échanges de présentateur pour les marchés d'exportation |
| Éducation | un concept expliqué en 30 secondes, visualisations de principes, un personnage hôte cohérent à travers une série, livraison multilingue |
| Industriel | visites guidées d'assemblage, aperçus de produits en modèle 3D blanc, échanges de plaques signalétiques entre gammes de produits, formation à la sécurité dans plusieurs langues |
| IP de divertissement | bandes-annonces de style jeu vidéo, performances d'idoles virtuelles, vidéos de skins de vacances, animateurs virtuels multilingues |
Le plus discret d'abord : une histoire sans dialogue de 30 secondes racontée en un seul paragraphe, sans aucun numéro de plan, portée entièrement par la description de la scène et le son ambiant :
plaintext1Une histoire visuelle sans paroles de 30 secondes avec l'élégance tranquille de la France rurale, un après-midi d'été en Provence. Une jeune femme en robe de lin blanc cassé termine une lettre manuscrite à une vieille table en bois à l'intérieur d'un cottage en pierre, sort, suit un chemin de gravier à travers un champ de tournesols, et glisse la lettre dans une boîte aux lettres jaune vintage à la lisière du village. La caméra s'ouvre sur un gros plan en faible profondeur de champ du bureau, passe par la porte tandis que la lumière cède la place à l'ombre, puis s'élève et recule vers un plan large de la vallée dorée. Son ambiant seulement : cigales, vent, grattement de la plume sur le papier, le clic doux de la fermeture de la boîte aux lettres.

Quand un morceau repose sur une humeur continue, l'échafaudage de plans numérotés disparaît. Les deux modèles sont valides.
La galerie publicitaire montre le pipeline maître unique en deux étapes. Le maître est une publicité de 12 secondes avec un présentateur, scriptée avec des temps de dialogue par seconde. Chaque version localisée est ensuite une simple ligne d'édition :
plaintext1Remplacer le présentateur par une femme américaine, ré-oraliser le texte en anglais. 2Remplacer le présentateur par un homme espagnol, ré-oraliser le texte en espagnol. 3Remplacer le présentateur par une femme indonésienne, ré-oraliser le texte en indonésien.

La ligne éducation fusionne les deux techniques que ce guide a couvertes séparément : un documentaire de musée de 30 secondes où un guide traverse quatre galeries et parle anglais, mandarin, malais, puis japonais, chaque segment ancré à une fenêtre de 7,5 secondes. Et les prompts industriels FPV drone améliorent la queue de contrainte de la section formule au-delà du boilerplate : ils se ferment avec des contraintes de mouvement et de scène, des lignes comme "no on-screen text or markers, do not fly backward, weather and lighting stay constant."
Foire aux questions
Seedance 2.5 est-il disponible via une API ?
Pas encore au lancement. Le déploiement du 31 juillet couvre d'abord les propres applications de ByteDance, Jimeng AI et le niveau professionnel Doubao parmi elles. L'accès API et le playground Ark devraient ouvrir complètement le 7 août 2026, avec deux détails d'accès à signaler : pas de quota gratuit, et l'activation nécessite soit un solde de compte supérieur à 200 RMB, soit un pack de ressources Seedance 2.0 actif. La famille Seedance 2.0 reste entièrement servie via API entre-temps.
Les prompts Seedance 2.0 fonctionnent-ils toujours sur Seedance 2.5 ?
La structure se transfère : les définitions de sujet, les références @, les plans numérotés, les wrappers de dialogue et de son, et la division des tâches référence/édition/extension sont tous repris sans changement dans Seedance 2.5. Ce que vous devriez re-tester, ce sont les anciennes solutions de contournement, car plusieurs points douloureux de Seedance 2.0 (passages uniques courts, contrôle d'édition grossier, signaux de timing instables) sont exactement ce que Seedance 2.5 prétend corriger.
Combien de fichiers de référence un prompt Seedance 2.5 peut-il inclure ?
Jusqu'à 50 par tâche : 30 images, 10 clips vidéo et 10 clips audio. Les références vidéo totalisent jusqu'à 30 secondes, l'audio 30 autres, et chaque clip dure de 2 à 30 secondes. Le budget complet est destiné aux distributions d'ensemble et aux scènes fortement référencées ; la section sur les emplacements de référence ci-dessus couvre les ratios maximaux recommandés pour les tâches quotidiennes.
Seedance 2.5 peut-il générer des dialogues dans d'autres langues que l'anglais ou le chinois ?
Oui. Les langues prises en charge nativement incluent le chinois, l'anglais, l'espagnol, l'indonésien, le malais, le thaï, l'arabe, le portugais, le vietnamien, le japonais et le coréen parmi ses langues supportées nativement, et propose une distribution "un maître, plusieurs langues" : sa démo de bande-annonce ré-oralise le même montage en japonais et en français avec un prompt d'édition d'une ligne. Marquez la langue avant chaque ligne de dialogue ; le modèle d'accent de la section formule s'applique sans changement.
Combien de temps peut durer une vidéo Seedance 2.5 ?
Trente secondes en un seul passage, avec une extension multi-tours disponible en plus pour des coupes plus longues. Ne confondez pas cela avec les plafonds de 30 secondes sur les clips de référence ; ceux-ci budgétisent vos entrées, pas votre sortie.
Conclusion
Le langage du prompt est la partie stable. Les sujets définis une fois et référencés avec @, les plans numérotés dans l'ordre, le dialogue entre accolades, les contraintes à la fin : cette grammaire écrivait des clips de 15 secondes en février et écrit des clips de 30 secondes maintenant. Ce qui a changé, ce sont les plafonds autour. Entraînez-vous sur la grammaire avec les points de terminaison Seedance 2.0 aujourd'hui, gardez vos ensembles de référence petits et nommés, et une fois que Seedance 2.5 s'ouvrira via API, le portage de vos prompts devrait être l'étape facile.






