Seedance 2.5 · ByteDance
Trente secondes, en une seule génération
Une publicité entière, une démo de produit ou un temps fort de scène est généré sous forme d<b>une seule génération de trente secondes</b> plutôt que cinq clips à assembler — maintenus ensemble par jusquà cinquante ressources de référence, et édités ensuite sans devoir tout régénérer.
Disponible sur Popcraft, aux côtés de Seedance 2.0.
Trente secondes, deux fois
Deux des films de démonstration propres à ByteDance, à la durée pour laquelle le modèle a été conçu. Chacun est une seule génération : l'image, les mouvements de caméra et le son arrivent ensemble, sans aucun assemblage ultérieur.
Ce qu'il faut y observer
Les quatre gains sont les détails qui déterminent si un plan ressemble à une vraie séquence ou à un rendu.
Une lumière qui obéit à la pièce
Les reflets dans les yeux apparaissent comme du verre doté de profondeur, tandis que la direction, l'atténuation et la réflexion de la lumière respectent la physique de la scène au lieu de paraître peintes.
Des mouvements qui gardent leur trajectoire
Les trajectoires de travelling, de panoramique et d'inclinaison ressortent plus fluides et plus stables, ce qui permet à un mouvement de trente secondes de tenir sur toute sa durée.
L'expression sous forme de courbe
Des micro-expressions — un frémissement de l'œil, un pincement de lèvres — restituées sous forme de mouvement continu tout au long d'un temps, plutôt que saccadées entre différentes poses.
Peau, cheveux et l'effet d'inquiétante étrangeté
La texture de la peau, la brillance des cheveux et les micro-mouvements du visage sont plus proches d'un enregistrement caméra, réduisant l'aspect plastique qui trahit une image générée.
Quatre éléments changent, et un seul d'entre eux est la durée
La version 2.5 progresse sur quatre axes : des générations plus longues, des références plus riches, un montage précis et une création multilingue. La longueur fait la une. Le montage est le changement qui transforme concrètement le quotidien de travail.
Trente secondes en une seule génération
Jusqu'à trente secondes en une seule génération, en conservant le mouvement de caméra, la continuité et un arc narratif complet sur l'ensemble du clip. Seedance 2.0 plafonne à quinze. L'extension temporelle haute fidélité permet ensuite de prolonger un court clip vers l'avant, vers l'arrière ou de faire le pont entre deux clips.
Tout ce dont le plan a besoin, en un seul brief
Trente images, dix clips vidéo et dix clips audio peuvent être intégrés dans une seule génération : distribution, produit, lieu, comportement de la caméra, musique et voix combinés. Dans la version 2.0, ce plafond était de neuf images et trois clips.
Modifiez un détail, conservez le clip
L'édition vidéo contrôlable conserve le cadre, la caméra et le rythme, et ne réécrit que ce que vous désignez : un arrière-plan, un vêtement, un produit, l'expression d'un acteur, la musique. Un défaut dans une bonne séquence de trente secondes ne nécessite plus de tout régénérer.
Rédige ton brief avec tes propres mots
Le chinois, l'anglais, l'espagnol, l'indonésien, le malais, le thaï, l'arabe, le portugais, le vietnamien, le japonais et le coréen, entre autres, de manière native : le prompt n'a plus besoin d'être traduit avant que le modèle ne le lise. Le respect des instructions est renforcé sur tous les plans.
2.5 à côté de 2.0, ligne par ligne
Seedance 2.0 reste dans la gamme, et en 4K, c'est toujours l'outil idéal pour un plan court.
| Capacité | Seedance 2.0 | Seedance 2.5 |
|---|---|---|
| Plus longue génération unique | 15 s | 30 s |
| Images de référence | 9 | 30 |
| Clips vidéo et audio de référence | 3 | 10 vidéo + 10 audio |
| Durée totale de référence | 15 s | 30 s vidéo, 30 s audio, comptés séparément |
| Référence audio uniquement | — | Pris en charge |
| Horodatages dans le prompt | Numéros de plan uniquement | Horodatages en secondes entières |
| Images du sujet multi-vues | Déconseillé | Pris en charge |
| Rapport d'aspect de sortie | Six ratios fixes | Tout ratio de 0,4 à 2,5, défini par l'entrée |
| Sortie MOV, pour le montage et l'extension | — | Pris en charge — continuité des couleurs et de l'audio au niveau des raccords |
Chaque ressource a un rôle précis
Le nombre n'est que la partie facile. Ce qui le rend exploitable, c'est que chaque ressource est associée à un symbole @ et reçoit un rôle précis, afin que le modèle sache quelle image correspond à l'acteur et laquelle correspond à l'éclairage.
Jusqu'à 4K, 30 Mo chacun. JPEG, PNG, WebP, BMP, TIFF, GIF, HEIC, HEIF. Les ensembles multi-vues d'un même sujet sont pris en charge dans la version 2.5, alors que la version 2.0 les déconseillait.
Du 480p au 4K, 200 Mo chacun, 2 à 30 s par clip, MP4 ou MOV. Les clips se partagent un total de trente secondes.
15 Mo chacun, 2 à 30 s par clip, MP3 ou WAV, avec son propre total séparé de trente secondes. Les références uniquement audio sont une nouveauté de la version 2.5 — un fond sonore musical, une voix ou une piste d'effets peuvent guider le rythme, le calage sur le tempo et la synchronisation labiale à elles seules.
Ce que l'on peut demander à une référence de transmettre
- Sujet
- L'apparence ou la voix d'une personne, d'un animal, d'un produit, d'un accessoire, d'un lieu ou d'un personnage inventé — l'élément qui doit rester identique tout au long du clip.Utilise la femme de l'@image 1 comme personnage principal, marchant dans une rue de la ville au crépuscule.
- Mouvement
- L'action, le mouvement de caméra, le rythme et les effets sont extraits d'un clip et appliqués à un sujet différent. Le transfert s'effectue entre espèces et styles, et pas seulement d'une prise à l'autre.Suis le mouvement de caméra et le rythme de course dans @video 1 ; le sujet est @image 1.
- Modèle blanc
- Une ébauche 3D brute sans texture dirige la chorégraphie de la caméra et la mise en scène ; les matériaux finis, l'éclairage et l'atmosphère proviennent d'images fixes. Une géométrie simplifiée fonctionne mieux ici qu'un modèle détaillé.Rends le mouvement du modèle blanc dans @video 1 ; sujet @image 1, scène @image 2.
- Style
- La palette, l'étalonnage et la texture sont extraits d'une image ou d'un clip, tandis que le casting reste le tien.Utilise l'étalonnage de nuit bleu froid de la @video 1, en conservant le personnage principal de l'@image 1.
- Audio
- Musique, mélodie, dialogue ou timbre vocal. Attribue une voix à chaque personnage et le film la reprendra.La voix du père : grave, posée, d'âge mûr. Référence @audio 1.
- Storyboard
- Un story-board à plusieurs cases lu comme une trame narrative. Quinze cases ou moins, un dessin au trait de préférence à un story-board rendu, et aucun texte dessiné dans les cases. Le résultat suit l'histoire, et non le dessin image par image.Suis les quatre cases dans @image 1 ; le personnage est @image 2.
- Images clés
- Une image pour la première frame, deux pour la première et la dernière, ou un ensemble d'images clés indépendantes. Contrairement à un storyboard, le rendu les suit fidèlement.@image 1 est la première image, @image 5 la dernière ; fais-la marcher de l'intérieur vers l'extérieur.




Le re-roll cesse d'être la seule option
Ces deux fonctionnalités prennent un clip terminé comme @video 1 et ne touchent à rien de ce que tu n'as pas nommé. L'édition réécrit une partie de ce qui existe déjà. L'extension écrit ce qui vient avant ou après.


Réécrire une zone, conserver le reste
Ajoute un sujet, supprime-en un, remplace un vêtement ou une scène par rapport à une image de référence, ou modifie l'audio — un fond musical différent, un effet ajouté, une réplique réenregistrée. Les horodatages limitent une modification à un intervalle : 0:02–0:05 et rien ne bouge en dehors.
La structure qui fonctionne se compose de trois parties : désigner la source, nommer l'objet et la modification, puis ajouter une clause de préservation pour que le modèle ne touche pas au reste de l'image.
Remplace la tenue sombre de l'homme dans @video 1\npar la tenue dans @image 2.\nConserve tout le reste inchangé.
Écris ce qui vient avant et après
Étendez vers l'avant à partir de la dernière image, vers l'arrière dans l'instant précédant la première, ou générez le raccord manquant entre deux clips pour les assembler. Le personnage, la scène et la caméra se poursuivent de part et d'autre de la jonction, et la transition peut être rendue fluide aussi bien pour l'image que pour le son.
L'extension permet de transformer six excellentes secondes en trente secondes finalisées sans régénérer ce qui fonctionne déjà. L'import et l'export au format MOV constituent la méthode recommandée : ils préservent la cohérence des couleurs, de la luminosité et de l'audio au niveau du raccord.
Commencer à partir de la dernière image de @video 1 et prolonger de\n6 secondes : elle quitte le champ, le ciel s'assombrit,\nles lampadaires s'allument un à un. Garder une transition fluide.
Ce que l'entrée détermine pour toi
La version 2.5 divise les tâches selon que les ressources sources fixent la forme du résultat ou non. La version 2.0 ne fait pas cette distinction, et c'est ce qui risque le plus de surprendre les personnes effectuant la transition.
| Tâche | Format d'image | Durée |
|---|---|---|
| Édition | Verrouillé sur le clip source | Suit la source, à environ un tiers de seconde près |
| Première image, ou première et dernière | Verrouillé sur la première image | À toi de définir |
| Extension | Verrouillé sur le clip source | À toi de définir |
| Génération de référence | Ouvert | À toi de définir |
| Storyboards et images clés | Ouvert | À toi de définir |
Là où trente secondes font toute la différence
Les cas d'usage du modèle se divisent en cinq catégories. Quatre d'entre eux sont des tâches qui deviennent plus rapides. Le cinquième ne devient possible que lorsqu'une génération atteint cette durée.
Une scène qui se déroule
Un temps fort de l'intrigue qui se déroule sur toute sa longueur en une seule génération, avec un ensemble maintenu cohérent grâce à une série d'images de référence. Les corrections de continuité — un équipement visible, un objet parasite — deviennent une simple retouche au lieu d'un nouveau tournage.
Un master, puis toutes les déclinaisons
Un montage principal, puis des déclinaisons : remplace le SKU, le modèle, le texte à l'écran ou le marché, tout en verrouillant l'apparence du produit et le style de la marque par référence. La voix off suit dans les langues dont tu as besoin.
Toute l'idée en une seule prise
Une idée expliquée de bout en bout en trente secondes, un présentateur remplacé sans tout réenregistrer, et le même ensemble diffusé en plusieurs langues.
Une procédure, du début à la fin
Les étapes d'assemblage et de fonctionnement sont présentées de bout en bout, avec les plaques signalétiques, les panneaux de spécifications et le texte d'emballage réécrits pour chaque produit, tandis que le plan reste inchangé.
Le travail que quinze secondes refusaient
Bandes-annonces de jeux et graphismes 3D, présentateurs virtuels, court-métrage décliné en série, personnage vieilli ou relooké pour une version saisonnière.
Rédige-le comme une liste de plans
Considère le modèle comme un producteur lisant un brief structuré. La structure ci-dessous est celle qui survit lorsqu'elle est transmise à quelqu'un d'autre.









Cinq parties, dans cet ordre
Sujet, lieu, événement, genre et style, mouvement de caméra. Puis une séquence de plans — des horodatages à la seconde près ou des plans numérotés, les deux sont lus — décrivant pour chaque segment ce qui est vu, comment la caméra se déplace, ce qui est dit et ce qui est entendu. Termine par les constantes : l'angle, l'environnement, l'atmosphère, le son en arrière-plan.
Conserve environ une seconde d'histoire par seconde d'écran. S'il y en a trop peu dans une fenêtre, le modèle improvise ; s'il y en a trop, il coupe frénétiquement ou en abandonne la moitié.
Associe chacune d'elles dans le texte
Numérote les ressources dans l'ordre d'importation et lie chacune d'elles dans le prompt : laquelle est le sujet, la voix, l'action ou la scène. Inscrire un nom sur l'image et l'utiliser dans le prompt est le moyen le plus fiable d'obtenir deux fois le même personnage.
Lorsqu'une référence est déjà précise, indique de la suivre et arrête-toi là. Redécrire le mouvement qu'elle contient donne au modèle deux instructions à concilier.
img1–2 correspondent au personnage 1, doublé par @audio 1 ;\nimg3–4 correspondent au personnage 2, doublé par @audio 2.\nSuis l'action d'incantation de sort dans @video 1 et le\nmouvement d'orbite dans @video 2.
- Langage de caméra
- Les termes standards s'utilisent tels quels : cadrage, travelling avant, travelling arrière, panoramique, suivi, orbite, contre-plongée, plan-séquence, travelling contrarié, caméra au poing, variation de vitesse. Un terme spécialisé nécessite une explication simple juste après, et une transition exige d'indiquer son point de déclenchement ainsi que sa méthode.
- Action et expression
- Décrivez la majeure partie de l'action de manière globale et réservez les détails aux deux ou trois temps forts essentiels. Les expressions sont mieux interprétées lorsqu'elles sont décrites explicitement plutôt que désignées par une expression idiomatique.
- Le positif plutôt que le négatif
- Décrivez ce qui doit être présent. Les formulations négatives sont prises en compte lorsqu'elles concernent les sous-titres et l'audio (pas de sous-titres, pas de musique de fond), qui sont justement les deux éléments qu'un modèle est le plus susceptible d'ajouter sans qu'on le lui demande.
- Son
- L'ambiance, les effets, les dialogues et la musique peuvent chacun être créés à partir d'une référence audio et décrits dans le brief, y compris en précisant lesquels doivent s'effacer lorsque quelqu'un parle.
Ce que coûte une seconde de 2.5
Seedance 2.5 est facturé à la seconde produite, selon la résolution choisie. Les tarifs de votre forfait s'appliquent automatiquement — la réduction est liée au forfait et s'applique sur chaque génération.
Ce que coûte une génération Seedance 2.5 en 720p avec la facturation standard. Le 480p coûte 24 crédits par seconde, un moyen plus économique d'itérer avant le rendu final.
−20 % sur la facturation mensuelle. La réduction s'applique à chaque génération Seedance, pas seulement une fois.
−40 % sur la facturation mensuelle. Le tarif le plus avantageux, et la raison pour laquelle une génération de trente secondes vaut la peine d'être lancée deux fois.
Questions
Oui — Seedance 2.5 est disponible dans le sélecteur de modèles vidéo de Popcraft. Choisis-le à côté de Seedance 2.0, définis une durée allant jusqu'à trente secondes, puis génère.
Non. Seedance 2.0 et Seedance 2.0 4K restent dans la liste des modèles. Un plan produit de six secondes n'a pas besoin d'un plafond de trente secondes, et le rendu 4K est une raison de choisir la version 2.0. Ce que la version 2.5 apporte, c'est de la longueur, le nombre de références et la possibilité de modifier un clip existant.
Cinquante constitue un plafond, et il est conseillé de rester bien en dessous : huit sujets d'image ou moins, cinq ou moins lorsque les références principales sont audio ou vidéo, des clips de cinq à dix secondes et des storyboards de quinze vignettes ou moins. Au-delà, la stabilité diminue et les générations nécessitent des réitérations.
Prends un clip qui te plaît déjà et étends-le. L'extension est le test le moins cher de cette promesse, car elle part d'une séquence que tu as déjà jugée. Si le raccord tient — le visage, l'étalonnage, la vitesse de la caméra —, le reste des promesses du modèle vaut la peine d'investir dans une génération plus longue. Si ce n'est pas le cas, tu l'auras appris pour le prix de quelques secondes.
Trente secondes, c'est toute la publicité
Le raccord entre deux clips de quinze secondes est l'endroit où un film généré se trahit. Seedance 2.5 rend ce raccord optionnel.
Continuez à explorer
Modèles associés
MiniMax H3 génère des vidéos 2K à 24 fps avec bande-son stéréo synchronisée : effets, ambiance et dialogues. Multi-plans, 5 à 15 s, contrôle des images clés. Sur Popcraft.
Générez de la vidéo cinématographique en 4K à partir de texte, d'images ou de clips avec Seedance 2.0 sur Popcraft. Audio synchronisé natif, séquences multi-plans et détail d'une netteté absolue jusqu'en 4K (2160p).

Seedance 2.0 Mini est l'offre vidéo la plus légère de ByteDance — jusqu'à 50 % moins chère que Seedance 2.0 standard et ~2× plus rapide que Fast, avec des prompts texte, image, vidéo et audio. Disponible sur Popcraft.

Transformez vos images et vos prompts en vidéos cinématographiques avec Seedance 2.0 sur Popcraft. Génération à partir de références, première/dernière image et formats d'image multiples jusqu'en 4K.
