NEWVotre prochaine publicité UGC virale est à portée de clic. Découvrez Studio.Créer une publicité
PopcraftPopcraft
Nouveau modèle

Seedance 2.5 · ByteDance

Trente secondes, en une seule génération

Une publicité entière, une démo de produit ou un temps fort de scène est généré sous forme d<b>une seule génération de trente secondes</b> plutôt que cinq clips à assembler — maintenus ensemble par jusquà cinquante ressources de référence, et édités ensuite sans devoir tout régénérer.

Disponible sur Popcraft, aux côtés de Seedance 2.0.

30 sen une seule génération
50ressources de référence par tâche
10+langues, en natif
Par rapport à Seedance 2.0
Plus longue génération unique
15 s30 s
Images de référence
930
Clips de référence, vidéo + audio
310 + 10
Rapport d'aspect de sortie
6 ratios fixes0,4–2,5
Modèles vidéo sur Popcraft

Trente secondes, deux fois

Deux des films de démonstration propres à ByteDance, à la durée pour laquelle le modèle a été conçu. Chacun est une seule génération : l'image, les mouvements de caméra et le son arrivent ensemble, sans aucun assemblage ultérieur.

Seedance 2.51920×108029.98sAvec sonUn coin de rue, de bout en bout. Une seule génération, avec la musique et les bruits de la rue qui arrivent en même temps que l'image. La caméra change neuf fois de cadrage au cours de celle-ci — au niveau de la rue, vue de dessus du croisement, gros plans sur les visages, plan large à contre-jour — et aucun de ces changements n'est un raccord entre plusieurs générations. C'est le film qui passe en arrière-plan sans son sous le titre en haut de la page. Ici, il a sa bande-son.
Seedance 2.51280×72030.04sAvec sonUne vidéo explicative avec un début, un milieu et une fin. L'histoire de la monnaie dans un seul décor en pâte à modeler — troc, pièce, billet, banque, paiement sans contact — à travers neuf étapes scénarisées qui conservent la matière, la lumière et l'échelle tout du long.

Ce qu'il faut y observer

Les quatre gains sont les détails qui déterminent si un plan ressemble à une vraie séquence ou à un rendu.

Éclairage

Une lumière qui obéit à la pièce

Les reflets dans les yeux apparaissent comme du verre doté de profondeur, tandis que la direction, l'atténuation et la réflexion de la lumière respectent la physique de la scène au lieu de paraître peintes.

Appareil photo

Des mouvements qui gardent leur trajectoire

Les trajectoires de travelling, de panoramique et d'inclinaison ressortent plus fluides et plus stables, ce qui permet à un mouvement de trente secondes de tenir sur toute sa durée.

Performance

L'expression sous forme de courbe

Des micro-expressions — un frémissement de l'œil, un pincement de lèvres — restituées sous forme de mouvement continu tout au long d'un temps, plutôt que saccadées entre différentes poses.

Réalisme

Peau, cheveux et l'effet d'inquiétante étrangeté

La texture de la peau, la brillance des cheveux et les micro-mouvements du visage sont plus proches d'un enregistrement caméra, réduisant l'aspect plastique qui trahit une image générée.

Quatre éléments changent, et un seul d'entre eux est la durée

La version 2.5 progresse sur quatre axes : des générations plus longues, des références plus riches, un montage précis et une création multilingue. La longueur fait la une. Le montage est le changement qui transforme concrètement le quotidien de travail.

Longueur
30 s une génération

Trente secondes en une seule génération

Jusqu'à trente secondes en une seule génération, en conservant le mouvement de caméra, la continuité et un arc narratif complet sur l'ensemble du clip. Seedance 2.0 plafonne à quinze. L'extension temporelle haute fidélité permet ensuite de prolonger un court clip vers l'avant, vers l'arrière ou de faire le pont entre deux clips.

Références
50 ressources par tâche

Tout ce dont le plan a besoin, en un seul brief

Trente images, dix clips vidéo et dix clips audio peuvent être intégrés dans une seule génération : distribution, produit, lieu, comportement de la caméra, musique et voix combinés. Dans la version 2.0, ce plafond était de neuf images et trois clips.

Édition
Local réécritures

Modifiez un détail, conservez le clip

L'édition vidéo contrôlable conserve le cadre, la caméra et le rythme, et ne réécrit que ce que vous désignez : un arrière-plan, un vêtement, un produit, l'expression d'un acteur, la musique. Un défaut dans une bonne séquence de trente secondes ne nécessite plus de tout régénérer.

Langue
10+ langues

Rédige ton brief avec tes propres mots

Le chinois, l'anglais, l'espagnol, l'indonésien, le malais, le thaï, l'arabe, le portugais, le vietnamien, le japonais et le coréen, entre autres, de manière native : le prompt n'a plus besoin d'être traduit avant que le modèle ne le lise. Le respect des instructions est renforcé sur tous les plans.

2.5 à côté de 2.0, ligne par ligne

Seedance 2.0 reste dans la gamme, et en 4K, c'est toujours l'outil idéal pour un plan court.

CapacitéSeedance 2.0Seedance 2.5
Plus longue génération unique15 s30 s
Images de référence930
Clips vidéo et audio de référence310 vidéo + 10 audio
Durée totale de référence15 s30 s vidéo, 30 s audio, comptés séparément
Référence audio uniquementPris en charge
Horodatages dans le promptNuméros de plan uniquementHorodatages en secondes entières
Images du sujet multi-vuesDéconseilléPris en charge
Rapport d'aspect de sortieSix ratios fixesTout ratio de 0,4 à 2,5, défini par l'entrée
Sortie MOV, pour le montage et l'extensionPris en charge — continuité des couleurs et de l'audio au niveau des raccords

Chaque ressource a un rôle précis

Le nombre n'est que la partie facile. Ce qui le rend exploitable, c'est que chaque ressource est associée à un symbole @ et reçoit un rôle précis, afin que le modèle sache quelle image correspond à l'acteur et laquelle correspond à l'éclairage.

Images
30 par tâche

Jusqu'à 4K, 30 Mo chacun. JPEG, PNG, WebP, BMP, TIFF, GIF, HEIC, HEIF. Les ensembles multi-vues d'un même sujet sont pris en charge dans la version 2.5, alors que la version 2.0 les déconseillait.

Clips vidéo
10 par tâche

Du 480p au 4K, 200 Mo chacun, 2 à 30 s par clip, MP4 ou MOV. Les clips se partagent un total de trente secondes.

Clips audio
10 par tâche

15 Mo chacun, 2 à 30 s par clip, MP3 ou WAV, avec son propre total séparé de trente secondes. Les références uniquement audio sont une nouveauté de la version 2.5 — un fond sonore musical, une voix ou une piste d'effets peuvent guider le rythme, le calage sur le tempo et la synchronisation labiale à elles seules.

Ce que l'on peut demander à une référence de transmettre

Sujet
L'apparence ou la voix d'une personne, d'un animal, d'un produit, d'un accessoire, d'un lieu ou d'un personnage inventé — l'élément qui doit rester identique tout au long du clip.Utilise la femme de l'@image 1 comme personnage principal, marchant dans une rue de la ville au crépuscule.
Mouvement
L'action, le mouvement de caméra, le rythme et les effets sont extraits d'un clip et appliqués à un sujet différent. Le transfert s'effectue entre espèces et styles, et pas seulement d'une prise à l'autre.Suis le mouvement de caméra et le rythme de course dans @video 1 ; le sujet est @image 1.
Modèle blanc
Une ébauche 3D brute sans texture dirige la chorégraphie de la caméra et la mise en scène ; les matériaux finis, l'éclairage et l'atmosphère proviennent d'images fixes. Une géométrie simplifiée fonctionne mieux ici qu'un modèle détaillé.Rends le mouvement du modèle blanc dans @video 1 ; sujet @image 1, scène @image 2.
Style
La palette, l'étalonnage et la texture sont extraits d'une image ou d'un clip, tandis que le casting reste le tien.Utilise l'étalonnage de nuit bleu froid de la @video 1, en conservant le personnage principal de l'@image 1.
Audio
Musique, mélodie, dialogue ou timbre vocal. Attribue une voix à chaque personnage et le film la reprendra.La voix du père : grave, posée, d'âge mûr. Référence @audio 1.
Storyboard
Un story-board à plusieurs cases lu comme une trame narrative. Quinze cases ou moins, un dessin au trait de préférence à un story-board rendu, et aucun texte dessiné dans les cases. Le résultat suit l'histoire, et non le dessin image par image.Suis les quatre cases dans @image 1 ; le personnage est @image 2.
Images clés
Une image pour la première frame, deux pour la première et la dernière, ou un ensemble d'images clés indépendantes. Contrairement à un storyboard, le rendu les suit fidèlement.@image 1 est la première image, @image 5 la dernière ; fais-la marcher de l'intérieur vers l'extérieur.
Plan large au niveau de la rue : le personnage principal avec une casquette rouge et un casque traverse au feu.Plan rapproché de côté : la même femme passe devant un mur en briques, le visage de profil.Plan large à contre-jour : elle marche vers la caméra sous un soleil bas, avec d'autres personnes derrière elle.Plan large final : elle se tient sur le passage piéton à la fin du film avec trois autres personnes.
Une personne, quatre configurations, une génération. Quatre images dans l'ordre issues du film de rue de trente secondes ci-dessus : un plan large à hauteur de rue, un profil rapproché, une approche en contre-jour, un plan large final. Maintenir un visage, un vêtement et une silhouette stables tout au long d'un clip, c'est la tâche confiée à une référence de sujet lorsque tu en rédiges une toi-même.
Un ensemble ciblé vaut mieux qu'un ensemble complet. La qualité dépend du mélange plutôt que du nombre : limitez les sujets d'image à huit ou moins, les sujets audio et vidéo à cinq, et les clips de référence à une durée de cinq à dix secondes, là où un clip de deux secondes apporte trop peu et un clip de trente secondes dilue l'essentiel. Lorsque des ressources sont en concurrence, la priorité va aux personnages principaux, puis aux produits et accessoires clés, puis à l'environnement, et enfin au style.

Le re-roll cesse d'être la seule option

Ces deux fonctionnalités prennent un clip terminé comme @video 1 et ne touchent à rien de ce que tu n'as pas nommé. L'édition réécrit une partie de ce qui existe déjà. L'extension écrit ce qui vient avant ou après.

Première image du film de rue : un croisement vide sur un coin ensoleillé, quelques personnes sur le trottoir d'en face.Dernière image du film de rue : quatre personnes debout ensemble sur le même croisement à la fin du film.
La première et la dernière image du film de rue de trente secondes. L'extension est demandée à l'un de ces deux bords : écris en arrière dans la minute précédant le croisement vide, ou en avant à partir du moment où le groupe se tient. L'édition agit sur tout ce qui se trouve entre les deux, en conservant le cadre et en ne réécrivant que ce que tu nommes.
Édition vidéo contrôlable

Réécrire une zone, conserver le reste

Ajoute un sujet, supprime-en un, remplace un vêtement ou une scène par rapport à une image de référence, ou modifie l'audio — un fond musical différent, un effet ajouté, une réplique réenregistrée. Les horodatages limitent une modification à un intervalle : 0:02–0:05 et rien ne bouge en dehors.

La structure qui fonctionne se compose de trois parties : désigner la source, nommer l'objet et la modification, puis ajouter une clause de préservation pour que le modèle ne touche pas au reste de l'image.

Remplace la tenue sombre de l'homme dans @video 1\npar la tenue dans @image 2.\nConserve tout le reste inchangé.
Extension temporelle haute fidélité

Écris ce qui vient avant et après

Étendez vers l'avant à partir de la dernière image, vers l'arrière dans l'instant précédant la première, ou générez le raccord manquant entre deux clips pour les assembler. Le personnage, la scène et la caméra se poursuivent de part et d'autre de la jonction, et la transition peut être rendue fluide aussi bien pour l'image que pour le son.

L'extension permet de transformer six excellentes secondes en trente secondes finalisées sans régénérer ce qui fonctionne déjà. L'import et l'export au format MOV constituent la méthode recommandée : ils préservent la cohérence des couleurs, de la luminosité et de l'audio au niveau du raccord.

Commencer à partir de la dernière image de @video 1 et prolonger de\n6 secondes : elle quitte le champ, le ciel s'assombrit,\nles lampadaires s'allument un à un. Garder une transition fluide.

Ce que l'entrée détermine pour toi

La version 2.5 divise les tâches selon que les ressources sources fixent la forme du résultat ou non. La version 2.0 ne fait pas cette distinction, et c'est ce qui risque le plus de surprendre les personnes effectuant la transition.

TâcheFormat d'imageDurée
ÉditionVerrouillé sur le clip sourceSuit la source, à environ un tiers de seconde près
Première image, ou première et dernièreVerrouillé sur la première imageÀ toi de définir
ExtensionVerrouillé sur le clip sourceÀ toi de définir
Génération de référenceOuvertÀ toi de définir
Storyboards et images clésOuvertÀ toi de définir
Fournis une première et une dernière image aux mêmes dimensions. Lorsqu'elles diffèrent, la dernière image est étirée pour correspondre à la première, et cet étirement est le modèle qui exécute les instructions données plutôt qu'un défaut à corriger dans le prompter.

Là où trente secondes font toute la différence

Les cas d'usage du modèle se divisent en cinq catégories. Quatre d'entre eux sont des tâches qui deviennent plus rapides. Le cinquième ne devient possible que lorsqu'une génération atteint cette durée.

Histoire et narration

Une scène qui se déroule

Un temps fort de l'intrigue qui se déroule sur toute sa longueur en une seule génération, avec un ensemble maintenu cohérent grâce à une série d'images de référence. Les corrections de continuité — un équipement visible, un objet parasite — deviennent une simple retouche au lieu d'un nouveau tournage.

Publicité et commerce

Un master, puis toutes les déclinaisons

Un montage principal, puis des déclinaisons : remplace le SKU, le modèle, le texte à l'écran ou le marché, tout en verrouillant l'apparence du produit et le style de la marque par référence. La voix off suit dans les langues dont tu as besoin.

Connaissances et explications

Toute l'idée en une seule prise

Une idée expliquée de bout en bout en trente secondes, un présentateur remplacé sans tout réenregistrer, et le même ensemble diffusé en plusieurs langues.

Industriel

Une procédure, du début à la fin

Les étapes d'assemblage et de fonctionnement sont présentées de bout en bout, avec les plaques signalétiques, les panneaux de spécifications et le texte d'emballage réécrits pour chaque produit, tandis que le plan reste inchangé.

Ce que permet la longueur supplémentaire

Le travail que quinze secondes refusaient

Bandes-annonces de jeux et graphismes 3D, présentateurs virtuels, court-métrage décliné en série, personnage vieilli ou relooké pour une version saisonnière.

La prévisualisation s'applique aux cinq. Un blocage gris sommaire — le genre qu'un artiste de layout crée en une après-midi — sert de source de mouvement, tandis que les matériaux finis, l'éclairage et l'atmosphère proviennent d'images fixes. La chorégraphie de caméra que tu as conçue subsiste dans le rendu, c'est pourquoi une géométrie grossière fonctionne mieux ici qu'un modèle détaillé.

Rédige-le comme une liste de plans

Considère le modèle comme un producteur lisant un brief structuré. La structure ci-dessous est celle qui survit lorsqu'elle est transmise à quelqu'un d'autre.

Deux figurines en argile troquent une toison contre un pot près d'un feu.Un marchand en pâte à modeler à un étal de marché brandit un collier de coquillages.Un marteau frappe une pièce d'or portant la tête d'un roi sur un bloc de bois.Une presse d'imprimerie en pâte à modeler éjecte un billet de banque.Une balance pèse un billet face à un plateau de pièces entre deux personnages.Un banquier est assis à un bureau avec des piles de billets et un coffre-fort derrière lui.Un personnage insère une carte dans un terminal à côté d'une pile de lingots d'or.Un personnage approche un téléphone d'un lecteur de carte devant une ligne d'horizon éclairée par des néons.L'ensemble du diorama en plan large : le décor étalé bout à bout sur une table, chaleureux à une extrémité et néon à l'autre.
Neuf images, dans l'ordre, issues du film en pâte à modeler de trente secondes ci-dessus. Le troc, les coquillages de monnaie, une pièce frappée, un billet imprimé, la balance, le banquier, la chambre forte, le paiement sans contact, l'ensemble complet. Voici à quoi ressemble un découpage technique une fois généré : neuf temps forts, chacun avec sa propre mise en scène, au sein d'une même tâche.
La structure

Cinq parties, dans cet ordre

Sujet, lieu, événement, genre et style, mouvement de caméra. Puis une séquence de plans — des horodatages à la seconde près ou des plans numérotés, les deux sont lus — décrivant pour chaque segment ce qui est vu, comment la caméra se déplace, ce qui est dit et ce qui est entendu. Termine par les constantes : l'angle, l'environnement, l'atmosphère, le son en arrière-plan.

Conserve environ une seconde d'histoire par seconde d'écran. S'il y en a trop peu dans une fenêtre, le modèle improvise ; s'il y en a trop, il coupe frénétiquement ou en abandonne la moitié.

Les ressources

Associe chacune d'elles dans le texte

Numérote les ressources dans l'ordre d'importation et lie chacune d'elles dans le prompt : laquelle est le sujet, la voix, l'action ou la scène. Inscrire un nom sur l'image et l'utiliser dans le prompt est le moyen le plus fiable d'obtenir deux fois le même personnage.

Lorsqu'une référence est déjà précise, indique de la suivre et arrête-toi là. Redécrire le mouvement qu'elle contient donne au modèle deux instructions à concilier.

img1–2 correspondent au personnage 1, doublé par @audio 1 ;\nimg3–4 correspondent au personnage 2, doublé par @audio 2.\nSuis l'action d'incantation de sort dans @video 1 et le\nmouvement d'orbite dans @video 2.
Langage de caméra
Les termes standards s'utilisent tels quels : cadrage, travelling avant, travelling arrière, panoramique, suivi, orbite, contre-plongée, plan-séquence, travelling contrarié, caméra au poing, variation de vitesse. Un terme spécialisé nécessite une explication simple juste après, et une transition exige d'indiquer son point de déclenchement ainsi que sa méthode.
Action et expression
Décrivez la majeure partie de l'action de manière globale et réservez les détails aux deux ou trois temps forts essentiels. Les expressions sont mieux interprétées lorsqu'elles sont décrites explicitement plutôt que désignées par une expression idiomatique.
Le positif plutôt que le négatif
Décrivez ce qui doit être présent. Les formulations négatives sont prises en compte lorsqu'elles concernent les sous-titres et l'audio (pas de sous-titres, pas de musique de fond), qui sont justement les deux éléments qu'un modèle est le plus susceptible d'ajouter sans qu'on le lui demande.
Son
L'ambiance, les effets, les dialogues et la musique peuvent chacun être créés à partir d'une référence audio et décrits dans le brief, y compris en précisant lesquels doivent s'effacer lorsque quelqu'un parle.

Ce que coûte une seconde de 2.5

Seedance 2.5 est facturé à la seconde produite, selon la résolution choisie. Les tarifs de votre forfait s'appliquent automatiquement — la réduction est liée au forfait et s'applique sur chaque génération.

Tarif catalogue, 720p
42 crédits / seconde

Ce que coûte une génération Seedance 2.5 en 720p avec la facturation standard. Le 480p coûte 24 crédits par seconde, un moyen plus économique d'itérer avant le rendu final.

Forfaits Pro
−40 % sur le tarif annuel

−20 % sur la facturation mensuelle. La réduction s'applique à chaque génération Seedance, pas seulement une fois.

Forfaits Max
−60 % sur le tarif annuel

−40 % sur la facturation mensuelle. Le tarif le plus avantageux, et la raison pour laquelle une génération de trente secondes vaut la peine d'être lancée deux fois.

Les tarifs actuels de chaque modèle sont disponibles sur la page des tarifs, qui indique les montants réellement appliqués à votre forfait.

Questions

Oui — Seedance 2.5 est disponible dans le sélecteur de modèles vidéo de Popcraft. Choisis-le à côté de Seedance 2.0, définis une durée allant jusqu'à trente secondes, puis génère.

Non. Seedance 2.0 et Seedance 2.0 4K restent dans la liste des modèles. Un plan produit de six secondes n'a pas besoin d'un plafond de trente secondes, et le rendu 4K est une raison de choisir la version 2.0. Ce que la version 2.5 apporte, c'est de la longueur, le nombre de références et la possibilité de modifier un clip existant.

Cinquante constitue un plafond, et il est conseillé de rester bien en dessous : huit sujets d'image ou moins, cinq ou moins lorsque les références principales sont audio ou vidéo, des clips de cinq à dix secondes et des storyboards de quinze vignettes ou moins. Au-delà, la stabilité diminue et les générations nécessitent des réitérations.

Prends un clip qui te plaît déjà et étends-le. L'extension est le test le moins cher de cette promesse, car elle part d'une séquence que tu as déjà jugée. Si le raccord tient — le visage, l'étalonnage, la vitesse de la caméra —, le reste des promesses du modèle vaut la peine d'investir dans une génération plus longue. Si ce n'est pas le cas, tu l'auras appris pour le prix de quelques secondes.

Trente secondes, c'est toute la publicité

Le raccord entre deux clips de quinze secondes est l'endroit où un film généré se trahit. Seedance 2.5 rend ce raccord optionnel.

Continuez à explorer

Modèles associés