Seedance 2.5 · ByteDance
Dreißig Sekunden in einer einzigen Generierung
Eine komplette Anzeige, eine Produktdemo oder ein Szenenabschnitt wird als eine einzige dreißigsekündige Generierung ausgegeben, statt als fünf Clips und ein Übergang – zusammengehalten von bis zu fünfzig Referenz-Assets und im Nachhinein ohne erneutes Generieren bearbeitbar.
Live auf Popcraft, neben Seedance 2.0.
Dreißig Sekunden, zweimal
Zwei von ByteDances eigenen Demonstrationsfilmen in der Länge, für die das Modell entwickelt wurde. Jeder ist eine einzige Generierung – Bild, Kamerawechsel und Ton entstehen gleichzeitig, ohne dass nachträglich etwas zusammengesetzt wird.
Worauf du achten solltest
Die vier Vorteile sind die Details, die darüber entscheiden, ob eine Aufnahme wie reales Filmmaterial oder wie eine KI-Generierung wirkt.
Licht, das dem Raum gehorcht
Lichtreflexe in den Augen wirken wie Glas mit Tiefe, und Richtung, Abfall sowie Reflexion folgen der Physik der Szene, anstatt aufgemalt zu wirken.
Bewegungen, die ihre Linie halten
Kamerabewegungen wie Ranfahren, Zurückfahren, Schwenken und Neigen werden flüssiger und stabiler wiedergegeben – genau das sorgt dafür, dass eine 30-sekündige Bewegung über die vollen 30 Sekunden hinweg überzeugt.
Ausdruck als Kurve
Mikroausdrücke – ein Zittern am Auge, ein Zusammenpressen der Lippen –, die als kontinuierliche Bewegung über einen gesamten Takt hinweg übertragen werden, anstatt zwischen Posen umzuspringen.
Haut, Haare und die unheimliche Kluft
Hauttextur, Haarglanz und kleine Gesichtsbewegungen wirken realistischer, wie von einer Kamera aufgezeichnet – mit weniger Plastik-Look, der ein generiertes Gesicht verrät.
Vier Dinge ändern sich, und nur eines davon ist die Länge
2.5 macht Fortschritte in vier Bereichen: längere Generierungen, reichhaltigere Referenzen, präzise Bearbeitung und mehrsprachige Erstellung. Die Länge ist das Hauptmerkmal. Die Bearbeitung ist die Änderung, die man im Arbeitsalltag tatsächlich spürt.
Dreißig Sekunden aus einer einzigen Generierung
Bis zu dreißig Sekunden in einer einzigen Generierung, unter Beibehaltung von Kamerabewegung, Kontinuität und einem vollständigen Erzählbogen über den gesamten Clip. Seedance 2.0 ist auf fünfzehn beschränkt. High-Fidelity Temporal Extension führt einen kurzen Clip anschließend vorwärts, rückwärts oder verbindet zwei Clips miteinander.
Alles, was die Einstellung braucht, in einem Briefing
Dreißig Bilder, zehn Videoclips und zehn Audioclips können in eine einzige Generierung einfließen – Besetzung, Produkt, Drehort, Kameraführung, Musik und Stimme zusammen. In 2.0 lag diese Obergrenze bei neun Bildern und drei Clips.
Ändere ein Detail, behalte den Clip
Die steuerbare Videobearbeitung behält Frame, Kamera und Timing bei und schreibt nur das um, was du benennst: einen Hintergrund, ein Kleidungsstück, ein Produkt, den Gesichtsausdruck eines Schauspielers oder die Musik. Ein Makel in guten dreißig Sekunden ist kein Grund mehr, die Generierung neu zu starten.
Beschreibe es in deinen eigenen Worten
Chinesisch, Englisch, Spanisch, Indonesisch, Malaysisch, Thai, Arabisch, Portugiesisch, Vietnamesisch, Japanisch und Koreanisch unter anderem nativ – der Prompt muss nicht mehr übersetzt werden, bevor das Modell ihn liest. Die Befolgung von Anweisungen ist durchweg stärker.
2.5 neben 2.0, Zeile für Zeile
Seedance 2.0 bleibt im Line-up, und bei 4K ist es nach wie vor das richtige Werkzeug für eine kurze Einstellung.
| Leistungsfähigkeit | Seedance 2.0 | Seedance 2.5 |
|---|---|---|
| Längste Einzelgenerierung | 15s | 30 s |
| Referenzbilder | 9 | 30 |
| Referenzvideo- und -audioclips | 3 | 10 Video + 10 Audio |
| Gesamte Referenzdauer | 15s | 30 s Video, 30 s Audio, getrennt gezählt |
| Reine Audio-Referenz | — | Unterstützt |
| Zeitstempel im Prompt | Nur Shot-Nummern | Zeitstempel in ganzen Sekunden |
| Multi-View-Motivbilder | Nicht empfohlen | Unterstützt |
| Ausgabe-Seitenverhältnis | Sechs feste Seitenverhältnisse | Jedes Verhältnis von 0,4 bis 2,5, festgelegt durch die Eingabe |
| MOV-Ausgabe zur Bearbeitung und Verlängerung | — | Unterstützt – Farb- und Audiokontinuität über einen Übergang hinweg |
Jedes Asset wird mit einem Auftrag übermittelt
Die Anzahl ist der einfache Teil. Was es nutzbar macht, ist, dass jedes Asset mit einem @-Zeichen versehen und ihm eine festgelegte Rolle zugewiesen wird, sodass das Modell weiß, welches Bild der Darsteller und welches das Licht ist.
Bis zu 4K, jeweils 30 MB. JPEG, PNG, WebP, BMP, TIFF, GIF, HEIC, HEIF. Ansichten aus mehreren Blickwinkeln (Multi-View) desselben Motivs werden in 2.5 unterstützt, während 2.0 davon abriet.
480p bis 4K, jeweils 200 MB, 2–30 s pro Clip, MP4 oder MOV. Die Clips teilen sich eine Gesamtlänge von 30 Sekunden.
Jeweils 15 MB, 2–30 s pro Clip, MP3 oder WAV, mit einer eigenen, separaten Gesamtlänge von dreißig Sekunden. Reine Audio-Referenzen sind neu in 2.5 – eine Hintergrundmusik, eine Sprach- oder eine Effektspur können Tempo, Beat-Matching und Lippensynchronisation ganz von selbst steuern.
Was eine Referenz beinhalten kann
- Motiv
- Das Erscheinungsbild oder die Stimme einer Person, eines Tieres, eines Produkts, einer Requisite, eines Ortes oder eines erfundenen Charakters – das Element, das während des gesamten Clips unverändert bleiben muss.Verwende die Frau aus @image 1 als Hauptfigur, die in der Dämmerung durch eine Stadtstraße geht.
- Bewegung
- Aktion, Kamerabewegung, Timing und Effekte werden aus einem Clip übernommen und auf ein anderes Subjekt angewendet. Dies lässt sich über Spezies und Stile hinweg übertragen, nicht nur über verschiedene Einstellungen.Folge der Kamerabewegung und dem Laufrhythmus in @video 1; das Motiv ist @image 1.
- Weißes Modell
- Ein einfaches, untexturiertes 3D-Blockout steuert die Kamerachoreografie und die Inszenierung; die fertigen Materialien, die Beleuchtung und die Atmosphäre stammen aus Standbildern. Grobe Geometrie funktioniert hier besser als ein detailliertes Modell.Rendere die Bewegung im White-Model @video 1; Subjekt @image 1, Szene @image 2.
- Stil
- Farbpalette, Color Grading und Textur werden von einem Bild oder Clip übernommen, während die Besetzung deine bleibt.Verwende das kaltblaue Nacht-Color-Grading von @video 1 und behalte die Hauptfigur aus @image 1 bei.
- Audio
- Musik, Melodie, Dialog oder Stimmfarbe. Weise jedem Charakter eine Stimme zu, und der Film spricht in dieser Stimme.Die Stimme des Vaters: tief, gelassen, mittleren Alters. Referenz @audio 1.
- Storyboard
- Ein Multi-Panel-Board als Plot-Übersicht. Fünfzehn Panels oder weniger, bevorzugt Strichzeichnungen statt eines gerenderten Boards und kein in die Panels gezeichneter Text. Das Ergebnis folgt der Geschichte, nicht der Zeichnung Frame für Frame.Folge den vier Panels in @image 1; der Charakter ist @image 2.
- Keyframes
- Ein Bild als erstes Frame, zwei als erstes und letztes oder eine Reihe unabhängiger Keyframes. Anders als bei einem Storyboard folgt die Ausgabe diesen genau.@image 1 ist der erste Frame, @image 5 der letzte; führe sie von drinnen nach draußen.




Erneutes Generieren ist nicht mehr die einzige Option
Beide Funktionen nehmen einen fertigen Clip als @video 1 und lassen alles unverändert, was du nicht benannt hast. Beim Bearbeiten wird ein Teil des bereits Vorhandenen umgeschrieben. Beim Erweitern wird geschrieben, was davor oder danach kommt.


Einen Bereich umschreiben, den Rest beibehalten
Füge ein Subjekt hinzu, entferne eines, tausche ein Kleidungsstück oder eine Szene anhand eines Referenzbildes aus oder ändere das Audio – eine andere Musikspur, ein hinzugefügter Effekt, eine neu vertonte Zeile. Zeitstempel grenzen eine Bearbeitung auf ein Fenster ein: 0:02–0:05, und nichts außerhalb davon bewegt sich.
Das funktionierende Muster besteht aus drei Teilen: auf die Quelle zeigen, das Objekt und die Änderung benennen und dann eine Bewahrungsklausel hinzufügen, damit das Modell den Rest des Frames unberührt lässt.
Ersetze das dunkle Outfit des Mannes in @video 1\ndurch das Outfit in @image 2.\nLasse alles andere unverändert.
Schreibe, was davor und danach kommt
Erweitere vom letzten Frame nach vorne, vom ersten Frame nach hinten in den Moment davor oder generiere die fehlende Übergangsbrücke zwischen zwei Clips, damit sie nahtlos ineinander übergehen. Figur, Szene und Kamera werden über den Übergang hinweg beibehalten, und der Übergang kann sowohl in Bild als auch Ton nahtlos gestaltet werden.
Verlängerung ist die Möglichkeit, aus starken sechs Sekunden fertige dreißig zu machen, ohne den bereits funktionierenden Teil neu zu generieren. MOV als Import und Export ist der empfohlene Weg – so bleiben Farbe, Helligkeit und Audiokonsistenz über den Schnitt hinweg erhalten.
Starte mit dem letzten Frame von @video 1 und verlängere um\n6 Sekunden: Sie verlässt das Bild, der Himmel verdunkelt sich,\nStraßenlaternen gehen nacheinander an. Halte es nahtlos.
Was die Eingabe für dich entscheidet
2.5 teilt Aufträge danach auf, ob die Quell-Assets die Form der Ausgabe festlegen. 2.0 zieht keine solche Grenze, und das ist der Punkt, der Umsteiger am ehesten überrascht.
| Aufgabe | Seitenverhältnis | Dauer |
|---|---|---|
| Bearbeitung | An den Quellclip gebunden | Folgt der Quelle, innerhalb etwa einer Drittelsekunde |
| Erstes Frame oder erstes und letztes | An das erste Einzelbild gebunden | Frei einstellbar |
| Verlängerung | An den Quellclip gebunden | Frei einstellbar |
| Referenzgenerierung | Offen | Frei einstellbar |
| Storyboards und Keyframes | Offen | Frei einstellbar |
Wo sich dreißig Sekunden wirklich lohnen
Die Anwendungsfälle des Modells lassen sich in fünf Kategorien unterteilen. Vier davon sind Aufgaben, die kürzer werden. Die fünfte wird erst möglich, wenn eine Generierung so lange dauert.
Eine Szene, die sich entfaltet
Ein Handlungselement, das seine volle Länge in einer einzigen Generierung durchläuft, mit einem Ensemble, das durch ein Set von Referenz-Stills zusammengehalten wird. Kontinuitätskorrekturen – ein sichtbares Rig, ein verstreutes Objekt – werden zu einer Bearbeitung statt zu einem Nachdreh.
Ein Master, dann jede Version
Ein Master-Cut, dann Versionen: Tausche die SKU, das Modell, den Bildschirmtext oder den Markt aus, während das Erscheinungsbild des Produkts und der Look der Marke per Referenz fixiert bleiben. Voiceover folgt in den Sprachen, die du benötigst.
Die gesamte Idee in einer einzigen Einstellung
Eine Idee, die in dreißig Sekunden durchgehend erklärt wird, ein Präsentator, der ohne Neuaufnahme ausgetauscht wird, und dasselbe Set, das in mehreren Sprachen bereitgestellt wird.
Ein Ablauf von Anfang bis Ende
Montage- und Bedienungsschritte werden von Anfang bis Ende gezeigt, wobei Typenschilder, Spezifikationstafeln und Verpackungstexte je nach Produkt angepasst werden und die Aufnahme bestehen bleibt.
Die Arbeit, die in fünfzehn Sekunden nicht möglich war
Spieletrailer und CG, virtuelle Moderatoren, ein Kurzfilm zu einer Serie erweitert, ein gealterter oder für einen saisonalen Zuschnitt neu gestalteter Charakter.
Schreibe es wie eine Einstellungsliste
Betrachte das Modell als einen Produzenten, der ein strukturiertes Briefing liest. Die untenstehende Form ist diejenige, die auch bei der Weitergabe an andere Bestand hat.









Fünf Teile in dieser Reihenfolge
Subjekt, Ort, Ereignis, Genre und Stil, Kamerabewegung. Danach eine Shot-Sequenz – Zeitstempel in ganzen Sekunden oder nummerierte Shots, beides wird erkannt –, die pro Segment beschreibt, was zu sehen ist, wie sich die Kamera bewegt, was gesagt und was gehört wird. Schließe mit den Konstanten ab: dem Winkel, der Umgebung, der Atmosphäre und dem Sound, der im Hintergrund läuft.
Behalte etwa eine Sekunde Story pro Sekunde Bildschirmzeit bei. Bei zu wenig Input in einem Zeitfenster improvisiert das Modell; bei zu viel schneidet es entweder hektisch oder lässt die Hälfte weg.
Weise jedes einzelne im Text zu
Nummeriere Assets in der Reihenfolge des Uploads und binde jedes im Prompt ein: welches das Motiv, welches die Stimme, welches die Handlung und welches die Szene ist. Das Schreiben eines Namens auf das Bild und dessen Verwendung im Prompt ist der zuverlässige Weg, zweimal denselben Charakter zu erhalten.
Wenn eine Referenz bereits genau ist, gib an, dass ihr gefolgt werden soll, und belasse es dabei. Das erneute Beschreiben der darin enthaltenen Bewegung gibt dem Modell zwei Vorgaben, die es in Einklang bringen muss.
img1–2 sind Figur 1, gesprochen von @audio 1;\nimg3–4 sind Figur 2, gesprochen von @audio 2.\nBefolge die Zauber-Aktion in @video 1 und die\nKameraumkreisung in @video 2.
- Kamerasprache
- Standardbegriffe werden direkt übernommen – Einstellungsgrößen, Push In, Pull Out, Schwenk, Fahrt, Orbit, Froschperspektive, One-Take, Dolly Zoom, Handkamera, Speed Ramp. Ein Nischenbegriff benötigt danach eine einfache englische Erklärung, und ein Übergang benötigt sowohl seinen Auslösepunkt als auch seine Methode.
- Handlung und Ausdruck
- Beschreibe die meiste Handlung allgemein und hebe dir Details für die zwei oder drei entscheidenden Momente auf. Mimik und Ausdrücke wirken besser, wenn sie ausformuliert statt mit Redewendungen benannt werden.
- Positiv vor Negativ
- Beschreibe, was vorhanden sein soll. Negative Angaben werden berücksichtigt, wenn es um Untertitel und Audio geht – keine Untertitel, keine Hintergrundmusik –, was auch die zwei Dinge sind, die ein Modell am ehesten ungefragt hinzufügt.
- Ton
- Atmosphäre, Effekte, Dialoge und Filmmusik können jeweils aus einer Audio-Referenz übernommen und im Briefing beschrieben werden – einschließlich der Angabe, was davon in den Hintergrund treten soll, wenn jemand spricht.
Was eine Sekunde von 2.5 kostet
Seedance 2.5 wird pro Sekunde der Ausgabe in der von dir gewählten Auflösung abgerechnet. Tarifstufen-Preise gelten automatisch – der Rabatt gehört zum Tarif und wird bei jeder Generierung angewendet.
Was eine Seedance 2.5-Generierung bei 720p mit Standardabrechnung kostet. 480p läuft mit 24 Credits pro Sekunde – die günstigere Möglichkeit zum Iterieren vor dem finalen Durchgang.
−20% bei monatlicher Abrechnung. Der Rabatt gilt für jede Seedance-Generierung, nicht nur einmal.
−40% bei monatlicher Abrechnung. Der höchste Rabatt und der Grund, warum es sich lohnt, eine dreißigsekündige Generierung zweimal auszuführen.
Fragen
Ja – Seedance 2.5 ist in der Videomodell-Auswahl von Popcraft verfügbar. Wähle es neben Seedance 2.0 aus, stelle eine Dauer von bis zu dreißig Sekunden ein und generiere.
Nein. Seedance 2.0 und Seedance 2.0 4K verbleiben in der Modellliste. Eine sechssekündige Produktaufnahme benötigt keine Obergrenze von dreißig Sekunden, und die 4K-Ausgabe ist ein Grund, dafür 2.0 zu wählen. Was 2.5 hinzufügt, sind Länge, die Anzahl der Referenzen und die Möglichkeit, einen bereits vorhandenen Clip zu bearbeiten.
Fünfzig ist das Maximum, und die Empfehlung lautet, deutlich darunter zu bleiben: acht oder weniger Bildsubjekte, fünf oder weniger, wenn die Hauptreferenzen Audio oder Video sind, Clips von fünf bis zehn Sekunden und Storyboards mit fünfzehn oder weniger Panels. Darüber hinaus sinkt die Stabilität und Generierungen müssen wiederholt werden.
Nimm einen Clip, der dir bereits gefällt, und verlängere ihn. Das Verlängern ist der günstigste Test des Versprechens, da es auf Bildmaterial aufbaut, das du bereits bewertet hast. Wenn die Nahtstelle hält – das Gesicht, das Grading, die Kamerageschwindigkeit –, lohnt es sich, für die restlichen Versprechungen des Modells eine längere Generierung zu starten. Wenn nicht, hast du das zum Preis von nur wenigen Sekunden erfahren.
Dreißig Sekunden sind der gesamte Werbespot
An dem Übergang zwischen zwei fünfzehnsekündigen Clips verrät sich ein generierter Film. Seedance 2.5 macht diesen Übergang optional.
Weiter erkunden
Ähnliche Modelle
MiniMax H3 generiert 2K-Videos mit 24 fps und synchronisiertem Stereo-Soundtrack — Effekte, Atmo und Dialoge in einem Schritt. Multi-Shot aus einem Prompt, 5 bis 15 Sekunden. Jetzt auf Popcraft.
Generiere filmreifes 4K-Video aus Text, Bildern oder Clips mit Seedance 2.0 auf Popcraft. Nativ synchronisierter Ton, Multi-Shot-Sequenzen und gestochen scharfes Detail bis 4K (2160p).

Seedance 2.0 Mini ist die schlankeste Videostufe von ByteDance – bis zu 50 % günstiger als das Standard-Seedance 2.0 und ~2× schneller als Fast, mit Text-, Bild-, Video- und Audio-Prompting. Live auf Popcraft.

Verwandle Bilder und Prompts mit Seedance 2.0 auf Popcraft in kinoreife Videos. Reference-to-Video, First/Last Frame und Ausgaben in mehreren Seitenverhältnissen mit bis zu 4K.
