Seedance 2.5 · ByteDance
Tiga puluh saat, dalam satu penjanaan
Iklan penuh, demo produk atau babak adegan dihasilkan sebagai satu penjanaan 30 saat berbanding lima klip yang perlu digabung — disokong sehingga lima puluh aset rujukan, boleh disunting selepasnya tanpa penjanaan semula.
Kini tersedia di Popcraft, bersama Seedance 2.0.
Tiga puluh saat, dua kali
Dua filem demonstrasi milik ByteDance, mengikut panjang yang direka untuk model ini. Setiap satu adalah satu penjanaan — gambar, peralihan kamera dan audio dihasilkan serentak, tiada penyusunan dilakukan selepasnya.
Perkara yang perlu diperhatikan dalam hasil ini
Empat ciri penentu ini adalah butiran yang membezakan sama ada rakaman kelihatan seperti rakaman sebenar atau hasil ciptaan AI.
Cahaya yang menyesuaikan dengan ruang bilik
Cahaya pantulan pada mata kelihatan seperti kaca yang mempunyai kedalaman, manakala arah, kecerunan dan pantulan cahaya mengikut fizik sebenar adegan dan bukan hanya dilukis secara cetek.
Pergerakan yang mengekalkan garisan konsisten
Lintasan pergerakan tolak, tarik, pan dan condong kamera dihasilkan dengan lebih lancar dan stabil, membolehkan pergerakan 30 saat kekal berkualiti sepanjang tempoh tersebut.
Ekspresi sebagai lengkung pergerakan
Mikro-ekspresi — seperti gegaran pada kelopak mata, atau pengecutan bibir — dipaparkan sebagai pergerakan berterusan sepanjang masa, bukannya beralih secara tiba-tiba antara posisi.
Kulit, rambut, dan jurang realiti yang ketara
Tekstur kulit, kilauan rambut dan pergerakan muka kecil dihasilkan hampir sama dengan rakaman kamera sebenar, mengurangkan rupa 'plastik' yang biasanya mendedahkan wajah hasil ciptaan AI.
Empat penambahbaikan utama, dan hanya satu daripadanya berkaitan tempoh rakaman
Kemajuan 2.5 langkah pada empat aspek: penjanaan lebih panjang, rujukan lebih kaya, penyuntingan tepat, dan penciptaan berbilang bahasa. Tempoh rakaman adalah ciri utama. Manakala fungsi penyuntingan adalah penambahbaikan yang paling dirasai dalam penggunaan harian.
Tiga puluh saat daripada satu penjanaan
Sehingga 30 saat dalam satu penjanaan, mengekalkan pergerakan kamera, kesinambungan dan alur naratif penuh sepanjang klip. Seedance 2.0 hanya menyokong maksimum 15 saat. High-Fidelity Temporal Extension kemudiannya boleh memanjangkan klip pendek ke hadapan, ke belakang, atau menyambungkan dua klip berbeza.
Semua yang diperlukan untuk rakaman, dalam satu permintaan
Satu penjanaan boleh menerima 30 gambar, 10 klip video dan 10 klip audio — gabungan watak, produk, lokasi, pergerakan kamera, muzik serta suara. Bagi versi 2.0, had maksimum hanyalah 9 gambar dan 3 klip sahaja.
Ubah butiran, kekalkan klip
Penyuntingan Video Terkawal mengekalkan bingkai, kedudukan kamera dan rentak asal, hanya menulis semula bahagian yang anda pilih: latar belakang, pakaian, produk, ekspresi pelakon, mahupun muzik. Kini anda tidak perlu menjana semula keseluruhan klip 30 saat hanya kerana satu kecacatan kecil.
Berikan arahan mengikut kata-kata anda sendiri
Disokong secara asli Bahasa Cina, Inggeris, Sepanyol, Indonesia, Melayu, Thai, Arab, Portugis, Vietnam, Jepun, Korea dan banyak lagi — gesaan tidak perlu diterjemahkan terlebih dahulu sebelum dibaca oleh model. Keupayaan model mengikut arahan juga telah dipertingkatkan secara menyeluruh.
Perbandingan baris demi baris: versi 2.5 berbanding 2.0
Seedance 2.0 kekal tersedia untuk digunakan, dan masih merupakan pilihan terbaik bagi menjana klip pendek resolusi 4K.
| Keupayaan | Seedance 2.0 | Seedance 2.5 |
|---|---|---|
| Penjanaan tunggal terpanjang | 15s | 30s |
| Imej rujukan | 9 | 30 |
| Klip video dan audio rujukan | 3 | 10 video + 10 audio |
| Jumlah tempoh rujukan | 15s | 30 saat video, 30 saat audio, dikira secara berasingan |
| Rujukan audio sahaja | — | Disokong |
| Cap masa dalam gesaan | Nombor babak sahaja | Cap masa saat penuh |
| Imej subjek pelbagai pandangan | Tidak disyorkan | Disokong |
| Nisbah aspek output | Enam nisbah tetap | Mana-mana nisbah dari 0.4 hingga 2.5, ditetapkan mengikut input |
| Output MOV, untuk penyuntingan dan lanjutan | — | Disokong — kesinambungan warna dan audio merentasi cantuman |
Setiap aset disertakan bersama tugas
Mengira bilangan adalah bahagian mudah. Apa yang menjadikannya berguna ialah setiap aset ditanda dengan simbol @ dan diberikan peranan yang jelas, supaya model dapat mengenal pasti gambar mana yang merupakan pelakon dan yang mana adalah sumber cahaya.
Sehingga 4K, 30 MB setiap satu. Menyokong JPEG, PNG, WebP, BMP, TIFF, GIF, HEIC, HEIF. Set imej pelbagai pandangan untuk subjek yang sama disokong dalam versi 2.5, manakala versi 2.0 tidak menyarankan penggunaannya.
480p hingga 4K, setiap klip 200 MB, panjang 2–30 saat, format MP4 atau MOV. Jumlah keseluruhan semua klip ialah 30 saat.
Setiap klip 15 MB, panjang 2–30 saat, format MP3 atau WAV, dengan jumlah keseluruhan 30 saat berasingan. Rujukan audio sahaja adalah ciri baharu dalam versi 2.5 — trek muzik latar, suara atau kesan bunyi boleh mengawal rentak, padanan rentak dan sebutan bibir secara sendirian.
Perkara yang boleh dibawa oleh rujukan
- Subjek
- Rupa atau suara manusia, haiwan, produk, hiasan, lokasi atau watak rekaan — elemen yang perlu dikekalkan sepanjang klip.Gunakan wanita dalam @image 1 sebagai watak utama, berjalan di jalan bandar semasa senja.
- Pergerakan
- Tindakan, pergerakan kamera, pemasaan dan kesan yang diambil daripada satu klip untuk digunakan pada subjek lain. Boleh dipindahkan merentas jenis dan gaya, bukan hanya antara ambilan yang sama.Ikut pergerakan kamera dan rentak larian dalam @video 1; subjek ialah @image 1.
- Model putih
- Lakaran 3D kasar tanpa tekstur memacu koreografi kamera dan penyusunan babak; bahan akhir, pencahayaan dan suasana diambil daripada gambar statik. Geometri kasar berfungsi lebih baik di sini berbanding model terperinci.Rendarkan pergerakan dalam model putih @video 1; subjek @image 1, pemandangan @image 2.
- Gaya
- Palet warna, gred warna dan tekstur diambil daripada gambar atau klip, manakala watak kekal seperti yang ditetapkan.Gunakan gred warna malam biru sejuk daripada @video 1, sambil mengekalkan watak utama daripada @image 1.
- Audio
- Muzik, melodi, dialog atau timbre suara. Tetapkan suara bagi setiap watak dan video akan dijana menggunakan suara tersebut.Suara bapa: garau, tenang, pertengahan umur. Rujuk @audio 1.
- Papan Cerita
- Papan cerita berbilang panel yang dibaca sebagai garis panduan plot. Maksimum 15 panel, utamakan lakaran garisan berbanding papan cerita yang telah dijana, dan tiada teks dilukis di dalam panel. Hasil akhir akan mengikut alur cerita, bukan menyalin setiap bingkai lukisan.Ikut empat panel dalam @image 1; watak ialah @image 2.
- Bingkai Kunci
- Satu imej sebagai bingkai pertama, dua imej sebagai bingkai pertama dan terakhir, atau satu set bingkai kunci yang berasingan. Berbeza dengan papan cerita, output akan mengekalkan butiran bingkai ini dengan tepat.@image 1 ialah bingkai pertama, @image 5 ialah bingkai terakhir; gerakkan dia dari kawasan dalam rumah ke luar.




Menjana semula bukan lagi satu-satunya pilihan
Kedua-dua fungsi ini menerima klip siap sebagai @video 1 dan tidak akan mengubah mana-mana bahagian yang tidak anda nyatakan. Penyuntingan menulis semula sebahagian kandungan sedia ada. Pelanjutan mencipta kandungan sebelum atau selepas klip sedia ada.


Tulis semula kawasan tertentu, kekalkan bahagian lain
Tambah subjek, alih keluar subjek, tukar pakaian atau latar belakang berdasarkan imej rujukan, atau ubah audio — ganti muzik latar, tambah kesan bunyi, atau ganti suara dialog. Gunakan cap masa untuk mengehadkan penyuntingan pada julat tertentu: contohnya 0:02–0:05, tiada perubahan akan berlaku di luar julat tersebut.
Corak yang berkesan terdiri daripada tiga bahagian: tunjuk sumber asal, nyatakan objek dan perubahan yang dikehendaki, kemudian tambah arahan pengekalan supaya model tidak mengubah bahagian bingkai yang lain.
Ganti pakaian gelap lelaki dalam @video 1\ndengan pakaian dalam @image 2.\nKekalkan semua perkara lain tidak berubah.
Tulis apa yang datang sebelum dan selepas
Lanjutkan ke hadapan dari bingkai terakhir, ke belakang ke saat sebelum bingkai pertama, atau jana bahagian penghubung yang hilang di antara dua klip supaya kedua-duanya dapat disambung dengan lancar. Watak, pemandangan dan kamera akan dikekalkan merentasi penyambungan, dan peralihan boleh ditetapkan agar lancar dari segi gambar mahupun bunyi.
Fungsi lanjutan membolehkan klip 6 saat yang baik dijadikan klip lengkap 30 saat tanpa perlu menjana semula bahagian yang sudah siap. Kaedah MOV masuk dan MOV keluar adalah disyorkan — ia mengekalkan konsistensi warna, kecerahan dan audio di titik penyambungan.
Mulakan dari bingkai terakhir @video 1 dan lanjutkan\nselama 6 saat: dia keluar dari bingkai, langit menjadi gelap,\nlampu jalan menyala satu persatu. Pastikan peralihan lancar.
Perkara yang ditetapkan secara automatik oleh input
Versi 2.5 mengasingkan tugas berdasarkan sama ada aset sumber menetapkan bentuk output. Tiada pemisahan sedemikian pada versi 2.0, dan perbezaan ini selalunya mengejutkan pengguna yang bertukar versi.
| Tugas | Nisbah aspek | Tempoh |
|---|---|---|
| Penyuntingan | Dikunci mengikut klip sumber | Mengikut sumber, dengan toleransi kira-kira satu pertiga saat |
| Bingkai pertama, atau bingkai pertama dan terakhir | Dikunci mengikut imej bingkai pertama | Boleh ditetapkan oleh anda |
| Lanjutan | Dikunci mengikut klip sumber | Boleh ditetapkan oleh anda |
| Penjanaan rujukan | Buka | Boleh ditetapkan oleh anda |
| Papan cerita dan bingkai utama | Buka | Boleh ditetapkan oleh anda |
Di mana tiga puluh saat menunjukkan nilainya
Kes penggunaan model ini terbahagi kepada lima kategori. Empat daripadanya adalah tugas yang menjadi lebih singkat. Kategori kelima hanya menjadi mungkin apabila penjanaan berjalan sepanjang ini.
Adegan yang berjalan sepenuhnya
Plot cerita yang dihasilkan sepenuhnya dalam satu penjanaan, dengan watak dikekalkan konsisten menggunakan gambar rujukan. Pembaikan kesinambungan — seperti rig yang kelihatan atau objek tersalah letak — hanya memerlukan pengeditan kecil, bukan rakaman semula keseluruhan.
Satu sumber utama, semua versi lain
Satu suntingan utama, kemudian hasilkan pelbagai versi: tukar SKU, model, teks paparan atau pasaran sasaran, dengan rupa produk dan identiti jenama dikekalkan melalui rujukan. Suara alih juga boleh dihasilkan dalam semua bahasa yang diperlukan.
Keseluruhan idea dalam sekali rakam
Terangkan satu idea dari awal hingga akhir dalam tiga puluh saat, tukar pembentang tanpa perlu rakam semula, dan edarkan set yang sama dalam pelbagai bahasa.
Prosedur lengkap dari awal hingga akhir
Langkah pemasangan dan operasi dipaparkan dari awal hingga akhir, dengan papan nama, panel spesifikasi dan teks pembungkusan ditulis semula mengikut produk manakala syot dikekalkan.
Kandungan yang tidak dapat dihasilkan dalam lima belas saat
Treler permainan dan CG, penyampai maya, klip pendek yang dikembangkan menjadi siri, watak yang diubah usia atau gaya untuk potongan bermusim.
Tulis seperti senarai syot
Anggap model ini sebagai penerbit yang membaca ringkasan kerja berstruktur. Format yang ditunjukkan di bawah adalah format yang kekal utuh apabila diserahkan kepada orang lain.









Lima bahagian, mengikut turutan ini
Subjek, lokasi, peristiwa, genre dan gaya, pergerakan kamera. Seterusnya turutan gambar — sama ada menggunakan cap masa saat penuh atau gambar bernombor — yang menerangkan bagi setiap segmen: apa yang dilihat, cara kamera bergerak, apa yang dituturkan dan apa yang didengari. Akhiri dengan pemalar: sudut pandangan, persekitaran, suasana, dan bunyi latar yang berterusan.
Kekalkan kira-kira satu saat cerita bagi setiap saat paparan. Sekiranya kandungan terlalu sedikit, model akan mencipta aksi tambahan secara spontan; sekiranya terlalu banyak, model sama ada akan memotong adegan secara tergesa-gesa atau mengabaikan separuh daripada kandungan.
Nyatakan setiap satu dengan jelas di dalam teks
Nomborkan aset mengikut urutan muat naik dan ikat setiap satu dalam gesaan: yang mana satu subjek, suara, aksi, mahupun latar. Menulis nama pada imej dan menggunakannya dalam gesaan adalah kaedah paling pasti untuk mendapatkan dua watak yang sama.
Sekiranya rujukan sudah tepat, nyatakan untuk mengikutinya dan berhenti. Menerangkan semula gerakan yang terkandung di dalamnya akan menyebabkan model perlu menyelaraskan dua arahan berbeza.
img1–2 ialah watak 1, disuarakan oleh @audio 1;\nimg3–4 ialah watak 2, disuarakan oleh @audio 2.\nIkuti aksi lontar sihir dalam @video 1 dan pergerakan orbit dalam @video 2.
- Bahasa penggambaran kamera
- Gunakan istilah standard seperti sedia ada — saiz tangkapan, push in, pull out, pan, track, orbit, sudut rendah, one-take, dolly zoom, pegang tangan, speed ramp. Istilah khusus perlu disertakan penjelasan ringkas selepasnya, manakala peralihan perlu dinyatakan titik pencetus dan kaedahnya.
- Aksi dan ekspresi
- Huraikan kebanyakan aksi secara umum, hanya berikan butiran terperinci untuk 2 atau 3 bahagian penting sahaja. Ekspresi akan lebih difahami jika ditulis secara terperinci berbanding menggunakan istilah kiasan.
- Utamakan penyataan positif
- Nyatakan perkara yang sepatutnya wujud. Penafian hanya digunakan untuk sari kata dan audio — tiada sari kata, tiada muzik latar — kerana kedua-dua perkara ini paling kerap ditambah secara automatik oleh model tanpa diminta.
- Bunyi
- Bunyi persekitaran, kesan bunyi, dialog dan muzik latar boleh dijana daripada rujukan audio dan dinyatakan dalam arahan, termasuk yang mana satu perlu dikecilkan apabila terdapat pertuturan.
Kos setiap saat untuk Seedance 2.5
Seedance 2.5 dicaj mengikut saat output, pada resolusi yang anda pilih. Kadar pelan langganan akan digunakan secara automatik — diskaun diberikan mengikut pelan dan dikenakan pada setiap penjanaan.
Kos penjanaan Seedance 2.5 pada resolusi 720p dengan kadar caj standard. Resolusi 480p hanya memerlukan 24 kredit sesaat — pilihan lebih jimat untuk ujian sebelum output akhir.
−20% pada bil bulanan. Diskaun ini dikenakan untuk setiap penjanaan Seedance, bukan sekali sahaja.
−40% pada bil bulanan. Kadar diskaun tertinggi, inilah sebab penjanaan tiga puluh saat berbaloi untuk dijalankan dua kali.
Soalan Lazim
Ya — Seedance 2.5 sudah tersedia dalam pemilih model video Popcraft. Pilih model ini bersebelahan Seedance 2.0, tetapkan tempoh sehingga tiga puluh saat, dan mula menjana.
Tidak. Seedance 2.0 dan Seedance 2.0 4K kekal dalam senarai model. Rakaman produk enam saat tidak memerlukan had maksimum tiga puluh saat, manakala output 4K adalah sebab untuk memilih versi 2.0. Apa yang ditambah dalam versi 2.5 ialah tempoh lebih panjang, bilangan rujukan, dan keupayaan untuk mengedit klip yang sedia ada.
Had maksimum ialah lima puluh, dan disyorkan untuk menggunakan jumlah yang jauh lebih rendah: lapan subjek imej atau kurang, lima atau kurang sekiranya rujukan utama adalah audio atau video, klip berdurasi lima hingga sepuluh saat, dan papan cerita lima belas panel atau kurang. Melebihi had ini akan mengurangkan kestabilan dan penjanaan mungkin perlu diulang berkali-kali.
Ambil klip yang anda sudah puas hati dan panjangkan tempohnya. Memanjangkan klip adalah cara ujian paling murah, kerana ia bermula daripada rakaman yang anda sudah sahkan kualitinya. Sekiranya sambungan klip kelihatan lancar — wajah, warna, kelajuan kamera — maka ciri lain model ini juga berbaloi untuk dicuba dengan penjanaan lebih panjang. Jika tidak, anda hanya perlu belanja beberapa saat sahaja untuk mengesahkannya.
Tiga puluh saat adalah keseluruhan iklan
Sambungan di antara dua klip lima belas saat adalah tempat filem yang dijana biasanya mendedahkan kelemahannya. Seedance 2.5 membolehkan anda tidak perlu membuat sambungan sedemikian.
Teruskan meneroka
Model berkaitan
MiniMax H3 menjana video 2K pada 24fps dengan runut bunyi stereo segerak — kesan, ambien dan dialog dalam satu tugasan. Berbilang syot dari satu gesaan, 5 hingga 15 saat, kawalan bingkai pertama dan terakhir. Kini di Popcraft.
Jana video sinematik 4K daripada teks, imej atau klip dengan Seedance 2.0 di Popcraft. Audio segerak natif, jujukan berbilang syot, dan perincian tajam sehingga 4K (2160p).

Seedance 2.0 Mini ialah tahap video paling ringkas daripada ByteDance — sehingga 50% lebih murah berbanding Seedance 2.0 standard dan ~2× lebih laju daripada mod Fast, menyokong gesaan teks, imej, video dan audio. Kini tersedia di Popcraft.

Tukarkan imej dan gesaan kepada video sinematik menggunakan Seedance 2.0 di Popcraft. Menyokong penjanaan video daripada rujukan, bingkai pertama/terakhir, dan output pelbagai nisbah sehingga 4K.
