Google · Gemini Omni 1.1 Flash
Cipta dan edit video daripada sebarang input
Omni Flash daripada Google ialah satu model untuk penjanaan, pengeditan dan pelanjutan video — masukkan teks, gambar atau klip, dapatkan video lengkap dengan pertuturan, muzik dan kesan bunyi sendiri. Versi 1.1 menambah pelanjutan adegan sehingga 40 saat, kawalan bingkai pertama dan terakhir, serta output 1080p dan 4K.
Tersedia di studio video, Canvas dan penyambung MCP
- 3s
- 10s
- 20s
- 30s
- 40s
Huraikan adegan, kamera, pencahayaan dan suasana. Audio akan dijana secara sepadan.
Imej tersebut berfungsi sebagai panduan atau titik permulaan; gesaan menentukan pergerakan yang akan dihasilkan.
Model ini menghasilkan animasi daripada bingkai pertama hingga terakhir — termasuk putaran orbit, zum masuk/keluar, dan gelung lancar.
Watak dan objek di dalam gambar akan kekal konsisten sepanjang klip video.
Semua kandungan yang tidak dinyatakan akan dikekalkan semasa menyunting; pelanjutan akan menambah 10 saat pada satu masa.
Ciri yang dibina Google ke dalam Omni
Tiga perkara utama yang diketengahkan dalam kad model dan siaran pelancaran, serta kepentingannya untuk klip panjang. Semua pernyataan di bawah adalah milik Google; hasil paparan di bahagian bawah adalah ciptaan kami.
Ingatan 10 saat antara segmen
Omni 1.1 menganalisis sehingga 10 saat konteks terdahulu semasa memanjangkan adegan — model terdahulu hanya merujuk saat terakhir sahaja. Inilah sebabnya rantai 40 saat dapat mengekalkan kapten, kapal dan gred yang sama merentasi empat segmen.
Fizik dan pengetahuan dunia
Google menghuraikan pemahaman intuitif mengenai graviti, tenaga kinetik dan dinamik bendalir, digabungkan dengan pengetahuan Gemini mengenai sejarah, sains dan budaya — air yang memancut seperti air sebenar, kapal layar lama yang condong seperti kapal sebenar.
SynthID dan C2PA pada setiap klip
Setiap video yang dijana membawa tanda air SynthID Google yang tidak kelihatan dan menyokong Content Credentials (C2PA), justeru klip utama boleh diterbitkan dengan asal usul yang boleh disahkan — satu keperluan yang semakin diamalkan di pelbagai platform.
Sumber: catatan Google "Memperkenalkan Gemini Omni" dan "Gemini Omni 1.1 Flash membolehkan anda membina dengan kawalan yang lebih baik", kad model DeepMind, serta halaman model Platform Ejen Gemini Enterprise.
Dua demonstrasi, terus dijana daripada model
Kedua-duanya dijana di Popcraft dan dipaparkan sebagaimana asalnya — tiada suntingan, tiada muzik tambahan. Treler tersebut adalah hasil satu permintaan selama 40 saat pada resolusi 1080p. Pasangan di sebelah kanan ialah klip 5 saat dan klip yang sama selepas dipanjangkan kepada 25 saat.
Mana-mana tempoh sehingga 40 saat. Popcraft akan menyambungkannya secara automatik untuk anda.
Catatan pelancaran Google memanggil ciri ini pemanjangan adegan: video dipanjangkan "dalam kenaikan 10 saat sehingga jumlah keseluruhan 40 saat". Anda tidak perlu menguruskan perkara ini di Popcraft. Hanya pilih mana-mana tempoh antara 3 hingga 40 saat pada satu peluncur, dan Popcraft akan menyambung proses pemanjangan secara automatik daripada satu gesaan anda sahaja, kemudian memulangkan satu fail, satu cerita dan satu trek audio yang lengkap. Berikut adalah treler pada enam titik berbeza sepanjang klip tersebut.
1s
8s
15s
22s
29s
36sMana-mana panjang, disambung automatik
Pilih tempoh 3 hingga 40 saat dan Popcraft akan menjalankan rantaian sambungan Google untuk anda di latar belakang — tiada perancangan bahagian, tiada klip yang perlu digabung — dan anda hanya membayar untuk saat yang dihasilkan.
Resolusi hasil keluaran
"Hasil keluaran 1080p atau 4K resolusi tinggi yang kemas dan sedia untuk pengeluaran profesional", menurut keterangan Google. Di Popcraft, rantaian 4K boleh dijalankan sehingga 30 saat.
Bingkai pertama dan terakhir
Baharu dalam versi 1.1: tetapkan bingkai mula dan bingkai tamat bagi satu rakaman, dan Omni akan menjana video berterusan di antara kedua-duanya — orbit kamera yang kompleks, peralihan zum, serta gelung yang lancar.
Ucapan, muzik, kesan bunyi
Audio akan dijana bersama gambar dan disenaraikan pada kad model. Nyatakan keperluan audio dalam gesaan — contoh: radio dimainkan, tiada dialog, hanya bunyi persekitaran — dan sistem akan mematuhinya.
Gunakan gambar atau video anda sendiri
Model yang sama membaca rujukan, mengedit dan melanjutkan. Panduan Google adalah untuk bergantung pada gesaan: nyatakan perkara yang perlu dikekalkan, nyatakan perkara yang perlu diubah, dan katakan "lanjutkan" apabila anda maksudkan melanjutkan.
Rujukan subjek
Lampirkan gambar seseorang, produk atau lokasi, kemudian huraikan adegan yang dikehendaki. Model akan mengekalkan konsistensi watak dan objek sepanjang klip video, termasuk untuk bahagian-bahagian video yang panjang.
Tiada langkah latihan diperlukan, tiada fail watak khas perlu disediakan. Menggunakan dua gambar subjek yang sama dari sudut berbeza akan menghasilkan konsistensi yang lebih baik berbanding satu gambar sahaja.
Wanita dalam gambar rujukan berjalan ke arah kamera di pantai semasa waktu emas, rambut ditiup angin, dengan ombak di belakangnya.
Sunting video
Lampirkan klip dan nyatakan perkara yang perlu diubah. Nasihat rasmi Google: "Gesaan ringkas adalah terbaik untuk penyuntingan video" — model ini akan mengekalkan semua elemen yang anda tidak nyatakan.
Hasil output akan mengekalkan panjang dan bingkai asal video, dan caj dikenakan berdasarkan panjang tersebut.
Buatkan salji turun dengan lebat. Kekalkan semua perkara lain seperti asal.
Pemanjangan adegan
Lampirkan klip dan pilih jumlah tempoh yang lebih panjang. Video asal dikekalkan bingkai demi bingkai, rakaman baharu akan ditambah dalam bahagian 10 saat dengan audio yang berterusan, dan model akan membaca sehingga 10 saat klip awal untuk kesinambungan.
Nyatakan "lanjutkan" — Popcraft akan menambah perkataan ini secara automatik pada panel Lanjutkan Video sekiranya anda terlupa, kerana tanpa perkataan ini model akan menganggap permintaan anda sebagai penyuntingan. Fungsi lanjutan hanya menambah rakaman pada hujung video sahaja.
Lanjutkan video ini: sambungkan adegan yang sama apabila bot sampai ke jeti dan anak kapal melontar tali ke pantai.
Perbandingan Omni dengan Seedance 2.5 dan Veo 3.1
Ketiga-tiga model ini boleh menjana audio bersama visual. Kelebihan Omni: boleh melanjutkan adegan sehingga 40 saat dan output 4K dalam satu model; kelebihan Seedance: bilangan rujukan dan penyuntingan tepat mengikut kawasan; kelebihan Veo: kawalan bingkai untuk tempoh 8 saat. Pilih model mengikut keperluan tugas anda.
| Keupayaan | Gemini Omni 1.1 Flash | Seedance 2.5 | Veo 3.1 |
|---|---|---|---|
| Klip terpanjang bagi satu permintaan | 40 saat melalui lanjutan adegan (30 saat untuk resolusi 4K) | 30 saat | 8 saat |
| Resolusi tertinggi | 4K (3840×2160), tersedia juga draf resolusi 360p | 1080p | 1080p |
| Audio asli | Ucapan, muzik, kesan bunyi | Ya | Ya |
| Imej rujukan | Sehingga 10 | Sehingga 30 (+10 video, +10 audio) | Sehingga 3 |
| Video rujukan | Sehingga 3 | Sehingga 10 | 1 (sambungan) |
| Penyuntingan video | Berbual; mengekalkan perkara yang tidak anda nyatakan | Boleh dikawal, tepat mengikut kawasan | — |
| Sambungan video | Tambahan 10 saat sehingga 40 saat, 10 saat konteks | Sebelum atau selepas, sehingga 30 saat | +7 saat setiap langkah |
| Asal Usul | SynthID + Kredensial Kandungan C2PA | — | SynthID |
Data Omni diambil dari halaman model dan siaran pelancaran Google; had Popcraft adalah yang dipaparkan oleh pemilih pada masa ini. Had pembekal boleh berubah; pemilih akan sentiasa memaparkan kandungan yang tersedia ketika ini.
Situasi di mana satu permintaan yang lengkap dan jelas memberikan hasil terbaik
Apa sahaja yang dulunya memerlukan lima klip dan proses cantuman.
Bahagian utama halaman pendaratan
Mana-mana panjang antara 3 hingga 40 saat (30 saat untuk resolusi 4K) dengan skor muzik tersendiri, dalam satu fail. Tetapkan peluncur kepada 24 dan Popcraft akan menyambungkan sambungan secara automatik untuk anda.
Treler dan teaser
Alur cerita lengkap — pembukaan, pendedahan, klimaks — dalam satu janaan berterusan, dengan muzik yang meningkat seiring.
Iklan dengan watak konsisten
Hanya beberapa gambar produk atau penyampai sudah cukup untuk mengekalkan rupa yang sama di setiap babak.
Sunting semula rakaman asal
Ubah cuaca, pakaian atau waktu hari pada rakaman sebenar, tanpa menukar panjang video atau kedudukan kamera.
Huraikan idea secara visual
Catatan pelancaran Google menonjolkan ciri ini: "video penjelasan menarik daripada gesaan ringkas", dengan visual yang memudahkan kefahaman idea kompleks.
Menulis gesaan untuk janaan bersiri
Panduan Google memerlukan huraian adegan, pergerakan kamera, pencahayaan dan suasana, serta menyokong sintaks kod masa untuk acara. Semua ciri lain diambil daripada contoh treler di atas: sistem melaksanakan arahan yang diberikan, malah menyusun semula arahan tersebut sekiranya terlalu banyak arahan diberikan bagi satu bahagian.
Satu tindakan setiap 10 saat, bersama kod masa
Tulis alur cerita sebagai urutan mengikut masa — panduan Google sendiri menerangkan sintaks [0-3s] … [3-6s] …. Berikan satu arahan jelas bagi setiap bahagian 10 saat; model akan merancang bahagian tersebut berdasarkan gesaan, jadi berikan rancangan tersebut kepadanya.
Letakkan gaya (gred, lensa, suasana) dalam satu baris pendek di bahagian akhir, bukan sebagai perenggan di awal. Untuk rakaman berterusan tanpa potongan, nyatakan: "dalam satu rakaman berterusan, tiada potongan adegan".
Kapal galleon lanun ketika ribut pada waktu senja, bendera tengkorak, layar hitam koyak. Rakaman berterusan tunggal, tiada potongan adegan.\n[0-10s] Kapal menerjang ombak; kamera naik ke atas dek.\n[10-20s] Kapten berjanggut di roda kemudi menjerit arahan; anak kapal membalas dengan sorakan.\n[20-30s] Beliau membuka peti besi di bahagian haluan; peti itu penuh dengan beri kranberi merah.\n[30-40s] Kapal musuh menembak; beri kranberi bertaburan dalam gerakan perlahan ketika beliau mengangkat pedang.\nGaya: suar anamorfik, gred teal-amber, muzik orkestra, tiada teks pada skrin.
Perenggan treler yang padat
Inilah yang sebenarnya kami hantar untuk treler di atas: lima urutan aksi, pendedahan peti, kapal saingan dan pengakhiran, semuanya dalam satu perenggan berterusan. Model ini mengekalkan elemen kapal, kapten dan gred warna, cuma menukar susunan adegan.
Percikan beri kranberi muncul pada saat ke-8; peti tidak pernah dibuka dengan jelas. Gesaan yang padat tidak gagal — ia hanya akan diringkaskan.
Treler filem blokbuster Hollywood, "Pirates of the Cranberries". Gaya sinematik aksi langsung epik: suar lensa anamorfik, gred teal-amber mendalam, kabus laut volumetrik, butiran filem 35mm… [lima urutan aksi, satu perenggan, 240 patah perkataan]
- Nyatakan "lanjutkan"
- Perkataan tersebut adalah pencetus untuk fungsi lanjutan video. Popcraft akan menambahkannya secara automatik pada panel Lanjutkan Video sekiranya tiada; jika menggunakan API atau MCP, sila tulis perkataan ini sendiri. Fungsi lanjutan hanya menambah kandungan di bahagian akhir sahaja — tiada pilihan untuk menambah di bahagian awal.
- Bingkai juga memerlukan arahan
- Dua gambar yang dimuat naik akan dianggap sebagai rujukan subjek, melainkan anda nyatakan "bingkai pertama" dan "bingkai terakhir" serta huraikan peralihan yang diinginkan.
- Arahkan bunyi
- Panduan Google: "Secara lalai, model akan cuba menjana trek audio yang bersesuaian". Gunakan penafian ringkas — "tiada dialog", "tiada kesan bunyi tambahan" — atau nyatakan bunyi yang anda mahukan: radio sedang dimainkan, bunyi hujan di atas kanvas, alunan muzik bertali yang semakin kuat.
- Kekalkan arahan suntingan ringkas
- Panduan Google sekali lagi: "Gesaan yang terlalu terperinci boleh menyebabkan perubahan yang tidak diingini". Nyatakan sahaja perubahan yang dikehendaki, tambah "kekalkan semua perkara lain seperti sedia ada", dan selesai.
Kadar harga
Omni dicaj mengikut setiap saat video yang dijana, berdasarkan resolusi. Oleh kerana Popcraft hanya menawarkan tempoh video yang boleh dijana tepat oleh model, harga yang dipaparkan sebelum penjanaan adalah harga sebenar yang akan dikenakan.
Draf dan media sosial. Klip 10 saat ialah 150 kredit; keseluruhan 40 saat ialah 600 kredit.
Kualiti penghantaran. Treler 40 saat di atas ialah 920 kredit — satu permintaan, termasuk audio.
Resolusi asli 3840×2160 untuk paparan utama. Had maksimum 30 saat; rantaian 4K penuh 30 saat berharga 1,350 kredit.
Soalan lazim
Model video Google, yang diterangkan oleh DeepMind sebagai "langkah seterusnya kami ke arah model yang boleh mencipta dan mengedit sebarang kandungan daripada sebarang input — bermula dengan video". Satu model ini menyokong penjanaan video daripada teks, penjanaan video daripada imej, interpolasi bingkai pertama dan terakhir, rujukan subjek, pengeditan video serta sambungan adegan, dan turut menjana ucapan, muzik serta kesan bunyi untuk setiap klip. Versi 1.1 yang dikeluarkan pada 27 Ogos 2026 menambah ciri sambungan video, bingkai kunci serta output 1080p/4K.
Setiap proses penjanaan adalah sehingga 10 saat; sambungan adegan menambah panjang video secara kenaikan 10 saat sehingga jumlah maksimum 40 saat. Di Popcraft, anda hanya perlu memilih panjang antara 3 hingga 40 saat pada peluncur, dan Popcraft akan menjalankan proses sambungan secara automatik berdasarkan gesaan anda. Peluncur hanya memaparkan panjang yang disokong model, dan anda hanya dicaj untuk panjang klip yang dijana. Bagi resolusi 4K, had maksimum adalah 30 saat. Manakala video jenis interpolasi bingkai pertama dan terakhir hanya melalui satu proses penjanaan, jadi panjangnya adalah antara 3 hingga 10 saat.
Secara lalai, ya — panduan Google menyatakan model ini "akan cuba menjana trek audio yang bersesuaian", dan dokumen model menyenaraikan sokongan untuk ucapan, muzik serta kesan bunyi. Anda boleh arahkan model melalui gesaan, contohnya masukkan arahan "tiada dialog" atau "tiada muzik" sekiranya anda mahukan klip tanpa bunyi. Anda juga boleh mengganti atau menambah lapisan audio kemudian pada garis masa Popcraft.
Muat naik klip yang ingin disambung dan pilih jumlah panjang akhir yang dikehendaki. Klip asal akan dikekalkan sepenuhnya bingkai demi bingkai, dan bahagian sambungan 10 saat akan ditambah pada hujung klip. Model akan membaca sehingga 10 saat klip asal untuk memastikan kesinambungan visual. Oleh itu, klip 5 saat hanya boleh disambung menjadi 15, 25 atau 35 saat — tidak boleh 20 saat. Popcraft hanya memaparkan panjang yang disokong model dan akan mencaj dengan tepat mengikut panjang akhir. Sambungan hanya boleh ditambah pada hujung klip sahaja.
Boleh. Muat naik klip asal dan huraikan perubahan yang dikehendaki. Google mengesyorkan menggunakan gesaan pengeditan yang ringkas dan tambah arahan "kekalkan semua perkara lain sama"; model akan mengekalkan semua elemen yang tidak anda nyatakan. Klip hasil edit akan mengekalkan panjang dan bingkai asal, dan dicaj mengikut panjang klip asal. Pengeditan dialog pertuturan tidak disokong pada masa ini.
Penjanaan 4K menggunakan resolusi 3840×2160 dan berharga tiga kali ganda kadar 720p sesaat, kerana ia memerlukan tiga kali ganda kuasa pengiraan. Setiap bahagian sambungan 4K mengambil masa beberapa minit untuk diproses di pelayan, jadi had maksimum rantaian ditetapkan pada 30 saat. Harga kredit untuk setiap panjang dan resolusi akan dipaparkan sebelum anda memulakan penjanaan.
Kerana setiap bahagian 10 saat adalah sambungan daripada bahagian sebelumnya, dan model akan merancang rentak masa secara automatik. Berikan satu tindakan yang jelas bagi setiap 10 saat menggunakan sintaks kod masa Google, dan elakkan ayat hiasan bahasa filem yang tidak perlu. Treler dengan lima rentak padat akan dipadatkan atau disusun semula; tiga rentak sepanjang 30 saat akan dikekalkan susunannya.
Setiap video Omni dilengkapi tanda air SynthID tidak kelihatan daripada Google dan menyokong Kredensial Kandungan C2PA, yang mengesahkan asal usul tanpa menjejaskan rupa klip video. Pelan berbayar Popcraft memberikan hak komersial ke atas video yang anda hasilkan; muat turun peringkat percuma mempunyai tanda air Popcraft yang kelihatan, yang dibuang dalam pelan berbayar. Anda kekal bertanggungjawab ke atas rupa dan kandungan dalam gesaan serta media rujukan anda.
Sudah bersedia untuk membuat satu permintaan sahaja, bukannya lima klip berasingan?
Mulakan dengan video 10 saat pada resolusi 720p, semak hasilnya, kemudian lanjutkan adegan — atau gunakan klip yang sudah anda sukai untuk dilanjutkan.
Teruskan meneroka
Model berkaitan
Seedance 2.5 menjana video sehingga 30 saat dalam satu tugasan, dengan sokongan sehingga 50 aset rujukan, penyuntingan video terkawal, pelanjutan masa ketepatan tinggi, mana-mana nisbah aspek 0.4 hingga 2.5, serta gesaan asli dalam lebih 10 bahasa. Kini tersedia di Popcraft.
MiniMax H3 menjana video 2K pada 24fps dengan runut bunyi stereo segerak — kesan, ambien dan dialog dalam satu tugasan. Berbilang syot dari satu gesaan, 5 hingga 15 saat, kawalan bingkai pertama dan terakhir. Kini di Popcraft.
Jana video sinematik 4K daripada teks, imej atau klip dengan Seedance 2.0 di Popcraft. Audio segerak natif, jujukan berbilang syot, dan perincian tajam sehingga 4K (2160p).

Seedance 2.0 Mini ialah tahap video paling ringkas daripada ByteDance — sehingga 50% lebih murah berbanding Seedance 2.0 standard dan ~2× lebih laju daripada mod Fast, menyokong gesaan teks, imej, video dan audio. Kini tersedia di Popcraft.
