Google · Gemini Omni 1.1 Flash
Buat dan edit video dari input apa pun
Omni Flash dari Google adalah satu model untuk pembuatan, pengeditan, dan perpanjangan video — teks, gambar, atau klip sebagai input, video dengan ucapan, musik, dan efek suara sendiri sebagai output. Versi 1.1 menambahkan perpanjangan adegan hingga 40 detik, kontrol bingkai pertama dan terakhir, serta output 1080p dan 4K.
Tersedia di studio video, Canvas, dan konektor MCP
- 3s
- 10s
- 20s
- 30s
- 40s
Deskripsikan adegan, kamera, pencahayaan, dan suasana. Audio dihasilkan agar sesuai.
Gambar menjadi panduan atau titik awal; prompt menentukan apa yang bergerak.
Model menganimasi dari bingkai pertama hingga terakhir — mengorbit, memperbesar, loop mulus.
Karakter dan objek dalam foto tetap konsisten sepanjang klip.
Edit mempertahankan semua yang tidak Anda sebutkan; perpanjangan menambahkan 10 detik setiap kali.
Apa yang Google tanamkan dalam Omni
Tiga hal yang ditonjolkan dalam kartu model dan postingan peluncuran, serta mengapa hal itu penting untuk klip panjang. Setiap klaim di bawah ini adalah milik Google; render di bawahnya adalah milik kami.
Sepuluh detik memori antarbagian
Omni 1.1 menganalisis hingga 10 detik konteks sebelumnya saat memperpanjang adegan — model sebelumnya hanya mereferensikan detik terakhir. Itulah mengapa rangkaian 40 detik mempertahankan kapten, kapal, dan kualitas yang sama di empat bagian.
Fisika dan pengetahuan dunia
Google menggambarkan pemahaman intuitif tentang gravitasi, energi kinetis, dan dinamika fluida, dipadukan dengan pengetahuan Gemini tentang sejarah, sains, dan budaya — air yang memancar layaknya air, kapal galleon yang miring layaknya kapal.
SynthID dan C2PA pada setiap klip
Setiap video yang dihasilkan membawa watermark SynthID tak kasatmata dari Google dan mendukung Content Credentials (C2PA), sehingga klip unggulan dapat dipublikasikan dengan asal-usul yang dapat diverifikasi — sebuah persyaratan di semakin banyak platform.
Sumber: postingan "Introducing Gemini Omni" dan "Gemini Omni 1.1 Flash lets you build with more control" dari Google, kartu model DeepMind, dan halaman model Gemini Enterprise Agent Platform.
Dua demonstrasi, langsung dari model
Keduanya dihasilkan di Popcraft dan ditampilkan apa adanya — tanpa penyuntingan, tanpa musik tambahan. Trailer tersebut adalah satu permintaan 40 detik pada 1080p. Pasangan di sebelah kanan adalah klip 5 detik dan klip yang sama setelah perpanjangan adegan menjadi 25 detik.
Durasi apa pun hingga 40 detik. Popcraft merangkainya untuk Anda.
Posting peluncuran Google menyebutnya perpanjangan adegan: video bertambah "dalam kelipatan 10 detik hingga total panjang kumulatif 40 detik". Di Popcraft, Anda tidak perlu mengelolanya. Pilih durasi apa pun dari 3 hingga 40 detik pada satu slider dan Popcraft secara otomatis merangkai proses perpanjangan dari satu prompt Anda, lalu menghasilkan satu file, satu cerita, satu soundtrack. Berikut trailernya pada enam titik di sepanjang durasinya.
1s
8s
15s
22s
29s
36sDurasi apa pun, dirantai otomatis
Pilih 3 hingga 40 detik dan Popcraft menjalankan rantai ekstensi Google untuk Anda di balik layar — tidak perlu merencanakan segmen, tidak perlu menyambung klip — dan Anda hanya membayar untuk detik yang dihasilkan.
Resolusi produksi
"Output 1080p atau 4K yang halus dan beresolusi tinggi, siap untuk produksi profesional", menurut Google. Di Popcraft, rantai 4K berjalan hingga 30 detik.
Frame pertama dan terakhir
Baru di 1.1: tentukan frame awal dan akhir sebuah shot dan Omni menghasilkan video berkelanjutan di antaranya — orbit kamera kompleks, transisi zoom, loop mulus.
Ucapan, musik, efek suara
Tercantum di kartu model sebagai dihasilkan bersama gambar. Arahkan dalam prompt — radio menyala, tanpa dialog, hanya ambien — dan model akan mengikutinya.
Bawa gambar atau video Anda sendiri
Model yang sama membaca referensi, mengedit, dan memperpanjang. Panduan Google adalah mengandalkan prompting: sebutkan apa yang harus dipertahankan, sebutkan apa yang harus diubah, dan katakan "extend" saat Anda bermaksud memperpanjang.
Referensi subjek
Lampirkan foto orang, produk, atau lokasi dan deskripsikan adegannya. Model menjaga karakter dan objek tetap konsisten sepanjang klip, termasuk di seluruh segmen video panjang.
Tanpa langkah pelatihan, tanpa file karakter. Dua foto subjek yang sama dari sudut berbeda memberikan hasil lebih baik daripada satu.
Wanita dalam foto referensi berjalan menuju kamera di pantai saat golden hour, angin menerpa rambutnya, ombak di belakangnya.
Edit video
Lampirkan klip dan jelaskan apa yang harus diubah. Saran dari Google: "Prompt sederhana bekerja paling baik untuk pengeditan video" — model akan mempertahankan elemen yang tidak Anda sebutkan.
Output mempertahankan durasi dan pembingkaian sumber, dan ditagih berdasarkan durasi tersebut.
Buat salju turun lebat. Pertahankan semua hal lainnya tetap sama.
Perpanjangan adegan
Lampirkan klip dan pilih durasi total yang lebih panjang. Video asli dipertahankan bingkai demi bingkai, rekaman baru ditambahkan dalam segmen 10 detik dengan suara yang dilanjutkan, dan model membaca hingga 10 detik klip untuk kesinambungan.
Katakan "extend" — Popcraft akan menambahkannya untuk Anda di panel Perpanjang Video jika Anda lupa, karena tanpa kata tersebut model akan menganggap permintaan sebagai pengeditan. Perpanjangan hanya ditambahkan di akhir.
Perpanjang video ini: lanjutkan adegan yang sama persis saat perahu mencapai dermaga dan kru melemparkan tali ke darat.
Omni bersanding dengan Seedance 2.5 dan Veo 3.1
Tiga model yang sama-sama menghasilkan audio bersama gambar. Keunggulan Omni adalah perpanjangan adegan hingga 40 detik dan output 4K dari satu model; keunggulan Seedance adalah jumlah referensi dan pengeditan presisi wilayah; keunggulan Veo adalah kontrol bingkai pada 8 detik. Pilih sesuai kebutuhan.
| Kemampuan | Gemini Omni 1.1 Flash | Seedance 2.5 | Veo 3.1 |
|---|---|---|---|
| Klip terpanjang dari satu permintaan | 40 dtk dengan perpanjangan adegan (30 dtk pada 4K) | 30 dtk | 8 dtk |
| Resolusi tertinggi | 4K (3840×2160), hingga tier draf 360p | 1080p | 1080p |
| Audio asli | Ucapan, musik, efek suara | Ya | Ya |
| Gambar referensi | Hingga 10 | Hingga 30 (+10 video, +10 audio) | Hingga 3 |
| Video referensi | Hingga 3 | Hingga 10 | 1 (ekstensi) |
| Pengeditan video | Percakapan; mempertahankan apa yang tidak Anda sebutkan | Dapat dikontrol, presisi wilayah | — |
| Perpanjangan video | Peningkatan 10 dtk hingga 40 dtk, 10 dtk konteks | Sebelum atau sesudah, hingga 30 dtk | +7 dtk per langkah |
| Provenans | SynthID + Kredensial Konten C2PA | — | SynthID |
Angka Omni berasal dari halaman model dan postingan peluncuran Google; batas Popcraft adalah yang ditampilkan pemilih saat ini. Batas penyedia dapat berubah; pemilih selalu menampilkan apa yang tersedia saat ini.
Di mana permintaan tunggal yang panjang dan jelas memberikan hasil terbaik
Apa pun yang dulunya berarti lima klip dan satu penyambungan.
Hero halaman landas
Durasi apa pun dari 3 hingga 40 detik (30 pada 4K) dengan skornya sendiri, dalam satu file. Atur slider ke 24 dan Popcraft akan merangkai ekstensinya secara otomatis untuk Anda.
Trailer dan teaser
Satu alur utuh — pengenalan, pengungkapan, klimaks — dalam satu render berkelanjutan, dengan musik yang mengiringi di latar belakang.
Iklan dengan bintang yang konsisten
Beberapa foto produk atau presenter menjaganya tetap identik di setiap pengambilan gambar.
Ubah ulang hasil rekaman Anda
Cuaca, pakaian, atau waktu dalam hari diubah pada rekaman asli, durasi dan kamera tetap tidak tersentuh.
Ide yang diuraikan secara visual
Postingan peluncuran Google menyoroti hal ini: "video penjelasan yang menarik dari prompt singkat", dengan visual yang menguraikan ide yang kompleks.
Prompt untuk rangkaian
Panduan Google meminta deskripsi adegan, pergerakan kamera, pencahayaan, dan suasana, serta menyediakan sintaks timecode untuk peristiwa. Semua hal lainnya di sini berasal dari trailer di atas: ia melakukan apa yang kita minta, dan mengubah urutan yang kita minta, karena kita meminta terlalu banyak per segmen.
Satu aksi per 10 detik, dengan timecode
Tulis beat sebagai urutan berwaktu — panduan Google sendiri mendokumentasikan sintaks [0-3s] … [3-6s] …. Setiap segmen 10 detik mendapat satu hal yang jelas untuk dilakukan; model merencanakan segmen dari prompt, jadi berikan rencananya.
Tuliskan tampilan (grade, lensa, suasana) dalam satu baris singkat di akhir, bukan satu paragraf di awal. Untuk satu pengambilan tanpa putus, tuliskan: "dalam satu pengambilan berkelanjutan, tanpa potongan adegan".
Sebuah kapal bajak laut di tengah badai saat senja, bendera tengkorak, layar hitam yang robek. Satu pengambilan berkelanjutan, tanpa potongan adegan.\n[0-10s] Kapal menerobos ombak; kamera naik ke geladak.\n[10-20s] Kapten berjanggut di kemudi meneriakkan perintah; para kru membalas dengan sorakan.\n[20-30s] Ia membuka peti besi di haluan; isinya melimpah dengan cranberry merah.\n[30-40s] Kapal lawan menembak; cranberry berhamburan dalam gerakan lambat saat ia mengangkat pedangnya.\nTampilan: flare anamorfik, grade teal-dan-amber, skor orkestra, tanpa teks di layar.
Paragraf trailer yang padat
Inilah yang sebenarnya kami kirim untuk trailer di atas: lima ketukan, pengungkapan peti, kapal lawan, dan finale dalam satu paragraf tanpa putus. Model mempertahankan kapal, kapten, dan grade-nya, namun mengacak urutannya.
Semprotan cranberry muncul pada detik ke-8; peti tidak pernah terbuka dengan jelas. Prompt yang padat tidak gagal, melainkan dipadatkan.
Trailer blockbuster Hollywood, "Pirates of the Cranberries". Tampilan sinematik live-action epik: flare lensa anamorfik, grade teal-dan-amber yang dalam, kabut laut volumetrik, grain film 35mm… [lima ketukan, satu paragraf, 240 kata]
- Katakan "extend"
- Untuk ekstensi, kata tersebut adalah tombolnya. Popcraft menambahkannya di panel Extend Video jika belum ada; dari API atau MCP, tuliskan sendiri. Ekstensi hanya ditambahkan di akhir — tidak ada prepend.
- Frame juga butuh kata
- Dua gambar menjadi referensi subjek kecuali Anda menyebutkan "first frame" dan "last frame" serta mendeskripsikan transisinya.
- Arahkan suaranya
- Panduan Google: "Secara default, model akan mencoba menghasilkan track audio yang sesuai." Gunakan negasi sederhana — "tanpa dialog", "tanpa efek suara tambahan" — atau sebutkan yang Anda inginkan: radio yang menyala, hujan di atas canvas, dentingan string yang membesar.
- Jaga editan tetap sederhana
- Panduan Google lagi: "Prompt yang terlalu deskriptif dapat menyebabkan perubahan yang tidak diinginkan." Sebutkan perubahannya, tambahkan "pertahankan yang lain tetap sama", selesai.
Biayanya
Omni ditagihkan per detik yang dihasilkan, berdasarkan resolusi. Karena Popcraft hanya menawarkan durasi yang dapat dicapai model secara tepat, harga yang Anda lihat sebelum menghasilkan adalah harga yang Anda bayar.
Draf dan media sosial. Klip 10 detik membutuhkan 150 kredit; 40 detik penuh membutuhkan 600.
Kualitas hasil akhir. Trailer 40 detik di atas membutuhkan 920 kredit — satu permintaan, sudah termasuk suara.
Native 3840×2160 untuk penempatan utama. Dibatasi hingga 30 detik; rangkaian 4K 30 detik penuh membutuhkan 1.350 kredit.
Pertanyaan yang sering diajukan
Model video Google, yang digambarkan oleh DeepMind sebagai "langkah kami selanjutnya menuju model yang dapat membuat dan mengedit apa pun dari input apa pun — dimulai dengan video". Satu model mencakup teks-ke-video, gambar-ke-video, interpolasi bingkai pertama dan terakhir, referensi subjek, pengeditan video, dan perpanjangan adegan, serta menghasilkan ucapan, musik, dan efek suara di setiap klip. Versi 1.1, dirilis 27 Agustus 2026, menambahkan perpanjangan, bingkai kunci, dan output 1080p/4K.
Setiap proses pembuatan berlangsung hingga 10 detik; perpanjangan adegan menambah video dalam kelipatan 10 detik hingga total kumulatif 40 detik. Di Popcraft, Anda cukup memilih panjang apa pun dari 3 hingga 40 detik pada satu slider dan Popcraft secara otomatis merangkai proses perpanjangan dari satu prompt Anda; slider hanya menawarkan panjang yang dapat dihasilkan model, dan Anda membayar sesuai detik yang Anda dapatkan. Pada 4K, rangkaian berhenti di 30 detik, dan video bingkai pertama dan terakhir diproses dalam satu kali proses, sehingga panjangnya 3 hingga 10 detik.
Secara default, ya — panduan Google menyatakan model "akan mencoba menghasilkan trek audio yang sesuai", dan kartu model mencantumkan ucapan, musik, dan efek suara. Arahkan dalam prompt, termasuk "tanpa dialog" atau "tanpa musik" jika Anda menginginkan keheningan. Anda juga dapat mengganti atau melapisi audio setelahnya di timeline Popcraft.
Lampirkan klip dan pilih total panjang yang Anda inginkan. Klip asli dipertahankan bingkai demi bingkai dan segmen 10 detik penuh ditambahkan di akhir, dengan hingga 10 detik klip dibaca untuk kontinuitas. Klip 5 detik akan menjadi 15, 25, atau 35 detik — tidak pernah 20. Popcraft hanya menawarkan panjang yang dapat dihasilkan model dan menagihkan persis sesuai itu. Perpanjangan hanya ditambahkan di akhir.
Ya. Lampirkan sumber dan jelaskan perubahannya. Google merekomendasikan prompt edit sederhana dan menambahkan "pertahankan yang lain tetap sama"; model akan mempertahankan elemen yang tidak Anda sebutkan. Hasilnya mempertahankan panjang dan pembingkaian asli serta ditagihkan berdasarkan panjang klip sumber. Pengeditan dialog lisan tidak didukung.
4K dirender pada 3840×2160 dan biayanya tiga kali lipat tarif 720p per detik, karena menggunakan tiga kali lipat daya komputasi. Setiap segmen 4K memerlukan beberapa menit di hulu, sehingga rangkaian berhenti di 30 detik. Setiap panjang dan resolusi menampilkan harga kreditnya sebelum Anda membuat.
Karena setiap segmen 10 detik merupakan kelanjutan dari segmen sebelumnya dan model merencanakan ketukannya sendiri. Berikan satu tindakan jelas per 10 detik menggunakan sintaks timecode Google, dan hilangkan pengisi bahasa film. Trailer padat lima ketukan akan dikompresi atau diacak urutannya; tiga ketukan dalam 30 detik akan tetap utuh.
Setiap video Omni membawa watermark SynthID tak terlihat dari Google dan mendukung C2PA Content Credentials, yang memverifikasi asal tanpa memengaruhi tampilan klip. Paket berbayar Popcraft memberikan hak komersial atas video yang Anda hasilkan; unduhan tier gratis membawa watermark Popcraft yang terlihat, yang akan dihapus oleh paket berbayar. Anda tetap bertanggung jawab atas kemiripan dan konten dalam prompt serta media referensi Anda.
Siap untuk satu permintaan alih-alih lima klip?
Mulai dengan 10 detik pada 720p, nilai hasilnya, lalu perpanjang adegan — atau bawa klip yang sudah Anda sukai dan perpanjang klip tersebut.
Terus jelajahi
Model terkait
Seedance 2.5 menghasilkan video hingga 30 detik dalam satu proses, dengan hingga 50 aset referensi, pengeditan video yang dapat dikontrol, perpanjangan temporal fidelitas tinggi, rasio aspek apa pun dari 0,4 hingga 2,5, dan prompting native dalam 10+ bahasa. Tersedia di Popcraft.
MiniMax H3 menghasilkan video 2K pada 24fps dengan soundtrack stereo tersinkronisasi — efek, ambien, dan dialog dalam satu proses. Multi-shot dari satu prompt, 5 hingga 15 detik, kontrol bingkai awal dan akhir. Hadir di Popcraft.
Hasilkan video sinematik 4K dari teks, gambar, atau klip dengan Seedance 2.0 di Popcraft. Audio tersinkronisasi native, sekuens multi-shot, dan detail setajam silet hingga 4K (2160p).

Seedance 2.0 Mini adalah tier video paling ringan dari ByteDance — hingga 50% lebih murah dari Seedance 2.0 standar dan ~2× lebih cepat dari Fast, dengan prompt teks, gambar, video, dan audio. Tersedia di Popcraft.
