UpdateModel dan insight11 menit baca

Gemini Omni 1.1 Flash: apa yang diluncurkan untuk kontrol video

Gemini Omni 1.1 Flash dari Google adalah pembaruan video siap produksi: perpanjang adegan, tetapkan frame pertama dan terakhir, draf di 360p, lalu buat keluaran 1080p atau 4K.

Tim OmniArt
Gemini Omni 1.1 Flash: apa yang diluncurkan untuk kontrol video

Pada 27 Agustus 2026, Google merilis Gemini Omni 1.1 Flash — pembaruan berorientasi produksi pertama untuk model video Omni Flash yang diluncurkan di I/O. Pengumuman resmi dan utas X Google membingkainya sebagai rilis kontrol, bukan ganti nama: perpanjang sebuah adegan, kunci frame awal dan akhir, lampirkan referensi video pendek, draf dengan murah di 360p, lalu buat 1080p atau 4K untuk take yang Anda pertahankan.

Itu pekerjaan yang berbeda dari debut konsumen 19 Mei yang kami bahas di Gemini Omni Flash: apa yang diluncurkan dan apa yang ditahan Google. Pitch Flash asli adalah pengeditan percakapan dan input any-to-any, dengan klip keras 10 detik dan tanpa perpanjangan adegan di API developer 30 Juni. 1.1 adalah putaran yang mencoba membuat klip itu cukup panjang, cukup tajam, dan cukup terarah untuk pipeline produksi.

Artikel ini adalah ringkasan kemampuan: apa yang benar-benar ditambahkan 1.1, batas mana yang masih berlaku, dan pekerjaan mana yang sudah bisa Anda jalankan di OmniArt hari ini.

Apa yang benar-benar diluncurkan Gemini Omni 1.1 Flash

ID API Google adalah gemini-omni-1.1-flash (pratinjau di Gemini Enterprise Agent Platform sebagai gemini-omni-1.1-flash-preview). Keluaran default masih landscape 720p; 16:9 dan 9:16 tetap dua rasio aspek. Watermark SynthID masih wajib.

KemampuanOmni Flash asliOmni 1.1 Flash
Durasi klip10 detik per pembuatanPembuatan 10 detik, bisa diperpanjang dalam langkah 10 detik hingga total 40 detik
Perpanjangan adeganTidak ada di API 30 JuniMenganalisis hingga 10 detik rekaman sebelumnya (bukan hanya detik terakhir)
Frame pertama dan terakhirBukan mode API kelas satuMenginterpolasi gerak berkelanjutan di antara dua keyframe
Referensi videoSatu klip; klip lebih dari 3 detik tidak diproses sepenuhnyaHingga tiga klip, masing-masing 3 detik
Resolusi drafDefault 720p, tanpa tingkatan pratinjau yang lebih murahDraf 360p, Google menyebut hingga 60% lebih cepat dan sekitar sepertiga biaya 720p
Resolusi akhirTidak diungkap di I/O; OmniArt menyajikan 720pKeluaran 1080p atau 4K, didokumentasikan sebagai hasil dari pembuatan 720p yang diperbesar ke resolusi itu
PermukaanAplikasi Gemini, Flow, YouTube, lalu API 30 JuniGoogle AI Studio, Gemini API, Gemini Enterprise Agent Platform, Google Flow; perpanjangan adegan juga di aplikasi Gemini untuk Google AI Plus, Pro, dan Ultra

Daftar yang ditahan sejak I/O tidak bergerak. Dokumentasi Google saat ini masih menyatakan pengeditan suara tidak didukung, unggah referensi audio tidak didukung, dan mode avatar tidak pernah menjadi bagian dari rilis ini. 1.1 menambah arah dan durasi. Ia tidak menambah fitur yang ditahan demi keamanan.

Perpanjangan adegan: 10 detik konteks, hingga 40 detik

Perpanjangan adegan adalah berita utamanya. Anda melanjutkan dari ekor klip yang sudah ada, alih-alih berharap pembuatan 10 detik baru cocok dengannya.

Angka Google sendiri: model kini membaca hingga 10 detik rekaman sebelumnya — "lompatan dari model sebelumnya yang hanya merujuk detik terakhir" — lalu menambahkan 3–10 detik lagi. Ulangi itu dalam kenaikan 10 detik sampai klip kumulatif mencapai 40 detik. Beberapa frame terakhir sumber ditulis ulang agar sambungannya bukan potongan keras. Anda tidak bisa menambahkan di depan, dan Anda tidak bisa memperpanjang bagian tengah klip.

Demo perpanjangan adegan Gemini Omni 1.1 FlashDemo resmi Google tentang Omni 1.1 Flash yang melanjutkan adegan dari rekaman sebelumnya sambil mempertahankan identitas karakter, pencahayaan, dan konteks naratif.Perhatikan sambungannya, bukan hanya aksi baru: identitas, pencahayaan, dan skor seharusnya bertahan di perpanjangan, bukan direset.

Prompt untuk perpanjangan bisa sesingkat "Continue the scene." atau sespesifik gerakan kamera baru. Dokumentasi Google eksplisit bahwa 0 detik dalam prompt perpanjangan berstempel waktu berarti awal segmen baru, bukan awal klip asli. Deskripsikan audio jika Anda butuh skor berubah; jika tidak, model mencoba menjaganya koheren.

Dua batasan penting sebelum Anda merencanakan karya 40 detik di sekitar ini:

  • Klip sumber yang diunggah untuk perpanjangan harus 10 detik atau lebih pendek, kecuali Anda memperpanjang klip yang sudah dibuat model dalam sesi multi-giliran yang sama.
  • Memperpanjang klip unggahan tidak tersedia di EEA, Swiss, atau Inggris. Memperpanjang klip hasil pembuatan model tersedia di semua wilayah tempat API itu sendiri tersedia.

Di OmniArt, Seedance 2.5 sudah mencakup pekerjaan terkait: perpanjang hasil apa pun berdurasi 30 detik atau kurang, berulang, hingga 60 detik, atau buat 30–180 detik dalam satu pass Long Video. Itu jalur ruang kerja untuk video terarah yang panjang hari ini. Rantai native Omni 40 detik milik 1.1 adalah versi permukaan Google dari gagasan yang sama.

Frame pertama dan terakhir

Tetapkan gambar awal dan gambar akhir; Omni 1.1 membuat gerak berkelanjutan di antara keduanya. Google memosisikan ini untuk orbit kamera, transisi zoom, dan klip looping — yang terakhir dengan memakai gambar yang sama sebagai frame pertama sekaligus frame terakhir.

Demo frame pertama dan terakhir Gemini Omni 1.1 FlashDemo resmi Google tentang Omni 1.1 Flash yang menginterpolasi gerak kamera berkelanjutan antara shot awal dan frame akhir yang ditentukan.Uji yang berguna adalah apakah gerak di antaranya terbaca sebagai satu shot — whip-pan, zoom, loop — bukan dua still dengan dissolve.

Tag prompt mengikat perannya. Google mendokumentasikan tag sederhana FIRST_FRAME dan LAST_FRAME di dalam prompt; prompt yang lebih kompleks bisa menyatakan sumber secara eksplisit:

[# Sources <FIRST_FRAME>@Image1 <LAST_FRAME>@Image2]

Tag tetap di prompt sebagaimana ditulis. Instruksi di sekitarnya adalah tempat Anda mendeskripsikan gerakannya: satu shot berkelanjutan, tanpa jump cut, apa yang dilakukan kamera di antara dua still itu.

Di OmniArt, PixVerse V6 sudah mengekspos alur kerja transisi antara frame awal dan akhir yang disetujui. Jika brief-nya "dari frame ini ke frame itu," Anda tidak perlu menunggu Omni 1.1 mendarat sebagai id model terpisah. Jika brief-nya "lakukan itu di dalam utas percakapan Omni Flash," itu masih hidup di Interactions API Google.

Referensi video, hingga tiga detik masing-masing

1.1 memungkinkan Anda memasukkan video referensi pendek ke prompt multimodal yang sama bersama teks dan gambar. Demo publik Google memetakan tiga klip penari ke tiga still karakter dan meminta satu shot berkelanjutan.

Demo referensi video Gemini Omni 1.1 FlashDemo resmi Google tentang Omni 1.1 Flash yang memakai klip referensi pendek untuk mentransfer gerak dan performa karakter ke adegan baru.Setiap klip mengerjakan tugas gerak, bukan tugas tampilan: still membawa identitas, video tiga detik membawa tarian.

Langit-langit yang didokumentasikan lebih ketat daripada garis pemasaran. Referensi video paling baik untuk kemiripan; audio di dalam klip referensi diabaikan; Anda mendapat maksimum tiga klip, hingga 3 detik masing-masing. Google juga menyatakan merujuk atau bernalar lintas beberapa video tidak didukung sebagai perbandingan naratif — perlakukan setiap klip sebagai subjek atau referensi gerak, bukan sebagai sumber kedua untuk diedit.

Itu perluasan nyata dari pratinjau 30 Juni, yang menerima satu referensi video dan tidak memproses klip lebih panjang dari 3 detik secara penuh. Ini masih bukan separuh audio-masuk dari pitch any-to-any. Suara tetap sesuatu yang Anda deskripsikan di prompt.

Entri Gemini Omni OmniArt saat ini menerima satu video referensi (MP4 atau MOV, 1–10 detik) dicampur dengan hingga lima gambar referensi, dan menagih dari durasi klip sumber. Gunakan itu untuk satu referensi gerak hari ini. Untuk paket referensi yang lebih besar, Seedance 2.5 masih model ruang kerja yang dibangun di sekitar pekerjaan itu.

Draf 360p dan keluaran 1080p / 4K

Tangga resolusi adalah perubahan produksi lainnya. Pembuatan default adalah 720p. Anda kini bisa meminta:

  • 360p — tingkatan draf murah Google. Diklaim hingga 60% throughput lebih cepat dan sekitar sepertiga biaya 720p. Flow memungkinkan Anda membuat draf di 360p, lalu mengunduh hasil yang dipertahankan di 720p.
  • 1080p atau 4K — didokumentasikan sebagai keluaran dari pembuatan 720p yang diperbesar ke resolusi itu, ditujukan untuk finishing sosial, digital, atau siaran.

Alur kerja yang berguna adalah yang paling jelas: jelajahi kamera, performa, dan titik potong di 360p, lalu belanjakan pembuatan 1080p atau 4K pada take yang benar-benar akan Anda kirim. Itu disiplin yang sama dengan membuat draf pada model cepat di OmniArt sebelum menyelesaikan pada model berbiaya lebih tinggi — hanya sekarang ini sakelar resolusi pada satu model Omni.

Catatan

Google memublikasikan tabel harga API per resolusi bersama pengumuman 1.1. Perlakukan klaim 360p "sepertiga dari 720p" sebagai perbandingan Google sendiri, bukan sebagai perhitungan kredit OmniArt. Entri Gemini Omni di OmniArt saat ini menagih terhadap permukaan 720p, 3–10 detik.

Pembuatan 4K native masih pekerjaan Veo 3.1 dalam jajaran ini. Jalur 4K 1.1 adalah langkah finishing pada klip Omni, bukan klaim bahwa Omni menggantikan Veo untuk pengiriman layar besar.

Di mana ia aktif, dan apa yang diekspos OmniArt hari ini

Google merilis 1.1 di seluruh tumpukannya sendiri pada 27 Agustus:

  • Google AI Studio dan Gemini API (gemini-omni-1.1-flash)
  • Gemini Enterprise Agent Platform (gemini-omni-1.1-flash-preview)
  • Google Flow, termasuk frame awal/akhir, draf 360p, dan ekspor 1080p / 4K
  • Perpanjangan adegan aplikasi Gemini, untuk pelanggan Google AI Plus, Pro, dan Ultra

Pembuatan Gemini Omni standar sudah ada di OmniArt: 720p, 3–10 detik, audio native, hingga lima gambar referensi dan satu video referensi, paket Starter ke atas. OmniArt saat ini tidak mengekspos id model gemini-omni-1.1-flash terpisah, rantai perpanjangan 40 detik, tugas frame pertama-dan-terakhir, atau tangga resolusi 360p / 1080p / 4K. Pengeditan percakapan yang mempertahankan sesi masih memerlukan Interactions API Google, seperti saat kami membahas API developer 30 Juni.

Peringatan

Jangan merencanakan pengiriman Omni 1.1 40 detik terhadap pemilih Gemini Omni OmniArt saat ini. Model ruang kerja yang aktif adalah permukaan Omni Flash 720p, 10 detik. Gunakan API Google atau Flow untuk kontrol khusus 1.1 sampai entri model yang berbeda mendarat di sini.

Cara memilih dibanding Veo 3.1 dan Seedance 2.5

1.1 tidak memensiunkan sisa lini Google, dan tidak membuat Omni satu-satunya opsi video terarah di OmniArt. Pilih per shot:

Shot membutuhkanPilih
Revisi berbasis chat di dalam satu utas OmniGemini Omni 1.1 di API / Flow Google
4K native, audio spasial, finishing siaranVeo 3.1 di OmniArt
Take tunggal 30 detik, perpanjangan 60 detik, atau video panjang 180 detikSeedance 2.5 di OmniArt
Interpolasi frame pertama-ke-terakhir di ruang kerja hari iniTransisi PixVerse V6, atau First and Last Frames Seedance 2.5
Pembuatan Omni 720p cepat dengan satu referensi videoGemini Omni di OmniArt
Paket referensi multimodal yang besarSeedance 2.5

Polanya sama dengan yang kami pakai di I/O: rilis Omni baru adalah tambahan. Anda mempertahankan model yang sudah mencakup brief, dan Anda menambahkan 1.1 ketika pekerjaannya secara spesifik adalah kontrol percakapan Omni plus finishing yang lebih panjang dan lebih tajam.

Untuk kebiasaan prompt yang masih berlaku pada ketukan 10 detik pertama — satu aksi yang jelas, suara ditulis ke dalam prompt, tanpa kolom prompt negatif — lihat panduan prompt Omni Flash. Untuk bahasa perpanjangan pada model ruang kerja yang sudah melakukannya, lihat panduan pengeditan dan perpanjangan Seedance 2.5.

Apa yang dilakukan minggu ini di OmniArt

Jika Anda ingin mencoba Omni itu sendiri, buka Gemini Omni di ruang kerja video dan jalankan permukaan 10 detik, 720p saat ini: teks, gambar referensi, atau satu referensi video pendek. Bandingkan berdampingan dengan Veo 3.1, Seedance 2.5, PixVerse V6, Kling, dan sisa jajaran — satu saldo, satu tata bahasa prompt.

Jika brief-nya secara spesifik kontrol baru 1.1 — perpanjangan native Omni 40 detik, interpolasi frame pertama/terakhir di dalam Omni, atau loop 360p-lalu-4K — gunakan Google AI Studio, Flow, atau Gemini API minggu ini, dan perlakukan OmniArt sebagai tempat Anda sudah membuat sisa proyek.

Pemisahan itu sementara dengan cara yang sama dengan celah API Flash asli. Ketika kontrol 1.1 mendarat sebagai model OmniArt yang bisa dipilih, mereka menjadi opsi lain di ruang kerja yang sudah memproduksi, bukan alasan untuk menunggu.

FAQ

Apa itu Gemini Omni 1.1 Flash?

Gemini Omni 1.1 Flash adalah pembaruan Google 27 Agustus 2026 untuk Omni Flash, model pembuatan dan pengeditan video multimodal. Ia menambahkan perpanjangan adegan, interpolasi frame pertama-dan-terakhir, referensi video pendek, draf 360p, dan keluaran 1080p / 4K di atas pengeditan percakapan asli serta input teks/gambar/video.

Apakah Gemini Omni 1.1 Flash tersedia di OmniArt?

Tidak sebagai id model terpisah. OmniArt saat ini menyajikan pembuatan Gemini Omni standar pada 720p dan 3–10 detik. Kontrol khusus 1.1 — perpanjangan 40 detik, frame pertama/terakhir, draf 360p, dan keluaran 1080p / 4K — sedang dirilis di Google AI Studio, Flow, Gemini API, dan Gemini Enterprise Agent Platform.

Berapa lama video Omni 1.1 Flash bisa?

Satu pembuatan masih klip 10 detik. Perpanjangan adegan menambahkan 3–10 detik per kali, memakai hingga 10 detik rekaman sebelumnya sebagai konteks, hingga maksimum kumulatif 40 detik. Sumber unggahan untuk perpanjangan harus 10 detik atau lebih pendek.

Apakah Omni 1.1 Flash membuat 4K native?

Google mendokumentasikan 1080p dan 4K sebagai keluaran dari pembuatan 720p default yang diperbesar ke resolusi itu, bukan sebagai jalur pengambilan 4K native. Untuk video 4K native di OmniArt, Veo 3.1 tetap model lini Google yang dibangun untuk finishing itu.

Apakah 1.1 menambahkan unggah referensi audio atau pengeditan suara?

Tidak. Dokumentasi Omni Google saat ini masih mencantumkan unggah referensi audio dan pengeditan suara sebagai tidak didukung. Audio referensi video diabaikan. Suara masih diarahkan di prompt, yang sesuai dengan yang kami catat di artikel input any-to-any.

Siap membuat?

Mulai membuat konten menakjubkan dengan AI

Mulai gratis