Google ana ngumumake Gemini Omni 1.1 Flash, nganyari siap produksi kanggo model video generatif sing nambah ekstensi pemandangan, kontrol kamera sinematik lan output 4K, miturut kiriman ing blog Google resmi dening manajer produk DeepMind Anish Nangia lan Alisa Fortin.
Nganyari kasebut mindhah Omni saka model eksperimen menyang apa sing diarani Google minangka kesiapan produksi kanggo panggunaan profesional liwat API Gemini ing Google AI Studio, kanthi kasedhiyan uga kadhaptar liwat Platform Agen Gemini Enterprise. Google njlèntrèhaké Gemini Omni minangka wis nggawa pertimbangan donya nyata kanggo nggawe generatif, lan posisi release 1.1 minangka titik ngendi model dadi cukup andal kanggo pangembang mbangun alur kerja video, alat kreatif lan piranti lunak editing media.
Crita sing luwih dawa liwat ekstensi pemandangan
Kapabilitas judhul yaiku ekstensi pemandangan, sing ngidini para pangembang njupuk video sing wis ana lan terus ngasilake cuplikan kanthi lancar saka papan sing ditinggalake. Kanthi Omni 1.1, Google ujar manawa model kasebut bisa nganalisa nganti 10 detik konteks sadurunge - lompatan saka model sadurunge sing mung referensi detik pungkasan. Asil kasebut, miturut perusahaan, nambah konsistensi visual lan ketaatan narasi nalika mbangun crita sing luwih dawa utawa ngepang menyang arah kreatif anyar.
Video bisa ditambahi kanthi tambahan 10 detik nganti total dawa kumulatif 40 detik. Sing tetep cendhak dawa video tradisional, nanging kanggo isi short-form, iklan kreatif lan karya pra-visualisasi, Google taruhan sing kontrol lan konsistensi penting luwih saka durasi.
Materi demonstrasi sing diterbitake bebarengan karo woro-woro kasebut nuduhake kepiye alur kerja kasebut bisa digunakake ing praktik: saben pituduh anyar nerusake adegan sadurunge, kanthi model nggawa konteks visual maju nalika pituduh kasebut ngarahake owah-owahan ing gerakan kamera, setelan lan malah swasana ati - siji urutan pindhah saka obrolan sing cedhak menyang tarik-metu alon liwat katakombe sing mbledug lan banjur menyang perpustakaan ngambang sing amba. Mbangun pemandangan ing lapisan, tinimbang ngasilake ing siji tembakan, luwih cedhak karo cara editor nglumpukake cuplikan tinimbang carane piranti teks-kanggo-video awal bisa digunakake.
Kontrol kamera lan interpolasi pigura
Rilis kasebut uga nambahake apa sing diterangake Google minangka alat produksi video kualitas studio. Antarane conto sing ditampilake ing kirim woro-woro: dolly-zoom sinematik sing mindhah kamera maju nalika nggedhekake, zoom-zoom mekanik menyang mata karakter, lan rotasi orbital 360 derajat ngubengi karakter beku kanggo nampilake ambane lan paralaks 3D.
Pangembang uga bisa nemtokake pigura pisanan lan pungkasan kanggo dijupuk, karo model interpolasi transisi Gamelan antarane wong-wong mau - technique menowo kanggo animator profesional sing menehi kontrol nggoleki-grained ngendi dijupuk wiwit lan ends. Tindakake perkembangan AI paling anyar amarga Google nerusake irama rilis kanthi cepet.
Iterate ing 360p, ngirim ing 4K
Omni 1.1 Flash ngenalake alur kerja kualitas rong tingkat sing ngarahake kontrol biaya. Pangembang bisa ngasilake pratinjau 360p kanthi cepet kanggo ngowahi gagasan kanthi luwih cepet lan luwih murah sajrone proses kreatif, banjur ningkatake proyek pungkasan dadi resolusi 4K kanggo asil sing apik. Google ngandika upscaling mrodhuksi garing, output dhuwur-resolusi cocok kanggo nggunakake profesional.
Pipa pratinjau-kanggo-4K ngatasi salah sawijining masalah ekonomi sing terus-terusan saka video generatif: biaya regenerasi output resolusi lengkap saben owah-owahan cepet. Kanthi ngilangi eksplorasi saka pangiriman, Google nggawe model kasebut luwih praktis kanggo saluran pipa komersial ing ngendi puluhan iterasi ndhisiki render pungkasan.
Apa iku penting
Pembaruan kasebut nggambarake owah-owahan industri saka kualitas generasi mentah menyang kontrol - kemampuan kanggo ngarahake gerakan kamera, njaga konsistensi karakter lan ngetung pigura sing tepat, kaya sing ditindakake dening direktur utawa editor. Kanggo pangembang sing nggawe piranti lunak kreatif, prabédan antarane demo lan produk sing bisa disebarake asring ana ing kontrol kasebut tinimbang kasetyan mentah.
Bingkai Google babagan rilis kasebut ndadekake pamirsa sing dituju kanthi jelas. Perusahaan kasebut ngarani telung kategori target - alur kerja video generatif, piranti kreatif lan piranti lunak panyuntingan media - lan nggambarake nganyari kasebut minangka nggawe video generatif luwih bisa dikontrol, luwih cepet diulang lan dipoles kanggo penyebaran donya nyata. Prototyping luwih cepet katon bebarengan karo upscaling 4K ing ringkesan rilis, nandheske manawa kacepetan iterasi didol minangka fitur dhewe.
Kanthi Omni 1.1 Flash kasedhiya ing AI Studio lan liwat Gemini API, Google uga nyurung model kasebut menyang pangguna perusahaan liwat Gemini Enterprise Agent Platform, menehi tandha yen video generatif diposisikan minangka infrastruktur bisnis tinimbang barang anyar kanggo konsumen.
Apa sing kudu ditonton
Rincian rega kanggo output 4K ora disorot ing woro-woro kasebut, lan pangembang bakal nonton kepiye watesan kumulatif 40 detik mengaruhi rencana produksi ing donya nyata. Kompetisi ing video AI tetep kuat, kanthi saingan ngirim fitur kontrol dhewe kanthi cepet - dinamis sing wis bola-bali nyepetake umur pratelan sing paling canggih ing taun iki.
Saiki, pesen Google kanggo pangembang langsung: video generatif sing sepisan mbutuhake alkimia lan luck saiki bisa diarahake, ditambahi lan rampung ing 4K liwat API siji.
---
Tetep Ahead of AIEntuk warta, analisis, lan terobosan AI paling anyar - kabeh ing sak panggonan.
Waca liyane AI warta →