Google DeepMind wis ngowahi panggunaan komputer dadi alat sing dibangun ing Gemini 3.5 Flash, menehi pangembang cara asli kanggo mbangun agen AI sing bisa sesambungan karo piranti lunak ing antarane platform tanpa bolting ing kerangka pihak katelu.

Pengumuman kasebut, diterbitake tanggal 24 Juni 2026 ing blog Kata Kunci resmi Google, posisi Gemini 3.5 Flash minangka pesaing ing pasar sing obah kanthi cepet kanggo agen sing bisa ndeleng layar, mindhah kursor, klik, lan ngetik - kemampuan sing nganti saiki mbutuhake teknik khusus sing signifikan. For more context on this story, see our ongoing artificial intelligence updates.

"Penggunaan komputer saiki dadi alat sing dibangun ing Gemini 3.5 Flash kanggo mbangun agen sing bisa sesambungan antarane platform," tulis perusahaan. Kiriman kasebut ditulis dening Mateo Quiros, manajer produk ing Google DeepMind.

Cara Kerjane

Panggunaan komputer ngidini model kanggo ngoperasikake komputer kaya manungsa: kanthi napsirake apa sing ana ing layar lan njupuk tindakan kayata ngeklik, nggulung, lan ngetik teks. Kanthi nggawe kemampuan langsung menyang Gemini 3.5 Flash tinimbang nawakake minangka produk sing kapisah, Google nyuda alangan kanggo pangembang sing pengin nggawe agen sing navigasi aplikasi nyata, situs web, lan sistem operasi.

Miturut kiriman blog, pangembang lan perusahaan bisa miwiti nggunakake komputer ing 3.5 Flash liwat Gemini API lan Gemini Enterprise Agent Platform, lingkungan khusus Google kanggo mbangun lan nyebarake agen kanthi skala.

Google nuduhake kemampuan kasebut kanthi kasus panggunaan konkrit. Ing salah sawijining conto, Gemini 3.5 Flash nggunakake komputer kanggo nganalisa aplikasi Gemini dhewe lan ngasilake dhaptar fitur sing dikategorikake. Ing liyane, model kasebut ngaudit dokumentasi dhewe kanggo masalah aksesibilitas - tugas referensi mandiri sing menehi pitunjuk babagan carane agen sing nggunakake komputer bisa mbantu njaga ekosistem piranti lunak sing ditindakake.

Safety: Adversarial Training lan Pendekatan 'Defense-in-Depth'

Sisih paling penting saka rilis kasebut yaiku apa sing diomongake Google babagan safety. Agen sing beroperasi ing lingkungan urip unik banget ngrugekke kanggo injeksi cepet - serangan sing instruksi didhelikake ditempelake ing kaca web, email, utawa dokumen mbajak agen kanggo njupuk tindakan sing ora disengaja.

Google ujar nggunakake latihan adversarial sing ditargetake kanggo panggunaan komputer ing Gemini 3.5 Flash kanggo nyuda risiko kasebut. Iki uga ngeculake rong sistem perlindungan perusahaan opsional sing dikandhakake perusahaan supaya organisasi bisa ngontrol apa sing bisa ditindakake dening agen kasebut.

Njupuk pendekatan "pertahanan-in-depth", Google nyengkuyung para pangembang kanggo nggabungake fitur-fitur kasebut karo sandboxing aman, verifikasi manungsa-in-the-loop, lan kontrol akses sing ketat. Perusahaan nerbitake pandhuan tambahan ing dokumentasi praktik paling apik kanggo fitur kasebut.

Sing penting framing. Panggunaan komputer dianggep minangka salah sawijining kemampuan agen sing luwih mbebayani kanggo disebarake, amarga agen sing dikompromi bisa tumindak nyata ing akun lan sistem pangguna. Kanthi ngarahake latihan mungsuh lan perlindungan berlapis, Google nyoba ngyakinake para panuku perusahaan sing ragu-ragu ngontrol kursor menyang AI.

Napa Panggunaan Komputer Dadi Medan Perang

Panggunaan komputer Gemini 3.5 Flash teka minangka balapan laboratorium AI utama kanggo nggawe agen sing bisa nindakake pakaryan migunani tinimbang mung mangsuli pitakon. Anthropic ngenalake alat panggunaan komputer kanggo Claude ing pungkasan taun 2024, lan produk operator lan agen OpenAI wis maju menyang arah sing padha. Nggawe kapabilitas asli saka model sing cepet lan hemat biaya kaya Flash - tinimbang nyetop kanggo tingkat premium - sinyal yen Google pengin commoditize kontrol agen kanthi cepet.

Pilihan saka Flash dhewe kacathet. Lampu kilat minangka model tingkat efisiensi Google, dioptimalake kanggo kacepetan lan biaya. Nambahake panggunaan komputer ing kana, tinimbang mung ing model Pro sing luwih gedhe, nyaranake Google ngarepake beban kerja agen kanthi volume dhuwur, sensitif latensi - jinis sing ngotomatisasi tugas sing bola-bali ing piranti lunak bisnis kanthi skala.

Google ujar manawa wis ndeleng para pelanggan nyopir nilai kanthi nggunakake komputer, sanajan kiriman blog kasebut ora menehi jeneng penyebaran komersial khusus utawa ngitung asil.

Taruhan Kompetitif

Kanggo pangembang, daya tarik saka alat komputer-nggunakake dibangun ing langsung: integrasi kurang kanggo njaga lan vendor siji tanggung jawab kanggo model lan lapisan agen. Nanging uga nambah katergantungan ing platform Google, sawijining tradeoff sing bakal ditimbang dening perusahaan marang keluwesan kerangka agen model-agnostik.

Rilis kasebut uga nambah ketegangan ing ekonomi agen. Gerbang agen open-source sing dikembangake kanthi mandiri, kayata kerangka Lightport sing nggawe macem-macem panyedhiya LLM kompatibel karo OpenAI, nuduhake pira permintaan kanggo infrastruktur agen portabel. Taruhan Google yaiku alat panggunaan komputer pihak katelu sing hardened keamanan bakal menangake pangembang sing bakal nggawe alat pihak katelu. Nalika model entuk kemampuan kanggo tumindak ing layar, garis antarane asisten AI lan operator otonom terus burem - lan uga garis antarane terobosan produktivitas lan tanggung jawab keamanan. Wangsulan Google kanggo ketegangan kasebut yaiku perlindungan berlapis lan latihan mungsuh. Apa iku cukup kanggo gawe marem Enterprises averse resiko bakal nemtokake carane cepet agen nggunakake komputer pindhah saka demo kanggo nggunakake saben dina.

Kanthi Gemini 3.5 Flash, Google wis nggawe taruhan sing jelas: masa depan AI ora mung model sing mangsuli, nanging model sing tumindak - lan pengin para pangembang mbangun model akting kasebut ing platform kasebut.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →