Google wis ngluncurake Gemini 3.8 Live lan Gemini 3.8 Live Extended Thinking, pasangan model dialog langsung sing diterangake perusahaan minangka sing paling maju kanggo obrolan swara alami. Model kasebut wiwit diluncurake tanggal 15 September ing Gemini API, Google AI Studio, Search Live, Gemini Live lan Google Workspace, kanthi akses perusahaan ing pratinjau pribadi liwat Gemini Enterprise.

Pengumuman kasebut teka saka Tom Ouyang, insinyur utama, lan Malini Jaganathan, anggota staf teknis, nulis atas jenenge Tim Audio Gemini. Iki ngluwihi kulawarga Gemini 3.8 sing miwiti debut awal wulan iki kanthi model Flash lan Flash Cyber, lan menehi tandha push paling agresif Google ing wektu nyata, pitulung swara multimodal - pasar ing ngendi mode swara OpenAI lan gelombang wiwitan wicara saingan kanggo kasus panggunaan saben dina sing padha.

Peluncuran mathuk menyang babagan rame banget kanggo garis model Google; jangkoan perkembangan AI paling anyar nuduhake perusahaan saiki wis dikirim bola-bali sajrone sawetara minggu amarga nglawan pesaing babagan rega, coding lan saiki swara.

Dibangun kanggo Obrolan Real-Time

Sing mbedakake model Live saka model chatting standar karo mikropon ditempelake iku latensi lan negara. Dokumentasi API Live Google njlèntrèhaké antarmuka latensi sing kurang sing ngolah aliran audio, gambar lan teks sing terus-terusan liwat sambungan WebSocket stateful, nampa audio PCM 16kHz mentah, gambar JPEG nganti siji pigura per detik, lan teks, lan ngasilake audio sing diucapake kanthi nyata.

Model ngolah input visual ing wektu nyata, ngidini asisten ndeleng apa sing dideleng pangguna - video demonstrasi Google nuduhake Gemini 3.8 Live nuntun sesi onboarding karyawan nggunakake konteks visual, muter catur ing wektu nyata, lan mbangun rencana bisnis lengkap lan toolkit marketing khusus liwat wicara alami. Model kasebut uga bisa ndeteksi lan transisi ing antarane 97 basa sing didhukung kanthi otomatis, ing tengah obrolan, tanpa ngganti setelan pangguna.

Mbok menawa sing paling penting kanggo panggunaan praktis: model nglakokake alat lan panggilan API ing latar mburi nalika obrolan diterusake, ngakoni panjaluk lan njaga dialog nalika tugas rampung. Sing dadi asisten saka responden adhedhasar strictly dadi soko nyedhaki agen sing kelakon ngomong.

Angka-angka sing Ditemokake Google

Google nglaporake manawa Gemini 3.8 Live Extended Thinking entuk posisi paling dhuwur ing Indeks Kualitas Speech-to-Speech Analisis Artificial kanthi skor 82.6. Nalika ngrampungake tugas agen, perusahaan kasebut nyebutake 68.6% ing pathokan τ-Voice lan 35.1% ing evaluasi τ-Voice-banking Sierra, bebarengan karo skor 97.7% ing Big Bench Audio.

Iki minangka tokoh sing dilaporake Google dhewe, lan verifikasi independen bakal mbutuhake wektu - nanging pratelan ing ndhuwur grafik Analisis Artificial, yen ana, bakal ndadekake Google luwih dhisik tinimbang penawaran sing dioptimalake ucapan saka OpenAI lan perusahaan AI swara khusus babagan kualitas obrolan sakabèhé. Google uga ujar Extended Thinking njaga titik rega sing kompetitif banget, kanthi implisit kanggo tekanan rega sing wis nemtokake generasi 3.8.

Kabeh audio sing diasilake dening model kasebut diwenehi tandha banyu nganggo SynthID, tandha banyu Google sing ora katon, saengga wicara sing digawe AI tetep bisa dideteksi - perlindungan kepatuhan lan salah informasi sing dadi standar ing produk generatif Google.

Ngendi Sampeyan Bisa Gunakake

Kasedhiyan beda antarane rong model. Gemini 3.8 Live kasedhiya kanggo kabeh wong ing Search Live, mode telusuran visual wektu nyata Google. Extended Thinking kasedhiya ing Gemini Live, ing Docs kanggo Google AI Pro lan pelanggan Ultra liwat Workspace, lan ing Gmail lan Keep kanggo kabeh pangguna Google.

Pangembang entuk model liwat Gemini API lan Google AI Studio, lan Google ujar manawa Live API wis digunakake dening platform kalebu Agora, Fishjam, LiveKit, Pipecat, Vercel lan Agen Vision kanggo mbangun antarmuka sing didorong swara ing ndhuwur infrastruktur wektu nyata Google. Salesforce, Genspark lan Lumeris dijenengi minangka mitra peluncuran kanggo model anyar.

Pasar AI Swara rame

Swara dadi medan perang antarmuka taun 2026 amarga ing kana AI pungkasane lolos saka keyboard. Model sing bisa ndeleng, ngrungokake, ngalih basa lan mbukak alat nalika ngomong ora saingan karo chatbots liyane nanging kanthi telpon, garis dhukungan pelanggan lan asisten pribadi.

Kauntungan Google yaiku distribusi: Panelusuran, Android, Workspace lan Chrome menehi model Live basis sing diinstal sing ora ana saingan sing bisa cocog. Perusahaan taruhan manawa ana ing saben pojok dina pangguna - saiki nganggo model swara sing paling apik - bakal luwih penting tinimbang menang benchmark. Saingan bakal entuk kesempatan kanggo nanggapi, nanging Google wis jelas manawa swara kasebut, yen wis dadi fitur demo, saiki dadi baris produk kelas siji.

Kanggo pangembang, pesen kasebut uga langsung. Kanthi nerbitake format input sing tepat, nyathet eksekusi alat latar mburi lan nyebarake ekosistem nganggo platform Live API, Google nyoba nggawe tumpukan kasebut minangka substrat standar kanggo sapa wae sing nggawe antarmuka lisan - saka bot dhukungan pelanggan nganti asisten sing bisa dipakai. Apa pratelan kualitas Gemini 3.8 Live tetep ing tes independen, play kasedhiyan wis aktif.

---

Tetep Ahead of AI

Entuk warta, analisis, lan terobosan AI paling anyar - kabeh ing sak panggonan.

Waca liyane AI warta →