Gemini 3.5 Pro Google yang telah lama tertangguh telah berulang kali muncul di dalam kolam ujian buta LMSYS Chatbot Arena, menghantar isyarat jelas kepada komuniti pembangun bahawa keluaran awam model perdana mungkin akan tiba. Walaupun talian rasmi syarikat kekal bahawa model itu "sedang dalam ujian rakan kongsi," rentetan penampakan komuniti, anomali bahagian belakang dan respons yang luar biasa kuat semuanya menunjukkan ujian A/B peringkat akhir sebelum pelancaran yang lebih luas.

Penampakan itu penting kerana penampilan di Chatbot Arena jarang sekali tidak disengajakan. Apabila model yang tidak diumumkan muncul dalam pertarungan pilihan buta platform, ia biasanya berfungsi sebagai fasa ujian tekanan terakhir menjelang API awam dan pelancaran web. Untuk mendapatkan maklumat lanjut tentang cara kitaran keluaran ini membentuk pasaran, ikuti [liputan model AI] kami(https://aibuzzwire.news).

Perkara yang dilihat oleh pembangun

Menurut pemerhatian komuniti yang dilaporkan oleh NokiaPowerUser pada 2 Ogos 2026, penguji di seluruh X dan Discord telah menggambarkan menghadapi model yang pantas dan sangat cekap yang mengenal pasti dirinya sebagai ciptaan DeepMind di bawah pengecam gemini-3.5-pro. Beberapa corak telah muncul:

  • Kemunculan ujian buta berulang: Model ini terus muncul dalam perbandingan kepala ke kepala tanpa nama Chatbot Arena, jenis pendedahan yang biasanya disimpan oleh Google untuk model yang akan dihantar.
  • Isyarat ujian A/B aktif: Kemas kini antara muka dan bahagian belakang yang halus telah dikesan merentas platform pembangun, corak yang konsisten dengan peringkat penggunaan prapelancaran.
  • Anomali "Flash": Berbilang pengguna mendokumenkan respons terpencil daripada model Flash standard yang memaparkan penaakulan luar biasa mendalam, mencadangkan penghalaan bayangan kepada model peringkat tinggi yang belum dikeluarkan semasa penilaian langsung.

Google DeepMind telah mengekalkan bahawa pengesahan rakan kongsi masih berterusan. Tetapi seperti yang dinyatakan oleh NokiaPowerUser, sejarah menunjukkan fasa ini biasanya beralih dengan cepat kepada ketersediaan umum sebaik sahaja pementasan Arena bermula.

Model yang sudah lewat

Penampakan Arena datang selepas berbulan-bulan kekecewaan untuk gergasi pencarian. Pada persidangan pembangun Google I/O pada Mei 2026, Google melancarkan model Gemini 3.5 Flash yang lebih ringan untuk kegunaan harian, dan Ketua Pegawai Eksekutif Sundar Pichai memberitahu taklimat media pra-persidangan bahawa versi Pro akan diikuti pada bulan Jun. "Kami juga teruja untuk 3.5 Pro," kata Pichai, menurut Mashable. "Kami menggunakannya secara dalaman. Ia menunjukkan peningkatan yang hebat."

Jun datang dan pergi tanpa pelepasan. Menjelang pertengahan Julai, Bloomberg melaporkan bahawa kelewatan itu telah menyebabkan kekecewaan di kalangan jurutera Google, penyelidik AI, dan pengurus yang bimbang syarikat itu berisiko kehilangan kelebihannya kepada saingan Anthropic dan OpenAI. Mashable, yang mengesahkan laporan Bloomberg pada 17 Julai, menyatakan bahawa Google hanya memberikan kenyataan yang samar-samar tentang "penghantaran dengan cepat merentasi pelbagai model."

Bagi Google, pertaruhan melangkaui hak bercakap besar. Kebocoran sebelum ini mencadangkan Gemini 3.5 Pro bergelut dalam bidang utama seperti penaakulan lanjutan, pengekodan dan pelaksanaan tugas jangka panjang, meletakkannya di belakang pesaing seperti Anthropic's Fable 5 dan OpenAI's GPT-5.6 dalam beberapa penanda aras.

Mengapa jurang pengekodan penting

Masa untuk sebarang pelancaran adalah kritikal. Walaupun keluaran terbaharu seperti Gemini 3.6 Flash menyampaikan kecekapan token yang kukuh dan kependaman yang lebih rendah, maklum balas pembangun menunjukkan bahawa model ringan masih gagal semasa tugas kejuruteraan perisian yang kompleks dan panjang. Pembangun sedang mencari perdana yang mampu memfaktorkan semula gred perusahaan, penyahpepijatan autonomi dan pelaksanaan logik yang kompleks tanpa jatuh ke dalam gelung halusinasi.

Berdasarkan interaksi komuniti awal dan corak keluaran Google baru-baru ini, kawasan tumpuan yang dijangkakan untuk Gemini 3.5 Pro termasuk pengekodan agenik lanjutan, penyepaduan alat yang lebih mendalam dan penaakulan peringkat sempadan — persis keupayaan di mana model ringan kurang memberangsangkan.

Tekanan persaingan semakin meningkat

Google tidak beroperasi dalam ruang hampa. Pasaran model yang lebih luas telah digoncang oleh persaingan harga yang agresif dan gelombang keluaran berwajaran terbuka yang mampu, terutamanya daripada pemaju China. Kimi K3 DeepSeek dan Moonshot AI telah mengurangkan kos dan mengecilkan jurang prestasi, manakala Anthropic dan OpenAI terus bergerak pantas pada tawaran sempadan mereka.

Dalam persekitaran itu, kelewatan berpanjangan lebih berisiko daripada memalukan. Setiap minggu tanpa perdana yang kompetitif adalah seminggu pembangun dan perusahaan menimbang alternatif — dan beberapa alternatif tersebut kini lebih murah dan, dalam tugas tertentu, lebih pantas. Penampakan Arena mencadangkan Google mengetahui jam semakin berdetik.

Sama ada Gemini 3.5 Pro menutup jurang pengekodan dan menyenyapkan kebimbangan tentang keupayaan penaakulannya hanya akan menjadi jelas apabila ia beralih daripada ujian buta ke tangan pembangun. Tetapi selepas musim panas tarikh akhir terlepas, kemunculan model dalam kumpulan ujian LMSYS adalah isyarat paling kuat bahawa pelancaran hampir.

Kekal Mendahului AI

Perlumbaan untuk menghantar model sempadan seterusnya tidak pernah perlahan. AI Buzz Wire menjejaki setiap keluaran, kebocoran dan penanda aras semasa ia berlaku.

Terokai perkembangan AI terkini →