Довго відкладений Gemini 3.5 Pro від Google неодноразово з’являвся в пулі сліпого тестування LMSYS Chatbot Arena, надсилаючи чіткий сигнал спільноті розробників про те, що публічний випуск флагманської моделі нарешті може бути неминучим. Хоча офіційна лінія компанії залишається такою, що модель «наразі тестується партнерами», низка спостережень спільноти, аномалії серверної частини та надзвичайно сильні відповіді вказують на пізню стадію A/B-тестування перед ширшим впровадженням.
Спостереження мають значення, оскільки поява на Chatbot Arena рідко буває випадковою. Коли неоголошені моделі з’являються під час сліпих битв за переваги платформи, це зазвичай служить останньою фазою стрес-тестування перед публічним API та запуском веб-сайту. Щоб отримати докладнішу інформацію про те, як ці цикли випусків формують ринок, перегляньте висвітлення моделі AI.
Що бачать розробники
Згідно зі спостереженнями спільноти, опублікованими NokiaPowerUser 2 серпня 2026 року, тестувальники X і Discord описали, як зустріли швидку, висококомпетентну модель, яка ідентифікує себе як творіння DeepMind під ідентифікатором gemini-3.5-pro. З’явилося кілька закономірностей:
- Неодноразове сліпе тестування: модель постійно з’являється в анонімних особистих порівняннях Chatbot Arena, яке Google зазвичай резервує для моделей, які збирається відправити.
- Сигнали активного A/B-тестування: Тонкі оновлення інтерфейсу та серверної частини були помічені на платформах розробників, шаблон узгоджується з етапами розгортання перед запуском.
- Аномалії «Flash»: кілька користувачів задокументували відхилення від стандартних моделей Flash, які відображали надзвичайно глибокі міркування, що вказує на перенаправлення тіні до неопублікованої моделі вищого рівня під час реальної оцінки.
Google DeepMind стверджує, що перевірка партнера все ще триває. Але, як зазначає NokiaPowerUser, історія показує, що ця фаза зазвичай швидко переходить до загальнодоступної, щойно починається постановка на Арені.
Модель, яка вже запізнилася
Спостереження на Arena сталися після місяців розчарування пошукового гіганта. На своїй конференції розробників Google I/O у травні 2026 року Google представила полегшену модель Gemini 3.5 Flash для повсякденного використання, і генеральний директор Сундар Пічаї повідомив на брифінгу для ЗМІ перед конференцією, що версія Pro з’явиться в червні. «Ми також раді 3.5 Pro», — сказав Пічаї, повідомляє Mashable. «Ми використовуємо його всередині країни. Він демонструє значні покращення».
Червень прийшов і пішов без звільнення. У середині липня Bloomberg повідомляв, що затримка викликала розчарування серед інженерів Google, дослідників штучного інтелекту та менеджерів, стурбованих тим, що компанія ризикує втратити перевагу перед конкурентами Anthropic і OpenAI. Mashable, який підтвердив звіт Bloomberg 17 липня, зазначив, що Google надала лише розпливчасту заяву про «швидку доставку для широкого діапазону моделей».
Для Google ставки виходять за рамки хвастощів. Попередні витоки свідчать про те, що Gemini 3.5 Pro має проблеми в ключових сферах, таких як просунуте міркування, кодування та довгострокове виконання завдань, що поміщає його позаду таких конкурентів, як Fable 5 від Anthropic і GPT-5.6 від OpenAI у деяких тестах.
Чому прогалина кодування має значення
Час будь-якого розгортання має вирішальне значення. Хоча нещодавні випуски, як-от Gemini 3.6 Flash, забезпечили надійну ефективність маркерів і меншу затримку, відгуки розробників свідчать про те, що полегшені моделі все ще не вистачають під час виконання складних довгострокових завдань розробки програмного забезпечення. Розробники шукають флагман, здатний здійснювати рефакторинг корпоративного рівня, автономне налагодження та виконання складної логіки, не потрапляючи в петлі галюцинацій.
Базуючись на ранніх взаємодіях із спільнотою та моделях нещодавніх випусків Google, очікувані напрямки для Gemini 3.5 Pro включають розширене агентне кодування, глибшу інтеграцію інструментів і обґрунтування на передовому рівні — саме ті можливості, які полегшені моделі недооцінювали.
Конкурентний тиск зростає
Google не працює у вакуумі. Широкий ринок моделей був збурений агресивною ціновою конкуренцією та хвилею потужних відкритих випусків, особливо від китайських розробників. Kimi K3 від DeepSeek і Moonshot AI знизили витрати та скоротили розрив у продуктивності, тоді як Anthropic і OpenAI продовжують швидко вдосконалювати свої передові пропозиції.
У такому середовищі тривала затримка загрожує не лише збентеженням. Кожен тиждень без конкурентоспроможного флагмана — це тиждень, коли розробники та підприємства зважують альтернативи — і деякі з цих альтернатив тепер дешевші, а в конкретних завданнях — швидші. Спостереження на Арені показують, що Google знає, що годинник цокає.
Чи Gemini 3.5 Pro заповнить прогалину кодування та заспокоїть занепокоєння щодо своїх можливостей міркування, стане зрозуміло лише після переходу від сліпого тестування до рук розробників. Але після літа пропущених термінів поява моделі в тестовому пулі LMSYS є найсильнішим сигналом того, що запуск наближається.
Будьте попереду ШІ
Гонка за випуск наступної передової моделі ніколи не сповільнюється. AI Buzz Wire відстежує кожен випуск, витік і контрольний тест.
Ознайомтеся з останніми розробками ШІ →