Długo opóźniany Gemini 3.5 Pro firmy Google wielokrotnie pojawiał się w puli ślepych testów LMSYS Chatbot Arena, wysyłając wyraźny sygnał społeczności programistów, że publiczna premiera flagowego modelu może w końcu być nieuchronna. Chociaż oficjalne stanowisko firmy pozostaje takie, że model „jest obecnie w fazie testów przez partnerów”, szereg obserwacji społeczności, anomalii zaplecza i niezwykle silnych reakcji wskazuje na późną fazę testów A/B przed szerszym wdrożeniem.

Obserwacje mają znaczenie, ponieważ pojawienie się na Chatbot Arena rzadko jest przypadkowe. Kiedy w ślepej bitwie o preferencje platformy pojawiają się niezapowiedziane modele, zwykle stanowi to ostatnią fazę testów warunków skrajnych przed publicznym interfejsem API i uruchomieniem sieci. Więcej informacji o tym, jak cykle wydawnicze kształtują rynek, znajdziesz w naszym opisie modeli sztucznej inteligencji.

Co widzą programiści

Zgodnie z obserwacjami społeczności zgłoszonymi przez NokiaPowerUser 2 sierpnia 2026 r. testerzy X i Discord opisali napotkanie szybkiego, wysoce kompetentnego modelu, który identyfikuje się jako dzieło DeepMind pod identyfikatorem gemini-3.5-pro. Pojawiło się kilka wzorców:

  • Powtarzające się występy w ramach ślepych testów: modelka stale pojawia się w anonimowych bezpośrednich porównaniach w Chatbot Arena. Jest to rodzaj ekspozycji, którą Google zwykle rezerwuje dla modeli, które ma wkrótce wysłać.
  • Aktywne sygnały z testów A/B: Na platformach programistycznych wykryto subtelne aktualizacje interfejsu i backendu, co jest zgodne z etapami wdrażania przed uruchomieniem.
  • Anomalie „Flash”: Wielu użytkowników udokumentowało odbiegające od normy odpowiedzi ze standardowych modeli Flash, które wykazały niezwykle głębokie rozumowanie, sugerując przekierowanie w tle do niepublikowanego modelu wyższego poziomu podczas oceny na żywo.

Google DeepMind utrzymuje, że weryfikacja partnera nadal trwa. Jak jednak zauważyła NokiaPowerUser, historia pokazuje, że ta faza zwykle szybko przechodzi do ogólnej dostępności po rozpoczęciu inscenizacji Areny.

Modelka, która jest już spóźniona

Obserwacje na Arenie mają miejsce po miesiącach frustracji giganta poszukiwawczego. Na konferencji programistów Google I/O w maju 2026 r. firma Google wprowadziła na rynek lżejszy model Gemini 3.5 Flash do codziennego użytku, a dyrektor generalny Sundar Pichai powiedział podczas odprawy prasowej przed konferencją, że wersja Pro pojawi się w czerwcu. „Jesteśmy również podekscytowani wersją 3.5 Pro” – powiedział Pichai według Mashable. „Używamy go wewnętrznie. Wykazujemy znaczną poprawę”.

Czerwiec przyszedł i minął bez zwolnienia. W połowie lipca Bloomberg poinformował, że opóźnienie spowodowało frustrację inżynierów Google, badaczy sztucznej inteligencji i menedżerów zaniepokojonych obawą, że firma ryzykuje utratę przewagi na rzecz rywali Anthropic i OpenAI. Mashable, który potwierdził raport Bloomberga z 17 lipca, zauważył, że Google przedstawił jedynie niejasne oświadczenie na temat „szybkiej wysyłki szerokiej gamy modeli”.

Dla Google stawka wykracza poza prawo do przechwalania się. Wcześniejsze przecieki sugerowały problemy Gemini 3.5 Pro w kluczowych obszarach, takich jak zaawansowane rozumowanie, kodowanie i długoterminowe wykonywanie zadań, co w niektórych testach plasowało go za konkurentami, takimi jak Fable 5 firmy Anthropic i GPT-5.6 firmy OpenAI.

Dlaczego luka w kodowaniu ma znaczenie

Moment każdego wdrożenia ma kluczowe znaczenie. Chociaż najnowsze wydania, takie jak Gemini 3.6 Flash, zapewniały solidną wydajność tokena i mniejsze opóźnienia, opinie programistów wskazują, że lekkie modele nadal nie sprawdzają się w przypadku złożonych, długoterminowych zadań inżynierii oprogramowania. Programiści szukają produktu flagowego zdolnego do refaktoryzacji na poziomie korporacyjnym, autonomicznego debugowania i wykonywania złożonej logiki bez wpadania w pętle halucynacji.

W oparciu o wczesne interakcje ze społecznością i najnowsze wzorce wydań Google, oczekiwane obszary zainteresowania Gemini 3.5 Pro obejmują zaawansowane kodowanie agentowe, głębszą integrację narzędzi i rozumowanie na poziomie pionierskim — czyli dokładnie te możliwości, w których lekkie modele okazały się niewystarczające.

Presja konkurencji rośnie

Google nie działa w próżni. Szerszym rynkiem modeli wstrząsnęła agresywna konkurencja cenowa i fala wydajnych modeli o otwartej wadze, szczególnie od chińskich deweloperów. DeepSeek i Moonshot AI Kimi K3 obniżyły koszty i zmniejszyły różnicę w wydajności, podczas gdy Anthropic i OpenAI w dalszym ciągu szybko udoskonalają swoje pionierskie oferty.

W takim środowisku przedłużone opóźnienie stwarza większe ryzyko niż zakłopotanie. Każdy tydzień bez konkurencyjnego produktu flagowego jest tygodniem, w którym programiści i przedsiębiorstwa rozważają alternatywy — a niektóre z tych alternatyw są teraz tańsze, a przy określonych zadaniach szybsze. Obserwacje na Arenie sugerują, że Google wie, że zegar tyka.

To, czy Gemini 3.5 Pro wypełni lukę w kodowaniu i uciszy obawy dotyczące jego możliwości rozumowania, stanie się jasne dopiero, gdy przejdzie od ślepych testów do rąk programistów. Jednak po lecie niedotrzymanych terminów pojawienie się modelu w puli testowej LMSYS jest najsilniejszym jak dotąd sygnałem, że premiera jest bliska.

Wyprzedź sztuczną inteligencję

Wyścig o dostarczenie kolejnego pionierskiego modelu nigdy nie zwalnia. AI Buzz Wire śledzi na bieżąco każdą publikację, wyciek i test porównawczy.

Poznaj najnowsze osiągnięcia AI →