Google DeepMind готується запустити нову модель штучного інтелекту Gemini 3.8 Flash уже в середу, націлену на можливості розробки програмного забезпечення, де Google відставала від конкурентів Anthropic і OpenAI. The Wall Street Journal опублікував плани в понеділок, посилаючись на внутрішні тести, які показують, що нова модель досягає прогресу в кодуванні — області, яка стала полем битви між передовими лабораторіями.
Цей звіт сколихнув ринки: згідно з Barron's, акції Alphabet виросли на торгах у позаурочний час після публікації WSJ. Інвестори уважно спостерігали за ефективністю кодування Google, оскільки розробники дедалі більше орієнтуються у своєму виборі інструментів на те, яка модель найбільш надійно записує, налагоджує та рефакторює код у агентських робочих процесах. For more context on this story, see our ongoing more AI stories.
Про що повідомляє WSJ
Згідно з журналом, внутрішні тести Gemini 3.8 Flash показують прогрес саме в кодуванні, можливостях, де Gemini відстає як від моделей Claude від Anthropic, так і від лінійки GPT від OpenAI. Реліз очікується цього тижня, середа вказана як найраніший можливий день.
Оформлення має значення: Google не претендує на те, щоб здолати всіх конкурентів. Натомість компанія атакує свою найбільш очевидну слабкість. Агентське кодування, де модель штучного інтелекту планує, пише, тестує та виправляє код у багатьох файлах протягом тривалих сеансів, стало еталоном, який найбільше цікавить корпоративних покупців і стартапи інструментів для розробників, і це місце, де конкуренти Google створили провідних лідерів і базу лояльних користувачів.
Google має усунути прогалину кодування
Кодування тихо стало основним джерелом прибутку індустрії ШІ. Anthropic і OpenAI створили значні підприємства, продаючи моделі з можливістю кодування підприємствам і платформам розробників, а сторонні оцінки продуктивності агентного кодування незмінно ставлять моделі Claude і GPT попереду Gemini до 2026 року.
Цей розрив має реальні наслідки. Розробники, які обирають модель кодування, як правило, залишаються всередині її екосистеми — її інструментів CLI, її інтеграції редакторів, її виставлення рахунків API. Величезні переваги Google у розповсюдженні через Пошук, Android і Workspace не призвели до еквівалентного домінування в ніші кодування, і звіт WSJ свідчить про те, що DeepMind знає вікно для змін, яке є зараз.
Сам бренд Flash є частиною розрахунку. З тих пір, як Google почав позиціонувати Flash як швидкий і недорогий рівень сімейства Gemini, суфікс став представляти модель, яку розробники фактично використовують у виробництві — великі обсяги, чутливі до ціни робочі навантаження, де невеликі відмінності в затримці та вартості визначають вибір API. Модель Flash-рівня, яка також лідирує в кодуванні, підірвала б аргументи конкурентів щодо ціни, водночас відповідаючи їхнім вимогам щодо якості.
Швидкий перехід до Gemini 3.7 Flash
Якщо запуск відбудеться в середу, він відбудеться лише через кілька тижнів після того, як Google випустив Gemini 3.7 Flash у середині серпня, випуск, який компанія позиціонувала як свою найрозумнішу модель для програмування та агентів приблизно вдвічі нижчу від попередньої. Google також представив Gemini 3.7 Flash з розширеною потужністю кодування в кінці серпня, висвітлюючи його розгортання.
Стиснута каденція не залишилася непоміченою. NokiaPowerUser повідомила цього тижня про те, «як Google так швидко виправив 3.7 Flash», відображаючи ширшу думку про те, що DeepMind перейшов на швидку, поступову доставку — ближче до щотижневого ритму ітерацій своїх конкурентів, ніж до річних перерв у попередніх поколіннях Gemini.
Зосередженість на кодуванні та менше галюцинацій
Окрім міцності необробленого кодування, охоплення майбутньої моделі вказує на другий пріоритет: зменшення галюцинацій. VOI.ID повідомив, що тестування Gemini 3.8 Flash зосереджено на кодуванні, одночасно зменшуючи галюцинації штучного інтелекту — проблему надійності, яка має найбільше значення в роботі програмного забезпечення, де впевнено неправильна пропозиція може зламати робочу систему.
Ця комбінація — посилене агентне кодування плюс менша кількість сфабрикованих результатів — націлена саме на дві осі, на які розробники посилаються, пояснюючи, чому вони дотримуються інструментів на основі Claude або GPT для серйозної інженерної роботи.
Витік паперу Tencent
Ім’я моделі з’явилося на публіці ще до звіту WSJ, хоча й ледве. Згадка про Gemini 3.8 Flash з’явилася в дослідницькій статті Tencent, як повідомив Паскуале Піліттері, давши ентузіастам перше тверде підтвердження того, що модель існувала, але по суті нічого про неї не розкриває. Випадковий витік є знайомою закономірністю в галузі: порівняльні таблиці та списки цитувань у наукових статтях стали постійним джерелом інформації про неопубліковані моделі перед запуском.
Що це означає для розробників і ринку
Якщо Gemini 3.8 Flash з’явиться цього тижня, як повідомлялося, розробники матимуть три передові лабораторії, які постачатимуть моделі кодування найвищого рівня протягом того ж місяця, після запуску Anthropic Claude Fable 5.1 та Mythos 5.1 із дешевшим агентським кодуванням у понеділок. Ціновий тиск, який і без того є сильним, посилюватиметься — і виробники інструментів, які базуються на цих API, отримають важелі переговорів з кожним новим конкурентом.
Для Google ставки виходять за рамки думки розробника. Хмарний бізнес Alphabet, його пакет продуктивності Workspace та екосистема Android — усе це виграє, якщо власні моделі компанії можуть достовірно забезпечувати робочі процеси кодування, які підприємства першочергово автоматизують. Надійна історія кодування Gemini підтримує всі три.
Звіти WSJ свідчать про те, що Google вважає, що нарешті усунула прогалину. Чи згодні тести — і, що важливіше, робочі розробники — буде зрозуміло протягом кількох днів.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →
