У вівторок Google анонсувала Gemini 4 Argon, свою новітню передову модель, створену для довгострокової професійної роботи в області розробки програмного забезпечення, завдань корпоративних знань і захисту кібербезпеки. В офіційному блозі Google Корай Кавукчуоглу, старший віце-президент Google DeepMind і головний архітектор штучного інтелекту, сказав, що спочатку модель розгортається для набору надійних кіберзахисників через програму Fairwind від Google, а після зміцнення огорожі з’явиться ширший доступ.

Оголошення припадає на один із найактивніших періодів року щодо передових випусків ШІ. Для безперервного висвітлення запусків моделей, політичних суперечок і раундів фінансування AI Buzz Wire відстежує важливі події, коли вони відбуваються.

Поетапне розгортання, сформоване обережністю

На відміну від типового запуску великої моделі, більшість користувачів не можуть спробувати Argon сьогодні. Google заявив, що бере участь у добровільному процесі уряду США щодо доступу до попередніх моделей і поступово розширюватиме доступність у міру того, як відгуки перших тестувальників формуватимуть її гарантії. Агентство Reuters повідомило, що флагман надійде після місяців затримок, а VentureBeat зазначив, що стратегія обмеженого випуску все ще дозволяє Google претендувати на повторне лідерство в тестах OpenAI і Anthropic. Bloomberg повідомляв про вимірний скептицизм щодо нової моделі серед власних співробітників Google перед запуском.

Коли з’явиться ширший доступ, Google повідомила, що почне з платних клієнтів API та передплатників Google AI Ultra.

Що, за словами Google, може зробити аргон

Головна зміна можливостей — це витривалість. Обмеження вихідних токенів Argon було розширено до найкращого в галузі 1 мільйона токенів порівняно з попередніми 64 тисячами. Google стверджує, що, надавши моделі запас для обдумування сотень тисяч токенів в одній траєкторії, вона дає змогу вирішувати складні проблеми за один прохід, а не фрагментувати роботу між сеансами.

Google опублікував результати порівняльного тесту, щоб підтвердити передову вимогу:

  • DeepSWE v1.1: 77,9% — новий рівень техніки в реальному тесті розробки програмного забезпечення
  • Індекс Вальса: № 1 — найкращі показники фінансової, програмної, юридичної та податкової діяльності, зважені за внеском у ВВП США
  • AutomationBench: 51,3% — перше місце в еталонному тесті наскрізного бізнес-виконання Zapier
  • LVBench: 91,7% — сучасний рівень розуміння довгого відео
  • CWE-bench v1: 68% — перше місце у виправленні вразливості безпеки

У власних робочих процесах Google

Argon вже є джерелом внутрішньої роботи Google, і компанія надала надзвичайно конкретні приклади. У квантових обчисленнях модель оптимізувала просторово-часові ресурси для вузьких підпрограм, перевищивши опубліковану базову лінію на 40% за хвилини. Аналізуючи телеметрію профілювання всієї групи, команди агентів Argon визначили та застосували оптимізацію пам’яті в центрах обробки даних Google, що звільнило понад 300 TiB після розгортання, із приблизною економією від 500 TiB до 1 PiB.

Модель також забезпечує масштабну міграцію коду з C/C++ на Rust, масштабуючи від десятків тисяч рядків у основних бібліотеках, таких як re2 і libgav1, до понад 800 000 рядків у ядрі Fuchsia Zircon. Для libgav1, відеодекодера Google з відкритим вихідним кодом, агенти Argon замінили 32 000 рядків SIMD-коду на зручний для компілятора безпечний Rust, створивши безпечний для пам’яті декодер, який працює в 2,7 рази швидше, ніж попередній порт Rust з ідентичним виходом.

Захист від кібербезпеки на першому місці

Аргон був спеціально навчений для оборонної кіберроботи: автономного пошуку, перевірки та виправлення критичних уразливостей програмного забезпечення. Для надійних захисників і внутрішніх команд Google компанія випустить модель без кіберперегородок, щоб захисники отримали повні можливості. У CWE-bench v1, який вимірює усунення вразливостей, Argon займає перше місце з показником 68%, базуючись на передовій продуктивності 3.8 Flash Cyber, і Google каже, що Argon перевершив цю модель у виявленні поверхонь атаки та створенні доказів концепції у внутрішньому еталонному тесті Wiz на проникнення через чорну скриньку.

Охоронна фірма Wiz вже використовує Argon через свою ініціативу Scan for Good, яка безкоштовно захищає критичну громадську інфраструктуру. Під час першої демонстрації Google стверджує, що модель виявила критичну вразливість, через яку відкривається конфіденційна особиста інформація в програмному забезпеченні охорони здоров’я, яке використовується в лікарнях по всьому світу — ризик, який попередні передові моделі упустили.

Чотири рівні прикордонних гарантій

Перш ніж стати широко доступним, Google посилює захист у чотирьох сферах. Захищаючи від зловживання, Argon розроблено таким чином, щоб відхиляти запити на кібер- та ХБРЯ-атаки, зберігаючи при цьому законні дослідження подвійного використання за допомогою нових методів, які відстежують внутрішні активації моделі для виявлення зловживань. Проти швидкого введення завдяки суперницькому тренуванню Argon став найстійкішою моделлю Google, яка лідирує в тесті Indirect Prompt Injection від Gray Swan.

У разі неузгодженості Google використовує засоби пом’якшення, які відстежують ланцюжок думок і дій Argon, припиняючи виконання, коли це необхідно, із направленням сповіщень до спеціальної групи реагування на інциденти. Компанія також посилила свої навчальні та оцінювальні середовища в ізольованому програмному середовищі, закриваючи їх перед запусками з високим ризиком. Зокрема, Google закликав решту представників галузі зберігати прозорість міркувань, щоб модельні думки залишалися корисними для діагностики неузгодженості.

Ціни та наявність

Argon буде запущено за початковою ціною 2 долари США за мільйон вхідних токенів і 10 доларів США за мільйон вихідних токенів, із кешованими вхідними токенами на 95% нижче від вхідної ціни. Після вступного періоду ціна зростає до 4 доларів США за мільйон вхідних токенів і 20 доларів США за мільйон вихідних токенів, що робить Argon агресивним проти конкуруючих передових пропозицій.

Поетапний дебют відображає нову реальність передових випусків: можливості тепер є ставками, а диференціатор демонструє контроль. Google робить ставку на те, що кіберзахисники, лікарняне програмне забезпечення та міграції Rust є правильною вітриною, і що повільніше публічне впровадження коштує дешевше, ніж черговий інцидент безпеки. Розробникам і підприємствам слід стежити за платним вікном доступу до API та AI Ultra, яке, за словами Google, відкриється, щойно це дозволить тестування огорожі.

---

Будьте попереду ШІ

Отримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.

Читати більше новин AI →