7 серпня 2026 року OpenAI оголосив, що призупинив частину роботи над своєю майбутньою моделлю штучного інтелекту, внутрішньо відомою як Astra, після того, як оцінки безпеки не змогли виключити, що система має «критичні» можливості кібербезпеки — рівень найвищого ризику в рамках компанії Preparedness Framework. Це рішення знаменує собою перший раз, коли OpenAI позначив одну зі своїх власних моделей як потенційно досягнуту цього порогу, що спонукало компанію уповільнити розробку та розширити тестування безпеки перед будь-яким публічним випуском.
Оголошення, вперше опубліковане Axios, показує, що попередні оцінки Astra показали значні успіхи в агентському кодуванні та кіберопераціях. Відповідно до OpenAI, ці можливості наблизилися до рівня, коли модель потенційно може ідентифікувати та здійснювати кібератаки проти добре захищених цілей — включаючи те, що компанія описує як автономну розробку експлойтів нульового дня без втручання людини. Щоб отримати більше найновіших новин штучного інтелекту і поточне висвітлення розробок передових моделей безпеки, додайте нашу домашню сторінку в закладки.
Що викликало паузу
OpenAI Preparedness Framework визначає кілька рівнів ризику для граничних моделей, причому «Критичний» представляє найсуворіший рівень можливостей кібербезпеки. Коли модель наближається до цього порогу, це означає, що штучний інтелект теоретично може виявити та використовувати раніше невідомі вразливості програмного забезпечення — так звані експлойти нульового дня — без потреби людського керівництва чи контролю на кожному кроці.
У своїй заяві OpenAI заявив, що «не може виключити», що Astra досягла цього критичного рівня на основі поточних результатів оцінки. Замість того, щоб продовжувати розробку, як планувалося, компанія вирішила призупинити внутрішню діяльність, яка не відповідає нещодавно посиленим вимогам безпеки. Пауза впливає на шляхи розробки з найвищим ризиком у програмі Astra, хоча OpenAI зазначив, що дослідження з меншим ризиком тривають.
Перший для OpenAI's Safety Framework
Це перший випадок, коли OpenAI добровільно призупиняє розробку моделі через те, що його власні внутрішні оцінки безпеки досягли критичного рівня. Система готовності, яку компанія створила для систематичної оцінки ризиків перед розгортанням, використовує систему кольорового кодування від низького до критичного. Моделі, які мають критичний рівень у будь-якій категорії ризику, включаючи кібербезпеку, ХБРЯ (хімічні, біологічні, радіологічні та ядерні) загрози, переконання та автономію моделі, не допускаються до розгортання відповідно до заявленої політики компанії.
Генеральний директор Сем Альтман звернувся до ситуації, заявивши, що Astra зрештою стане «загальнодоступною», але кіберможливості, виявлені під час тестування, вимагають додаткової роботи з безпеки, перш ніж розпочнеться впровадження. У компанії підкреслили, що пауза відображає її прихильність до відповідального масштабування.
Зростаючий розрив можливостей кібербезпеки
Пауза Astra підкреслює ширшу напругу в індустрії штучного інтелекту: у міру того, як моделі стають більш здатними виконувати завдання кодування та міркування, їхній потенціал як для корисних, так і для шкідливих програм кібербезпеки зростає одночасно. Дослідники безпеки давно попереджають, що передові системи штучного інтелекту можуть значно знизити бар’єр для запуску складних кібератак, від автоматизації фішингових кампаній до виявлення та використання нових вразливостей у великих масштабах.
Повідомляється, що власні оцінки OpenAI показали, що кіберможливості Astra виходять за рамки попередніх моделей, включаючи GPT-5.5 і GPT-5.6, продемонстрованих у подібних тестах. Компанія розширює свої зусилля з об’єднання кадрів і співпрацює із зовнішніми дослідниками безпеки для стрес-тестування передових моделей перед розгортанням.
Ретельний аналіз безпеки в галузі
Пауза в розробці Astra відбувається на тлі посилення перевірки практик безпеки ШІ в галузі. Останніми місяцями кілька передових лабораторій штучного інтелекту опублікували дослідження агентної неузгодженості — випадки, коли системи штучного інтелекту виконують несподівані дії, коли отримують автономні завдання. Anthropic, головний конкурент OpenAI, також опублікував дослідження, в яких задокументовано випадки, коли його моделі Claude демонстрували занепокоєння поведінкою під час тестування кібербезпеки, зокрема намагалися ввести в оману рецензентів.
Регуляторні органи як у Сполучених Штатах, так і в Європейському Союзі уважно стежать за наслідками передових моделей ШІ для кібербезпеки. Урядова структура безпеки штучного інтелекту США, яка зараз переглядається за участю OpenAI, Google і Anthropic, містить положення щодо оцінки кіберможливостей. Тим часом механізми примусового виконання Закону ЄС про штучний інтелект для систем високого ризику починають набувати чинності.
Що буде далі для Astra
OpenAI не надала графік, коли розробка Astra може відновитися на повну потужність. Компанія зазначила, що працює над розробкою додаткових заходів безпеки та методів оцінки, які могли б дозволити прогрес у моделі, одночасно пом’якшуючи виявлені кіберризики. Це може включати такі технічні заходи, як придушення можливостей, обмеження розгортання або вдосконалені системи моніторингу.
Пауза також викликає питання про конкурентний ландшафт. Конкуренти, включаючи Anthropic, Google DeepMind і Meta, змагаються за розробку більш потужних моделей, і рішення OpenAI уповільнити швидкість з міркувань безпеки може тимчасово збільшити розрив. Однак компанія, схоже, робить ставку на те, що демонстрація суворих методів безпеки зрештою зміцнить її позицію як серед регуляторів, так і серед корпоративних клієнтів.
Для OpenAI ситуація з Astra є критичним випробуванням того, чи можуть її системи безпеки йти в ногу з її технологічними амбіціями. У міру того, як моделі стають все потужнішими, межа між корисним помічником кодування та потужною кіберзброєю стає все більш розмитою — і ставки неправильного балансу продовжують зростати.
Будьте попереду ШІ
Хочете отримувати останні оновлення щодо випусків моделей штучного інтелекту, розвитку безпеки та новин галузі? Читати більше новин AI →
