OpenAI увеличила вознаграждение за обнаружение «универсальных джейлбрейков» в своих моделях искусственного интеллекта до 50 000 долларов США, что более чем вдвое превышает предыдущую награду и сигнализирует о том, что компания считает определенные классы обходов безопасности достаточно серьезными, чтобы гарантировать выплату премии.

Обновленная программа Bio Bug Bounty, анонсированная OpenAI 9 июля 2026 года, просит исследователей безопасности найти подсказки, которые могут повсеместно преодолеть барьеры безопасности модели — обходные пути, которые работают в нескольких разговорах и контекстах, а не в отдельных крайних случаях. Программа специально нацелена на взломы, связанные с биологическими угрозами, когда модель ИИ может быть вынуждена предоставить действенные рекомендации по созданию опасных патогенов или оружия.

Чтобы узнать больше о последних новостях в области искусственного интеллекта и провести углубленный анализ, посетите AI Buzz Wire.

Почему 50 000 долларов?

Увеличение вознаграждения отражает растущую обеспокоенность по поводу разрыва между тем, что передовым моделям ИИ не рекомендуется делать, и тем, что решительные пользователи могут на самом деле извлечь из них пользу. Универсальный джейлбрейк особенно опасен, поскольку, в отличие от разового трюка с быстрым внедрением, он представляет собой систематическую слабость, которую можно тиражировать и распространять.

TechRepublic сообщила 10 июля, что увеличение вознаграждения происходит на фоне повышенного внимания к самым мощным моделям OpenAI. По данным National Technology News, администрация Трампа ранее просила OpenAI ограничить выпуск своей новейшей кибер-совместимой модели тщательно отобранной группой проверенных пользователей, что отражает обеспокоенность правительства по поводу наступательного потенциала передовых систем искусственного интеллекта.

Агентство Великобритании обнаружило, что кибервозможности искусственного интеллекта ускоряются

Объявление о награде совпадает с резким предупреждением британского Института безопасности искусственного интеллекта (AISI), который с 2024 года проводит независимую оценку кибервозможностей передовых моделей.

В ходе оценки OpenAI GPT-5.5 в апреле 2026 года AISI обнаружило, что эта модель достигла 71,4% проходимости задач кибербезопасности экспертного уровня — это самый высокий показатель среди всех протестированных моделей, превзойдя Anthropic Claude Mythos Preview с 68,6%, GPT-5.4 с 52,4% и Opus 4.7 с 48,6%.

Один из показателей был особенно поразительным. AISI разработала специальную задачу по обратному проектированию виртуальной машины — многоэтапную задачу, требующую от злоумышленника создания собственного декодера инструкций, обратного проектирования аутентификатора и восстановления действующего пароля. Эксперт-испытатель Crystal Peak Security решил задачу примерно за 12 часов, используя профессиональные инструменты. GPT-5.5 решил эту проблему за 10 минут и 22 секунды, заплатив за использование API 1,73 доллара США и не прибегая к помощи человека.

Удваивается каждые несколько месяцев

В отдельном анализе, опубликованном в мае 2026 года, AISI обнаружило, что продолжительность пограничных киберзадач, которые модели ИИ могут выполнять автономно, удваивается каждые 4,7 месяца с конца 2024 года — ускорение по сравнению с оценкой в 8 месяцев в ноябре 2025 года.

«Нынешние темпы изменений указывают на растущий потенциал кибервозможностей искусственного интеллекта, которые могут превратиться в ощутимые риски — риски, с которыми британским организациям придется столкнуться в ближайшие месяцы», — пишет AISI.

Claude Mythos Preview и GPT-5.5 существенно превзошли предыдущую тенденцию удвоения, что ставит вопрос о том, становится ли темп еще быстрее.

Универсальные джейлбрейки: самые высокие ставки

Различие между узким и универсальным побегом из тюрьмы имеет решающее значение. Узкий джейлбрейк может заставить модель выдать один запрещенный ответ при определенных условиях. Универсальный джейлбрейк, напротив, представляет собой фундаментальную брешь в архитектуре безопасности модели — метод, который надежно обходит барьеры в широком диапазоне входных данных.

Решение OpenAI предложить 50 000 долларов за такие открытия говорит о том, что компания считает, что универсальные джейлбрейки достаточно редки, чтобы оправдать большую награду, и достаточно опасны, чтобы оправдать инвестиции. Если универсальный джейлбрейк для запросов, связанных с биоугрозами, будет обнаружен злоумышленником до того, как он будет исправлен, последствия могут быть серьезными.

Программа также выполняет функцию прозрачности. Приглашая внешних исследователей для исследования своих моделей, OpenAI может выявлять и устранять уязвимости до того, как они будут использованы в реальных условиях — при условии, что вознаграждение достаточно велико для привлечения необходимого уровня талантов.

Гонка между нападением и защитой

Параллельные события — увеличение вознаграждения OpenAI и оценки возможностей AISI — иллюстрируют центральную напряженность в безопасности ИИ сегодня. Модели становятся значительно более способными решать киберзадачи, а временной горизонт задач, которые они могут выполнить, удваивается каждые несколько месяцев. В то же время компании спешат исправить уязвимости, которые делают их модели опасными.

Смогут ли награды и красные команды идти в ногу с ускоряющейся кривой возможностей, остается открытым вопросом. Но цифра в 50 000 долларов посылает четкий сигнал: OpenAI считает, что угроза достаточно серьезна, чтобы заплатить большие деньги любому, кто сможет доказать существование взлома.

Будьте впереди ИИ

По мере того, как передовые модели становятся все более мощными, битва между ограждениями безопасности и теми, кто пытается их сломать, будет только усиливаться. Следите за последними событиями на AI Buzz Wire.

Подробнее освещение отрасли искусственного интеллекта читайте на сайте AI Buzz Wire.