OpenAI підвищила винагороду за виявлення «універсальних джейлбрейків» у своїх моделях штучного інтелекту до 50 000 доларів, що більш ніж удвічі перевищує попередню винагороду та свідчить про те, що компанія вважає певні класи обходів безпеки достатньо серйозними, щоб виправдати преміальну виплату.

Оновлена ​​програма Bio Bug Bounty, оголошена OpenAI 9 липня 2026 року, просить дослідників безпеки знайти підказки, які можуть універсально прорвати захисні поручні моделі — обхідні засоби, які працюють у кількох розмовах і контекстах, а не в окремих крайових випадках. Програма спеціально націлена на втечу з в’язниці, пов’язану з біологічними загрозами, коли модель штучного інтелекту можна змусити надавати дієві вказівки щодо створення небезпечних патогенів або зброї.

Щоб отримати більше останніх новин AI та поглибленого аналізу, відвідайте AI Buzz Wire.

Чому 50 000 доларів?

Збільшення винагороди відображає зростаюче занепокоєння щодо розриву між тим, чого передові моделі штучного інтелекту заборонено робити, і тим, що рішучі користувачі можуть фактично отримати з них. Універсальний джейлбрейк є особливо небезпечним, оскільки, на відміну від одноразового трюку швидкого впровадження, він представляє систематичну слабкість, яку можна відтворити та поширити.

10 липня TechRepublic повідомило, що підвищення винагороди відбувається на тлі посиленої перевірки найпотужніших моделей OpenAI. Раніше адміністрація Трампа звернулася до OpenAI з проханням обмежити випуск своєї новітньої кібер-сумісної моделі спеціально відібраною групою перевірених користувачів, згідно з National Technology News, що відображає стурбованість уряду щодо наступального потенціалу прикордонних систем ШІ.

Британське агентство вважає, що кіберможливості ШІ прискорюються

Оголошення про винагороду збігається з різким попередженням Інституту безпеки штучного інтелекту Великобританії (AISI), який з 2024 року незалежно оцінює кібер-можливості передових моделей.

Під час оцінки OpenAI GPT-5.5 у квітні 2026 року AISI виявив, що ця модель досягла 71,4% результатів завдань із кібербезпеки на рівні експерта — найвищого показника з усіх перевірених моделей, перевершивши Claude Mythos Preview від Anthropic — 68,6%, GPT-5.4 — 52,4% і Opus 4.7 — 48,6%.

Один показник був особливо вражаючим. AISI розробила спеціальне завдання зворотного проектування віртуальної машини — багатоетапне завдання, яке вимагає від зловмисника створення спеціального декодера інструкцій, зворотного проектування автентифікатора та відновлення дійсного пароля. Експерт Crystal Peak Security вирішив це завдання приблизно за 12 годин за допомогою професійних інструментів. GPT-5.5 розв’язав її за 10 хвилин і 22 секунди за 1,73 долара за використання API без допомоги людини.

Подвоєння кожні кілька місяців

В окремому аналізі, опублікованому в травні 2026 року, AISI виявив, що з кінця 2024 року тривалість кіберзавдань, які передові моделі штучного інтелекту можуть виконувати автономно, подвоюється кожні 4,7 місяця — це прискорення порівняно з оцінкою 8 місяців у листопаді 2025 року.

«Поточні темпи змін вказують на зростаючий потенціал кіберможливостей штучного інтелекту для перетворення на відчутні ризики — ризики, з якими організаціям Великобританії доведеться орієнтуватися в найближчі місяці», — пише AISI.

Claude Mythos Preview і GPT-5.5 значно перевершили попередню тенденцію подвоєння, що викликає питання, чи темпи стають ще швидшими.

Універсальний джейлбрейк: найвищі ставки

Різниця між вузьким джейлбрейком і універсальним є критичною. Вузький джейлбрейк може змусити модель створити єдину заборонену відповідь за певних умов. Універсальний джейлбрейк, навпаки, представляє фундаментальну тріщину в архітектурі безпеки моделі — метод, який надійно обходить огорожу в широкому діапазоні вхідних даних.

Рішення OpenAI запропонувати 50 000 доларів США за такі відкриття говорить про те, що компанія вважає, що універсальні джейлбрейки досить рідкісні, щоб виправдати велику винагороду, і досить небезпечні, щоб виправдати інвестиції. Якщо універсальний джейлбрейк для запитів, пов’язаних із біозагрозами, виявить зловмисник до того, як його виправлять, наслідки можуть бути серйозними.

Програма також виконує функцію прозорості. Запрошуючи зовнішніх дослідників для дослідження своїх моделей, OpenAI може виявляти та виправляти вразливості до того, як їх використають у дикій природі — за умови, що винагорода достатньо велика, щоб залучити потрібний калібр талантів.

Гонка між нападом і захистом

Паралельні події — збільшення винагороди OpenAI та оцінка можливостей AISI — ілюструють центральну напругу в безпеці ШІ сьогодні. Моделі стають значно більш спроможними виконувати кіберзавдання, а часовий горизонт завдань, які вони можуть виконати, подвоюється кожні кілька місяців. У той же час компанії намагаються виправити вразливості, які роблять їхні моделі небезпечними.

Питання, чи зможуть баунті та червоне об’єднання йти в ногу з прискоренням кривої можливостей, залишається відкритим. Але цифра в 50 000 доларів є чітким сигналом: OpenAI вважає, що загроза достатньо серйозна, щоб заплатити найкращі гроші будь-кому, хто зможе довести існування тріщин.

Будьте попереду ШІ

Оскільки прикордонні моделі стають потужнішими, боротьба між огорожами безпеки та тими, хто намагається їх зламати, лише посилюватиметься. Слідкуйте за останніми подіями на AI Buzz Wire.

Докладніше [висвітлення індустрії штучного інтелекту] (https://aibuzzwire.news) на сайті AI Buzz Wire.