OpenAI розмовляє з кількома незалежними оцінювачами, щоб допомогти збільшити кількість компаній, які мають досвід у безпеці передового штучного інтелекту та можуть надавати ефективні сторонні оцінки, повідомляється в блозі компанії у вівторок, 22 вересня, як повідомляє PYMNTS.

У дописі викладаються запропоновані OpenAI пріоритети та принципи ефективного стороннього нагляду — структура, за її словами, повинна застосовуватися до всіх передових лабораторій штучного інтелекту, коли вони навчаються, оцінюють і розгортають дедалі ефективніші моделі. Оголошення припадає на середину надзвичайно насиченого місяця для політики безпеки штучного інтелекту, і це можна зрозуміти як поступку критикам і спробу сформувати правила до того, як їх напишуть уряди. Для всіх, хто стежить за [найновішими новинами штучного інтелекту] (https://aibuzzwire.news), це останній крок у тижневому змаганні між лабораторіями, їхніми критиками та регуляторами щодо того, хто зможе перевірити безпечність передових моделей.

Що пропонує OpenAI

«Ми прагнемо підтримувати незалежних оцінювачів і встановлювати більш чіткі спільні міжнародні стандарти — як через майбутні закони, так і через ініціативи приватного управління — для ефективних оцінок третіми сторонами», — йдеться в публікації OpenAI, повідомляє PYMNTS.

Основною проблемою, яку описує OpenAI, є провал ринку: просто занадто мало організацій із технічною глибиною для аудиту граничної моделі. Змістовна оцінка безпеки вимагає доступу до неопублікованих систем, досвіду в сферах від кібербезпеки до біозахисту та інституційної незалежності для публікації небажаних висновків. Залучаючи та підтримуючи кількох оцінювачів, а не одного привілейованого аудитора, OpenAI каже, що хоче побудувати екосистему, де оцінка третьою стороною є звичайною частиною розгортання прикордонних систем, а не одноразовою вправою зі зв’язків з громадськістю.

Компанія не назвала імен оцінювачів, з якими вона розмовляє, і ще невідомо, чи нададуть результативні домовленості оцінювачам доступ, незалежність від фінансування та права на публікацію, які дослідники безпеки вважають доцільними.

Тиждень ударів по хлисту щодо політики штучного інтелекту

The proposal arrives amid a rapid sequence of policy developments that have defined September's AI debate:

  • Понеділок, 21 вересня: OpenAI закликав Сполучені Штати очолити міжнародні зусилля з розробки глобальних технічних стандартів для передового ШІ — включаючи рекурсивне самовдосконалення, точку, на якій системи ШІ вдосконалюються самі. Компанія попередила, що повністю автономна розробка штучного інтелекту може випередити здатність людини розуміти та контролювати його, і сказала, що рішення про те, чи потрібно продовжувати, і як це робити, потрібно приймати зараз.
  • П’ятниця, 18 вересня: Губернатор Каліфорнії Гевін Ньюсом підписав указ про скликання національних експертів для посилення законів штату про безпеку штучного інтелекту, явно спрямованих на прискорення впровадження нового стороннього нагляду за безпекою та ризиками безпеки в системах ШІ.
  • Субота, 19 вересня: Президент Дональд Трамп відкинув занепокоєння щодо безпеки галузі в дописі Truth Social, написавши: «Ми жодним чином не будемо перешкоджати чи душити зростання цієї неймовірної галузі. ШІ — це наступна промислова революція, або Інтернет, але він буде ще більшим і впливовішим, можливо, до 25% ВВП нашої країни».

Як ми повідомляли раніше цього тижня, пропозиція стандартів OpenAI під керівництвом США ознаменувала разючі зміни для компанії, яка роками протистояла обов’язковому нагляду, і нові принципи сторонньої оцінки поширюють цю позицію на фронт приватного управління.

Проблема незалежності

OpenAI's embrace of external watchdogs follows a parallel proposal from its chief rival. Приблизно тижнем раніше генеральний директор Anthropic Даріо Амодей опублікував есе, в якому пропонується план безпеки штучного інтелекту, побудований на основі незалежних оцінювачів, які працюють у провідних компаніях штучного інтелекту, координації між компаніями в демократичних країнах і, зрештою, міжнародної угоди, яка включає Китай.

Both proposals have drawn immediate skepticism from experts. CNBC reported that a coalition of more than 100 AI experts is urging independence and transparency from Anthropic, OpenAI and other foundation model labs conducting evaluations, warning that evaluators who are embedded within — or paid by — the companies they audit face unavoidable conflicts of interest. Watchdogs backed by AI pioneer Geoffrey Hinton have pressed both companies on the details of their safety plans, and commentators have flagged the revolving door between AI safety evaluation organizations and the labs themselves: the people grading the safety homework may also be the ones who wrote it.

That tension is the crux of the debate OpenAI's new post tries to defuse. The company's answer — more assessors, shared international standards, and oversight enforced through both future laws and private initiatives — is a framework, not yet a guarantee. Critics will point out that the labs proposing the rules are the same labs subject to them, and that self-shaped governance has historically favored the companies doing the shaping.

Чому це важливо

The next frontier models are already in training, and the window for designing oversight before deployment is closing. If OpenAI's recruitment of independent assessors produces auditors with real access and real independence, it could become the template for how frontier AI is governed worldwide — a private regime that lawmakers in Washington, Brussels and elsewhere have so far failed to build themselves. If it produces affiliated consultancies with NDAs, it will confirm the skeptics' worst reading.

Either way, the fact that OpenAI is competing with Anthropic over who can propose the most credible oversight regime is itself new. A year ago, the labs were unified mainly in opposing regulation. Тепер вони змагаються, щоб визначити це.

---

Будьте попереду ШІ

Отримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.

Читати більше новин AI →