У суботу Anthropic опублікував детальний набір самовимірів, щоб дозволити громадськості, журналістам і урядам відстежувати, наскільки швидко насправді розробляється передовий ШІ, включаючи перший у своєму роді індекс того, скільки власних досліджень компанії зараз виконує ШІ, а також відомості про те, що приблизно 30 000 агентів ШІ проводять дослідження та інженерну роботу всередині компанії в будь-який момент.

Публікація під назвою «Вимірювання для розуміння темпів розвитку штучного інтелекту в передових лабораторіях» знаходиться в центрі найбільш важливого аргументу в галузі: чи слід передовий розвиток навмисно сповільнювати. Даріо Амодей закликав до координації, щоб «вирівнювати межі», пропозиція, яка сколихнула ринки, викликала позов від споживачів про звинувачення в змові між великими лабораторіями та спонукала президента Трампа оголосити про створення «сил ШІ», спрямованих на запобігання будь-якому уповільненню. Антропік чітко висловлює цей контекст: «Оскільки світ розглядає питання про уповільнення темпів передового розвитку ШІ, громадськості потрібно більше інформації».

Три вимірювання для відстеження прогресу ШІ

Компанія виклала три області вимірювань, які, на її думку, будь-яка прикордонна лабораторія могла б регулярно публікувати:

1. Скільки досліджень і розробок у сфері штучного інтелекту виконується самим штучним інтелектом. Anthropic створила прототип «Індексу автоматизації досліджень і розробок Anthropic», каталогізувавши всі види досліджень і розробок у сфері штучного інтелекту, які виконуються в компанії, оцінюючи, наскільки автоматизовано кожне завдання на даний момент, і зводячи результати. Рейтинги використовуються за загальнодоступною шкалою «Рівня автоматизації» Epoch AI, яка проходить від AL0 (без участі ШІ) до AL5 (ШІ працює повністю автономно, без участі людини). У цьому масштабі AL3 означає, що штучний інтелект «співпрацює» — виконує великі частини роботи під наглядом людини, тоді як AL4 означає, що штучний інтелект «керує», виконуючи більшу частину завдання наскрізно за підказкою високого рівня, поки людина контролює.

Мета індексу полягає в тому, щоб виміряти, наскільки близько будь-яка лабораторія наближається до рекурсивного самовдосконалення — моделі, яка повністю автономно будує власного наступника. Anthropic зазначає, що моделі, які прискорюють розробку штучного інтелекту, «можуть ускладнити людям розуміння цих систем або керування ними».

2. Наскільки добре контролюються дії агентів штучного інтелекту. Тут з’являється цифра 30 000. Станом на серпень 2026 року приблизно 30 000 агентів виконували дослідницьку та інженерну роботу в будь-який час на найбільш використовуваній внутрішній платформі Anthropic, делегуючи завдання один одному та працюючи напівавтономно протягом тривалого часу. Компанія вимірює три параметри нагляду за цими агентами: охоплення (частка дій агента, які проходять через монітор до або після виконання), затримку перегляду (як швидко перевіряються дії, позначені прапорцями, спочатку автоматизованим монітором, а потім людиною) і рівень ескалації (частка дій, заблокованих, перенаправлених або позначених для перевірки).

Дані моніторингу Anthropic поки свідчать про те, що окремі агенти рідко поводяться неправильно, але компанія попереджає, що «коли в економіці працюють мільйони або мільярди агентів, навіть рідкісні події можуть відбуватися регулярно».

3. Як розподіляється обчислювальний ресурс. ​​Третє вимірювання відстежує, як розподіляються обчислювальні ресурси лабораторії — необроблені вхідні дані, які співвідносяться з можливостями моделі. Разом із двома іншими показниками Anthropic стверджує, що це дає стороннім можливість співвідносити вхідні дані моделі з результатами моделі, доповнюючи оцінки можливостей, які компанія вже публікує у звітах про ризики політики відповідального масштабування.

Цифри будуть змінюватися під час сповільнення

Найбільш політично гострий рядок у дописі спрямований безпосередньо на дискусію щодо темпів: Anthropic заявляє, що «очікує, що ці цифри зміняться, якби була координація щодо проходження кордону, як закликав генеральний директор Anthropic Даріо Амодей». Іншими словами, якщо галузь справді сповільнюється, громадськість може це підтвердити за цими показниками, і якщо компанії стверджують, що темпи ростуть, у той час як їхні показники продовжують зростати, вимірювання також це виявлять.

Незалежної перевірки бракує

Anthropic визнає основну слабкість самооцінених показників: вона використовує власні моделі для оцінки власних систем, що означає, що модель «судді» може розділити сліпі плями моделі, яку перевіряють. Компанія також відзначає відсутність єдиної методології в лабораторіях, що ускладнює порівняння.

Запропонований засіб виправлення полягає в тому, щоб включити незалежних сторонніх оцінювачів із кількох організацій до Anthropic, надаючи їм доступ до внутрішніх процесів, систем і даних, які можна порівняти з тими, які бачать внутрішні групи оцінки ризиків. Ці треті сторони перевірятимуть методи безпеки, повідомлятимуть про інциденти та відстежуватимуть нові показники. Компанія каже, що METR, некомерційна оцінювальна організація, раніше самостійно об’єднала свою платформу офлайн-моніторингу та планує регулярно публікувати ці вимірювання у формі, яку інші зможуть перевірити.

Вимірювання пов’язані з ширшою пропозицією Anthropic Advanced AI Framework, яка викладає «правила дорожнього руху» для прикордонних випусків моделей, включаючи зобов’язання щодо прозорості, які можуть вимагати уряди — наприклад, стандартизовані звіти про ризики.

Тест для всієї галузі

Більш глибоке значення посади може бути змагальним. Anthropic фактично закликає кожну прикордонну лабораторію публікувати однакові цифри, стверджуючи, що «будь-який прикордонний розробник міг би регулярно публікувати ці показники, використовуючи публічну методологію». Якщо суперники відмовляються, контраст стає власним джерелом даних у дискусії про безпеку; якщо вони погоджуються, галузь отримує перший загальний критерій того, наскільки швидко ШІ справді розвивається.

Наразі ці цифри повідомляє сама компанія, яка явно зацікавлена ​​в темпі розмови. Але вони являють собою те, чого не вистачає дискусії: конкретні, повторювані вимірювання, які б показали, чи прискорюється кордон, тримається стабільно чи насправді сповільнюється.

Будьте попереду ШІ

Подібні дані лабораторії Frontier публікуються щотижня. Щоб дізнатися більше про новітні дослідження штучного інтелекту та висвітлення галузі, слідкуйте за AI Buzz Wire.

Читати останні новини ШІ →