В субботу Anthropic опубликовала подробный набор собственных измерений, призванных позволить общественности, журналистам и правительствам отслеживать, насколько быстро на самом деле разрабатывается передовой ИИ, включая первый в своем роде индекс того, какая часть собственных исследований компании сейчас выполняется с помощью ИИ, а также сообщение о том, что около 30 000 агентов ИИ выполняют исследовательскую и инженерную работу внутри компании в любой момент времени.

Пост, озаглавленный «Измерения для понимания темпов развития ИИ в передовых лабораториях», оказывается в центре наиболее значимого спора в отрасли: следует ли намеренно замедлять передовое развитие. Дарио Амодей призвал к координации, чтобы «пройти границу», предложение, которое потрясло рынки, вызвало иск потребителей, обвиняющих в сговоре между крупными лабораториями, и побудило президента Трампа объявить о создании «Силы искусственного интеллекта», призванной предотвратить любое замедление темпов роста. Формулировка Anthropic четко описывает этот контекст: «Поскольку мир рассматривает возможность замедления темпов передового развития искусственного интеллекта, общественность нуждается в большем количестве информации».

Три показателя для отслеживания прогресса ИИ

Компания выделила три области измерений, которые, по ее мнению, любая передовая лаборатория могла бы регулярно публиковать:

1. Какая часть исследований и разработок в области ИИ выполняется самим ИИ. Anthropic создала прототип «Индекса автоматизации антропных исследований и разработок», каталогизируя все виды исследований и разработок в области ИИ, проводимых в компании, оценивая степень автоматизации каждой задачи в настоящее время и агрегируя результаты. В рейтингах используется общедоступная шкала «Уровня автоматизации» Epoch AI, которая варьируется от AL0 (без участия ИИ) до AL5 (ИИ работает полностью автономно, без участия человека). В этом масштабе AL3 означает, что ИИ «сотрудничает» — выполняя большие объемы работы под непосредственным руководством человека, — в то время как AL4 означает, что ИИ «руководит», выполняя большую часть задач сквозным образом с помощью подсказок высокого уровня под контролем человека.

Цель индекса — измерить, насколько близка какая-либо лаборатория к рекурсивному самосовершенствованию — модели, полностью автономно создающей свою собственную преемницу. Anthropic отмечает, что модели, ускоряющие разработку ИИ, «могут затруднить людям понимание этих систем или контроль над ними».

2. Насколько хорошо контролируются действия ИИ-агентов. Отсюда и появляется цифра в 30 000. По состоянию на август 2026 года около 30 000 агентов одновременно выполняли исследовательскую и инженерную работу на наиболее используемой внутренней платформе Anthropic, делегируя задачи друг другу и работая в полуавтономном режиме в течение длительного времени. Компания измеряет три параметра надзора за этими агентами: охват (доля действий агента, которые проходят через монитор до или после выполнения), задержка проверки (как быстро помеченные действия проверяются сначала автоматическим монитором, а затем человеком) и скорость эскалации (доля действий, заблокированных, перенаправленных или помеченных для проверки).

Данные мониторинга Anthropic на данный момент показывают, что отдельные агенты редко ведут себя плохо, но компания предупреждает, что «когда в экономике действуют миллионы или миллиарды агентов, даже редкие события могут происходить регулярно».

3. Как распределяются вычислительные ресурсы. Третье измерение отслеживает, как распределяются вычислительные ресурсы лаборатории — необработанные входные данные, которые коррелируют с возможностями модели. Вместе с двумя другими метриками, утверждает Anthropic, это дает посторонним возможность сопоставлять входные данные модели с результатами модели, дополняя оценки возможностей, которые компания уже публикует в своих отчетах о рисках в рамках политики ответственного масштабирования.

Числа будут снижаться в условиях замедления

Самая политически острая линия в посте направлена непосредственно на дебаты о темпах: Anthropic заявляет, что «ожидала бы, что эти цифры изменятся, если бы существовала координация в определении темпов развития, как того требует генеральный директор Anthropic Дарио Амодей». Другими словами, если отрасль действительно замедляется, общественность может это проверить с помощью этих показателей, а если компании заявляют, что идут в ногу со временем, в то время как их численность продолжает расти, измерения также покажут это.

Независимая проверка — недостающая часть

Anthropic признает главную слабость самооцениваемых показателей: она использует свои собственные модели для оценки своих систем, а это означает, что «судья»-модель может разделять «слепые зоны» проверяемой модели. Компания также отмечает отсутствие единой методологии в лабораториях, что затрудняет сравнение.

Предлагаемое решение — внедрить в Anthropic независимых сторонних оценщиков из нескольких организаций, предоставив им доступ к внутренним процессам, системам и данным, сопоставимым с тем, что видят внутренние группы по оценке рисков. Эти третьи стороны будут проверять правила техники безопасности, сообщать об инцидентах и ​​отслеживать новые показатели. Компания сообщает, что METR, некоммерческая организация по оценке, ранее самостоятельно объединила свою платформу автономного мониторинга и планирует регулярно публиковать эти измерения в форме, которую смогут проверить другие.

Измерения связаны с более широким предложением Anthropic Advanced AI Framework, в котором излагаются «правила движения» для выпусков пограничных моделей, включая обязательства по прозрачности, которые могут потребоваться правительствам, например, стандартизированные отчеты о рисках.

Тест для всей отрасли

Более глубокое значение поста может быть конкурентным. Anthropic фактически призывает каждую передовую лабораторию публиковать одни и те же цифры, утверждая, что «любой передовой разработчик может регулярно публиковать эти показатели, используя общедоступную методологию». Если конкуренты откажутся, контраст станет отдельной точкой данных в дебатах о безопасности; если они согласятся, отрасль получит первый общий критерий того, насколько быстро действительно развивается ИИ.

На данный момент цифры предоставлены компанией, явно заинтересованной в разговоре о темпах. Но они представляют собой то, чего не хватало в дебатах: конкретные, повторяемые измерения, которые показали бы, ускоряется ли фронтир, остается стабильным или фактически замедляется.

Будьте впереди ИИ

Подобные разоблачения из пограничной лаборатории происходят еженедельно. Чтобы узнать больше о последних исследованиях в области искусственного интеллекта и освещении отрасли, подписывайтесь на AI Buzz Wire.

Читайте последние новости искусственного интеллекта →