На этой неделе Anthropic опубликовала первый в своем роде обзор собственного процесса разработки, сообщив, что ее модель Клода теперь «руководит» 26% исследований и разработок в области искусственного интеллекта в компании — по сравнению с менее чем 1% в феврале 2026 года. Цифры появились в сообщении в блоге компании под названием «Измерения для понимания темпов разработки искусственного интеллекта в передовых лабораториях», опубликованном Anthropic 17 сентября и опубликованном агентством Reuters, Вашингтон. Почта и другие торговые точки.
Этот пост частично является демонстрацией прозрачности, а частично аргументом: Anthropic хочет, чтобы другие пограничные лаборатории публиковали такие же цифры, чтобы общественность и правительства могли отслеживать, как быстро ИИ передаёт ключи к созданию ИИ. Подробнее об этой истории — в нашем новости об ИИ.
Три цифры для отслеживания развития ИИ
Компания предложила три показателя, которые, по ее словам, проливают свет на темпы разработки в передовых лабораториях: какая часть исследований и разработок в области ИИ выполняется самим ИИ, насколько хорошо контролируются действия агентов ИИ и как вычисления распределяются между работой по обеспечению возможностей и работой по обеспечению безопасности.
Заголовок взят из того, что Anthropic называет своим индексом автоматизации исследований и разработок. Компания каталогизировала все виды исследований и разработок в области искусственного интеллекта, проведенных в компании, оценила, насколько автоматизирована каждая задача в настоящее время, и обобщила результаты, используя шкалу, разработанную исследовательской группой Epoch AI. Шкала варьируется от AL0 (без участия ИИ) до AL5 (ИИ работает полностью автономно, без участия человека), при этом AL3 означает, что ИИ «сотрудничает» при выполнении больших объемов работы под непосредственным руководством человека, а AL4 означает, что ИИ «руководит», выполняя большую часть задачи сквозным образом с помощью подсказок высокого уровня под контролем человека.
По данным Anthropic, по состоянию на август 2026 года Клод возглавляет 26% исследований и разработок компании в области искусственного интеллекта. Доля работ на уровне или выше «ИИ сотрудничает» превышает 90%. Клод не работает полностью автономно в какой-либо части исследований и разработок в области ИИ.
30 000 агентов, один монитор
Второе измерение касается надзора. Anthropic сообщила, что по состоянию на август 2026 года около 30 000 агентов одновременно выполняли исследовательскую и инженерную работу в компании на ее наиболее используемой внутренней платформе.
Согласно сообщению, каждое действие этих агентов проходит через онлайн-монитор перед тем, как оно будет выполнено, обычно в течение нескольких секунд. Anthropic заявляет, что проанализировала более миллиарда решений своих исследовательских и инженерных агентов за август и обнаружила, что доля действий, заблокированных или эскалированных мониторами, составила 0,002%.
Что касается распределения вычислительных ресурсов, третьего измерения, компания сообщила, что за исследуемую неделю примерно 6% вычислительных ресурсов, которые пошли на исследования и разработки в области ИИ, были выделены на обеспечение безопасности.
Создание собственного преемника под контролем людей
Обрамление имеет такое же значение, как и цифры. Модели Anthropic все активнее участвуют в создании следующего поколения тех же самых моделей — то, что исследователи называют рекурсивным самосовершенствованием, и то, что в заголовке The Washington Post более прямо описывается как чат-бот, «берущий на себя работу по созданию своего собственного преемника».
Anthropic старается провести грань между «ИИ ведет» и «ИИ заменяет». На уровне AL4 человек по-прежнему контролирует ситуацию и может вмешиваться; компания прямо сообщила, что ни одна часть ее научно-исследовательских работ не выполняется на уровне AL5. Но траектория крутая: рост с менее 1% до 26% примерно за семь месяцев предполагает, что доля работ, основанных на искусственном интеллекте, может сократиться наполовину задолго до конца десятилетия, если нынешние тенденции сохранятся.
Методология имеет реальные ограничения, и Anthropic об этом говорит. Рейтинги автоматизации были составлены на основе выборки собственных рабочих записей компании, включая сообщения Slack и внутреннюю документацию, а также оценки степени автоматизации каждой задачи как людьми, так и экспертами. В ходе слепого теста сотрудники оценивали задачи, не зная, какие доказательства собрали модели. Компания сообщила, что ее модельный судья соглашался с людьми примерно так же часто, как люди соглашались друг с другом: точное согласие между моделью и человеком составляло 59%, тогда как согласие между людьми составляло всего 35%, а оценки модели и человека находились в пределах одного уровня друг от друга в 97% случаев.
Компания также признала риск самореференции в своей собственной методологии: Anthropic использовала собственные модели для оценки своих систем, что может означать, что модель оценки допускает те же ошибки, что и модель, которую она проверяет. В нем утверждается, что верификация третьей стороной является реальным ответом.
Приближаются внешние глаза
С этой целью Anthropic заявляет, что планирует внедрить в компанию независимых сторонних оценщиков из нескольких организаций, предоставив им доступ к внутренним процессам, системам и данным, сопоставимым с тем, что есть у внутренних групп по оценке рисков. Некоммерческая организация METR, занимающаяся внешними исследованиями в области искусственного интеллекта, ранее объединила платформу автономного мониторинга Anthropic.
Об этом стало известно на фоне обостряющихся дебатов о темпах. Генеральный директор Anthropic Дарио Амодей призвал к координации усилий по замедлению темпов роста, и компания отмечает, что, если бы такая координация существовала, ее собственные показатели могли бы измениться. На этой неделе Anthropic и OpenAI также стали объектом публичного письма от экспертов по безопасности, в котором утверждалось, что лабораториям нужны действительно независимые эксперты по оценке безопасности.
Последуют ли конкуренты примеру Anthropic, вопрос открытый. Компания утверждает, что любой передовой разработчик может регулярно публиковать эти показатели, используя общедоступную методологию. Пока они этого не сделают, единственные публичные цифры о том, насколько быстро ИИ создает ИИ, исходят из самих лабораторий.
---
Будьте в курсе ИИПоследние новости, аналитика и прорывы в сфере ИИ — всё в одном месте.
Читать больше новостей об ИИ →