Společnost Anthropic tento týden zveřejnila první svého druhu pohled do svého vlastního vývojového kanálu a odhalila, že jeho model Claude nyní „vede“ 26 % výzkumné a vývojové práce AI ve společnosti – oproti méně než 1 % v únoru 2026. Čísla se objevila ve firemním blogovém příspěvku s názvem „Měření pro pochopení tempa vývoje AI“, které zveřejnily Washington, Anthropic 17 Post, Washington, Reuters, Reuters. a další prodejny.
Příspěvek je částečně cvičením transparentnosti a částečně argumentem: Antropic chce, aby další hraniční laboratoře zveřejnily stejné druhy čísel, aby veřejnost a vlády mohly sledovat, jak rychle jsou AI předávány klíče k budování AI. For more context on this story, see our ongoing AI news.
Tři čísla pro sledování vývoje AI
Společnost navrhla tři měření, která podle ní osvětlují tempo vývoje v hraničních laboratořích: kolik výzkumu a vývoje AI provádí samotná AI, jak dobře je dohlíženo na akce agentů AI a jak jsou výpočty alokovány mezi práci se schopnostmi a práci v oblasti bezpečnosti.
Číslo titulku pochází z toho, co Anthropic nazývá R&D Automation Index. Společnost katalogizovala všechny druhy výzkumné a vývojové práce v oblasti AI prováděné ve společnosti, hodnotila, jak jsou jednotlivé úlohy v současnosti automatizované, a agregovala výsledky pomocí škály vyvinuté výzkumnou skupinou Epoch AI. Stupnice sahá od AL0 (bez zapojení umělé inteligence) po AL5 (AI funguje plně autonomně, bez člověka ve smyčce), přičemž AL3 znamená, že umělá inteligence „spolupracuje“ na velkých kusech práce pod blízkým lidským vedením a AL4 znamená, že umělá inteligence „vede“ a dokončuje většinu úkolů od začátku do konce z výzvy na vysoké úrovni, zatímco člověk dohlíží.
V srpnu 2026, společnost Anthropic uvedla, že Claude vede 26 % výzkumné a vývojové práce společnosti v oblasti AI. Podíl práce na úrovni „AI spolupracuje“ nebo nad ní je nad 90 %. Claude nepracuje plně autonomně pro žádnou měřenou podmnožinu výzkumných a vývojových prací v oblasti AI.
30 000 agentů, jeden monitor
Druhé měření se týká dohledu. Společnost Anthropic prozradila, že v srpnu 2026 ve společnosti na její nejpoužívanější interní platformě v jednu chvíli provádělo výzkum a inženýrské práce přibližně 30 000 agentů.
Každá akce, kterou tito agenti provedou, prochází online monitorem, než je provedena, obvykle během několika sekund, podle příspěvku. Společnost Anthropic tvrdí, že během srpna analyzovala více než miliardu rozhodnutí svých výzkumných a inženýrských agentů a zjistila, že podíl činností blokovaných nebo eskalovaných monitory byl 0,002 %.
Pokud jde o alokaci výpočtů, třetí měření, společnost uvedla, že během zkoumaného týdne bylo zhruba 6 % výpočtů, které šly do výzkumu a vývoje AI, přiděleno na bezpečnost.
Budování vlastního nástupce — s dohledem lidí
Na orámování záleží stejně jako na postavách. Modely Anthropic se stále více podílejí na budování další generace stejných modelů – to, co výzkumníci nazývají rekurzivní sebezdokonalování a co titulek The Washington Post popsal otevřeněji jako chatbot „přebírající práci na budování vlastního nástupce“.
Antropická dbá na to, aby nakreslila čáru mezi „AI vede“ a „AI nahrazuje“. Na AL4 člověk stále dohlíží a může zasáhnout; společnost výslovně uvedla, že žádná měřená podmnožina jejích výzkumných a vývojových prací neprobíhá na úrovni AL5. Ale trajektorie je strmá: přechod z méně než 1 % na 26 % za zhruba sedm měsíců naznačuje, že podíl práce vedené umělou inteligencí by mohl překročit polovinu daleko před koncem dekády, pokud se současné trendy udrží.
Metodika má skutečné limity a Anthropic to říká. Hodnocení automatizace bylo vytvořeno vzorkováním vlastních pracovních záznamů společnosti – včetně zpráv Slack a interní dokumentace – a tím, že jak lidé, tak soudci modelovali, jak automatizovaný je každý úkol. Ve slepém testu zaměstnanci hodnotili úkoly, aniž by věděli, jaké důkazy modely nashromáždily. Společnost uvedla, že její modelový soudce souhlasil s lidmi asi tak často, jako se lidé shodli mezi sebou: přesná shoda mezi modelem a člověkem byla 59 %, zatímco shoda mezi lidmi byla pouze 35 % a hodnocení modelu a člověka se v 97 % případů pohybovalo na jedné úrovni.
Společnost také uznala riziko sebereference ve své vlastní metodologii: Anthropic použil své vlastní modely, aby pomohl vyhodnotit své systémy, což by mohlo znamenat, že model rozhodčího dělá stejné druhy chyb jako model, který kontroluje. Ověření třetí stranou, tvrdí, je skutečnou odpovědí.
Přicházejí vnější oči
Za tímto účelem společnost Anthropic říká, že plánuje začlenit nezávislé hodnotitele třetích stran z různých organizací uvnitř společnosti, což jim umožní přístup k interním procesům, systémům a datům srovnatelným s tím, co mají interní týmy pro hodnocení rizik. Externí nezisková organizace zabývající se výzkumem umělé inteligence METR již dříve vytvořila červený tým offline monitorovací platformy Anthropic.
Zveřejnění přichází uprostřed eskalující debaty o tempu. Generální ředitel společnosti Anthropic Dario Amodei vyzval ke koordinaci na zpomalení hranice a společnost poznamenává, že by se očekávalo, že se její vlastní čísla změní, pokud taková koordinace existuje. Tento týden byly společnosti Anthropic a OpenAI také předmětem veřejného dopisu bezpečnostních expertů, kteří tvrdili, že laboratoře potřebují skutečně nezávislé hodnotitele bezpečnosti.
Otevřenou otázkou je, zda soupeři následují náskok Anthropic. Společnost tvrdí, že jakýkoli hraniční developer by mohl tato opatření pravidelně zveřejňovat pomocí veřejné metodiky. Dokud to neudělají, jediná veřejná čísla o tom, jak rychle AI buduje AI, pocházejí ze samotných laboratoří.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →