Společnost Anthropic v sobotu zveřejnila podrobný soubor vlastních měření, jejichž cílem je umožnit veřejnosti, novinářům a vládám sledovat, jak rychle se hraniční umělá inteligence skutečně vyvíjí – včetně prvního indexu svého druhu, jak velkou část vlastního výzkumu společnosti nyní provádí umělá inteligence, a zjištění, že zhruba 30 000 agentů umělé inteligence v daný okamžik provádí výzkum a inženýrské práce uvnitř společnosti.

Příspěvek s názvem „Měření pro pochopení tempa vývoje umělé inteligence v hraničních laboratořích“ se dostává do středu nejzávažnějšího argumentu v oboru: zda by měl být hraniční vývoj záměrně zpomalen. Dario Amodei vyzval ke koordinaci s cílem „urychlit hranici“, což je návrh, který otřásl trhy, vyvolal spotřebitelskou žalobu na údajnou tajnou dohodu o tempu mezi velkými laboratořemi a přiměl prezidenta Trumpa, aby oznámil „sílu umělé inteligence“, která má zabránit jakémukoli zpomalení. Rámec Anthropic je v tomto kontextu explicitní: "Svět zvažuje zpomalení tempa vývoje hraniční umělé inteligence, veřejnost potřebuje více informací."

Tři měření pro sledování pokroku AI

Společnost stanovila tři oblasti měření, které by podle ní mohla pravidelně publikovat každá hraniční laboratoř:

1. Jak velkou část výzkumu a vývoje AI provádí samotná AI. Společnost Anthropic vytvořila prototyp „Anthropic R&D Automation Index“ katalogizací všech druhů výzkumné a vývojové práce AI prováděné ve společnosti, hodnocením toho, jak jsou jednotlivé úkoly aktuálně automatizované, a agregací výsledků. Hodnocení používá veřejnou stupnici „Úroveň automatizace“ Epoch AI, která se pohybuje od AL0 (bez zapojení umělé inteligence) do AL5 (AI funguje plně autonomně bez člověka ve smyčce). V tomto měřítku AL3 znamená, že umělá inteligence „spolupracuje“ – dělá velké kusy práce pod blízkým lidským vedením – zatímco AL4 znamená, že AI „vede“, dokončí většinu úkolů od začátku do konce z výzvy na vysoké úrovni, zatímco člověk dohlíží.

Smyslem indexu je měřit, jak blízko se kterákoli laboratoř blíží rekurzivnímu sebezdokonalování – modelu, který si plně autonomně buduje svého vlastního nástupce. Anthropic poznamenává, že modely urychlující vývoj umělé inteligence „by mohly pro lidi ztížit pochopení nebo ovládání těchto systémů“.

2. Jak dobře jsou dohlíženy na akce agentů AI. Zde se objeví číslo 30 000. V srpnu 2026 provádělo v nejpoužívanější interní platformě Anthropic přibližně 30 000 agentů současně výzkumnou a inženýrskou práci, vzájemně si delegovali úkoly a pracovali poloautonomně po dlouhé úseky. Společnost měří tři věci týkající se dohledu nad těmito agenty: pokrytí (podíl akcí agentů, které projdou monitorem před nebo po provedení), latence kontroly (jak rychle jsou označené akce zkontrolovány, nejprve automatickým monitorem a poté člověkem) a míra eskalace (podíl aktivit blokovaných, přesměrovaných nebo označených ke kontrole).

Dosavadní údaje z monitorování Antropic naznačují, že se jednotliví agenti jen zřídka chovají špatně – ale společnost varuje, že „když v ekonomice působí miliony nebo miliardy agentů, může se pravidelně dít i vzácné události“.

3. Jak jsou alokovány výpočty. Třetí měření sleduje, jak jsou distribuovány výpočetní zdroje laboratoře – nezpracovaný vstup, který koreluje s možnostmi modelu. Společně s dalšími dvěma metrikami to Anthropic tvrdí, že to lidem zvenčí poskytuje způsob, jak korelovat modelové vstupy s výstupy modelu, čímž doplňuje hodnocení schopností, které společnost již publikuje prostřednictvím svých zpráv o rizicích Responsible Scaling Policy.

Čísla by se při zpomalení pohybovala

Politicky nejostřejší linie v příspěvku je zaměřena přímo na debatu o tempu: Anthropic uvádí, že „očekává, že se tato čísla posunou, pokud by existovala koordinace při tempu na hranici, jak požadoval generální ředitel Anthropic Dario Amodei“. Jinými slovy, pokud se průmysl skutečně zpomalí, veřejnost by si to mohla ověřit pomocí těchto metrik – a pokud společnosti tvrdí, že se pohybují, zatímco jejich počet neustále roste, měření by to také odhalila.

Nezávislé ověření je chybějící kus

Společnost Antropic uznává hlavní slabinu metrik s vlastními údaji: používá své vlastní modely k hodnocení svých vlastních systémů, což znamená, že model „soudce“ by mohl sdílet slepá místa kontrolovaného modelu. Společnost také zaznamenala nedostatek společné metodiky napříč laboratořemi, což ztěžuje srovnání.

Navrhovaným řešením je začlenit nezávislé hodnotitele třetích stran z různých organizací do Antropic, což jim umožní přístup k interním procesům, systémům a datům srovnatelným s tím, co vidí interní týmy pro hodnocení rizik. Tyto třetí strany by ověřovaly bezpečnostní postupy, hlásily incidenty a monitorovaly nové metriky. Společnost říká, že METR, hodnotící nezisková organizace, již dříve nezávisle vytvořila svou offline monitorovací platformu a že plánuje tato měření pravidelně zveřejňovat ve formě, kterou si ostatní mohou ověřit.

Měření navazují na širší návrh pokročilého rámce umělé inteligence společnosti Anthropic, který stanoví „pravidla silničního provozu“ pro vydávání hraničních modelů, včetně povinností transparentnosti, které by vlády mohly vyžadovat – jako jsou standardizované zprávy o rizicích.

Test pro celý průmysl

Hlubší význam příspěvku může být konkurenční. Antropic účinně vyzývá každou hraniční laboratoř, aby zveřejnila stejná čísla, a tvrdí, že „jakýkoli hraniční vývojář by mohl tato opatření pravidelně zveřejňovat pomocí veřejné metodologie“. Pokud soupeři klesnou, kontrast se stane vlastním datovým bodem v debatě o bezpečnosti; pokud budou souhlasit, získá průmysl první společné měřítko toho, jak rychle se AI skutečně vyvíjí.

V současnosti tato čísla uvádí společnost, která má zjevný zájem o konverzaci. Představují však něco, co debata postrádala: konkrétní, opakovatelná měření, která by ukázala, zda se hranice zrychluje, zůstává stabilní nebo skutečně zpomaluje.

Udržujte si náskok před AI

Zveřejňování informací z hraničních laboratoří, jako je toto, přibývá každý týden. Chcete-li získat další nejnovější výzkum AI a průmyslové pokrytí, sledujte [AI Buzz Wire] (https://aibuzzwire.news).

Přečtěte si nejnovější zprávy o AI →