Vlna veřejných varování zevnitř Anthropic zesílila tento týden, když několik výzkumníků ze společnosti AI zopakovalo apokalyptické hodnocení umělé inteligence bývalého kolegy – což vyvolalo opovržlivou odpověď od Elona Muska, který tvrdil, že výkřik byl koordinovaný „psyop“.

Podle The Guardian k eskalaci došlo jeden den poté, co výzkumník v oblasti Anthropic Jacob Coxon oznámil svou rezignaci ve virálním příspěvku a napsal, že ani Anthropic, ani OpenAI – jeho bývalý zaměstnavatel – nevytvářejí modely umělé inteligence zodpovědně a „hazardují s našimi životy“. Spíše než slábnoucí kontroverze narůstala, když současní zaměstnanci Anthropic zveřejnili svá vlastní hrozivá hodnocení na podporu. For more context on this story, see our ongoing AI industry coverage.

Varování se hromadí

Anna Wang, která se zabývá bezpečností umělé inteligence ve společnosti Anthropic a dříve pracovala v DeepMind společnosti Google, ve čtvrtek uvedla, že mnoho lidí ve společnosti chce zpomalit vývoj, aby plánovali rizika, která představují stále schopnější modely.

"Zatím neexistuje životaschopný vědecký plán, jak vyřešit rizika z rekurzivně se zlepšující AI," napsal Wang na X.

Další zaměstnanec Anthropic, Drake Thomas, řekl, že respektuje Coxonovo rozhodnutí ustoupit od budování technologie. "Věci se pohybují příliš rychle, nemáme ani zdaleka takovou míru jistoty, kterou bychom chtěli pro ASI [umělou superinteligenci]," napsal Thomas.

Samuel Marks, který ve společnosti pracuje na výzkumu bezpečnosti, tvrdil, že obavy jsou v tomto odvětví široce sdíleny – a že seniorita koreluje s alarmem. „Vývojáři AI věří, že jejich technologie by mohla způsobit vyhynutí lidstva (nebo podobně špatné výsledky),“ napsal Marks. "To by se mohlo stát v příštích několika letech. Obecně platí, že čím je zaměstnanec starší, tím více se o něj stará."

Nejdále zašel Evan Hubinger, který sám sebe popisuje jako vedoucího v divizi zarovnání Anthropic. "Opravdu vážně věříme, že AI dokáže zabít všechny lidi!" Hubinger napsal a dodal, že on osobně dává pravděpodobnost nad 10 procent během příští dekády.

The Insider poznamenává po zprávách CBS News, že antropický výzkumník přisoudil více než 10procentní šanci umělé inteligenci způsobující vyhynutí lidstva, a zpravodajství The Japan Times, že varování obnovila výzvy k novým pravidlům umělé inteligence ve Spojených státech.

Musk: „Vypadá to jako nastavení“

Elon Musk zaujal ostře nepřátelský pohled. "Vypadá to jako nastavení," napsal nejbohatší muž světa na X, své vlastní sociální platformě.

Coxon odpověděl selfie: "Jsem skutečný a toto jsou moje skutečná přesvědčení. Mohl by ses na mě zeptat svých výzkumníků xAI, kdybys je nevyhodil."

Musk a další soucitné hlasy umocnily teorii vznesenou Parkerem Thayerem, výzkumníkem z konzervativního think-tanku Capital Research, který navrhl – s malými důkazy, poznamenává The Guardian –, že Coxonův příspěvek byl zahajovacím krokem „VELMI sofistikované a dobře financované PR operace s cílem získat podporu pro demokraty k regulaci umělé inteligence do zapomnění“.

Manažer hedgeového fondu miliardář Bill Ackman citoval Thayerův příspěvek jednoslovnou odpovědí: "Zajímavé."

Musk později upřesnil. "Myslím, že základy pro tento psychoop (pro nedostatek lepšího termínu) byly připravovány dlouho," napsal. "Tohle byla právě zápalka, která zapálila oheň."

Antropický hájí svůj přístup

Anthropic, chycený mezi varování vlastních zaměstnanců a útoky zvenčí, nabídl odměřenou veřejnou reakci.

„Vždy jsme byli transparentní, že umělá inteligence přinese jak obrovské výhody, tak bezprecedentní rizika,“ řekl mluvčí společnosti The Guardian. "Abychom tato rizika řešili, pokračujeme ve vytváření modelů s některými z nejsilnějších ochranných opatření v oboru."

Společnost poukázala na své záznamy o dokumentování a narušování zneužití. Ve stejný den, kdy se varování stala virální, zveřejnila společnost Anthropic svou zářijovou zprávu o hrozbách, která podrobně popisuje, jak společnost rozebrala operaci pokoušející se vyrobit biologickou zbraň pomocí svých modelů AI – spolu s narušenými kampaněmi zahrnujícími kybernetické útoky a operace vlivu. Al-Džazíra a BBC byly v pátek mezi výstupy upozorňující na nálezy biologických zbraní.

Skeptici vidí jiné riziko

Ne každý přijímá rámování zániku. Gary Marcus, vědec a dlouholetý kritik umělé inteligence, tvrdil, že tato technologie již způsobuje škody, které vyžadují akci bez ohledu na scénáře superinteligence – a vyzval k bojkotu umělé inteligence kvůli současným škodám.

Marcus řekl The Guardian více než vyhynutí, že se obává „rizika katastrofy“ z „patogenů generovaných umělou inteligencí, z válek zahájených nebo eskalovaných dezinformacemi generovanými umělou inteligencí, z hacků, které ničí kritickou infrastrukturu a tak dále. Nic, co jsem viděl, nenaznačuje, že by cokoli z toho bylo pod kontrolou.“

Jeho pozice podtrhuje rozkol v rámci samotné debaty o bezpečnosti umělé inteligence: mezi těmi, kteří se zaměřují na dlouhodobá civilizační rizika budoucích systémů, a těmi, kteří se zaměřují na konkrétní škody z dnešních modelů.

Debata, která odmítá zůstat interní

To, co začalo jako rezignační dopis jednoho výzkumníka, se stalo velmi veřejným referendem o tom, jak průmysl AI buduje své nejvýkonnější systémy. Zaměstnanci uvnitř společnosti Anthropic otevřeně diskutují o tom, zda jejich vlastní časové osy pro bezpečný rozvoj neuklouzly. Mimo něj se varování skládají do stále více polarizovaného politického boje o to, zda a jak by měly vlády zasáhnout.

Zprávy The Guardian naznačují, že mnoho zaměstnanců Antropie tyto obavy soukromě sdílí, ale veřejně se nevyjádřili. Pokud bude Coxona, Wanga, Thomase, Markse a Hubingera následovat více z nich, tlak na vedoucí laboratoře umělé inteligence, aby zpomalily – a na regulační orgány, aby jednaly – jen poroste.

_Tento článek je založen na zprávách The Guardian s dalším kontextem z CBS News, The Japan Times, Al Jazeera a BBC._

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →