Een golf van publieke waarschuwingen van binnenuit Anthropic werd deze week heviger toen meerdere onderzoekers van het AI-bedrijf de apocalyptische beoordeling van kunstmatige intelligentie van een voormalige collega herhaalden – wat een minachtende reactie opleverde van Elon Musk, die suggereerde dat de verontwaardiging een gecoördineerde ‘psyop’ was.

Volgens The Guardian kwam de escalatie een dag nadat Anthropic-onderzoeker Jacob Coxon zijn ontslag aankondigde in een virale post, waarin hij schreef dat noch Anthropic noch OpenAI – zijn voormalige werkgever – op verantwoorde wijze AI-modellen bouwden en ‘met onze levens gokten’. In plaats van te vervagen, groeide de controverse toen de huidige medewerkers van Anthropic hun eigen sombere beoordelingen ter ondersteuning publiceerden. Voor meer context over dit verhaal, zie ons AI-trends.

De waarschuwingen stapelen zich op

Anna Wang, die bij Anthropic werkt aan de veiligheid van kunstmatige algemene intelligentie en eerder werkte bij Google's DeepMind, zei donderdag dat veel mensen bij het bedrijf de ontwikkeling willen vertragen om plannen te maken voor de risico's van steeds capabelere modellen.

“Er is nog geen haalbaar wetenschappelijk plan om de risico’s van recursief zelfverbeterende AI op te lossen”, schreef Wang op X.

Een andere medewerker van Anthropic, Drake Thomas, zei dat hij de beslissing van Coxon respecteerde om af te stappen van het bouwen van de technologie. "De zaken gaan veel te snel, we hebben lang niet de mate van zekerheid die we willen hebben voor ASI [kunstmatige superintelligentie]", schreef Thomas.

Samuel Marks, die bij het bedrijf aan veiligheidsonderzoek werkt, betoogde dat de zorgen breed gedeeld worden binnen de sector – en dat anciënniteit samenhangt met ongerustheid. “AI-ontwikkelaars geloven dat hun technologie het uitsterven van de mensheid kan veroorzaken (of vergelijkbare slechte resultaten)”, schreef Marks. "Dit zou de komende jaren kunnen gebeuren. Over het algemeen geldt dat hoe hoger de medewerker is, hoe bezorgder hij zich maakt."

Evan Hubinger, die zichzelf omschrijft als een leider in de divisie voor afstemming van Anthropic, ging het verst. "We geloven echt oprecht dat AI alle mensen kan doden!" Hubinger schreef, eraan toevoegend dat hij persoonlijk de waarschijnlijkheid binnen het komende decennium boven de 10 procent schat.

De Insider merkt op na berichtgeving door CBS News dat een antropische onderzoeker een kans van meer dan 10 procent heeft toegekend aan AI die het uitsterven van de mens veroorzaakt, en berichtgeving door The Japan Times dat de waarschuwingen de roep om nieuwe AI-regels in de Verenigde Staten hebben hernieuwd.

Musk: 'Lijkt op een opzetje'

Elon Musk nam een scherp vijandig standpunt in. “Het lijkt een opzetje”, schreef de rijkste man ter wereld op X, zijn eigen sociale platform.

Coxon antwoordde met een selfie: "Ik ben echt en dit zijn mijn echte overtuigingen. Je zou je xAI-onderzoekers naar mij kunnen vragen als je ze niet had ontslagen."

Musk en andere sympathieke stemmen versterkten een theorie van Parker Thayer, een onderzoeker bij de conservatieve denktank Capital Research, die suggereerde – met weinig bewijs, merkt The Guardian – op dat de post van Coxon de openingszet was van een “ZEER geavanceerde en goed gefinancierde PR-operatie om steun te krijgen voor de Democraten om AI in de vergetelheid te brengen.”

Miljardair hedgefondsmanager Bill Ackman citeerde de post van Thayer met een antwoord van één woord: "Interessant."

Musk heeft dit later uitgewerkt. “Ik denk dat de basis voor deze psy-op (bij gebrek aan een betere term) al lange tijd is voorbereid”, schreef hij. "Dit was precies de wedstrijd die het vuur aanstak."

Anthropic verdedigt zijn aanpak

Gevangen tussen de waarschuwingen van zijn eigen medewerkers en aanvallen van buitenaf, bood Anthropic een afgemeten publieke reactie.

"We zijn altijd transparant geweest dat AI zowel enorme voordelen als ongekende risico's met zich mee zal brengen", vertelde een woordvoerder van het bedrijf aan The Guardian. "Om deze risico's aan te pakken, blijven we modellen bouwen met enkele van de sterkste waarborgen in de sector."

Het bedrijf wees op zijn staat van dienst op het gebied van het documenteren en verstoren van misbruik. Op dezelfde dag dat de waarschuwingen viraal gingen, bracht Anthropic zijn rapport over bedreigingen uit september uit, waarin gedetailleerd werd beschreven hoe het bedrijf een operatie ontmantelde die probeerde een biologisch wapen te bouwen met behulp van zijn AI-modellen – naast verstoorde campagnes die cyberaanvallen omvatten en operaties beïnvloedden. Al Jazeera en de BBC behoorden vrijdag tot de media die de bevindingen over biowapens onder de aandacht brachten.

Sceptici zien een ander risico

Niet iedereen accepteert het uitstervingsframework. Gary Marcus, de wetenschapper en oud-AI-criticus, betoogde dat de technologie nu al schade aanricht die actie rechtvaardigt, ongeacht de superintelligentiescenario's. Hij riep op tot een boycot van AI vanwege de huidige schade.

Meer dan uitsterven vertelde Marcus aan The Guardian dat hij zich zorgen maakte over het ‘risico op een catastrofe’ door ‘door AI gegenereerde ziekteverwekkers, door oorlogen die zijn begonnen of geëscaleerd door door AI gegenereerde desinformatie, door hacks die kritieke infrastructuur vernietigen, enzovoort. Niets dat ik heb gezien geeft enige aanwijzing dat dit allemaal onder controle is.’

Zijn standpunt onderstreept een tweedeling binnen het AI-veiligheidsdebat zelf: tussen degenen die zich richten op de langetermijnrisico’s op beschavingsniveau van toekomstige systemen, en degenen die zich richten op concrete schade van de huidige modellen.

Een debat dat weigert intern te blijven

Wat begon als de ontslagbrief van een onderzoeker is uitgegroeid tot een zeer publiek referendum over de manier waarop de AI-industrie haar krachtigste systemen bouwt. Binnen Anthropic debatteren medewerkers openlijk over de vraag of hun eigen tijdlijnen voor veilige ontwikkeling zijn verschoven. Daarbuiten worden de waarschuwingen samengevoegd tot een steeds meer gepolariseerde politieke strijd over de vraag of en hoe regeringen moeten ingrijpen.

Uit de rapportage van The Guardian blijkt dat veel medewerkers van Anthropic deze zorgen privé delen, maar niet in het openbaar hebben gesproken. Als meer van hen Coxon, Wang, Thomas, Marks en Hubinger volgen, zal de druk op toonaangevende AI-laboratoria om te vertragen – en op toezichthouders om actie te ondernemen – alleen maar toenemen.

_Dit artikel is gebaseerd op berichtgeving door The Guardian, met aanvullende context van CBS News, The Japan Times, Al Jazeera en de BBC._

---

Blijf Voorop met AI

Het laatste AI-nieuws, analyses en doorbraken — allemaal op één plek.

Lees meer AI-nieuws →