Anthropic publiceerde donderdag zijn dreigingsinformatierapport van september 2026, ‘Detecting and countering misuse of AI’, waarin wordt beschreven hoe het Threat Intelligence-team dreigingsactoren heeft geïdentificeerd en verstoord die Claude tussen december 2025 en augustus 2026 hebben misbruikt. De zaken bestrijken zeven verschillende schadegebieden: cyberoperaties, beïnvloedingsoperaties, surveillance, oplichting en fraude, biologisch misbruik, de ontwikkeling van conventionele wapens en illegale modeldistillatie. Volgens het bedrijf werd elke campagne die het beschrijft verstoord en werd waar nodig informatie gedeeld met autoriteiten en industriële partners.

Het rapport komt op een moment van intensieve kritiek voor de AI-industrie, en voor Anthropic in het bijzonder, aangezien het laatste AI-nieuws (https://aibuzzwire.news) deze week werd gedomineerd door veiligheidsonthullingen, klokkenluidersverslagen en toenemende druk van wetgevers. Het komt ook samen met berichtgeving van The New York Times en Politico waarin pogingen worden benadrukt om grensmodellen te bewapenen – inclusief geblokkeerde inspanningen in verband met de ontwikkeling van biologische wapens.

Hoe Anthropic door AI ondersteunde dreigingsactoren volgt

Anthropic volgt de actoren in haar rapport onder interne aanduidingen die bekend staan als Genative Threat Groups of GTG's. Elke casestudy meet wat het bedrijf ‘uplift’ noemt: de capaciteitsboost die AI een operatie geeft op drie dimensies: snelheid, schaal en diepgang. Bij de gevallen van misbruik waren modellen van Claude Haiku, Sonnet en Opus betrokken. Bij geen daarvan waren de modellen van de Fable- of Mythos-klasse van het bedrijf betrokken, met uitzondering van één geval van illegale distillatie.

Anthropic beschouwt zijn bereidheid om te publiceren eerder als een plicht dan als een marketingoefening, en stelt in het rapport dat "wij geloven dat we een verantwoordelijkheid hebben om kwaadwillig misbruik van onze diensten aan het licht te brengen."

Een aan Midnight Blizzard gekoppelde operatie die zijn eigen malware opnieuw heeft opgebouwd

De meest uitgebreide cyberzaak van het rapport, bijgehouden als GTG-20006, beschrijft een acteur wiens toeschrijving volgens Anthropic consistent is met de openbare berichtgeving die hem koppelt aan Midnight Blizzard, de Russische staatsgelieerde hackgroep die voorheen bekend stond als Nobelium of APT29. Een van de operators, een persoon die de hendel "JackPoterz" gebruikt, spreekt Russisch.

Volgens het rapport richtte de groep zich op meer dan twintig organisaties, geconcentreerd onder de Oekraïense regering, militaire en diplomatieke instanties. Het compromitteerde ten minste drie WiFi-leveranciers van hotels om DNS-records te kapen, nam de WhatsApp-accounts over van ten minste twee voormalige Oekraïense functionarissen op hoog niveau en stal meer dan 300.000 nationale identiteitsgegevens samen met commerciële registergegevens van meer dan een half miljoen bedrijven van een technologie-autoriteit van de Noord-Afrikaanse overheid.

Het meest opvallende detail is de autonome aanpassing: Anthropic meldt dat de AI-agenten van de acteur de malware van de groep hebben aangepast en opnieuw opgebouwd wanneer beveiligingsproducten deze ontdekten – een lus waarvoor voorheen bekwame ontwikkelaars op afroep nodig waren.

Credential Harvesting op schaal en autonome Zero-Day-jacht

Een tweede zaak, GTG-50014, heeft betrekking op operators die verdacht worden van banden met het ShinyHunters-collectief. Hun pijplijnen voor het verzamelen van inloggegevens hebben massaal 1,8 miljoen Android APK's gedownload en gescand op hardgecodeerde geheimen. Bij één compromis van een technologieleverancier werd meer dan een terabyte aan gegevens geëxfiltreerd, waaronder miljoenen betaalkaartgegevens. Een andere partner verzamelde gegevens van ongeveer 200 downstream-klanten van een software-as-a-service-provider en dumpte in ongeveer 34 uur meer dan 2.100 Azure AD-tokensets verspreid over meer dan 40 zakelijke huurders – waarbij AI-agenten bijna al het werk deden, aldus het rapport.

GTG-10007 is nog ontnuchterender voor verdedigers. Anthropic schrijft dit cluster toe aan Chineessprekende operators, waarschijnlijk gevestigd in Changsha, Hunan – van wie er twee werden geïdentificeerd als studenten – die zich op ongeveer vijftig organisaties richtten en een autonoom onderzoeksprogramma naar kwetsbaarheid uitvoerden. Eén workflow, herhalend op netwerkapparatuur, leverde in één maand ruim een ​​dozijn mogelijke zero-day-bevindingen op.

Afpersing, een eenzame hacktivist en een mislukte aanval op AI Labs

Financieel gemotiveerd misbruik komt prominent voor. GTG-50020, een Russisch sprekende acteur, exfiltreerde ongeveer 26 gigabytes van één slachtoffer en eiste tussen de $1,5 miljoen en $2,5 miljoen aan afpersing. Dezelfde groep viel vervolgens in ongeveer vier dagen ongeveer dertig AI-bedrijven aan met als doel toegang te krijgen tot een pre-release Claude-model. Anthropic zegt dat elke poging mislukte en dat zijn eigen systemen nooit in gevaar zijn gebracht.

Aan de andere kant van het spectrum was GTG-50029 een enkele Franstalige hacktivist die een voorheen ongedocumenteerde WordPress-herinstallatie-race condition uitbuitte tegen ten minste vier sites, interne toegang kreeg tot ten minste 14 van de 42 gevolgde doelen en ongeveer 140.000 records exfiltreerde – inclusief de politieke meningen van gebruikers van een campagneplatform. De acteur bouwde vervolgens een doxxingplatform, fafsearch, geladen met tientallen miljoenen rijen.

Beïnvloed operaties van de Centraal-Afrikaanse Republiek tot Maleisië

Negen gevallen van beïnvloedingsoperaties in het rapport vonden hun oorsprong in Rusland, Iran, Turkije, de Golf, Zuid-Azië, Afrika en Europa, waarbij het bereik werd gemeten op de Breakout Scale van het Brookings Institution. In één geval produceerde GTG-04001, een Russisch sprekende acteur gevestigd in Bangui, dagelijkse inhoud voor Radio Lengo Songo, een zender Anthropic verbonden aan Politology – de invloedstak van het Afrikakorps en Wagner die volgens haar eind 2023 onder controle van de Russische Buitenlandse Inlichtingendienst kwam. De operatie leverde vervalste regeringsdocumenten en arbeidscontracten van de Centraal-Afrikaanse Republiek op die loyaliteit aan de president van het land en aan Rusland verplichtten, en werd op de schaal beoordeeld als Categorie Vier.

Een ander netwerk, GTG-54002, was terug te voeren op LKM Company, een in Frankrijk gevestigd digitaal reclamebureau dat ongeveer 70 verzonnen nieuwswebsites, 70 overeenkomende X-accounts en meer dan 250 niet-authentieke commentaaraccounts exploiteert. Het netwerk publiceerde minstens 8.913 artikelen in ongeveer 20 talen, waarvan 318 gericht op de Democratische Republiek Congo.

Verkiezingen waren ook een doelwit. GTG-84005, een commercieel verkiezingsmanipulatieplatform gericht op Maleisië dat Anthropic heeft gekoppeld aan het in Istanbul gevestigde BBS Bilisim Teknolojileri, beheerde ongeveer 1.000 nep-X-accounts in alle 222 Maleisische parlementaire kiesdistricten en verzonnen dossiers tegen een politicus van de oppositie. Een afzonderlijk cluster, GTG-24015, gebruikte vier accounts als een AI-ondersteunde redactie die de Russische staatsmedia voedde.

Waarom openbaarmaking belangrijk is

Anthropic zegt dat het de activiteiten in elk geval heeft verstoord, de bevindingen heeft gebruikt om de veiligheidsmaatregelen te versterken en waar nodig informatie heeft gedeeld met autoriteiten en partners uit de industrie. Het publiceren van gedetailleerde casestudies – compleet met foutanalyses van de eigen detecties – blijft zeldzaam onder grenslaboratoria, en het bedrijf stelt dat transparantie de basis voor de hele sector verhoogt.

Het rapport onderstreept ook een verschuiving die beveiligingsteams niet langer kunnen negeren: de gevaarlijkste AI-operaties die hier worden beschreven waren geen hypothetische demonstraties, maar live campagnes tegen regeringen, bedrijven en verkiezingen. Naarmate de modellen steeds capabeler worden, suggereren de gegevens van Anthropic dat de verbetering die ze aan vastberaden tegenstanders bieden steeds groter wordt – en het beste beschikbare antwoord van de verdedigers is voorlopig zichtbaarheid, openbaarmaking en snellere herhaling van beveiligingsmaatregelen.

---

Blijf AI een stap voor

Ontvang het laatste AI-nieuws, analyses en doorbraken – allemaal op één plek.

Lees meer AI-nieuws →