Anthropic publicerade i torsdags sin rapport om hotunderrättelser från september 2026, "Att upptäcka och motverka missbruk av AI", som beskrev hur deras team för hotunderrättelsetjänst identifierade och störde hotaktörer som missbrukade Claude mellan december 2025 och augusti 2026. Fallen sträcker sig över sju distinkta skadeområden: cyberoperationer, övervakningsoperationer och influenser. missbruk, utveckling av konventionella vapen och olaglig modelldestillation. Enligt företaget stördes varje kampanj som det beskriver, och underrättelser delades med myndigheter och branschpartners där så var lämpligt.

Rapporten hamnar i ett ögonblick av intensiv granskning för AI-branschen, och för Anthropic i synnerhet, eftersom brytande AI-nyheter den här veckan har dominerats av säkerhetsavslöjanden, whistleblowerkonton och ökande press från lagstiftare. Det kommer också tillsammans med rapporter från The New York Times och Politico som lyfter fram försök att beväpna gränsmodeller - inklusive blockerade ansträngningar relaterade till utveckling av biologiska vapen.

Hur Anthropic spårar AI-aktiverade hotaktörer

Anthropic spårar aktörerna i sin rapport under interna beteckningar som kallas Generative Threat Groups eller GTGs. Varje fallstudie mäter vad företaget kallar uplift – den kapacitetsökning som AI ger en operation över tre dimensioner: hastighet, skala och djup. Missbruksfallen involverade modeller av Claude Haiku, Sonnet och Opus. Ingen involverade företagets Fable- eller Mythos-klassmodeller, med undantag för ett fall av olaglig destillation.

Anthropic formulerar sin vilja att publicera som en plikt snarare än en marknadsföringsövning, och säger i rapporten att "vi anser att vi har ett ansvar att avslöja skadligt missbruk av våra tjänster."

En Midnight Blizzard-länkad operation som återuppbyggde sin egen skadliga programvara

Rapportens mest omfattande cyberfall, spårat som GTG-20006, beskriver en skådespelare vars tillskrivning Anthropic säger stämmer överens med offentlig rapportering som kopplar den till Midnight Blizzard, den ryska statsanpassade hackergruppen tidigare känd som Nobelium eller APT29. En av dess operatörer, en person som använder handtaget "JackPoterz", är en rysktalande.

Enligt rapporten riktade gruppen sig mot mer än 20 organisationer, koncentrerade till ukrainska myndigheter, militärer och diplomatiska organ. Det komprometterade minst tre wifi-hotellleverantörer för att kapa DNS-poster, tog över WhatsApp-konton för minst två före detta ukrainska tjänstemän på hög nivå och stal mer än 300 000 nationella identitetsregister tillsammans med kommersiella registerdata som täcker mer än en halv miljon företag från en nordafrikansk statlig teknikmyndighet.

Den mest slående detaljen är autonom anpassning: Anthropic rapporterar att skådespelarens AI-agenter modifierade och byggde om gruppens skadliga program närhelst säkerhetsprodukter upptäckte det – en loop som tidigare skulle ha krävt skickliga utvecklare på begäran.

Credential Harvesting i skala och autonom Zero-Day Jakt

Ett andra fall, GTG-50014, omfattar operatörer som misstänks ha anknytning till ShinyHunters-kollektivet. Deras pipelines för insamling av autentiseringsuppgifter massnedladdade 1,8 miljoner Android APK-filer och skannade dem efter hårdkodade hemligheter. I en kompromiss av en teknikleverantör exfiltrerades mer än en terabyte data, inklusive miljontals betalkortsregister. En annan affiliate extraherade data från ungefär 200 nedströmskunder hos en mjukvaru-som-en-tjänst-leverantör och dumpade mer än 2 100 Azure AD-tokenuppsättningar som spänner över 40 företagshyresgäster på cirka 34 timmar – med AI-agenter som utför nästan allt arbete, enligt rapporten.

GTG-10007 är ännu mer nykter för försvarare. Anthropic tillskriver detta kluster till kinesisktalande operatörer som sannolikt är baserade i Changsha, Hunan - av vilka två identifierades som studenter på grundnivå - som riktade sig till ett femtiotal organisationer och drev ett autonomt sårbarhetsforskningsprogram. Ett arbetsflöde, itererande på nätverksapparater, gav mer än ett dussin möjliga nolldagarsfynd under en enda månad.

Utpressning, en ensam hacktivist och en misslyckad raid på AI Labs

Ekonomiskt motiverat missbruk är framträdande. GTG-50020, en rysktalande skådespelare, exfiltrerade ungefär 26 gigabyte från ett offer och sökte mellan 1,5 miljoner och 2,5 miljoner dollar i utpressning. Samma grupp attackerade sedan ett trettiotal AI-företag på ungefär fyra dagar med det uttalade målet att få tillgång till en pre-release Claude-modell. Anthropic säger att varje försöksväg misslyckades och att dess egna system aldrig äventyrades.

I andra änden av spektrumet var GTG-50029 en ensam fransktalande hacktivist som utnyttjade ett tidigare odokumenterat WordPress-ominstallationsracetillstånd mot minst fyra sajter, fick intern tillgång till minst 14 av 42 spårade mål och exfiltrerade cirka 140 000 poster – inklusive användares politiska åsikter från en kampanjplattform. Skådespelaren byggde sedan en doxxing-plattform, fafsearch, laddad med tiotals miljoner rader.

Inflytande operationer från Centralafrikanska republiken till Malaysia

Nio fall av påverkansoperationer i rapporten har sitt ursprung i Ryssland, Iran, Turkiet, Gulfen, Sydasien, Afrika och Europa, med räckvidd mätt på Brookings Institution's Breakout Scale. I ett fall producerade GTG-04001, en rysktalande skådespelare baserad i Bangui dagligt innehåll för Radio Lengo Songo, en station Anthropic kopplad till Politology — Afrikakårens och Wagners inflytandegren som den bedömer hamnade under den ryska utrikesunderrättelsetjänstens kontroll i slutet av 2023. Operationen producerade förfalskade centralafrikanska republikens regeringsdokument och anställningskontrakt till Rysslands president och anställningskontrakt som var lojala mot Rysslands president och bedömande av landets president och bedömer. vågen.

Ett annat nätverk, GTG-54002, spårades till LKM Company, en Frankrikebaserad digital reklambyrå som driver cirka 70 tillverkade nyhetswebbplatser, 70 matchande X-konton och mer än 250 oäkta kommentarskonton. Nätverket publicerade minst 8 913 artiklar på cirka 20 språk, 318 av dem fokuserade på Demokratiska republiken Kongo.

Val var också ett mål. GTG-84005, en kommersiell plattform för valmanipulation riktad mot Malaysia som Anthropic kopplade till Istanbul-baserade BBS Bilisim Teknolojileri, hanterade cirka 1 000 falska X-konton i alla 222 malaysiska parlamentariska valkretsar och tillverkade ärenden mot en oppositionspolitiker. Ett separat kluster, GTG-24015, använde fyra konton som en AI-assisterad redaktion som matade rysk statlig media.

Varför avslöjande är viktigt

Anthropic säger att de störde verksamheten i varje enskilt fall, använde resultaten för att stärka sina skyddsåtgärder och delade intelligens med myndigheter och branschpartner där så var lämpligt. Att publicera detaljerade fallstudier – kompletta med felanalyser av sina egna upptäckter – är fortfarande sällsynt bland gränslaboratorier, och företaget hävdar att transparens höjer baslinjen för hela branschen.

Rapporten understryker också en förändring som säkerhetsteam inte längre kan ignorera: de farligaste AI-aktiverade operationerna som beskrivs här var inte hypotetiska demonstrationer utan livekampanjer mot regeringar, företag och val. Allt eftersom modellerna blir mer kapabla, tyder Anthropics data på att upplyftningen de ger till beslutsamma motståndare förvärras – och försvararnas bästa tillgängliga svar, för tillfället, är synlighet, avslöjande och snabbare iteration av skyddsåtgärder.

---

Stay ahead of AI

Få de senaste AI-nyheterna, analyserna och genombrotten – allt på ett ställe.

Läs mer AI-nyheter →