Společnost Antropic ve čtvrtek zveřejnila svou zprávu o hrozbách ze září 2026, „Detekce a boj proti zneužití AI“, popisující, jak její tým Threat Intelligence identifikoval a narušil aktéry hrozeb, kteří zneužili Clauda mezi prosincem 2025 a srpnem 2026. Případy pokrývají sedm různých oblastí poškození: kybernetické operace, operace vlivu, sledování, podvody a podvody při vývoji konvenčních zbraní, zneužití biologických modelů. Podle společnosti byla každá kampaň, kterou popisuje, narušena a informace byly sdíleny s úřady a průmyslovými partnery, kde to bylo vhodné.
Zpráva se dostává do okamžiku intenzivního zkoumání odvětví umělé inteligence, a zejména společnosti Anthropic, protože aktuální zprávy o umělé inteligenci tento týden dominovaly bezpečnostní informace, oznamovatelské účty a rostoucí tlak zákonodárců. Přichází také spolu se zprávami z The New York Times a Politico, které zdůrazňují pokusy o vyzbrojení hraničních modelů – včetně zablokovaných snah souvisejících s vývojem biologických zbraní.
Jak Anthropic sleduje aktéry hrozeb s podporou umělé inteligence
Anthropic sleduje aktéry ve své zprávě pod interními označeními známými jako skupiny generativních hrozeb nebo GTG. Každá případová studie měří to, co společnost nazývá uplift – zvýšení schopností, které AI poskytuje operaci ve třech dimenzích: rychlost, rozsah a hloubka. Případy zneužití zahrnovaly modely Claude Haiku, Sonnet a Opus. Žádný nezahrnoval modely třídy Fable nebo Mythos společnosti, s výjimkou jednoho případu nezákonné destilace.
Antropic svou ochotu publikovat považuje za povinnost, nikoli za marketingové cvičení, přičemž ve zprávě uvádí, že „jsme přesvědčeni, že máme odpovědnost odhalit škodlivé zneužití našich služeb“.
Operace spojená s Midnight Blizzardem, která přestavěla svůj vlastní malware
Nejrozsáhlejší kybernetický případ zprávy, sledovaný jako GTG-20006, popisuje herce, jehož atribuce podle Antropic odpovídá veřejným zprávám spojujícím jej s Midnight Blizzard, ruskou státem orientovanou hackerskou skupinou dříve známou jako Nobelium nebo APT29. Jeden z jeho operátorů, osoba používající rukojeť „JackPoterz“, je rusky mluvící.
Podle zprávy se skupina zaměřila na více než 20 organizací soustředěných mezi ukrajinskou vládou, armádou a diplomatickými orgány. Zkompromitovala nejméně tři dodavatele hotelových WiFi, aby ukradli záznamy DNS, převzala účty WhatsApp nejméně dvou bývalých vysokých ukrajinských úředníků a od severoafrického vládního technologického úřadu ukradla více než 300 000 záznamů národní identity spolu s údaji z obchodního registru zahrnujících více než půl milionu společností.
Nejvýraznějším detailem je autonomní adaptace: Anthropic uvádí, že agenti AI herce upravili a přestavěli skupinový malware, kdykoli jej bezpečnostní produkty detekovaly – smyčka, která dříve vyžadovala zkušené vývojáře na vyžádání.
Credential Harvesting v měřítku a autonomní nultý den lov
Druhý případ, GTG-50014, se týká operátorů podezřelých ze spojení s kolektivem ShinyHunters. Jejich kanály pro shromažďování pověření hromadně stáhly 1,8 milionu souborů APK pro Android a naskenovaly je, zda neobsahují pevně zakódovaná tajemství. Při jednom kompromisu poskytovatele technologie bylo exfiltrováno více než terabajt dat, včetně milionů záznamů o platebních kartách. Další přidružená společnost extrahovala data od zhruba 200 následných zákazníků poskytovatele softwaru jako služby, který byl narušen, a za přibližně 34 hodin vyložila více než 2 100 sad tokenů Azure AD zahrnujících více než 40 firemních tenantů – podle zprávy téměř veškerou práci vykonávali agenti AI.
GTG-10007 je pro obránce ještě střízlivější. Anthropic připisuje tento klastr čínsky mluvícím operátorům pravděpodobně sídlícím v Changsha, Hunan – dva z nich identifikoval jako vysokoškolské studenty – kteří se zaměřili na zhruba padesát organizací a provozovali autonomní výzkumný program zranitelnosti. Jeden pracovní postup, iterovaný na síťových zařízeních, přinesl více než tucet možných nálezů zero-day za jediný měsíc.
Vydírání, osamělý hacktivista a neúspěšný nájezd na AI Labs
Výrazně se objevuje finančně motivované zneužívání. GTG-50020, rusky mluvící herec, získal od jedné oběti zhruba 26 gigabajtů a hledal mezi 1,5 miliony a 2,5 miliony dolarů vydírání. Stejná skupina pak zaútočila na zhruba třicet společností AI během asi čtyř dnů s uvedeným cílem získat přístup k modelu Claude před vydáním. Společnost Antropic říká, že každý pokus o cestu selhal a její vlastní systémy nebyly nikdy ohroženy.
Na opačném konci spektra byl GTG-50029 jediný francouzsky mluvící hacktivista, který zneužil dříve nezdokumentovanou soutěžní podmínku při reinstalaci WordPressu proti nejméně čtyřem webům, získal interní přístup k nejméně 14 ze 42 sledovaným cílům a exfiltroval přibližně 140 000 záznamů – včetně politických názorů uživatelů z platformy kampaně. Herec pak vybudoval doxxingovou platformu, fafsearch, nabitou desítkami milionů řádků.
Ovlivněte operace od Středoafrické republiky po Malajsii
Devět případů vlivových operací ve zprávě pocházelo z Ruska, Íránu, Turecka, Perského zálivu, jižní Asie, Afriky a Evropy, přičemž dosah byl měřen na Breakout Scale Brookings Institution. V jednom případě GTG-04001, rusky mluvící herec sídlící v Bangui, produkoval denní obsah pro Radio Lengo Songo, stanici Anthropic napojenou na Politologii – africký sbor a Wagnerův vliv, který podle ní spadal pod kontrolu ruské zahraniční zpravodajské služby na konci roku 2023. Tato operace vytvořila padělané vládní dokumenty Středoafrické republiky a pracovní smlouvy, které nařizovaly loajalitu k Rusku jako prezidenta kategorie čtyři a byly posouzeny jako loajalita k Rusku.
Další síť, GTG-54002, byla vysledována k LKM Company, francouzské digitální reklamní agentuře, která provozuje zhruba 70 umělých zpravodajských webů, 70 odpovídajících X účtů a více než 250 neautentických komentujících účtů. Síť zveřejnila nejméně 8 913 článků ve zhruba 20 jazycích, z nichž 318 se zaměřilo na Demokratickou republiku Kongo.
Cílem byly také volby. GTG-84005, komerční platforma pro manipulaci s volbami zaměřená na Malajsii, kterou Anthropic napojil na istanbulskou BBS Bilisim Teknolojileri, spravovala asi 1000 falešných X účtů ve všech 222 malajských parlamentních obvodech a vymyslela spisy proti opozičnímu politikovi. Samostatný cluster, GTG-24015, používal čtyři účty jako redakční stůl s podporou umělé inteligence, který zásoboval ruská státní média.
Proč na zveřejnění záleží
Společnost Antropic říká, že v každém případě narušila činnost, použila zjištění k posílení svých záruk a v případě potřeby sdílela zpravodajské informace s úřady a průmyslovými partnery. Publikování podrobných případových studií – doplněných o analýzy selhání vlastních detekcí – zůstává mezi hraničními laboratořemi vzácné a společnost tvrdí, že transparentnost zvyšuje základ pro celé odvětví.
Zpráva také podtrhuje posun, který bezpečnostní týmy již nemohou ignorovat: nejnebezpečnější operace s umělou inteligencí zde popsané nebyly hypotetické demonstrace, ale živé kampaně proti vládám, společnostem a volbám. Jak jsou modely stále schopnější, údaje společnosti Anthropic naznačují, že vzestup, který poskytují odhodlaným protivníkům, se sdružuje – a nejlepší dostupnou odpovědí obránců je prozatím viditelnost, odhalení a rychlejší opakování bezpečnostních opatření.
---
Stay Ahead of AIZískejte nejnovější zprávy, analýzy a průlomové informace o umělé inteligenci – vše na jednom místě.
Přečtěte si další zprávy o AI →