W czwartek firma Anthropic opublikowała raport dotyczący analizy zagrożeń z września 2026 r. zatytułowany „Wykrywanie i przeciwdziałanie nadużyciom sztucznej inteligencji” opisujący, w jaki sposób zespół ds. analizy zagrożeń zidentyfikował i powstrzymał podmioty zagrażające, które wykorzystały Claude w okresie od grudnia 2025 r. do sierpnia 2026 r. Przypadki obejmują siedem różnych obszarów szkód: operacje cybernetyczne, operacje wywierania wpływu, inwigilacja, oszustwa i oszustwa, niewłaściwe użycie biologiczne, rozwój broni konwencjonalnej i nielegalna destylacja modeli. Według firmy każda opisana przez nią kampania została przerwana, a w stosownych przypadkach przekazano informacje wywiadowcze władzom i partnerom branżowym.
Raport pojawia się w momencie wzmożonej analizy branży sztucznej inteligencji, a w szczególności Anthropic, ponieważ najnowsze wiadomości o sztucznej inteligencji ten tydzień został zdominowany przez ujawnianie informacji dotyczących bezpieczeństwa, relacje sygnalistów i rosnącą presję ze strony prawodawców. Pojawia się także wraz z doniesieniami „The New York Times” i „Politico” podkreślającymi próby uzbrojenia modeli granicznych w broń – w tym zablokowane wysiłki związane z rozwojem broni biologicznej.
Jak Anthropic śledzi podmioty zagrażające wykorzystujące sztuczną inteligencję
Anthropic śledzi aktorów w swoim raporcie za pomocą wewnętrznych oznaczeń znanych jako Generative Threat Groups, czyli GTG. Każde studium przypadku mierzy to, co firma nazywa wzrostem — zwiększenie możliwości, jakie sztuczna inteligencja zapewnia operacji w trzech wymiarach: szybkości, skali i głębokości. Przypadki nadużyć dotyczyły modeli Claude’a Haiku, Sonnet i Opus. Żaden nie dotyczył modeli firmy klasy Fable lub Mythos, z wyjątkiem jednego przypadku nielegalnej destylacji.
Anthropic swoją chęć publikowania traktuje jako obowiązek, a nie działanie marketingowe, stwierdzając w raporcie, że „uważamy, że mamy obowiązek ujawniać złośliwe niewłaściwe wykorzystanie naszych usług”.
Operacja powiązana z Midnight Blizzard, która odbudowała własne złośliwe oprogramowanie
Najbardziej obszerna sprawa cybernetyczna w raporcie, oznaczona jako GTG-20006, opisuje aktora, którego przypisanie według Anthropic jest zgodne z publicznymi doniesieniami łączącymi go z Midnight Blizzard, rosyjską grupą hakerską współpracującą z państwem, znaną wcześniej jako Nobelium lub APT29. Jeden z jego operatorów, osoba posługująca się pseudonimem „JackPoterz”, jest osobą mówiącą po rosyjsku.
Według raportu grupa zaatakowała ponad 20 organizacji skupionych wokół ukraińskiego rządu, wojska i organów dyplomatycznych. Naraził na szwank co najmniej trzech dostawców hotelowej sieci Wi-Fi w celu przejęcia rekordów DNS, przejął konta WhatsApp co najmniej dwóch byłych ukraińskich urzędników wysokiego szczebla i ukradł ponad 300 000 krajowych dokumentów tożsamości wraz z danymi z rejestrów handlowych obejmujących ponad pół miliona firm od północnoafrykańskiego organu ds. technologii.
Najbardziej uderzającym szczegółem jest autonomiczna adaptacja: Anthropic donosi, że agenci sztucznej inteligencji aktora modyfikowali i odbudowywali szkodliwe oprogramowanie grupy za każdym razem, gdy wykryły je produkty zabezpieczające – co wcześniej wymagało wykwalifikowanych programistów na żądanie.
Gromadzenie danych uwierzytelniających na dużą skalę i autonomiczne polowanie w dniu zerowym
Druga sprawa, GTG-50014, dotyczy operatorów podejrzanych o powiązania z kolektywem ShinyHunters. Ich potoki gromadzenia danych uwierzytelniających pobrały masowo 1,8 miliona plików APK dla Androida i przeskanowały je w poszukiwaniu zakodowanych na stałe sekretów. W wyniku jednego kompromisu dostawcy technologii wydobyto ponad terabajt danych, w tym miliony zapisów kart płatniczych. Inny podmiot stowarzyszony pobrał dane od około 200 dalszych klientów dostawcy oprogramowania jako usługi, którego dotyczyło naruszenie, i w ciągu około 34 godzin porzucił ponad 2100 zestawów tokenów Azure AD obejmujących ponad 40 dzierżawców korporacyjnych, przy czym prawie całą pracę wykonali agenci sztucznej inteligencji, jak wynika z raportu.
GTG-10007 jest jeszcze bardziej otrzeźwiający dla obrońców. Anthropic przypisuje tę klaster chińskojęzycznym operatorom prawdopodobnie mającym siedzibę w Changsha w stanie Hunan — z których dwóch zidentyfikowano jako studenci studiów licencjackich — którzy obrali za cel około pięćdziesiąt organizacji i prowadzili autonomiczny program badań podatności na zagrożenia. Jeden przepływ pracy, polegający na iteracji na urządzeniach sieciowych, przyniósł kilkanaście możliwych wyników typu zero-day w ciągu jednego miesiąca.
Wymuszenie, samotny hacktywista i nieudany nalot na laboratoria AI
Wyraźnie widać nadużycia motywowane finansowo. GTG-50020, rosyjskojęzyczny aktor, wydobył od jednej ofiary około 26 gigabajtów i zażądał wymuszenia na kwotę od 1,5 do 2,5 miliona dolarów. Następnie ta sama grupa zaatakowała około trzydziestu firm zajmujących się sztuczną inteligencją w ciągu około czterech dni, mając na celu uzyskanie dostępu do przedpremierowego modelu Claude. Anthropic twierdzi, że każda próba zakończyła się niepowodzeniem, a własne systemy nigdy nie zostały naruszone.
Na drugim końcu spektrum znajduje się GTG-50029, pojedynczy francuskojęzyczny haktywista, który wykorzystał wcześniej nieudokumentowaną sytuację wyścigową w zakresie ponownej instalacji WordPressa w co najmniej czterech witrynach, uzyskał wewnętrzny dostęp do co najmniej 14 z 42 śledzonych celów i wydobył około 140 000 rekordów — w tym opinie polityczne użytkowników z platformy kampanii. Następnie aktor zbudował platformę doxxingową o nazwie fafsearch, zawierającą dziesiątki milionów wierszy.
Wpływ na operacje od Republiki Środkowoafrykańskiej po Malezję
Dziewięć przypadków operacji wywierania wpływu opisanych w raporcie pochodzi z Rosji, Iranu, Turcji, Zatoki Perskiej, Azji Południowej, Afryki i Europy, a ich zasięg mierzony jest w skali przełamania Brookings Institution. W jednym przypadku GTG-04001, rosyjskojęzyczny aktor mieszkający w Bangi, codziennie produkował treści dla Radia Lengo Songo, stacji Anthropic powiązanej z Politologią – oddziału Afrykańskiego Korpusu i oddziału wpływów Wagnera, który według niego przeszedł pod kontrolę rosyjskiej Służby Wywiadu Zagranicznego pod koniec 2023 r. W wyniku operacji sfałszowano dokumenty rządowe Republiki Środkowoafrykańskiej i umowy o pracę nakładające obowiązek lojalności wobec prezydenta kraju i Rosji, i została oceniona w kategorii czwartej w skali.
Inną sieć, GTG-54002, powiązano z LKM Company, francuską agencją reklamy cyfrowej, obsługującą około 70 sfabrykowanych witryn z wiadomościami, 70 pasujących kont X i ponad 250 nieautentycznych kont z komentarzami. W sieci opublikowano co najmniej 8913 artykułów w około 20 językach, z czego 318 dotyczyło Demokratycznej Republiki Konga.
Celem były także wybory. GTG-84005, komercyjna platforma manipulacji wyborami wycelowana w Malezję, którą Anthropic powiązała z BBS Bilisim Teknolojileri z siedzibą w Stambule, zarządzała około 1000 fałszywych kont X we wszystkich 222 malezyjskich okręgach parlamentarnych i sfabrykowała dossier przeciwko politykowi opozycji. Oddzielny klaster, GTG-24015, wykorzystywał cztery konta jako redakcja wspomagana sztuczną inteligencją zaopatrująca rosyjskie media państwowe.
Dlaczego ujawnianie informacji ma znaczenie
Anthropic twierdzi, że w każdym przypadku zakłócała działalność, wykorzystała ustalenia do wzmocnienia swoich zabezpieczeń i, w stosownych przypadkach, podzieliła się informacjami wywiadowczymi z władzami i partnerami branżowymi. Publikowanie szczegółowych studiów przypadków – wraz z analizami błędów własnych wykryć – pozostaje rzadkością wśród pionierskich laboratoriów, a firma twierdzi, że przejrzystość podnosi poziom odniesienia dla całej branży.
W raporcie podkreślono również zmianę, której zespoły ds. bezpieczeństwa nie mogą już dłużej ignorować: najbardziej niebezpiecznymi opisanymi tutaj operacjami z wykorzystaniem sztucznej inteligencji nie były hipotetyczne demonstracje, ale kampanie na żywo przeciwko rządom, firmom i wyborom. Dane Anthropic sugerują, że w miarę zwiększania się możliwości modeli, korzyści, jakie zapewniają zdeterminowanym przeciwnikom, stają się coraz większe — a najlepszą dostępną odpowiedzią obrońców na razie jest widoczność, ujawnianie i szybsze wprowadzanie zabezpieczeń.
---
Wyprzedź sztuczną inteligencjęOtrzymuj najnowsze wiadomości, analizy i przełomowe informacje dotyczące sztucznej inteligencji — wszystko w jednym miejscu.
Przeczytaj więcej aktualności o sztucznej inteligencji →