Anthropic은 목요일에 2026년 9월 위협 인텔리전스 보고서인 "AI 오용 탐지 및 대응"을 발표했습니다. 이 보고서는 위협 인텔리전스 팀이 2025년 12월부터 2026년 8월 사이에 Claude를 오용한 위협 행위자를 어떻게 식별하고 방해했는지 설명합니다. 해당 사례는 사이버 작전, 영향 작전, 감시, 사기 및 사기, 생물학적 오용, 재래식 무기 개발, 불법 모델 증류 등 7가지 뚜렷한 피해 영역에 걸쳐 있습니다. 회사에 따르면 설명하는 모든 캠페인은 중단되었으며 적절한 경우 당국 및 업계 파트너와 정보가 공유되었습니다.
이번 주 AI 속보가 안전 공개, 내부 고발자 계정, 국회의원의 거세지는 압력으로 지배되었기 때문에 이 보고서는 AI 산업, 특히 Anthropic에 대한 철저한 조사의 순간에 발표되었습니다. 또한 생물학 무기 개발과 관련된 노력이 차단된 것을 포함하여 개척 모델을 무기화하려는 시도를 강조하는 New York Times 및 Politico의 보도와 함께 도착했습니다.
Anthropic이 AI 지원 위협 행위자를 추적하는 방법
Anthropic은 생성적 위협 그룹(GTG)으로 알려진 내부 지정자에 따라 보고서에서 행위자를 추적합니다. 각 사례 연구는 회사가 향상(uplift)이라고 부르는 것, 즉 AI가 속도, 규모 및 깊이라는 세 가지 차원에 걸쳐 작업을 제공하는 기능 향상을 측정합니다. 오용 사례에는 Claude Haiku, Sonnet 및 Opus 모델이 포함되었습니다. 한 번의 불법 증류 사례를 제외하고는 회사의 Fable 또는 Mythos급 모델과 관련된 것이 없습니다.
Anthropic은 보고서에서 "우리는 서비스의 악의적인 오용을 공개할 책임이 있다고 믿습니다"라고 말하면서 마케팅 활동이 아닌 의무로 게시하려는 의지를 갖고 있습니다.
자체 악성코드를 재구축한 Midnight Blizzard 연계 작전
GTG-20006으로 추적되는 이 보고서의 가장 광범위한 사이버 사건은 Anthropic이 밝힌 공격자가 이전에 Nobelium 또는 APT29로 알려졌던 러시아 정부 지원 해킹 그룹인 Midnight Blizzard와 연결되어 있다는 공개 보도와 일치한다고 설명합니다. 운영자 중 "JackPoterz"라는 이름을 사용하는 개인은 러시아어 사용자입니다.
보고서에 따르면 이 그룹은 우크라이나 정부, 군대, 외교 기관에 집중된 20개 이상의 조직을 표적으로 삼았습니다. 이 공격은 DNS 기록을 탈취하기 위해 호텔 WiFi 공급업체 3곳 이상을 해킹했고, 전직 우크라이나 고위 관리 2명의 WhatsApp 계정을 탈취했으며, 북아프리카 정부 기술 기관에서 50만 개 이상의 회사에 대한 상업 등록 데이터와 함께 300,000개 이상의 국가 신원 기록을 훔쳤습니다.
가장 눈에 띄는 세부 사항은 자율적 적응입니다. Anthropic은 보안 제품이 이를 감지할 때마다 행위자의 AI 에이전트가 그룹의 악성 코드를 수정하고 재구축했다고 보고합니다. 이전에는 필요에 따라 숙련된 개발자가 필요했던 루프였습니다.
대규모 자격 증명 수집 및 자율적인 제로데이 헌팅
두 번째 사례인 GTG-50014는 ShinyHunters 집단과 연계된 것으로 의심되는 운영자를 다루고 있습니다. 자격 증명 수집 파이프라인은 180만 개의 Android APK를 대량 다운로드하고 하드코딩된 비밀을 검색했습니다. 기술 제공업체의 한 번의 타협으로 수백만 개의 지불 카드 기록을 포함하여 1테라바이트 이상의 데이터가 유출되었습니다. 또 다른 계열사는 침해된 SaaS(Software-as-a-Service) 공급자의 다운스트림 고객 약 200명으로부터 데이터를 추출하고 약 34시간 만에 40개 이상의 기업 테넌트에 걸쳐 2,100개 이상의 Azure AD 토큰 세트를 덤프했습니다. 보고서에 따르면 AI 에이전트가 거의 모든 작업을 수행했습니다.
GTG-10007은 여전히 수비수들에게 더욱 정신을 차리게 만듭니다. Anthropic은 이 클러스터를 후난성 창사에 기반을 둔 중국어를 사용하는 운영자(그 중 2명은 학부생으로 확인됨)에 기인한다고 밝혔습니다. 이 운영자는 대략 50개 조직을 표적으로 삼고 자율적 취약성 연구 프로그램을 운영했습니다. 네트워크 어플라이언스에서 반복되는 하나의 워크플로는 한 달에 12개 이상의 가능한 제로데이 결과를 산출했습니다.
갈취, 고독한 핵티비스트, AI 연구소 습격 실패
재정적 동기가 있는 오용 기능이 눈에 띄게 나타납니다. 러시아어를 구사하는 배우인 GTG-50020은 피해자 한 명에게서 약 26GB를 유출하고 150만~250만 달러의 강탈금을 요구했습니다. 그런 다음 같은 그룹은 사전 출시된 Claude 모델에 액세스하겠다는 목표를 가지고 약 4일 만에 약 30개의 AI 회사를 공격했습니다. Anthropic은 시도한 모든 경로가 실패했으며 자체 시스템은 결코 손상되지 않았다고 말합니다.
스펙트럼의 반대편 끝에 있는 GTG-50029는 최소 4개 사이트에 대해 이전에 문서화되지 않은 WordPress 재설치 경쟁 조건을 악용하고 추적된 42개 대상 중 최소 14개에 대한 내부 액세스 권한을 얻었으며 캠페인 플랫폼에서 사용자의 정치적 의견을 포함하여 약 140,000개 기록을 유출한 프랑스어를 사용하는 단일 핵티비스트였습니다. 그런 다음 배우는 수천만 개의 행이 포함된 신상 털기 플랫폼인 fafsearch를 구축했습니다.
중앙아프리카공화국에서 말레이시아까지 영향력 행사
보고서에 포함된 9가지 영향력 운영 사례는 러시아, 이란, 터키, 걸프만, 남아시아, 아프리카 및 유럽에서 시작되었으며 브루킹스 연구소의 Breakout Scale에 따라 범위가 측정되었습니다. 한 사례에서는 방기에 기반을 둔 러시아어를 구사하는 배우 GTG-04001이 정치학과 연결된 Anthropic 방송국인 Radio Lengo Songo의 일일 콘텐츠를 제작했습니다. 이 방송국에서 평가한 아프리카 군단 및 Wagner 영향력 부서는 2023년 말 러시아 외무 정보국의 통제를 받았습니다. 이 작업은 국가 대통령과 러시아에 대한 충성을 요구하는 위조된 중앙 아프리카 공화국 정부 문서와 고용 계약을 생성했으며 규모에서 카테고리 4로 평가되었습니다.
또 다른 네트워크인 GTG-54002는 약 70개의 조작된 뉴스 웹사이트, 70개의 매칭 X 계정, 250개 이상의 허위 댓글 계정을 운영하는 프랑스 기반의 디지털 광고 대행사인 LKM Company로 추적되었습니다. 네트워크는 약 20개 언어로 최소 8,913개의 기사를 게재했으며 그 중 318개는 콩고민주공화국에 초점을 맞췄습니다.
선거도 목표였다. Anthropic이 이스탄불 기반 BBS Bilisim Teknolojileri와 연결한 말레이시아를 겨냥한 상업 선거 조작 플랫폼인 GTG-84005는 말레이시아 의회 선거구 전체 222개에서 약 1,000개의 가짜 X 계정을 관리하고 야당 정치인에 대한 서류를 조작했습니다. 별도의 클러스터인 GTG-24015는 4개의 계정을 러시아 국영 미디어에 정보를 제공하는 AI 지원 편집 데스크로 사용했습니다.
공개가 중요한 이유
Anthropic은 각 사례의 활동을 중단하고 조사 결과를 사용하여 안전 장치를 강화했으며 적절한 경우 당국 및 업계 파트너와 정보를 공유했다고 밝혔습니다. 자체 탐지에 대한 실패 분석을 포함하여 자세한 사례 연구를 게시하는 것은 선도적인 연구실에서는 거의 이루어지지 않으며 회사는 투명성이 전체 산업의 기준을 높인다고 주장합니다.
또한 이 보고서는 보안 팀이 더 이상 무시할 수 없는 변화를 강조합니다. 여기에 설명된 가장 위험한 AI 기반 작전은 가상의 시연이 아니라 정부, 기업, 선거에 반대하는 실시간 캠페인이었습니다. 모델의 역량이 향상됨에 따라 Anthropic의 데이터는 단호한 적에게 제공하는 향상이 더욱 복잡해지고 있음을 시사합니다. 현재 방어자가 사용할 수 있는 최선의 대답은 가시성, 공개 및 보호 장치에 대한 더 빠른 반복입니다.
---
AI보다 앞서 나가세요최신 AI 뉴스, 분석, 획기적인 소식을 모두 한 곳에서 받아보세요.
AI 뉴스 자세히 보기 →