Anthropic은 화요일에 사이버 보안 전문가를 위한 세 가지 별도의 계층을 갖춘 공식 사이버 검증 프로그램(CVP)으로 검증된 액세스 이니셔티브를 재구성하여 보안 중심 모델 액세스 노력을 대대적으로 확장한다고 발표했습니다. 이러한 움직임은 회사가 Project Glasswing 이니셔티브를 통해 4월 이후 최소 129,000개의 확인된 소프트웨어 취약점을 발견했다고 공개한 가운데 나온 것입니다.
재구성된 프로그램을 통해 검증된 보안 팀은 Claude Opus 5.5, Claude Sonnet 5.5 및 Claude Mythos 5.1을 포함한 Anthropic의 가장 유능한 모델을 축소된 보호 장치 및 차단 분류자, 일반 사용자가 일반적으로 사용할 수 없는 권한을 사용하여 실행할 수 있습니다. Anthropic에 따르면, 목표는 악의적인 행위자가 동일한 도구를 무기화하기 전에 최첨단 AI 기능을 방어자의 손에 제공하는 것입니다. 이 이야기에 대한 자세한 내용은 최신 AI 동향를 참조하세요.
세 가지 액세스 계층, 세 가지 위협 시나리오
새로운 프로그램은 세 가지 액세스 수준으로 구성되어 있으며 각 수준은 서로 다른 유형의 보안 작업에 맞춰져 있습니다.
- 방어 액세스에는 사고 대응, 악성 코드 리버스 엔지니어링, 취약성 분석 및 검증과 같은 방어 작업이 포함됩니다.
- 레드팀 액세스는 인증된 침투 테스트와 레드팀 구성을 방어 사용 사례에 추가하여 조직이 테스트할 권한이 있는 시스템에 대한 시뮬레이션 공격을 허용합니다.
- 특수 액세스는 최소한의 보호 장치를 제공하며 AI 안전 시스템 자체를 테스트할 권한이 있는 제한된 검증된 조직에 대해 예약되어 있습니다.
조직과 개별 보안 팀은 업무에 맞는 계층을 신청하고 Anthropic은 액세스 권한을 부여하기 전에 각 신청서를 검토합니다. 회사는 세 가지 계층 모두 현재 주력 모델과 앞으로 출시될 새로운 모델에 대한 액세스를 포함한다고 밝혔습니다.
여전히 물린 것을 보호합니다 — 선택적으로
Anthropic은 이 발표를 계층 시스템이 순한 방어 작업과 실제로 위험한 기능을 분리한다는 것을 보여주기 위한 평가 데이터와 결합했습니다. Claude Opus 5.5에 대한 CyScenarioBench 평가에서 회사는 보호 장치가 방어 액세스 계층에서 50개 작업 중 46개 작업을 차단했다고 보고했습니다. 동일한 모델의 Red Team Access 계층에서는 어떤 작업도 차단되지 않았으며 모델은 50개 중 34개를 완료했습니다. 이는 보호 조치가 전혀 적용되지 않았을 때 기록된 것과 동일한 완료율입니다.
이와 대조적으로 Anthropic에 따르면 CVP 액세스가 없으면 첫 번째 프롬프트에서 모든 작업이 차단되었습니다.
The Hacker News, Reuters 및 SecurityWeek에 의해 널리 보도된 발표에서 회사는 "이러한 평가를 통해 더 광범위한 방어자들이 고급 사이버 기능을 안전하게 사용할 수 있도록 하여 Project Glasswing으로 시작한 방어 노력을 확장할 수 있다는 확신을 갖게 되었습니다."라고 밝혔습니다.
이 설계는 대부분의 방어 보안 작업(패칭, 로그 분석, 맬웨어 분류)이 엄격한 가드레일 아래에서 진행될 수 있는 반면 합법적인 공격 테스트에는 더 넓은 범위가 필요하다는 점을 반영합니다. 이는 또한 보안 업계가 오랫동안 이중 용도 도구를 처리해 온 방식을 반영합니다. 도구뿐만 아니라 실무자를 조사합니다.
Glasswing의 확장되는 발자국
프로그램 확장은 중요한 소프트웨어 강화에 모델을 적용하려는 Anthropic의 이니셔티브인 Project Glasswing과 긴밀하게 연결되어 있습니다. 회사에 따르면 Glasswing은 2026년 4월부터 7월까지 최소 129,000개의 확인된 소프트웨어 취약점을 발견했으며, 오픈 소스 검색 노력을 통해 4월부터 10월까지 추가로 5,500개의 확인된 취약점을 발견했습니다.
확인된 취약점 중 지금까지 33,000개 이상의 취약점이 심각 또는 높은 심각도로 평가되었습니다. Anthropic에서는 Glasswing 파트너 중 일부의 설문 조사 데이터만 사용하므로 이 수치가 상당히 과소평가될 가능성이 있다고 설명합니다. 회사는 실제 영향이 최소 5배 이상 클 수 있다고 추정합니다.
AI 기반 취약점 발견에 대한 측정된 관점
독립적인 분석에 따르면 AI가 발견한 결함의 홍수는 악용된 침해의 물결로 직접적으로 변환되지는 않습니다. 지난달 말 발표된 분석에서 VulnCheck 연구원 Patrick Garrity는 Anthropic 또는 Project Glasswing이 발견한 300개의 취약점 중 2개(약 0.67%)만이 실제로 악용되었음을 발견했습니다.
악용된 두 가지 결함은 Ghost CMS의 SQL 주입 취약점인 CVE-2026-26980과 Rejetto HTTP 파일 서버의 세션 위조 결함인 CVE-2026-61500입니다. 이 데이터는 보안 연구자들이 강조해 온 미묘한 차이를 뒷받침합니다. AI는 취약점 발견의 장벽을 낮추고 있지만 AI가 표면화하는 대부분의 결함은 공격자의 레이더에 포착되지 않았습니다.
이번 발표는 또한 AI로 생성된 보안 작업에 대한 광범위한 논의가 진행되는 가운데 이루어졌습니다. 1Password와 Veracode의 연구에 따르면 AI로 작성된 취약성 패치 자체가 새로운 결함을 유발할 수 있으며 자동화가 도움이 되지만 사람의 확인을 대체하지는 않는다는 점을 강조합니다.
보안 산업에 미치는 영향
보안 팀의 경우 CVP는 실제 방어 작업에서 프론티어 모델을 사용하기 위한 활성화 에너지를 낮춥니다. 사고 대응자는 맬웨어 분석 지원을 받을 수 있는 승인된 경로를 얻습니다. 침투 테스터는 AI 지원 공격을 위한 통제된 환경을 얻습니다. AI 안전 시스템을 감사하는 소규모 조직 자체는 최소한의 액세스 제한을 받습니다.
Anthropic의 경우 이 프로그램은 안전 전략이자 상업적인 전략입니다. 이는 강력한 사이버 기능을 완전히 억제하기보다는 심사를 받은 방어자에게 의도적으로 공개해야 한다는 회사의 입장을 구체화합니다. 이는 사이버 통제가 약한 모델에 대한 조사를 받는 경쟁업체와는 대조적입니다. 이는 또한 프론티어 모델 액세스 비용을 지불할 가능성이 가장 높은 기업, 즉 정부, 중요 인프라 운영자 및 대규모 보안 공급업체와 Anthropic의 관계를 심화시킵니다.
회사는 프로그램과 관련된 가격 변경을 발표하지 않았으며 신청서는 Anthropic의 기존 심사 액세스 채널을 통해 처리됩니다. Glasswing이 이미 표면화한 규모와 그 숫자가 현실을 과소평가할 가능성이 있다는 회사 자체의 인정을 고려할 때 보안 업계에서는 공격자가 먼저 발견하기 전에 129,000개의 발견 항목 중 얼마나 많은 부분이 수정될지 지켜볼 것입니다.
---
AI 최신 소식최신 AI 뉴스, 분석 및 혁신을 한 곳에서 확인하세요.
AI 뉴스 더 보기 →