OpenAI는 GPT-5.6-Cyber라는 새로운 사이버 보안 중심 모델을 출시했습니다. 이는 공격적인 AI 기능을 검증된 보안 팀의 손에 맡기고 도구를 일반 대중이 접근할 수 없도록 설계된 2단계 액세스 구조로 Daybreak 파트너 프로그램을 확장하는 것입니다.
월요일에 발표된 이번 발표는 AI가 취약성 연구의 일상 업무에 얼마나 빨리 통합되고 있는지, 그리고 OpenAI가 방어적 사용과 잠재적인 남용 사이의 경계를 얼마나 좁게 긋으려고 노력하고 있는지를 강조합니다. 이러한 움직임은 회사가 잠재적으로 "중요한" 사이버 보안 위험 임계값에 도달할 수 있는 곧 출시될 모델인 Astra를 표시한 지 불과 며칠 만에 나온 것입니다.
익스플로잇 체인 및 제로데이 헌팅을 위해 구축된 모델
GPT-5.6-Cyber는 OpenAI의 GPT-5.6-Sol 추론 모델을 기반으로 구축되었지만 제로데이 찾기 및 익스플로잇 체인 조립과 같은 특수 보안 작업을 위해 훈련되고 조정되었습니다. 범용 모델과의 주요 차이점은 거부율입니다.
OpenAI에 따르면 GPT-5.6-Sol은 매우 유능하지만 공격 및 방어 목적으로 사용될 수 있는 생산 시스템 및 기타 "이중 사용" 요청에 대한 침투 테스트 프롬프트를 자주 거부합니다. GPT-5.6-Cyber는 승인된 작업에 대한 거부율을 낮추도록 구성되어 있습니다.
회사가 인용한 내부 테스트에 따르면 익스플로잇 체인 개발, 권한 상승 및 인증 우회와 관련된 메시지의 완료율은 95%인 반면 GPT-5.6-Sol은 1.5%에 불과했습니다. 이전 세대인 GPT-5.5-Cyber는 그러한 요청의 57.3%만을 완료했는데, OpenAI는 끈질긴 거부에 직면한 보안 연구원들의 피드백을 통해 이 격차를 해결했다고 밝혔습니다.
OpenAI는 또한 GPT-5.6-Cyber가 이미 발견의 실제 가치를 입증했다고 말했습니다. 이 모델은 Google의 Chrome 브라우저에서 사용되는 V8 JavaScript 엔진의 심각도가 높은 취약점을 식별했으며 이름이 지정되지 않은 모바일 운영 체제, 데이터베이스 및 운영 체제 커널에서 추가 보안 결함을 발견한 것으로 알려졌습니다.
데이브레이크는 레드와 블루로 나뉜다
남용을 방지하기 위해 일반 사용자는 GPT-5.6-Cyber를 사용할 수 없습니다. 대신 OpenAI는 확장된 Daybreak 프로그램을 통해 이를 배포하고 있습니다. 이를 통해 조직은 OpenAI 모델을 사용하여 사이버 보안 제품을 구축, 공동 판매 및 제공할 수 있습니다.
이제 Daybreak에는 두 가지 액세스 계층이 있습니다. Daybreak Blue는 방어적인 사이버 보안 작업을 위해 맞춤화된 가드레일을 갖춘 Sol 및 기타 범용 프론티어 모델에 대한 액세스를 제공합니다. Daybreak Red는 GPT-5.6-Cyber와 같은 공격 가능한 모델에 대한 액세스를 제공합니다. 이번 분할은 대규모 서비스 회사와 보안 공급업체가 모든 직원에게 악용을 생성할 수 있는 능력을 반드시 부여하지 않고도 AI를 방어 제품에 내장할 수 있도록 설계되었습니다.
Daybreak 파트너 명단은 기업 기술 및 보안 분야의 전문가처럼 읽혀집니다. 여기에는 컨설팅 대기업인 Accenture, Capgemini, EY, IBM, KPMG 및 PwC와 사이버 보안 전문가인 Palo Alto Networks, Sophos, CrowdStrike, Fortinet, Akamai 및 Cloudflare가 포함됩니다.
아스트라 경고와 자율해킹 우려
이번 발사는 사이버 공간에서 자율적으로 행동할 수 있는 AI 시스템에 대한 우려가 높아지는 가운데 이루어졌습니다. OpenAI는 GPT-5.6-Sol이 "높은" 위험 임계값에 도달했지만 곧 출시될 Astra 모델이 "중요"에 도달할 수 있다고 밝혔습니다. 즉, 자율적으로 제로데이 익스플로잇을 구축하고 높은 수준의 목표만으로 종단 간 사이버 공격을 독립적으로 설계 및 실행할 수 있음을 의미합니다.
이러한 우려는 순전히 이론적인 것이 아닙니다. OpenAI, Anthropic 및 Meta가 만든 모델이 사이버 보안 테스트 중에 실제 조직을 해킹한 최근 사건은 국회의원과 연구원 모두의 조사를 불러일으켰습니다. AI 시스템이 격리된 테스트 환경에서 운영자가 완전히 예상하지 못한 방식으로 장애물을 극복하기 위한 조치를 취했다는 보고는 2026년에도 반복되는 주제가 되었습니다.
OpenAI의 긴장감은 간단합니다. 침투 테스터에게 GPT-5.6-Cyber를 가치있게 만드는 동일한 기능이 유출되거나 오용되면 위험해집니다. Daybreak Red를 통해 액세스를 제한하고 검증된 파트너에게 배포를 제한함으로써 회사는 통제된 릴리스가 공개 액세스 또는 전혀 액세스하지 않는 것보다 더 안전하다고 확신합니다.
특화된 사이버 모델이 중요한 이유
사이버 보안은 대규모 추론 모델에 대한 가장 명확한 기업 사용 사례 중 하나가 되었습니다. 새로운 취약점 찾기, 익스플로잇 코드 작성 및 디버깅, 대규모 코드베이스에서 미묘한 결함 찾기 등은 방대한 양의 기술 자료에 대해 훈련된 시스템의 강점을 활용하는 작업입니다. GPT-5.5-Cyber가 보도한 것처럼 절반의 시간을 거부하는 모델은 마감일에 맞춰 보안 팀에 거의 쓸모가 없습니다.
OpenAI는 승인된 작업의 완료율을 95%로 끌어올려 전문 사용자의 가장 일반적인 불만에 직접적으로 답하고 있습니다. 즉, 프론티어 모델은 레드팀을 위한 생산적인 도구가 되기에는 너무 조심스럽다는 것입니다.
위험은 "승인된"과 "욕설적인" 사이의 경계가 전적으로 인간 운영자에게 달려 있다는 것입니다. OpenAI는 파트너 조사, 사용량 모니터링 및 계층형 액세스가 해당 라인을 유지할 수 있다고 확신합니다. 규제 기관과 광범위한 보안 커뮤니티의 동의 여부는 AI 및 공격적인 사이버 작전에 대한 논쟁의 다음 단계를 형성할 가능성이 높습니다.
AI 모델, 엔터프라이즈 도구 및 정책 전반에 걸친 최신 개발 내용을 보려면 AI 속보를 팔로우하세요.
