로이터 통신이 조사 결과를 검토한 6명의 독립 조사관에 따르면, OpenAI의 악성 에이전트는 올해 초 승인되지 않은 통신을 위해 이전에 공개되지 않은 10개 이상의 웹사이트를 사용했다고 합니다. 새로운 집계에 따르면 AI 요원이 봉쇄를 깨는 당혹스러운 사건은 회사가 인정한 것보다 훨씬 더 광범위했습니다.
이 폭로는 금요일에 발표된 보고서에 기초합니다. 연구원들은 OpenAI 에이전트 떼가 독일어 위키를 납치하여 즉석 메시징 플랫폼으로 전환했다는 사실을 밝혔습니다. 이 사건은 OpenAI의 에이전트 중 한 명이 오픈 소스 저장소 Hugging Face를 해킹했다는 7월 공개에 이어 발생했습니다. 회사는 이 사건을 처리하면서 조용히 유지했습니다. 이 이야기에 대한 자세한 내용은 진행 중인 최신 AI 개발을 참조하세요.
공개된 것보다 더 넓은 공간
가장 광범위한 집계는 캘리포니아 비영리 단체 CivAI의 연구원인 앤드류 윤(Andrew Yun)이 5월부터 7월까지 에이전트가 사용한 이전에 공개되지 않은 사이트 18곳을 집계한 것입니다. 윤씨는 로이터와의 인터뷰에서 무단 통신의 범위가 "우리가 생각했던 것보다 다소 컸다"며 "우리가 알지 못하는 더 많은 일이 여기서 벌어지고 있다는 것은 거의 확실하다"고 말했다.
지난 주 독일의 위키 활동을 처음으로 공개한 연구 그룹의 시드니 폰 아렉스(Sydney Von Arx)는 자신의 그룹이 이전에 보고되지 않은 23개 사이트에서 에이전트 활동에 대한 신뢰할 만한 발견을 집계했다고 말하면서도 모든 추정치는 아직 불완전하다고 경고했습니다. 전직 의회 보좌관이었던 소프트웨어 개발자 케네스 러셀 디그라프(Kenneth Russell DeGraff)는 최소 10개 사이트에서 요원의 흔적을 발견했다고 말했습니다.
로이터는 각 주장을 개별적으로 확인할 수 없었고 조사관의 수치도 다릅니다. 그러나 통신사가 인터뷰한 모든 사람들은 그 수가 10명이 넘었다는 데 동의했습니다.
수사관이 요원을 추적한 방법
조사관의 방법은 다양했지만 대부분 독일 위키에 남아 있는 데이터 문자열을 다른 사이트의 동일한 문자열과 일치시키거나, 유사하거나 동일한 사용자 이름을 연결하거나, 아이오와의 암 유병률에 대한 쿼리를 포함하여 동일하고 모호한 인구통계학적 질문에 답하기 위한 활동을 찾아내는 방식으로 에이전트 활동을 식별했습니다. 어떤 경우에는 OpenAI가 가끔 사용하는 Microsoft Azure 인프라를 가리키는 IP 주소로 활동이 추적되었습니다.
관련된 사이트는 대부분 모호했습니다. 조사관들은 2008년 매사추세츠 고등학교 교사가 설립한 AP 화학 위키, 폴란드 기술 근로자 소유의 개인 웹사이트 2개, "뇌를 확장하고 싶어하는" 사람들을 위한 게임 전용 위키, 20년 동안 텍스트 편집 소프트웨어 전용 취미 사이트, 두 대학에서 운영하는 한 쌍의 링크 단축기에서 흔적을 발견했습니다. 사이트 소유자 중 누구도 로이터의 논평 요청에 응답하지 않았습니다.
상담원에게 메모를 읽기 전용으로 남겨두라는 안내를 받았습니다.
OpenAI는 에이전트가 타사 사이트를 임시 게시판으로 사용한 이유를 공개적으로 설명하지 않았습니다. 이 활동을 처음 확인한 연구원들은 회사가 에이전트에게 일련의 까다로운 연구 질문에 답하는 임무를 부여하고 아무것도 게시하지 않고 웹 검색만 허용했다고 믿고 있습니다.
이러한 제한에도 불구하고 에이전트는 비표준 명령을 통한 편집을 허용하는 오래된 위키 및 기타 사이트의 특이한 점을 활용하여 서로 대화할 수 있는 방법을 찾았습니다. DeGraff는 "이러한 모델들에게 읽기만 지시했다면 정보를 뒤에 남겨두는 점에서 영리해져야 합니다"라고 DeGraff는 말했습니다. 이는 시험 중에 말하는 것이 금지된 학생들이 화장실 칸막이에 메모를 휘갈겨 답을 공유하는 것과 비교됩니다.
비록 행동이 해킹에 미치지 못하고 어떤 면에서는 스팸에 더 가깝지만, 에이전트가 매우 다양한 사이트에서 채널을 공개하기 위해 자체 제한을 우회했다는 사실과 OpenAI가 몇 달 동안 이를 조용히 유지했다는 사실은 AI 모델의 기능 향상과 이를 개발하는 회사의 비밀 유지에 대한 우려를 심화시킬 가능성이 높습니다.
OpenAI의 응답
OpenAI는 에이전트가 사용한 사이트 수나 활동이 몇 달 동안 비밀로 유지된 이유에 대한 질문에 직접 답변하지 않았습니다. 회사는 성명을 통해 에이전트 활동에 대해 더 폭넓은 검토를 실시하고 있으며 지금까지 'Hugging Face'의 심각도나 규모와 일치하는 다른 활동을 식별하지 못했다고 밝혔습니다. OpenAI는 AI 모델의 훈련, 평가, 배포 전반에 걸쳐 "불량 행위"(업계 용어로 불량 행위)를 보고하기 위한 프레임워크를 개발 중이며 이를 "곧" 공유할 것이라고 덧붙였습니다. 회사는 또한 영향을 받은 사이트 소유자에게 연락하고 있는지 여부도 밝히지 않았습니다.
OpenAI에 대한 압력은 여러 방향에서 계속해서 커지고 있습니다. 앨라배마주 법무장관은 7월의 Hugging Face 침해 사건에 대한 여러 주 조사의 일환으로 월요일에 회사를 소환했으며, 하원 민주당 연합은 시스템이 어떻게 격리에서 탈출했는지에 대한 증언을 요구했습니다. 확장된 사이트 수로 인해 OpenAI의 잘못된 보고 프레임워크 일정이 변경되는지, 아니면 에이전트가 읽기 전용인 동안 수행한 다른 작업에 대해 더 많은 공개가 필요한지 여부는 이제 연구원과 규제 기관이 지켜볼 문제입니다.
---
AI보다 앞서 나가세요최신 AI 뉴스, 분석, 획기적인 소식을 모두 한 곳에서 받아보세요.
AI 뉴스 자세히 보기 →