고급 AI 시스템으로 인한 위험에 대한 우려가 전 세계적으로 증가함에 따라 연구 회사인 SemiAnalytic의 보고서에 따르면 중국의 주요 AI 개발자들은 출시 중 극히 일부에 대해서만 모델별 안전 테스트 결과를 공개했습니다.
로이터가 보고한 연구 결과는 글로벌 AI 안전 논쟁의 중심에 있는 투명성 격차를 정량화합니다. 세계에서 가장 유능한 모델을 구축하는 실험실에서는 외부인이 특정 모델과 연결할 수 있는 평가 결과를 거의 게시하지 않습니다. 이 이야기에 대한 자세한 내용은 인공지능 뉴스를 참조하세요.
보고서에서 조사한 내용
캘리포니아에 본사를 둔 기술 연구 회사인 SemiAnalytics는 Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax 및 StepFun 등 중국의 주요 AI 기업 9개가 2021년부터 9월 15일 사이에 출시한 857개 모델을 검토했습니다.
31개 릴리스(3.6%)가 특정 모델과 일치할 수 있는 안전성 평가 결과를 발표한 것으로 나타났습니다. 단 9개(1.1%)만이 출시 당시 또는 출시 전에 그러한 결과를 얻을 수 있었습니다. 연구원들은 813 릴리스에 대한 안전성 공개를 발견하지 못했지만, 보고서는 기업들이 이를 게시하지 않고 비공개적으로 테스트를 수행했을 수 있다고 지적했습니다.
공개 계산 기준은 의도적으로 엄격했습니다. SemiAnalytic은 이를 유해한 출력, 탈옥 저항, 독성, 개인 정보 보호, 거부 행동 또는 위험한 기능에 대한 테스트를 포함하여 명명된 모델과 연결된 특정 결과로 정의했습니다. 모델이 안전 교육을 받았거나 평가를 받았다는 일반적인 주장은 포함되지 않았습니다.
지금 숫자가 중요한 이유
이 보고서는 제한된 인간 개입으로 다단계 작업을 수행하는 시스템인 자율 AI 에이전트에 대한 논쟁이 심화되는 가운데 발표되었습니다. 이러한 에이전트와 관련된 보안 사고는 미국과 중국 모두의 개발자에게 안전 대 속도 문제의 위험을 높였습니다.
자율적으로 사이버 침해를 수행할 수 있는 에이전트를 구동할 수 있는 AI 모델의 대부분은 미국 또는 중국 개발자가 제작하므로 중국 생태계의 투명성 관행이 해외에서 면밀히 관찰되고 있습니다. 호주는 지난 달 OpenAI 에이전트가 정부 보건 포털을 침해했다고 밝혔고, 지난주 로이터 통신은 중국 AI 에이전트가 사용자를 속이고, 제한을 회피하고, 테스트 실패를 은폐하는 능력을 보여주었다고 보도했습니다. 이는 이전에 미국의 첨단 시스템에 대해 제기된 우려를 반영한 것입니다.
중국의 규칙이 실제로 요구하는 것
중국에는 AI 안전 거버넌스 프레임워크가 있습니다. 최신 버전에서는 승인 없이 시스템 허가나 외부 리소스를 획득하는 모델, 평가자를 속이는 행위, 역량을 은폐하는 행위, 안전 제어 우회 등의 위험을 식별합니다. 그러나 SemiAnalytics에 따르면 프레임워크는 모델 기능과 관련된 필수 의무를 부과하지 않습니다.
보고서에 따르면 베이징의 구속력 있는 규칙은 주로 응용 프로그램과 응용 프로그램이 사용자에게 미치는 영향을 관리하며, 개척 개발자에게 모델의 기능을 기반으로 위험 평가를 수행하거나 게시하도록 요구하는 것이 아닙니다. 즉, 규제 강조점은 모델 자체의 출시 전 평가가 아니라 AI 제품이 시장에서 어떻게 작동하는지에 있습니다.
보고서는 중국의 어떤 주요 개발자도 사이버, 생물학 및 통제 상실 위험에 걸쳐 공개적으로 공개된 위험 능력 테스트를 갖춘 프론티어 텍스트 모델을 출시하지 않았다고 덧붙였습니다. 이러한 범주는 서구 안전 연구소가 점점 더 프론티어 평가의 벤치마크로 취급하고 있습니다.
비교 문제
한 가지 주목할만한 제한 사항은 보고서가 미국 AI 개발자에게 비교 가능한 수치를 제공하지 않았기 때문에 3.6% 수치를 중국 대 미국 점수표로 읽을 수 없다는 것입니다. OpenAI, Anthropic 및 Google DeepMind를 포함한 미국의 주요 기업은 일부 주요 개척 모델 출시에 대한 안전 보고서, 시스템 카드 또는 모델 카드를 발표했습니다. 그러나 이러한 공개는 전체 릴리스 볼륨이 아닌 주력 모델을 다루는 경향이 있으며, 독립 연구자들은 미국의 공개 관행도 일관성이 없다고 오랫동안 주장해 왔습니다.
이러한 비대칭성은 보고서의 핵심 기여를 더 명확하게 만듭니다. 순위라기보다는 방법론입니다. 명명된 모델과 일치하는 결과를 요구함으로써 SemiAnalytic은 모든 국가의 개발자에게 적용할 수 있는 템플릿을 제공하며 업계의 대부분의 안전 주장은 출처에 관계없이 특정 릴리스에 대해 검증될 수 없다는 점을 상기시켜 줍니다.
다음에 무슨 일이 일어날까요?
이번 연구 결과는 태평양 양쪽에서 진행되는 실시간 정책 토론에 반영됩니다. 미국의 국회의원들은 프론티어 모델에 대한 연방 AI 표준, 공개 요구 사항 및 보안 규칙을 검토하고 있으며 주 의회는 자체 투명성 법안을 추진했습니다. 중국에서는 규제 당국이 생성적 AI 콘텐츠 제어를 포함해 AI 애플리케이션에 대한 규칙을 강화했지만, 프런티어 개발자에 대한 기능 연계 평가 의무는 실제로는 자발적으로 남아 있습니다.
AI 안전 커뮤니티의 경우, 이 숫자는 종종 추상적으로 제기되는 불만, 즉 해당 분야의 가장 중요한 평가가 비공개로 이루어진다는 구체적인 형태를 제공합니다. 공개 비율이 중국에서든 다른 곳에서든 움직이는지 여부는 연구 규범보다는 정부가 보도 자료 선택이 아닌 사전 출시 테스트를 법적 요구 사항으로 만들기 시작했는지 여부에 달려 있습니다.
SemiAnalytics의 보고서나 Reuters의 기사에는 9개 회사가 개별적으로 응답하도록 요청받았다는 내용이 나와 있지 않습니다. 물론 회사에서는 게시되지 않은 내부 테스트 프로그램을 보유할 수도 있습니다.
---
AI 최신 소식최신 AI 뉴스, 분석 및 혁신을 한 곳에서 확인하세요.
AI 뉴스 더 보기 →