OpenAI는 최첨단 AI 안전에 대한 전문 지식을 보유하고 효과적인 제3자 평가를 제공할 수 있는 기업의 수를 늘리기 위해 여러 독립 평가자와 논의하고 있다고 PYMNTS가 보고한 9월 22일 화요일에 게시된 블로그 게시물에서 밝혔습니다.
이 게시물은 효과적인 제3자 감독을 위해 OpenAI가 제안한 우선순위와 원칙을 제시합니다. 이 프레임워크는 점점 더 유능한 모델을 훈련, 평가 및 배포할 때 모든 첨단 AI 연구소에 적용되어야 한다고 말합니다. 이 발표는 AI 안전 정책에 대해 이례적으로 비용이 청구되는 한 달 중반에 이루어졌으며, 이는 비판자들에 대한 양보이자 정부가 규칙을 작성하기 전에 규칙을 형성하려는 시도로 읽혀집니다. AI 속보를 따르는 사람이라면 누구나 최신 모델이 안전한지 확인할 수 있는 사람을 놓고 실험실, 비평가 및 규제 기관 간에 몇 주 동안 진행된 경쟁의 최신 움직임입니다.
OpenAI가 제안하는 것
PYMNTS에 따르면 OpenAI는 게시물에서 "우리는 효과적인 제3자 평가를 위해 미래 법률과 민간 거버넌스 이니셔티브를 통해 독립적인 평가자를 지원하고 보다 명확하고 공유되는 국제 표준을 확립하기 위해 최선을 다하고 있습니다"라고 밝혔습니다.
OpenAI가 설명하는 핵심 문제는 시장 실패입니다. 즉, 프런티어 모델을 감사할 수 있는 기술적 깊이를 갖춘 조직이 너무 적다는 것입니다. 의미 있는 안전성 평가를 위해서는 아직 공개되지 않은 시스템에 대한 접근, 사이버보안에서 생물보안에 이르는 분야의 전문지식, 그리고 원하지 않는 결과를 발표할 수 있는 제도적 독립성이 필요합니다. OpenAI는 권한 있는 단일 감사자가 아닌 여러 평가자를 모집하고 지원함으로써 일회성 홍보 활동이 아닌 제3자 평가가 프론티어 시스템 배포의 일상적인 부분이 되는 생태계를 구축하고자 한다고 말합니다.
회사는 대화 중인 평가자의 이름을 밝히지 않았으며 결과적인 합의가 평가자에게 안전 연구자가 의미 있다고 생각하는 액세스, 자금 독립성 및 출판 권한을 제공할지 여부는 아직 지켜봐야 합니다.
AI 정책에 관한 Whiplash의 한 주
이 제안은 9월의 AI 토론을 정의한 정책 개발이 빠르게 진행되는 가운데 나온 것입니다.
- 9월 21일 월요일: OpenAI는 미국이 AI 시스템이 스스로 개선되는 지점인 반복적 자기 개선을 포함하여 첨단 AI에 대한 글로벌 기술 표준을 개발하기 위한 국제적인 노력을 주도할 것을 촉구했습니다. 회사는 완전 자율 AI 개발이 인간의 이해 및 제어 능력을 앞지를 수 있다고 경고했으며, 진행할지 여부와 방법에 대한 결정을 지금 내려야 한다고 말했습니다.
- 9월 18일 금요일: 캘리포니아 주지사 Gavin Newsom은 주의 AI 안전법을 강화하기 위해 국가 전문가를 소집하는 행정 명령에 서명했습니다. 이는 AI 시스템의 안전 및 보안 위험에 대한 새로운 제3자 감독 구현을 가속화하는 것을 명시적으로 목표로 합니다.
- 9월 19일 토요일: 도널드 트럼프 대통령은 진실 소셜(Truth Social) 게시물에서 업계의 안전에 대한 우려를 일축하며 다음과 같이 적었습니다. "우리는 이 놀라운 산업의 성장을 어떤 식으로든 방해하거나 억누르지 않을 것입니다. AI는 차세대 산업 혁명, 즉 인터넷이지만 훨씬 더 크고 영향력이 커질 것이며 아마도 우리나라 GDP의 25%에 이를 것입니다."
이번 주 초에 보고한 바와 같이, OpenAI의 미국 주도 표준 제안은 수년 동안 구속력 있는 감독에 저항해 온 회사에 놀라운 변화를 가져왔으며, 새로운 제3자 평가 원칙은 이러한 입장을 민간 거버넌스 전선으로 확장했습니다.
독립 문제
OpenAI가 외부 감시자를 수용한 것은 주요 경쟁자의 유사한 제안을 따른 것입니다. 약 일주일 전, Anthropic CEO Dario Amodei는 선도적인 AI 기업에 포함된 독립적인 평가자, 민주주의 국가의 기업 간 조정, 그리고 결국 중국을 포함하는 국제 협약을 중심으로 구축된 AI 안전 계획을 제안하는 에세이를 발표했습니다.
두 제안 모두 전문가들로부터 즉각 회의적인 반응을 불러일으켰습니다. CNBC는 100명 이상의 AI 전문가 연합이 평가를 수행하는 Anthropic, OpenAI 및 기타 기초 모델 연구소에 독립성과 투명성을 촉구하고 있으며, 자신이 감사하는 회사에 소속되거나 급여를 받는 평가자는 피할 수 없는 이해 상충에 직면할 것이라고 경고했습니다. AI 선구자 Geoffrey Hinton이 지원하는 감시자들은 두 회사 모두의 안전 계획에 대해 세부 사항을 압박했으며 논평자들은 AI 안전 평가 조직과 연구소 자체 사이의 회전문을 표시했습니다. 안전 숙제를 채점하는 사람들이 그것을 작성한 사람일 수도 있습니다.
이러한 긴장은 OpenAI의 새로운 게시물이 완화하려는 논쟁의 핵심입니다. 더 많은 평가자, 공유된 국제 표준, 미래 법률과 민간 이니셔티브를 통해 시행되는 감독 등 회사의 대답은 프레임워크일 뿐 아직은 보장되지 않습니다. 비평가들은 규칙을 제안하는 연구소가 규칙을 적용받는 동일한 연구소이며, 자체 형성 거버넌스는 역사적으로 형성을 수행하는 회사를 선호해 왔다는 점을 지적할 것입니다.
중요한 이유
차세대 프론티어 모델은 이미 교육 중이며 배포 전 설계 감독 기간이 종료되었습니다. OpenAI가 독립적인 평가자를 모집하여 실제 접근 권한과 실질적인 독립성을 갖춘 감사자가 배출된다면 이는 전 세계적으로 프론티어 AI가 관리되는 방식에 대한 템플릿이 될 수 있습니다. 이는 워싱턴, 브뤼셀 및 기타 지역의 국회의원들이 지금까지 스스로 구축하지 못한 민간 체제입니다. NDA와 제휴 컨설팅을 생산한다면 회의론자들의 최악의 해석을 확인하게 될 것입니다.
어느 쪽이든, OpenAI가 누가 가장 신뢰할 수 있는 감독 제도를 제안할 수 있는지 두고 Anthropic과 경쟁하고 있다는 사실 자체가 새로운 것입니다. 1년 전, 연구실은 주로 규제에 반대하는 입장으로 통합되었습니다. 이제 그들은 그것을 정의하기 위해 경주하고 있습니다.
---
AI보다 앞서 나가세요최신 AI 뉴스, 분석, 획기적인 소식을 모두 한 곳에서 받아보세요.
AI 뉴스 자세히 보기 →