Google DeepMind는 일반 인공 지능(AI)에 대한 대화를 넓히는 데 전념하는 새로운 연구소를 시작했습니다. 창립 에세이에는 배포 전에 최첨단 AI 모델을 평가할 미국 주도 기관에 대한 Demis Hassabis의 구체적인 제안이 포함되어 있습니다.

TechCrunch에 따르면 수요일 구글과 구글 딥마인드 연구원들이 출범한 딥마인드 연구소(DeepMind Institute)는 딥마인드 공동 창업자인 셰인 레그(Shane Legg)를 편집장으로, 구글 임원 제임스 매니카(James Manyika), 구글 딥마인드 회장 데미스 하사비스(Demis Hassabis)를 이사로 등록했다. 이 이야기에 대한 자세한 내용은 최신 AI 동향를 참조하세요.

동의할 여지

연구소의 명시된 목적은 Google 내부를 포함하여 진정한 불일치를 표면화하는 것입니다. "그들은 항상 동의하지는 않을 것이며, 빠르게 움직이는 국경에서 더 많은 데이터와 정보가 밝혀짐에 따라 마음이 바뀔 가능성이 높습니다"라고 발표했습니다.

첫 번째 컬렉션은 잠재적인 AGI 혼란을 관리하기 위한 경제 정책, 인간이 읽을 수 있는 모델 추론 보존, 인간 번영의 원칙, 첨단 AI 모델을 평가하기 위한 프레임워크를 다루는 4개의 에세이로 구성됩니다.

공개적인 불일치를 제도화하는 것은 공개 메시징이 엄격하게 통제되는 경향이 있는 기업 AI 연구소에서는 이례적인 움직임입니다. 의도적으로 연구소는 Google 연구원들에게 회사의 상업적 이익 또는 서로의 상업적 이익과 상충될 수 있는 입장을 주장할 수 있는 장소를 제공합니다.

투명성 에세이: '불투명한 연속 깊이'를 살펴보세요

DeepMind 안전 연구원 Rohin Shah와 Anca Dragan이 작성한 4개의 에세이 중 하나는 새로운 아키텍처로 인해 가장 강력한 모델을 모니터링하기가 더 어려워지더라도 AI의 투명성 창(모델의 단계별 추론을 보고 확인할 수 있는 능력)이 줄어드는 것은 불가피하지 않다고 주장합니다.

저자는 개발자와 규제 기관이 안전 상충관계에 직접 직면해야 한다고 말합니다. 구체적으로 이는 읽을 수 있는 추론 추적을 생성하지 않고 모델이 수행할 수 있는 순차적 계산의 양인 "불투명 직렬 깊이"를 제한하거나 개발자가 덜 투명한 시스템이 해석 가능한 시스템만큼 모니터링 가능하다는 것을 입증하도록 요구하는 것을 의미할 수 있습니다.

이 제안은 해석 가능성의 상실을 규모의 피할 수 없는 결과라기보다는 설계 및 정책 선택으로 간주하여 규제에 기록될 수 있는 요구 사항의 문을 열었다는 점에서 주목할 만합니다.

Hassabis의 제안: 미국 개척 표준 기관

가장 중요한 에세이는 Hassabis의 것일 수 있습니다. 그는 가장 발전된 AI 모델을 평가하는 임무를 맡은 미국이 주도하는 첨단 AI 표준 기관을 제안합니다. 프레임워크에 따라 개발자는 처음에는 출시 전 최대 30일 검토를 위해 자발적으로 모델을 제출합니다. 평가 시스템이 효과적이라는 것이 입증되면 테스트 통과가 미국에서 프런티어 모델을 배포하기 위한 필수 사항이 될 수 있습니다.

이 기관은 AI 회사와 협의하여 평가를 설계하는 것으로 시작하지만 결국 실험실이 공개 평가 체제의 잘 문서화된 실패 모드인 알려진 벤치마크에 모델을 맞춤화하는 것을 방지하기 위해 에세이에서 "보류" 테스트라고 부르는 독립적이고 공개되지 않은 평가를 개발할 것입니다.

Hassabis는 또한 단계적 확대의 문을 열어 두었습니다. 즉, 프레임워크는 "상황의 심각성에 따라 조정될 수 있으며" 잠재적으로 선두 AI 개발자들 사이의 조정된 둔화를 포함할 수 있습니다.

다른 두 에세이가 중요한 이유

AGI 혼란을 관리하기 위한 경제 정책과 인간 번영의 원칙에 관한 나머지 두 개의 에세이는 AGI를 순전히 기술적인 문제가 아닌 사회 전반의 문제로 다루는 컬렉션을 완성합니다. 경제적 변위는 오랫동안 고급 AI에 대한 가장 가시적인 대중의 관심사였으며 이를 평가 정책 및 해석 가능성과 함께 구성하는 것은 연구소가 정책 입안자들이 이 부분들을 별도의 토론이 아닌 하나의 의제로 보기를 원한다는 것을 시사합니다.

그 폭은 Google의 포지셔닝에 대한 신호이기도 합니다. 이 회사는 기업 고객과 정부 계약을 두고 경쟁하는 동시에 프론티어 시스템에는 외부 조사가 필요하다고 주장하고 있습니다. 긴장감을 완화하기보다는 공개하는 것이 연구소의 핵심 전제입니다.

고민부터 구체적인 제안까지

이 에세이는 업계의 안전 논의가 광범위한 우려 진술에서 특정 메커니즘(공개 요구 사항, 외부 조사 및 안전 조치가 뒤처지는 경우 조정된 속도 저하)으로 이동함에 따라 도착했습니다. TechCrunch에 따르면 업계 리더들이 Anthropic CEO Dario Amodei의 첨단 AI 개발 요구 사항을 승인하면서 이번 주 이러한 변화가 가속화되었습니다.

타이밍이 중요합니다. 대서양 양쪽의 정부는 평가 인프라보다 빠르게 발전하는 기능을 갖춘 시스템을 감독하는 방법을 고려하고 있습니다. 선도적인 AI 연구소에서 시작된 제안서(출시 전 검토 포함)는 정책 입안자에게 업계 자체가 명목상 승인한 템플릿을 제공하며, 이는 역사적으로 의미 있는 AI 규제의 전제 조건이었습니다.

볼만한 동영상

Google로부터 연구소의 편집 독립성이 첫 번째 테스트가 될 것입니다. 투명성 에세이가 주장하는 것처럼 에세이에 Google의 상업적 로드맵에 반대하는 입장이 계속 포함된다면 해당 장소는 AGI 정책 토론에 심각한 기여를 할 수 있습니다. 기업 메시징 쪽으로 표류한다면 혼잡한 분야에서 또 하나의 홍보 채널이 될 것입니다.

어느 쪽이든, 이제 그 내용은 논의되고 있습니다. 출시 전 평가 요구 사항, 지속 테스트, 심지어 조정된 속도 저하까지 AI 분야의 가장 강력한 인물 중 한 명이 공개적으로 주장하고 있습니다. 문제는 더 이상 프론티어 모델을 독립적으로 평가해야 하는지 여부가 아니라 누가 평가를 수행하는지, 그리고 시간표는 무엇인지입니다.

---

AI 최신 소식

최신 AI 뉴스, 분석 및 혁신을 한 곳에서 확인하세요.

AI 뉴스 더 보기 →