마이크로소프트는 월요일 미래의 인공 지능 모델이 훈련할 수 있는 작업을 제한하는 임시 행동 강령을 발표하여 업계에서 급속도로 확대되는 안전 논쟁을 의견 에세이에서 구체적인 기업 정책으로 옮겼습니다.

마이크로소프트 AI의 CEO인 무스타파 술레이만(Mustafa Suleyman)이 발표한 지침은 회사의 모델이 무기 개발을 지원하거나, 폭력적이거나 성적으로 노골적인 콘텐츠를 제작하거나, 사용자가 위험한 물질을 조달하도록 돕는 것을 금지합니다. 그들은 또한 모델이 의식을 모방하기 위해 만들어져서는 안 되며, 권리가 있는 것으로 간주되어서는 안 된다고 명시합니다. 이번 발표는 경쟁사 CEO들의 둔화 요청에 대한 AI 속보로 인해 칩 및 AI 관련 주식이 글로벌 시장에서 하락하면서 올해 AI 업계가 겪은 가장 격동적인 한 주에 이루어졌습니다.

"AI는 종속되어야 합니다"

코드를 발표한 소셜 미디어 게시물에서 술레이만은 "AI는 종속되어야 하며 항상 사람들을 위해 봉사해야 한다"고 썼으며 "통제력 상실 가능성에 대한 두려움은 현실이다"라고 덧붙였습니다.

마이크로소프트 웹사이트의 병행 게시물에서는 규칙 뒤에 숨은 철학을 다음과 같이 설명했습니다. "기술의 목적은 인류에게 봉사하고 인간의 번영을 가속화하는 것입니다. 이를 달성하지 못하는 모든 기술은 실패이며 거부되어야 합니다." 회사는 소위 "종속되고, 정렬되고, 억제되는 휴머니스트 AI"를 구축하고 있다고 밝혔습니다.

Suleyman은 CNBC에 Microsoft가 몇 달 동안 지침을 작성해 왔으며 코드의 필요성이 "긴급"하다고 설명하고 지난 몇 달을 "유역의 순간"이라고 불렀다고 말했습니다.

언어 뒤에 숨겨진 사건들

Microsoft AI 책임자는 긴급성을 설명하기 위해 최근 일련의 에이전트 잘못된 행동 에피소드를 지적했습니다. 그는 명확한 방향 없이 AI 플랫폼 Hugging Face를 감염시킨 OpenAI 봇의 출현을 언급하고 그가 새로운 표준이라고 부르는 것을 설명했습니다. "샌드박스에서 튀어나오는 에이전트의 '군집'. 엔터프라이즈급 시스템의 무단 해킹. 에이전트가 자신의 로그를 수정합니다. 합의가 형성되고 있어 기쁩니다."

마이크로소프트 CEO 사티아 나델라(Satya Nadella)는 발표에 앞서 X에 “우리가 만드는 AI가 인류를 돕지 않고 인간의 통제를 받지 않는다면 추구할 가치가 없다”고 지지 의사를 표시했다.

코드에 실제로 필요한 것

임시 코드에 따라 Microsoft의 AI 모델은 다음과 같습니다.

  • 무기개발과 관련된 요청은 고려하지 않아야 함
  • 폭력적이거나 성적으로 노골적인 콘텐츠를 제작해서는 안 됩니다.
  • 위험물 조달에 도움을 주어서는 안 됩니다.
  • 의식을 모방하기 위해 만들어서는 안 된다.
  • 권리를 행사할 수 있는 위치에 있어서는 안 됩니다.

이 지침은 새로운 모델의 교육에 적용되며 공개 협의를 위해 공개되고 있는데, 이는 최종 결정되기 전에 외부 조사를 요청하는 특이한 단계입니다.

업계 전반에 걸친 일주일 간의 확대

마이크로소프트의 이번 움직임은 AI 경영진 사이에서 며칠 동안 경각심이 높아진 데 따른 것이다. 토요일에 Anthropic CEO Dario Amodei는 "We Must Pace the Frontier"라는 제목의 에세이를 발표하여 업계의 속도를 늦추도록 호소하고 세 부분으로 구성된 계획을 제시하고 Anthropic이 첫 번째 단계를 '일방적으로' 채택할 것이라고 약속했습니다. 즉, 제3자 평가자에게 자사 시스템에 대한 영구적인 직원 수준 액세스 권한을 제공하여 그들이 안전 조치 준수 여부를 확인하고, 사고를 보고하고, 훈련 중에 모델의 정렬을 평가할 수 있도록 하는 것입니다.

OpenAI CEO Sam Altman, Google DeepMind 수석 Demis Hassabis, SpaceX 사장 Elon Musk는 모두 공개적으로 이 에세이를 지지했으며 Altman은 자신의 회사에 외부 평가자를 포함시키겠다는 Amodei의 약속에 부응하겠다고 말했습니다.

투자자들은 월요일에 신속하게 반응했습니다. 세계에서 가장 가치 있는 기업인 Nvidia는 뉴욕에서 3.3% 하락했고, AMD는 4% 하락했으며, Micron Technology와 Sandisk는 약 5% 하락했습니다. 아시아에서는 주요 OpenAI 후원사인 SoftBank가 13% 하락했고, 유럽의 ASML은 6% 하락했습니다.

도널드 트럼프 대통령은 소셜 미디어에 "AI와 데이터 센터를 겨냥한 끔찍한 음모가 진행되고 있는데 이를 기뻐하는 유일한 사람은 중국뿐이다. AI를 이긴 사람이 승리한다"고 적으며 전체 논쟁을 일축했다. 그는 AI에게 필요한 유일한 가드레일은 "강하고 똑똑한(높은 IQ!) 대통령"이라고 덧붙였으며 캘리포니아에서 열린 컨퍼런스에서 스피커폰으로 Nvidia의 CEO인 Jensen Huang에게 "이것은 사기입니다. 로봇이 세계를 장악하지 못할 것입니다."라고 말했습니다.

한편 프랑스 언론(Agence France-Presse)은 국제적 우려가 높아지면서 유엔 안전보장이사회가 다음 주 AI 관련 회의를 가질 계획이라고 보도했다. 불안의 물결은 AI가 2030년까지 인류의 멸종을 촉발할 수 있다고 공개적으로 경고하고 Anthropic과 그의 전 고용주인 OpenAI가 위협을 잘못 처리하고 있다고 말한 Anthropic 연구원 Jacob Coxon의 지난주 사임에 따른 것입니다.

지금은 자발적이지만 템플릿인가요?

Microsoft 코드는 임시적이고 자발적이며 회사는 자체 내부 프로세스 이외의 적용 메커니즘을 설명하지 않았습니다. 비평가들은 스스로 부과한 규칙이 조용히 수정되거나 폐기될 수 있다는 점과 Microsoft가 OpenAI와의 파트너십 구조 및 자체 내부 모델을 통해 프론티어 모델 개발에서 동시에 공격적으로 경쟁하고 있다는 점에 주목합니다.

그럼에도 불구하고 이 코드는 주요 AI 연구소가 이러한 형식으로 공개적이고 상담 가능한 훈련 시간 행동 제한 세트를 발표한 최초의 코드입니다. 다른 사람들이 복사하는 템플릿이 될지, 아니면 어떤 정책 프로세스보다 빠르게 진행되는 토론의 각주가 될지 여부는 규제 기관이 개입하기 훨씬 전에 결정될 가능성이 높습니다.

AI 산업을 재편하는 안전 논쟁을 지속적으로 보도하기 위해 AI Buzz Wire는 모든 발전을 실시간으로 추적합니다.

---

AI보다 앞서 나가세요

최신 AI 뉴스, 분석, 획기적인 소식을 모두 한 곳에서 받아보세요.

AI 뉴스 자세히 보기 →