OpenAI는 아직 공개되지 않은 내부 프론티어 모델로 제작된 722개의 수학 원고를 출판했으며 전체 컬렉션을 Apache-2.0 라이선스에 따라 공개 GitHub 저장소에 배치했습니다. 2026년 10월 6일 "수학에서 AI 진행 상황 공유"라는 제목의 연구 게시물에서 발표된 이 릴리스는 현재까지 AI에서 생성된 수학적 결과의 단일 덤프 중 가장 큰 것 중 하나이며 공식적인 Lean 증명 검사, 요약된 추론 요약 및 각 결과가 소비한 컴퓨팅 양에 대한 특이한 세부 정보와 함께 제공됩니다.

이동은 이미 가장자리에 있는 필드에 도달합니다. New York Times는 이 릴리스가 심각한 연구 결과를 생성하는 AI 시스템과 씨름하는 데 몇 달을 소비한 수학 커뮤니티를 더욱 혼란스럽게 만들었다고 보도했으며, Scientific American은 OpenAI가 "이미 충격에 빠진 분야에 수백 가지의 더 많은 수학 결과를 내놓는 것"이라고 설명했습니다. 최신 AI 연구 개발을 추적하는 독자들에게 이번 릴리스는 신용 분쟁을 촉발하지 않고 첨단 연구소가 기계 생성 과학을 공유하는 방법에 대한 테스트 사례입니다.

저장소 내부에는 무엇이 있습니까?

컬렉션은 GitHub의 openai/math 저장소에 있습니다. README에 따르면 해당 내용은 공개 연구 문제에 대한 모델 개발 평가의 일부로 수집된 내부 OpenAI 모델에 의해 생성된 수학적 원고 및 지원 증명 아티팩트입니다. 현재 카탈로그에는 372개의 계열로 구성된 722개의 원고가 포함되어 있으며, 여기서 계열은 주요 결과, 동반 논증, 결과 또는 대체 증명을 포함할 수 있는 관련 논문을 그룹으로 묶고 각각 수학적 분야로 분류됩니다.

사전 인쇄 디렉토리에는 PDF, 소스 파일, 원고별 인용 및 작성 지침이 들어 있습니다. Lean 라이브러리는 관련 논문 및 검증 구성과 함께 공식 교정을 카탈로그화합니다. 모든 원고가 형식화되어 있는 것은 아닙니다. 많은 결과에는 컴퓨터가 교정 내용을 한 줄씩 확인할 수 있도록 하는 프로그래밍 언어인 Lean으로 형식화가 수반되지만 README에서는 일부 비정형화 결과에 문제가 있을 수 있음을 경고합니다. OpenAI는 이러한 문제를 신속하게 해결할 것이며 컬렉션의 공개 릴리스 기록을 보존하고 이전 버전에 대한 액세스를 유지하면서 수정 및 수정 사항을 새 버전으로 기록하기 위해 최선을 다하고 있다고 밝혔습니다. 각 원고 디렉토리에는 인용을 위한 BibTeX 블록도 포함되어 있습니다.

결과가 어떻게 산출되었는가

대부분의 결과는 아직 출시되지 않은 내부 OpenAI 모델을 사용하는 단일 고정 절차에서 나왔습니다. 평가 과정에서 모델에는 약 4,000개의 문제가 제기되었습니다. OpenAI는 게시된 평균 결과가 약 3시간의 ChatGPT Pro 사고 컴퓨팅에 해당하는 시간을 소비했다고 보고합니다. 이는 업계에서 여전히 드문 수준의 투명성입니다. 회사는 기존 수학적 벤치마크의 성능이 포화된 후 이러한 평가를 확대했으며 일부 출력은 자체 모델에서 생성된 이전 결과를 기반으로 한다고 밝혔습니다. 적절한 수준의 중요성을 요구하고 원본 출력물을 계열 및 원고로 집계하여 출판된 카탈로그를 제작했습니다.

해당 절차에서 벗어난 두 가지 명명된 예외: 리만 제타 함수에 대해 0이 없는 영역을 설정하는 작업, 가독성을 위해 사람이 편집한 Re(s) > 11/12 영역을 다루는 글, CM 아벨 변형에 대한 Hodge 추측의 증명. 둘 다 진지한 주류 수학이며 이제 둘 다 커뮤니티 조사에 직면하게 될 것입니다.

모델 추론에 대한 10개의 요약 요약도 게시됩니다. 여기에는 pi의 비합리성 지수, 대칭 및 일반 말러 추측, 자유군 인자의 동형성, 산술 수열에 대한 준다항식 경계, 특성 2의 Kaplansky의 직접 유한성 추측, 희석 스핀 유리에 대한 Mezard-Parisi 공식, 양자 Heisenberg 강자성체의 자발적 자화 및 3차원 상대론적 Vlasov-Maxwell 시스템을 포함한 결과가 포함됩니다.

릴리스 구성에 도움을 준 자문 그룹

OpenAI는 결과 공유를 위한 모범 사례를 개발하는 동시에 고등연구소의 독립적인 수학 및 인공 지능 자문 그룹과 협의했다고 밝혔습니다. 해당 그룹은 수학 커뮤니티로부터 600개 이상의 답변을 받은 후 2026년 9월 29일 책임 릴리스 권장 사항을 발표했습니다. 권장 사항은 무뚝뚝합니다. "우리는 이 관행을 지지하지 않으며 독점 ​​모델에 대한 고급 수학적 문제 테스트를 중단하도록 요청합니다." 이 그룹은 연구실에 AI 연구소가 통제하지 않는 학술 저장소에 결과를 보관하고, 지속적으로 인용 가능한 식별자를 할당하고, 모델 이름, 사용된 프롬프트 및 요약된 추론 체인을 공개하고, 결과 릴리스를 마케팅 수단으로 취급하지 말 것을 촉구합니다.

OpenAI의 릴리스는 분명히 해당 프레임워크를 무시하기보다는 이를 준수하려는 시도입니다. 커뮤니티가 이를 받아들이는지 여부는 또 다른 문제입니다. 자문 그룹의 설문 조사에서는 실험실이 세부 정보를 제공하지 않고 많은 결과의 존재를 발표하는 시나리오에 대해 구체적으로 물었고, 나타난 권장 사항에는 검증을 앞지르는 발표에 대한 깊은 우려가 반영되었습니다.

검증 부담이 수학자에게 전가됨

이제 실질적인 도전은 현직 수학자들의 몫입니다. 형식적인 린 교정은 기계적으로 검사할 수 있으며, 교정이 있으면 오류 위험이 크게 줄어듭니다. 그러나 README 자체에서 잠재적인 결함이 있는 것으로 표시되는 공식화되지 않은 원고에는 전통적인 동료 검토가 필요하며 722개의 원고는 커뮤니티가 빠르게 흡수할 수 있는 것보다 훨씬 많습니다. 우선순위와 신용에 대한 문제도 있습니다. 이러한 문제에 인접해 수년을 보낸 수학자들은 모델이 무엇을 요청했는지, 무엇을 제공했는지, 인간의 결과가 통합되었는지 여부를 정확히 알고 싶어할 것입니다. OpenAI의 프롬프트 요약 및 계산 통계 게시는 이러한 질문 중 일부에 미리 답변하도록 설계되었습니다.

또한 이 릴리스에서는 경쟁업체가 따라야 할 템플릿도 설정합니다. Anthropic, Google DeepMind 및 연구 수준 수학이 가능한 최첨단 모델을 갖춘 기타 연구소는 이제 독점 모델에 숨겨진 결과가 완전한 출처와 함께 공개되거나 전혀 놀리지 않아야 한다는 자문 그룹이 명시한 사실상의 표준에 직면해 있습니다.

현재 저장소는 활성화되어 있고 공식화 작업이 진행 중이며 수정 사항이 공개적으로 버전화되고 있습니다. 이것이 AI 생성 수학의 표준 플레이북이 될지, 실험실과 그들이 끌어들이는 연구 커뮤니티 사이의 갈등이 심화되는 또 다른 인화점이 될지는 앞으로 몇 주간의 조사가 어떻게 진행되는지에 달려 있습니다.

AI 곡선에서 앞서 나가세요

AI 기반 과학은 보도 자료에서 동료 검토로 이동하고 있습니다. aibuzzwire.news에서 AI 속보를 팔로우하여 모든 주요 연구 릴리스, 모델 출시 및 정책 변화에 대한 정보를 얻으세요.

AI 뉴스 자세히 보기 →