OpenAI가 가장 강력한 모델을 일반적으로 사용할 수 있게 만든 지 하루 만에 회사는 이 시스템이 약 반세기 동안 수학자들을 거부했던 그래프 이론의 유명한 공개 문제인 순환 이중 표지 추측(Cycle Double Cover Conjecture)에 대한 완전한 증거를 생성했다고 밝혔습니다.
OpenAI 연구원 Ethan Knight는 2026년 7월 10일 GPT-5.6 Sol Ultra가 "단 1시간 이내에 64개의 하위 에이전트를 사용하여 50년 된 Cycle Double Cover 추측의 증거를 생성했습니다"라고 게시하면서 결과를 발표했습니다. 이 주장은 빠르게 Hacker News의 상위권으로 올라갔고, 수학자 및 엔지니어로부터 증명이 유효한지에 대해 토론하는 수백 개의 논평을 받았습니다.
최신 AI 개발을 추적하는 사람에게 결과는 개척 모델이 어디로 향하고 있는지에 대한 놀라운 시연이며, 그들의 수학적 주장은 여전히 구식 방식으로 확인되어야 한다는 점을 상기시켜 줍니다.
사이클 이중 표지 추측이란 무엇입니까?
추측은 그래프 이론이라고 불리는 수학의 한 분야에 속합니다. 간단히 말해서, 이는 믿을 수 없을 정도로 간단한 질문을 던집니다. 모든 "브리지 없는" 그래프의 가장자리(제거하면 분할될 가장자리가 없는 그래프)는 모든 단일 가장자리가 정확히 두 번 나타나도록 항상 사이클 모음으로 덮일 수 있습니까?
이 문제는 1979년 Paul Seymour와 1973년 George Szekeres를 포함하여 수년에 걸쳐 여러 수학자에 의해 독립적으로 제기되었으며, 초기에는 W. T. Tutte와 Alon Itai 및 Michael Rodeh의 연구에 뿌리를 두고 있습니다. 간단한 설명에도 불구하고 해당 분야에서 가장 잘 알려진 미해결 문제 중 하나가 되었으며 부분적인 결과는 특수한 클래스의 그래프에 대해서만 알려졌습니다.
공개된 증거 노트 OpenAI에 따르면 이 주장은 문제를 루프 없는 입방 그래프로 축소한 다음 고전적인 결과인 F32 그룹에 대한 아무데도 없는 흐름 정리(Tutte의 8 흐름 정리와 동일) 및 에지 라벨링을 사이클 이중 커버에 필요한 구조로 변환하는 주요 선형 대수 단계에 의존합니다. 이 글은 단 몇 페이지에 불과하며, 한 Hacker News 논평자가 관찰한 것처럼 "지난 30년 동안 개발된 수학이 전혀 없습니다"라는 내용이 특히 사용되었습니다.
GPT-5.6 Sol Ultra가 어떻게 접근했나요?
이 결과가 일반적인 챗봇 답변과 다른 점은 모델이 배포된 방식입니다. GPT-5.6 Sol Ultra는 OpenAI의 "다중 에이전트 v2" 모드에서 실행되어 다양한 증명 전략을 동시에 탐색하는 최대 64개의 협력 하위 에이전트로 구성된 시스템을 가동했습니다. OpenAI는 증거와 함께 전체 프롬프트를 공개하여 시스템에 제공된 지침을 드물게 보여줍니다.
프롬프트에서는 모델에 "다양한 접근 방식 포트폴리오"를 유지하기 위해 "다양한 접근 방식 포트폴리오"를 유지하기 위해 "다중 에이전트 v2를 공격적이고 동적으로 사용"하고, 적대적 에이전트를 배포하여 순환으로 가장하는 폐쇄 트레일이나 우발적인 순환 추론과 같은 일반적인 함정에 대한 후보 증거를 감사하도록 지시했습니다. 심지어 최종 실행은 1시간 이내에 완료된 것으로 알려졌지만 시스템에 "복귀 또는 포기를 생각하기 전에 최소 8시간을 투자하라"고 지시했습니다.
증거 노트의 "AI 사용 설명" 섹션에서 OpenAI는 다음과 같이 명시합니다. "이 노트의 증거는 전적으로 GPT 5.6 Sol Ultra 및 Codex(GPT 5.6 Sol 포함)에 대한 작성에 따른 것입니다."
아직 모두가 확신하는 것은 아닙니다
수학계는 흥분과 주의가 혼합된 반응을 보이고 있으며 이러한 회의론은 타당합니다. 출판 당시, 증명은 Lean과 같은 증명 보조 프로그램에서 공식적으로 검증되지 않았으며 전통적인 동료 검토를 통과하지도 못했습니다.
Hacker News에서 몇몇 논평자들은 유명한 추측에 대한 짧고 우아한 증명은 특히 주의 깊게 조사할 가치가 있다고 지적했습니다. 한 사용자는 "지난 30년 동안 개발된 수학을 전혀 사용하지 않은 매우 짧은 증명"이라고 썼습니다. "반드시 잘못된 것은 아니지만 Lean의 기계화나 적절한 동료 검토가 없다면 이 글을 게시하는 것은 시기상조라고 생각합니다."
다른 사람들은 그래프 이론의 주요 형식 증명 라이브러리가 아직 이런 종류의 연구 수준 결과를 확인할 만큼 성숙하지 못했다고 지적했습니다. 즉, 논증을 한 줄씩 읽는 인간 전문가의 검증이 필요할 수도 있다는 의미입니다. OpenAI 자체는 이 발표를 보다 광범위한 패턴의 일부로 구성했습니다. "더 많은 테스트 시간 컴퓨팅으로 인해 더 큰 지능이 발생합니다."라고 회사는 말하면서 단일 결과가 아닌 다중 에이전트 접근 방식이 이것이 말하고 싶은 실제 이야기임을 나타냅니다.
중요한 이유
Cycle Double Cover 증명에 궁극적으로 수정이 필요하더라도 이 에피소드는 대규모 언어 모델이 순수 수학에서 수행할 수 있는 작업에 대한 의미 있는 변화를 나타냅니다. 프론티어 AI 시스템은 이전에 기하학 및 조합론의 문제 해결에 대한 최근 주장을 포함하여 전문 영역에서 새로운 연구 결과를 생성했지만, 조정된 추론 에이전트 떼를 사용하여 명명된 수십 년 된 추측을 공격하면 기준이 상당히 높아집니다.
연구자에게 있어 시사점은 두 가지입니다. 첫째, 다중 에이전트 레시피(많은 독립적인 시도, 아이디어의 교차 수분, 적대적 감사)는 어려운 문제 해결에 정말 유용한 템플릿인 것으로 보입니다. 둘째, 검증 병목 현상은 이제 전적으로 인간에게 있습니다. 모델은 커뮤니티가 확인할 수 있는 것보다 더 빠르게 후보 증명을 생성할 수 있습니다.
이러한 긴장은 AI 지원 수학의 다음 단계를 정의할 가능성이 높습니다. 한 논평가가 말했듯이, 이 증거가 유효하다면 "누군가가 차세대 모델에 던질 다른 오랜 문제의 목록을 곧 시작할 것"입니다.
현재 수학자들은 손에 연필을 쥐고 3페이지 분량의 메모를 주의 깊게 읽을 것이며 나머지 AI 업계에서는 GPT-5.6의 한 시간에 걸친 노력이 영구적인 수학 기록의 일부가 되는지 지켜볼 것입니다.
AI보다 앞서 나가세요
최첨단 모델 혁신과 AI 연구 보도에 대한 자세한 내용을 보려면 AI Buzz Wire 홈페이지를 방문하세요.
AI 뉴스 자세히 보기 →



