
이미지: METAL
요약
- 오픈AI가 10월 6일 미공개 내부 모델이 만든 수학 논문 722편을 372개 결과군으로 묶어 깃허브 저장소 openai/math에 공개했다.
- 모델은 약 4000개 문제를 받았고 결과당 평균 챗GPT 프로 사고 연산 약 3시간이 들었으며, 상당수에 린 형식화가 붙었지만 형식화되지 않은 결과는 문제가 있을 수 있다고 회사가 밝혔다.
- 프린스턴 고등연구소 자문그룹 권고를 참고했다지만 모델 이름과 결과별 프롬프트는 공개하지 않았고, 회사는 워크숍·학회 지원과 모델 공개를 예고했다.
- 발표
- 2026년 10월 6일 · 오픈AI · Sharing AI progress in mathematics
- 저장소
- github.com/openai/math · 논문 722편 · 결과군 372개 · 분야별 분류
- 개요 PDF
- 41쪽 · 17개 분야(정수론·대수기하·이론 컴퓨터과학·조합론·작용소 대수·편미분방정식 등)
- 생성 모델
- 미공개 내부 프런티어 모델 · 이름 비공개
- 문제 수
- 평가 기간 약 4000개 문제 제시
- 계산량
- 결과당 평균 챗GPT 프로 사고 연산 약 3시간 상당
- 검증
- 다수에 린 형식화 · 전부는 아님 · 형식화 없는 결과는 문제 가능성
- 추론 요약
- 10개 결과 · 파이 무리성 지수 · 말러 추측 · 메자르-파리시 공식 · 자유군 인자 동형 등
- 예외 절차
- 리만 제타 영점 없는 영역 · CM 아벨 다양체 호지 추측 · 11/12 원고는 사람이 가독성 편집
- 주요 주장
- 준 리만 가설(실수부 7/8) · 유리수 위 힐베르트 제10문제 · 카탈랑 상수 무리수성 · CM 아벨 다양체 유리 호지 추측 · 자유군 인자 동형 · 순환 아다마르 추측
- 자문
- 프린스턴 고등연구소 수학·인공지능 자문그룹 · 권고안 9월 29일 · 응답 600건 이상
- 권고 대비 누락
- 모델 이름 · 결과별 프롬프트 · 결과별 비용(평균만)
- 후속 계획
- 워크숍·학회·특별 프로그램 자금 지원 · 모델의 책임 있는 공개 추진 · 규모·일정 미공개
- 배경
- 9월 8일 나비에-스토크스 특이점 증명 발표 · 버크마스터 우선권 분쟁
오픈AI가 10월 6일 아직 공개하지 않은 내부 프런티어 모델이 만든 수학 논문 722편을 깃허브 저장소 openai/math에 한꺼번에 올렸다. 논문은 관련 결과끼리 묶은 372개 결과군(family)으로 정리됐고, 상당수에는 컴퓨터가 증명을 검사할 수 있는 린(Lean) 형식화가 붙었다. 회사는 모델이 이번 평가 기간에 약 4000개 문제를 받았고, 결과 하나에 평균 챗GPT 프로의 사고 연산 약 3시간에 해당하는 계산이 들었다고 밝혔다. 형식화가 없는 결과에는 문제가 있을 수 있다는 단서도 저장소에 함께 적었다.
메탈이 확인한 저장소의 41쪽짜리 개요 PDF에는 정수론과 대수기하, 이론 컴퓨터과학, 조합론, 작용소 대수, 편미분방정식 등 17개 분야로 나눈 목록이 실려 있다. 목록이 내건 주장은 하나하나가 수학계의 오래된 질문이다. 디리클레 L-함수가 실수부 7/8보다 큰 영역에서 0을 갖지 않는다는 이른바 준 리만 가설, 유리수 위 힐베르트 제10문제의 부정적 해결, 카탈랑 상수의 무리수성, CM 아벨 다양체에 대한 유리 호지 추측, 모든 비가환 자유군 인자가 서로 동형이라는 결과, 순환 아다마르 추측이 목록에 들어 있다. 오픈AI는 번호가 순위를 뜻하지 않는다고 적었다.
만든 방식도 공개했다. README에 따르면 결과 대부분은 같은 절차로 내부 모델 하나에서 나왔다. 기존 수학 평가에서 성능이 포화하자 회사가 미해결 연구 문제로 평가를 넓힌 결과이고, 일부는 모델이 앞서 낸 결과 위에 쌓였다. 예외는 리만 제타 함수의 영점 없는 영역 연구와 CM 아벨 다양체의 호지 추측 증명 두 건이며, 실수부 11/12 영역에 대한 원고는 읽기 쉽게 사람이 손봤다. 저장소에는 파이의 무리성 지수와 말러 추측, 스핀 글라스의 메자르-파리시 공식 등 10개 결과에 대한 모델 추론 요약도 실렸다.
발표 방식은 외부 권고를 의식했다. 오픈AI는 프린스턴 고등연구소에 꾸려진 독립 기구 수학·인공지능 자문그룹과 상의해 공개 원칙을 정했다고 밝혔다. 메탈은 오픈AI가 이 자문그룹 출범을 발표했다고 보도한 바 있다. 보도에 따르면 자문그룹은 9월 29일 수학계 응답 600건 이상을 바탕으로 권고안을 냈고, 결과마다 모델 이름과 프롬프트, 추론 요약, 걸린 시간, 계산 비용을 공개하고 AI 연구소가 통제하지 않는 학술 저장소에 맡기라고 요구했다. 권고안은 공개되지 않은 모델로 고난도 수학 문제를 시험하는 관행에 대해 "우리는 이 관행을 지지하지 않으며, 이를 멈출 것을 요청한다"고 적었다.

이번 공개는 그 요구 가운데 일부만 따랐다. 추론 요약과 시도한 문제 수, 계산량 추정, 이전 판을 남기는 개정 정책은 내놨다. 모델 이름과 결과별 프롬프트는 빠졌고, 비용은 결과별이 아닌 평균으로만 밝혔다. 저장소도 오픈AI가 관리하는 깃허브이며, 회사는 자문그룹 기준에 맞는 커뮤니티 운영 저장소를 계속 찾겠다고 설명했다. 보도에 따르면 오픈AI는 자문그룹이 결과를 어떻게 알릴지는 조언할 수 있어도 결과를 낼지, 얼마나 빨리 낼지에는 관여하지 못하도록 선을 그었다.
이 모델은 한 달 전 논란의 한가운데 있었다. 오픈AI는 9월 8일 같은 내부 시스템이 나비에-스토크스 방정식의 유한 시간 특이점을 증명했다고 발표했고, 보도에 따르면 당시 이 모델이 GPT-6 Astra보다 상당히 뛰어나다고 밝혔다. 메탈은 이 발표를 두고 우선권 싸움이 붙었다고 보도한 바 있다. 뉴욕대 수학자 트리스탄 버크마스터가 자신의 연구 방향을 오픈AI가 뒤따랐다고 주장하자, 오픈AI 소속 수학자 세바스티앙 뷔벡은 기자회견에서 "우리는 그들의 프롬프트나 증명으로 모델에 지시하거나 에이전트를 움직이지 않았다"고 반박했다.
수학계의 경계심은 그때부터 커졌다. 필즈상 수상자인 수학자 테렌스 타오는 당시 마스토돈에 "누군가 어떤 문제를 연구한다는 소문만으로도 원래 연구가 잠재력을 다 펴기 전에 AI를 동원한 대규모 작업이 그 문제를 밀어 버릴 수 있다는 것을 이제 보게 됐다"고 썼다. 메탈은 필즈상 수상자 25명이 AI 회사와 수학의 목표가 어긋났다는 공개서한을 냈다고 보도한 바 있다. 보도에 따르면 자문그룹에 참여한 필즈상 수상자 티머시 가워스는 10~20년 안에 수학 문헌은 크게 불어나는데 그것을 이해하는 인간 공동체는 남지 않을 수 있다고 경고했다.
오픈AI는 다음 단계로 돈과 모델을 내걸었다. AI가 낸 주요 결과를 이해하기 위한 워크숍과 학회, 특별 프로그램에 자금을 대겠다고 밝혔고, 이 결과를 만든 모델을 책임 있게 공개하는 작업도 하고 있다고 했다. 회사는 "최첨단 역량으로 과학자들에게 직접 힘을 실어 주고 싶다"고 설명했다. 다만 지원 규모와 일정, 모델 공개 시점은 내놓지 않았다.
이번 발표의 무게는 논문 수보다 검증의 순서에 있다. 린 형식화는 증명이 논리적으로 맞는지는 기계로 확인해 주지만, 그 결과가 얼마나 새롭고 중요한지는 말해 주지 않는다. 722편 가운데 무엇이 진짜 돌파이고 무엇이 손질이 필요한지 가려내는 일은 이제 학계의 몫으로 넘어갔다. 결과를 쏟아낸 쪽과 그것을 읽어야 하는 쪽의 속도 차이가 앞으로 수학의 의제가 된다.
출처
- OpenAI — Sharing AI progress in mathematics →
- OpenAI (GitHub) — openai/math →
- Unite.AI — OpenAI Releases 722 Math Manuscripts From an Unreleased AI Model →
- RuntimeWire — OpenAI publishes 722 math manuscripts generated by an unreleased model →
- Futurism — OpenAI's Supposed Mathematical Breakthrough Devolves Into Explosive Drama →
- The Decoder — OpenAI dumps 372 AI-generated math proofs on GitHub →
- Value Add Pulse — OpenAI math dispute: Altman, Tao respond to claims →





댓글