오픈AI, 내부 모델이 증명한 수학 정리 10여 개 공개… 린 검증 코드 포함
핵심: 무슨 일이 일어났나
오픈AI가 내부 프론티어 모델이 증명한 수학 결과물을 깃허브 저장소에 올렸다. 평균적으로 챗GPT 프로 3시간 분량의 연산을 써서 얻은 증명들이다. 모델 가중치나 추론 코드는 공개하지 않았다. 대신 증명 과정을 사람이 읽을 수 있는 논문 초안과, 컴퓨터가 검증 가능한 린(Lean) 공식화 코드를 함께 내놨다.
자문 기구는 프린스턴 고등연구소(IAS)의 '수학과 인공지능 자문 그룹'이다. 오픈AI는 이들의 권고를 참고해 논문 수정·인용 프로토콜을 마련했다고 밝혔다. 향후 워크숍과 컨퍼런스 지원도 예고했다.
쉽게 풀어보면
오픈AI가 '수학 문제를 풀고 증명한 과정'을 통째로 공개했습니다. 뷔페에 비유하면 이렇습니다. 요리사(AI)가 새로운 요리(수학 정리)를 만들어냈습니다. 레시피(증명 과정)를 종이에 적어 내놓았고, 식품검사기관(린 컴파일러)이 "이 레시피대로 만들면 독성 물질이 안 나온다"는 도장을 찍어줬습니다.
중요한 건 요리사 본인(모델 가중치)은 주방 밖으로 나오지 않았다는 점입니다. 누구나 레시피를 보고 검증할 수는 있지만, 요리사를 자기 주방에 데려다 쓸 수는 없습니다. 오픈AI는 "책임 있는 공개를 위해 모델 자체는 나중에 내놓겠다"고만 했습니다.
이번 공개분 중에는 모델이 생각한 과정을 요약한 10개 메모도 들어 있습니다. "이 단계에서 막혔으나 우회했다" 같은 내부 독백이 일부 드러난 셈입니다. 연구자들은 이 메모를 보며 AI가 수학적 직관을 어떻게 모방하는지 들여다볼 수 있게 됐습니다.
커뮤니티 반응: 수학자들의 불안과 냉소
해커뉴스 댓글 408개 중 다수는 기술적 검증보다 **'인간 수학자의 의미'**를 묻습니다.
- "AI가 만든 린 증명도 읽기 힘든데, 오퍼스 5가 비공식 증명을 내면 어쩌나" — 검증 도구 자체의 가독성 문제 제기
- "이게 밝은 인재들을 좌절시키지 않길 바란다" — 동기 상실 우려
- "인간이 우주에서 지배적 세력으로 남을 수 있을지 신경 쓰인다" — 실존적 불안
- "오픈AI가 수학자들 노동으로 학습시킨 모델로 성과 내고 자기 공로로 돌린다" — 데이터 착취 비판
반론도 있습니다. "계산기 나왔을 때도 수학자 안 사라졌다"는 의견이 꾸준히 나옵니다. 하지만 계산기는 연산을 대체했고, 이번 모델은 증명 전략 수립까지 넘본다는 차이가 있습니다. 이 구분이 댓글 창에서 반복돼 등장합니다.
빠져 있는 조건들: "내부 모델"이란 무엇인가
발표문에는 모델 이름, 파라미터 수, 학습 데이터 구성, 벤치마크 점수가 전혀 없습니다. "내부 프론티어 모델" 한 줄로만 지칭됩니다. 이 모델이 GPT-5 계열인지, 별도 수학 특화 모델인지는 알 수 없습니다.
또 **'평균 3시간 프로 연산'**이라는 수치도 조건부가 붙습니다. 프로 요금제 기준이라는 뜻입니다. 무료·플러스 사용자가 같은 조건을 재현하려면 비용·시간이 다를 것으로 보입니다. 발표문은 "프로 사용량으로 환산"이라고만 적었습니다.
린 공식화 역시 **전체 증명이 아닌 '많은 증명'**만 공유됐습니다. 저장소 업데이트는 "얻는 대로" 하겠다고 했습니다. 검증 완료 비율이 몇 %인지는 공개되지 않았습니다.
과거와 연결: 생각의 주체성 논쟁의 연장선
본지가 29일 전 다룬 AI에게 글쓰기를 맡기면 내 생각이 사라질까 기사에서 한 개발자는 "AI로 글 쓰지 않겠다"고 선언했습니다. 수학계에서도 같은 긴장감이 감지됩니다. 증명을 기계에 맡기면 내 수학적 직관도 사라지는가 — 해커뉴스 댓글들이 던지는 질문의 핵심입니다.
4일 전 레고 설계도 AI 'ldraw-nova'는 오픈소스로 모델까지 풀었습니다. 오픈AI는 반대입니다. 검증 도구(린)는 열었지만 생성 엔진(모델)은 닫았습니다. 이 비대칭성이 '책임 있는 공개'인지 '독점 유지'인지는 앞으로의 모델 공개 여부가 가를 것입니다.
나에게 미치는 영향
대학생·대학원생이라면: 린(Lean) 공부를 고려해 볼 만합니다. 수학·컴퓨터과학 전공자가 아니어도 린 공식 문서로 입문할 수 있습니다. AI가 만든 증명을 읽고 수정하려면 린 문법이 필수가 되고 있는 것으로 보입니다.
직장인·일반 사용자라면: 챗GPT 프로 구독자는 '고급 추론' 모드에서 이 모델의 일부 능력을 이미 쓰고 있을 수 있습니다. 오픈AI는 "프로 사용량 3시간 분량"이라고 명시했습니다. 무료·플러스 사용자의 재현 조건은 아직 공개되지 않았습니다.
오늘 바로 확인해 볼 것: 깃허브 저장소에서 'reasoning_summaries' 폴더를 열어보세요. AI가 "이 가설이 안 통하니 다른 각도에서 시도"라며 스스로 방향을 틀어가는 장면이 나옵니다. 수학을 몰라도 '기계가 어떻게 막힘을 돌파하는가'는 볼 수 있습니다.
남은 쟁점: 검증 가능한 개방성인가
오픈AI는 **'과학적 투명성'**을 내세웠습니다. 논문 초안, 린 코드, 추론 요약, 연산량 통계까지 공개했습니다. 이는 폐쇄형 모델 발표로는 이례적입니다.
그러나 모델 자체는 비공개입니다. 제3자가 "같은 조건에서 같은 문제가 풀리는가"를 재현하려면 오픈AI API를 써야 합니다. 자문 그룹 권고대로 '커뮤니티 호스팅 대안'을 찾는 중이라고 했지만, 일정은 없습니다.
수학계가 바라는 건 **'증명 검증'**만이 아닙니다. **'증명 생성 과정을 내 손으로 돌려보기'**입니다. 그 간극이 좁혀지지 않으면 이번 공개는 '쇼케이스'로 남을 가능성이 큽니다. 오픈AI가 약속한 워크숍과 모델 공개 일정이 첫 시험대가 될 것입니다.
이 기사의 출처
- Hacker NewsSharing AI progress in mathematics
- OpenAI BlogSharing AI progress in mathematics
- r/singularitySharing AI progress in mathematics
이 글은 위 원문과 커뮤니티 반응을 바탕으로 AI의 도움을 받아 작성했으며, 발행 전 사람이 확인합니다. 사실관계는 원문 링크에서 직접 확인하실 수 있습니다.