







오픈AI가 한국 시각 10월 7일 아침 7시 공개하지 않은 내부 모델이 쓴 수학·이론전산학 원고 722편을 깃허브 저장소에 올렸습니다.
모델에 약 4,000개 문제를 던져 나온 결과를 372개 묶음으로 정리했고, 결과 하나에 평균 ChatGPT Pro 사고 연산 3시간이 들었습니다.
상당수에 Lean(증명을 기계로 검증하는 언어) 형식 증명이 붙었지만 전부는 아니며, 오픈AI 대변인은 사이언티픽 아메리칸에 거의 모든 결과가 에이전트 하나에 프롬프트 하나로 나왔다고 말했습니다.
Choi
오픈AI가 9월 21일 꾸린 독립 수학 자문그룹은 결과마다 모델과 프롬프트, 연산 시간을 공개하라고 권고했지만 이번 공개에는 프롬프트가 없습니다. MIT의 앤드루 서덜랜드는 단일 에이전트가 한 번에 풀었다는 주장은 모델이 공개돼 재현되기 전까지 검증되지 않은 것이라고 말했습니다.
타오는 사람 수학자가 문제를 오래 붙잡는 느린 과정에서 영감을 얻고, 동료와 학생에게 통찰을 나누며 수학 생태계 전체에 기여한다고 설명했습니다.
AI는 정답으로 곧장 가는 지름길을 택해 그 과정의 발견을 놓친다고 꼬집었습니다.
새로운 미해결 과제와 연구 방향은 천천히 깊이 파고드는 과정에서 나온다고 말했습니다.
Choi
타오는 9월 11일 다른 필즈상 수상자 24명과 함께 「A Severe Misalignment of AI in Mathematics」 선언에 서명했고, AI 회사들이 수학 문제를 성능 지표로 쓰는 방식이 수학에 해롭다고 주장해 왔습니다.
오픈AI가 9월 21일 새 내부 모델이 나비에-스토크스에 이어 수학 여러 분야에서 장기 미해결 문제 100개 넘게 해결했다고 밝혔습니다.
약 1만 개의 에이전트가 함께 난제를 풀었고, 8월 28일 학습을 시작해 24일 만에 발표까지 이어졌습니다.
같은 날 티머시 가워스, 마르틴 하이러, 에드워드 위튼 등이 참여하는 독립 수학 자문그룹도 출범했습니다.
Choi
사전학습을 마친 모델에 대규모 강화학습을 더하는 동안 더 학습된 버전이 나오면 탐색 중인 에이전트를 새 버전으로 교체했습니다. 학습과 난제 탐색을 같은 24일 안에서 함께 돌린 방식이 발표 속도를 만들었습니다.
Becker, Greger, Peters가 Astra와 긴 대화를 주고받으며 증명을 완성했습니다.
반례를 찾는 대신, 애초에 그런 반례가 존재하지 않는다는 것을 증명했습니다.
Epoch AI는 이를 FrontierMath Open Problems에서 처음 나온 ‘Major Advance’ 사례로 분류했습니다.
또 사람과 AI가 함께 해결한 문제로 기록했지만, 아이디어 대부분은 Astra에서 나왔다고 설명했습니다.
Peters 역시 Astra가 없었다면 해당 증명을 찾기 어려웠을 것이라고 밝혔습니다.
Choi
아이디어 대부분이 모델에서 나왔다는 평가가 기록으로 남으면서 공동 저자 표기 관행이 흔들립니다.
AI가 난제를 푸는 것 자체보다, 문제 풀이를 벤치마크처럼 소비하며 결과를 빠르게 발표하는 과정에서 기존 연구 인용과 아이디어 출처가 흐려지고, 수학의 목적이 ‘정답’으로 축소될 수 있다고 지적했습니다.
AI가 수학을 발전시킬 수는 있지만, 무엇을 위해 수학을 하는지까지 바뀌어선 안 된다는 주장입니다.
Choi
AI 기업이 난제 풀이를 벤치마크처럼 빠르게 발표하면서 기존 연구 인용과 아이디어 출처가 빠진다는 비판입니다. 풀이가 맞는지와 별개로, 학계가 공로를 나누는 방식과 부딪치는 문제입니다.
클로드 Fable 5가 87년 된 야코비안 추측의 반례를 216자 식 하나로 찾았고, 오픈AI Astra는 비소픽 군 존재 증명을 포함해 수학 난제 10건을 한꺼번에 풀었습니다.
GPT-5.2 Pro는 에르되시 미해결 문제를 푼 첫 명확한 사례로 기록됐고, GPT-5.6 Sol Ultra는 50년 된 사이클 이중 덮개 추측을 증명했으며, Grok 4.5는 5년간 미해결이던 초수축성 경계 문제를 반증했습니다.
의학에서는 20년간 병명을 찾지 못한 환자의 유전적 원인이 NEJM AI에 보고됐고, 오픈AI는 실험실에서 효소 반응 효율을 79배 높이며 새 효소 메커니즘을 찾았습니다.
아이소모픽 랩스는 알파폴드 3를 2배 이상 넘는 신약 설계 엔진 IsoDDE를 공개했고, 오픈AI는 AtCoder 알고리즘 부문 5문제를 모두 풀었으며 내부 모델은 80년 된 에르되시 단위 거리 추측을 반증했습니다.
Choi
한 해 성과가 목록으로 쌓이면 개별 사례를 예외로 넘기기 어려워집니다. 검증이 쉬운 분야부터 먼저 뚫린 순서도 보입니다.
매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.