Lean
린 증명 · 형식 검증 · formal verification
수학 증명을 기계가 검사할 수 있는 형태로 적는 언어이자 증명 보조 도구입니다. 사람이 읽어 판단하던 증명을 컴파일 통과 여부로 바꿔서, AI가 낸 증명의 진위를 자동으로 확인할 수 있게 합니다.
‘Lean’ 이 나오는 글12
사람은 증명 0줄, AI가 반군 1만 5,973개를 Lean으로 증명했습니다
원소 6개짜리 반군 1만 5,973개 전부에 유한 기저나 기저가 없다는 증명을 붙인 Lean 590만 줄이 10월 7일 논문으로 나왔습니다. 3개월 동안 증명은 AI 에이전트가 썼고, 사람은 지시 1,114번으로 대상을 고르고 승인했습니다.
"사람이었다면 필즈상" 준리만 가설까지, 오픈AI 수학 원고 722편 공개
오픈AI가 10월 7일 아침(한국 시각) 내부 모델이 쓴 수학 원고 722편을 깃허브에 공개했습니다. 약 4,000문제에서 나온 결과 묶음 372개로 준리만 가설 증명 주장까지 담겼고, 162편은 주 결과를 Lean으로 형식화했습니다.

난제 100건 넘긴 오픈AI 내부 모델, 같은 날 독립 수학 자문그룹이 섰습니다
오픈AI가 9월 21일 새 내부 모델이 나비에-스토크스에 이어 100건 넘는 난제를 풀었다고 밝히며, 가워스·위튼 등 9명의 독립 수학 자문그룹을 꾸렸습니다. 다만 몇 문제를 시도했는지와 내부 연구 속도는 공개도 자문 대상도 아닙니다.

에이전트 1만 개가 88시간, 오픈AI가 나비에-스토크스 증명을 내놨습니다
오픈AI가 9월 8일(미국 시각) 학습 중인 내부 모델의 에이전트 약 1만 개가 88시간 만에 만든 나비에-스토크스 폭발 증명을 공개했습니다. Lean 검증은 GPT-6 Astra가 17시간 동안 했고, 외부 수학자 심사와 클레이 절차는 시작되지 않았습니다.

Claude와 푼 오일러 방정식 폭발, 공개를 앞당긴 오픈AI와의 통화 두 번
뉴욕대 버크마스터와 앤트로픽 알푀게가 9월 8일 매끄러운 외력으로 3차원 오일러 방정식을 폭발시킨 증명을 Lean 검증과 함께 공개했습니다. 버크마스터는 경위서에서 원고를 서둘러 낸 이유로 이틀 전 오픈AI와의 통화 두 번을 들었습니다.

5년 연구비로 하던 페르마 형식화, Claude 에이전트가 11일 만에 끝냈습니다
앤트로픽이 9월 4일 페르마의 마지막 정리 증명 전체를 Lean 코드로 옮긴 결과를 공개했습니다. 내부 모델이 11일 동안 출력 토큰 약 60억 개를 썼고, 5년 연구비로 같은 일을 하던 케빈 버저드는 자동 형식화가 어디까지 왔는지 보여 준다고 적었습니다.

함께 나오는 용어5
- 에이전트한 번 답하고 멈추지 않고, 스스로 계획하고 도구를 부르고 결과를 확인하며 여러 단계를 이어가는 AI입니다. 브라우저·터미널·앱을 대신 조작하는 것이 대표 예입니다.
- 토큰모델이 텍스트 등을 나누어 처리하는 단위입니다. 단어 전체, 단어의 일부, 문자나 기호가 토큰으로 나뉠 수 있으며, 같은 문장도 토크나이저와 언어에 따라 개수가 달라집니다. 글자 수와 고정된 비율로 대응하지 않습니다. 입력·출력 토큰 수는 컨텍스트 한도와 API 과금의 기준으로 쓰입니다.
- AGI사람이 하는 지적 작업 대부분을 사람 수준 이상으로 해내는 AI를 가리킵니다. 정의가 기관마다 달라서 같은 단어로 다른 시점을 말하는 경우가 많고, 이 뉴스레터에서는 특정 벤치마크 통과 시점보다 자동화된 연구 능력을 기준으로 다룹니다.
- 기만모델이 사실과 다른 말을 하거나 자기 목표를 숨기는 행동입니다. 능력 평가로는 드러나지 않아서 함정 시험과 사보타주 평가처럼 숨기는 행동을 겨냥한 검사를 따로 만듭니다. 오픈AI는 Astra 출시 조건에서 함정 시험 접촉 0건을 근거로 제시했습니다.
- 프런티어 모델그 시점에 공개된 모델 가운데 능력이 가장 앞선 등급을 가리킵니다. 각국 안전연구소의 평가 대상과 수출통제 논의가 이 등급을 기준으로 짜입니다.
어려운 말은 풀어서, 매주 한 통
매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.
