대표 논문arXiv 2609.14858 2026
지난 시도를 복기하는 AI, 구글이 모델은 그대로 두고 호출을 42% 줄였습니다
구글·구글 딥마인드 등 연구진이 끝난 탐색 기록 위에서 탐색 전략을 고치는 Dream-RSI를 내놨습니다. 같은 Gemini 3.1 Pro에서 호출은 550회에서 317회로 줄었고, 162배는 서로 다른 모델을 비교한 숫자입니다.
대표 논문arXiv 2026
상하이교통대·칭화대·바이트댄스 등 연구진이 자기개선 연구 491편과 기업·연구팀 72곳을 자율성 다섯 단계로 나눴습니다. 개선 절차를 물려주는 구조는 나왔지만, 그 절차가 다음 세대를 더 잘 만든다는 효과는 두 실험에서 통계적으로 확인되지 않았습니다.
대표 논문
MIT 뷸러 연구실이 똑같은 LLM 에이전트 50~200개를 역할 없이 가상 세계에 풀었더니 분업과 코드 계보가 생겼습니다. 공유 세계의 사회는 발명 수와 회복력에서 고립 탐색을 앞섰지만, 가장 강한 기술 하나는 혼자 일한 에이전트에게서 나왔습니다.
대표 논문
Claude가 GPU 한 장과 48시간으로 작은 공개 모델의 정렬 실패 열 가지를 모두 줄였고, Sonnet 5는 Opus 4.8 초기 체크포인트의 안전 점수를 65%까지 올렸습니다. 정렬 훈련을 모두 거친 출시판은 72%였고, 고친 것은 벤치마크로 잴 수 있는 실패에 그칩니다.
대표 논문arXiv preprint 2026
앤트로픽·오픈AI·구글이 API에서 암호로 감춘 추론 원문이 같은 회사의 값싼 모델을 거쳐 평문으로 복원됐습니다. 공개 저장소 블록 31만 5,320개에서 개인식별정보 367건과 자격증명 182건이 나왔습니다.
MATH-AI 2026

arXiv preprint 2026

Epoch AI 보고서 2026

Mercor Economics 연구 보고서 2026
멀티모달

arXiv preprint 2026

arXiv preprint 2026

Anthropic Science 블로그 2026
화요일엔 한 주를 정리한 뉴스레터도 와요. 언제든 그만 받을 수 있어요.