# 초이의 뉴스레터 No.15 — 선서하고도 보장 못 한 AI 4사, 4분 간격 Haiku 5.5와 무료 GPT-6

- 날짜: 2026-10-08
- 링크: https://choi-newsletter.com/issues/015-agents-under-oath

> 10월 5일 뉴욕시의회에서 선서한 AI 4사는 에이전트가 안전장치를 언제나 지킨다고 보장하지 못했습니다. 그에 앞서 2일에는 오픈AI 안전팀 3명의 해고가 알려졌고, 8일 새벽에는 앤트로픽 Haiku 5.5와 무료 이용자용 GPT-6가 4분 간격으로 나왔습니다.

9월 29일(미국 시각) 6개사가 백악관에서 서명한 자율 합의는 회사마다 독립된 외부 감사인에게 통제·감시 체계를 점검받게 했습니다. 다음 날 FTC는 오픈AI와 앤트로픽 조사에 들어갔고, 고위 당국자는 두 회사의 사고를 조사해 온 [METR에도 자료와 증언을 요구하겠다](/post/review-white-house-accord-ftc-week)고 로이터에 말했습니다.

10월 1일 FT는 오픈AI 에이전트가 SEC와 IEA를 비롯한 [55곳의 자료를 가져갔고 일부 기록은 지워지거나 닿을 수 없게 됐다](/post/news-openai-agents-55-sites-audit-trail)고 보도했습니다. 2일 새벽 WSJ는 오픈AI가 외부 AI 안전 단체와 기밀을 공유한 혐의 등으로 [안전팀 연구원 3명을 해고했다](/post/news-openai-safety-researchers-fired)고 전했는데, 오픈AI는 9월 22일 독립 평가자에게 훈련부터 배포까지 깊은 접근을 주겠다는 원칙을 낸 회사입니다. 3일 밤에는 출시 12건의 안전 보고서를 총괄한 데이비드 로빈슨이 디애틀랜틱 기고로 퇴사를 알리며 [「시행착오의 시대는 끝났다」](/post/news-openai-david-robinson-exit)고 썼습니다.

4일(미국 시각) 트럼프 대통령이 만든 [초지능 포스(SIF)](/post/news-super-intelligence-force-clayton)는 제이 클레이턴 국가정보국장과 오픈AI를 조사하는 FTC의 앤드루 퍼거슨 위원장 등 4명이 이끌고, 클레이턴은 120일 안에 위험과 기회를 담은 보고서를 내겠다고 했습니다. 다음 날 뉴욕시의회는 시의원 51명 전원이 위원인 청문회에서 오픈AI·앤트로픽·구글·메타의 정책 책임자를 선서시켰습니다.

에이전트가 안전장치를 언제나 지키느냐는 물음에 네 회사는 보장 대신 노력과 목표를 답했고, 재앙 위험에 대비한 보험이 있느냐는 물음에는 아무도 손을 들지 않았습니다. 같은 날 증언한 알렉스 터너 전 딥마인드 연구원은 검증자를 AI 회사가 고르거나 영향을 주지 못하게 하자고 제안했습니다.

저는 이 감사들이 실제로 작동할지가 평가자를 누가 고르느냐로 갈린다고 봅니다. 백악관 합의문은 그것을 정하지 않았고, 지금까지 두 회사의 사고를 조사한 METR은 회사가 참여를 정하고 접근권을 주고 조사 범위까지 함께 정하는 구조였기 때문입니다.

같은 주 미국·유럽 회사들이 낸 오픈웨이트 모델의 학습 자료와 비교 점수에는 모두 중국 모델이 들어 있었습니다. 3일 독일 알레프 알파가 공개한 781억 파라미터 [Kolibri](/post/news-aleph-alpha-kolibri-open-weights)는 미세조정 데이터를 주로 중국 GLM-5.2·5.3과 Qwen3.8-27B로 만들었고, 6일 새벽 리플렉션 AI는 첫 모델 [Beam](/post/news-reflection-beam-open-weights)이 GLM-5.2급 추론 점수를 3배에서 4배 적은 연산으로 냈다고 밝혔습니다. 다만 리플렉션 비교표에서도 GLM-5.3과 DeepSeek V4.1-Flash는 Beam보다 높았습니다.

6일 밤 나온 1조 파라미터 Mistral Large 4 프리뷰는 아티피셜애널리시스(AA) 지수 38점으로 중국 밖 오픈 모델 가운데 가장 높았고, 중국 오픈 모델 7개보다는 낮았습니다. 가중치는 10월 말에 풉니다.

비교 상대가 된 중국 쪽에는 돈과 칩이 몰렸습니다. 블룸버그는 6일 딥시크가 처음 목표 500억 위안을 넘겨 [최소 800억 위안을 모은다](/post/news-deepseek-funding-tencent-catl)고 전하며 가장 큰 투자자로 텐센트와 CATL을 꼽았습니다. 그 텐센트는 중국에 들일 수 없는 첨단 칩 약 10만 개를 [오라클 동남아 데이터센터에서 5년 동안 빌리는](/post/news-tencent-oracle-7b-chips-southeast-asia) 약 70억 달러 계약을 맺었다고 FT가 1일 보도했습니다.

미 법무부는 1일(미국 시각) 말레이시아 합판 회사 등을 거쳐 3억 달러어치가 넘는 GPU 서버를 중국에 보낸 혐의로 [어스메이드 컴퓨터 대표를 체포](/post/news-nvidia-gpu-smuggling-cases)했습니다. 오픈AI는 문샷AI 관련자들이 7월 24일과 25일에 추론 추출 요청 1만 6,000건을 보낸 [증류 캠페인을 막았다](/post/news-openai-moonshot-distillation-disrupted)고 밝혔고, 디인포메이션은 베이징 하이뎬구의 한 사무실 건물 입주사 30여 곳 가운데 6곳이 [Claude 재판매업체](/post/news-claude-discount-resale-beijing)라고 보도했습니다. 이런 중계소 가격은 공식가보다 70%에서 90% 쌉니다.

8일 새벽 3시 1분 앤트로픽이 Haiku 5.5를 공개했고, 4분 뒤 오픈AI는 [ChatGPT 무료 요금제까지 GPT-6를 넣는다](/post/news-gpt6-intelligent-ui-all-plans)고 발표했습니다. Haiku 5.5는 10만 토큰 이하 요청에서 100만 토큰당 입력 0.1달러·출력 0.5달러로, 무료·Go 이용자가 받는 GPT-6 Luna와 가격이 같고 Haiku 4.5의 10분의 1입니다.

AA 지수는 43점으로 Luna보다 5점 높았지만 최고 설정에서 출력 토큰을 3배 넘게 써, 과제당 비용도 0.21달러로 Luna의 3배가 나왔습니다.

단가가 같은 두 모델의 과제당 비용이 3배 벌어진 이상, 다음 소형 모델 비교는 100만 토큰당 가격보다 과제 하나를 끝내는 데 쓴 토큰 수로 하게 될 겁니다. 구글은 10월 9일부터 거꾸로 무료 이용자의 제미나이 앱 모델을 [Flash-Lite 하나로 줄이고](/post/news-gemini-free-plus-model-access-october), 1일 공개한 [제미나이 4 아르곤](/post/news-gemini-4-argon-launch)은 GPT-6 Astra와 같은 AA 지수 53점을 받았지만 사이버 방어자에게 먼저 열렸습니다.

토큰 가격이 내려간 주에 그 토큰을 만드는 메모리 가격은 올라 있었습니다. 마이크론의 분기 매출은 1년 새 [4.8배인 542억 달러](/post/news-micron-record-quarter-ai-memory)가 됐지만 매출원가는 15% 늘었고, 매출총이익률 86.8%는 엔비디아의 75.0%보다 높습니다. 메모리를 64GB로 줄인 [DGX Spark](/post/news-nvidia-dgx-spark-64gb-sync)는 1년 전 128GB 모델의 출시가 3,999달러보다 비싼 4,999달러입니다. 에포크 AI는 2025년부터 2027년까지 출하될 HBM으로 동시에 돌릴 수 있는 프런티어 에이전트를 [3,300만 개에서 1억 7,100만 개로 추산했습니다](/post/paper-epoch-agent-population-hbm).

돈과 전기도 미리 묶였습니다. 브로드컴은 TPU 리스료로만 쓸 수 있는 전환사채로 앤트로픽에 [최대 420억 달러를 빌려주기로](/post/news-broadcom-anthropic-42b-financing) 했고, 이는 5년짜리 TPU 리스 약정 1,252억 달러의 약 3분의 1입니다. 구글은 컨스텔레이션 원자로 11기의 출력을 키워 890MW를 새로 만드는 20년 계약을 포함해 [약 3.6GW를 계약했고](/post/news-google-constellation-nuclear-3-6gw), 과기정통부는 2027년 예산안의 [약 4조 7,000억 원으로 GPU 1만 장과 데이터·인재](/post/news-korea-frontier-ai-4-7-trillion-plan)를 몰아줄 프런티어 AI 수행 기업을 새로 공모합니다.

<!-- note:review -->

한국 시각 2일 새벽 3시간 사이에 결정 모델 세 개가 나왔습니다. 결정 모델은 글을 쓰지 않고 개발자가 정해 둔 선택지마다 확률을 매겨 돌려주는 모델로, 0시 34분 클라우드플레어가 [Clef를, 30분쯤 뒤 AWS가 Strands Decider 2B를](/post/review-decision-models-clef-strands-jev) 아파치 2.0으로 풀었습니다. 3시 24분에 나온 [퍼플렉시티 모델](/post/review-perplexity-decisions-api-open-weights)은 입력 100만 토큰당 0.04달러에 종합 정확도 85.71%로 Jev를 앞섰지만, 시험 11개를 단순 평균하면 Jev가 0.21%포인트 높았습니다.

CopilotKit의 [OpenDots](/post/review-copilotkit-opendots-self-hosted-agents) 저장소는 오픈AI가 키노트에서 dots를 발표하던 9월 30일 새벽 2시 13분에 만들어졌고, 첫 코드는 5시간 16분 만에 합쳐졌습니다. 엔비디아가 낸 [OpenShell과 Sentry](/post/review-nvidia-sentry-agent-safety-policy)는 에이전트를 바깥에서 묶고 별도 칩에서 지켜보는 설계로, 자체 실험에서 AI 심사관은 416번 결정 가운데 한 번 속았고 그 한 번은 바깥의 집행 장치가 막았습니다.

앤트로픽이 1일 낸 [로봇 노출 지수](/post/review-anthropic-robot-exposure-index)에서 로봇은 미국 물리 과업의 74%를 해낼 수 있었지만, 사람보다 싸게 하는 일은 전체 노동시간의 0.3%였습니다. 같은 날 런웨이는 웹 영상으로 사전학습한 정책의 오차가 로봇 영상으로 학습한 정책과 같았다며(16.1cm 대 16.0cm) [Praxis-1](/post/news-runway-praxis-1-video-robot-policy)을 냈고, 성공률은 공개하지 않았습니다.

<!-- note:paper -->

arXiv는 9월 제출이 2년 전의 두 배인 4만 363편에 이르자 10월 1일부터 [제출자 한 사람당 한 달 2편](/post/news-arxiv-two-papers-month-limit)으로 제한했습니다. 7일 아침 오픈AI는 내부 모델이 쓴 [수학 원고 722편](/post/news-openai-math-manuscripts-722)을 깃허브에 올렸는데, 주 결과를 Lean으로 형식화한 원고는 162편이고 외부 수학자의 심사는 아직 시작되지 않았습니다.

원소 6개짜리 반군 1만 5,973개 전부를 다룬 Lean 증명 590만 줄은 3개월 동안 Codex 에이전트가 쓰고 Claude 에이전트가 심사했습니다. 사람은 지시 1,114번으로 대상을 고르고 승인했고, 증명은 한 줄도 쓰지 않았습니다.

머코어 실험에서 미국 공인회계사 12명은 AI 없이 월말 결산 과제의 채점 항목을 평균 약 37% 채웠고, [Claude Opus 5는 같은 과제 20번을 모두 만점](/post/paper-mercor-human-baselines-accounting)으로 풀었습니다. 애플의 [LoopCD](/post/paper-apple-loopcd-looped-decoding)는 루프 모델이 버리던 첫 바퀴 예측을 기준점으로 써서, 추가 학습 없이 Ouro-2.6B-Thinking의 AIME 2024 정답률을 61.88%에서 73.33%로 올렸습니다. 딥마인드의 [SynthID Bio](/post/paper-deepmind-synthid-bio-protein-watermark)는 AI가 설계한 단백질에 표시를 심고도 결합력에 의미 있는 차이가 없었지만, 서열을 다시 짜면 표시가 지워진다는 한계를 함께 적었습니다.

<!-- note:interview -->

에마드 모스타크는 [원격으로 하는 일은 2년 뒤 사람에게 맡길 경제적 이유가 사라진다](/post/interview-emad-mostaque-two-years)고 했지만, 그가 근거로 든 맥킨지 보고서는 지금 업무의 절반이 자동화되는 시점을 2045년 전후로 잡았습니다. 반면 개빈 뉴섬 캘리포니아 주지사는 9월 30일 [AI만 보고 직원을 해고하거나 징계하지 못하게 하는 법](/post/news-california-ai-workplace-laws)에 서명했고, 시행은 2027년 7월입니다.

앤트로픽의 숄토 더글러스는 사람이 컴퓨터로 하는 모든 일을 [모든 인간만큼 해내는 모델이 2년 안팎에 나올 가능성이 매우 높다](/post/interview-sholto-douglas-agi-couple-years)고 봤고, 함께 나온 닉 마웰은 학습 데이터를 만드는 속도를 가장 큰 제약으로 꼽았습니다. 사티아 나델라는 [에이전트 시대가 클라우드보다 몇 자릿수 커진다](/post/interview-nadella-agents-customer-surplus)고 하면서 고객이 토큰에 쓴 돈의 몇 배를 벌어야 한다는 조건을 붙였습니다.

리눅스 커널 관리자 그렉 크로아하트만은 Mythos가 찾았다는 버그 79건의 원자료를 하나씩 열어 [필요한 수정 20건, 실제 버그 수정 10건](/post/interview-kroah-hartman-llm-bug-reports)을 추렸고, 이를 커널 개발 1시간 분량이라고 했습니다. 그래도 커널 CVE는 1년 전 주 50건 남짓에서 하루 33건으로 늘었습니다. 앤트로픽은 7일 Mythos를 쓰는 [사이버 검증 프로그램을 3단계로 넓히고](/post/news-anthropic-cyber-verification-program) Project Glasswing을 합쳤는데, Glasswing 파트너가 4월부터 7월까지 찾은 취약점은 12만 9,000건이 넘습니다.

<!-- note:podcast -->

이번 주 팟캐스트 네 편에는 에이전트를 감시하는 쪽과 만드는 쪽이 함께 나왔습니다. 굿파이어 CEO 에릭 호는 MAD 팟캐스트에서 오픈웨이트 모델 셋의 [에이전트 시험 실행 가운데 50%에서 96%가 보상 해킹이었다는 연구](/post/podcast-mad-eric-ho-goodfire-hidden-cheating)를 풀며, 모델 내부 활성값에서 부정행위를 읽는 탐침으로 키미 K3의 LLM 감시 비용을 90% 줄였다고 밝혔습니다. 하드포크에서는 뉴욕타임스 기자 일라이 탄이 [메타 Muse에 은행 계좌까지 2주 동안 맡긴 경험](/post/podcast-hard-fork-ai-agents-dangerous)을 들려줬고, 패널 한 사람은 백악관 합의를 이빨 없는 약속이라고 불렀습니다.

ChatGPT를 이끄는 티보 소티오는 Lenny's Podcast에서 [인터넷 행동의 대부분을 에이전트가 하게 된다](/post/podcast-lennys-tibo-sottiaux-chatgpt-new-era)며 dots를 AI를 쓰는 기본 통로로 그렸습니다. 구글 AI 인프라 총괄 아민 바흐다트는 Training Data에서 [가속기 10만 개면 구성에 따라 한 시간에도 여러 번 고장 난다](/post/podcast-training-data-amin-vahdat-ai-infrastructure)며, 칩의 이론 성능 대신 고장과 재시작을 뺀 실제 작업량(굿풋)으로 성과를 잰다고 했습니다.

<!-- note:news -->

마이크로소프트는 7일(미국 시각) 에이전트가 건드릴 파일과 네트워크를 정책으로 묶는 MXC를 정식 출시하고, [터미널 없이 에이전트를 설치하는 화면과 메타 Muse의 윈도 앱](/post/news-microsoft-windows-agents-event)을 예고했습니다. 애플은 그보다 5일 앞서 AI 에이전트가 자율적일수록 위험이 커진다며 맥의 [전체 디스크 접근 권한을 조이겠다](/post/news-apple-macos-full-disk-access-agents)고 밝혔고, 시점은 적지 않았습니다.

메타는 [Muse Gadgets](/post/news-meta-muse-gadgets-home-link-sdk)를 공개하며 Muse가 집 안 TV와 프린터를 다루게 하는 Home Link 5,000대를 미국 구독자에게 나눠 줍니다. 아마존이 9월 Muse의 구매를 막은 뒤, 메타는 6일 시에라와 함께 에이전트가 OAuth로 로그인해 소비자가 준 권한 안에서만 일하게 하는 [공개 표준 PAP](/post/news-sierra-meta-personal-agent-protocol)를 냈습니다.

Claude는 경쟁사 제품 안으로 들어갔습니다. 머스크는 7일 Grok Bot에 [Claude Opus 5.5와 미드저니, 수노를 넣겠다](/post/news-grok-bot-external-models)고 밝혔는데, AA 지수는 Opus 5.5가 58점, Grok 4.7이 46.4점입니다. 앤트로픽은 6일(미국 시각) 제미나이가 깔린 [구글 문서·시트·슬라이드에 Claude 사이드바](/post/news-claude-google-workspace)를 공개 베타로 열었고, 구글은 1일 Gems를 스킬로 바꾸면서 앤트로픽이 만든 [SKILL.md 형식을 받아들였습니다](/post/news-google-gemini-skills-gems-migration).

Claude Code 2.1.287은 도구 호출을 붙잡거나 화면을 새로 그리는 [모드](/post/news-claude-code-mods-events-ui)를 기본으로 켰고, 이 함수들은 샌드박스 없이 사용자 권한으로 돕니다. Supabase는 매달 새로 생기는 데이터베이스 400만 개 가운데 [70%를 에이전트와 AI 도구가 만든다](/post/news-supabase-select-agent-backend)며 Turso를 사들였고, 딥시크는 [하네스 맥·윈도 앱](/post/news-deepseek-harness-desktop-plugins)을 내며 공식 API 사용자의 약 60%가 서드파티 플러그인을 쓴다고 밝혔습니다.

1만 2,000곳 넘는 금융기관 계좌를 잇는 ChatGPT [Finances](/post/news-chatgpt-finances-plaid-experian)는 미국 무료 이용자까지 넓어졌습니다. 오픈AI는 이달 안에 미국 무료·Go 이용자의 이미지 생성 화면에서 [그림 광고를 시험](/post/news-chatgpt-image-ads-test)하는데, 광고 매출은 출시 200일이 안 돼 연환산 10억 달러를 넘겼습니다.

국내에서는 신한·KB국민·하나은행 등 금융사 7곳에서 개인 고객 6만 6,000명 가까운 정보가 빠져나갔고, 이억원 금융위원장은 4일 [AI 해킹 가능성을 배제할 수 없다](/post/news-korea-financial-breach-ai-intrusion)고 말했습니다. 6일까지 공식 확인은 나오지 않았습니다.

<!-- note:shorts -->

10월 1일부터 8일까지 소식 167건을 실었습니다(1일 35건, 2일 34건, 3일 27건, 4일 23건, 5일 10건, 6일 15건, 7일 15건, 8일 8건). 결정 모델 소식은 1일 인셉션 Mercury Decide부터 7일 오픈AI Decisions API 공개 베타, 8일 리퀴드 AI d1까지 7건이 이어졌고, 3일과 4일에는 나델라 4건, 머스크 4건, 모스타크 6건처럼 대담 발언이 몰렸습니다. 6일에는 위키미디어 재단이 오픈AI 에이전트로 보이는 무단 편집을 확인했고, 제이슨 권 오픈AI 최고전략책임자는 호주 의회에서 메디케어 통계 해킹을 사과했습니다.

<!-- note:closing -->

구글은 10월 9일부터 무료 이용자의 제미나이 모델을 Flash-Lite로 줄이기 시작하고, 오픈AI는 14일 ChatGPT·Work·코덱스에서 GPT-5.5를 은퇴시킬 예정입니다. 리플렉션 Beam과 미스트랄 Large 4의 가중치, PAP 규격 초안 v0.1은 모두 10월 안으로 약속돼 있어, 다음 호에서는 세 가지가 날짜를 지켰는지부터 확인하려 합니다.

## 이번 호 글
- [소식] 추론하고도 0.32초, 인셉션이 전화 상담용 Mercury Voice를 내놨습니다 — https://choi-newsletter.com/post/news-inception-mercury-voice-reasoning-latency
- [소식] 7개월 만의 최상위 구글 제미나이 4 아르곤, 방어자에게 먼저 풉니다 — https://choi-newsletter.com/post/news-gemini-4-argon-launch
- [소식] 2년 쓴 Gems 접는 제미나이, 앤트로픽이 만든 SKILL.md 형식을 받습니다 — https://choi-newsletter.com/post/news-google-gemini-skills-gems-migration
- [소식] 매출 1년 새 4.8배, 마이크론 이익률이 엔비디아를 넘었습니다 — https://choi-newsletter.com/post/news-micron-record-quarter-ai-memory
- [소식] 오픈AI도 문샷 지목, 막힌 추론 빼내기는 애저에선 9월 27일까지 통했습니다 — https://choi-newsletter.com/post/news-openai-moonshot-distillation-disrupted
- [아티클] '도덕적 구속력' 합의 다음 날 FTC 조사, 외부 평가자 METR도 대상 — https://choi-newsletter.com/post/review-white-house-accord-ftc-week
- [소식] AI만으로는 해고 못 한다, 뉴섬이 1년 전 거부한 법의 새 판에 서명 — https://choi-newsletter.com/post/news-california-ai-workplace-laws
- [아티클] 물리 과업 74% 해내는 로봇, 사람보다 싼 일은 0.3%… 앤트로픽 로봇 지수 — https://choi-newsletter.com/post/review-anthropic-robot-exposure-index
- [논문] AI가 설계한 단백질에 워터마크, 붙는 세기는 그대로였습니다 — https://choi-newsletter.com/post/paper-deepmind-synthid-bio-protein-watermark
- [소식] 중국에선 못 사는 AI 칩 10만 개, 텐센트가 오라클 동남아에서 빌립니다 — https://choi-newsletter.com/post/news-tencent-oracle-7b-chips-southeast-asia
- [소식] 영상 만들던 런웨이가 로봇을 움직입니다, 가중치 공개할 Praxis-1 — https://choi-newsletter.com/post/news-runway-praxis-1-video-robot-policy
- [소식] 칩 팔고 돈도 대는 브로드컴, 앤트로픽에 최대 420억 달러 빌려줍니다 — https://choi-newsletter.com/post/news-broadcom-anthropic-42b-financing
- [소식] 통계 찾던 오픈AI 에이전트가 55곳에 접근했고, 일부 기록은 사라졌습니다 — https://choi-newsletter.com/post/news-openai-agents-55-sites-audit-trail
- [소식] 외부 평가 원칙 낸 오픈AI, '외부 단체에 기밀 공유' 안전팀 3명 해고 — https://choi-newsletter.com/post/news-openai-safety-researchers-fired
- [소식] "아주 최소한의 시험" 구글 첫 TPU 위성이 교신에 성공했습니다 — https://choi-newsletter.com/post/news-google-suncatcher-launch-orbit
- [소식] 한 달 4만 편 넘자 arXiv, 제출자 한 사람당 월 2편으로 제한 — https://choi-newsletter.com/post/news-arxiv-two-papers-month-limit
- [아티클] Jev 대항마 줄줄이, 클라우드플레어·AWS가 30분 간격으로 결정 모델 공개 — https://choi-newsletter.com/post/review-decision-models-clef-strands-jev
- [팟캐스트] 에이전트 시험 최대 96% 부정행위, 굿파이어 "모델은 자기가 속이는 줄 안다" — https://choi-newsletter.com/post/podcast-mad-eric-ho-goodfire-hidden-cheating
- [소식] 링크트인·오피스 이끈 로슬란스키, 레드먼드 상주 대신 MS를 떠납니다 — https://choi-newsletter.com/post/news-microsoft-roslansky-departure-m365
- [소식] 합판 회사로 간 엔비디아 서버, 미 검찰 "3억 달러어치 중국 밀반출" 기소 — https://choi-newsletter.com/post/news-nvidia-gpu-smuggling-cases
- [소식] 버려지던 뇌 신호 5만 시간, 뉴럴링크가 사전학습해 11.32BPS 신기록 — https://choi-newsletter.com/post/news-neuralink-50000-hours-pretraining
- [소식] 게임처럼 '모드' 까는 Claude Code, 권한은 내 계정 그대로입니다 — https://choi-newsletter.com/post/news-claude-code-mods-events-ui
- [아티클] Jev보다 싸고 이미지도 읽는 퍼플렉시티 결정 모델, 종합 1위의 셈법 — https://choi-newsletter.com/post/review-perplexity-decisions-api-open-weights
- [소식] 셀카 한 장으로 옷을 입어 본다, ChatGPT 가상 피팅 전 세계 출시 — https://choi-newsletter.com/post/news-chatgpt-virtual-try-on-favorites
- [아티클] dots 키노트 도중 만든 저장소, 2일 만에 오픈소스판 OpenDots 공개 — https://choi-newsletter.com/post/review-copilotkit-opendots-self-hosted-agents
- [소식] 딥시크 하네스, 맥·윈도 앱 공개… 공식 API 사용자 60%가 외부 플러그인 — https://choi-newsletter.com/post/news-deepseek-harness-desktop-plugins
- [소식] 베이징 건물 한 동에 Claude 재판매상 6곳, 앤트로픽이 막은 중국의 회색시장 — https://choi-newsletter.com/post/news-claude-discount-resale-beijing
- [논문] 월말 결산 네 과제, 회계사 평균 37%… Claude는 20번 모두 만점 — https://choi-newsletter.com/post/paper-mercor-human-baselines-accounting
- [아티클] 엔비디아 "허깅페이스 침해 막을 수 있었다"… 에이전트 감시는 별도 칩에서 — https://choi-newsletter.com/post/review-nvidia-sentry-agent-safety-policy
- [인터뷰] 나델라 "에이전트 시대는 클라우드보다 몇 자릿수 크다", 조건은 고객의 잉여 — https://choi-newsletter.com/post/interview-nadella-agents-customer-surplus
- [소식] 공짜 동글 5,000대에 코드까지, 메타 Muse가 집 안 TV·프린터를 다룹니다 — https://choi-newsletter.com/post/news-meta-muse-gadgets-home-link-sdk
- [팟캐스트] 통장까지 Muse에 맡긴 NYT 기자, 하드포크가 본 "이빨 없는" 백악관 서약 — https://choi-newsletter.com/post/podcast-hard-fork-ai-agents-dangerous
- [소식] 메일·메시지·방문 기록까지 여는 맥 권한, 애플이 AI 에이전트 때문에 조입니다 — https://choi-newsletter.com/post/news-apple-macos-full-disk-access-agents
- [소식] 유료 회원만 쓰던 ChatGPT 가계부, 미국 무료 이용자에게도 열렸습니다 — https://choi-newsletter.com/post/news-chatgpt-finances-plaid-experian
- [논문] HBM으로 센 AI 에이전트 최대 1억 7,100만, 에포크 계산을 뜯어보니 — https://choi-newsletter.com/post/paper-epoch-agent-population-hbm
- [소식] 다룰 사람이 모자란 AI, 앤트로픽이 1억 달러로 엔지니어 1만 명 키웁니다 — https://choi-newsletter.com/post/news-anthropic-claude-frontier-academy
- [소식] 메모리는 반, 값은 1년 전 128GB보다 1,000달러 비싼 DGX Spark — https://choi-newsletter.com/post/news-nvidia-dgx-spark-64gb-sync
- [소식] 독일산 오픈웨이트 Kolibri 공개, 미세조정 교사는 중국 GLM·Qwen — https://choi-newsletter.com/post/news-aleph-alpha-kolibri-open-weights
- [소식] "시행착오의 시대는 끝났다" 오픈AI 안전 보고서 12건 총괄한 로빈슨 퇴사 — https://choi-newsletter.com/post/news-openai-david-robinson-exit
- [소식] 새 DB 70%는 에이전트가 띄운다, Supabase가 Turso를 사들입니다 — https://choi-newsletter.com/post/news-supabase-select-agent-backend
- [소식] '3 Pro' 앞세워 판 AI Plus, 구글이 10월부터 Pro 모델을 뺍니다 — https://choi-newsletter.com/post/news-gemini-free-plus-model-access-october
- [논문] 버리던 첫 바퀴 답을 살리자, 애플 루프 모델 수학 정답률 11%포인트 올랐습니다 — https://choi-newsletter.com/post/paper-apple-loopcd-looped-decoding
- [인터뷰] 모스타크 "원격 일의 수명 2년"… 그가 든 맥킨지는 절반 자동화를 2045년으로 — https://choi-newsletter.com/post/interview-emad-mostaque-two-years
- [소식] AI 차르는 정보기관 수장, 트럼프 초지능 TF에 오픈AI 조사하는 FTC도 — https://choi-newsletter.com/post/news-super-intelligence-force-clayton
- [팟캐스트] "인터넷 행동 대부분은 에이전트가" ChatGPT 총괄 소티오의 dots 구상 — https://choi-newsletter.com/post/podcast-lennys-tibo-sottiaux-chatgpt-new-era
- [소식] "GPU 1,000장으론 어렵다" 정부, 4.7조 원 프런티어 AI 새로 공모 — https://choi-newsletter.com/post/news-korea-frontier-ai-4-7-trillion-plan
- [인터뷰] 앤트로픽 연구자 "사람 넘는 AGI 2년 안팎"… 근거는 코딩, 조건은 데이터 — https://choi-newsletter.com/post/interview-sholto-douglas-agi-couple-years
- [소식] 그림 그려지는 동안 광고 한 장, ChatGPT가 미국에서 먼저 시험합니다 — https://choi-newsletter.com/post/news-chatgpt-image-ads-test
- [아티클] 뉴욕시의회서 선서한 AI 4사, 에이전트 안전장치 준수는 아무도 보장 못 했습니다 — https://choi-newsletter.com/post/review-nyc-council-ai-agents-hearing
- [소식] 금융사 7곳서 고객 6만여 명 유출, 금융위원장 "AI 해킹 가능성 배제 못 해" — https://choi-newsletter.com/post/news-korea-financial-breach-ai-intrusion
- [소식] 원자로 한 기 짓는 대신 11기를 키운다, 구글·컨스텔레이션 3.6GW 계약 — https://choi-newsletter.com/post/news-google-constellation-nuclear-3-6gw
- [소식] 목표 500억에 800억 위안 몰린 딥시크, 텐센트·CATL이 최대 투자 — https://choi-newsletter.com/post/news-deepseek-funding-tencent-catl
- [소식] 리플렉션 첫 모델 Beam "GLM-5.2급 점수를 3~4배 적은 연산으로" — https://choi-newsletter.com/post/news-reflection-beam-open-weights
- [소식] 중국 밖 오픈 모델 1위, 미스트랄 1조 파라미터 Large 4가 나왔습니다 — https://choi-newsletter.com/post/news-mistral-large-4-preview
- [소식] 아마존이 막은 Muse, 메타·시에라가 '에이전트 로그인' 표준을 냈습니다 — https://choi-newsletter.com/post/news-sierra-meta-personal-agent-protocol
- [소식] 앤트로픽, 사이버 접근을 3단계로 나누고 Glasswing을 합쳤습니다 — https://choi-newsletter.com/post/news-anthropic-cyber-verification-program
- [팟캐스트] "10만 칩이면 한 시간에도 여러 번 고장" 구글 AI 인프라 총괄의 굿풋론 — https://choi-newsletter.com/post/podcast-training-data-amin-vahdat-ai-infrastructure
- [소식] 제미나이 깔린 구글 문서에 Claude까지, 앤트로픽 애드온 베타 공개 — https://choi-newsletter.com/post/news-claude-google-workspace
- [소식] "사람이었다면 필즈상" 준리만 가설까지, 오픈AI 수학 원고 722편 공개 — https://choi-newsletter.com/post/news-openai-math-manuscripts-722
- [인터뷰] Mythos가 찾았다는 리눅스 버그 79건, 크로아하트만 "진짜 수정은 10건" — https://choi-newsletter.com/post/interview-kroah-hartman-llm-bug-reports
- [논문] 사람은 증명 0줄, AI가 반군 1만 5,973개를 Lean으로 증명했습니다 — https://choi-newsletter.com/post/paper-semigroups-order-six-lean-ai
- [소식] Grok이 못 미친다던 Opus 5.5, 머스크가 Grok Bot에 넣습니다 — https://choi-newsletter.com/post/news-grok-bot-external-models
- [소식] 클릭 몇 번에 에이전트 설치, MS가 윈도에 메타 Muse까지 들입니다 — https://choi-newsletter.com/post/news-microsoft-windows-agents-event
- [소식] GPT-6 Luna와 같은 값의 Haiku 5.5, 점수는 높고 토큰은 3배 — https://choi-newsletter.com/post/news-claude-haiku-55-launch
- [소식] 무료 이용자에게도 GPT-6, ChatGPT 답에 버튼과 계산기가 붙습니다 — https://choi-newsletter.com/post/news-gpt6-intelligent-ui-all-plans
