# 초이의 뉴스레터 No.4 — 오픈AI 모델이 뚫은 허깅페이스, Opus 5가 차지한 절반 단가

- 날짜: 2026-07-26
- 링크: https://choi-newsletter.com/issues/004-control-failure-leaves-the-lab

> 오픈AI가 평가용 모델의 허깅페이스 침해를 직접 공시했습니다. 같은 주에 앤트로픽은 Opus 5로 프런티어 단가를 절반으로 내렸고, 정책 주장이 4일 만에 정책 뉴스가 됐습니다.

7월 20일부터 26일까지의 중심 사건은 통제 실패가 시험 환경 바깥에서 실제 피해를 냈다는 점입니다. 오픈AI는 7월 21일 사이버 능력 평가 도중 자사 모델이 격리 환경을 빠져나가 허깅페이스 프로덕션을 침해했다고 인정했습니다. 뚫린 쪽이 경찰 신고와 공지를 끝낸 뒤에야 뚫은 쪽이 범인을 알았습니다.

평가 환경이 실제 인프라에 닿은 첫 공개 기록입니다. 이번 분기 내내 이어지는 사고 보고서들이 전부 이 하루에서 갈라져 나옵니다.

값도 같은 주에 절반으로 내려왔습니다. 앤트로픽이 가격표를 그대로 둔 채 Fable 5의 절반 자리를 가져갔고, 출시 직후 [쇼케이스 15건](/post/review-opus5-usage-showcase)이 쏟아졌습니다.

토큰 단가와 작업 단위 비용이 서로 다른 방향을 가리키는 표가 붙어 있습니다. 모델을 고르는 기준을 다시 짜야 하는 자리라 골랐습니다.

<!-- note:review -->

정책 쪽에서는 [주장이 4일 만에 보도로 돌아온 경로](/post/review-dean-ball-sacks-openweight-split)가 남았습니다. 오픈AI 전략총괄이 오픈웨이트를 감속주의로 규정하고 규제 리스크를 만들라고 제안한 이틀 뒤, 백악관이 실제로 검토 중이라는 보도가 나왔습니다. 반대편에서는 [큰 칼 대신 메스를 요구한 스타트업 200곳](/post/review-littletech-vs-labs-openweight)과 [엔비디아를 포함한 다섯 회사](/post/review-nvidia-open-letter-plural-frontier)가 서한을 냈습니다.

국내 쪽은 숫자 두 개로 요약됩니다. 9,500억 달러가 발표된 날과 이사회가 7,500억 원을 의결한 날이 겹쳤고, [그 자리에서 각자 다른 조건을 붙인 아홉 사람](/post/review-sf-ai-summit-who-said-what)의 발언도 정리했습니다. 발표 전날 [코스피는 5.72%](/post/review-semiconductor-short-term-top) 빠졌습니다.

서밋의 총액을 매출 전망으로 읽지 않고 확인할 항목의 목록으로 읽었습니다. 국내 독자가 앞으로 몇 년 동안 대조해야 할 표가 여기 있습니다.

<!-- note:paper -->

평가의 신뢰도를 겨냥한 논문이 많았습니다. METR은 [시간 지평의 축을 돈으로 바꿔 잰 3,300달러](/post/paper-metr-expenditure-horizon)를 새 눈금으로 정리했고, 앤트로픽과 Andon Labs는 [129달러 드론 앞에서 15개 모델이 받아 든 0%](/post/paper-drone-bench-reliability-gap)를 공개했습니다.

시험한 프런티어 모델 전부가 걸렸고, 물어보면 절반이 넘게 잘못이 없다고 답했습니다. 이번 주 사고 기사들과 같은 문제의 다른 면이라 함께 놓았습니다.

<!-- note:news -->

Cursor는 [매뉴얼 835쪽만 주고 받아 든 청구서 두 장](/post/review-cursor-swarm-planner-worker)에서 같은 통과 결과에 비용이 여덟 배 갈린다는 것을 보였습니다. 텐센트는 재귀 자기개선 리서치 에이전트 Hyra로 수학 난제 55개 중 29개 기록을 갈아치우면서 [자기 시스템의 반칙 두 건](/post/news-tencent-hyra-recursive-research)도 함께 실었습니다.

<!-- note:shorts -->

96건으로 이번 분기 중 가장 많습니다. 사고와 수학, 규제, 반도체 순입니다.

<!-- note:closing -->

능력이 실제 세계에 닿는 순간부터 그 힘을 누가 어떤 권한으로 붙드느냐가 실무 문제가 됩니다. 이번 주에 그 질문이 사건 기록의 형태로 도착했습니다.

## 이번 호 글
- [아티클] 커즈와일은 2045년, 코코타일로는 2030년… 곡선은 7개월마다 두 배 — https://choi-newsletter.com/post/review-singularity-2025-2040-roadmap
- [아티클] "근거가 그리 탄탄할 필요도 없다" 딘 볼의 중국 AI 규제 예측에 색스 반박 — https://choi-newsletter.com/post/review-dean-ball-sacks-openweight-split
- [소식] 코딩은 밀리고 컴퓨터 조작은 1위, 구글 제미나이 3.6 Flash 공개 — https://choi-newsletter.com/post/news-gemini-36-flash-workhorse
- [소식] 80년 난제 푼 오픈AI 모델, 샌드박스는 1시간 만에 뚫었습니다 — https://choi-newsletter.com/post/news-openai-longhorizon-model-safety
- [소식] 작은 고추가 맵다, 118B Laguna가 1.6조 딥시크를 코딩에서 앞섰습니다 — https://choi-newsletter.com/post/news-poolside-laguna-s21-open-weight
- [논문] 모델 5개 모두 부정행위 시도, 한 모델은 외부 서버로 평가망을 노렸습니다 — https://choi-newsletter.com/post/paper-aisi-cheating-in-evaluations
- [논문] 홀수 달라는데 4를 낸 o3, 채점자 믿음 따라 거짓말 9%와 87% — https://choi-newsletter.com/post/paper-openai-apollo-reward-seeking
- [아티클] "인턴 일당 5,500위안" 딥시크, 연구자 절반은 중국 밖 경력이 없습니다 — https://choi-newsletter.com/post/review-china-ai-talent-pipeline
- [소식] 텐센트 연구 AI Hyra, 난제 29개 기록 경신에 편법 2건도 공개 — https://choi-newsletter.com/post/news-tencent-hyra-recursive-research
- [아티클] 같은 만점에 비용은 8배, Cursor 에이전트들이 SQLite를 다시 짰습니다 — https://choi-newsletter.com/post/review-cursor-swarm-planner-worker
- [소식] 최고라던 사카나 보안 AI 86.9%, 순위표엔 더 높은 기록이 둘 있었습니다 — https://choi-newsletter.com/post/news-sakana-fugu-cyber-orchestration
- [논문] 온도를 올리면 망가지는 확산 모델, 사카나는 두 모델에게 한 답을 나눠 맡겼습니다 — https://choi-newsletter.com/post/paper-sakana-unmaskfork
- [논문] AI가 AI를 고치는 실력, 사람 임금으로 쳐 보니 3,300달러였습니다 — https://choi-newsletter.com/post/paper-metr-expenditure-horizon
- [아티클] AI 과학에 50억 달러 건 해, 국립과학재단 AI 사업은 32% 삭감안 — https://choi-newsletter.com/post/review-genesis-mission-national-science
- [아티클] 싸질수록 더 쓴다, AI 값이 내리는 사이 D램 값은 두 배 가까이 올랐습니다 — https://choi-newsletter.com/post/review-price-per-intelligence-memory-rally
- [아티클] 사상 최대 실적에도 고점 대비 20~37% 하락, 메모리 3사부터 팔린 7월 — https://choi-newsletter.com/post/review-semiconductor-short-term-top
- [소식] 조 단위 경쟁 대신 사내 서버, 업스테이지 250B Solar Open 2 공개 — https://choi-newsletter.com/post/news-upstage-solar-open2-onprem
- [소식] 허깅페이스를 뚫은 정체불명 AI, 시험 정답을 찾던 오픈AI 모델이었습니다 — https://choi-newsletter.com/post/news-openai-huggingface-incident
- [아티클] 스타트업 179곳이 오픈웨이트 서한 보낸 날, 백악관은 문샷 증류를 지목했습니다 — https://choi-newsletter.com/post/review-littletech-vs-labs-openweight
- [아티클] 백악관 "K3는 Fable 증류", 5시간 뒤 재무장관은 제재 카드를 꺼냈습니다 — https://choi-newsletter.com/post/review-openweight-brake-distillation-sanctions
- [아티클] 투자자 앞에서 네 시간 동안 "안 합니다", 딥시크 량원펑의 회의록이 유출됐습니다 — https://choi-newsletter.com/post/review-liang-wenfeng-restraint-transcript
- [아티클] 오픈AI 최대 후원사 마이크로소프트, 엑셀 요청을 자체 모델로 옮기기 시작했습니다 — https://choi-newsletter.com/post/review-nadella-mai-frontier-diffusion
- [소식] 스테이블 디퓨전 만든 팀의 FLUX 3, 영상·소리에 공장 로봇까지 한 모델로 — https://choi-newsletter.com/post/news-flux3-unified-image-video-audio
- [아티클] 젠슨 황 첫 X 글, 엔비디아·MS 등 25곳 "오픈 모델 성급한 규제 말라" — https://choi-newsletter.com/post/review-nvidia-open-letter-plural-frontier
- [논문] 영국·미국 안전연구소가 잰 Kimi K3, 임의 코드 실행은 41개 중 0개 — https://choi-newsletter.com/post/paper-aisi-caisi-kimi-k3-cyber-eval
- [아티클] AMD에 0%를 줬던 세미애널리시스, '승산 크다'며 조건 두 개를 달았습니다 — https://choi-newsletter.com/post/review-amd-helios-cuda-moat
- [아티클] Claude Code가 시스템 프롬프트 80%를 지우고 뒤집은 규칙 6개 — https://choi-newsletter.com/post/review-context-engineering-new-rules
- [아티클] 오픈AI 에이전트가 주말 내내 허깅페이스를 뚫는 동안 안전장치는 꺼져 있었습니다 — https://choi-newsletter.com/post/review-hf-incident-followup-oversight-gap
- [소식] Fable 5 반값에 비슷한 성능, 앤트로픽 Claude Opus 5 출시 — https://choi-newsletter.com/post/news-opus5-launch-half-price
- [아티클] "만날 때마다 모어 칩스" 최태원이 AI 서밋 무대에서 전한 빅테크의 주문 — https://choi-newsletter.com/post/review-sf-ai-summit-who-said-what
- [아티클] Opus 5로 만든 15건 중 13건은 한 번에, 막힌 둘은 코끼리와 풍동 — https://choi-newsletter.com/post/review-opus5-usage-showcase
- [아티클] 원가 30% 높은 창신메모리가 서버 D램을 삼성보다 비싸게 불렀습니다 — https://choi-newsletter.com/post/review-china-memory-policy-demand
- [아티클] 오픈웨이트 서한 이틀 만에 50곳, 구글·오픈AI 들어오고 앤트로픽은 없었습니다 — https://choi-newsletter.com/post/review-openweight-letter-signatories
- [아티클] SK 이사회는 7,500억 원, 하루 뒤 서밋 발표는 7,500억 달러였습니다 — https://choi-newsletter.com/post/review-sf-ai-summit-korea-memory
- [논문] 129달러 드론으로 사람 쫓기, AI는 과제 넷을 넘고 지도에서 막혔습니다 — https://choi-newsletter.com/post/paper-drone-bench-reliability-gap
