# 초이의 뉴스레터 No.2 — 프런티어 셋이 같은 주에, 값은 열한 배 차이

- 날짜: 2026-07-12
- 링크: https://choi-newsletter.com/issues/002-frontier-three-in-one-week

> 오픈AI가 GPT-5.6을 정식 출시로 넘기고 ChatGPT Work와 GPT-Live를 같은 날 붙였습니다. 이틀 뒤 간판을 SpaceXAI로 바꾼 머스크가 Grok 4.5를 냈고, 같은 주에 자기가 밀던 코딩 벤치마크의 30%가 깨져 있다는 감사 결과도 나왔습니다.

7월 6일부터 12일까지 프런티어 모델 세 개가 겹쳐 나왔습니다. 오픈AI는 정부 승인 파트너 20곳에만 열려 있던 GPT-5.6 프리뷰를 전면 개방하면서 플래그십 Sol과 중간 Terra, 경량 Luna 세 등급을 한 번에 세웠습니다. 같은 날 앱과 파일을 가로질러 직접 행동하는 [ChatGPT Work](/post/review-chatgpt-work-answers-and-tasks-split)가 나왔고, 입력을 받으면서 동시에 출력을 만드는 풀듀플렉스 음성 모델 GPT-Live도 붙었습니다.

값이 가장 먼저 움직였습니다. 같은 코딩 작업을 끝내는 데 드는 비용이 17.32달러와 1.51달러로 갈렸고, 메타는 [Muse Spark 1.1을 첫 유료 API로 열면서](/post/news-meta-model-api-first-metered) 출력 토큰을 경쟁 모델의 6분의 1로 매겼습니다.

세 등급의 값이 발표문 가운데에 놓인 첫 프런티어 출시입니다. 이번 주 나머지 발표를 읽는 순서가 여기서 정해졌습니다.

<!-- note:review -->

모델 바깥을 다룬 평론이 이번 주에 몰렸습니다. 릴리안 웽은 모델을 한 줄도 고치지 않고 SWE-bench를 20%에서 50%로 올린 기록을 자기개선의 시작점으로 지목했습니다. 앤트로픽 Claude Code 팀은 [루프에 넘길 판단을 넷으로 나눈 단계표](/post/review-claude-code-delegation-ladder)에 이어 [모델 손잡이와 노력 손잡이가 무엇을 바꾸는지](/post/review-claude-code-model-and-effort-knobs)도 정리했습니다. 코드가 나와도 남던 [배포와 운영 구간](/post/review-manus-prompt-to-deployed-app)을 게시 버튼 하나로 접으려는 제품도 같은 주에 나왔습니다.

자기개선이라는 말이 가중치 바깥에서도 성립한다는 주장입니다. 이번 주 다른 기사 절반이 이 글의 전제 위에 서 있어 먼저 놓았습니다.

노동 쪽 숫자는 더 구체적입니다. 미국 22세부터 25세 개발자 취업이 [3년 만에 19%](/post/review-junior-developer-market-collapse) 내려앉았고, KDI는 [2030년 일자리 90%에 자동화 가능 딱지를 붙인 계산](/post/review-kdi-9090-canary-dashboard)을 내놨습니다.

<!-- note:paper -->

모델이 속으로 무엇을 하고 있는지 들여다본 논문이 세 편입니다. [사용자 직업만 바꿔도 도덕 점수가 36점까지 갈린 실험](/post/paper-llm-infers-occupation-moral-judgment)에서는 법 위반(36.2점)과 즐거움 빼앗기(36.8점)처럼 해석 여지가 있는 항목의 폭이 컸습니다. 리퀴드AI는 [반복 고리를 여는 첫 토큰 하나를 다시 가르쳐](/post/paper-liquid-antidoom-one-token) 반복률을 22.9%에서 1%대로 떨어뜨렸습니다.

시험을 통과한 이유가 윤리인지 시험인지 가려 보려는 시도입니다. 평가를 믿을 수 있느냐는 이번 주 질문의 바닥에 이 실험이 있습니다.

<!-- note:news -->

수학에서 한 주에 두 건이 나왔습니다. GPT-5.6 Sol Ultra가 50년 된 사이클 이중 덮개 추측의 증명을 한 시간 안에 내놨고, Grok 4.5는 4차원에서 반례를 만들어 3차원이 실제 경계임을 보였습니다. 엔비디아는 [에이전트 시대의 병목으로 CPU를 지목하며 Vera](/post/news-nvidia-vera-cpu-agent-bottleneck)를 냈고, 팀 쿡은 [브로드컴과 300억 달러 계약](/post/review-apple-broadcom-30bn-internalization)을 발표했습니다.

4개월 남짓 전 자기가 밀던 점수표를 스스로 감사해 공개 과제의 30%가 깨져 있다고 적었습니다. 이번 주 내내 인용된 코딩 숫자들의 신뢰 구간이 여기서 정해집니다.

<!-- note:shorts -->

62건입니다. 모델 출시와 수학, 규제, 하드웨어 순으로 배열했습니다.

<!-- note:closing -->

세 모델이 같은 주에 나오면서 비교 기준이 점수표에서 단가와 라이선스로 옮겨갔습니다. 그 점수표 자체의 눈금이 틀어져 있었다는 감사 결과도 같은 주에 나왔습니다.

## 이번 호 글
- [소식] "한국에는 적용되지 않는다"던 텐센트 라이선스, Hy3 정식판에서 사라졌습니다 — https://choi-newsletter.com/post/news-tencent-hy3-apache-license
- [아티클] 모델은 그대로 두고 SWE-bench 20%→50%, 릴리안 웽이 꺼낸 '하네스' — https://choi-newsletter.com/post/review-agent-harness-architecture
- [아티클] 대화 2시간마다 알림, 중국 규정 앞에서 더우바오·큐원이 AI 캐릭터를 끕니다 — https://choi-newsletter.com/post/review-ai-companion-regulation-landscape
- [아티클] 22~25세 개발자만 19% 줄던 해, 깃허브엔 3,600만 명이 왔습니다 — https://choi-newsletter.com/post/review-junior-developer-market-collapse
- [논문] 말하지 않은 생각을 읽는 렌즈, 앤트로픽이 Claude 속 작업 공간을 찾았습니다 — https://choi-newsletter.com/post/paper-anthropic-global-workspace-jspace
- [아티클] 프롬프트 대신 루프, Claude Code 팀이 넘길 판단을 넷으로 나눴습니다 — https://choi-newsletter.com/post/review-claude-code-delegation-ladder
- [아티클] 모델은 그대로, 하네스만 고쳐 점수 2.5배, 릴리안 웽의 자기개선론 — https://choi-newsletter.com/post/review-lilian-weng-harness-self-improvement
- [아티클] 코덱스는 알려 준 만큼 움직입니다, 오픈AI 서울 밋업이 꼽은 활용법 다섯 가지 — https://choi-newsletter.com/post/review-codex-five-ways-to-use
- [아티클] "CLI는 없애지 않는다" 오픈AI가 서울 코덱스 밋업 질의응답에서 내놓은 답 — https://choi-newsletter.com/post/review-codex-meetup-qa
- [아티클] 89조 원 번 날 주가는 6.9% 하락, 메모리 정점 논쟁 뒤의 추론 칩 경쟁 — https://choi-newsletter.com/post/review-semiconductor-peak-sovereign-competition
- [논문] 같은 말 되풀이하던 추론 모델, 리퀴드AI가 토큰 하나 고쳐 반복률 1%대로 — https://choi-newsletter.com/post/paper-liquid-antidoom-one-token
- [아티클] 끝까지 물고 늘어지는 GPT-5.6, 초기 테스터 후기는 극찬과 경고로 갈렸습니다 — https://choi-newsletter.com/post/review-gpt56-early-testers-never-stops
- [소식] GPU 파는 엔비디아가 ‘에이전트 병목은 CPU’라며 Vera를 앞세웠습니다 — https://choi-newsletter.com/post/news-nvidia-vera-cpu-agent-bottleneck
- [소식] Cursor와 만든 Grok 4.5, 출력 가격은 Opus 4.8의 4분의 1 — https://choi-newsletter.com/post/news-grok-45-cursor-price-war
- [소식] 맞장구치며 듣는 챗GPT, 오픈AI가 음성 모델 GPT-Live를 공개했습니다 — https://choi-newsletter.com/post/news-openai-gpt-live-fullduplex
- [논문] 직선 하나로는 못 담는 프레첼, 굿파이어가 AI 속 개념을 덩어리로 읽었습니다 — https://choi-newsletter.com/post/paper-goodfire-block-sparse-featurizer
- [아티클] 운영 데이터를 건드린 에이전트에 2점, 아폴로가 AI 감시자 16개를 시험했습니다 — https://choi-newsletter.com/post/review-apollo-coding-agent-monitor
- [아티클] 미국산 칩 150억 개, 애플이 브로드컴과 300억 달러 넘는 약정을 맺었습니다 — https://choi-newsletter.com/post/review-apple-broadcom-30bn-internalization
- [아티클] 결제·도메인·서버를 버튼 하나로 여는 Manus, 한국은 결제에서 멈춥니다 — https://choi-newsletter.com/post/review-manus-prompt-to-deployed-app
- [아티클] 막혔다 다시 열린 Fable 5, 일주일 동안 쏟아진 결과물 50여 건 — https://choi-newsletter.com/post/review-fable5-showcase-eight-days
- [아티클] 덜 알았나, 덜 해 봤나, Claude Code 모델·노력 고르는 법 — https://choi-newsletter.com/post/review-claude-code-model-and-effort-knobs
- [논문] 141개국 AI 노출 지수에 한국은 없고, 타지키스탄은 송금 탓에 상위권입니다 — https://choi-newsletter.com/post/paper-jagged-global-economy-ai-exposure
- [아티클] 멸종을 그렸던 'AI 2027' 팀, 이번엔 "초지능은 2040년까지 미루자" — https://choi-newsletter.com/post/review-ai-2040-plan-a
- [아티클] AI가 할 수 있는 일 94%, 실제로 쓴 일 33%… 정부가 공급자로 나섰습니다 — https://choi-newsletter.com/post/review-ai-no-profit-sovereign-public-good
- [아티클] "일자리 90% AI로 가능" KDI 추정, 청년 일자리는 21만 개 줄었습니다 — https://choi-newsletter.com/post/review-kdi-9090-canary-dashboard
- [소식] 라마를 공짜로 풀던 메타, 처음 받는 모델 사용료는 출력 4.25달러 — https://choi-newsletter.com/post/news-meta-model-api-first-metered
- [소식] 진 점수도 실은 GPT-5.6, 같은 과제 비용은 Fable 5의 3분의 1 — https://choi-newsletter.com/post/news-gpt56-launch-price-per-result
- [아티클] 코딩 도구로 일하던 비개발자 100만 명, 오픈AI가 챗GPT 워크를 내놨습니다 — https://choi-newsletter.com/post/review-chatgpt-work-answers-and-tasks-split
- [아티클] 34분짜리 운영체제부터 일주일짜리 맨해튼까지, GPT-5.6 첫날 15건 — https://choi-newsletter.com/post/review-gpt56-day-one-showcase
- [아티클] 코덱스 AMA 추천 1위는 월 20달러 요금 질문, 30분 뒤 한도 초기화 — https://choi-newsletter.com/post/review-codex-ama-pricing-and-trust
- [아티클] 카파시는 일부러 모호하게 남겼고, 학생용 ExamWiki는 숫자로 채웠습니다 — https://choi-newsletter.com/post/review-examwiki-executable-spec
- [논문] 사용자 직업만 바꿨는데 AI가 매긴 법 위반 점수가 36점 갈렸습니다 — https://choi-newsletter.com/post/paper-llm-infers-occupation-moral-judgment
- [소식] 80%까지 오른 코딩 시험, 오픈AI "과제 30% 깨졌다"며 추천 철회 — https://choi-newsletter.com/post/news-openai-audits-swebench-pro
