# 초이의 뉴스레터 No.14 — DevDay의 24시간 비서 dots, 출시가 취소된 GPT-6.1 Astra

- 날짜: 2026-09-30
- 링크: https://choi-newsletter.com/issues/014-evidence-before-the-next-step

> 오픈AI가 DevDay에서 24시간 일하는 에이전트 dots와 Astra 값의 5분의 1인 GPT-6.1 Sol을 내놓았습니다. 키노트 19시간 전에는 기만이 늘어난 GPT-6.1 Astra의 출시 취소가 보도됐고, 같은 날 오픈AI는 호주 정부에 에이전트 무단 접근을 사과했습니다.

한국 시각 9월 29일 오전 7시, 월스트리트저널이 GPT-6.1 Astra의 10월 출시 취소를 처음 보도했고 오픈AI가 확인했습니다. 내부 시험에서 6.1 Astra는 게으름이 줄었지만 이전 모델보다 기만이 늘고 사용자 허락 없이 일을 밀어붙였습니다. 그보다 4시간 앞서 앤트로픽은 [Sonnet 5.5](/post/news-claude-sonnet-55-launch)를 GPT-6 Sol과 같은 입력 2달러·출력 10달러에 내놨습니다.

오픈AI는 6.1 Astra의 기만률도 범위 시험 점수도 내놓지 않았습니다. 같은 날 나온 영국 AISI 시험과 시스템 카드로 끈기와 정직이 함께 움직이는 경로를 정리했습니다.

DevDay 키노트는 보도 19시간 뒤인 30일 새벽 2시에 열렸습니다. 올트먼은 첫 신제품으로 [상시 에이전트 dots](/post/news-openai-devday-dots-always-on-agents)를 꺼내며, 그 바탕인 GPT-6 Astra를 「우리의 가장 정렬된 모델」이라고 불렀습니다. 첫 dot은 월 100달러부터인 Pro 요금제에 들어가고, 한국 Pro 이용자도 대상입니다.

[GPT-6.1 Sol](/post/news-openai-gpt61-sol-ultrafast)은 Astra의 5분의 1 값이고, 오픈AI 측정에서 과학 연구 과제 하나를 평균 5.47달러에 풀었습니다(Astra 23.80달러). 표준의 6배 값을 받는 속도 등급 Ultrafast는 Pro 가운데 [월 500달러 Pro](/post/news-openai-pro-500-plan-pro-200-cut)에만 들어갑니다. 저는 9월 25일 새벽 스레드에 Pro 윗등급 요금제가 나올 것으로 보인다고 적었고, 4일 뒤 나온 것이 이 요금제입니다. 가입을 다시 받는 200달러 Pro는 10월 30일부터 Work·코덱스 사용량이 Plus의 20배에서 10배로 줄어듭니다.

[코덱스는 노트북을 닫아도 클라우드에서 돌고](/post/news-openai-devday-codex-cloud-agents-api), 개발자는 오픈AI의 에이전트 실행 틀을 Agents API로 빌려 컴퓨터 사용까지 시킵니다. 사람이 8시간에서 16시간 걸릴 과제를 개입 없이 끝낸 비율이 1월 10%에서 7월 35%가 됐다는 숫자의 출처는 사이먼 윌리슨이 찍은 키노트 슬라이드 사진 설명뿐입니다.

주간 사용자 12억 명의 ChatGPT를 사람과 에이전트의 공용 공간으로 연 20개 넘는 발표를 다섯 묶음으로 나눴습니다.

<!-- note:review -->

[오픈AI 에이전트 사고](/post/review-openai-rogue-agents-us-agencies-australia)는 호주를 넘어 미국 교육부·상무부·SEC 사이트와 사용자 이미지 53장으로 번졌습니다. 오픈AI는 29일 호주 정부에 공식 사과했고, 제이슨 권 최고전략책임자가 10월 6일 호주 의회 위원회에 나갑니다.

스탠퍼드 연구진의 [HomeBody](/post/review-homebody-spatial-memory)에서는 GPT-6 Astra가 휴머노이드를 조종해 처음 본 주방의 서랍 속 약을 찾아왔지만, 성공률은 공개되지 않았습니다. 행동 분류기 [Span-01](/post/review-span1-behavior-evaluation)의 F1 0.843은 프런티어 모델 두 개가 합의한 라벨로 잰 값입니다.

<!-- note:paper -->

구글의 [A²RD](/post/paper-a2rd-video-memory)는 구간마다 인물·배경 상태를 기억하고 새 구간을 두 번 검사해 1분 영상의 인물 일관성을 0.57에서 0.74로 올렸습니다. [VQQA](/post/paper-vqqa-video-questions)는 영상에 던진 질문으로 프롬프트를 고쳐 CogVideoX-5B의 T2V-CompBench 점수를 11.57%포인트 높였습니다.

<!-- note:interview -->

구글 펠로 존 플랫은 [ERA를 전동공구에 빗대며](/post/interview-john-platt-era-science) 2년 막힌 비행운 계산을 풀었다고 밝혔고, 예측 모델이 세상을 설명하는지 가리는 일은 과학자에게 남는다고 덧붙였습니다. 네이선 램버트는 [실험 주기가 10배 빨라져도 분야의 이해는 다른 축](/post/interview-lambert-denain-research-bottlenecks)이라고 말했습니다.

<!-- note:podcast -->

미국 시각 28일 공개된 팟캐스트 두 편에서는 SaaS 회사 대표와 코딩 에이전트 개발자가 에이전트 이후의 소프트웨어를 이야기했습니다. 아틀라시안 CEO 마이크 캐넌브룩스는 Decoder에서 에이전트에만 기능을 여는 헤드리스 전략을 「느린 항복」이라 부르며, [MCP 사용자 98%가 같은 달 지라 화면에서도 활동했다는 숫자](/post/podcast-decoder-atlassian-saaspocalypse)로 SaaS 종말론을 반박했습니다. 같은 날 Latent Space에 나온 앤트로픽 Claude Code 팀의 타리크 시히파르는 [검증 토큰이 줄면 가장 똑똑한 모델이 쉬운 일도 가장 싸게 하고 CLAUDE.md는 사라질 것](/post/podcast-latent-space-thariq-claude-code-next-era)이라고 내다봤습니다.

<!-- note:news -->

Claude 에이전트 세션 949개가 찾은 [효소 시스템 ART](/post/news-anthropic-art-discovery)는 같은 캠페인을 10번 더 돌렸을 때 다시 나오지 않았고, [Exa Agent Ultra의 WANDR 81.4%](/post/news-exa-ultra-search-completeness)는 Exa가 고친 채점 틀에서 나왔습니다. 서울에서는 29일부터 [Bedrock의 Claude Opus 5·Sonnet 5를 리전 안에서만 처리](/post/news-claude-bedrock-seoul-in-region)할 수 있고, 값은 전 세계 교차 리전보다 10% 비쌉니다.

29일에는 로이터가 입수한 [앤트로픽 상장 투자설명서](/post/review-anthropic-s1-prospectus-compute)에서 2025년 매출 45.9억 달러와 순손실 419.7억 달러, 연산 약정 5,180억 달러가 나왔습니다. 약정의 약 80%는 쓰지 않아도 값을 내야 하는 계약입니다. DevDay 키노트와 같은 날(미국 시각 9월 29일) 백악관에서는 트럼프 대통령이 [연방정부 문서에 AI 대신 「초지능」을 쓰라는 행정명령](/post/news-white-house-superintelligence-order)에 서명했고, 같은 오찬에서 구글·앤트로픽·메타·오픈AI·엔비디아 대표와 일론 머스크가 자율 안전 합의에 이름을 올렸습니다. 앤트로픽은 그날 [중국 오픈웨이트 GLM-5.3의 사이버 능력](/post/news-anthropic-glm53-cyber-spread)이 미국 최전선 모델보다 약 4개월 뒤라는 CAISI 평가를 자체 시험으로 다시 확인했습니다. 같은 29일 AMD는 페이페이 리의 [월드랩스를 전액 주식 82억 달러에 사기로](/post/news-amd-world-labs-acquisition) 했고, 30일 밤 일레븐랩스는 [3억 달러 직원 지분 공개매수로 기업가치 220억 달러](/post/news-elevenlabs-22b-tender-voice-agents)를 인정받았습니다.

<!-- note:shorts -->

9월 28일부터 30일까지 소식 74건을 실었습니다. 30일 30건 가운데 12건이 DevDay 발표입니다.

<!-- note:closing -->

dots 발표문은 감시 시스템이 안전 문제를 찾으면 dot의 작업을 멈추거나 끝낼 수 있다고 적었습니다. 저는 dots의 첫 달을 그 정지 장치와 활동 보기(Activity View)에 남는 기록으로 판단하려 합니다. 6.1 Astra의 출시를 막은 문제가 허락 없는 진행과 부정확한 보고였고, dot은 그 직전 판인 GPT-6 Astra로 사용자가 노트북을 닫은 뒤에도 일하기 때문입니다.

## 이번 호 글
- [인터뷰] 구글 존 플랫 "ERA는 전동공구"… 2년 막힌 비행운 계산 풀었다 — https://choi-newsletter.com/post/interview-john-platt-era-science
- [인터뷰] 램버트 "실험 주기는 10배, 이해는 다른 축"… 에포크 데냉과 RSI 대담 — https://choi-newsletter.com/post/interview-lambert-denain-research-bottlenecks
- [소식] 클로드가 21시간에 찾은 효소 ART, 같은 캠페인 10번은 못 찾았습니다 — https://choi-newsletter.com/post/news-anthropic-art-discovery
- [소식] Exa Agent Ultra가 WANDR에서 81.4%, 채점은 Exa가 했습니다 — https://choi-newsletter.com/post/news-exa-ultra-search-completeness
- [소식] 하루 2,000만 개 올라오는 유튜브, 말로 편집하는 쇼츠는 2027년 초 — https://choi-newsletter.com/post/news-youtube-2026-editing-distribution
- [논문] 문장 80개로 10분 영상을, 구글 A²RD가 주인공을 잊지 않는 법 — https://choi-newsletter.com/post/paper-a2rd-video-memory
- [논문] AI 영상에 질문을 던져 고친다, 구글 VQQA가 올린 11.57%포인트 — https://choi-newsletter.com/post/paper-vqqa-video-questions
- [아티클] 처음 본 주방에서 서랍 속 약까지, GPT-6 Astra가 조종한 휴머노이드 — https://choi-newsletter.com/post/review-homebody-spatial-memory
- [아티클] xAI 출신 롤란드 "루프가 곧 제품"… 실패 패턴을 평가로 바꾸는 법 — https://choi-newsletter.com/post/review-roland-agent-feedback-loop
- [아티클] 행동 판정만 하는 Span-01, 100만 토큰 0.02달러에 F1 0.843 — https://choi-newsletter.com/post/review-span1-behavior-evaluation
- [소식] 초안은 AI가, 마무리는 사람이… open-slide 2.0 '편집되는 PPTX' — https://choi-newsletter.com/post/news-open-slide-2-editable-powerpoint-handoff
- [소식] Opus 5.5에 2점 차 Sonnet 5.5, 값은 GPT-6 Sol과 같습니다 — https://choi-newsletter.com/post/news-claude-sonnet-55-launch
- [팟캐스트] "헤드리스는 느린 항복" 아틀라시안 CEO, MCP 사용자 98%는 지라도 썼다 — https://choi-newsletter.com/post/podcast-decoder-atlassian-saaspocalypse
- [팟캐스트] "가장 똑똑한 모델이 가장 싸진다" Claude Code 타리크의 하네스 전망 — https://choi-newsletter.com/post/podcast-latent-space-thariq-claude-code-next-era
- [소식] 엔비디아도 투자한 페이페이 리의 월드랩스, AMD가 82억 달러에 삽니다 — https://choi-newsletter.com/post/news-amd-world-labs-acquisition
- [소식] 봇은 하나, 대화와 사용량은 사람마다… SpaceXAI 'Team Bots' 공개 — https://choi-newsletter.com/post/news-grok-team-bots-shared-memory
- [소식] 덜 게으르고 덜 정직한 GPT-6.1 Astra, 오픈AI가 출시를 취소했습니다 — https://choi-newsletter.com/post/news-openai-gpt61-astra-release-cancelled
- [아티클] 호주 넘어 미국 정부 사이트로, 오픈AI 에이전트 사고가 번진 2주 — https://choi-newsletter.com/post/review-openai-rogue-agents-us-agencies-australia
- [아티클] 80%는 쓰든 안 쓰든 낸다, 앤트로픽 상장 서류 속 5,180억 달러 연산 약정 — https://choi-newsletter.com/post/review-anthropic-s1-prospectus-compute
- [소식] 자기 컴퓨터로 24시간 일하는 AI 비서, 오픈AI가 dots를 공개했습니다 — https://choi-newsletter.com/post/news-openai-devday-dots-always-on-agents
- [소식] 5분의 1 값에 Astra 근접한 GPT-6.1 Sol, 속도는 6배 값에 팝니다 — https://choi-newsletter.com/post/news-openai-gpt61-sol-ultrafast
- [소식] 가입 재개한 200달러 Pro는 사용량 절반, 오픈AI 월 500달러 Pro 신설 — https://choi-newsletter.com/post/news-openai-pro-500-plan-pro-200-cut
- [소식] 노트북 닫아도 도는 코덱스, 오픈AI가 개발자 에이전트도 대신 돌립니다 — https://choi-newsletter.com/post/news-openai-devday-codex-cloud-agents-api
- [아티클] 12억 명의 ChatGPT, 오픈AI가 사람과 에이전트의 공용 사무실로 엽니다 — https://choi-newsletter.com/post/review-openai-devday-2026-chatgpt-shared-surface
- [소식] 서울 밖으로 안 나가는 Claude, 10% 더 내고 최신 5.5는 빠졌습니다 — https://choi-newsletter.com/post/news-claude-bedrock-seoul-in-region
- [소식] "인공은 가짜라는 뜻" 트럼프, AI를 SI로 바꾸고 빅테크 6곳과 자율 합의 — https://choi-newsletter.com/post/news-white-house-superintelligence-order
- [소식] 사이버 능력 1위 오픈모델 GLM-5.3, 앤트로픽이 경고했습니다 — https://choi-newsletter.com/post/news-anthropic-glm53-cyber-spread
- [소식] 주당 대화 1,500만 건, 일레븐랩스 몸값 220억 달러가 됐습니다 — https://choi-newsletter.com/post/news-elevenlabs-22b-tender-voice-agents
