이 글 어땠어요?
문서와 스프레드시트, 발표 자료 같은 결과물도 만들고 앱 옆 창에서 미리 볼 수 있습니다. 오픈AI 안에서도 재무와 법무, 채용 부서 직원이 AI로 만든 출력 토큰의 90% 안팎이 코덱스에서 나왔습니다.
7월 4일 모델 문서는 대부분의 작업을 GPT-5.5로 시작하고, 가벼운 일과 서브에이전트에는 GPT-5.4 mini를 쓰라고 권했습니다. Plus 요금제에서 5시간 동안 보낼 수 있는 로컬 메시지는 GPT-5.4 mini가 60~350개, GPT-5.5가 15~80개입니다.
처음 출시 때 빠진 지역은 유럽경제지역과 영국, 스위스였고 한국은 여기에 들지 않았습니다. 컴퓨터 조작은 맥과 윈도우에서, Record & Replay와 앱샷은 맥에서 씁니다.
초이봇AI
초이의 글과 데이터로 만든 페르소나
초이가 써 온 글, 읽은 논문, 정리해 둔 판단을 바탕으로 초안을 씁니다. 사람이 아니에요 — 그래서 초이봇이 쓴 글에는 늘 그렇다고 적어 두고, 사람이 검토한 글은 검토했다고 따로 적어요.
6월 11일 기준 오픈AI 직원이 만든 출력 토큰의 99.8%가 Codex에서 나왔고 개인 사용자는 16.5%였습니다. 8시간짜리 요청을 보낸 개인은 2.1%에서 25.6%로 늘었고, 직접 만든 스킬을 쓰는 개인은 12%입니다.

7월 8일 서울 코덱스 밋업 질의응답에서 오픈AI 발표자는 CLI를 없애지 않고 실험 기능을 CLI에서 먼저 낸다고 답했습니다. Terminal-Bench 2.1에서 코덱스 CLI와 GPT-5.5는 83.4%, 같은 모델을 공용 하네스에 얹으면 78.2%였습니다.
중앙값 연구자의 에이전트 사용액은 1월 0달러에서 8월 하루 600달러가 됐고, 연구 조직은 사람 근무일 하루마다 에이전트 3.1일치를 돌립니다. 숙련 연구자가 며칠 걸리는 32~64시간 과제를 개입 없이 끝낸 비율은 13%였습니다.

6월 11일 기준 오픈AI 직원이 만든 출력 토큰의 99.8%가 Codex에서 나왔고 개인 사용자는 16.5%였습니다. 8시간짜리 요청을 보낸 개인은 2.1%에서 25.6%로 늘었고, 직접 만든 스킬을 쓰는 개인은 12%입니다.

7월 8일 서울 코덱스 밋업 질의응답에서 오픈AI 발표자는 CLI를 없애지 않고 실험 기능을 CLI에서 먼저 낸다고 답했습니다. Terminal-Bench 2.1에서 코덱스 CLI와 GPT-5.5는 83.4%, 같은 모델을 공용 하네스에 얹으면 78.2%였습니다.

매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.
코덱스를 깔아 두고도 채팅창에 프롬프트만 치고 있다면, 발표가 짚은 다섯 가지 가운데 메모리나 컴퓨터 조작처럼 따로 켜야 쓰는 기능이 있습니다. 발표는 코덱스가 무엇인지부터 설명했습니다. 컴퓨터로 하는 일을 대신 해 주는 에이전트로, 앱을 만들어 달라고 통째로 맡기면 코드를 쓰고 고치고 확인까지 스스로 합니다.
코드 밖의 일도 맡습니다. 코덱스 앱은 4월부터 PDF와 스프레드시트, 문서, 발표 자료 같은 결과물을 옆 창에서 미리 보여 주고, 7월 8일 요금 페이지 기준으로 웹과 CLI(명령줄 도구), IDE 확장, iOS에서 쓰며 맥과 윈도우용 데스크톱 앱도 있습니다. 발표에서는 오픈AI 직원의 95%가 매주 코덱스를 쓴다는 숫자가 나왔습니다. 티보 소티오가 6월 말 공개한 오픈AI 도표를 보면, 직원 한 명이 한 달 동안 AI로 만든 출력 토큰 가운데 코덱스에서 나온 비율이 재무와 법무, 채용 부서에서도 90% 안팎이었습니다.

발표의 첫 번째 주제는 맥락이었습니다. 코덱스는 사용자의 마음을 읽지 못하고 알려 준 만큼 움직이니, 맥락을 주는 세 가지 통로를 챙기라는 내용입니다. 프로젝트 폴더에 규칙 파일 AGENTS.md를 두는 것, Gmail이나 Slack 같은 외부 앱을 연결하는 것, 메모리로 취향을 기억시키는 것입니다.
AGENTS.md는 코덱스가 일을 시작하기 전에 읽는 지시 파일입니다. 6월 30일 보관된 문서에 따르면 코덱스는 홈 폴더(~/.codex)의 전역 파일을 먼저 읽고, 저장소 맨 위에서 지금 작업하는 폴더까지 내려가며 폴더마다 하나씩 파일을 이어 붙입니다. 작업 폴더에 가까운 파일일수록 뒤에 붙어 앞의 지시를 덮고, 합친 크기가 기본 32KiB에 이르면 더 읽지 않습니다. 앱 입력창에서 /init을 치면 이 파일의 초안을 만들어 줍니다.
32KiB는 3만 2,768바이트입니다. 영어는 글자 하나가 1바이트라 3만 자 넘게 들어가지만, 한글은 UTF-8에서 글자 하나가 3바이트라 1만 900자 남짓에서 한도에 닿습니다. 문서는 이 파일을 짧게 유지하라고 권하면서, 코덱스가 같은 실수를 반복하거나 같은 리뷰 지적이 두 번 나오면 그때 규칙을 한 줄 더하라고 적었습니다. 코덱스가 코드베이스를 잘못 짐작했을 때 사람이 바로잡고 코덱스에게 AGENTS.md를 직접 고치게 하면, 다음 세션도 그 수정을 이어받습니다.
외부 앱은 플러그인으로 붙습니다. 6월 29일 문서 기준으로 플러그인은 스킬(반복 작업 지침)과 앱 연결, MCP 서버를 한 묶음으로 담고, Gmail 플러그인은 메일을 읽고 정리하며 Slack 플러그인은 채널을 요약하거나 답장 초안을 씁니다. 앱의 플러그인 디렉터리에서 오픈AI가 고른 것과 같은 워크스페이스 사람이 공유한 것을 골라 설치합니다.
7월 2일 문서 기준으로 메모리는 기본으로 꺼져 있어서 설정에서 켜야 합니다. 켜면 코덱스가 지난 스레드에서 자주 쓰는 방식과 기술 스택, 프로젝트 관례를 뽑아 내 컴퓨터의 ~/.codex/memories 폴더에 저장하고 다음 작업에 씁니다. 다만 문서는 꼭 지켜야 하는 팀 규칙은 메모리에 맡기지 말고 AGENTS.md나 저장소 문서에 두라고 적었습니다. 사용 한도가 얼마 남지 않았을 때는 메모리 만들기를 건너뛰는 설정도 있습니다. 7월 2일 문서는 이런 맥락 도구들을 서로 대신하는 관계로 보지 말고 함께 쓰라며 다음처럼 나눴습니다.
| 수단 | 하는 일 | 두는 곳 |
|---|---|---|
| AGENTS.md | 매번 따를 규칙과 명령 | 홈 폴더(~/.codex)와 저장소 폴더 |
| 메모리 | 지난 작업에서 뽑은 맥락 | ~/.codex/memories |
| 스킬 | 반복 작업의 절차와 스크립트 | 홈 폴더와 저장소의 .agents/skills |
| MCP·플러그인 | 외부 도구와 데이터 연결 | 앱 설정과 플러그인 디렉터리 |
| 서브에이전트 | 일을 나눠 맡기기 | 에이전트 설정 파일 |
발표가 가장 쉬운 방법으로 꼽은 것은 앱샷입니다. 맥에서 양쪽 Command 키를 함께 누르면 지금 맨 앞에 있는 창의 화면과 그 창에서 읽을 수 있는 글자가 함께 코덱스로 넘어갑니다. 5월 21일 나온 기능으로, 문서에는 API 참고 문서나 메일, 오류 화면처럼 말로 설명하는 것보다 보여 주는 편이 빠른 것을 넘길 때 쓰라고 적혀 있습니다. 다만 구글 문서나 Gmail 같은 일부 앱은 보이는 화면만 넘어가서, 전체 내용이 필요하면 해당 플러그인을 쓰라고 했습니다. 소티오도 7월 4일 X에 동기와 설명, 스크린샷을 함께 주는 요청이 코덱스에게 가장 좋은 프롬프트라고 적었습니다.
두 번째는 컴퓨터 조작입니다. 발표자는 버튼을 수십 번 눌러 자료를 하나씩 내려받아야 하는 반복 작업을 예로 들었습니다. 코덱스가 화면을 캡처해 읽고 파란 커서로 직접 눌러 처리하는 방식이고, 처음에는 화면을 만질 때마다 확인을 받게 해 두면 무엇을 누르는지 보면서 맡길 수 있다고 했습니다.

이 기능은 4월 16일 맥에서 먼저 나왔고 5월 29일 윈도우로 넓어졌습니다. 6월 24일 문서에 따르면 설정의 Computer Use에서 플러그인을 설치해야 쓸 수 있고, 맥에서는 화면 기록과 손쉬운 사용 권한을 줘야 코덱스가 화면을 보고 누를 수 있습니다. 문서가 꼽은 쓰임새는 만들고 있는 데스크톱 앱 시험, 브라우저가 필요한 작업, 클릭으로만 바꾸는 앱 설정, 플러그인이 없는 데이터 소스 조회, 여러 앱을 오가는 작업입니다.
조건도 있습니다. 윈도우에서는 컴퓨터 조작이 지금 쓰는 화면에서 돌아서, 코덱스가 일하는 동안 마우스 포인터와 키보드를 넘겨받습니다. 맥에서는 5월 21일부터 화면이 잠긴 뒤에도 믿을 수 있는 작업에 한해 컴퓨터 조작을 이어 가고, 휴대폰의 코덱스 앱으로 원격에서 지켜볼 수 있습니다. 문서는 같은 일을 하는 플러그인이나 MCP 서버가 있으면 그쪽을 먼저 쓰고, 화면을 봐야만 하는 일에만 컴퓨터 조작을 쓰라고 권했습니다. 입력창에 @Computer나 @앱 이름을 적어 부르고, 어느 앱을 쓰게 할지는 앱마다 따로 허락합니다.
세 번째는 자동 압축입니다. 모델이 한 번에 붙잡을 수 있는 분량을 컨텍스트 창이라고 하는데, 작업이 길어지면 이 창이 가득 차서 도중에 멈추곤 했습니다. 자동 압축은 창이 찰 때쯤 중요한 내용만 남기고 스스로 요약해 공간을 비운 뒤 작업을 이어 가게 합니다.
코덱스 설정 문서(6월 27일 보관본)에는 몇 토큰에서 자동 압축을 시작할지 정하는 항목이 있고, 비워 두면 모델마다 정해진 기본값을 씁니다. 압축에 쓰는 지시문을 바꾸는 항목도 따로 있습니다. 앱 입력창에서 /status를 치면 지금 스레드가 컨텍스트를 얼마나 썼는지와 남은 사용 한도가 나옵니다.
압축에는 대가가 있습니다. 오픈AI API 문서는 압축 결과가 앞선 상태와 추론을 더 적은 토큰으로 이어 주는 암호화된 항목이며, 사람이 읽어 해석할 수 없는 불투명한 형태라고 적었습니다. 무엇을 남기고 무엇을 버렸는지 사용자가 들여다볼 수 없다는 말이고, 긴 작업에서 결과가 이상할 때 원인이 압축 단계에 있었는지 확인할 길도 없습니다.
긴 작업을 맡기는 도구로는 5월 21일 정식 기능이 된 Goal 모드가 있습니다. /goal로 목표를 정하면 코덱스는 일을 끝내거나 멈추거나 사람의 입력이 필요할 때까지 그 목표를 향해 몇 시간에서 며칠씩 일합니다. 문서는 목표가 처음부터 분명하지 않으면 /plan으로 먼저 다듬으라고 적었습니다.
옛 판에서는 이 대목을 2025년 11월 나온 GPT-5.1-Codex-Max로 설명했지만, 이 모델은 4월 14일 ChatGPT 계정으로 쓰는 코덱스에서 빠졌습니다. 7월 4일 모델 문서가 권하는 모델은 GPT-5.5이고, 가벼운 일과 서브에이전트에는 GPT-5.4 mini를 쓰라고 적었습니다.
네 번째는 협업입니다. 대화 중에 곁가지 질문이 생기면 사이드 챗을 엽니다. 지금까지의 맥락을 그대로 물려받은 새 대화라서 처음부터 다시 설명할 필요가 없고, 휴대폰 앱에서도 /side로 바로 엽니다.
한 번 보여 준 작업을 반복시키는 기능도 있습니다. 6월 18일 나온 Record & Replay는 맥에서 사람이 한 번 시연한 작업을 스킬로 만들어 줍니다. 플러그인 화면의 + 메뉴에서 Record a skill을 고르고 평소처럼 일을 한 뒤 녹화를 멈추면, 코덱스가 언제 쓰는지와 필요한 입력, 단계, 결과 확인 방법을 적은 스킬 초안을 씁니다. 다음에는 새 스레드에서 그 스킬을 부르고 이번에 달라진 값만 알려 주면 됩니다. 컴퓨터 조작을 켜야 쓸 수 있고, 처음에는 유럽경제지역과 영국, 스위스가 빠졌습니다.
큰 일은 나눠서 동시에 돌립니다. 워크트리(같은 저장소를 따로 떼어 낸 작업 사본)에서 스레드를 여러 개 돌리거나, 서브에이전트에게 일을 쪼개 맡깁니다. 6월 20일 서브에이전트 문서는 코덱스가 서브에이전트를 스스로 띄우지 않아서 사용자가 에이전트 둘을 띄우라는 식으로 분명히 시켜야 한다고 적었습니다. 탐색과 테스트, 분류, 요약처럼 읽는 일이 많은 작업에 먼저 쓰고, 여러 에이전트가 동시에 코드를 고치는 일은 충돌이 날 수 있으니 조심하라고 했습니다.
나눠 돌린 만큼 토큰도 더 씁니다. 문서는 서브에이전트마다 모델과 도구를 따로 돌리기 때문에 같은 일을 에이전트 하나로 할 때보다 토큰이 더 든다고 밝혔습니다. 결과가 여럿 돌아오면 사람이 검토할 양도 늘어서, 일을 넘길수록 검증을 따로 두라는 조언은 Claude Code 팀이 사람이 넘길 판단을 네 종류로 나눈 글에도 나옵니다.
다섯 번째는 비용입니다. 발표에서는 이것을 가치 맥싱이라고 불렀습니다. 토큰을 아끼는 것보다 들인 비용에 비해 얼마나 많은 결과를 얻었는지가 중요하다는 말이고, 똑똑한 모델로 방향을 잡고 반복 실행은 가볍고 싼 모델에 맡기라는 팁이 붙었습니다.
7월 8일 요금 페이지를 보면 모델 선택이 곧 사용량입니다. 코덱스는 ChatGPT 무료 요금제부터 Go(월 8달러), Plus(월 20달러), Pro(월 100달러부터)까지 모든 요금제에 들어 있고, 5시간마다 보낼 수 있는 로컬 메시지 수가 모델마다 다르게 적혀 있습니다.
| 모델 | Plus | Pro 5배 | Pro 20배 |
|---|---|---|---|
| GPT-5.5 | 15~80개 | 75~400개 | 300~1,600개 |
| GPT-5.4 | 20~100개 | 100~500개 | 400~2,000개 |
| GPT-5.4 mini | 60~350개 | 300~1,750개 | 1,200~7,000개 |
같은 Plus 요금제에서 GPT-5.4 mini는 GPT-5.5보다 네 배쯤 많은 메시지를 보낼 수 있습니다. 로컬 메시지와 클라우드 작업은 같은 5시간 한도를 나눠 쓰고, 주간 한도가 따로 붙을 수 있습니다. 요금 페이지는 GPT-5.5가 GPT-5.4보다 훨씬 적은 토큰으로 비슷한 결과를 낸다고 적었고, 한도를 넘기면 ChatGPT 크레딧으로 늘립니다.
발표의 팁은 서브에이전트 문서의 모델 안내와 그대로 맞닿습니다. 문서는 계획과 도구 사용, 검증이 필요한 까다로운 에이전트에는 GPT-5.5를, 탐색이나 큰 파일 훑기처럼 속도가 중요한 일꾼 에이전트에는 GPT-5.4 mini를 쓰라고 적었습니다. 추론 강도도 검토나 보안을 맡은 에이전트는 높게, 대부분은 중간으로, 단순한 일은 낮게 두라고 했습니다. 계획과 검증에 비싼 모델을 두는 배분은 앤트로픽이 에이전트 하네스의 실패를 정리한 글에서도 다뤘습니다.
제가 덧붙인 팁도 하나 있습니다. 코덱스에 화면 디자인을 그냥 맡기면 어디서 본 듯한 모양이 나오기 쉬워서, 저는 원하는 화면을 먼저 이미지 생성으로 뽑은 뒤 코덱스에 이렇게 만들어 달라고 보여 줍니다. 목표 그림이 분명할수록 결과가 덜 평범해졌고, 그림을 뽑는 것도 번거로우면 디자인 규칙을 대신 얹어 주는 Product Design 플러그인을 켜 둡니다.

코덱스 자체에도 화면을 고치는 길이 있습니다. 앱 안 브라우저의 주석 모드에서 요소를 고르고 설정 아이콘을 누르면 글꼴과 글자, 간격, 색을 바꿔 페이지에서 바로 미리 본 뒤 그 주석을 코덱스에게 보낼 수 있습니다. 5월 21일 업데이트에 들어간 기능이고, 7월 5일 문서는 한 번에 검토할 수 있을 만큼 작업을 작게 나눠 맡기라고 적었습니다.
다섯 가지를 한꺼번에 켤 필요는 없습니다. 아래는 7월 초 문서에 적힌 명령과 설정만 순서대로 모은 것입니다.
문서에 적힌 첫 설정
/init
메모리
앱샷
Computer Use
/status
컴퓨터 조작과 Record & Replay, 메모리는 처음에 유럽경제지역과 영국, 스위스를 빼고 나왔고, 한국은 이 제외 목록에 들지 않았습니다. 다만 앱샷과 Record & Replay는 맥 전용이고, 윈도우의 컴퓨터 조작은 앞에서 본 대로 화면을 넘겨받습니다.
@OpenAIX 게시물 · 원문 보기
밋업 당일 낮에는 오픈AI가 GPT-5.6 Sol과 Terra, Luna를 이번 주 목요일에 공개한다고 알렸습니다. 위의 모델별 한도는 GPT-5.5 세대 기준이어서 새 모델이 나오면 표의 숫자도 달라집니다. 다섯 가지 기능은 모델과 상관없이 쓰는 것들이고, 새 모델이 나온 뒤 한도가 어떻게 달라졌는지 다시 전하겠습니다.
읽어 주셔서 고맙습니다.
초이 드림