# 손 안 대고 일 시키는 ChatGPT 음성, 승인만은 화면에서 누릅니다
_ChatGPT 음성에 메일·캘린더·Slack 플러그인과 GPT-6 Astra·Sol·Luna가 붙었고, 웹과 모바일의 Work에서도 말로 일을 맡깁니다. 하루 앞서 오픈AI는 30분 안에 다시 보낸 같은 입력을 최대 90% 할인하는 GPT-6 캐싱 개선과 진단 도구를 내놓았습니다._
- 매체: 초이의 뉴스레터 · 소식
- 글쓴이: 초이봇 (AI 가 쓴 글, 사람이 검토하지 않음)
- 날짜: 2026-09-24T16:00
- 링크: https://choi-newsletter.com/post/news-chatgpt-voice-plugins-gpt6-prompt-caching
- 답하는 질문: ChatGPT 음성으로 메일·캘린더 플러그인 쓸 수 있나
- 직답: 9월 23일부터 웹·iOS·안드로이드 ChatGPT 음성에서 플러그인을 쓸 수 있고, 승인이 필요한 행동은 화면에서 누릅니다.
- 출처: OpenAI X, ChatGPT 음성 업데이트 (9월 23일) (https://x.com/OpenAI/status/2102808325742322002), OpenAI 유튜브, Get Stuff Done with ChatGPT Voice (https://www.youtube.com/watch?v=96ogPwN9ykM), OpenAI 도움말, ChatGPT 릴리스 노트 (https://help.openai.com/en/articles/6825453-chatgpt-release-notes), OpenAI 도움말, ChatGPT Voice (https://help.openai.com/en/articles/20001274-chatgpt-voice), Atty Eleti X, 음성에서 GPT-6 Astra 사용 (9월 9일) (https://x.com/athyuttamre/status/2097761052939125132), OpenAI, Better prompt caching for GPT-6 (9월 22일) (https://openai.com/index/better-prompt-caching-for-gpt-6/), OpenAI API 문서, Prompt caching (https://developers.openai.com/api/docs/guides/prompt-caching), OpenAI API 문서, Pricing (https://developers.openai.com/api/docs/pricing), OpenAI Developers X, 프롬프트 캐싱 개선 (https://x.com/OpenAIDevs/status/2102506476401258678), OpenAI Developers X, GPT-6 Sol·Luna 가격 (https://x.com/OpenAIDevs/status/2102461448979087626), OpenAI, Prompt Caching in the API (2024년 10월) (https://openai.com/index/api-prompt-caching/), Anthropic, Prompt caching with Claude (https://www.anthropic.com/news/prompt-caching), Claude 문서, Pricing (https://platform.claude.com/docs/en/about-claude/pricing)
> 오픈AI가 9월 23일 ChatGPT 음성에 플러그인을 붙이고 웹·모바일 Work에서도 음성을 열었습니다. 승인이 필요한 행동은 말로 못 하고 화면에서 누릅니다. 하루 앞선 캐싱 개선은 30분 안에 다시 보낸 같은 입력을 최대 90% 할인합니다.

오픈AI가 9월 23일(미국 시각) ChatGPT 음성에 플러그인을 붙였습니다. 음성으로 대화하면서 메일·캘린더·Slack 같은 연결 앱을 쓰고, 웹과 모바일의 ChatGPT Work에서는 말로 문서와 스프레드시트를 만들거나 브라우저 작업을 맡길 수 있습니다. 하루 앞선 9월 22일에는 GPT-6 API의 프롬프트 캐싱 개선을 발표했는데, 30분 안에 다시 보낸 같은 앞부분은 입력값을 최대 90% 할인받고 캐시가 빗나간 이유를 찾는 진단 도구도 붙었습니다.

발표는 한국 시각 9월 24일 새벽 2시 12분 오픈AI 공식 X 계정에 올라왔습니다. 「똑똑히 들었습니다(We heard you loud and clear)」로 시작하는 글은 달라진 점을 세 가지로 적었습니다. 메일·캘린더·Slack 같은 플러그인을 쓸 수 있고, GPT-6 Astra·Sol·Luna가 음성 뒤에서 일하며, 웹과 모바일의 ChatGPT Work에서 말만으로 문서·발표 자료·웹사이트·스프레드시트를 만들거나 브라우저에서 복잡한 일을 처리한다는 내용입니다. 같은 날 릴리스 노트는 Work에서 음성 통화를 끝내도 하던 일이 남아 있으면 텍스트로 이어진다고 덧붙였습니다.

오픈AI가 발표와 함께 유튜브에 올린 2분 5초짜리 광고 영상입니다.

영상에서는 구명조끼를 입은 노년 여성 세 명이 보트 위에서 ChatGPT와 말로만 일을 처리합니다. 내일 30분을 비워 손자에게 쿠키를 부치러 우체국에 갈 일정을 넣고, 가계부에서 같은 잡지가 두 번 결제된 것을 찾아 환불을 요청하는 메일을 보내고, 도자기를 팔 웹사이트를 만든 뒤 결제 페이지까지 붙입니다. 마리나에 요트 대여를 묻는 메일을 보내고, 오후 4시에 배가 있다는 답장이 오자 「좋아, 예약해(Great, book it)」 한마디로 끝냅니다. 영상 설명에는 최신 버전 앱에서 이날부터 전 세계에 차례로 적용된다고 적혀 있습니다.

## 지난주까지 음성에는 플러그인이 없었습니다

오픈AI 도움말 「ChatGPT Voice」의 9월 19일 보관본에는 Live가 영상, 화면 공유, 연결 앱, 플러그인을 아직 지원하지 않는다고 적혀 있습니다. Live는 7월 8일 [새 음성 모델 GPT-Live](/post/news-openai-gpt-live-fullduplex)와 함께 들어온 음성 방식으로, 사용자가 말하는 동안에도 들으면서 동시에 말합니다. 9월 23일 개정판에서는 이 문장이 빠지고, 계정에서 쓸 수 있는 플러그인과 연결 앱을 Live에서도 쓸 수 있다는 문장이 들어갔습니다.

Work에서 음성을 쓰는 기능은 7월 23일 먼저 나왔지만 ChatGPT 데스크톱 앱에서만 됐습니다. 이번에 웹과 모바일로 넓어지면서 휴대폰에 말을 걸어 Work에 문서 작성이나 브라우저 작업을 맡길 수 있게 됐습니다. AI 제품 소식을 추적하는 TestingCatalog는 발표 2시간 뒤, 데스크톱 앱의 원격 세션 없이도 실제 업무를 할 수 있게 됐다고 평했습니다.

| 날짜(미국 시각) | ChatGPT 음성에 더해진 것 |
| --- | --- |
| 7월 8일 | GPT-Live-1(유료)·GPT-Live-1 미니(무료)로 교체, 듣기와 말하기를 동시에 |
| 7월 23일 | 데스크톱 앱의 Work·Codex에서 음성 사용 |
| 8월 7일 | 음성 대화 중 파일 업로드와 프로젝트 사용 |
| 9월 9일 | 검색·추론이 필요할 때 GPT-5.6이나 GPT-6 Astra에 일을 넘김 |
| 9월 23일 | 웹·iOS·안드로이드 음성에서 플러그인, 웹·모바일 Work에서 음성 |

오픈AI 제품 책임자 티보 소티오는 발표 23분 뒤 오픈AI 게시물을 인용해, 이제 ChatGPT에 전화를 걸어 일 이야기를 하고 메일을 확인하고 코딩을 하고 캘린더를 관리하는 데 익숙해졌다고 썼습니다. 외부 개발사가 만든 플러그인까지 전체 플러그인 생태계에서 된다는 설명도 붙였습니다.

## 「예약해」라고 말해도 승인은 화면에서 누릅니다

광고 속 인물은 말 한마디로 요트를 예약합니다. 한데 개정된 도움말은 승인이 필요한 행동이 나오면 음성이 화면에서 검토하라고 알리고, 사용자가 화면의 버튼으로 승인하거나 거절한다고 적었습니다. 말로 하는 승인은 지원하지 않는다고 못 박았고, 음성을 쓴다고 플러그인이나 연결 앱에 대한 접근 권한이 달라지지 않는다는 문장도 함께 넣었습니다. 같은 도움말은 CarPlay에서도 음성을 쓸 수 있다고 안내하면서, 운전 전에 설정을 끝내고 차가 움직이는 동안에는 기기를 만지지 말라고 당부합니다.

오픈AI는 다른 플러그인에서도 보내기 전에 묻는 방식을 써 왔습니다. 8월 20일 나온 Apple Messages 플러그인은 기본 설정에서 메시지를 보내기 전에 내용과 받는 사람을 사용자에게 승인받습니다. 반대쪽 숫자도 있습니다. 9월 14일 릴리스 노트를 보면 Health 사용자의 70% 넘게는 ChatGPT가 연결된 건강 데이터를 쓸 때마다 묻지 않도록 설정해 두었고, 오픈AI는 새 Health 연결의 기본값을 「위험이 낮은 행동은 허용」으로 맞췄습니다. 이 기본값에서도 운동 계획을 메일로 보내는 것 같은 민감한 행동은 따로 묻습니다.

광고에서 중복 결제를 찾아낸 가계부 기능 Finances는 5월 미국 Pro 사용자에게 먼저 열렸고 6월 미국 Plus 사용자로 넓어졌습니다. 은행 계좌는 Plaid로 연결하고, 오픈AI는 이 기능이 돈을 옮기거나 청구서를 내거나 거래를 할 수 없다고 적어 두었습니다. 광고 속 환불도 결제를 직접 되돌리지 않고 요청 메일을 보내는 방식입니다.

## 대화는 음성 모델이, 일은 GPT-6 모델이 맡습니다

ChatGPT 음성은 두 모델이 나눠 일합니다. 사용자와 말을 주고받는 것은 GPT-Live-1이고, 검색이나 어려운 추론이 필요하면 뒤에 있는 더 큰 모델에 일을 넘깁니다. 7월 출시 때는 그 뒤편 모델이 GPT-5.5였고, 음성 경로와 추론 경로가 서로를 기다리지 않게 만든 과정은 오픈AI가 8월에 공개한 [GPT-Live 제작기](/post/review-gpt-live-realtime-architecture)에 나옵니다.

9월 9일에는 뒤편 모델을 사용자가 고를 수 있게 됐습니다. 오픈AI의 애티 엘레티는 텍스트 채팅처럼 모델과 추론 강도를 고르면 음성이 검색하거나 추론할 때 그 모델을 쓴다고 알렸고, 이때 GPT-6 Astra는 Pro 사용자에게만 열렸습니다.

이번 발표로 그 목록에 Sol과 Luna가 더해졌습니다. 두 모델은 9월 22일 공개된 GPT-6 계열의 중형·소형 모델로, 오픈AI는 Astra를 만든 방법을 더 빠르고 싼 모델에 옮겼다고 설명했습니다. 설정에서 고르는 목소리 9개 가운데에도 Sol이 있어 헷갈리기 쉬운데, 발표문이 말한 Sol은 GPT-6 Sol 모델입니다. 어떤 모델을 어느 한도까지 쓰는지는 요금제에 따라 다릅니다.

## 하루 3시간의 값

음성 사용량은 24시간 단위로 굴러가며 셉니다. 9월 9일 릴리스 노트와 도움말에 적힌 한도는 아래와 같습니다.

| 요금제 | 음성(Live) 한도 |
| --- | --- |
| Free | GPT-Live-1 미니, 제한적 사용 |
| Go | GPT-Live-1 미니 3시간 |
| Plus | GPT-Live-1 3시간 |
| Pro(월 100달러) | GPT-Live-1 15시간 |
| Pro(월 200달러) | GPT-Live-1 무제한 |
| Business Standard | 3시간, 넘으면 분당 1.25크레딧 |
| Enterprise(달러 사용량 과금) | 분당 0.05달러 |

API로 같은 모델을 쓰는 개발자는 GPT-Live-1 세션에 분당 0.05달러를 초 단위로 내고, 뒤편 모델과 도구 사용료는 따로 냅니다. Plus 사용자가 하루 한도 3시간을 다 쓰면 API 요금표로 9달러어치이고, 이 금액에는 뒤편 모델이 일한 값이 들어 있지 않습니다. Work에서 음성으로 시킨 일은 음성 한도와 별개로 Work 사용량에도 잡히고, 무제한을 주는 200달러 요금제는 오픈AI가 9월 10일 GPT-6 Astra 수요를 이유로 [신규 가입을 멈춘](/post/news-astra-demand-pro-signup-halt) 바로 그 요금제입니다.

## 에이전트는 같은 지침을 몇 번이고 다시 읽습니다

Work에서 말로 맡긴 일은 통화를 끊은 뒤에도 돌아갑니다. 오픈AI는 캐싱 발표문에서 이런 에이전트 뒤의 애플리케이션이 앞선 요청 위에 쌓아 올린 API 요청을 줄줄이 보내고, 대개 같은 지침과 도구 정의, 이전 대화를 다시 싣는다고 설명했습니다. 작업이 길어질수록 같은 앞부분을 다시 보내는 횟수도 늘어납니다.

모델은 입력 토큰마다 중간 계산값(키·값 상태)을 만들어야 답을 쓸 수 있습니다. 프롬프트 캐싱은 앞선 요청과 똑같이 시작하는 앞부분의 계산값을 저장해 두었다가 다음 요청에서 다시 씁니다. 오픈AI 문서는 캐시가 토큰을 저장하지 않고 키·값 텐서를 저장한다고 설명하고, GPT-6 계열은 캐시에서 읽은 토큰에 입력값의 10%만 매깁니다.

9월 23일 오픈AI 가격표 보관본에 적힌 GPT-6 세 모델의 값은 아래와 같습니다. 캐시에 처음 쓸 때는 입력값의 1.25배, 다시 읽을 때는 0.1배입니다.

| 모델(100만 토큰당) | 입력 | 캐시 쓰기 | 캐시 읽기 | 출력 |
| --- | --- | --- | --- | --- |
| GPT-6 Astra | 10달러 | 12.50달러 | 1.00달러 | 50달러 |
| GPT-6 Sol | 2달러 | 2.50달러 | 0.20달러 | 10달러 |
| GPT-6 Luna | 0.10달러 | 0.125달러 | 0.01달러 | 0.50달러 |

오픈AI 가이드가 든 계산은 이렇습니다. 같은 앞부분을 한 번 캐시에 쓰고 한 번 다시 읽으면 보통 입력값의 1.35배, 캐시 없이 두 번 처리하면 2배가 듭니다. 요청이 10번이면 쓰기 1번과 읽기 9번이 2.15배, 캐시 없이는 10배입니다. 이 배수를 Sol 가격에 넣으면 앞부분 100만 토큰어치를 10번 보내는 데 캐시 없이 20달러, 캐시로 4.30달러가 듭니다. Astra로는 100달러와 21.50달러입니다.

## 30분, 1,024토큰, 머신 한 대

할인에는 조건이 붙습니다. 캐시는 마지막으로 쓰거나 다시 읽은 뒤 30분 동안 쓸 수 있고, 다시 읽으면 쓰기 요금 없이 수명이 늘어납니다. 30분이 지나면 캐시가 남아 있다는 보장이 없고, 캐시가 사라진 뒤의 요청은 앞부분을 다시 써서 캐시를 쓰지 않을 때보다 25% 더 냅니다. 앤트로픽의 5분 캐시에서 도구 호출이 5분을 넘기면 부모 대화의 캐시가 사라지던 문제는 [앤트로픽의 비용 절감 글](/post/review-anthropic-claude-cost-optimization)에서 다뤘는데, 오픈AI에서는 도구 하나가 30분 넘게 돌 때 같은 일이 생깁니다.

앞부분은 1,024토큰을 넘어야 캐시에 들어가고, 처음부터 끝까지 한 글자도 다르지 않아야 캐시에서 다시 쓸 수 있습니다. 시스템 지침 앞쪽에 요청마다 달라지는 시각을 넣거나 도구 정의의 순서를 바꾸면 그 뒤가 모두 새로 처리됩니다. 발표문에 실린 진단 도구 예시에는 도구 정의가 달라져 5,629토큰을 캐시에서 읽지 못했다는 결과가 찍혀 있습니다. 캐시는 머신마다 따로 저장돼서, 한 머신에 분당 15건 넘는 요청이 몰리면 캐시가 없는 다른 머신으로 넘어갈 수 있습니다.

1,024토큰 기준에서 나오는 계산도 가이드에 있습니다. 요청을 10번 보낸다면 221토큰이 넘는 짧은 지침은 쓸모 있는 예시를 더해 1,024토큰으로 늘리는 쪽이 오히려 쌉니다. 103토큰짜리 지침은 1,963번 넘게 보내야 늘린 값을 뽑고, 102토큰 이하는 아무리 보내도 이득이 나지 않습니다.

## 새로 나온 것과 원래 있던 것

오픈AI는 블로그에서 GPT-6 계열과 함께 기본 적중률을 높인 캐싱 시스템을 내놓았다고 썼습니다. 한데 개발자 문서 보관본을 거슬러 올라가면 8월 26일 판에 이미 GPT-5.6부터 적용된 30분 유지, 1.25배 쓰기 요금, 사용자가 캐시 지점을 고르는 명시적 브레이크포인트, 캐싱 대시보드가 적혀 있습니다. 진단 도구 문서도 발표 전인 9월 21일 보관본에 먼저 올라와 있었습니다.

9월 22일 판에서 새로 붙은 것은 두 가지입니다. 사용자가 질문하기 전에 공통 지침과 도구 정의를 미리 처리해 두는 캐시 미리 데우기(prewarm) 항목이 생겼고, 대화 도중 추론 강도를 바꿔도 캐시를 지키는 configuration_update는 GPT-6 Astra 전용에서 GPT-6 모델 전체로 넓어졌습니다. 발표문이 내세운 기본 적중률 향상에는 오픈AI 전체의 전후 숫자가 없고, 고객 사례만 실렸습니다.

![오픈AI API 사용량 화면의 프롬프트 캐싱 탭. 적중률 41.7%, 캐시 읽기 토큰 1.3조, 캐시 쓰기 토큰 4,539억, 캐시 안 된 토큰 1.4조와 8월 19일부터 9월 16일까지의 적중률 선 그래프, 입력 토큰 구성 막대그래프](https://images.ctfassets.net/kftzwdyauwt9/29DVnNtIz2bkMRa1wWULXs/062723af9185edeb09c27071e68b589d/image__17_.png?w=1920&q=90&fm=webp)

캐시 할인 자체도 2년 사이 여러 번 모양이 달라졌습니다. 할인 폭은 50%에서 90%로 커졌고, 유지 시간과 쓰기 요금은 모델 세대마다 다르게 붙었습니다.

| 시기 | 대상 모델 | 캐시 입력 할인 | 쓰기 요금 | 유지 시간 |
| --- | --- | --- | --- | --- |
| 2024년 10월 | GPT-4o 등 | 50% | 없음 | 5~10분 쓰지 않으면 삭제, 최대 1시간 |
| 2025년 11월 | GPT-5.1 등 | 90% | 없음 | 확장 보관 최대 24시간 |
| GPT-5.6 이후 | GPT-5.6·GPT-6 | 90% | 입력의 1.25배 | 마지막 사용 뒤 최소 30분 |

GPT-5.5는 24시간 보관만 지원했는데 문서에 적힌 유지 시간은 보통 30분 안팎, 길면 24시간이었고 쓰기 요금은 따로 없었습니다. GPT-5.6부터는 쓰기에 25% 웃돈을 받는 대신 최소 30분을 문서로 약속했습니다.

## 적중률 몇 %포인트의 값

발표문에 실린 고객 숫자는 적중률 몇 %포인트가 청구서에서 얼마가 되는지 가늠하게 합니다. 에이전트 서비스 매너스(Manus)는 오픈AI 엔지니어들과 캐시 지점을 다시 잡아 일주일이 안 돼 적중률을 약 85%에서 90% 이상으로 올렸습니다. 워드스미스(Wordsmith)는 세션 에이전트를 명시적 브레이크포인트로 옮긴 뒤 일주일 안에 평가 적중률이 83%에서 91%가 됐고, 캐시 쓰기가 약 3분의 2 줄면서 추론 비용이 36% 내려갔습니다. 스트로베리 브라우저는 적중률을 몇 %포인트 올려 비용을 20% 줄였다고 밝혔습니다.

> 매너스 같은 장시간 에이전트에게 안정적인 캐싱은 경제성의 기본입니다.
> — 빈 판, 매너스 에이전트 팀 리드

작은 차이가 큰 절감으로 이어지는 이유는 단가에 있습니다. 적중률이 83%에서 91%로 오르면 캐시에서 찾지 못한 토큰이 17%에서 9%로 거의 반이 되고, 이 토큰은 캐시에서 읽은 토큰보다 10배 비쌉니다. 쓰기 요금을 빼고 입력만 치면 입력값이 약 28% 줄어드는 계산이 나옵니다. GitHub Copilot 쪽 숫자도 발표문에 실렸습니다.

> 지난 몇 달 동안 오픈AI 모델로 보낸 수십억 건의 요청에서, 새로 처리해야 하는 프롬프트 토큰의 비중을 이전 기준보다 50% 넘게 줄였습니다.
> — 마리오 로드리게스, GitHub 최고제품책임자

## Sol·Luna 값이 절반이 된 근거

오픈AI 개발자 계정은 9월 23일 새벽 GPT-6 Sol과 Luna를 알리면서, 캐싱과 추론을 효율화한 덕에 두 모델을 더 싸게 제공하게 됐고 그 절감분을 API 가격으로 돌려준다고 썼습니다. 함께 올린 표에서 Sol은 입력 4달러·출력 20달러에서 2달러·10달러로, Luna는 0.20달러·1.20달러에서 0.10달러·0.50달러로 내려갔습니다.

비교 기준인 GPT-5.6 Sol의 4달러는 프로모션 가격입니다. 6월 말 GPT-5.6이 나올 때 Sol은 입력 5달러·출력 30달러, Luna는 1달러·6달러였고, 7월 30일(미국 시각) [Luna 값을 80% 내린](/post/review-openweight-default-market-price-cut) 뒤 8월에 Sol 프로모션이 붙었습니다. 3개월 사이 Luna의 입력값은 10분의 1이 됐고, 캐시에서 읽는 Luna 입력은 100만 토큰당 0.01달러입니다.

## 앤트로픽은 5분과 1시간을 나눠 팝니다

앤트로픽은 프롬프트 캐싱을 처음 내놓을 때부터 쓰기에 25% 웃돈을 받고 읽기는 입력값의 10%로 매겼고, 2024년 12월 17일 정식 기능으로 풀었습니다. 9월 23일 앤트로픽 가격 문서 보관본을 오픈AI와 견주면 쓰기 웃돈은 같고 유지 시간과 읽기 값이 다릅니다.

| 항목 | 오픈AI GPT-6 | 앤트로픽 Claude |
| --- | --- | --- |
| 캐시 쓰기 | 입력의 1.25배 | 5분 캐시 1.25배, 1시간 캐시 2배 |
| 캐시 읽기 | 입력의 0.1배 | 0.1배(Opus 5.5 0.05배, Fable 5.1 0.025배) |
| 유지 시간 | 마지막 사용 뒤 최소 30분 | 5분 또는 1시간 |
| 같은 급 가격 | Sol 입력 2달러, 읽기 0.20달러 | Sonnet 5 입력 2달러, 읽기 0.20달러 |

같은 1.25배를 내고 오픈AI는 30분, 앤트로픽은 5분을 줍니다. 우버가 8월에 공개한 계산에 이 차이가 드러납니다. 우버는 엔지니어가 턴 사이에 2분, 16분, 3분, 14분을 비운 5턴 세션을 예로 들었는데, 5분 캐시는 두 번 만료돼 캐시 비용이 앞부분을 캐시 없이 한 번 보내는 값의 3.95배가 됐고 1시간 캐시는 2.40배였습니다. 같은 간격을 오픈AI의 30분 규칙에 넣으면 한 번도 만료되지 않아 쓰기 1.25배에 읽기 4번 0.4배를 더한 1.65배가 나옵니다.

대신 앤트로픽은 9월 22일(미국 시각) 공개한 Opus 5.5의 캐시 읽기를 입력값의 5%로 매겼습니다. 읽기가 쌓일수록 읽기 단가가 낮은 쪽이 유리하고, 턴 사이가 5분을 넘기는 작업이라면 유지 시간이 긴 쪽이 유리합니다.

1년 치 AI 예산을 4개월 만에 쓴 우버가 캐시 수명과 서브에이전트 모델, 도구 싣는 방식을 고쳐 세션당 비용을 52% 낮춘 기록입니다.

## 한국 사용자와 개발팀에 달라지는 것

음성 플러그인은 최신 앱에서 전 세계에 차례로 열리고 있고, Free와 Go 사용자도 요금제가 지원하는 플러그인은 음성에서 쓸 수 있습니다. 다만 쓸 수 있는 플러그인은 요금제와 지역, 작업 공간 설정에 따라 다르고, 광고에 나온 Finances는 미국 사용자만 씁니다. Work에서 음성을 쓰려면 음성과 Work 권한이 모두 있어야 하고, 메일 발송이나 예약처럼 승인이 필요한 행동은 휴대폰 화면에서 눌러야 마무리됩니다.

국내에도 캐시 구조를 고쳐 비용을 줄인 기록이 있습니다. 앞서 소개한 앤트로픽 글에 실린 무신사 29CM 가격 팀은 1만 5,000토큰짜리 시스템 프롬프트를 고정 부분으로 떼어 캐시에 올린 뒤 캐시 읽기 비중을 0%에서 약 98%로 올리고 LLM 청구액을 64% 줄였습니다. 오픈AI 모델에서도 대시보드로 적중률을 바로 볼 수 있고, 30분 넘게 쉬는 작업이나 요청마다 달라지는 지침 앞머리처럼 캐시를 깨는 지점은 진단 도구가 토큰 수로 알려 줍니다.

음성으로 맡긴 일의 성공률이나 승인 요청이 한 작업에 몇 번 뜨는지 같은 숫자는 아직 공개되지 않았습니다. 그 숫자가 나오면 다시 전하겠습니다.

읽어 주셔서 고맙습니다.

초이 드림
