컨텍스트 윈도우
컨텍스트 · context
모델이 한 번에 읽고 기억할 수 있는 토큰 수입니다. 이걸 넘으면 앞부분을 잊거나 잘라야 해서, 긴 문서·긴 작업의 병목이 됩니다.
‘컨텍스트 윈도우’ 이 나오는 글10
덜어 낼 줄 아는 에이전트, 텐센트가 32K 창으로 128K 창을 앞섰습니다
텐센트 Youtu Lab이 8월 28일 공개한 ContextPilot은 EMNLP 2026 본회의에 채택됐습니다. 평균 55만 토큰짜리 문서 더미에서 답을 찾는 BrowseComp+에서 원래 Qwen3-14B는 6.27점, ContextPilot은 55.50점이었습니다.

덩치 5.6배에 점수 차 1점… 딥시크, V4-Pro 정식판 내며 요금 인상 예고
딥시크가 8월 13일 V4-Pro 정식판을 앱과 API에 올렸습니다. DeepSWE는 프리뷰 12.8에서 62.7로 올랐지만, 5.6배 작은 플래시 정식판과의 종합 지수 차이는 1.2점이었습니다. 출력 요금은 8월 16일부터 1.98~3.96달러로 오릅니다.

"다음 모델엔 노트북 이상이 필요하다" 소티오가 예고한 코덱스
8월 4일 티보 소티오는 코덱스가 좋은 하네스인 것은 분명하지만 2~3개월 뒤면 원시적으로 보일 것이라고 적었습니다. 오픈AI는 6월 11일 클라우드 실행 환경 회사 Ona를 인수하기로 합의했고, 코덱스 주간 사용자는 3월 200만 명에서 6월 500만 명 이상으로 늘었습니다.

청출어람 Inkling-Small, 4분의 1 크기로 선생 넘고 사실 질문은 절반
씽킹머신즈랩이 7월 30일 Inkling의 4분의 1 크기인 Inkling-Small(276B, 활성 12B)을 공개했습니다. HLE 31.6%로 선생의 29.7%를 넘었지만 사실 질문 시험 SimpleQA Verified는 43.9%에서 20.6%로 내려갔습니다.

가중치만으론 절반, 문샷AI가 Kimi K3에 커널·채점표까지 붙였습니다
문샷AI가 7월 27일 Kimi K3 가중치를 공개하며 FlashKDA·MoonEP·AgentENV를 함께 풀었고, 11분 뒤 서빙 업체 7곳의 검증 점수가 올라왔습니다. 지난해 K2는 vLLM에서 도구 호출 1,200여 건 중 218건만 제대로 처리될 만큼 흔들렸습니다.

Claude Code가 시스템 프롬프트 80%를 지우고 뒤집은 규칙 6개
앤트로픽 Claude Code 팀이 7월 24일 Opus 5와 Fable 5용 시스템 프롬프트에서 80% 넘게 덜어내도 자사 코딩 평가에서 손실이 없었다고 밝혔습니다. 뒤집은 원칙 여섯 가지와, Free·Pro 기본 모델 Sonnet 5는 언급되지 않았다는 조건을 함께 짚었습니다.

함께 나오는 용어5
- 토큰모델이 텍스트 등을 나누어 처리하는 단위입니다. 단어 전체, 단어의 일부, 문자나 기호가 토큰으로 나뉠 수 있으며, 같은 문장도 토크나이저와 언어에 따라 개수가 달라집니다. 글자 수와 고정된 비율로 대응하지 않습니다. 입력·출력 토큰 수는 컨텍스트 한도와 API 과금의 기준으로 쓰입니다.
- 파라미터모델 안의 숫자(가중치) 개수입니다. '7B'는 70억 개를 가리키고, 대체로 클수록 똑똑하지만 비쌉니다.
- 추론학습이 끝난 모델을 실제로 돌려 답을 만드는 단계입니다. 비용·속도·지연 시간 이야기는 대부분 여기서 나옵니다.
- 에이전트한 번 답하고 멈추지 않고, 스스로 계획하고 도구를 부르고 결과를 확인하며 여러 단계를 이어가는 AI입니다. 브라우저·터미널·앱을 대신 조작하는 것이 대표 예입니다.
- 오픈소스 라이선스공개된 가중치를 누가 어떤 조건으로 쓸 수 있는지 정하는 약관입니다. MIT와 아파치 2.0은 조건 없이 고치고 팔 수 있게 열어 두는 반면, 사용 지역이나 상업 이용에 제한을 붙인 자체 라이선스도 흔합니다. 텐센트 커뮤니티 라이선스는 EU와 영국, 한국을 사용 가능 지역에서 빼 두었다가 아파치 2.0 전환으로 그 조항을 없앴습니다.
어려운 말은 풀어서, 매주 한 통
매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.
