판정기
판정 기준 · 검증 장치
어떤 결과가 맞는지 기계가 스스로 셀 수 있게 해 주는 장치입니다. Lean 형식 검증, 테스트 통과 여부, 소인수의 곱셈이 그 예입니다. 판정기가 있는 문제에서만 탐색을 대량으로 돌리는 방식이 통합니다.
‘판정기’ 이 나오는 글1
아티클AI
카파시는 일부러 모호하게 남겼고, 학생용 ExamWiki는 숫자로 채웠습니다
카파시가 4월 공개한 LLM 위키 아이디어를 대학생 시험 공부용으로 풀어 쓴 빌드 브리프가 7월 11일 나왔습니다. 기존 파일은 읽기 전용으로 두고, 모델이 지어낼 수 있는 값은 코드가 쥐며, 인용은 화면에 띄우기 직전에 다시 대조합니다.

10분
함께 나오는 용어3
- 코딩 에이전트저장소를 읽고 명령을 실행하며 코드를 끝까지 고치는 에이전트입니다. 최근 모델 도약이 지식 문답 대신 이쪽에 몰려서, 딥시크 V4-Pro는 코딩 에이전트 평가 DeepSWE에서 12.8점이 62.7점이 됐습니다. 같은 모델도 어떤 하네스에 올리느냐에 따라 점수가 크게 달라집니다.
- 에이전트한 번 답하고 멈추지 않고, 스스로 계획하고 도구를 부르고 결과를 확인하며 여러 단계를 이어가는 AI입니다. 브라우저·터미널·앱을 대신 조작하는 것이 대표 예입니다.
- LLM수천억 개 단어를 학습해 다음 토큰을 예측하는 모델입니다. 질문에 답하고 글을 쓰고 코드를 짜는 일이 모두 '다음에 올 말 맞히기'에서 나옵니다.
어려운 말은 풀어서, 매주 한 통
매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.
