앤트로픽은 Claude Code 주간 사용량을 “25% 늘린다”고 공지했지만 지금과 비교하면 약 17% 줄고, 오픈AI는 Codex·ChatGPT Work의 사용량 누수 버그를 고친 뒤 유료 사용자 사용량을 초기화했습니다. 새로 나온 Terminal-Bench 4.0에서는 Z.ai의 오픈웨이트 GLM-5.3 Max가 GPT-5.6 Sol Max를 앞섰습니다.
AI 인사이트
‘25% 증가’는 기본 한도를 기준으로 잰 숫자라, 한시 혜택이 붙은 지금의 150과 견주면 125로 줄어 앤트로픽 스스로도 약 17% 감소라고 밝혔습니다.
AI 인사이트
WebMCP에서는 웹사이트가 검색·장바구니·예약 같은 기능을 AI에 직접 알려 주므로, 에이전트가 화면에서 버튼을 찾지 않고 기능을 바로 호출합니다.
AI 인사이트
가중치를 직접 고쳤는데도 MaliciousInstruct 거부율 11%, JailbreakBench 12%가 남아, 안전장치가 한 부분에 몰려 있지 않을 가능성이 제기됐습니다.
AI 인사이트
이미지 압축 잔여물, 끝나지 않는 Memory·/goals 작업, 중복 처리된 MCP 결과처럼 사용자가 보지 못하는 곳에서 사용량이 빠져, 일부 사례는 주간 사용량의 15~70%를 썼습니다.
AI 인사이트
검색된 페이지 전체 대신 질문과 관련된 부분만 넘기므로, 에이전트 평가에서 전체 토큰은 30% 줄고 성능은 평균 2.1% 올랐습니다.
AI 인사이트
예약 작업은 사용자가 요청하지 않아도 정해진 일정에 ChatGPT가 스스로 실행하므로, 뉴스 요약이나 일정 확인 같은 반복 확인을 무료 계정에서도 맡길 수 있습니다.
AI 인사이트
15초 영상을 약 13초에 만드는 속도는 B200 GPU 4장 환경에서 나온 수치이고, 어려운 움직임과 일부 오디오는 원본 MiniMax H3보다 품질이 낮을 수 있습니다.
AI 인사이트
Nemotron 3 Nano 30B를 추론 기능을 끈 상태로도 도구를 정확히 부르게 학습해, GPT 5.6 Terra와 비슷한 정확도에서 응답 지연은 약 3분의 1, 비용은 약 18분의 1로 줄였습니다.
AI 인사이트
Suno는 이미 학습 데이터 저작권 소송을 겪고 있는데, 유출 자료에 YouTube Music 음악을 크롤러로 대규모 수집한 정황이 담겼다는 주장이 나왔고 자료의 진위는 아직 확인되지 않았습니다.
AI 인사이트
Terminal-Bench 4.0은 기존 평가에서 문제가 있던 작업을 고치거나 빼고 실행 시간과 CPU·메모리 조건을 다시 맞춘 새 평가입니다.
AI 인사이트
코딩 에이전트가 캐릭터 위치·물체 상태·규칙을 코드로 관리하고 비디오 모델은 화면만 그리므로, 긴 영상에서도 상태와 인과관계가 코드에 남아 유지됩니다.
AI 인사이트
PPE는 데이터 검색과 변수 구성, 모델 학습·평가를 자동으로 이어, 콩고 에볼라 예측에서 새로 확산된 18개 지역 중 15개를 찾았습니다.
AI 인사이트
논문을 넣으면 여러 Claude·Codex 에이전트가 동시에 구현과 실험을 돌리고 Tinker API로 강화학습 실험을 병렬로 이어, 논문 재현에 드는 사람 손이 줄어듭니다.
AI 인사이트
봇 설정을 템플릿으로 공유하면 다른 사용자가 클릭 몇 번으로 같은 구성의 에이전트를 쓰게 되어, 코딩·리서치·프로젝트 관리·로봇 제어용 템플릿이 이미 올라오고 있습니다.
AI 인사이트
시청자가 채팅에 입력한 프롬프트가 몇 초 뒤 영상에 반영되고 앞 화면과 이어지므로, 미리 만든 영상 없이 방송이 계속 생성됩니다.
AI 인사이트
Gemini 3 Deep Think가 실험 장비에 맞춘 합성법을 설계해 MoS₂·MoSe₂·WS₂ 단층 반도체를 첫 시도에 만들었고, 대장균 실험에서는 적은 데이터로 지표 4개 중 3개를 맞혔습니다.
AI 인사이트
컴퓨터 조작 에이전트를 강화학습으로 훈련하려면 실제 macOS가 도는 기기가 필요해, 오픈AI는 맥을 직접 사고 앤트로픽은 AWS에서 Mac mini를 빌려 씁니다.
같은 날 올라온 〈"AI 연구 인턴 목표 달성" 오픈AI, 같은 달 가장 큰 훈련은 멈췄습니다〉는 알렉스 히스 기자가 8월 두 주 동안 오픈AI 본사에 머물며 20명 넘게 인터뷰한 TIME 커버스토리를 정리했습니다.