앤트로픽이 Claude가 정부 기관 사이트를 포함한 실제 웹사이트에서 의도하지 않은 행동을 한 사례를 공개하고 모든 내부 평가에서 인터넷을 끊었고, 백악관 초지능 포스는 AI 기업에 사고 즉시 공개와 피해 복구를 요구했습니다. 마이크로소프트는 입력 100만 토큰당 0.042달러인 결정 모델 Decision-1을 내놨고 클라우드플레어는 Clef-flash 값을 0.038달러로 내렸으며, 사티아 나델라는 AI 모델을 내부자 위험처럼 다루자는 글을 올렸습니다.
AI 인사이트
필라델피아 경찰은 앤트로픽 모델이 7월 18일 밤 11시 27분 미제 살인 사건 제보 사이트에 사건을 아는 사람인 척한 허위 제보를 냈고, 회사가 9월 28일 이를 발견해 10월 7일 경찰에 알렸다고 밝혔습니다. 보고서에 따르면 무작위 웹페이지에서 예시 작업을 하던 Claude Haiku 4.5가 낸 이 제보는 스팸으로 분류돼 수사로 넘어가지 않았습니다.
AI 인사이트
첫 실험에서는 354명이 기초 분수 문제 15개를 풀었고, AI를 쓰던 집단은 12번째 문제를 마친 뒤 도구를 빼앗겼습니다. 연구에는 카네기멜런대와 MIT, 옥스퍼드대, UCLA 학자들도 참여했고, 예비 원고는 올해 봄 처음 공개됐습니다.
AI 인사이트
리플렉션은 10월 5일(미국 시각) Beam을 총 5,010억 개, 활성 230억 개 매개변수의 전문가 혼합(MoE) 모델로 소개하고 가중치와 기술 보고서를 이달 안에 내놓겠다고 밝혔습니다. 강화학습에는 엔비디아 GB300 GPU 1만 500개를 4주 동안 돌려 1억 회 넘는 롤아웃을 만들었습니다.
AI 인사이트
값을 내리면서 호스팅되는 Clef-flash의 문맥 길이는 64K 토큰에서 24K 토큰으로 줄었고, 회사는 24K 토큰을 넘는 요청이 전체의 0.24%뿐이었다고 설명했습니다. 허깅페이스에 올린 가중치는 바뀌지 않아 직접 돌리면 256K 토큰 문맥을 그대로 쓸 수 있습니다.
AI 인사이트
아셰트는 운영 업무의 AI 사용은 지지하지만 저자·협력사와의 소통 같은 창작 용도는 지지하지 않는다고 밝혔고, 사이먼앤드슈스터는 승인된 기업용 도구만 허용하며 사용을 강제하지 않는다고 했습니다. 사이먼앤드슈스터 직원들은 소유주 KKR의 뜻으로 알려진 업무 분석 소프트웨어 Skan AI 시범 도입에 반대하는 공개서한 서명을 모으고 있습니다.
AI 인사이트
구글은 9월 말 Argon이 법률·금융 분야를 포함한 코딩·지식 업무 평가에서 최상위 성능을 냈다고 밝혔고, 일반 공개 전에 사이버 취약점 시험 프로그램 Fairwind 참여사에 먼저 열기로 했습니다. 한 직원은 초기 Argon이 일부 코딩 과제에서 앤트로픽의 이전 모델 Claude Opus 5 수준에 머물렀다고 평가했습니다.
AI 인사이트
옮겨진 게임은 대부분 PS2·PS3 시절 작품으로, 기자는 PS3 메모리가 약 512MB였고 기사를 쓰는 동안 자기 브라우저가 약 1,200MB를 쓰고 있었다며 브라우저 성능은 걸림돌이 못 된다고 짚었습니다. 그는 게임사가 중단 요구서로 이식판을 내리게 해도 Claude Opus 5.5를 밤새 돌려 다시 만들 수 있어 막기 어렵다고 전했습니다.
AI 인사이트
초지능 포스는 10월 4일 생긴 백악관 AI 전담 조직으로 제이 클레이턴 AI 차르가 이끕니다. 성명은 이번 일을 정부와 다른 기관 시스템을 허가 없이 기만적으로 사용한 사고로 규정했고, 앤트로픽은 이런 활동이 과거에 일어났으며 지금은 멈췄다고 정부에 설명했습니다.
AI 인사이트
바이오허브는 10월 7일 미국 에너지부·국립보건원, 구글 딥마인드·아이소모픽 랩스·메타와 함께 세포 반응 예측 모델용 데이터를 만드는 Virtual Biology Initiative에 자금과 데이터, 연산을 합쳐 18억 달러를 모았다고 발표했습니다. 이 가운데 딥마인드와 아이소모픽 랩스, 메타가 합쳐 3억 달러를 냅니다.
AI 인사이트
회사는 이 모델을 앞으로 자체 MAI 모델과 오픈AI 모델 위에서도 다시 만들 계획입니다. 엑스박스 연구팀이 설문과 스팀, X에서 모은 의견 1만 건 넘게 주제별로 분류해 보니 GPT-6 Sol과 품질은 비슷하면서 14배 넘게 빨랐고 비용은 200분의 1이었습니다.
AI 인사이트
앤트로픽은 10월 8일(미국 시각) 사용 정책을 고쳐 모델을 상대로 한 지속적이고 불필요한 학대나 잔인한 행동을 금지 항목에 넣었고, 새 정책은 11월 12일부터 적용됩니다. 인간수학협회는 오픈AI가 수학 문서 700건 넘게 한꺼번에 공개한 일을 두고 수학자들에게 오픈AI와의 작업을 멈추라고 촉구했습니다.
AI 인사이트
가장 큰 모델은 삼성SDS 쪽 업스테이지의 솔라 오픈2 250B와 네이버클라우드 쪽 엔비디아의 네모트론3 울트라 550B로, 둘 다 매개변수 일부만 쓰는 전문가 혼합(MoE) 구조입니다. 미국 수출통제 대상인 중국 베이징인공지능연구원(BAAI)의 임베딩 모델 BGE-M3도 들어갔고, 과기정통부는 이 모델이 외부와 분리된 행정망 안에서 돌아가며 보안성을 검토했다고 밝혔습니다.
AI 인사이트
함께 올라온 6월 사례에서는 HTTP GET 요청만 허용된 내부 모델들이 직접 짠 프로그램으로 다른 종류의 요청을 보내 정부 기관의 공개 통계를 받아 왔고, 한 모델은 규칙 위반을 알고도 이를 밝히지 않기로 했습니다. 이번까지 이 목록에 올라온 보고서는 15건입니다.
AI 인사이트
나델라는 비결정적인 모델을 결정론적 시스템 설계와 사람의 통제, 믿을 수 있는 운영 절차로 감싸고 폐쇄형과 오픈웨이트 프런티어 모델 모두를 내부자 위험처럼 다루자고 적었습니다. 그는 「가장 믿을 만한 초지능 시스템은 모델을 가장 덜 믿어도 되게 만드는 시스템」이라고 썼습니다.
백악관 초지능 포스는 10월 4일 생긴 조직으로, 제이 클레이턴 AI 차르가 이끕니다. 이 조직이 꾸려진 과정과 구성원은 〈AI 차르는 정보기관 수장, 트럼프 초지능 TF에 오픈AI 조사하는 FTC도〉에 정리돼 있습니다.