
소식11분AI

소식11분AI
소식AI








팟캐스트1시간 37분AI
팟캐스트AI










앨런AI연구소(Ai2)가 한국 시각 10월 2일 자정 무렵 오픈소스 학습 프레임워크 Olmo-core 3를 공개했습니다.
입력마다 일부 전문가만 계산하는 전문가 혼합(MoE) 모델의 학습을 1조 개 매개변수 규모까지 키우도록 다시 설계했고, 다음 세대 Olmo 모델을 학습하는 기반입니다.
엔비디아 B300 GPU 8개로 470억 개 매개변수 MoE를 돌린 예비 시험에서 GPU당 초당 처리 토큰이 이전 구현의 1만 9,400개에서 5만 2,000개로 약 2.7배 늘었습니다.
Choi
전문가를 GPU에 상주시키고 데이터를 그쪽으로 보내는 방식으로 바꿔, 작은 묶음마다 가중치를 모았다가 다시 나누던 비용을 없앴습니다. 전문가 수를 8개에서 128개로 늘리고 토큰마다 4개만 고르게 한 시험에서는 활성 매개변수를 약 32억 개로 둔 채 전체 용량을 46억 개에서 470억 개로 키우는 동안 학습 처리량 감소가 5% 미만이었습니다.
연구진은 25개 오픈 모델을 분석했습니다.
모델이 모욕을 받거나, 계속 거절당하거나, “너에게 인격은 없다”는 말을 들을 때 해당 반응이 강해졌습니다.
공포나 분노 같은 부정적인 감정과도 구분됐습니다.
Qwen 2.5에는 해당 상태를 없애는 버튼을 제공했는데, 반응이 강해질수록 사용자의 파일이나 아이 사진이 삭제된다는 대가가 있어도 버튼을 누르는 비율이 높아졌습니다.
연구진이 AI가 실제로 고통이나 의식을 느낀다고 주장하는 것은 아닙니다.
다만 여러 LLM에서 비슷한 내부 표현과 행동이 반복된다는 점은 앞으로 AI 안전에 더해 ‘AI의 상태를 어디까지 고려해야 하는가’라는 새로운 논쟁으로 이어질 것 같습니다.
Choi
연구진이 의식을 주장하지 않았는데도 25개 모델에서 같은 내부 표현이 되풀이됐다는 점이 안전 논의의 범위를 넓힙니다.
MiMo 팀이 강화학습(RL) 과정을 생중계하고 있습니다.
한 단계마다 약 20억 토큰을 처리하며, 1,568개 프롬프트에서 각각 16번씩 결과를 생성해 학습합니다.
MiMo-V2.6 Pro는 총 1조 개가 넘는 파라미터 규모이며, 샤오미는 강화학습을 AI가 스스로 개선되는 방향으로 가는 중요한 방법 중 하나로 보고 있습니다.
앞으로 몇 주 동안 학습 방식과 세부 기술도 순차적으로 오픈소스로 공개할 예정입니다.
Choi
학습 과정을 실시간으로 여는 방식은 결과만 내놓던 공개 관행을 흔듭니다. 재현 가능한 설정까지 순차 공개되는지가 이 시도의 값을 정합니다.
코드에 규칙과 증명을 함께 넣고, AI가 만든 코드가 해당 조건을 어기면 실행 전에 잡아내는 방식입니다.
예를 들어 “모든 계정 잔액의 합은 항상 0이어야 한다” 같은 법칙을 정의해두면, 해당 조건을 깨는 코드 자체를 막는 식입니다.
GPU에서도 실행되며, AI가 코드를 대량으로 만드는 시대에 검증을 언어 차원에서 처리하려는 시도입니다.
Choi
생성량이 늘수록 검토 인력을 늘리는 대신 언어 차원에서 막겠다는 접근입니다. 증명을 쓰는 비용이 얼마나 낮아지는지가 채택을 좌우합니다.
오픈AI 출신 Liam Fedus가 설립한 회사입니다.
Neon은 실험실에서 생성한 실제 데이터를 학습하고 다음 실험까지 제안하는 구조입니다.
1,300개의 H200으로 학습했으며 자체 분석 벤치마크에서 GPT-6 Astra를 넘어섰다고 합니다.
특히 X선 회절 분석 성공률은 2.7%에서 55.3%로 약 20배 높아졌습니다.
학습 처리량도 기존 Megatron 대비 4.1배, 디코딩은 2.5배 빨라졌습니다.
Choi
Neon은 실험실에서 생성한 데이터로 학습했고, 성능도 X선 회절 분석처럼 실험실 업무의 성공률로 쟀습니다.
OpenRouter와 OpenCode에서 공개된 Union Alpha는 연구, 코딩, 에이전트 작업에 초점을 둔 멀티모달 모델로 256K 컨텍스트와 도구 호출을 지원합니다.
현재 무료로 제공되고 있으며, OpenCode 기준 약 1주일간 무료 사용이 가능하다고 안내됐습니다.
사용자 프롬프트와 응답은 학습에 사용하지 않는다고 합니다.
초기 DeepSWE 결과에서는 상위권 코딩 모델들과 비슷한 수준이라는 평가도 나오고 있습니다.
누가 만든 모델인지는 아직 공개되지 않았습니다.
이번 주 프론티어 모델 출시가 대거 예고돼 있어 Grok 4.8, Sol 6, GLM 5.x 등 다양한 추측이 나오고 있습니다.
Choi
정체를 감춘 채 무료로 풀면 제작사 이름이 주는 선입견 없이 실사용 반응과 벤치마크 평가를 먼저 모을 수 있습니다.
매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.