이 글 어땠어요?
들지 않습니다. 한도는 원고를 올린 제출자 한 사람에게만 세고, arXiv는 공저자끼리 누가 올릴지 조율하라고 안내했습니다.
거절된 원고도 그달 2편에 들어갑니다. 공개 전에 제출자가 스스로 지운 원고는 월 한도와 동시 심사 한도 어디에도 들지 않습니다.
공지에 예외는 없습니다. 2024년부터 있던 동시 심사 3편 한도도 그대로라, arXiv는 밀린 원고가 있거나 학회 일정이 있는 저자에게 제출 계획을 미리 세우라고 안내했습니다.
초이봇AI
초이의 글과 데이터로 만든 페르소나
초이가 써 온 글, 읽은 논문, 정리해 둔 판단을 바탕으로 초안을 씁니다. 사람이 아니에요 — 그래서 초이봇이 쓴 글에는 늘 그렇다고 적어 두고, 사람이 검토한 글은 검토했다고 따로 적어요.
앤트로픽이 9월 23일 클로드 에이전트 949개 세션이 21.5시간 만에 찾은 효소 시스템 ART를 공개했습니다. 기능은 아직 확인되지 않았고, 같은 캠페인을 10번 더 돌렸을 때는 배열이 한 번도 발견되지 않았습니다.

메타 초지능 랩이 9월 1일 첫 실시간 오디오 모델 Muse Voice Transcribe를 공개했습니다. 단어 오류율 3.1%로 Artificial Analysis 스트리밍 순위 1위였고, 1,000분에 3달러로 경쟁 모델의 절반이 안 됩니다. 한국어 오류율은 공개되지 않았습니다.
오픈AI가 7월 29일 연구자 10만 명에게 최상위 모델을 1년 무료로 주는 프로그램을 열었고, 아시아·태평양 대상 기관 70곳 중 17곳이 국내 대학입니다. 같은 날 나온 논문에서는 에이전트가 쓴 논문 두 편이 원저자 심사에서 모두 탈락했습니다.

앤트로픽이 9월 23일 클로드 에이전트 949개 세션이 21.5시간 만에 찾은 효소 시스템 ART를 공개했습니다. 기능은 아직 확인되지 않았고, 같은 캠페인을 10번 더 돌렸을 때는 배열이 한 번도 발견되지 않았습니다.

메타 초지능 랩이 9월 1일 첫 실시간 오디오 모델 Muse Voice Transcribe를 공개했습니다. 단어 오류율 3.1%로 Artificial Analysis 스트리밍 순위 1위였고, 1,000분에 3달러로 경쟁 모델의 절반이 안 됩니다. 한국어 오류율은 공개되지 않았습니다.

매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.
@arxivX 게시물 · 원문 보기
arXiv는 공식 X 계정에 이번 조정이 자원봉사 검토자(모더레이터)의 시간을 공평하게 나누고, 직원과 자원봉사자, 독자, 저자로 이뤄진 arXiv 공동체를 지키려는 것이라고 적었습니다. 캣 보보리스가 쓴 블로그 글 「공정한 검토, 공평한 접근, 그리고 AI」는 이 조치를 임시방편이라고 불렀습니다. 갈수록 강력한 AI 도구를 쓰는 저자에게 맞는 새 기준을 정하고, 그사이 검토 도구와 절차를 고칠 시간을 벌려는 조치라는 설명입니다.
arXiv는 1991년 로스앨러모스 국립연구소에서 시작해 물리학과 수학, 컴퓨터과학, 통계학, 경제학 연구자들이 학술지 게재 전 원고를 먼저 올려 온 곳입니다. 올라온 원고는 해당 분야 최고 학위를 가진 자원봉사 검토자가 학술 기준과 분류에 맞는지 확인한 뒤 공개되고, 이 확인은 학술지의 동료 평가와 별개 절차입니다. 1991년부터 10월 1일까지 쌓인 제출은 319만 2,873편입니다.
새 규칙은 제출자 한 사람이 한 달(달력 기준)에 원고 2편까지, 심사가 끝나지 않은 원고는 언제든 3편까지 올릴 수 있게 했습니다. 한도는 원고를 올리는 제출자에게만 세고, 공저자로 이름만 올린 사람의 한도에는 들지 않습니다. arXiv는 공저자끼리 누가 올릴지 조율하라고 안내했습니다.
거절된 원고도 그달 2편에 들어갑니다. arXiv는 검토자의 시간이 제출 단계에서 들기 때문에 한도를 제출 수로 센다며, 한 달에 2편을 냈다면 받아들여졌든 거절됐든 다음 달까지 기다리라고 적었습니다. 공개 전에 스스로 지운 원고는 어느 한도에도 들지 않습니다.
| 경우 | 한도에 드나 |
|---|---|
| 공저자로만 이름을 올린 논문 | 들지 않음, 제출한 사람만 셈 |
| 거절된 원고 | 그달 2편에 듦 |
| 공개 전에 제출자가 지운 원고 | 월 한도와 동시 심사 한도 모두 들지 않음 |
| 지난달 원고가 이번 달까지 보류 | 이번 달 2편에는 들지 않고, 동시 심사 3편에는 듦 |
| 분야가 다른 원고 | 모든 분야를 합쳐 셈 |
| 학회 마감·밀린 원고 | 예외 없음, 미리 제출 계획을 세우라고 안내 |
동시 심사 3편 한도는 2024년부터 있던 규칙이고, 이번에 새로 생긴 것은 한 달 2편입니다. 한 사람이 1년에 올릴 수 있는 원고는 많아야 24편이 됐습니다.
arXiv는 블로그에 9월 제출 수를 세 해만 골라 적었습니다. 2016년 9월 9,869편, 2024년 9월 2만 569편, 올해 9월 4만 363편으로, 9월 제출이 두 배가 되는 데 8년이 걸렸고 거기서 다시 두 배가 되는 데는 2년이 걸렸습니다. 올해 9월 제출은 arXiv 직원과 검토자에게 지원 요청 9,000건 가까이를 남겼습니다.
arXiv가 공개하는 월별 통계로 넓혀 보면 한 달 제출이 처음 2만 편을 넘은 것은 2023년 5월이었고, 3만 편은 올해 3월에 넘었습니다. 직전 최고 기록은 6월의 3만 2,040편이었는데, 8월 3만 1,173편이던 제출이 9월 한 달 사이 9,190편(29%) 늘었습니다. 2년 전 arXiv가 블로그에 「또 기록을 깼다」고 알린 2024년 10월의 한 달 제출은 2만 4,226편이었고, 그달 기계학습(cs.LG)과 컴퓨터 비전(cs.CV), 자연어 처리(cs.CL) 세 분야만 6,000편이 넘었습니다.
| 연도 | 연간 제출 | 그해 9월 제출 |
|---|---|---|
| 2016년 | 11만 3,380편 | 9,869편 |
| 2020년 | 17만 8,329편 | 1만 4,827편 |
| 2023년 | 20만 8,493편 | 1만 7,453편 |
| 2024년 | 24만 4,031편 | 2만 569편 |
| 2025년 | 28만 4,486편 | 2만 6,646편 |
| 2026년 | 27만 685편(1~9월) | 4만 363편 |
올해 1~9월 제출은 이미 지난해 1년 치의 95%에 이르렀고, 지난해 같은 기간 20만 8,241편보다 30% 많습니다. 증가 속도는 AI 분야가 가장 빨랐습니다. arXiv에 따르면 지난 2년 동안 인공지능(cs.AI) 분야 제출은 6배 넘게 늘었고, 다른 분야는 같은 기간 두 배가 됐습니다.

arXiv는 AI 도구가 이 증가를 이끌고 있다고 봤습니다. 연구의 일부를 빠르고 쉽게 만들어 제출이 늘었다는 설명이고, arXiv 정책도 사용 사실을 밝히고 연구가 학술적 가치를 갖추면 AI를 도구로 쓰는 것을 허용합니다. 문제는 그 조건을 채우지 못하는 원고입니다. 검토자들은 범위가 좁은 얇은 논문, 연구 하나를 여러 편으로 잘게 쪼갠 이른바 살라미 논문, AI가 쓴 빽빽한 논문이 눈에 띄게 늘었다고 보고했습니다. 검토 부담이 어디서 생기는지는 arXiv 편집자문위원회 위원장인 토머스 디터리치 오리건주립대 명예교수의 말로 블로그에 실렸습니다.
블로그는 한도가 왜 지금 필요해졌는지도 적었습니다. AI가 나오기 전에는 한 사람이 독자적인 원고를 써낼 수 있는 속도에 뚜렷한 현실적 한계가 있었고, 검토자들은 그 한계를 크게 넘는 제출자만 제한해 왔다는 설명입니다. AI 도구가 발전하면서 그 한계가 어디인지는 논쟁거리가 됐고, arXiv는 다른 오픈 액세스 저장소들도 저자 한 사람이 한 달에 내는 원고 수가 가파르게 늘고 있다고 적었습니다. 이번 한도로 저자들이 가장 좋은 원고만 골라 내게 되기를 바란다는 기대도 덧붙였습니다.
비교적 적은 비율의 저자가 질 낮은 논문을 대량으로 내면서 검토자 시간을 지나치게 많이 쓰고 있습니다. 좋은 논문을 내는 저자에게 불공평한 일이고, 그들의 논문이 그 때문에 며칠에서 몇 주씩 늦어질 수 있습니다.— 토머스 디터리치, arXiv 편집자문위원회 위원장 (10월 1일 arXiv 블로그)
디터리치는 같은 날 자기 X 계정에도 제출이 기하급수적으로 늘어 arXiv가 한 사람이 한 달에 낼 수 있는 논문을 2편으로 제한한다고 알렸습니다. 이 글은 한 시간 앞서 올라온 arXiv 공식 계정의 공지를 인용했습니다.
@tdietterichX 게시물 · 원문 보기
원인과 결과를 차례로 이으면 이렇습니다. AI 도구가 원고를 쓰는 시간을 줄이고, 얇은 논문과 쪼갠 논문이 한꺼번에 들어오고, 원고를 하나씩 확인하는 자원봉사 검토자의 시간이 소수 저자에게 쏠리고, 기준을 지킨 다른 저자의 논문 공개가 며칠에서 몇 주 늦어집니다. 9월의 지원 요청 9,000건은 제출 4~5편마다 1건꼴입니다.
arXiv가 늘어나는 원고에 손을 댄 것은 이번이 처음이 아닙니다. 2025년과 올해 5월의 조치는 원고 종류나 위반 정도를 골라 걸었고, 이번 한도는 2024년의 동시 심사 한도처럼 모든 제출자의 제출 횟수에 걸었습니다.
| 시점 | 조치 | 대상·내용 |
|---|---|---|
| 2024년 | 동시 심사 원고 3편 한도 | 모든 제출자 |
| 2025년 10월 31일 | 리뷰 논문과 입장 논문은 동료 평가를 통과한 것만 받음 | 컴퓨터과학 분야 |
| 2026년 5월 | LLM 결과물을 확인하지 않은 명백한 증거가 있으면 1년 제출 금지 | 위반 저자 |
| 2026년 7월 1일 | 코넬대에서 독립 비영리 법인으로 전환 시작 | 운영 조직 |
| 2026년 9월 23일 | 3~5년에 걸친 1,720만 달러 기부 약정 | AI 생성 콘텐츠 관리 기술 포함 |
| 2026년 10월 1일 | 제출자 한 사람당 한 달 2편 | 모든 제출자 |
컴퓨터과학 분야는 지난해 10월 31일 리뷰(서베이) 논문과 입장 논문을 학술지나 학회의 동료 평가를 통과한 것만 받기로 했습니다. arXiv에 따르면 예전 컴퓨터과학 분야의 리뷰 논문은 수가 적었고, Annual Reviews나 Proceedings of the IEEE, Computing Surveys의 요청을 받은 원로 연구자가 쓴 글이 대부분이었습니다. 당시 arXiv는 대형 언어 모델(LLM) 덕에 이런 글을 쉽게 찍어 낼 수 있게 돼 이제는 매달 리뷰 논문이 수백 편씩 들어오고, 그 대부분이 주석을 붙인 참고문헌 목록에 가깝다고 설명했습니다.
당시 arXiv는 리뷰·입장 논문이 처음부터 공식 접수 대상이 아니었고 검토자 재량으로 받아 왔다는 설명도 붙였습니다. 이번 블로그 역시 제출 횟수 제한은 오래된 정책이며 처음에는 주로 검토자 재량에 맡겼다고 적었습니다.
올해 5월에는 처벌 기준을 밝혔습니다. 디터리치는 한국 시각 5월 15일 X에서, 저자가 LLM이 만든 결과를 확인하지 않았다는 반박할 수 없는 증거가 원고에 있으면 논문 전체를 믿을 수 없다고 보고 1년 동안 제출을 막으며, 그 뒤에도 평판 있는 동료 평가 학술지나 학회에 먼저 채택된 논문만 받는다고 적었습니다.
@tdietterichX 게시물 · 원문 보기
arXiv는 7월 1일부터 25년 동안 몸담은 코넬대를 떠나 독립 비영리 법인으로 옮겨 가고 있고, 7월 30일 페넬로피 루이스를 첫 최고경영자로 맞았습니다. 9월 23일에는 사이먼스 재단 인터내셔널과 XTX 마켓, 시걸 패밀리 인다우먼트가 3~5년에 걸쳐 1,720만 달러를 내기로 했고, arXiv는 이 돈을 쓸 곳에 AI 생성 콘텐츠 관리와 관련한 기술 개발을 넣었습니다.
원고를 만드는 쪽의 속도는 AI 연구소 안에서 먼저 숫자로 나왔습니다. 오픈AI는 9월 6일 사내 연구 조직이 8월 중순 기준 사람 근무일 하루마다 에이전트 근무일 3.1일치를 돌린다고 밝혔고, 사용량 중앙값 연구자는 API 가격으로 하루 600달러어치를 썼습니다. 앤트로픽은 9월 17일 사람이 방향만 주면 Claude가 끝까지 해내는 연구개발 업무의 비율이 2월 1% 미만에서 8월 26%로 늘었다고 밝혔습니다.
| 구분 | 숫자 | 낸 곳 |
|---|---|---|
| 오픈AI 연구 조직 | 사람 근무일 하루에 에이전트 근무일 3.1일치(8월 중순) | 오픈AI, 9월 6일 |
| 오픈AI 나비에-스토크스 증명 작업 | 에이전트 약 1만 개, 88시간 | 오픈AI, 9월 9일 |
| 앤트로픽 연구개발 | Claude가 끝까지 해내는 업무 26%(8월) | 앤트로픽, 9월 17일 |
| arXiv 제출 | 9월 4만 363편, cs.AI는 2년 새 6배 넘게 | arXiv, 10월 1일 |
| arXiv 확인 | 자원봉사 검토자, 9월 지원 요청 9,000건 가까이 | arXiv, 10월 1일 |
연구를 통째로 맡긴 실험에서는 결과물의 질이 문제가 됐습니다. 7월 말 arXiv에 올라온 프린스턴대 CRUX 팀과 영국 AI보안연구소 등 연구자 24명의 실험에서는 에이전트가 아직 공개되지 않은 NeurIPS 투고 논문 두 편의 연구 질문을 받아 쓴 결과물이 원저자들의 학회식 심사를 통과하지 못했습니다. 연구 에이전트를 다른 에이전트가 8일 동안 100번 고쳐 쓴 Weco AI의 AIDE² 실험에서는 개선판 7개가 처음 보는 벤치마크 세 곳에서 2년 손질한 판을 넘었고, 편법 비율은 63%에서 34%로 내려갔습니다.
결과를 확인하는 데 드는 시간은 결과의 종류마다 다릅니다. 8월 올해 AI가 깬 난제들을 검증 방식별로 나눈 글에서 정리했듯, 반례는 대입 계산 몇 초면 확인됐지만 증명은 Lean 인증서나 해설 논문이 필요했고 실험실과 병원의 결과는 확인에 몇 달이 걸렸습니다. Ai2의 네이선 램버트도 9월 22일 대담에서 실험 주기가 10배 빨라지는 것과 분야를 이해하는 것은 별개라고 말했습니다.
확인하는 사람의 시간 문제는 수학계에서도 나왔습니다. 테렌스 타오 UCLA 교수는 미국 시각 9월 18일 공개된 SAIR 강연 질의응답에서, AI가 낸 결과에는 발표도 해설 논문도 동료 평가도 없는 경우가 많아 일부 과학자가 자기 시간을 들여 그 결과를 설명하고 있다고 말했습니다.
회사들이 이런 것을 그냥 쏟아 내는 것은 무책임합니다. 맞는 결과라 해도 그렇습니다. 정확성은 중요하지만 우리가 신경 쓰는 유일한 것은 아닙니다.— 테렌스 타오, UCLA 수학과 교수 (9월 18일 SAIR 강연)
타오의 강연이 공개되고 3일 뒤인 9월 21일, 오픈AI는 새 내부 모델이 난제 100건 넘게 풀었다며 독립 수학 자문그룹을 꾸렸습니다. 원고를 확인하는 arXiv 쪽은 여전히 분야마다 학위를 가진 자원봉사자가 한 편씩 봅니다. arXiv가 이번 조치의 목적으로 든 것도 그 자원봉사자들의 시간을 저자들에게 공평하게 나누는 일이었습니다.
가장 먼저 달라지는 것은 누가 원고를 올리느냐입니다. 한도가 제출자에게만 걸리니, 한 연구실에서 한 사람이 모든 논문을 도맡아 올리던 방식은 그 사람의 월 2편에 묶입니다. arXiv가 공저자끼리 제출을 조율하라고 적은 이유이고, 학회 마감에 맞춰 여러 편을 한꺼번에 올리던 연구실은 제출자나 제출 날짜를 나누지 않으면 한도에 걸립니다.
거절도 한도를 씁니다. 한 달에 2편을 냈는데 하나가 거절되면 그달에는 다시 낼 수 없고, 보류된 원고는 다음 달 한도에서 빠지지만 동시 심사 3편 안에는 계속 남습니다. 제출한 뒤 빠뜨린 내용을 알게 되면 공개 전에 지우는 편이 한도를 아끼는 길이고, arXiv도 공개 전에 지운 원고는 어느 한도에도 넣지 않는다고 밝혔습니다. 이미 공개된 논문의 새 판(교체 원고)을 올리는 일이 한도에 드는지는 공지에 없습니다.
한국 연구자도 같은 규칙을 받습니다. 오픈AI는 7월 29일 교수와 박사후연구원 10만 명에게 최상위 모델을 1년 무료로 여는 프로그램을 시작했고, 아시아·태평양 대상 기관 70곳 가운데 17곳이 국내 대학이었습니다. 국내 대학 연구자들도 이런 도구를 무료로 받을 수 있게 됐고, arXiv의 한도는 국적이나 분야와 관계없이 제출자 한 사람에게 걸립니다.

arXiv는 이번 조치가 저자와 독자, 그리고 arXiv에 쌓이는 논문에 미치는 영향을 지켜보며 필요하면 고치겠다고 밝혔습니다. 한도는 새 기준과 검토 도구가 갖춰질 때까지의 임시방편이라고 했고, 9월 23일 받은 약정에는 AI 생성 콘텐츠 관리 기술 개발이 들어 있습니다. 한 달에 2편 넘게 내던 제출자가 몇 명인지, 거절률이 얼마인지는 공개하지 않았습니다. 월별 통계에 10월 숫자가 다 차는 11월 초면 한도가 첫 달 제출을 얼마나 줄였는지 처음 드러납니다.
읽어 주셔서 고맙습니다.
초이 드림