











논문 사전 공개 저장소 arXiv가 한국 시각 10월 2일 새벽 4시, 모든 제출자의 제출 한도를 한 달 2편, 동시에 심사 중인 원고 3편으로 정했다고 발표했습니다.
10월 1일부터 모든 분야에 적용하며, 한도는 원고를 올린 제출자 한 사람에게만 적용됩니다.
9월 한 달 제출은 4만 363편으로 사상 최대였고, 2016년 9월 9,869편, 2024년 9월 2만 569편에서 2년 만에 두 배가 됐습니다.
Choi
arXiv는 AI 도구로 쉽게 만든 얇은 논문, 한 연구를 잘게 쪼갠 논문, AI가 쓴 빽빽한 논문이 늘면서 소수 저자가 자원봉사 검토자의 시간을 지나치게 차지한다고 설명했습니다. 9월 제출로 지원 요청이 약 9,000건 쌓였고, 최근 2년 사이 cs.AI 분야 제출은 6배 넘게 늘었습니다.
alphaXiv가 arXiv 논문을 여러 Claude·Codex 에이전트로 자동 재현하고 실험할 수 있는 autoresearch 기능을 공개했습니다.
논문을 넣으면 여러 에이전트가 동시에 구현과 실험을 진행하고, 후속 학습은 Tinker API를 이용해 여러 강화학습 실험을 병렬로 돌릴 수 있습니다.
실험 결과가 가지처럼 쌓이는 과정도 직접 확인할 수 있으며, 현재 OpenResearch에서 사용할 수 있습니다.
Choi
논문을 넣으면 여러 Claude·Codex 에이전트가 동시에 구현과 실험을 돌리고 Tinker API로 강화학습 실험을 병렬로 이어, 논문 재현에 드는 사람 손이 줄어듭니다.
GPT-5.6 Sol 한 번 실행으로 arXiv 논문을 인터랙티브 Marimo 노트북으로 바꿉니다.
만드는 순서가 재미있습니다.
에이전트가 먼저 논문에서 대표 실험 하나를 골라 직접 재현하고, 거기서 나온 결과물을 재료로 시각화 노트북을 조립합니다.
그래서 완성본에서는 파라미터를 바꿔가며 논문 주장을 직접 확인해 볼 수 있습니다.
해석 가능성, 추론 엔지니어링, 에이전트 하네스, 벤치마킹처럼 손으로 만져봐야 이해되는 분야의 예시가 이미 올라와 있습니다.
alphaXiv도 어떤 논문에 통하는지는 아직 가려내는 중이라고 밝혔습니다.
계산 자원이 적게 드는 논문일수록 재현이 잘 된다고 합니다.
논문을 자주 읽는 분들은 한번 써 보면 좋겠습니다.
Choi
재현을 먼저 하고 그 결과로 노트북을 짓는 순서가 이 워크플로의 요령입니다. 완성본에서는 파라미터를 바꿔 가며 논문 주장을 직접 확인할 수 있습니다.
매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.