每月两篇:预印本库给出了硬性配额

预印本平台 arXiv 宣布新的限流政策:自 10 月 1 日起,每位提交者每个自然月最多提交两篇新论文,同时在审数量维持既有的三篇上限——该项自 2024 年起执行,并非新增。社区互动经理 Kat Boboris 在周四的公告中确认政策即刻生效,The Register 于 10 月 2 日作了报道。几个细则值得留意:额度只记在「点下提交按钮」的提交者头上,合著者不受影响,多人团队可以轮流署名提交分摊额度;被拒的稿件同样消耗当月额度;政策覆盖全部学科,没有会议截稿日豁免,也没有未用额度的结转。arXiv 还请研究者「优先提交能完整反映工作成果的论文,而不是多篇增量式小论文」。

数据:两年翻倍,九千张工单压向志愿者

arXiv 在政策说明中给出了自家的数字:2026 年 9 月收稿 40,363 篇,创历史纪录;十年前的同期是 9,869 篇,两年前是 20,569 篇——总盘子十年涨了约四倍、两年翻了一倍,其中计算机科学 AI 类目在两年间涨了六倍以上。仅 9 月一个月,这批投稿就产生了近 9,000 个支持工单,压在以志愿者为主的审核队伍上,合规稿件的审核因此被拖延数天甚至数周。第三方媒体 byteiota 整理的口径还显示,拒稿率已从约 4% 抬升到 10%-12%。

arXiv 每年 9 月收稿量(官方政策说明口径)9,8692016-0920,5692024-0940,363(纪录)2026-09十年约 4.1 倍 · 两年翻倍cs.AI 类目两年涨逾六倍9 月支持工单近 9,000 个拒稿率约 4% 升至 10%-12%(第三方媒体整理口径)新规要点每提交者每月 2 篇新投稿 · 在审上限 3 篇(2024 年起)· 拒稿也占额度 · 合著者不受影响
arXiv 9 月收稿量十年对照与政策要点(arXiv 官方口径)

审核团队观察到的问题不只是量大:一篇工作被拆成多篇的「香肠论文」在变多,内容单薄、选题过窄的投稿在变多,AI 密集撰写、近乎「带注释的参考文献列表」的综述也在变多,而且相当一部分来自少数作者。arXiv 的规则本就允许作者把 AI 当研究工具使用,前提是披露用途并达到学术水准——现在的问题是,许多投稿并不满足后一条。

对研究者来说,新规落地后的操作姿势其实很具体:先把每月两个名额当预算来规划,而不是等论文写完再想投哪;相关性强的结果合并成一篇投,消融实验、勘误与主论文抢的是同一个名额; borderline 的稿件宁缓勿投,因为一次被拒就烧掉六分之一个月度额度;多人团队则要协调好谁来做提交者,把额度摊到更多人头上。这些琐碎的排队规则,正在成为 AI 时代科研产出流程里一个绕不开的约束条件。

学界吵起来了:限流是排堵还是误伤

政策公布后,观点迅速分野。罗格斯大学数学家 Alex Kontorovich 站在支持侧,说法很直接:「我不打算这个月读你的 42 篇论文,挑两篇你最好的。」哈佛商学院教授 Scott Kominers——一位在 arXiv 上有近二十年投稿记录的作者——则认为 arXiv 该压缩的是审核成本而不是学术产出,一刀切的限流惩罚了所有研究者,而不是少数滥发者。研究者 Prachee Avasthi 的表述更尖锐:「每月有多少科学进入公开记录,如今取决于人类的带宽,而不是有多少科学正在发生。」两边说的都是真问题:洪峰确实在稀释信号,但配额也确实误伤了守规矩的人。

治标与治本之间

把背景补全会看得更清楚:arXiv 今年 7 月刚从康奈尔大学独立为非营利组织,部分目的就是为审核基础设施筹集资金;5 月,平台曾对含幻觉参考文献、残留提示词的论文作者施以一年封禁。此番限流被官方定位为过渡性措施,长期解法指向自动化的出处核验——检查论文背后是否有真实的数据、代码与版本痕迹,这才能随投稿量一起规模化。对习惯把 arXiv 当作训练语料与基准来源的 AI 行业来说,这条政策还有一层间接影响:当灌水的成本趋近于零,公开语料渠道也在学着给自己降噪,未来模型能「读到」什么,正在被这类基础设施决策悄悄重塑。