arXiv 是世界上大部分人工智能研究首先出现的预印本服务器,由于人工智能驱动的大量论文淹没了其志愿者版主,该服务器已将作者每个日历月提交的论文数量限制为两次。

该限制于 2026 年 10 月开始生效,适用于所有类别。自 2024 年起实施的现有规则保持不变,该规则规定作者在任何给定时间最多只能提交 3 次活跃提交。 更多相关背景,请参阅我们的AI最新动态。

帽子后面的数字

增长曲线解释了 arXiv 采取行动的原因。 2016年9月,该平台收到9,869条提交内容。到 2024 年 9 月,这一数字已达到 20,569 人。根据 arXiv 的数据,今年 9 月,提交数量达到 40,363 件,两年内翻了一番,仅 cs.AI 类别的提交数量就在同一时期增长了六倍多。

激增不仅仅是存储问题。它为工作人员和版主提供了近 9,000 张支持票,而该平台的志愿者审核员(arXiv 称之为质量控制的支柱)却将大量时间花在一小群多产、低质量的提交者身上。

新规则如何运作

该上限适用于提交论文的人,而不是共同作者,因此只要研究人员个人只提交两篇论文,他们仍然可以每月出现在多篇论文上。被拒绝的提交将计入限制,因为它们消耗的审核时间与已接受的提交相同。在论文发表之前删除论文的作者可以收回自己的位置。

arXiv 编辑咨询委员会主席托马斯·G·迪特里奇 (Thomas G. Dietterich) 写道,相对较小比例的作者提交了大量低质量论文,并占用了版主不公平的时间,导致严肃的工作延迟了几天或几周。在 Bluesky 上,他指出一些作者提交了数十篇论文,并表示他希望这一上限也能限制“微观结果”论文,这些论文只不过描述了一项额外的消融研究或微小的架构调整。

arXiv 将该规则描述为临时修复,直到其自己的审核工具能够扩展;迪特里希表示,他希望稍后可以提高或降低上限。

萨拉米纸和人工智能编写的文本

版主报告称,他们看到了更多薄弱、针对性强的论文——“萨拉米”研究从单一研究工作分割成尽可能小的可发表单位——以及读起来像机器编写的密集文本。这一数量的部分原因在于人工智能工具本身,它使得起草、扩展和重新包装论文的成本大大降低。

这不是 arXiv 的第一次镇压

该上限是在一系列紧缩措施之后出台的。 2025 年 11 月,arXiv 开始要求计算机科学评论文章和立场文件在提交前通过同行评审。 2026 年 5 月,Dietterich 宣布对论文中明显包含未经验证的法学硕士输出(例如幻觉引用)的作者实施一年禁令。

这对研究人员的实践意味着什么

对于在职科学家来说,上限改变了提交策略,而不是合作本身。由于该限制仅约束提交者,因此研究小组可能会轮换提交每篇论文的人,而之前自己提交所有内容的实验室负责人会将这项工作交给共同作者。被拒绝的论文现在带来了真正的成本——审核拒绝会烧掉研究人员两个月的时间之一——这让初次提交的论文更加谨慎。

该规则还可能会减缓机器学习中常见的模式:在同一个月发布一系列密切相关的论文来对一个想法提出主张。在新的上限下,一个项目的五篇论文“萨拉米切片”需要同一作者近三个月的提交时间,这可能会悄悄地鼓励将结果整合到更少、更完整的论文中——这可以说是质量控制倡导者一直想要的。

会议面临同样的压力

压力不仅限于预印本。 ICLR 2027 已在截止日期前收到约 50,000 份摘要,而 ICLR 2026 则收到约 19,500 份有效提交论文。在 NeurIPS 2025 上,GPTZero 分析发现,在约 5,000 篇接受的论文中至少有 100 篇伪造的引用,尽管每篇论文至少有 3 名审稿人。

新的独立,新的资金

arXiv 的治理也刚刚发生了变化。 25 年后,该平台从康奈尔大学分离出来,并于 2026 年 7 月 1 日成为独立的非营利组织。9 月下旬,西蒙斯国际基金会、XTX Markets 和西格尔家族捐赠基金承诺在三到五年内总共提供 1720 万美元,其中部分资金专门用于技术升级,专门用于处理人工智能生成的内容。

人工智能实验室希望成为答案的一部分

主要的人工智能实验室同时将他们的模型定位为研究工具。 8 月,Google DeepMind 扩展了其联合科学家系统,以规划实验、控制实验室设备和生成手稿。 Anthropic 正在建造一个生物实验室,克劳德在这里指导机器人进行实验。 9 月,OpenAI 宣布设立一名“自动化研究实习生”,负责在人类监督下处理明确的研究任务。

模型是否真的能够进行新颖的科学仍有待证实。普林斯顿大学和英国人工智能安全研究所参与的一项研究给了 Claude Opus 4.8 六天的时间来研究两篇未发表的 NeurIPS 论文中的研究问题;作为审稿人的原始作者拒绝了这两组结果。

目前,把关已经转移到基础设施层。 arXiv 的两篇论文上限是迄今为止最明显的迹象,表明人工智能研究的瓶颈不再是产生输出,而是找出值得阅读的内容。

---

掌握AI最新动态

获取最新的AI新闻、分析和突破——尽在一处。

阅读更多AI新闻 →