首页专栏正文

arXiv 开始封人了:引用了一条不存在的文献,封一年

arXiv 开始封人了:引用了一条不存在的文献,封一年

学术圈第一条针对 AI 的硬性处罚落地了。

arXiv 宣布:如果发现投稿里存在 AI 编造的参考文献,作者将被禁止在平台投稿一年。 而且不只是假文献,任何"无可辩驳地证明作者没有检查 AI 输出"的痕迹,都触发同样的处罚。

更狠的在后面:一年封禁结束之后,这位作者后续投到 arXiv 的稿子,必须先被一个正规同行评审平台接收,才能上传。

这不是某个期刊的内部规定,是全球物理、数学、计算机领域最主要的预印本平台。这篇讲清楚:规则具体是什么、触发条件有哪些、为什么现在动手、争议在哪、以及你该怎么办。


一、规则原文:处罚重在"你没检查",不在"你用了 AI"

宣布这项政策的是 Thomas Dietterich,arXiv 计算机方向的负责人。他给出的理由值得逐字看:

如果一份投稿里存在无可辩驳的证据表明作者没有检查 LLM 生成的结果,那么 arXiv 无法信任这篇论文里的任何内容。

这句话是整条规则的逻辑起点,请注意它的重点落在哪里。

它罚的不是"你用了 AI"。 arXiv 没有禁止使用大模型写作。它罚的是"你用了 AI,但没看一眼就交上来了"

这两件事的性质完全不同。前者是工具选择,后者是作者放弃了对内容的责任。而一旦证明你在某一处放弃了责任,审稿人就没有理由相信你在其他地方尽到了责任。这就是"无法信任这篇论文里的任何内容"这句话的分量。

政策的适用范围也比很多人以为的宽:官方口径提到的是投稿中包含由大模型写出的不当语言、抄袭内容、有偏内容、错误、失误、错误的参考文献或误导性内容。


二、三类"无可辩驳的证据",第二类最丢人

官方举了几种典型情况,我按由重到轻排一下:

第一类:幻觉参考文献。

引用了一条根本不存在的文献。这是最主要的触发条件,也是这次政策直接针对的东西。

第二类:正文里残留的大模型元评论。

这一类是真实发生的,而且不止一次。官方举的例子原封不动地摆在这里:

"here is a 200 word summary; would you like me to make any changes?" (这是一段 200 词的摘要,需要我做什么修改吗?)

"the data in this table is illustrative, fill it in with the real numbers from your experiments." (此表中的数据仅为示意,请用你实验中的真实数字替换。)

看到第二句要停一下。它不是"忘了删一句废话",它是模型明确告诉作者"这张表里的数是我编的,你去换成真的",而作者连这句话都没看见,就把稿子交了。 那张表里的数字是什么状态,不用多说。

第三类:占位数据。

模板里的 placeholder 没替换掉就投出去了,本质和第二类是一回事。

这三类有一个共同点:它们不需要专家判断,谁都能看出来。 这也是"incontrovertible(无可辩驳)"这个词的意思。arXiv 选的是一条执行成本最低、争议最小的红线。


三、为什么是现在:一组把人吓到的数字

政策不是凭空来的。它跟着一项研究走。

Zhenyue Zhao 等人完成、arXiv 创始人 Paul Ginsparg 参与的一项研究发现:仅 2025 年一年,四个预印本平台上的论文里就出现了将近 15 万条幻觉参考文献。

把它和另一组数据并排看,趋势就清楚了。今年 5 月《柳叶刀》刊出的一封通信,审计了近 250 万篇 PubMed 论文、核验 9710 万条参考文献,得到的比例是:

时间 至少含一条编造文献的论文比例
2023 年 约 1/2828
2025 年 1/458
2026 年前七周 1/277

两年,12 倍。

还有一个更让人不安的发现。今年 7 月挂到 arXiv 上的一篇论文,标题直接叫《Phantom References: Hallucinated Citations That Survive Peer Review at Top-Tier Conferences》,讨论的是幻觉引用能够通过顶级会议的同行评审活下来

也就是说,指望审稿人挡住这件事,已经被证明不现实了。所以平台只能自己动手,而且只能从那些"不需要判断力就能识别"的证据入手。


四、争议:欢迎,但执行得了吗

这条政策不是没有反对声音。

《高等教育内幕》(Inside Higher Ed)报道这件事时用的标题是 "Welcome but Unenforceable"(值得欢迎,但无法执行)。《自然》的报道也在导语里写了一句:并非所有人都认为这是正确的做法。

反对意见集中在几个点上,我觉得都站得住:

第一,能抓到的只是最笨的那一批。 会把"would you like me to make any changes?"留在正文里的作者,本来就是最不上心的那批人。真正批量生产 AI 论文的人,删掉这句话只要三秒钟。政策抓的是不小心的人,抓不到不诚实的人。

第二,"无可辩驳"的门槛意味着漏网的更多。 一条格式完整、作者是真人、期刊是真刊、只是这篇论文不存在的假文献,需要有人去点开才能发现。平台没有能力对每篇投稿的每条引用做核验。

第三,处罚落点的公平性。 一篇论文十几个作者,某一节是学生写的、某条文献是学生用 AI 补的,封的是谁?合作者要不要连坐?这些细节目前没有公开说清。

第四,一年之后那个附加条件很重。 封禁期满后要求"后续投稿必须先被正规同行评审平台接收",这实际上是永久性地取消了这位作者使用预印本的权利(预印本的核心价值就是先于同行评审公开)。对一个早期研究者来说,这个代价可能大于事件本身。

但我的判断是,这条政策的价值不在抓人,在定调。 它第一次把"没检查 AI 输出"明确定义为一种可处罚的行为,而不是一次可以道歉了事的疏忽。有了这个定义,后面各家跟进就有依据了。


五、这件事和你有什么关系

如果你觉得"我又不投 arXiv",先别急着划走。三层关系:

第一层,规则会扩散。 arXiv 是第一个,不会是最后一个。此前 ICMJE 在 2026 年 1 月版新增的第五章里已经写了:作者应能够声明论文中不存在抄袭,包括 AI 产出的文字和图片;而且不披露 AI 使用可能需要采取纠正措施,某些情况下可能被认定为学术不端。Elsevier 2026 年 6 月更新的政策明确要求作者核查来源,原文提醒 AI 生成的参考文献可能有误或系凭空编造。

方向是一致的:从"建议你检查"变成"不检查要担责"。

第二层,风险比你以为的高。 1/277 这个比例是全体论文的平均值,而你如果用过 AI 辅助检索或写作,你在的是风险更集中的那一档。做综述的更要注意:《柳叶刀》那份审计发现,综述类文章的编造率比其他类型高 57%

第三层,最要命的是你自己看不出来。 幻觉参考文献的特征是格式正确、作者是真实存在的研究者、期刊是真刊、发表日期合理,甚至带着格式完整但无法解析的 DOI。你扫一眼参考文献列表,看到的是一份体例整齐的清单,它唯一的破绽是点进去那篇论文不存在。


六、具体怎么办:投稿前三十分钟

方法很笨,但有效,而且真的只要半小时。

第一步,逐条点 DOI。

有 DOI 的,浏览器里打开 https://doi.org/ 加号码: - 能打开,且页面标题和你写的一致 → 通过; - 打不开、解析失败 → 高度可疑; - 能打开但是另一篇文章 → 你抄错了或者它是编的,两种都要改。

注意中间那一条:光看"有 DOI"不算数,要真的点开核对标题。有读者反馈过一种情况是假文献带着格式完整但无法解析的 DOI,还有一种是 ID 被数据库的模糊匹配算法"凑"上去的,看着能解析,其实指向另一篇。

没有 DOI 的(老文献、书、报告),把标题加引号在 Google Scholar 或 PubMed 搜。

第二步,重点查你没亲手读过的那些。

一篇论文四五十条参考文献,你逐字读过的可能只有一半。剩下那一半就是风险区,尤其是:AI 帮你"补充相关文献"给出的、从别人综述里顺下来的、为了凑"本领域已有大量研究"这类句子加进去的。

第三步,全文搜一遍这些词。

这一步是专门针对 arXiv 那三类证据的,十秒钟:

在 Word 或编辑器里搜 would you likelet me knowhere isAs an AIillustrativeplaceholderTODOXXX[insert此处填示例数据

听起来很傻,但被封的人就是栽在这上面。

第四步,交之前把域代码转成纯文本。

用 EndNote 或 Zotero 的,另存一份副本,全选后 Ctrl+Shift+F9。这一步顺手解决另一个问题:带域代码的文献会让重复率虚高。


七、常见问题

问:那我不用 AI 检索文献不就行了? 可以,但没必要因噎废食。问题从来不是用 AI,是不核验。 带联网检索的工具安全得多,但也不是免检:检索型工具会出现"找到一篇真文献但把结论概括错了",或者混合真实与虚构的元数据。规则很简单:写进参考文献的每一条,你都点开确认过。

问:AI 为什么会编文献,它不知道自己在编吗? 不知道。大模型逐词预测概率最高的下一个词,生成"一条看起来像参考文献的字符串"和生成一句话是同一件事,中间没有"去数据库查一下"这个步骤(除非工具明确接了检索)。有研究者的判断是,幻觉与大模型的运作方式不可分割,所以这个问题不会因为模型变强就自动消失。

问:已经发表的论文里发现了假文献怎么办? 主动联系期刊。按目前的实践,一两条且不影响主要结论的,多数走勘误;假文献支撑核心结论的,可能走撤稿。主动上报和被人查出来,处理结果差别很大。

问:合作者加进去的假文献,我要负责吗? 按现行的署名伦理,要。ICMJE 的口径是每位作者都要为整篇论文的准确性和完整性负责。这也是通讯作者投稿前必须自己过一遍参考文献的理由。

问:查重系统能查出假文献吗? 不能。查重比的是字面重合,它不核验每条引文是否真实存在。AI 率检测测的是文风统计特征,也不管引文真假。引文真实性是独立的第四道关,目前只能靠作者自己。 这一点我们说得很直白,因为夸大工具能力对谁都没好处。

问:这会不会影响我用 AI 写作? 不影响写,影响交。你可以用 AI 起草、组织、润色,但交出去之前:披露使用情况(按目标期刊要求的位置写)、核验每一条引用、全文搜一遍残留的元评论。这三件事加起来不到一小时,换的是不用赌。


最后

arXiv 这条规则最值得记的不是"封一年",是 Dietterich 那句话背后的逻辑:

你在一个地方证明了自己没检查,别人就没有理由相信你在别的地方检查了。

这句话适用范围远不止参考文献。它其实描述了 AI 时代学术信任的新规则:工具可以帮你产出,但责任不能转移。 你签下的每一份稿子,兜的是里面所有内容,包括不是你写的那部分。

所以真正该做的不是少用 AI,是在交出去之前,把该自己看的东西看一遍。参考文献逐条点开,文本重复率和 AI 率各跑一遍,图片过一次比对。这几件事花的时间,远少于稿子被退回来重做,更远少于被封一年。


查个重 · chagechong.com

重复率检测 · AI 率检测 · 图片检测

24 小时自助提交,报告在线可查。

查个重,查得准。想你所想,帮你阻挡。

报告仅为文字匹配与特征分析结果,是否构成抄袭需结合引用规范判断;引文真实性需作者自行逐条核验,检测系统不提供该项服务。


参考来源

  1. Nature News, Researchers who use hallucinated references to face arXiv ban(2026-05-19,Nature 653, 988-989,doi:10.1038/d41586-026-01595-5):https://www.nature.com/articles/d41586-026-01595-5
  2. Inside Higher Ed, Ban on Authors Who Submit AI Content "Welcome but Unenforceable"(2026-05-22,含 Thomas Dietterich 表述与元评论原文示例):https://www.insidehighered.com/news/faculty/books-publishing/2026/05/22/ban-authors-who-submit-ai-content-welcome-unenforceable
  3. Singapore Management University Library, arXiv tightens policy on hallucinated references:https://library.smu.edu.sg/topics-insights/arxiv-tightens-policy-hallucinated-references-what-researchers-should-know-about
  4. arXiv Content Moderation 官方说明:https://info.arxiv.org/help/moderation/index.html
  5. Zhao Z 等(含 arXiv 创始人 Paul Ginsparg)关于 2025 年四个预印本平台近 15 万条幻觉引用的研究,经上述报道引述。
  6. The Lancet 通信(Topaz M 等,2026):审计近 250 万篇 PubMed 论文,比例由 1/2828 升至 1/277;经 Retraction Watch 2026-05-07 报道:https://retractionwatch.com/2026/05/07/one-in-277-pubmed-indexed-papers-in-2026-shows-fabricated-references-says-analysis/
  7. Phantom References: Hallucinated Citations That Survive Peer Review at Top-Tier Conferences(arXiv,2026 年 7 月):https://arxiv.org/html/2607.00738
  8. ICMJE Recommendations, Section V.A Use of AI by Authors(2026 年 1 月版):https://www.icmje.org/recommendations/browse/artificial-intelligence/ai-use-by-authors.html
  9. Elsevier, Generative AI policies for journals(政策更新于 2026 年 6 月):https://www.elsevier.com/about/policies-and-standards/generative-ai-policies-for-journals

报告仅为文字匹配与特征分析结果,是否构成抄袭需结合引用规范判断;涉及具体期刊要求,以该期刊 Instructions for Authors 为准。

阅读下一篇
Science 主编:AI 让科学出版变得更慢、更差、更贵
2026-07-31 · 全文 3368 字 · 预计阅读 8 分钟
Science 主编:AI 让科学出版变得更慢、更差、更贵