学术圈第一条针对 AI 的硬性处罚落地了。
arXiv 宣布:如果发现投稿里存在 AI 编造的参考文献,作者将被禁止在平台投稿一年。 而且不只是假文献,任何"无可辩驳地证明作者没有检查 AI 输出"的痕迹,都触发同样的处罚。
更狠的在后面:一年封禁结束之后,这位作者后续投到 arXiv 的稿子,必须先被一个正规同行评审平台接收,才能上传。
这不是某个期刊的内部规定,是全球物理、数学、计算机领域最主要的预印本平台。这篇讲清楚:规则具体是什么、触发条件有哪些、为什么现在动手、争议在哪、以及你该怎么办。
一、规则原文:处罚重在"你没检查",不在"你用了 AI"
宣布这项政策的是 Thomas Dietterich,arXiv 计算机方向的负责人。他给出的理由值得逐字看:
如果一份投稿里存在无可辩驳的证据表明作者没有检查 LLM 生成的结果,那么 arXiv 无法信任这篇论文里的任何内容。
这句话是整条规则的逻辑起点,请注意它的重点落在哪里。
它罚的不是"你用了 AI"。 arXiv 没有禁止使用大模型写作。它罚的是"你用了 AI,但没看一眼就交上来了"。
这两件事的性质完全不同。前者是工具选择,后者是作者放弃了对内容的责任。而一旦证明你在某一处放弃了责任,审稿人就没有理由相信你在其他地方尽到了责任。这就是"无法信任这篇论文里的任何内容"这句话的分量。
政策的适用范围也比很多人以为的宽:官方口径提到的是投稿中包含由大模型写出的不当语言、抄袭内容、有偏内容、错误、失误、错误的参考文献或误导性内容。
二、三类"无可辩驳的证据",第二类最丢人
官方举了几种典型情况,我按由重到轻排一下:
第一类:幻觉参考文献。
引用了一条根本不存在的文献。这是最主要的触发条件,也是这次政策直接针对的东西。
第二类:正文里残留的大模型元评论。
这一类是真实发生的,而且不止一次。官方举的例子原封不动地摆在这里:
"here is a 200 word summary; would you like me to make any changes?" (这是一段 200 词的摘要,需要我做什么修改吗?)
"the data in this table is illustrative, fill it in with the real numbers from your experiments." (此表中的数据仅为示意,请用你实验中的真实数字替换。)
看到第二句要停一下。它不是"忘了删一句废话",它是模型明确告诉作者"这张表里的数是我编的,你去换成真的",而作者连这句话都没看见,就把稿子交了。 那张表里的数字是什么状态,不用多说。
第三类:占位数据。
模板里的 placeholder 没替换掉就投出去了,本质和第二类是一回事。
这三类有一个共同点:它们不需要专家判断,谁都能看出来。 这也是"incontrovertible(无可辩驳)"这个词的意思。arXiv 选的是一条执行成本最低、争议最小的红线。
三、为什么是现在:一组把人吓到的数字
政策不是凭空来的。它跟着一项研究走。
由 Zhenyue Zhao 等人完成、arXiv 创始人 Paul Ginsparg 参与的一项研究发现:仅 2025 年一年,四个预印本平台上的论文里就出现了将近 15 万条幻觉参考文献。
把它和另一组数据并排看,趋势就清楚了。今年 5 月《柳叶刀》刊出的一封通信,审计了近 250 万篇 PubMed 论文、核验 9710 万条参考文献,得到的比例是:
| 时间 | 至少含一条编造文献的论文比例 |
|---|---|
| 2023 年 | 约 1/2828 |
| 2025 年 | 1/458 |
| 2026 年前七周 | 1/277 |
两年,12 倍。
还有一个更让人不安的发现。今年 7 月挂到 arXiv 上的一篇论文,标题直接叫《Phantom References: Hallucinated Citations That Survive Peer Review at Top-Tier Conferences》,讨论的是幻觉引用能够通过顶级会议的同行评审活下来。
也就是说,指望审稿人挡住这件事,已经被证明不现实了。所以平台只能自己动手,而且只能从那些"不需要判断力就能识别"的证据入手。
四、争议:欢迎,但执行得了吗
这条政策不是没有反对声音。
《高等教育内幕》(Inside Higher Ed)报道这件事时用的标题是 "Welcome but Unenforceable"(值得欢迎,但无法执行)。《自然》的报道也在导语里写了一句:并非所有人都认为这是正确的做法。
反对意见集中在几个点上,我觉得都站得住:
第一,能抓到的只是最笨的那一批。 会把"would you like me to make any changes?"留在正文里的作者,本来就是最不上心的那批人。真正批量生产 AI 论文的人,删掉这句话只要三秒钟。政策抓的是不小心的人,抓不到不诚实的人。
第二,"无可辩驳"的门槛意味着漏网的更多。 一条格式完整、作者是真人、期刊是真刊、只是这篇论文不存在的假文献,需要有人去点开才能发现。平台没有能力对每篇投稿的每条引用做核验。
第三,处罚落点的公平性。 一篇论文十几个作者,某一节是学生写的、某条文献是学生用 AI 补的,封的是谁?合作者要不要连坐?这些细节目前没有公开说清。
第四,一年之后那个附加条件很重。 封禁期满后要求"后续投稿必须先被正规同行评审平台接收",这实际上是永久性地取消了这位作者使用预印本的权利(预印本的核心价值就是先于同行评审公开)。对一个早期研究者来说,这个代价可能大于事件本身。
但我的判断是,这条政策的价值不在抓人,在定调。 它第一次把"没检查 AI 输出"明确定义为一种可处罚的行为,而不是一次可以道歉了事的疏忽。有了这个定义,后面各家跟进就有依据了。
五、这件事和你有什么关系
如果你觉得"我又不投 arXiv",先别急着划走。三层关系:
第一层,规则会扩散。 arXiv 是第一个,不会是最后一个。此前 ICMJE 在 2026 年 1 月版新增的第五章里已经写了:作者应能够声明论文中不存在抄袭,包括 AI 产出的文字和图片;而且不披露 AI 使用可能需要采取纠正措施,某些情况下可能被认定为学术不端。Elsevier 2026 年 6 月更新的政策明确要求作者核查来源,原文提醒 AI 生成的参考文献可能有误或系凭空编造。
方向是一致的:从"建议你检查"变成"不检查要担责"。
第二层,风险比你以为的高。 1/277 这个比例是全体论文的平均值,而你如果用过 AI 辅助检索或写作,你在的是风险更集中的那一档。做综述的更要注意:《柳叶刀》那份审计发现,综述类文章的编造率比其他类型高 57%。
第三层,最要命的是你自己看不出来。 幻觉参考文献的特征是格式正确、作者是真实存在的研究者、期刊是真刊、发表日期合理,甚至带着格式完整但无法解析的 DOI。你扫一眼参考文献列表,看到的是一份体例整齐的清单,它唯一的破绽是点进去那篇论文不存在。
六、具体怎么办:投稿前三十分钟
方法很笨,但有效,而且真的只要半小时。
第一步,逐条点 DOI。
有 DOI 的,浏览器里打开 https://doi.org/ 加号码:
- 能打开,且页面标题和你写的一致 → 通过;
- 打不开、解析失败 → 高度可疑;
- 能打开但是另一篇文章 → 你抄错了或者它是编的,两种都要改。
注意中间那一条:光看"有 DOI"不算数,要真的点开核对标题。有读者反馈过一种情况是假文献带着格式完整但无法解析的 DOI,还有一种是 ID 被数据库的模糊匹配算法"凑"上去的,看着能解析,其实指向另一篇。
没有 DOI 的(老文献、书、报告),把标题加引号在 Google Scholar 或 PubMed 搜。
第二步,重点查你没亲手读过的那些。
一篇论文四五十条参考文献,你逐字读过的可能只有一半。剩下那一半就是风险区,尤其是:AI 帮你"补充相关文献"给出的、从别人综述里顺下来的、为了凑"本领域已有大量研究"这类句子加进去的。
第三步,全文搜一遍这些词。
这一步是专门针对 arXiv 那三类证据的,十秒钟:
在 Word 或编辑器里搜 would you like、let me know、here is、As an AI、illustrative、placeholder、TODO、XXX、[insert、此处填、示例数据。
听起来很傻,但被封的人就是栽在这上面。
第四步,交之前把域代码转成纯文本。
用 EndNote 或 Zotero 的,另存一份副本,全选后 Ctrl+Shift+F9。这一步顺手解决另一个问题:带域代码的文献会让重复率虚高。
七、常见问题
问:那我不用 AI 检索文献不就行了? 可以,但没必要因噎废食。问题从来不是用 AI,是不核验。 带联网检索的工具安全得多,但也不是免检:检索型工具会出现"找到一篇真文献但把结论概括错了",或者混合真实与虚构的元数据。规则很简单:写进参考文献的每一条,你都点开确认过。
问:AI 为什么会编文献,它不知道自己在编吗? 不知道。大模型逐词预测概率最高的下一个词,生成"一条看起来像参考文献的字符串"和生成一句话是同一件事,中间没有"去数据库查一下"这个步骤(除非工具明确接了检索)。有研究者的判断是,幻觉与大模型的运作方式不可分割,所以这个问题不会因为模型变强就自动消失。
问:已经发表的论文里发现了假文献怎么办? 主动联系期刊。按目前的实践,一两条且不影响主要结论的,多数走勘误;假文献支撑核心结论的,可能走撤稿。主动上报和被人查出来,处理结果差别很大。
问:合作者加进去的假文献,我要负责吗? 按现行的署名伦理,要。ICMJE 的口径是每位作者都要为整篇论文的准确性和完整性负责。这也是通讯作者投稿前必须自己过一遍参考文献的理由。
问:查重系统能查出假文献吗? 不能。查重比的是字面重合,它不核验每条引文是否真实存在。AI 率检测测的是文风统计特征,也不管引文真假。引文真实性是独立的第四道关,目前只能靠作者自己。 这一点我们说得很直白,因为夸大工具能力对谁都没好处。
问:这会不会影响我用 AI 写作? 不影响写,影响交。你可以用 AI 起草、组织、润色,但交出去之前:披露使用情况(按目标期刊要求的位置写)、核验每一条引用、全文搜一遍残留的元评论。这三件事加起来不到一小时,换的是不用赌。
最后
arXiv 这条规则最值得记的不是"封一年",是 Dietterich 那句话背后的逻辑:
你在一个地方证明了自己没检查,别人就没有理由相信你在别的地方检查了。
这句话适用范围远不止参考文献。它其实描述了 AI 时代学术信任的新规则:工具可以帮你产出,但责任不能转移。 你签下的每一份稿子,兜的是里面所有内容,包括不是你写的那部分。
所以真正该做的不是少用 AI,是在交出去之前,把该自己看的东西看一遍。参考文献逐条点开,文本重复率和 AI 率各跑一遍,图片过一次比对。这几件事花的时间,远少于稿子被退回来重做,更远少于被封一年。
查个重 · chagechong.com
重复率检测 · AI 率检测 · 图片检测
24 小时自助提交,报告在线可查。
查个重,查得准。想你所想,帮你阻挡。
报告仅为文字匹配与特征分析结果,是否构成抄袭需结合引用规范判断;引文真实性需作者自行逐条核验,检测系统不提供该项服务。
参考来源
- Nature News, Researchers who use hallucinated references to face arXiv ban(2026-05-19,Nature 653, 988-989,doi:10.1038/d41586-026-01595-5):https://www.nature.com/articles/d41586-026-01595-5
- Inside Higher Ed, Ban on Authors Who Submit AI Content "Welcome but Unenforceable"(2026-05-22,含 Thomas Dietterich 表述与元评论原文示例):https://www.insidehighered.com/news/faculty/books-publishing/2026/05/22/ban-authors-who-submit-ai-content-welcome-unenforceable
- Singapore Management University Library, arXiv tightens policy on hallucinated references:https://library.smu.edu.sg/topics-insights/arxiv-tightens-policy-hallucinated-references-what-researchers-should-know-about
- arXiv Content Moderation 官方说明:https://info.arxiv.org/help/moderation/index.html
- Zhao Z 等(含 arXiv 创始人 Paul Ginsparg)关于 2025 年四个预印本平台近 15 万条幻觉引用的研究,经上述报道引述。
- The Lancet 通信(Topaz M 等,2026):审计近 250 万篇 PubMed 论文,比例由 1/2828 升至 1/277;经 Retraction Watch 2026-05-07 报道:https://retractionwatch.com/2026/05/07/one-in-277-pubmed-indexed-papers-in-2026-shows-fabricated-references-says-analysis/
- Phantom References: Hallucinated Citations That Survive Peer Review at Top-Tier Conferences(arXiv,2026 年 7 月):https://arxiv.org/html/2607.00738
- ICMJE Recommendations, Section V.A Use of AI by Authors(2026 年 1 月版):https://www.icmje.org/recommendations/browse/artificial-intelligence/ai-use-by-authors.html
- Elsevier, Generative AI policies for journals(政策更新于 2026 年 6 月):https://www.elsevier.com/about/policies-and-standards/generative-ai-policies-for-journals

