首页专栏正文

投稿前的第四道关:参考文献逐条核验,完整实操指南

投稿前的第四道关:参考文献逐条核验,完整实操指南

投稿前你会查重复率,会看 AI 率,讲究一点的还会过一遍图片。

但参考文献那五十条,你有没有逐条确认过它们真的存在、真的没被撤、真的支持你说的那句话?

多数人没有。因为过去二十年,这不是一个常规动作。

现在它是了。arXiv 已经开始对幻觉参考文献封禁作者一年,有出版方在把自动引文核验前置到同行评审之前,还有研究发现 400 多项美国专利引用了撤稿论文。引文核验正在从"细心的人才做的事"变成"不做要担责的事"。

这篇是完整的实操指南:四类问题引用分别是什么、DOI 怎么核、撤稿状态怎么查、EndNote 和 Zotero 具体怎么操作、五十条文献怎么在半小时内过完、以及哪些情况必须重点查。

先说结论,免得你等到最后:这件事没有工具能替你做完,但有方法能让它只花半小时。


一、先分清四类问题引用,处理方式完全不同

很多人把"参考文献有问题"当成一件事,其实是四件,严重程度和处理方式都不一样。

类型 具体是什么 严重程度 谁能发现
① 幻觉文献 引的这篇论文根本不存在 最高,可触发封禁与撤稿 只能人工核验
② 撤稿文献 论文存在,但已被撤回 高,取决于它支撑什么 撤稿数据库可查
③ 张冠李戴 文献存在,但不支持你那句话 中到高,最难查 只能读原文
④ 格式错误 卷期页码、年份、作者拼写有误 低,属于规范问题 部分可自动校验

这张表最重要的信息是第四列:只有第 4 类有工具能大面积帮你,前三类都得靠人。

再补充两点判断:

第 1 类和第 2 类是"状态问题",答案是客观的,查一下就知道,所以最该系统化处理。本文第二、三节讲这两类。

第 3 类是"内容问题",没有任何工具能判断,包括查重和 AI 检测。它也是资深审稿人最容易抓到你的地方,因为他熟悉这个领域,一眼就看出你引的那篇论文说的不是这个意思。第五节专门讲它。


二、第一类:幻觉文献怎么查

2.1 为什么你自己扫一眼看不出来

先建立一个正确认知:AI 编的参考文献长得非常正常。

今年 5 月《柳叶刀》那份审计(近 250 万篇 PubMed 论文、核验 9710 万条参考文献、识别出 4406 条编造引用)对这些假文献的描述是:它们并不明显有缺陷,讨论的是具体的科学主题,格式正确、署的是真实存在的研究者、发表日期也合理

拆开看就明白它为什么能混过去:

  • 标题像真的。 大模型见过这个领域几十万篇论文的标题,它生成的标题甚至比真标题更"标准"。
  • 作者是真人。 它会挑这个领域高产的真实作者署上去。
  • 期刊是真刊,卷期页码格式规范。
  • 甚至带 DOI。 有读者补充过的案例里,某篇材料学论文有 9 条格式完整但无法解析的假 DOI,作者名用了 J. Doe、J. Smith 这类占位名。

所以扫一眼参考文献列表,你看到的是一份体例整齐的清单。它唯一的破绽是:点进去,那篇论文不存在。

2.2 核验方法:三种情况三条路径

情况 A:有 DOI(绝大多数 2000 年后的期刊论文)

在浏览器地址栏输入 https://doi.org/ 加上 DOI 号,回车。

三种结果: - 能打开,且页面标题和你写的一致 → 通过; - 解析失败、打不开 → 高度可疑,重点标记; - 能打开但是另一篇文章 → 你抄错了,或者这个 DOI 是编的。两种都要改。

注意中间那条必须做。 光看"这条有 DOI"不算数。假文献可以带一个格式完整但无法解析的 DOI;还有一种情况是 DOI 被出版社或数据库的模糊匹配算法"凑"上去的,看着能解析,其实指向另一篇论文。必须点开核对标题。

情况 B:没有 DOI(老文献、专著、报告、标准)

把标题加英文双引号放进 Google Scholar 或 PubMed 搜。加引号是为了精确匹配,不加引号搜索引擎会给你一堆"相关"结果,反而掩盖了"这篇不存在"的事实。

搜不到,再用作者名 + 年份 + 期刊名交叉搜一次。还是找不到,去查原始出处(你是从哪里知道这篇文献的?回到那个来源看它引对了没有)。

情况 C:中文文献

用 CNKI、万方或 CQVIP 按标题精确检索。中文文献的幻觉问题同样存在,而且因为可用的自动核验渠道更少,更需要手动确认。

2.3 批量操作:用 Zotero 或 EndNote 加速

逐条手点五十次太慢。文献管理软件能帮你砍掉大部分工作量。

Zotero 的做法:

  1. 新建一个空文件夹(Collection),命名成这篇论文的名字;
  2. 把你参考文献列表里的 DOI 全部复制出来,用"通过标识符添加条目"(工具栏那个魔杖图标)批量粘进去;
  3. 能自动抓到完整元数据的,说明这个 DOI 真实存在;抓不到的会报错,那些就是你要重点查的。

这一步的价值在于:它把"五十条都要查"变成"只有报错的那几条要查"。

  1. 抓下来之后,把 Zotero 里的标题和你论文里写的标题逐一对照。不一致的,说明你的引用信息有误。

EndNote 的做法类似: 用 "Find Reference Updates"(查找参考文献更新)功能,它会去联网核对每条记录的元数据。更新失败或者返回结果与原记录差异很大的,标记出来人工查。

一个提醒: 这两个方法验证的是"这个 DOI 存在且指向某篇论文",验证不了"这篇论文是不是你想引的那篇"。所以标题对照那一步不能省。

2.4 十秒钟的补充动作:全文搜关键词

这一步专门针对 arXiv 封禁政策里提到的另外两类证据(正文里残留的大模型元评论、未替换的占位数据)。

在 Word 或你的编辑器里,搜这些词:

would you like · let me know · here is · As an AI · I hope this helps · illustrative · placeholder · TODO · XXX · [insert · 此处填 · 示例数据 · 仅为示意

听起来很傻,但 arXiv 官方举的真实例子就是这个:

"the data in this table is illustrative, fill it in with the real numbers from your experiments." (此表中的数据仅为示意,请用你实验中的真实数字替换。)

模型明确告诉作者"这张表的数是我编的",作者没看见,稿子就交了。


三、第二类:撤稿文献怎么查

这一类过去几乎没人做,但今年之后必须做了。

3.1 为什么重要

7 月 30 日有一项研究显示,401 项已授权的美国专利引用了撤稿论文,其中 195 项在专利申请之前那篇论文就已经被撤了。这说明"引用前查撤稿状态"这个习惯,在学术界和产业界都普遍缺失。

而后果是实打实的:撤稿论文支撑的结论,等于没有支撑。 如果它撑的是你论文的核心论点,审稿人发现之后,你要么补新证据,要么改结论。

3.2 三个查询渠道

渠道一:Retraction Watch 撤稿数据库。 目前收录超过 66,000 条撤稿记录,已由 Crossref 托管并开放。可以按标题、作者、DOI 检索。这是覆盖面最广的一个。

渠道二:PubMed。 生物医学领域最方便。撤稿论文的页面顶部会有明显的 Retracted 标记,而且会关联到撤稿声明。检索结果列表里也会显示。

渠道三:期刊原页面。 撤稿声明通常挂在原文顶部,或者以链接形式关联。这也是为什么"点开 DOI 核对"这个动作一举两得:你在核对标题的同时,就能看到有没有撤稿标记。

3.3 哪些文献重点查

五十条全查最保险,但如果时间紧,按这个优先级:

第一优先:支撑你核心结论的那几条。 就是那些出现在"已有研究证明 X 导致 Y〔12〕"这种句子里的。这类一旦出问题,你的论证链就断了。

第二优先:高被引的"权威"文献。 反直觉但很重要:被引越多的论文,一旦造假影响面越大,也越容易成为打假的目标。 有研究发现高被引论文撤稿后引用降幅更大、也更受关注。你以为"这么多人引过,肯定没问题",恰恰相反。

第三优先:年代久远的关键依据。 十几二十年前的文献,撤稿可能发生在你不知道的任何时候。我们写过的例子:2005 年发表在 Cancer Research 的 PTEN 论文,二十年后才被撤;就在本周,还有一篇乳腺癌论文在打假人举报十年后才被撤。

第四优先:从二手来源拿到的。 你没读过原文、是从别人的综述或参考文献列表里顺下来的。别人错了你跟着错。

第五优先:来自你不熟悉的期刊的。 顺便可以查一下这本刊有没有被 Web of Science 剔除,或者在不在劫持期刊名单里(Retraction Watch 的 Hijacked Journal Checker 目前有 450 多条记录)。


四、第三类:文献存在,但不支持你的话

这是最难的一类,也是最没法偷懒的一类。

4.1 它为什么查不出来

任何工具都判断不了"这条文献支不支持你这句话"。

  • 查重比的是字面重合
  • AI 检测测的是文风统计特征
  • 撤稿库告诉你的是这篇论文的状态
  • 引文核验告诉你的是这篇论文是否存在

没有一项在回答"它说的是不是你说的那个意思"。

有研究者把这个问题称为比幻觉引用"更大更重要"的问题:那些不是完全凭空编造,但不准确、有偏、不完整的引用,"我们连检测它们都还做不到"。

4.2 三种常见形态

形态一:AI 帮你"补文献"补出来的。 你写完一句话,让 AI"给这句加个引用"。它找到的文献可能确实相关,但并不支持你这句话的具体主张。这是现在最高发的一种。

形态二:只读了摘要就引。 摘要说的是结论,正文里的限定条件(样本量、人群、剂量、边界条件)你没看到。于是你把一个有严格前提的结论,当成普适结论引了。

形态三:从别人的综述里搬引用。 综述作者可能引对了,也可能引错了,也可能语境和你的完全不同。你搬的是他的理解,不是原文。

4.3 怎么查

没有捷径,但可以聚焦:

挑出"结论性引用"逐条核。 判断标准很简单:这句话如果去掉引用,你的论证还站得住吗? 站不住的,就是结论性引用,必须打开原文确认。

反过来,"某某也研究过这个问题〔8〕"这类背景性引用,风险低得多,可以放到最后。

核的时候看三样: 原文的结论表述、它的适用范围(样本、条件、限制)、以及作者自己在讨论部分承认的局限。很多"引错"不是引了假的,是引了一个被作者本人明确限定过的结论。


五、完整流程:五十条文献,半小时

把上面的方法串起来。假设你有一篇 50 条参考文献的稿子。

第 0 步(2 分钟):把域代码转成纯文本。

用 EndNote 或 Zotero 的,先另存一份副本(原稿留着继续编辑),在副本里全选后按 Ctrl+Shift+F9,把域代码转成普通文字。

这一步有两个好处:核验时不会误触发字段更新;顺手解决另一个老问题,带域代码的文献会让重复率虚高,还容易让查重系统的参考文献自动排除失效

第 1 步(8 分钟):批量验 DOI。

把所有 DOI 复制出来,用 Zotero 的"通过标识符添加条目"批量导入。能自动抓到元数据的通过,报错的挑出来。 一般五十条里会有零到三条报错。

第 2 步(5 分钟):处理报错项。

对报错的每一条,走第二节 2.2 的流程:标题加引号搜 Google Scholar / PubMed / CNKI。找到了说明只是 DOI 写错,改掉;找不到,这条大概率是编的,删掉或换掉

第 3 步(5 分钟):标题对照。

把 Zotero 抓下来的标题和你稿子里的逐条比。不一致的说明引用信息有误。这一步能顺带发现大量格式错误(第四类问题)。

第 4 步(5 分钟):查撤稿状态。

按第三节的优先级,把核心依据类文献在撤稿数据库或 PubMed 里过一遍。如果第 1 步是通过点 DOI 做的,这一步很多已经顺带完成了(撤稿标记就在页面上)。

第 5 步(10 分钟):核结论性引用。

挑出"去掉引用论证就垮"的那几条(通常 5 到 10 条),打开原文确认它真的说了这个。这一步花的时间最多,价值也最大。

第 6 步(10 秒):全文搜关键词。

按 2.4 那份词表搜一遍,确认没有残留的 AI 元评论和占位数据。

合计约 35 分钟。 熟练之后 20 分钟能过完。


六、分场景:不同情况,重点不同

如果你做的是综述(review): 标准要提一级,全部逐条核,一条不漏。《柳叶刀》那份审计发现,综述类文章的编造率比其他类型高 57%。原因不难理解:综述引文多、每条权重低、作者不可能全读完,正好是 AI 补文献用得最多的场景。

如果你用过 AI 辅助检索或写作: 默认所有 AI 参与过的段落里的引用都要查。带联网检索的工具安全得多,但也会出现"找到一篇真文献却把结论概括错了"。

如果你要投预印本(arXiv、bioRxiv、medRxiv): 2.4 那一步的关键词搜索必须做。arXiv 的封禁触发条件里,残留的大模型元评论和占位数据与幻觉文献是并列的,而这两类恰恰是最容易十秒钟避免的。

如果你是通讯作者: 不能只查自己写的部分。按 ICMJE 的口径,每位作者都要为整篇论文的准确性和完整性负责。合作者补的文献出问题,你一样跑不掉。 投稿前把完整的参考文献列表自己过一遍,这是通讯作者的分内事。

如果论文已经发表,你才发现有问题: 主动联系期刊。一两条且不影响主要结论的,多数走勘误;假文献或撤稿文献支撑的是核心结论的,可能走撤稿。主动上报和被别人查出来,处理结果差别很大。


七、常见问题

问:有没有一键核验全部参考文献的工具? 目前没有能覆盖全部四类问题的。有一些工具能做 DOI 批量解析和元数据比对(本质就是第 1 步的自动化),但"这篇论文存不存在"之外的三类,都还得靠人。出版方那边在推自动引文核验前置到同行评审之前,但那是他们的流程,不是你手上的工具。

问:Zotero 抓到了元数据,是不是就一定真实存在? 是的,抓到元数据说明这个 DOI 在 Crossref 或对应注册机构里有登记。但这只解决了第 1 类问题,不代表它没被撤,也不代表它支持你的话。

问:查重系统能不能顺便告诉我参考文献有没有问题? 不能,这两件事没有交集。查重比对的是你正文的文字和已发表文献的重合度。它既不核验引文是否存在,也不判断引文是否成立。 所以每份检测报告底下那句"报告仅为文字匹配结果,是否构成抄袭需结合引用规范判断",是在精确描述工具的能力边界,不是免责套话。

问:我引用了一篇撤稿论文,能不能就说明一下继续引? 可以,前提是你知道它被撤了并且在文中说清楚。有正当场景:你的研究就是在讨论学术不端,或者你要说明某个曾被广泛接受的结论后来被推翻。问题从来不是引用本身,是不知情地把它当有效证据。

问:AI 为什么会编文献,它自己不知道吗? 不知道。大模型逐词预测概率最高的下一个词,生成"一条看起来像参考文献的字符串"和生成一句话是同一件事,中间没有"去数据库查一下"这个步骤(除非工具明确接了检索)。有研究者认为幻觉与大模型的运作方式不可分割,这个问题不会因为模型变强就自动消失

问:先查引文还是先降重? 先降重、处理完 AI 率,最后核引文。原因是降重改写的过程中你可能会增删引用,先核就白核了。引文核验放在定稿之后、投稿之前的最后一道。

问:这件事真的值得花半小时吗? 算笔账:半小时 vs. 稿子退回来重做(几周)vs. 发表后被质疑(不可控)vs. arXiv 封禁一年加此后永久要求先过同行评审。半小时是这几个选项里最便宜的一个。


最后

这套流程说穿了没什么技术含量,就是把过去默认"应该没问题"的地方,改成"确认一下"。

它之所以现在变得重要,不是因为研究者变差了,是因为产出引用的方式变了。以前一条引用是你读完一篇论文之后手动敲进去的,出错概率天然很低;现在一条引用可能是三秒钟自动生成的,中间没有任何人看过。

工具让产出快了一百倍,核验的责任却一点没减。这个落差,就是这半小时要补的东西。

顺带说一句:重复率、AI 率、图片这三关有工具能帮你,引文这一关只能靠自己。四关一起过完,你签那句"我对全文内容负全责"才是真的敢签。


查个重 · chagechong.com

重复率检测 · AI 率检测 · 图片检测

24 小时自助提交,报告在线可查。

查个重,查得准。想你所想,帮你阻挡。

报告仅为文字匹配与特征分析结果,是否构成抄袭需结合引用规范判断。引文真实性与撤稿状态需作者自行核验,检测系统不提供该项服务,本文第二、三节给出了自查方法。


参考来源

  1. Retraction Watch, One in 277 PubMed-indexed papers in 2026 shows fabricated references, says analysis(2026-05-07,报道 The Lancet 通信:审计近 250 万篇论文、核验 9710 万条参考文献、识别 4406 条编造引用,综述类编造率高 57%):https://retractionwatch.com/2026/05/07/one-in-277-pubmed-indexed-papers-in-2026-shows-fabricated-references-says-analysis/
  2. Nature News, Researchers who use hallucinated references to face arXiv ban(2026-05-19):https://www.nature.com/articles/d41586-026-01595-5
  3. Inside Higher Ed, Ban on Authors Who Submit AI Content "Welcome but Unenforceable"(2026-05-22,含大模型元评论与占位数据的原文示例):https://www.insidehighered.com/news/faculty/books-publishing/2026/05/22/ban-authors-who-submit-ai-content-welcome-unenforceable
  4. Retraction Watch, Just over 400 U.S. patents contain citations to retracted scientific papers(2026-07-30):https://retractionwatch.com/2026/07/30/us-patents-contain-citations-to-retracted-scientific-papers/
  5. Retraction Watch 撤稿数据库(Crossref 托管,超过 66,000 条记录):https://gitlab.com/crossref/retraction-watch-data ;Crossref 说明:https://www.crossref.org/documentation/retrieve-metadata/retraction-watch/
  6. Retraction Watch, Hijacked Journal Checker(超过 450 条记录):https://retractionwatch.com/the-retraction-watch-hijacked-journal-checker/
  7. Hosseini M, Resnik D, Accountability in Research(2026):关于幻觉引用与"不准确、有偏、不完整"引用的区分:https://www.tandfonline.com/doi/full/10.1080/08989621.2026.2645390
  8. Elsevier, Generative AI policies for journals(2026 年 6 月更新,要求作者核查来源,提醒 AI 生成的参考文献可能有误或系凭空编造):https://www.elsevier.com/about/policies-and-standards/generative-ai-policies-for-journals
  9. ICMJE Recommendations, Section V.A Use of AI by Authors(2026 年 1 月版):https://www.icmje.org/recommendations/browse/artificial-intelligence/ai-use-by-authors.html

报告仅为文字匹配与特征分析结果,是否构成抄袭需结合引用规范判断;涉及具体期刊要求,以该期刊 Instructions for Authors 为准。

阅读下一篇
400 多项美国专利,引用了已经被撤稿的论文
2026-07-31 · 全文 3536 字 · 预计阅读 9 分钟
400 多项美国专利,引用了已经被撤稿的论文