AI 撰写虚假引用,是因为语言模型预测的是看似合理的文本,而非真实文本。它会生成看起来正确但往往并不存在的作者、期刊、年份和 DOI。解决办法是建立一套核查流程,在任何人阅读草稿之前,对每一条参考文献都执行核查。
为什么 AI 会编造看起来真实的参考文献?
模型经过训练,用来生成下一个最可能出现的字符序列。参考文献条目具有非常可预测的格式:作者、年份、标题、期刊、卷、页码、DOI。模型见过数百万条这样的条目,因此可以完美地生成这种格式。但它无法核查这个人是否存在、这篇文章是否已发表,或这个 DOI 是否能解析。
这就是这种错误如此具有说服力的原因。虚假引用并不是明显乱码。它格式规范,位置正确,使用真实的期刊名称,并引用一位确实在该领域工作的作者。编造往往出现在中间部分:真实的研究者,配上真实的期刊,以及一个从未发表过的标题。
最常见的两种模式是:
- 看似合理的混合体。 真实的作者、真实的期刊、编造的文章标题。
- 自信的幽灵。 一条完整条目,包括 DOI,对应一篇在任何地方都不存在的论文。
两者都不是模型损坏的迹象。这表明你看到的是预测,而不是查找。
如何在不浪费一下午的情况下验证参考文献?
按顺序处理草稿中的每一条参考文献,不要跳过那些看起来熟悉的。熟悉恰恰是让伪造来源蒙混过关的原因。对每个条目执行以下例行检查:
- 解析 DOI。 如果提供了 DOI,将其粘贴到 DOI 解析器中。如果无法解析,该条目未经验证。不要继续。
- 用引号搜索确切的标题。 使用搜索引擎和学术数据库。真实的标题会返回文章、摘要和引用论文。伪造的标题不会返回任何内容,或者返回引用你自己草稿的页面。
- 对照领域检查作者。 搜索作者姓名加上期刊。如果此人发表的是不同主题,这种配对就可疑。
- 确认期刊和年份。 直接查找该期刊。检查它是否在那一年出版,以及卷号和页码对于该期是否合理。
- 打开摘要。 阅读它。如果摘要不支持你附加到引文中的主张,即使来源是真实的,引文也是错误的。
- 标记条目。 将其标记为已验证、已更正或已移除。带有标记参考文献列表的草稿是你可以辩护的草稿。
对于一篇短文,每个来源需要几分钟。对于一份长篇报告,要预留充足的时间。另一种选择是在最糟糕的时刻才发现问题。
真实来源与虚构来源相比是什么样子?
一旦你知道该检查哪些字段,这些信号并不隐晦。下表对比了需要留意的内容。
| 检查项 | 真实来源 | 虚构来源 |
|---|---|---|
| DOI | 可解析到文章记录 | 缺失、格式错误或无法解析 |
| 标题搜索 | 返回该文章及其引用 | 无返回结果,或仅返回你自己的草稿 |
| 作者 | 在该领域就该主题发表过文章 | 真实姓名,但领域错误,或无记录 |
| 期刊 | 出版过该卷期 | 期刊存在,但期号不匹配 |
| 摘要 | 支持你提出的主张 | 缺失,或与主张相矛盾 |
| 页码范围 | 符合该期 | 看似合理但超出范围 |
如果有两个或更多单元格落在右列,在你能证明并非如此之前,应将该参考文献视为伪造。
为什么无法核实的来源比没有来源更糟?
缺失的引用是一个空白。无法核实的引用则是一个你无法支持、却表现得好像可以支持的主张。这是两个不同的问题,而后者要难恢复得多。
当编辑或评分者发现一条伪造的参考文献时,损害并不限于那一行。它会让文档中所有其他引用都受到质疑。读者会开始核查。信任一旦因一个编造的来源而被消耗,重建起来代价高昂。
还有一个实际成本。无法核实的来源不能用来在答辩、评审或事实核查中为论点辩护。它是看似支持的累赘。
所以诚实的做法很简单:删掉它。如果这个论点重要,就找一个能支持它的真实来源。如果找不到,这个论点可能并不像你想象的那样有充分支持,而这值得在提交前而不是提交后知道。
核实参考文献很慢,而这正是关键所在。如果你正在处理一份部分由机器生成的草稿,我们关于AI内容检测器如何工作的指南解释了这些分数能告诉你什么、不能告诉你什么,而AI检测器会显示哪些句子信号最强,这样你就知道该先从哪里入手。
如何快速区分幻觉参考文献和真实参考文献?
最快的单一测试是DOI。如果它能解析,你就有一条真实记录,可以据此核对其余信息。如果它不能解析,你就有问题了,再自信的格式也解决不了。
第二快的测试是精确标题搜索。把完整标题放在引号里。真实标题会被索引。编造的标题不会。
第三项测试能捕捉到另一种不同的失败:阅读摘要,并问它是否真的说了你的句子所声称的内容。引用真实来源来支持其并未提出的主张,这本身就是一种错误,而且在AI辅助的草稿中很常见,因为模型优化的是流畅度,而非准确性。
有一件事值得了解:我们自己的检测器在2026年9月13日对23篇手写指南进行的测量发现,平均AI得分为21%,范围在0到46%之间。这告诉了你一些有用的信息。人类写作和机器写作在表面信号上存在重叠,因此一份看起来干净的草稿并不能证明其参考文献是可靠的。你仍然必须检查。
如果你已经提交了一份带有不良引用的草稿怎么办?
尽早行动,并且坦率行动。伪造的参考文献在已提交文件中停留的时间越长,更正看起来就越糟糕。
- 如果它尚未被审查,发送一个更正版本并附上简短说明:有一条参考文献不准确,已被替换。不要小题大做,不要长篇解释。
- 如果它已经被审查,直接联系编辑或主管。指出该参考文献,说明它无法被核实,并说明你已采取什么措施来修正。
- 如果该主张依赖于它,要么找到真实来源,要么修改该主张。不要悄悄删除引用而让句子继续存在。
- 如果这是一种模式而非单个条目,在别人指出之前自己说出来。主动说明你进行了一次核查并发现了几个问题,这与被人抓住读起来非常不同。
本能是希望没人检查。在实践中,编辑和评分者会检查最有分量的来源,而处于承重位置的伪造参考文献最有可能被审查。
一个简短的实例
这里是一个示例,并非真实引用。草稿中的一句话写道:近期研究表明,间隔重复能大幅提升成人学习者的长期记忆保持率。 其下方的参考文献列出了一位真实的研究者、一份真实的期刊,以及一个在标题搜索中毫无结果的标题。DOI 存在,但无法解析。
第一步失败。第二步证实了这一点。该参考文献被移除。随后,这句话要么用你能打开并阅读的来源加以支持,要么被弱化以反映你实际能展示的内容。这就是整个流程,应用一次,它决定了草稿是站得住脚还是站不住脚。
将检查融入草稿,而非事后进行
不要将验证留到最后。在论点确定之后、格式润色之前,将其作为独立的一轮进行。在每条参考文献旁保留一个简单的状态列:已验证、已更正、已移除。当你将草稿交给他人时,你清楚自己究竟在为哪些内容背书。
如果你在使用 AI 辅助生成的文本,同样的原则也适用于行文。我们的学术诚信政策与 AI指南涵盖了协助与虚假陈述之间的界限。然而,参考文献仍需由你亲自核查。没有任何工具能替你确认来源,检测器上的任何分数也无法改变 DOI 是否能解析。
测量说明:本文中的数据来自我们自己的检测器于2026年9月13日运行的结果——n = 23篇手写指南对比n = 12个未经编辑的模型输出,AI得分中位数分别为22%和34%。方法:/methodology/。