ARTICLE · 1061083
AI 参考文献查不到:编造套路只有三种
上周课题组一个师弟拿着初稿来找我,说参考文献有一半打不开。我让他把 DOI 挨个丢进浏览器。三条里有一条跳到一篇不相关的论文,两条干脆查无此文。他这份稿子的参考文献,是让模型一次性生成的。
说白了,AI 给参考文献的速度和格式都没问题,问题在它给的那条东西是不是真的存在。
结论先放这里:AI 给出的每一条参考文献都只能当线索,不能当来源。 而它编造的方式,拆开看只有三种。
01 · GHOST CITATION
套路一:整篇论文都不存在
最粗糙的一种,是把整篇论文凭空写出来。作者姓是真的,期刊对口,卷期号看着合理,DOI 长得也像那么回事。你去数据库里搜标题,什么都搜不到。
Cureus 2023 年那项研究就是这么测的。研究者让 ChatGPT 找了 115 条医学参考文献,逐条核对,47% 完全不存在,46% 存在但书目信息有错。
真正既真实又准确的只有 8 条,占 7%。

图 1:三个模型代际的参考文献虚构率对比,从 GPT-4 到 GPT-4o 这一档几乎没有继续下降。
这个比例随模型换代在降,但降得没有想象中快。Scientific Reports 2023 年的实验生成了 636 条引文、覆盖 42 个主题,GPT-3.5 的虚构率是 55%,GPT-4 降到 18%。
到 2025 年,《JMIR Mental Health》拿 GPT-4o 复测,整体虚构率 19.9%,和 GPT-4 基本持平。
NOTE
这三个数来自三项不同研究,样本量和提示词都不一样,只能当量级看,不能互相减。方向是一致的:换模型能压掉一部分,压不干净。
02 · CHIMERA
套路二:真论文被拼错了字段
第二种更麻烦。底稿是真论文,DOI 也能解析,但作者名、年份、期刊或者标题被换成了另一篇的。文献计量里把这种叫嵌合引用。
还是那项 176 条引文的研究。35 条完全虚构,剩下 141 条能追到真实来源的里面,45.4% 带着书目错误,最常见的一种就是 DOI 无效或者指向别处。
176 条里从头到尾没毛病的,只有 77 条。

图 2:176 条 AI 参考文献的核对结果,只有 43.8% 完全正确,六成以上有问题。
这里有个反直觉的点:只检查 DOI 能不能打开,挡不住这种错。 第三方在 2026 年 8 月测过三个主流模型,坏 DOI 里打开一个真实页面的,比打不开的还多。
原因是模型不在检索,它在续写。「作者名 + 期刊 + 年份 + DOI」是一段有固定形状的文本,它把形状补全,顺手从别的论文里借了个真 DOI 塞进去。
03 · MISATTRIBUTION
套路三:真专家挂上了假结论
第三种最难查,因为它每一部分都经得起看。专家是真专家,机构是真机构,引用的那篇论文也确实存在。错的是那句结论,原文里根本没有。
期刊侧已经吃过教训。Springer Nature 在 2025 年撤掉了一本机器学习教科书,46 条参考文献里有 25 条无法核实,抽样中三分之二的引用要么不存在、要么严重失真。
那这跟普通投稿有什么关系?关系在于风险并不均匀。
同一批 GPT-4o 输出,写重度抑郁这种资料极多的题目,虚构率 6%;换成暴食症和躯体变形障碍,直接涨到 28% 和 29%。

图 3:同一批 GPT-4o 输出在不同冷门程度题目上的参考文献虚构率,冷门题目是热门题目的近五倍。
说白了,题目越冷门、越交叉、越新,模型能抄的语言模式越少,编的概率越高。而交叉学科的作者,恰好最不容易一眼看出「这个人不该写这个题」。
04 · VERIFY
十分钟跑完的核对流程
核对不需要一条条读原文,按下面四步走就够。

图 4:参考文献核对四步流程,第三步的三字段比对是拦住嵌合引用的关键。
1. 把参考文献列表里的 DOI 全部抽出来单独成列。没有 DOI 的条目先标出来,那批优先查。
2. 把 DOI 批量丢进 doi.org 或者 OpenAlex、Crossref 的接口。这一步只筛出打不开的,能打开不等于对,别拿它当通过。
3. 对剩下的每一条做三字段比对:标题、第一作者、年份。三个都对上才算真,标题可以模糊匹配,但要设阈值。
4. 冷门题目、交叉题目的那部分全部人工过一遍,重点看结论有没有被拔高。
✅ 值得做:把这个脚本跑一次,把上次投稿的参考文献列表过一遍。100 条里查不出问题,说明你的写法本来就干净;查出三条以上,那三条大概率已经进了你正在改的稿子。
❌ 别做的:把「请只给出真实存在的参考文献」写进提示词就放心用。多项测试里,这类约束改变的是语气,结果没变。
⚠ 注意
数据来源和结论必须自己核过才能写进论文。理由很简单:AI 给的引用本来就不构成学术来源,一旦进了公开发表的正式记录,撤稿成本远高于核对成本。
判断只有一句:AI 帮着找方向可以,落到参考文献这一行,必须你自己一条条核。
明天能做的一件事:打开手上那篇在改的稿子,把参考文献列表里的 DOI 复制出来,按下第 04 节的第②步跑一遍,只看打不开的有几条。
常见问题
Q:AI 给的参考文献查不到,是提示词写得不好吗?
A:不是。换成「只给真实文献」也压不住,模型给的是形状。
Q:哪些东西能批量核对引文?
A:Crossref 和 OpenAlex 的接口都免费,doi.org 能解析单条。见第 04 节四步流程。
Q:冷门方向怎么降低风险?
A:检索改回数据库,让模型只做整理和排序。
你在核参考文献的时候踩过什么坑,是 DOI 打不开,还是打开之后发现根本不是那篇?评论区说说你的情况。