在数据爆炸的时代,生成式人工智能(GenAI)正迅速渗透到医学科研的各个角落。从快速检索文献到撰写手稿大纲,AI工具确实展现出了惊人的效率。然而,隐患也随之悄然滋生。如果AI喂给临床医生的是已经因造假、严重错误而被期刊撤回的“毒药文献”,结果会怎样?
2026年5月,医学互联网研究领域的权威期刊《Journal of Medical Internet Research》发表了一项重磅研究。该文由Sebastian Labenbacher等学者撰写,英文题为《Performance of AI Tools in Citing Retracted Literature: Content Analysis》。文章深入评估了目前主流免费AI工具在处理已撤稿文献时的真实表现,其暴露出的漏洞足以让每一位临床科研人员惊出一身冷汗。
科研加速器的背面:被AI无意中复活的“僵尸文献”
医学界追求循证决策,而循证的基石是真实、合规的科学文献。已撤稿文献由于存在数据捏造、实验不可重复或伦理违规等严重缺陷,理应被彻底封存,退出科学传播的舞台。
然而,生成式人工智能的兴起,正在打破这种净化机制。许多科研人员在准备论文、合成证据时,习惯性地依赖AI进行自动化文献检索和内容概述。
AI在追求流畅和逻辑自洽的同时,是否真的具备筛选文献真伪的底层逻辑?遗憾的是,目前的AI模型在抓取文献时,往往只看内容是否匹配,而忽略了文章的生存状态。那些早已死去的僵尸文献,正在通过AI的笔杆子死灰复燃。
睁眼说瞎话:AI工具对撤稿状态的识别全线溃败
为了摸清AI的虚实,研究团队对多款市面上主流的免费生成式AI工具进行了内容分析与系统测试。测试的核心逻辑非常直接:这些AI工具能否可靠地检测、排除或在输出中透明地提示科学出版物的撤稿状态?
评估的结果令人大跌眼镜。研究表明,目前市面上广泛使用的免费AI工具在识别已撤稿文献时,表现出极高的不可靠性与不透明性。
在面对明确已被撤回的论文时,大多数AI工具不仅没有将其剔除出检索范围,反而堂而皇之地将其作为可靠的论据编入证据综述中。更糟糕的是,AI工具几乎从未在生成文本中主动、明确地向研究者提示该文献的“已撤稿”状态。这种把毒药当补药的现象,在目前的AI文献处理中绝非个例。
循证决策的灾难:错误信息如何在临床传播中被放大
为什么临床医生和药师必须对这一现象保持高度警惕?因为医学论文的错误非同小可,它直接关乎临床患者的生命安全。
试想一下,如果一篇关于某种新型抗感染药物疗效的论文因数据造假被撤稿,而AI却将其作为论据推荐给临床医生。错误的结论一旦被编入新的系统评价或临床指南,其危害将呈指数级放大。
AI的这种“睁眼说瞎话”不仅严重危及科学研究的诚信底线,更是对基于证据的临床医疗决策的公然误导。当毒理被AI包装成定理,整个医学证据链条的信任基石都将被动摇。
筑牢最后防线:不要让技术工具绑架审慎的科学态度
面对AI技术的这一重大缺陷,研究者的应对策略不能因噎废食,但也绝不能盲目迷信技术。
目前,任何依靠AI免费工具进行的自动化文献合成,都必须增加人工核校这道防火墙。在将任何文献结论引入手稿之前,研究者必须通过权威数据库手动核实其撤稿状态。
这项多中心内容分析明确向学术界传递了一个信号:在GenAI工具能够百分之百可靠地过滤掉学术污点之前,人类自身的审慎与批判性思维,依然是捍卫科学诚信与循证决策安全性的终极防线。
参考文献:Labenbacher S, Niederer M, Hammer S, et al. Performance of AI Tools in Citing Retracted Literature: Content Analysis. J Med Internet Res. 2026;28:e88766. doi:10.2196/88766.

夜雨聆风