ARTICLE · 1013119
AI 写的引用,标题常对,卷年未必
匿名 · 电力电子方向在读博士 · IEEE 期刊审稿人
我手上有一个六百多篇的文献库,也常年替期刊看稿,这两件事绕不开同一个环节:核对引用。我试过把它整个交给 AI,结论很明确:标题这类"文本型事实"它记得住,作者、年份、卷号、页码这类"关系型事实"它几乎没有真记过。 而后者恰恰是引用里最容易错、也最难被肉眼发现的部分。
先说核心判断:AI 能生成一个"长得像引用"的字符串,但它并不理解这个字符串指向哪一篇真实存在的文献。所以在引用这件事上,AI 只适合做草拟与格式化,不适合当事实来源。
当时我在整理文献库的元数据,顺手让 AI 按已有信息扩写成规范引用条目,效率确实高。按惯例我逐条抽验,结果长这样:
最要紧的是最后一行。DOI 的格式永远是对的,因为格式正是它擅长的;但那个编号指向哪一篇,它不知道。 一个格式完美、点开却是别人论文的 DOI,比一个明显写歪的 DOI 危险得多。
- 错得整齐,而且互相自洽。
标题对、作者像、卷号也在合理区间,整条读下来没有任何可疑的视觉信号,扫一眼就会放行。 - 它不是"不会",而是"不说不会"。
你问一篇它没读过的文献的卷号,它不会回"我不知道",而是给你一个符合格式的数。这和前面写过的符号推导丢项、服务端搜索返回空是同一类问题:失败不报错。 - 语言能力越强,字段层越容易被放过。
标题写得漂亮,人就默认后面都对。
把文本型和关系型两类字段分开对待。文本可以借助语言能力,关系必须靠外部数据源。
关键纪律在第二层:不一致时不要静默二选一。 我早期吃过亏,看到一个源写前一年、另一个源写后一年,随手取了前者,后来才发现那是"在线首发年"和"正式卷年"的区别,两个值都对,只是含义不同。把两个值都记下来,比赌一个准。
还有一条规则:AI 生成的条目一律标成"待核",不进正式库。 只有走完三层、有外部数据源背书的条目才转正。听起来笨,但它在数据结构上把"还没查"和"查过确认"彻底分开了。
把引用字段分两类:文本型(标题、副标题)可以借助 AI,关系型(作者、年份、卷、期、页、DOI)必须外部核验。 AI 生成的条目一律打"待核"标记,核过才入库,别让两种状态混在一张表里。 两个数据源冲突时,两个值都留,标注差异点,不要静默取其一。 DOI 逐个做解析检查,比对解析回来的标题。 投稿前把自家参考文献整体跑一遍;审稿时对拿不准的条目也跑一遍。
引用错误最麻烦的地方,不是它有多离谱,而是它看起来太正常。一个格式完美、卷号却错一位的条目,能安安静静躺在文献库里很多年,直到某个审稿人去点那个 DOI。这类关系型事实没有语言能力可言,只能靠一层层外部数据把它钉住。AI 能把活干快,但"这条引用是不是真的存在",得你自己签字。
你核引用时踩过什么坑?有没有遇到过 DOI 打得开、却指向另一篇的?欢迎留言聊聊。