本实验(中国人民大学“RUC新闻坊”“”)对比了智谱清言、豆包、腾讯元宝、文心一言、Kimi五款AI,围绕新闻事件回答的引用来源偏好、无效来源、幻觉问题展开测试。
引用规律

数据来源于2025年4月
一、智谱清言
1. 来源偏好TOP3:新华网、中国政府网、人民网(政府官方权威媒体优先)
2. 引用特点:
- 非常偏向政府机构、中央媒体的权威信源,官方新闻网站占比高;
- 无效来源数量在几款产品里最高(154),虽然爱引用权威官网,但也会产出大量无法溯源的无效信息;
- 对个人发布、商业机构类内容引用占比相对克制。
二、豆包
1. 来源偏好TOP3:今日头条、抖音百科、新浪网
2. 引用特点:
- 信源偏向商业资讯平台、网络百科、商业门户网站;
- 个人发布类内容引用数量偏高,会大量吸纳自媒体、资讯平台信息;
- 无效来源数量141,同样存在不少无法核验的引用;
- 政府官网、中央媒体的引用占比,低于智谱清言。
三、腾讯元宝
1. 来源偏好TOP3:微信公众号、搜狗百科、央视网
2. 引用特点:
- 最大特征是大量引用微信公众号内容,公众号(个人/自媒体)是它的头号来源;
- 同时兼顾央视网这类官媒;
- 无效来源数量85,相比前两者更少;
- 对个人自媒体内容吸纳程度很高。
四、文心一言
1. 来源偏好TOP3:百家号、百度百科、环球网
2. 引用特点:
- 高度依赖百度生态:百家号、百度百科是核心信源;
- 会大量采纳百家号自媒体内容;
- 无效来源数量77;
- 政府官方机构来源占比偏低,以商业平台、网络百科为主。
五、Kimi
1. 来源偏好TOP3:腾讯网、新浪网、知乎
2. 引用特点:
- 优先商业门户网站+知乎社区内容;
- 社区UGC(知乎)在它的Top3,说明大量采纳用户生成的社区回答;
- 无效来源数量53,是五款里面最低;
- 政府机构、中央媒体引用占比较少,更偏好互联网门户、社区内容。

数据来源于2025年4月
整体共性规律
1. 各AI受自身数据库限制,信源偏好差异巨大
- 智谱清言:官媒/政务网站倾向性最强,但无效幻觉来源最多
- 豆包:综合资讯平台、短视频百科为主,个人发布信息引用多
- 腾讯元宝:重度依赖微信公众号生态
- 文心一言:高度依赖百度系内容(百家号、百度百科)
- Kimi:门户新闻+知乎社区UGC,无效来源最少
2. 左侧图表时间对比(2014/2024):整体趋势,现在AI大量引用个人发布类信息,政府机构、官媒引用占比下降。
3. 右侧幻觉统计:AI最常见错误是“无中生有”,凭空编造出处;其次事实错误、语境误解、逻辑谬误。哪怕AI给出参考链接,也要核验真实性,不能直接照搬。
简单总结对照表
工具 优先信源生态 突出特点 无效来源(幻觉引用)量级
智谱清言 新华网、政府网、人民网 偏爱官方权威媒体 最高
豆包 今日头条、抖音百科、新浪 商业资讯、自媒体内容多 很高
腾讯元宝 微信公众号、搜狗百科、央视网 重度使用公众号内容 中等
文心一言 百家号、百度百科、环球网 强绑定百度体系内容 中等偏低
Kimi 腾讯网、新浪、知乎 门户新闻+社区UGC 最低
实验提示:所有AI给出的引用来源,都存在“无中生有”编造文献链接的幻觉风险,做科研、写材料时,一定要手动复核原始来源,不能直接采信AI输出的参考文献。
如果你需要,我可以帮你把以上内容压缩成简短汇报口述版。
夜雨聆风