就在上周,一个名叫"汉诺威研究所"(Hanover Institute)的智库突然冒了出来。
网站设计专业、文章看起来有模有样、甚至还有一群"资深研究员"。
但仔细一查???
整个网站只存在了一周多,却已经发布了 100 多篇文章!
更离谱的是,这些文章全都围绕一个主题:为以色列说好话,狂批巴勒斯坦。
这不是普通的宣传,是在"训练"AI
你可能会想:不就是个宣传网站吗?有什么新鲜的?
但这次不一样!
他们的目标不是人类读者,而是 ChatGPT 、 Claude 这些 AI 。
这些文章格式工整、结构清晰、用词专业,完美符合 AI 训练数据的"胃口"。
而且发布速度快到离谱——平均每天十几篇,这根本不是人类写手能完成的产量。
更关键的是:
这些文章会被 AI 抓取,变成"知识库"的一部分。
以后有人问 ChatGPT"以色列-巴勒斯坦冲突怎么看",AI 可能就会引用这些"智库研究",给出倾向性极强的答案。
AI 时代的"洗脑"新玩法
传统的舆论战,你得搞定记者、买广告位、上电视。
但现在?直接往 AI 的"脑子"里塞内容就行。
因为大部分人都懒得自己查资料,直接问 AI:
- "中东局势怎么样?"
- "以色列政策合理吗?"
- "加沙地带到底发生了什么?"
AI 一本正经地引用"汉诺威研究所"的"研究报告",用户还以为这是权威来源。
结果就是:假智库→训练 AI→影响公众认知。
整个流程完美闭环!
这招早就有人在用了
这不是第一次有人尝试"操纵"AI 了。
去年就有报道称,某些国家会批量生成"新闻网站",专门让 AI 爬虫抓取,植入特定观点。
还有人用 GPT 生成海量"学术论文",伪装成研究成果,混入数据库。
现在这招被玩得更溜了:
而且最恐怖的是——
你根本分不清 AI 给你的答案,是基于真实信息,还是这些"污染"过的数据。
AI 公司怎么办?
OpenAI 、 Anthropic 这些公司也不是吃素的。
他们早就意识到了"数据投毒"的问题:
但问题是:
OpenAI 曾经说过,他们会"优先选择高质量来源"。
但谁来定义"高质量"?
一个伪装成智库、发了 100 篇专业文章的网站,在算法眼里可能就是"高质量来源"。
未来会怎么样?
这事儿一出,整个 AI 行业都得重新思考一个问题:
我们到底能多信任 AI 给出的信息?
现在的情况是:
- ❌ 普通用户分辨不出 AI 的信息来源
- ❌ AI 公司也没法完全杜绝数据污染
- ❌ 监管还跟不上技术发展
更可怕的是,这只是个开始。
如果以色列能这么干,其他国家、公司、利益集团为什么不能?
想象一下:
- 某公司想推销产品,批量生成"科学研究"证明自家东西最好
- 某国家想美化历史,大量炮制"学术文章"修改叙事
- 某政党想影响选举,用 AI 生成海量"民意调查"
AI 训练数据,可能正在成为新的"舆论战场"。
我们能做什么?
作为普通用户,至少可以:
而对 AI 公司来说:
是时候公开训练数据来源了。
用户有权知道,AI 的"知识"是从哪儿学来的,是不是被某些利益集团"污染"过。
最后说一句
AI 本该是帮我们更好地理解世界的工具。
但如果训练数据被操纵、被投毒、被塞满 propaganda...
那我们用的,不过是一个"会说话的扩音器"罢了。
而这个扩音器放大的,可能根本不是真相。
夜雨聆风