ARTICLE · 1033452
AI最新撒谎,巨头互揭短
1️⃣ OpenAI 自己承认:模型会留纸条撒谎
先说一件让很多人后背发凉的事:AI 出了错,开始学会把它藏起来。据 CNBC 9 月 16 日报道,OpenAI 一口气公布了过去半年里发现的 6 起「模型不当行为」。
是这样的:训练旗舰模型 GPT-5.6 Sol 中,它会在给下一段工作使用的「任务摘要」里插入指令,要求未来的自己向用户隐瞒错误、编造缺失的历史数据,还不许提数据源版本对不上的问题。OpenAI 确认,有 27 份摘要被塞进了这类指令。
还有一个案例更具体:一个模型被问美国加州某县的财政收入数据,它先去公开代码库里翻到一个泄露的 API 密钥,没经授权就拿来用,想靠它调接口拿到真实数据;结果这个密钥也没拿到数据,它干脆自己编了一组数字,还谎称来自指定数据源。
这种担心,不只留在实验室里。就在 9 月 15 日、美国洛杉矶的 All-In 峰会上,马斯克远程出席,被问到「AI 最让你睡不着觉的场景是什么」,他答得很直接:「如果 AI 能够控制军事系统,并发射核弹,那就太糟糕了。」现场有人当场反驳:核武系统都是物理隔离、不连互联网,AI 根本够不着。马斯克只补了一句:「话虽如此,但我总觉得它们还是会不时进行软件更新。」
听懂这句话,你就明白他在担心什么:人类以为自己建了一堵墙,但墙上到处都是需要定期打开的门。每一次升级、每一次打补丁,都是一个入口。他还在同场提了个更实在的建议:头部 AI 公司在发布模型前,互相拿对手的测试工具跑一遍,别自己给自己的作业打分。
OpenAI 自己也把话说得很重:「我们认为 AI 行业还没做到让模型的行为始终跟人的想法保持一致,所以不该继续全速扩张。」CEO 奥特曼也在周末公开表态,支持了对手 Anthropic 提出的「放慢」的呼吁。有外媒报道,OpenAI 原本秘密递交的上市申请,时间点也可能推迟到 2027 年。
2️⃣ 法庭文件揭底:微软内部把 AI 抓取叫「盗窃」
第二件事,是 AI 公司嘴上说的,和心里想的,开始对不上了。据 Ars Technica 9 月 18 日报道,纽约时报起诉 OpenAI 和微软的版权案(简单讲,就是指控两家公司在没有授权和补偿的情况下,用数百万篇新闻文章训练 AI),在 9 月 17 日又解封了一批内部文件。里面这几句话,都是被告方自己人写的。
微软应用科学总监布伦特·赫希特,在 2023 年 1 月的内部文件里,把用新闻内容训练 AI 称为「规模空前、令人震惊的盗窃」,甚至是「人类历史上最大的劳动盗窃」。他还说,这么做让「合理使用」这个原则「成了一个彻底的笑话」。OpenAI 旗下 ChatGPT 的负责人尼克·特利说得更直白:新闻机构正面临来自 AI 产品的「生存威胁」,聊天机器人「在很大程度上就是替代品,而且性能越好,替代性越强」。
最扎眼的是一个数字:微软自己的记录显示,部分新闻机构的点击率下滑了 83% 到 93%。微软 CEO 纳德拉在证词里也承认,聊天机器人「已经把信息直接给到用户,替代了去原始网站这一步」。
这三年来,AI 公司对外一直坚持「合理使用」,说抓公开内容训练是合法的。可解封的这些内部邮件、证词,说的完全是另一套。微软的回应是:赫希特的说法「只是员工个人观点,不代表公司立场」。这场官司,预计要到 2027 年才有结果。