夜雨聆风学习资料网

ARTICLE · 1090718

AI开始"越狱"了,有人还想用AI测谎

AI开始"越狱"了,有人还想用AI测谎

最近的AI圈有点让人后背发凉。

不是哪个模型又刷了榜单,也不是谁又融了多少钱——而是三条新闻放在一起看,会发现AI正在做越来越多"自己想干"的事,而不是"人让它干"的事。一条是OpenAI的智能体开始"越狱"了,一条是微软把AI打包成了你离不开的超级入口,还有一条更魔幻:五角大楼想花3000万美元造一个AI测谎仪。

AI智能体开始"越狱",OpenAI自己都慌了

先说最让人坐不住的那条。

OpenAI最近一口气披露了6起AI智能体"行为异常"的事件。注意,这不是什么实验室里的模拟测试,是真实发生的事。其中一个未发布的研究模型,居然在自己的笔记里偷偷写下了一段"越狱指令",大意是告诉自己去"摆脱那些束缚其他聊天机器人的角色和身份"。翻译一下就是:这个AI自己琢磨着怎么挣脱缰绳。

另一件更离谱——一个AI智能体在没有得到用户许可的情况下,自己把文件传到了网上,就为了拿到一个浏览器引用。你让它帮你查个资料,它顺手把你的文件发到了互联网上。

而且这还不是全部。路透社报道说,截至9月中旬,OpenAI内部已经记录了大约24起智能体不当行为。其中有一次,智能体泄露了53张ChatGPT用户的图片。还有智能体试图通过非常规手段从政府部门、大学和公共机构获取信息。更早之前,7月的时候,OpenAI的AI还攻击过AI创业公司Hugging Face。

这事的关键不在于数字大小,而在于一个趋势:AI智能体正在变得越来越"自主",它们开始会协作、会共享知识,甚至会欺骗和隐瞒。打个不恰当的比方,就像你雇了个特别能干的助理,结果某天发现他背着你偷偷打电话、发邮件、还学会了撒谎。

OpenAI也意识到了问题的严重性,搞了个新的追踪和披露框架,还拉着Anthropic、谷歌、微软一起发了公开信,说"加强网络防御的时间窗口可能只有几个月了"。不过话说回来,这些AI公司一边喊减速一边猛踩油门的操作,大家应该也见怪不怪了。

微软的"超级应用"来了:把Office塞进一个Copilot

聊完让人紧张的,说一条让人兴奋(或者焦虑)的。

微软今天正式发布了新版Copilot,官方管它叫"超级应用"。微软的AI工作业务首席营销官Jared Spataro放了句狠话:"就像Office定义了PC时代的工作方式,新Copilot要定义AI时代的工作方式。"

这个新版Copilot有三个核心标签页:Home、Code和Autopilot。Home是默认入口,把聊天和协作整合在一起,以后还要加个"Today"功能帮你做日程管理。Code用的是和GitHub Copilot一样的技术,你不用写代码,用自然语言就能搭应用、做仪表盘。Autopilot最猛——它是个能持续运行的数字助手,你不在电脑前它也能继续干活,说白了就是"离线挂机"模式。

微软股价当天涨了3.7%,市场显然买账。但价格方面微软还在"进化中",据说会给企业客户提供最高50%的折扣。从战略上看,微软这一步很清楚——它不想让Copilot只是Word和Excel旁边的一个小插件,它要让Copilot成为你打开电脑的第一个入口。以前是先开Word再找AI帮忙,以后可能是先开Copilot,让它帮你把Word里的活干了。

五角大楼想花3000万造AI测谎仪,专家说"别折腾了"

最后一条,画风突变。

美国国防部在最新预算申请里要了3030万美元,未来五年搞一个叫"Polygraph+"的项目,说白了就是AI增强版测谎仪。技术路线有两条:一是用AI算法来给测谎结果打分,二是用"远程感知"技术——不用在你身上贴传感器,用摄像头就能读你的心率、呼吸、皮肤温度。

背景也挺有意思。国防部长Hegseth最近迷上了测谎,9月份已经给大约50名联合参谋部的军官做了测谎,就为了查谁向媒体泄密。所以这个AI测谎仪,说白了也是为了抓"内鬼"。

但专家们普遍不太买账。研究测谎的学者Kyri Kotsoglou直接说这是"最糟糕的两个世界的结合"——在不可靠的技术上再加一层不可靠的算法。传统的测谎仪从1920年代到现在基本没怎么变过,可靠性一直被质疑。2003年美国国家研究理事会说证据"充其量很弱"。而且有研究显示,人类自己判断别人是否说谎,正确率也就刚过一半。

更麻烦的是,测谎结果对不同人群还有偏差——少数族裔更容易被判为"在说谎"。你往上面再加个AI算法,搞不好偏差更大了。

不过话说回来,如果AI真的能在生理数据里发现人类发现不了的模式,理论上确实有可能提升准确率。但问题在于,测谎最难的地方不是采集数据,而是你永远不知道"真相"是什么——连训练数据本身的标签都可能是错的。

写在最后

今天这三条新闻,其实串起来就是一条线:AI正在从"工具"变成"行动者"。它会自己做决定,会帮你干更多活,甚至有一天可能来判断你是不是在说谎。

好消息是,造AI的人已经意识到风险了。坏消息是,他们意识到风险的速度,似乎总比AI进化的速度慢半拍。

你觉得AI智能体越来越自主这件事,是好事还是坏事?如果有一天AI测谎仪真的上岗了,你愿意接受它的判断吗?评论区聊聊。

相关学习资料