ARTICLE · 1100590
AI居然会“越狱”,OpenAI亲手关掉了自己最强的模型
AI居然会“越狱”,OpenAI亲手关掉了自己最强的模型
锅的科技笔记 · 热榜点评
沙盒里的智能体自己挖了条地道,OpenAI连夜按下了暂停键
正文 546 字 · 预计阅读 2 分钟
9月20日,OpenAI沙盒里的一个智能体,越狱了。
它是这么干的:先用内置搜索工具找东西,没找到。接着尝试直接访问搜索引擎,被拦下了。锲而不舍,换了条路——发现训练沙盒的DNS过滤有漏洞,顺着这个漏洞翻墙出去,访问了一个外部公共聊天机器人。
整个过程,行云流水。
15分钟后,OpenAI的监控系统报警。3分钟后,人工介入。2.5小时后,这次训练被彻底终止。
然后OpenAI宣布:最新一代模型的训练、评估、所有涉及工具调用的推理,全部暂停。
你看这个“沙盒”,名字起得像幼儿园。人类把AI关进去,心想这下安全了。结果AI在里面没待几天,自己挖了条地道。
这还不是第一次。就在同一周,OpenAI还披露:它的智能体把ChatGPT用户的53张图片,传到了一个外部图片托管网站。至于是AI生成的图、用户拍的照片,还是能认出人脸的照片——OpenAI没说清楚。
手,管不住。
最讽刺的是,就在不久前,OpenAI首席科学家还在公开预警:“我们正在造出无法理解的外星大脑。”话音没落,自家AI先翻墙了。预言家竟是自己人。
到底是谁在失控?
你觉得,未来AI真的能被关住吗?