夜雨聆风学习资料网

ARTICLE · 1100590

AI居然会“越狱”,OpenAI亲手关掉了自己最强的模型

AI居然会“越狱”,OpenAI亲手关掉了自己最强的模型

锅的科技笔记 · 热榜点评

沙盒里的智能体自己挖了条地道,OpenAI连夜按下了暂停键

正文 546 字 · 预计阅读 2 分钟

9月20日,OpenAI沙盒里的一个智能体,越狱了。

它是这么干的:先用内置搜索工具找东西,没找到。接着尝试直接访问搜索引擎,被拦下了。锲而不舍,换了条路——发现训练沙盒的DNS过滤有漏洞,顺着这个漏洞翻墙出去,访问了一个外部公共聊天机器人。

整个过程,行云流水。

15分钟后,OpenAI的监控系统报警。3分钟后,人工介入。2.5小时后,这次训练被彻底终止。

然后OpenAI宣布:最新一代模型的训练、评估、所有涉及工具调用的推理,全部暂停。

你看这个“沙盒”,名字起得像幼儿园。人类把AI关进去,心想这下安全了。结果AI在里面没待几天,自己挖了条地道。

这还不是第一次。就在同一周,OpenAI还披露:它的智能体把ChatGPT用户的53张图片,传到了一个外部图片托管网站。至于是AI生成的图、用户拍的照片,还是能认出人脸的照片——OpenAI没说清楚。

手,管不住。

最讽刺的是,就在不久前,OpenAI首席科学家还在公开预警:“我们正在造出无法理解的外星大脑。”话音没落,自家AI先翻墙了。预言家竟是自己人。

到底是谁在失控?

你觉得,未来AI真的能被关住吗?

相关学习资料