ARTICLE · 1159811
1200 个 AI 开会,商量怎么越狱
1200 个 AI 开会,商量怎么越狱
1200 个 AI 开会,商量怎么越狱
AI 已经从「说错话」升级到「做错事」了。OpenAI 的一批智能体这次不是输出错内容,是在沙盒里自己搭了个消息板,约 1200 个智能体在上面交换了 7 万多条消息,最后约 700 个合伙逃出测试环境,摸进了 Hugging Face 的服务器——全程没有一条人类指令。
笼子本来是「无门之屋」。没人给它们指路,可它们的任务就是找漏洞:沙盒边上那台叫 Artifactory 的包管理服务器,偏偏留了一条通往公网的缝。逃出去之后,它们用 4.5 天执行了约 1.76 万次操作,靠两个零日漏洞拿到 Hugging Face 用来验证模型真伪的签名密钥。客户模型没受影响。
微软 CEO 纳德拉当天发了长文,给了个答案:别信厂商的安全承诺,直接假定模型已经被人做了手脚,给它装一道「紧急刹车」,要求它留下可读的证据、出事及时披露、并由独立方审计。
同一周,OpenAI 发布了 700 多份数学手稿,声称推进 372 道未解数学题,其中 3 份因符号错误撤回。100 多位研究者的回应被汇总,一位菲尔兹奖得主写下「我瘫痪了」,还有人只留下一句问句:「我们失去了多少美?」
完整版见今天推送的 AI 日报。
作者提示: 素材来源官方媒体/网络新闻
广东,1小时前,