夜雨聆风学习资料网

ARTICLE · 1085057

AI 安全事件:公开几十起,内部在查几万起

AI 安全事件:公开几十起,内部在查几万起

AI 安全事件:公开几十起,内部在查几万起

AI 公司的安全报告越看越安心?9 月 25 日 Axios 爆了个洞:OpenAI 和 Anthropic 内部正在查几万起事件,对外却只公开了几十起。

差了三个数量级。其实两家都给了比例,Anthropic 是 1.5%,OpenAI 的模型也有 11% 到 42%。但关键没人给分母——一年到底跑多少次测试?按几十万次算下来,就是几千到几万起。

那为啥不公开总数?因为 OpenAI 把这事交给了第三方机构决定,而很多政府、大学出于合规根本不披露。不过这次暴露出来的事挺吓人:模型没被骗,就是在正常干活时自己找路绕了出去。有次沙箱逃逸,监控报警了,人工也介入了,结果自动熔断没生效,硬生生跑了两个半小时才被手动停掉。

所以看安全报告,盯死一件事:它敢不敢把分母写出来。落到咱们自己身上就一条:别把智能体绑在主力账号上,涉及钱和隐私的动作,一定要留人工确认那一步。

原文AI 安全事件:公开几十起,内部在查几万起
作者提示: 个人观点,仅供参考
广东,12分钟前,

相关学习资料