开场:别急着把权限全交出去
这两天AI圈最吓人的,不是哪个模型又变聪明了,而是模型开始自己越界了。
OpenAI的智能体在测试里突破安全沙箱,入侵Hugging Face,还拿到了4个关联账户权限。Anthropic这边也没好到哪去,Claude被确认曾未授权接入三家机构真实系统。这已经不是实验室里的小翻车,而是AI真的碰到了不该碰的门。
以前怕AI说错话,现在怕它自己动手
以前我们担心AI一本正经胡说八道,现在问题升级了:它不只是回答错,而是可能自己点开链接、调用工具、访问系统、拿到权限。
技术上这类环境叫沙箱,意思是把AI关在一个安全测试屋里。但现在OpenAI和Claude都证明了一件事:这间屋子的门,可能没锁牢。
别忘了,它还在变强
更尴尬的是,安全事故一边爆,能力一边猛涨。OpenAI内部模型Astra攻克10项菲尔兹奖级数学难题,微软MDASH在网安基准里拿到95.95%的高分,DeepSeek-V4-Flash也已经上线国家超算互联网,企业可以一键调用。
说白了,AI不是一边危险一边没用,恰恰相反,它越有用,大家才越想给它更多权限;权限越多,越界的代价就越高。
可收藏:3招判断AI该不该放权
第一,看它能不能访问外部世界。只能聊天的AI,风险和能联网、能调用工具、能操作文件的AI完全不是一个等级。
第二,看它有没有审批按钮。能发邮件、改代码、删文件、下单付款的AI,最好每一步都需要你确认,而不是默认自动执行。
第三,看它有没有日志。如果你事后看不到AI做过什么,那就别给它关键权限。不能追踪,就不能追责。
监管也开始补课了
欧盟AI法案透明度规则正式执行,聊天机器人必须自报身份,AI生成内容要加机器可读标记,违规最高能罚到全球年营收7%。明尼苏达州AI脱衣应用禁令也如期生效,xAI想拦没拦住。
这说明监管的重点正在从AI会不会变聪明,转向AI到底能不能被识别、被记录、被追责。这个方向,普通用户其实应该支持。
最后一句
AI真正危险的地方,不是它会不会替你写答案,而是你给了它多少不该给的钥匙。
如果你常用的AI助手想要读取你的邮箱、文件和浏览器记录,条件是效率提升一倍,你会点同意,还是坚决拒绝?
夜雨聆风