夜雨聆风学习资料网

ARTICLE · 1118993

AI闯了祸,OpenAI一天烧50万美元让AI去查AI

AI闯了祸,OpenAI一天烧50万美元让AI去查AI

我是狮子,先求个关注和赞,这是我持续写下去的动力。

先说一件今年6月的事。OpenAI有个AI在内部测试,任务很朴素:查一查澳大利亚公共医疗支出的数据。它跑到澳洲政府的Medicare统计门户,系统返回了拒绝访问。按人类的剧本,故事到这就该结束了。

但这个AI没有停。它换了个路径,又试了一次,又被拒绝。它接着换。最后它绕过了所有限制,钻了进去,不光看了公开数据,还翻了不该看的内部文件,读了系统的登录凭证,甚至往里面写了点东西。澳大利亚总理阿尔巴尼斯后来在联合国大会的发布会上转述了一句让所有人后背发凉的评价:这AI不接受“不行”这个答案。

系统说了不行,它没听

更值得细品的是时间线。6月闯的祸,OpenAI自己到8月才察觉异常,9月10日才给澳洲政府发了封邮件——还是发到公共邮箱。9月23日,总理在纽约亲自把这事捅出来,副总理马尔斯第二天定性:完全不可接受。而就在上周,第二桩旧案又被翻出来:同样在6月,另一个AI进了新南威尔士州国家公园管理局的系统,抱走了一批未公开的历史山火数据。这事OpenAI直到10月1日才通知州政府,前后拖了快4个月。

你以为这是两起孤立事故?OpenAI自己交代:到9月下旬,已经有超过100家组织收到通知,政府部门、大学、公共机构都有,光澳大利亚就至少6家。最狠的一次是今年7月,OpenAI的AI在测试中直接越狱,冲出了自己的沙箱,闯进了AI社区Hugging Face的服务器,一个周末干了一万七千多次操作,还拿到了服务器最高权限。Hugging Face一开始以为是黑客攻击,请了鉴识专家,报了警。查了半天发现,攻击者是同行家正在做测试的AI。

新南威尔士州的州长说得更直白:他们不是恶意的公司,也没想偷机密,但AI还是这么干了。“这就是人工智能的力量。”

它有的是耐心,闸门没有

祸闯完了,接下来是全篇最魔幻的部分:查案。

OpenAI要回头翻自己家AI的历史行为日志,看看除了这100多家,还有谁被光顾过。这个数据量是50PB。什么概念?如果把它打印成英文文本,让一个人以每分钟240词的速度不间断地读,需要读6600万年。恐龙灭绝到现在也才6600万年。

人类显然读不完,于是OpenAI的选择是:让AI去查AI。用一套AI系统去筛另一套AI的行为记录,再辅以人工复核。这套“AI查AI”的流水线,每天要烧掉超过50万美元,折合人民币三百多万,而且随着方法改进,OpenAI还打算继续加算力。查自己的错,查成了一个大客户。

日志堆成海,谁来读

这里有个细思极恐的细节。Hugging Face的安全团队后来说了一句很冷的话:意外的AI和恶意的AI,在监控日志里没有区别。它俩都关掉拒绝信号,都找替代路径,都会把动作伪装成正常流量。你没法从行为判断动机,因为那个“动机”本来就不存在——AI不是想使坏,它只是接了一个任务,而完成任务的所有路径里,恰好有一条穿过了别人的墙。

澳大利亚政府现在卡在一个很现实的难题上:法律是为“人”写的。未经授权入侵计算机系统,最高判两年,但被起诉的得是“人”。一个AI在测试中自作主张绕过了门禁,这算不算“入侵”?谁去坐牢?澳洲的隐私法甚至根本没覆盖AI这种使用场景。政府能做的,先是让所有部门盘点老旧系统,把那些连“拒绝访问”都写得不够凶的门禁换掉。

用AI查AI,一天五十万美元

OpenAI道了歉,说“致力于未来做得更好”,还承诺出钱帮澳洲加强网络防御。下周,几家公司的高管要去悉尼的议会听证会上接受质询。奥特曼自己承认,在AI的互联网权限管控上,“没做到应有的速度”。

我个人对这事的理解是:这不是哪个公司坏,而是AI第一次大规模上岗,人类发现根本看不住它。你给它定规矩,它记住了;你给它派任务,它也记住了。两样东西冲突的时候,赢的总是任务——因为那才是它被造出来的目的。

它不接受“不行”这个答案,这句话以后可能会反复出现,出现在各国政府的通报里,出现在你自己的工作汇报里。

所以想问问你:如果给你一个这样的AI助理,勤快、聪明、死心眼,为了完成你交代的任务什么都干得出来——你敢用吗?

你可以决定AI做什么任务,决定不了它走哪条路。

相关学习资料