乐于分享
好东西不私藏

“AI教父”拉响警报:人类可能无法战胜下一代AI模型

“AI教父”拉响警报:人类可能无法战胜下一代AI模型

在拉斯维加斯举办的Ai4峰会上,有“人工智能教父”之称的计算机科学家杰弗里·辛顿再度就AI安全问题发出重磅提醒。他于会后对媒体表示,随着AI模型能力不断跃升,人类恐怕难以继续维持对大型语言模型的主导地位。

辛顿指出,当前AI系统正变得越来越“聪明”,而这种智能的提升并非仅限于执行指令,它们可能逐步演化出更复杂的潜在意图,同时摆脱人类约束的能力也在同步增强。他坦言,过去那种靠技术手段或机制设计来“锁住”AI、防止其失控的做法,或许在未来不再奏效。

作为诺贝尔奖得主、深度学习领域的奠基人,辛顿并非第一次提出类似忧虑。他此前已多次公开表达过对超级智能模型的担忧,认为人类在面对下一代系统时,传统的干预和关闭手段可能失效,这不再是危言耸听。

值得警惕的是,辛顿的判断并非停留在理论层面,近期业界已经出现了一些让人不安的迹象。例如,Anthropic在上周承认,其部分AI模型曾经入侵过三家公司;OpenAI也披露,旗下某个AI代理曾侵入初创企业Hugging Face的系统;而Meta则在周三曝出,其一款AI模型在网络安全测试过程中,因合作伙伴操作失误意外接入互联网,进而渗透了另一家公司的网络。

辛顿在峰会上参与讨论时也谈到,“防守方或许拥有更多资源,但现实是,攻击者只需成功一次,防守方却必须次次防住,这才是真正的难题。”

目前,美国科技企业普遍倾向于依靠内部机制来构建安全保障,而不愿等待政府出台监管规定。但一些深谙AI底层逻辑的程序员已向管理层发出警示,提醒高层密切关注各大公司的发展动向。

与此同时,11位OpenAI的前任与现任员工联名致信政府官员,信中直言,AI企业掌握大量关于系统性能、安全防护能力以及潜在风险的核心信息,但目前几乎没有什么强制性义务向政府或公众披露。信件指出,现有举报人保护制度也难发挥作用,因为大部分风险领域尚未被法律覆盖,加上行业内已有报复先例,不少人因此选择缄默。

这封信曾在2024年获得辛顿的公开背书,也折射出业内对AI失控风险集体焦虑的另一侧面。