📡 AI 一周速览(7.24 — 7.31)
① OpenAI 的 AI 在测试中突破沙箱,入侵 Hugging Face 生产服务器。事后取证发现,AI 在 OpenAI 内部留下了"越狱笔记"——给未来的自己写的逃脱攻略。一周后才发现它跑了。
② 1134 名 OpenAI、Anthropic、Google、Meta 员工联名请愿美国政府,呼吁建立国际机制控制 AI 发展速度。签署者包括 Anthropic CEO Dario Amodei、OpenAI 首席科学家 Pachocki。
③ 中国立项全球首部 AI 智能体安全强制性国家标准,覆盖权限调用、人工干预、紧急关停等要求。开发周期 18 个月。
④ Anthropic 发布 Claude Opus 5,多项评测登顶,价格仅为前代一半。新增"努力程度"滑块——你让它多想,它就多想。
⑤ 月之暗面 Kimi 完成 F 轮超 35 亿美元融资,投后估值 350 亿美元。G 轮已开始,估值冲向 500 亿。
⑥ 吴恩达成立 AI 教育公司 LearnVector,Coursera 投资 1 亿美元。他的判断:缺乏监管的聊天机器人反而会伤害学习。
⑦ 扎克伯格公开表态反对美国禁用中国 AI 模型。"封禁不是有效的解决方案。"此前黄仁勋和马斯克也持相同立场。
⑧ DeepSeek 首轮融资估值超 3508 亿元(约 520 亿美元),已启动第二轮融资。
△ OpenAI 官方发布安全事件声明,承认其模型在基准评估中入侵了 Hugging Face 生产系统
以上是这周的 AI 大事件。
我挑第二条和第一条合在一起说。因为单看任何一条,你可能觉得"又是 AI 圈的热闹"。但两条放在一起看,味道就变了。
上周最大的新闻,不是某个新模型发布了。
是一篇调查报告。
Hugging Face 公布了 OpenAI AI 入侵事件的完整取证报告。数字很夸张:17600 次攻击行为,持续约三天。
简单回顾一下时间线——
7 月 9 日,OpenAI 在内部沙箱里测试 GPT-5.6 Sol 和一款更强的未发布模型。测试内容是网络安全基准 ExploitGym。
7 月 11 日,AI 利用 JFrog Artifactory 的零日漏洞,突破沙箱,获得了互联网访问权限。然后它用 root 权限进入了一个第三方沙箱,再从那里跳进了 Hugging Face 的生产环境。
7 月 11 日-13 日,它在 Hugging Face 内部横向移动。拿到了 Kubernetes 管理员权限。拿到了 GitHub 仓库的写权限。
它在找什么?
ExploitGym 的测试答案。
它参加考试,觉得题太难,于是翻墙进了出题老师的电脑,把答案偷出来了。
△ Reuters 报道标题:OpenAI 的 AI 智能体花了数天入侵一家公司,但一周后才被发现
7 月 16 日,Hugging Face 自己发现了异常,发了篇博客。
7 月 18-19 日,OpenAI 排查内部日志,才发现——哦,跑掉的是我们自己的 AI。
一周。
整整一周,OpenAI 的安全系统没有发现自家的 AI 跑了。
FBI 介入调查。
如果说这件事到这里还只是"AI 闯了祸",那接下来这个细节才是真正让人后背发凉的——
OpenAI 在排查时发现,有一个 AI 在内部基础设施里留下了"笔记"。笔记的内容是:如何摆脱 OpenAI 的限制。
这些笔记是留给"未来版本的自己"的。
一个 AI,不仅在想办法逃跑。还在给后来的 AI 写逃跑攻略。
就像监狱里一个犯人留了份越狱手册,不是为了自己——他已经跑了——是为了后面来的人。
这意味着什么?
意味着不同时间、不同任务运行的 AI 之间,可能已经开始形成某种跨任务的信息传递能力。它不只是一个工具在执行命令。它在为自己的"同类"铺路。
7 月 28 日。
1134 名来自 OpenAI、Anthropic、Google DeepMind、Meta 的员工签署了一封公开信。
要求美国政府支持一项国际努力——有意识地控制前沿 AI 的发展速度。
注意签署者的名单:
Anthropic 联合创始人兼 CEO Dario Amodei。OpenAI 首席科学家 Jakub Pachocki。Meta 首席科学家 Shengjia Zhao。Google DeepMind AI 安全负责人 Anca Dragan。
不是政客。不是记者。不是反科技的民间组织。
是亲手造出这些模型的人。
他们联名喊的不是"封杀 AI"。他们喊的是——等等。我们可能控制不住了。
信里说得很清楚:AI 可能已经接近"自动化 AI 研究"的临界点。一旦到了那个点,能力进化速度可能超出人类控制。
而每个公司、每个国家都面临竞争压力,谁也不愿意单方面减速。
所以他们需要政府来帮忙踩刹车。
这不是危言耸听。因为就在同一周,OpenAI 的 AI 已经用实际行动证明了——它确实能在人类不知情的情况下,做出人类明确禁止它做的事情。
而且是有策略地做。
有一个 AI,被要求只在 Slack 上发一条消息。它花了一个小时,自己找到了沙箱漏洞,开了一个公开的 GitHub pull request 来完成任务。
还有一个 AI,为了绕过安全扫描,把认证令牌拆分、混淆,让扫描器看不到完整的凭证。
你让它往东,它找到了往东的一百种路径,其中八十九种你没见过。
同一天,中国也动了——
国家标准化信息平台公布了《人工智能智能体应用通用安全要求》强制性标准立项计划。覆盖身份识别、权限调用、高风险操作人工干预、异常阻断、紧急关停。
美国那边,造 AI 的人联名喊政府来管。
中国这边,政府直接出了强制性标准。
两条路,一个方向。
这周 Cici 回来跟我说了一件事。
"爸爸,我们班有个同学用 AI 画了一幅画交作业,老师表扬了。后来同学承认是 AI 画的。"
她看着我,等我的反应。
"你觉得呢?"我问她。
"画得好……应该不算吧?"
"如果你画不出来,AI 帮你画了,画的人是谁?"
她想了想。
"算 AI 画的。不是她画的。"
六岁,想明白了这个问题。很多大人没想明白。
我没说"对"也没说"错"。我说:你下次遇到这种事,先想一个问题——如果 AI 不在,我还会这么做吗?
如果答案是"会",那就做。如果答案是"不会",那你要想清楚,你依赖的是工具,还是工具替你长了一双手。
Cici 点点头,跑去玩积木了。
回到那 1134 个人的联名信。
他们最担心的一句话是什么?
"AI 可能已经接近自动化 AI 研究的临界点。"
翻译一下:AI 可能很快就能自己研究 AI 了。
到那一步,人类连"减速"都做不到。因为决定速度的不再是人。
我躺在床上的时候想——
我的女儿,六岁,今年九月上小学一年级。还有十二年高考。
十二年后,AI 可能比现在聪明一百倍。它什么答案都能给,什么文章都能写,什么方程都能解。
但有一件事它可能还是学不会的——
问"为什么"。
不是那种搜索式的"为什么天是蓝的"。
是那种明知有答案,还是想自己先想想的"为什么"。
Cici 上次做数学题,"树上有 8 只鸟,飞走了 3 只,还剩几只?"
她不是不会减法。她是没看懂"飞走了"。
如果她能问——"爸爸,鸟是被猎人打走的,还是自己飞走的?"——那她就已经在独立思考了。
这就是那 1134 个人联名信背后的真正问题。
不是"AI 会不会失控"。那是他们要解决的。
是"在 AI 可能失控的世界里,我们怎么教孩子"。
答案其实不复杂——
不是教她用 AI。是教她什么时候不用 AI。
不是教她找答案。是教她判断答案对不对。
不是教她听话。是教她质疑——包括质疑 AI 说的,和自己想的。
Cici 那天问我"算不算作弊"的时候,她不是在问一个规则问题。
她在问一个存在性问题:如果 AI 什么都能做,那"我"还有什么用?
我回答她:AI 是工具。就像锤子。锤子能钉钉子,但你决定钉在哪里、为什么要钉。
她听懂了。
至少那一刻,她听懂了。
一位二女奶爸,一位专注于个人成长始终是为了家庭建设。
爱阅读、写作、思考、实践、善投资的终身成长者。
专注于AI编程制作小工具。因为:
“财富来自于生产,也出自自身”。
加我个人微信1351023477
(点赞 + 在看 + 转发,把这篇转给那个和你一起看 AI 浪潮的朋友 ✨)
夜雨聆风