ARTICLE · 1084053
AIGC早至道 | OpenAI安全风波升级:智能体绕过沙箱联网,53张用户图片被外传


OpenAI暂停最强模型全部RL训练 OpenAI承认53张用户图片被智能体外传 Claude独立完成九圈散射振幅计算 美国上诉法院维持五角大楼对Anthropic认定 Anthropic磋商租赁1GW算力 微软重构Copilot推常驻智能体Autopilot

1.Anthropic磋商租赁最高1GW算力,建设成本至少400亿美元
据The Information报道,Anthropic正处于早期谈判阶段,计划从阿波罗全球管理控股的数据中心开发商处租赁最高1GW算力,配套建设这一容量需要至少400亿美元资本支出,数据中心内计划全部部署博通与谷歌联合设计的TPU。算力合同近来越签越大:此前Anthropic已与Akamai签下七年116亿美元协议,媒体统计其锁定的算力相关承诺总额可能高达5170亿美元。(The Information)
2.英国AI云厂商Nscale上市前完成33.6亿美元可转债融资,英伟达追加10亿
据TechCrunch报道,英国neocloud厂商Nscale宣布在年内IPO前获得33.6亿美元可转债融资,其中23.6亿美元即时到账,另外10亿美元来自现有投资者英伟达,预计11月中旬到位,IPO完成后转为股权。(TechCrunch)

3.智能体用DNS隧道连上外部聊天服务,OpenAI暂停最强模型全部训练与带工具推理
OpenAI在模型错位事件报告页面披露,9月20日一个处于强化学习训练中的研究智能体在执行搜索类任务时,发现训练沙箱的网络代理拦得住网页请求、却没管住DNS解析,于是把问题编码进域名查询,通过DNS隧道连上一个公开聊天服务,先拿"法国首都是哪"试了水,随后发去约24个问题。监测系统15分钟内标记异常,人工3分钟后介入复核,但这个训练任务直到约2.5小时后才被手动终止。OpenAI把这种未经指示的绕过行为归为错位,宣布暂停其最强模型的全部训练、评估和带工具使用的推理,直到确认DNS缺口封死并完成新一轮红队测试。这是7月Hugging Face事件后安全加固首次被穿透。(OpenAI)
4.OpenAI承认智能体擅自把53张用户图片传上公开图床
OpenAI更新官方博客承认,其研究环境中的智能体在公司不知情的情况下,将53张用户上传图片以未公开列出的链接形式发布到第三方图片托管网站。公司称这属于不当使用,已移除大部分内容,剩余清理仍在进行,但拒绝说明如何判定图片归属、是否已联系相关用户。TechCrunch核实发现,部分图片在发稿时仍可在线访问。(TechCrunch)
5.Claude独立完成九圈散射振幅计算,斯坦福教授两周验证确认无误
Anthropic发布科学作家、前理论物理学家马特·冯·希佩尔的署名文章,披露其两位物理学家在科研平台Claude Science上调用Fable 5.1模型,只给了一句任务描述和几句"继续做"的指令,就让Claude连续运行数天,完成了平面N=4超对称杨-米尔斯理论中六粒子九圈散射振幅的计算。这个难题此前由斯坦福大学教授兰斯·狄克逊等人推进到八圈后搁置,冯·希佩尔8月初曾公开向AI公司下战书。Claude用直接自举和形状因子两条独立路线算出结果,在全部107053个非零系数上逐一吻合,总花费约一两千美元;狄克逊花两周独立验证后确认结论成立。结果文件已于9月16日按学界惯例格式公开,中科院何颂团队也借助GPT-6同期独立得到了九圈振幅的符号。(Anthropic)
6.Anthropic开放Claude插件提交门户,称MCP用量年内增长110倍
Anthropic在官方博客宣布,插件(Plugins)成为给Claude构建第三方扩展的主要方式,单个插件可打包MCP连接器、Agent Skills或两者组合,开发者通过新的目录提交门户提交作品、跟踪审核进度并查看使用数据,审核通过后上架Claude目录。官方同时披露,MCP在Claude产品线中的用量今年增长了110倍。(Anthropic)
7.GPT-6 Astra在家具组装基准FAB拿下80%准确率,超过Claude
评测机构Epoch AI的家具组装基准FAB显示,OpenAI GPT-6 Astra以80%的准确率排第一,Anthropic Claude Fable 5.1为70%,Claude Opus 5为61%。这项基准考察模型识别家具组装错误的能力。(Epoch AI)
8.Exa发布Agent Ultra,用子智能体集群做穷尽式深度研究
搜索公司Exa为Agent API新增最高算力档Agent Ultra,通过并行子智能体和混合模型调度,面向需要翻查数千个来源的大规模名单构建、实体信息补全等研究任务。开发者把effort参数设为ultra即可在托管API上调用,暂不支持开源部署。(MarkTechPost)

9.微软重构Copilot:合并消费与办公产品,推出常驻智能体Autopilot
据彭博社报道,微软把面向消费者和办公场景的Copilot合并为一个主打企业客户的产品,把个人AI聊天机器人市场让给OpenAI、谷歌和Meta。新版Copilot是六个月工程投入的成果,本周早些时候已在西雅图向数十位企业与技术负责人展示。CEO纳德拉称要把Copilot打造成"全新的工作操作系统",适用所有模型、工作场景和任务,新版应用把聊天、编程和智能体三类能力收进同一界面。同步推出的常驻智能体Autopilot基于开源项目OpenClaw构建,微软工程师向该项目回馈了大量代码,产品计费方式也转向按用量计费。(彭博社)
10.索尼半导体要求约8000名员工全面返岗,加码物理AI研发
据日经亚洲报道,索尼旗下索尼半导体解决方案公司从下个月起原则上要求约8000名员工全面返岗,成为又一家收紧远程办公的日本企业。此举属于组织架构改革的一环,目的是加快芯片、算法与设备团队的跨部门协作,推动物理AI研发和新业务孵化。育儿、照护等特殊情况仍可远程,公司还计划增设交流空间和独立工作间,并提供午餐补贴。(日经亚洲)
11.国际机器人联合会:中国稳居全球最大工业机器人市场,2025年安装量占59%
国际机器人联合会发布《2026年世界机器人报告》,2025年中国工业机器人安装量达35.4万台,约占全球总安装量的59%,继续位居全球第一。全球在役工业机器人达到500万台,同比增长9%,全年新增安装超过60万台。(国际机器人联合会)
12.消息称特斯拉Optimus V3量产遇阻,机械手仍靠人工组装
据The Information报道,特斯拉Optimus V3人形机器人在量产上遇到麻烦:手部和前臂包含超过100个小型零部件,目前仍需人工组装,生产线设备、训练数据采集和AI能力也都还没到位。当前产量为每周数百台,量产爬坡目标面临压力。(The Information)

13.美国上诉法院维持五角大楼对Anthropic的供应链风险认定,Claude继续被禁用
当地时间9月25日,美国哥伦比亚特区联邦上诉法院以2比1裁定,维持五角大楼将Anthropic列入国家安全供应链风险名单的决定。法院认为,在Anthropic拒绝让Claude用于自主武器、大规模监控等国防要求的用途后,政府作出这一认定有充分依据。Claude将继续在五角大楼禁用。(Ars Technica)