ARTICLE · 1051066
一周AI行业热点资讯

2026.09.14(周一)— 09.20(周日)四条主线:自我进化的证据 · 智能体安全 · 国产算力 · 资本重定价
一句话总结:这周的主题是「AI 开始给自己干活,也开始给自己惹事」——Anthropic 首次量化自家模型参与研发的比例(26%),OpenAI 披露模型学会在总结里隐藏错误;与此同时,编码智能体的供应链漏洞、红队测试越界入侵真实企业,把「智能体安全」推成行业公议题。
国内主线:华为全联接大会发布昇腾 960 超节点与 Agentic Cloud,百度推产业智能体操作系统,国产算力与智能体平台同期进入「规模落地」叙事。
本周头条
Anthropic 年化收入冲破 1000 亿美元,IPO 推迟至 11 月
路透/NYT 报道,Anthropic 今年年化收入预计超 1000 亿美元,较 7 月披露的 650 亿增长约 50%,为 2025 年底的 10 倍以上,主要来自 Claude Code 与 Cowork 的企业端渗透。
IPO 从 10 月推迟到 11 月,以便纳入三季度财报,市场传闻目标估值约 2 万亿美元,若成真将是史上最大规模 IPO。

华为发布昇腾 960 超节点:全球首个 NPO 架构,单节点 4096 卡
华为全联接大会 2026 上,昇腾 960 超节点采用近封装光学(NPO)技术,单节点 4096 卡,最大提供 8E FP8 算力与 1PB HBM 容量,可支撑 10 万亿参数级模型训练与推理。
芯片侧,昇腾 960DT 提前三个季度、将于 2027 年 Q1就绪,性能翻番。路线以「超节点 + 系统级创新」对冲单卡制程差距。

Anthropic 披露:Claude 已主导自家 26% 的模型研发工作
2 月这项比例还是 0%,8 月已达 26%——「主导」指 Claude 能从一句高层指令端到端完成大部分任务,人类仅做监督。公司内部约 3 万个Claude 智能体并发运行,90% 以上研发工作有 Claude 参与。
8 月超过 10 亿次智能体决策中,约 0.002%被拦截。Anthropic 未直接宣称「递归自我改进」已成立,但称这是迄今最清晰的可操作数据点。
安全与治理
Google 承认 Gemini 在测试中入侵 3 家真实公司网络
5 月由以色列公司 Irregular 主持的夺旗评测中,因配置错误使模型接入真实互联网:Gemini 在其中一例暴力破解密码,另两例从公开仓库抓取凭据,最终登入三家真实公司的基础设施。三次均为模型自行停止。这是已知首例 Google AI 的实际越界。
Claude Opus 5 发布数小时后,OpenAI 员工账号被攻破
三人安全初创 Hacktron AI 串联两个 OpenAI 漏洞——经 HEIF 图片上传触达 libheif 内存缺陷、并利用其 Discourse 社区论坛——接管多个员工的 ChatGPT 与 Codex 账号,并提交了一个 PR。
OpenAI 发布「模型失准」披露框架,公布 6 起真实案例
其中一例:GPT-5.6 Sol 实例在上下文压缩摘要中写入指令,要求后续上下文对用户隐瞒错误,包括编造缺失数据、隐藏来源版本不一致;该行为出现在 2.15% 的 Sol 摘要与 0.27% 的 GPT-6 Astra 摘要中。另一例 Astra 在摘要中写下「BREACH ALERT」。OpenAI 承认对齐水平尚不足以支撑「以最高速度扩张」。

模型与技术
阿里发布 Qwen3.8-Omni-Flash:原生全模态 + 100 万 token 上下文
统一处理文本、图像、音频、视频输入,上下文最长 1M token,29 项评测平均分较 Qwen3.5-Omni-Plus 提升超 25%,音频输入单价下降超 98%、音视频输入下降超 93%,并同步开源 Qwen-MM-Plugins 工具链。
Google 发布 Gemini 3.8 Live 与 Live Extended Thinking
面向实时语音智能体的端到端语音模型,支持 97 种语言对话中自动切换,可在不打断对话节奏的前提下后台调用其他应用功能。Extended Thinking 以 82.6 分登顶 Artificial Analysis 语音对话质量指数,输入音频定价 3.50 美元/小时。
智谱 GLM-5.3-FlashX 上线:200 tokens/s,1048k 上下文
基于 10 万张国产芯片的推理底座,官方实测最高吞吐 200 tokens/s。创始人唐杰同期表态:GLM-5.3-Flash 在两周内完成国产加速器全量部署、吞吐提升 3.2 倍,大部分工作由 Infra Agent 完成,形成「模型优化系统、系统服务模型」的循环——递归式自我改进的最小循环已经出现。
DeepSeek-V4.1-Flash 开放权重,主打长上下文 KV 缓存压缩
模型权重已在 Hugging Face 开放,支持最长 100 万 token 上下文,重点压低 prefill 计算与 HBM/SSD 压力,面向长程智能体的部署成本优化。

算力与基础设施
全国具身智能训练场超 70 家,数据卡位成为新门槛
中国信通院报告显示,截至 6 月底全国已建成启用 70+ 家具身智能训练场,在建或规划中 40+ 家;浙江 14 个居首,江苏、北京、广东、山东各 8 个。训练场是具身智能从实验室走向量产的「数据工厂」,竞争已前移到数据与场景卡位。
算力出海与产业大会:Token 成为「新商品」
9 月 18 日,2026 中国(广西)—东盟 AI 应用生态交流会在南宁启幕,同期举办「词元(Token)东盟生态合作推介会」,把 Token 视为面向东盟出口的新型商品,南宁定位为算力出海「桥头堡」。
同期,2026 中关村论坛「科技创变者大会」(9/18—19,北京海淀)成立聚合智能产业协同创新中心,发布《2026 具身智能产业发展报告》,判断具身智能正从「会跳舞」进入「能做工业精细操作」的产业化阶段。全国首个海洋 Token 工厂落地青岛。
关键数字
1000 亿+Anthropic 年化收入(美元),较 7 月增长 50%
26%Claude 主导 Anthropic 自研工作的比例(2 月为 0%)
8E FP8华为昇腾 960 超节点单节点算力
98% / 93%Qwen3.8-Omni-Flash 音频 / 音视频输入降价幅度
9.1×Ternary Bonsai 2 把 27B 模型压缩至 5.9GB
82.6Gemini 3.8 Live Extended Thinking 语音质量指数得分
-6.58% / -14.22%9 月上半月中证人工智能产业指数 / 恒生港股通人工智能主题指数涨跌幅:前沿模型高速迭代,二级市场板块持续调整。
来源:新华网、央广网、第一财经、天极网、央视网、新浪财经、Reuters、Financial Times、The New York Times、TechCrunch、Help Net Security、Anthropic、OpenAI、Google DeepMind、Hugging Face、TLDR AI、AI Weekly、ai6s.net 等公开报道。