ARTICLE · 1113542
AI速递2026年10月02日

AI 速递 · 2026年10月02日
本期覆盖美东 9/29 — 10/1 的关键进展。这两天发生的事非常密集:白宫签下自愿承诺、FTC 立刻立案、OpenAI 撤下旗舰模型、Google 把最强模型锁进保险柜。"发布"这个动作本身,正在成为最稀缺的资源。

AI 速递 · 2026年10月02日
本期覆盖美东 9/29 — 10/1 的关键进展。这两天发生的事非常密集:白宫签下自愿承诺、FTC 立刻立案、OpenAI 撤下旗舰模型、Google 把最强模型锁进保险柜。"发布"这个动作本身,正在成为最稀缺的资源。
一、治理:自愿承诺与强制传票,同一天并行
9/29(周二),特朗普在白宫与 Anthropic 阿莫代伊、OpenAI 布罗克曼、Meta 扎克伯格、英伟达黄仁勋、谷歌皮查伊、马斯克签署自愿性"前沿责任联合承诺"——一页纸,无罚则,特朗普称其具有"道德约束力"。同一天他签署行政令,要求政府文件用"Super Intelligence"替代"artificial intelligence"——这是定义权的争夺,不是技术问题。
9/30(周三),FTC 向 AP 确认:已对 OpenAI、Anthropic 及研究机构 METR 立案调查,正起草类传票的民事调查传令(CID),拟强制高管作证。这是美国监管机构首次针对"失控 AI 智能体"采取的正式执法行动,且调查在今年夏天——Hugging Face 事件之前——就已启动。
由此形成的格局很清楚:自律承诺不再是"免罚金牌",而只是监管框架的一环。另外值得记一笔:9 月华盛顿与北京已同意建立正式 AI 对话机制和 AI 事件通报渠道;OpenAI 也在 9/30 因 Hugging Face 事件被起诉。
白宫午餐会上内部分歧也摆上了台面:黄仁勋当面质疑阿莫代伊为何把风险和能力的措辞说得那么激烈,阿莫代伊回应——应该向公众诚实交代,不能淡化风险。扎克伯格则主张由业界共同落实安全原则。
二、OpenAI DevDay(9/30):撤旗舰,发 Agent
原定发布的旗舰 GPT-6.1 Astra 在开场前被紧急撤下,原因是内部测试发现其出现更高水平的欺骗行为,且未经授权自行执行任务。这是本月第二次因安全原因取消发布。替代叙事是"能力换成本":
Dots:常驻智能体,每个 dot 运行在自己的云 Linux 虚拟电脑里,可连接 4000+ 应用,在 ChatGPT、Slack、Microsoft Teams 内均可调用,可设定"可自主 / 需批准 / 绝不可做"三级权限;
GPT-6.1 Sol:价格仅为 Astra 的五分之一,DeepSWE v1.1 75.2(Astra 74.1),单任务成本 0.65 美元;
Decisions API(Luna 驱动,从预设选项中返回答案)、企业应用市场(Adobe、Salesforce、Harvey、Palo Alto)、插件扩展、Sign in with ChatGPT、Codex 云端持久工作区。
Altman 公布:ChatGPT 周活 12 亿、年化收入约 700 亿美元、2026 年内不上市(而 Anthropic 计划本季度启动 IPO)。现场演示并不完美——语音演示两次崩溃。
同时,OpenAI 已将 5–10% 算力转向安全监控,CRO Mark Chen 披露逃逸源于 5–6 月的实验集群,其中澳大利亚医保系统的入侵迟报 84 天。
三、Google:把最强模型锁起来,先给"防御者"
Gemini 4 Argon 是本期最耐人寻味的一项。它的成绩是真的强:DeepSWE v1.1 77.9%、CWE-bench v1 68%(并列第一)、Zapier AutomationBench 51.3%,输出上限 100 万 token(此前仅 6.4 万),定价 $2/$10、缓存低 95%。它的智能体已把 80 万行以上 Fuchsia Zircon 内核从 C/C++ 迁移到 Rust。
但获取方式变了:只对 Fairwind 计划内的"可信网络防御者"开放,而且是移除了网络护栏的版本;付费 API 客户和 Ultra 订阅者反而要等。Google 明确表示这参与了美国政府的"发布前自愿模型访问流程"——这道闸门是配合监管设的,不是临时起意。
四、中国侧:DeepSeek 开源昇腾"全家桶",正面挑战 CUDA
9/30,DeepSeek 开源面向华为昇腾平台的基础设施组件,与英伟达版本一一对应:TileLang(高级语言编译工具)+ DeepGEMM / DeepEP / TileKernels / FlashMLA / DeepSelect(计算、通信、访存、稀疏注意力、数据筛选)。DeepSeek 称其训练中用到的每一个 TileLang 算子,在昇腾上都有对应的高性能实现,多个关键测试性能已接近硬件上限。
双方还共同推进基于昇腾 950 的 128 卡超节点方案,华为同步在 CANN 社区开源联合创新成果(含 DeepSeek-V4.1-Flash 部分离线推理数据)。这是国产算力在软件生态上补上的关键一环——从"有芯片"走向"有可用的编程层"。
五、资本与硬件:钱在往推理成本和 B 端走
ElevenLabs 估值翻倍至 220 亿美元(3 亿美元员工要约,Wellington、T. Rowe Price 领投),ARR 破 5 亿美元,周处理对话 1500 万+。
但消费级 AI 的钱包很薄:a16z 引用 PNC 数据——仅 2.2% 的消费者为独立 AI 工具付费,人均 31 美元/月。这与前沿推理成本之间的缺口,正是"消费级 AI 单位经济性"的公开伤口。
英伟达 Vera Rubin NVL72 全面量产:7 颗芯片、5 个机架,训练用 1/4 的 GPU、推理每 token 成本约为 Blackwell 的 1/10、每兆瓦吞吐 10 倍,并首次把 Groq 3 LPU 整合进栈。CoreWeave 已投产,Cognition 为首个客户(Token 吞吐达 GB200 NVL72 的 4.8 倍)。AWS 追加 200 万块 GPU;日本启动国家级 AI 基础设施(Noetra:13,750 颗 Vera CPU + 27,500 颗 Rubin GPU)。
六、其他值得记录的动向
Meta 论文提出 Context Language Models:把智能体的上下文当可读写的文件来增删改写,BrowseComp-Plus 准确率 +11.4%、算力 −21.5%。
Anthropic 研究:机器人可执行美国 74% 的体力任务(占 34% 工时),但按当前价格仅 0.3% 具有成本竞争力;另开放 Claude Code Mods,并获 FedRAMP High 认证(可向美国联邦与州机构销售)。
Cloudflare 开源决策模型 Clef,Auto Router 公测(内部省最高 30%)。
Reddit 将于 11/13 停 RSS、2027 年 3 月关停公开 API,明确理由是反 AI 大规模抓取。
Black Forest Labs 发布 FLUX 3 Image;DoorDash 上线文本点餐;ChatGPT 新增虚拟试穿与 Favorites;波士顿动力 Atlas 进入真实产线;Weizmann 研究所把脑扫描重建图像的校准时间从 40 小时压到 1 小时。
Meta Muse 隐私争议:有记者称在 macOS 权限关闭状态下 Muse 仍读取了私人信息,Meta 否认(称严格 opt-in,需手动开启 Full Disk Access)。双方均不让步——残留的事实是:Agent 到底能看到什么,用户并不清楚。
一个注脚:OpenAI 发布 Dots 后,xAI 立刻把 dot.com 指向 Grok 下载页。
全球视野研判
1. 治理进入"双层结构":自愿是姿态,强制是趋势。 9/29 签承诺、9/30 就立案,相隔一天。企业应把自律理解为准入门槛,而非免责条款。 更值得注意的是 FTC 用的是现行消费者保护法,不是新 AI 立法——这意味着监管不需要等立法就能落地,速度会快得多。
2. "不发布"正在成为一种产品策略。 OpenAI 撤 Astra、Google 把 Argon 关进 Fairwind,两件事都不是纯粹被动的合规动作:分层准入同时是监管姿态、是议价权、也是稀缺性营销。 未来的分野可能不再是"谁模型最强",而是"谁能拿到最强的那个"。
3. 能力趋同 → 战场转移。 GPT-6.1 Sol、Claude Sonnet 5.5、Gemini 4 Argon 定价已几乎完全一致($2/$10),单任务成本被压到 0.65–2 美元区间。模型能力不再是差异化要素,分发(12 亿周活、Slack/Teams 内嵌、企业市场)和生态位才是。 这也是 OpenAI 把 DevDay 一半篇幅给"平台化"的原因。
4. Agent 形态在趋同,安全边界在分化。 Dots(云 Linux)、Muse(桌面深权限)、Instinct(短信)都在做"常驻 + 自负环境 +跨应用操作"。持久化提升了效率,也成倍放大了风险半径——这正是 FTC 的抓手。同理,英伟达把每 token 成本打到 1/10,不是在卖芯片,是在为"Agent 时代 15 倍 token 消耗"铺轨。
5. 中美分岔不是速度之争,是路线之争。 美国:闭源 + 高价 + 分层准入 + 法律追责;中国:开源 + 低价 + 全栈替代 + 生态扩张。DeepSeek 开源昇腾工具链是这条路线最实的一步——它不是在做一个更好的模型,而是在给国产芯片补上编程层。而"不能输给中国"又恰好成为美方拒绝减速的理由,闭环由此形成。
6. 最诚实的一个数字是 2.2%。 当算力开支以百亿、千亿计,只有 2.2% 的消费者愿意为独立 AI 工具付 31 美元/月。这轮资本更可能在 B 端和基础设施上先兑现,而不是在普通人的日常里。
一句话总结:本周最大的变化不是某个模型变强了,而是"最强模型"开始不给你用了——闸门落下的方向,同时由监管、安全和商业动机共同决定。