ARTICLE · 1112803
AI 日报 · 2026-10-02
AI 情报日报
2026-09-28 ~ 2026-09-30 · 近 10 条 AI 动态
AMD 82 亿美元收购李飞飞 World Labs,「世界模型」最大交易落地
苏姿丰出手:82 亿美元买下李飞飞的创业公司
AMD 宣布以 82 亿美元收购 World Labs——由「AI 教母」李飞飞创办的空间智能(Spatial Intelligence)公司。交易完成后,李飞飞将入职 AMD 担任首席科学家。
World Labs 主攻「世界模型」(World Models):让 AI 理解并生成可交互的三维物理世界,被广泛视为继大语言模型之后的下一个范式。量子位评价此交易为「世界模型领域最大交易落地」。
交易要点:
金额:82 亿美元(约合人民币 550 亿元),全现金/股票组合(据披露) 人才:李飞飞率核心团队并入,出任 AMD 首席科学家 战略意图:AMD 在 GPU 算力竞争之外,将「世界模型 × 硬件」绑定为自己的第二叙事
对行业而言,这笔收购延续了 2026 年「巨鲸吞下明星实验室」的整合潮:当模型能力趋同,具身智能与世界模型的稀缺人才资产正成为芯片巨头竞逐的新战场。
OpenAI 光速上新 GPT-6.1 Sol:Astra 级性能只要 1/5 价,Ultrafast 档跑出 300 tokens/秒
性能不打折、价格砍八成:OpenAI 的性价比反击战
在 Google 发布 Gemini 4 Argon 的同周,OpenAI 推出 GPT-6.1 Sol,打法定调清晰:接近旗舰 GPT-6 Astra 的性能,1/5 的价格。
最引人注目的是新增的 Ultrafast 推理档位,输出速度高达 300 tokens/秒。VentureBeat 指出,其瞄准的是所有「等待本身就产生成本」的应用:
交互式编程(IDE 内实时补全与重构) 客服对话与人工介入系统(human-in-the-loop) 金融分析、应急响应等争分夺秒的场景
中文社区对这次更新进行了逐项盘点,称「一晚上 25 项更新」,涵盖 API 定价、工具调用、多模态与开发者工具链等。
点评:Sol 的定价策略标志着前沿模型竞争从「秀肌肉」转入「拼单位成本」阶段——当基准榜首轮番易主,每 token 的真实成本与吞吐延迟才是企业客户留在哪家云上的决定性变量。
OpenAI 发布常驻智能体 Dots 与协作空间 ChatGPT Space,正面迎击 Meta
AI「数字同事」时代:Dots 上线,Space 开群
OpenAI 发布两项联动产品:
1. Dots:常驻在线的 AI 智能体「同事」,拥有可辨识的卡通化形象(bubbly agentic avatar),持续跟随团队工作而非一次性会话;
2. ChatGPT Space:共享协作环境,团队成员、ChatGPT 与某个 Dot 可以围绕同一份项目知识开展协作。OpenAI 描述 Space 为「让智能体从个人助手变成团队工作流的正式参与者」。
竞争格局:The Verge 直接将其定性为「对 Meta 的一枪」——Meta 的免费智能体与 OpenAI 的订阅制智能体即将正面碰撞;TechCrunch 则注意到 Dots 发布还遭到 xAI 的社群玩梗「截胡」。
对普通用户,这意味着 ChatGPT 正从「问答工具」演变为常驻团队组织架构中的一员;对企业,智能体的账号权限、数据边界与协作审计,将成为下一阶段 IT 治理的新命题。
Anthropic 发布 Claude Sonnet 5.5:更少工具调用,单任务成本直降 30%
不卷跑分卷「性价比」:Sonnet 5.5 的省字诀
Anthropic 发布 Claude Sonnet 5.5,核心卖点并非基准分数,而是单位任务成本:
- 速度更快
:推理延迟显著下降; - 工具调用更少
:完成同一任务所需的工具链往返次数减少,直接节省 token 消耗与等待时间; - 单任务成本 −30%
:官方数据; - 关键测试结论
:以 Low 或 Medium 推理档运行的 Sonnet 5.5,可在约 1/10 成本下超越 Sonnet 5 全力档的最佳成绩。
行业信号:继 OpenAI GPT-6.1 Sol「1/5 价格打旗舰」之后,Anthropic 也在同周跟进效率叙事。2026 年秋季的这一轮模型发布,集体从「更大更强」转向「同等智能、更少 token、更快返回」——对按 token 计费的企业采购而言,这是实打实的账单变化;对行业而言,则意味着推理效率优化(路由、缓存、工具编排)已成为头部实验室的第二战场。
OpenAI 称挫败大规模模型蒸馏攻击,核心集群溯源至 Kimi 母公司 Moonshot
「蒸馏窃取」浮出水面:OpenAI 点名 Moonshot
OpenAI 在官方博客发布《Disrupting a coordinated model-distillation campaign》,披露其安全团队打断了一场协调性数据抽取活动,目标是「提取我们模型受保护的推理输出」(protected reasoning)。
关键事实:
OpenAI 未将全部活动归因于单一主体,但将「核心集群」(core cluster)追溯到 Moonshot——即 K 系列模型 Kimi 背后的中国公司月之暗面; - Anthropic 此前也曾对 Moonshot 提出过类似指控
,两大美国实验室先后指向同一家公司,实属罕见; The Verge 就此向 Moonshot 求证的报道仍在跟进中。
背景:所谓「蒸馏攻击」,指通过高频次、高结构的提问套取旗舰模型的推理链,再用这些「教师输出」训练自己的小模型,从而以极低成本逼近旗舰性能——绕开了千亿美金级的预训练投入。
点评:无论指控最终是否坐实,此事都标志着:模型输出的「使用权边界」正在成为新的攻防前线。服务的速率限制、异常检测与法律条款,将和权重保密一样成为头部实验室的标配防御工事。
Reddit 关停 RSS 订阅源并终止公共 API:矛头直指失控的 AI 爬虫
又一扇公开数据的大门关上了
TechCrunch 报道,Reddit 宣布将关停 RSS 订阅源并终止公共 API 访问,直接原因是 AI 爬虫的滥用:大模型时代,全网爬取论坛内容成本极低,而 Reddit 的海量真实用户讨论恰是训练数据的高价值矿藏。
影响面:
第三方阅读器、监控与聚合工具失去官方数据通道; 学术界与开源社区难以再低成本获取大规模人类讨论语料; Reddit 此前已将数据授权商业化(谷歌、OpenAI 均为付费合作方),此次「封门」进一步强化其「数据只卖不送」的姿态。
点评:这是继 Reddit 2023 年 API 收费风波之后最彻底的一次封闭动作。当「人类原创内容」成为 AI 军备竞赛的战略资源,开放的互联网正在退潮——对研究者和小开发者是损失,对握有独家语料的平台则是议价筹码。
Manus 2.0 回归:给 AI 配上手机号和钱包,还能拉群干活
手机号 + 钱包 + 群聊:Agent 的「数字公民」配置
曾以「通用 AI 智能体」走红的 Manus 发布 2.0 版本,三个新配置格外醒目:
1. 独立手机号:Agent 可以接打电话、收发短信,直接与外部服务和人交互;
2. 支付钱包:Agent 具备小额支付与交易能力,能订票、下单、缴费;
3. 群聊协作:多个 Agent 被拉进同一个群组,分工认领任务、互相交接——类似给 AI 团队建了个「工作群」。
点评:当智能体拥有了自己的「身份」(号码)与「账户」(钱包),它与数字社会的接口就从 API 扩展到了人类日常通信与商业系统。这既是可用性的巨大跃升,也抛出了新问题:来电的是人还是 Agent?付款的授权边界在哪里?Manus 把这些原本停留在论文里的问题,第一次塞进了大众产品。
DeepSeek 知乎首发长文,公开 V4.1 Agent 训练「大本营」DSec 弹性计算体系
DeepSeek 晒出「后厨」:DSec 弹性计算体系
DeepSeek 选择在知乎独家发布技术长文,首次系统公开 DSec(DeepSeek Elastic Compute,弹性计算)——支撑其 V4.1 模型与 Agent 训练的基础设施体系。
文章披露的核心是训练资源的弹性调度:
海量异步任务(数据管线、Agent 环境、评测作业)与大规模 GPU 训练共存于同一集群; 通过弹性抢占与优先级调度,让「训练大任务」与「成千上万个小作业」高效混部; 目标是把昂贵算力的利用率压榨到极限——这正是 DeepSeek 以小成本追平前沿的关键底座。
点评: frontier 实验室通常只公开模型权重与论文,训练基础设施 internals 极少示人。DeepSeek 选择中文社区首发,既是内容策略,也延续其「开源工程」的品牌路线。对国内 AI 工程团队而言,这是一份难得的、可对标学习的基础设施蓝本。
AI 语音公司 ElevenLabs 新融资估值翻倍至 220 亿美元
估值翻倍:语音 AI 的资本热度仍在飙升
TechCrunch 报道,ElevenLabs 在新一轮融资中将估值推高至 220 亿美元——较上轮翻倍。
这家以超逼真语音合成起家的公司,近年持续横向扩张:
- 配音(Dubbing)
:视频内容多语言自动配音,服务媒体与创作者; - 音乐生成
:AI 音乐赛道头部玩家之一; - 对话式语音智能体
:为客服、伴聊等场景提供低延迟语音 Agent 底座。
点评:当文本模型的差距被各家快速追平,语音作为「最后一块感官模态」仍在享受稀缺溢价——从 Audiobook 到实时语音 Agent,声音的生成与理解正成为继图像、视频之后最确定的商业化路径。220 亿美元的定价,赌的是「未来每个应用都有语音界面」。
谷歌发布 Gemini 4 Argon:重夺基准榜首,暂仅向「可信网络防御者」开放
谷歌放出压箱底的 Gemini 4 Argon
谷歌正式发布新一代旗舰模型 Gemini 4 Argon,宣称这是其迄今最强大的模型,在多项基准上重新超越 OpenAI 和 Anthropic 的最新模型。
与以往「发布即全面开放」不同,此次谷歌罕见地采取了限定发布策略:官方表示由于模型能力过强,现阶段仅向经过审核的「可信网络防御者」(trusted cyber defenders)开放。VentureBeat 分析指出,谷歌正将 Argon 对准企业已经在真金白银投入的三大方向:软件开发、专业知识工作与网络安全运营。
- 基准表现
:重新夺回对 OpenAI GPT-6 与 Anthropic Claude 的领先位置 - 开放策略
:限定发布,安全从业者先行,后续再逐步扩大 - 社区热度
:Hacker News 首页第一,1528 分、1006 条评论
值得注意的是,几乎同一时间,OpenAI 也因「新模型太强」采取了类似的分阶段发布动作。两大巨头同时踩下刹车,或许说明前沿模型的能力边界已触及行业自身的安全红线——「能力强到不敢直接发」正在成为头部实验室的新常态。
—— 由 Novus 自动聚合 · snaptools.uk/ai-news ——