ARTICLE · 1159583
AI摧毁软件护城河丨20261011 AI周报
AI摧毁软件护城河丨20261011 AI周报Anthropic发布Claude Managed Agents动态工作流(公测)并扩大Claude Code Projects公测,主Agent可自己编写分工程序、调度最多1000个Agent协作,官方测试中查Bug能力远超单Agent。 Anthropic披露全公司80%代码由Claude编写、工程师季度交付量为往年8倍。 Anthropic合并Claude Cowork与Chat,统一AI任务工作空间。 Anthropic 在最新研究中让 Claude 在不到四周时间内,由两名懂生物但不具备 GPU 底层优化背景的技术人员监督,自主完成了对 AlphaFold3、Boltz-2、Chai-1、ESMFold2、RFdiffusion 等 30 多个广泛使用的开源生物分子模型的推理优化与重写,在允许少量数值精度变化的情况下实现平均约 4 倍加速,要求输出完全一致时平均加速接近 2 倍,并同步开源了所有优化代码;这项工作证明大模型已具备直接改造复杂科学软件的能力,但报告也坦承“程序能跑通不等于科学结果正确”,且一次性生成的代码距离硬件性能极限仍有数倍差距,后续仍需依赖测量、诊断与迭代优化。 Anthropic 首次公开内部“AI 研发自动化”指标,宣称 RSI(递归自我改进 / AI 研发 AI)已经在实验室中真实发生。 OpenAI修正年化收入预期至500亿美元, IPO计划推迟至2027年。 GPT-6 Astra推翻59年核聚变猜想。马里兰大学等离子体物理学家Matt Landreman用提示词鼓励GPT-6 Astra Pro寻找非轴对称MHD平衡解,AI在20分34秒内找到第一族精确解、次日交出带磁剪切的第二族解,两篇arXiv论文(间隔一天)共同推翻Grad 1967年猜想。 OpenAI在GitHub公开722篇数学手稿,其中175页瞄准四维挂谷猜想(Hausdorff维数=4),97页瞄准比王虹-Zahl更强的三维极大函数版本。引发数学界众怒,Scott Aaronson称"数学末日",陶哲轩转发AHM联合声明抵制,而LeCun等则认为这是数学新时代的开端。 OpenAI发布Dots——由GPT-6 Astra驱动的"24小时AI同事",自带云电脑、连接4000+应用,关掉窗口仍持续推进任务,与xAI的Grok Bot、Anthropic Cowork正面撞车"持续性工作"赛道。 Astra 抢走大量企业 AI 预算, Anthropic 被逼到可能提前发新模型。 ChatGPT Voice正式接入插件(邮件、日历、Slack)和ChatGPT Work,GPT-6 Astra/Sol/Luna三模型在后台接活,全球所有套餐(含免费版)可用,用户动嘴即可让AI建文档、做PPT、搭网站。 OpenAI 发布 ChatGPT Images 2.5,把生图模型真正推进到可多轮、可定点、可生产的修图/设计工作流里。 ChatGPT 正式推出 Word 官方插件,让 AI 直接嵌入办公场景,大幅简化文档处理流程。 谷歌即将推出新一代 Gemini4 模型 Argon,并在内部测试其后续迭代版本 Carbon。 谷歌将Claude Opus 5/Sonnet 5.5集成进Gemini Business企业智能体,马斯克宣布Grok Bot按任务外包给Opus 5.5,两大巨头48小时内集体"接入Anthropic",被解读为针对OpenAI的联合绞杀。 谷歌/DeepMind 等团队提出 Dream-RSI(Recursive Self-Improvement through Evolving Worlds) 论文,核心不是“让大模型重新训练自己”,而是让 Agent 的探索策略通过“历史即世界”的方式自我改进。 字节跳动正加速推进其AI产品豆包向独立个人助理方向发展,已秘密内测名为“Spell”的应用。 字节系AI编程工具TRAE将TraeCode与TraeWork双端合并为统一的新TRAE,提供Agent模式(全局工作台、多Agent并行)与IDE模式(SOLO+IDE)一键切换。 剪映在抖音创作者大会上发布的新功能——剪映Hub,核心是打通了AI视频生成和后期剪辑之间的壁垒。简单来说,以前用AI生成视频,得先导出、再导入剪辑软件,流程是断的;现在剪映Hub把这两步接上了。你可以在同一个环境里:用AI生成图片或视频 → 自动生成分镜脚本 → 一键生成视频片段 → 直接跳转到多轨道剪辑界面做后期。 微软把执行隔离工具 MXC 放进 Windows 11,开发者能限制智能体可碰的文件、网络与邮件。 微软推出 Project Quine,通过 AI 技术整合多领域生物学数据,加速药物研发并减少成本。 DeepSeek 新一轮融资拟募超 800亿元,预计 10 月内完成。 马斯克宣布 Grok Bot 将不再仅依赖自研模型,而是根据任务需求调用多个第三方 API,实现更高效的 AI 任务处理。 SpaceXAI 推出的 Grok4.7 模型在长任务处理、专业领域性能和安全性方面均有显著提升,同时保持了较低的价格。 马斯克/SpaceX 被曝在讨论从陷入困境或已倒闭的初创公司手里买“客户信息 + 运营数据”用来训练 Grok,补足其真实业务场景能力。 英伟达发布了拥有约1亿参数的免费人工智能模型Nemotron3Diarization,专注于语音分割聚类任务。 2026年9月硅谷All-In峰会现场,黄仁勋正演讲,接到特朗普来电并开免提。特朗普直指出:“AI恐慌论是骗局”、“数据中心是未来20—25年的石油”、美国AI竞赛只能加速,不能刹车。黄仁勋配合表态:不会让AI减速发生,哪家公司觉得失控就自己停,别拖全行业。 Meta 旗下 AI 助手 Muse 登录 iPad 平台,上线仅一月下载量超660万次。 腾讯入局Personal Agent赛道,开发代号为Handy Bot的产品,已在微信低调内测。 腾讯签下甲骨文海外算力五年租约,约 70 亿美元。 腾讯开发T-Mem框架,让AI记忆不再依赖相似度检索,而是在写入时就预判未来场景并预设联想线索,使AI学会像人类一样通过“联想回忆”主动唤起关键记忆,填补了传统方案的结构性盲区。 小米MiMo团队发布开源MiMo V2.6系列(Pro/Flash/Ultraspeed),AA智能指数46分登顶全球开源模型第一,与Grok 4.7同分但单任务成本低约30倍。 智谱AI新一代大模型GLM-5.4与GLM-5.5在参数规模上实现重大突破,迈入万亿级别。 智谱宣布完成约50亿美元融资,重点用于下一代GLM基础模型研发及自训练体系打造,同时推进国产芯片适配和推理效率优化。 月之暗面上市前估值跳涨到约 500 亿美元。 月之暗面推出Kimi Code桌面版,通过图形界面提升AI编程体验,并集成多种开发工具。 开源项目REA(Reverse Engineer Anything)通过MCP协议把大模型与Ghidra/Hopper等反编译工具打通,让AI能逆向任何商业软件的二进制代码,三天斩获近8万GitHub星,增速超OpenClaw和Jev。 前OpenAI研究员Diogo Almeida创立的TypeSafe AI仅凭"只会下判断、不会聊天"的决策模型Jev,24天内估值从2亿美元暴涨至75亿美元。 杨立昆LeCun的创业公司AMI发布分层世界模型H-JEPA,多个JEPA逐层堆叠、在不同时间跨度上做规划,高层定粗略计划、低层接力细化,代码与权重全部开源。 AI原生影视公司Utopai Studios基于MiniMax H3深度后训练的定制视频模型Utopai X,以1150 Elo拿下Artificial Analysis盲评榜全球第二、全美第一,物理效果与音频同步两项登顶。 PyTRIO 提出 TaaS(训练即服务)新范式,将大模型训练封装为可编程的 Training API,让企业像调用推理接口一样按需调用训练能力,从而在 PMF 之后用自身数据低成本打造并持续迭代专属模型,从“租用智能”走向“掌控智能”。 Aether AI 提出 RSIAgent 框架,让开源模型在不更新参数的情况下,通过自主探索新环境、沉淀因果规律实现递归自我提升,在 OSWorld 2.0 和 Agents' Last Exam 等基准上超越 GPT-6 Astra 等闭源模型。 安全公司 Hacktron AI 的三名研究员用Claude借两个漏洞打进 OpenAI 社区论坛并进一步接管员工 ChatGPT/Codex 账号,最终在 OpenAI 内部代码仓库提交了一个无害 PoC PR。 前OpenAI后训练VP针对陶哲轩“AI毁掉数学”的言论做出回应:陶哲轩一方有点过度锚定当前 AI 水平,未来超级智能也可以帮人类建立新的概念框架。 甲骨文大幅裁员,全职员工从约 16.2 万降到 14.1 万,一年净减 2.1 万人(约 13%) 机器人训练正从依赖稀缺的真机数据转向利用人类第一视角经验(egocentric data)这一全新的Scaling路径。旧金山湾区公司Maxinsights作为核心“卖水人”浮出水面,通过Coverage-aware主动补采、自研MaxVLM视频理解引擎、SLAM手部轨迹重建等自动化流水线,将原始视频提纯为机器人可直接学习的高密度训练信号,以高达98%的数据良率建立起难以复制的工业级数据基础设施,其下一步目标是积累1000万小时高质量人类经验,致力于成为Physical AI时代的“物理经验引擎”。 Aether AI 发布的因果世界模型 CausalWM(16B),核心是用「Causal Chain-of-Thought(因果思维链)」让世界模型不只是“猜未来画面”,而是先推演物理变化再生成未来。 分子之心(MoleculeMind)发布反应性机器学习力场 QuantaMind,把“万—十万原子级、DFT 精度”的化学反应模拟,从传统方法几乎不可行,提升到接近经典分子动力学速度,让酶催化、质子转移、pH 响应等“反应过程”能被完整拍成“原子电影”。 中国电信开源轻量级大模型 Xing4.0-29B-A4B,专门给那些数据敏感、算力有限、要求本地部署的企业用。 高通公司总裁兼CEO安蒙:移动行业,正在从“以App为中心”的时代,迈入“以智能体为中心”的时代。 米哈游开始尝试让AI角色自主判断局势、参与博弈。 上海人工智能实验室的研究团队构建了性能超越Jev和目前所有相关开源模型的多模态决策SOTA模型Intern-Decision。 Manus 母公司近日完成新一轮超5亿美元融资,估值大幅攀升。此轮融资由博裕投资和 IDG 资本联合领投,老股东腾讯、红杉中国等继续跟投。