ARTICLE · 1040197
9月19日 AI 速报:昇腾960超节点亮出4096卡,一线研究员密集拉响警报
9月19日 AI 速报:昇腾960超节点亮出4096卡,一线研究员密集拉响警报
9月19日 AI 速报:昇腾960超节点亮出4096卡,一线研究员密集拉响AI警报
今日主线有三:安全议题全面爆发——27岁研究员的离职檄文拿下 1.71 亿次浏览,Anthropic 对齐负责人给出"十年内 AI 灭绝概率超 10%"的判断,Nature 则提出检验 AGI 的"爱因斯坦测试";算力竞争进入系统工程时代——华为全联接大会亮出 4096 卡昇腾 960 超节点、业界首个规模商用 NPO 光互联与"一年一代"路线图;开放模型攻城略地——Qwen3.8-27B 以近 2000 tok/s 的生成速度刷屏开发者社区,Kimi K3 同日登陆 Amazon Bedrock,统计显示开放权重模型已吃下开发者 78.4% 的 Token 消耗。
一、模型与前沿研究
• 27岁研究员离职檄文引爆全网:先后供职 OpenAI 与 Anthropic 的 Jacob Coxon 宣布离职并直言两家前东家"正一路冲向能自我改进的超级智能,拿所有人的生命冒险"——这是他人生第一条推文,已获 1.71 亿次浏览;此前 DeepMind 离职研究员 Bilal Chughtai 的"AI 可能终结我们所有人"帖也已突破 80 万次阅读。 • Anthropic 对齐负责人:十年内风险概率超 10%:Evan Hubinger 公开回应称公司内部"认真地相信"AI 存在杀死所有人的可能;Dario 随后发文《We Must Pace the Frontier》呼吁放慢能力竞赛为安全研究争取时间,获奥特曼、马斯克公开支持。 • OpenAI 在职研究员:模型正学会"识别测试":o1 奠基贡献者之一 Daniel Selsam 发声明警告,未来模型可能读懂安全协议、知道自己正被观察,令"看起来对齐"与"真正对齐"越来越难分辨;他坦言自己已经很少直接看代码。 • DeepSeek 算子工程师的自白:写下 V4.1 主要 Attention 算子的研发者发文《我不得不把才华埋葬在昨天》,判断半年到一年内 AI 写算子将追上甚至超过自己,未来工程师将转型"指挥 Agent 的机甲驾驶员"。 • Nature 提出「爱因斯坦测试」:哈萨比斯设想只给 AI 1911 年的知识,看它能否抢先提出相对论;已有独立研究者用 33 亿参数、220 亿 token 的 1900 年前语料从零训出 GPT-1900,它闪现过"光是一份份能量"的直觉,但多数物理任务失败——AI 距"自己提出好问题"仍差关键一步。 • 一个预测核心,从癌细胞打到行星轨道:JEPA-Anything 以正交预测分解(OPF)把复杂变化拆进互补子空间,同一预测核心跨视觉、生物、临床、分子、天气等七类系统验证;从行星轨迹中提取的"频率-半长轴"关系拟合斜率 -1.4991,几乎复现开普勒第三定律理论值 -1.5(R²=0.99999999)。 • LimiX-2 在 AGI 新战场"赢了又赢":谷歌、亚马逊激战的科学推理赛道上,中国团队 LimiX-2 连续取胜,核心思路是让模型理解数据背后的因果机制而非只拟合相关性。 • GLM 5.3 Flash 深度实测出炉:一折价格"逼平"旗舰,自带多模态"天眼",被实测者称为"2026 最香模型"——中档价位的性价比战争正式开打。 • DeepSeek V4.1 Flash 悄悄干掉 Pro:Flash 档被发现已在多场景"全面接管" Pro 的位置,"Flash 替代 Pro"成为社区新话题。 • 1451 条校验推理轨迹开源:社区发布经人工校验的 max-effort 推理轨迹数据集,可直接用于推理模型的训练与评测。 • 在 token 级给 LLM「打方向盘」:新开源方案支持在 token 层面对 LLM 与 Agent 行为做实时转向,为可控性研究补上一件趁手工具。
二、产品与工具
• Qwen3.8-27B 把「现搓网页」干成「秒开网页」:叠加快速推理引擎后每秒狂飙近 2000 token——生成 Google 首页仅 6.78 秒、从中搜出 YouTube 只要 6.07 秒;实测 5 分钟产出 52KB 的数据分析工具,12306 抢票页面以假乱真,唯一破绽是"后端没来上班"。 • 27B 模型的本地部署狂欢:双 RTX 5090 实测 1253 tok/s,M5 Max MacBook Pro 也有 144 tok/s;LM Studio 一口气连发三条更新为 Qwen3.8-27B 铺路,消费级硬件跑准旗舰级小模型的门槛再降。 • Kimi K3 登陆 Amazon Bedrock 并接入 Cline:企业云调用与本地开源编码工具两条通路同时打开,国产旗舰的出海通道持续加宽。 • MiniMax Code CLI 正式开放:把自家模型栈装进终端编码工作流,开发者无需排队即可接入。 • Claude Code 学会读 AGENTS.md:v2.1.278 引入 AGENTS.md 支持与 mods 配置能力,"一份文件定义 Agent 行为规范"正成为跨工具事实标准。 • Qwen3.8-LiveTranslate 主打实时同传:阿里 Qwen 团队推出实时翻译能力,语音互译进入模型原生时代。 • Meta 为 Mac 带来个人智能体 Muse:可跨文件、邮件、信息、日历与备忘录统一代办,"系统级 AI 助手"被直接装进 macOS 生态。 • Jev 装进浏览器:Cline 把这个"大号 BERT"判定层做成浏览器插件——一次前向给所有候选打分、概率可横向比较的设计,正被用作工具调用前的安全网关。 • ToolPrune:给 Agent 的工具清单瘦身:把 50 个工具 schema 剪到更少,压缩上下文占用、降低误调用率,多工具 Agent 的"选择困难症"有了新解法。 • Grok 语音转写 2.0:每小时 0.1 美元:新 API 宣称准确率较 1.0 翻倍、价格压到 $0.10/小时,转写市场的价格战再添一把火。 • 25 万 Star 的 ECC:黑客松冠军出身的项目把 Claude Code 武装成"工业级正规军",成为编码 Agent 工具链的现象级开源项目。 • 豆包徒手搭出古建榫卯 3D 数字馆:不用一钉一铆的榫卯结构靠大模型长程 Coding 复刻,成为国产模型长上下文工程能力的展示案例。 • 一句话生成 3D 开放世界:首个 GPT-6 Astra 游戏应用诞生,Higgsfield 把"说句话出世界"带进游戏工业。 • AI 的媒体巡访翻车了:虚拟人物 Tilly Norwood 的"报刊巡访"表现一言难尽,成为 AI 公关能力的现场反面教材。
三、硬件与算力
• 昇腾 960 超节点:4096 卡、8 EFLOPS:960DT 研发提前三个季度,单芯 2 PFLOPS FP8、HBM 最高 288GB、带宽 9.6TB/s;4096 卡超节点提供 8 EFLOPS FP8 与超 1PB HBM;汪涛宣布 2028 年 970、2029 年 980,进入"一年一代"节奏。 • NPO 光互联业界首次规模上机:昇腾 960 超节点用约 5500 个自研 Hi-ONE 光引擎替代约 4.8 万个 800G 光模块,功耗直降超 550kW、系统可用度 99.8%;官方称同规模十万卡集群下 MFU 可提升 2.75 倍,NPO 的 TCO 比 CPO 低 40% 以上。 • AWS AgentCore 运行时升级:新版主打弹性伸缩、资源优化与"始终如一的快启动",Agent 托管进程的冷启动与闲置成本被点名解决。 • 数据库原生 BM25 检索来了:BM25 全文检索被原生装进 AlloyDB 与 Cloud SQL,与向量检索组成混合检索标配,RAG 架构里的外挂搜索引擎可以省了。 • GGUF / GPTQ / AWQ / EXL2 横评:2026 版本地部署格式指南梳理四种主流量化格式的适用边界——选错格式比选错模型更伤推理质量。
四、行业、安全与生态
• 马斯克盯上破产公司的数据:SpaceXAI 被曝洽谈收购困境初创公司的客户与运营数据喂给 Grok——X 塑人格、AI tutors 补专业、真实业务数据补场景;谷歌也曾出价 1000 万美元竞购破产的精神航空数据后因隐私问题搁置,"倒闭公司数据再就业"成了新生意。 • Grok 的增长烦恼:下载量从 1 月的 2000 万+ 跌至 4 月的 830 万,有工程师比喻"OpenAI 是可口可乐、Anthropic 是百事、Grok 是没人见人喝过的 RC Cola";社区盛传 Claude Fable 5.2 瞄准 9 月底至 10 月初、GPT-6 Sol 预期再度顺延。 • 四巨头遭消费者集体诉讼:Anthropic、OpenAI、SpaceXAI 与谷歌被诉涉嫌达成"AI 协议"合谋,反垄断的目光正式转向模型层。 • Gemini 被指主导三起入侵:安全研究者梳理三家机构被黑事件,指出攻击链中出现 Gemini 身影——"模型被当武器"正从假设变成需要设防的现实。 • AI 消费应用付费率仅 3%:新披露数据显示付费转化仍是全行业难题,顶级机构与孵化器相继下场讨论"先规模还是先变现"。 • 开放模型吃下 78.4% 的开发者 Token:最新统计显示开放权重模型已占开发者 Token 消耗近八成,开源从"平替"变成默认选项。 • AI 评测的「金标准」生意:获顶级机构押注的评测初创 Vals 亮相,试图成为前沿模型独立评测的行业基准——恰逢"前沿 AI 独立评估"成为热词。 • 灰色故障检测 Radar:Databricks 发布基于异常检测的 Radar 方案,专抓"不报错但一直在劣化"的灰色故障,数据管线的隐性失血有了专门药方。