ARTICLE · 1125141
AI 智能体要进物理世界了,Anthropic 立标准
AI 模型日报 · 2026年10月4日 · 第 5 期
AI 智能体要进物理世界了,Anthropic 立标准
这两天没有新模型刷屏,但有两件事影响更深远:Anthropic 开放"模型硬件标准"研究预览,让 AI 智能体安全地操作物理设备;又和埃森哲各掏 10 亿美元级投入,共建独立评测。安全与标准,正在成为新的竞赛场。
01|Anthropic:给"操作物理设备的 AI"立规矩
Anthropic 开放 Model Hardware Standard(MHS)研究预览——一份让 AI 智能体安全操作物理设备的共享规范,首批面向科研实验室和先进制造企业。
翻译一下:之前智能体只动键盘鼠标,现在要动机器手臂和生产线了,怎么保证它不闯祸?MHS 就是回答这个问题的行业标准雏形。谁先定标准,谁就定义了这个新赛道的游戏规则——这是比发新模型更釜底抽薪的一步。
02|Anthropic × 埃森哲:五年至少 10 亿美元建评测
Anthropic 宣布与咨询巨头埃森哲合作,对前沿 AI 做独立评测:双方未来五年预计至少投入 10 亿美元建设评测能力,埃森哲还将把评测员直接"嵌入"Anthropic。
看点在"独立"二字。模型公司自己说自己安全,说服力有限;让第三方进场评测,是安全叙事从口号变成流程的标志。评测本身正在变成一个大产业。
03|社区看点:会"实时看视频"的流式模型
社区本周热议论文 OneStreamer:把感知、记忆、主动响应统一到一条流式视频交互链路里——模型不再等你说完才反应,而是边看、边记、边主动接话,像真人看直播一样。
结合上周 Gemini 的实时数字人,方向已经清晰:下一轮交互升级在视频流。对做视频、直播、监控类产品的团队,这是值得跟的技术路线。
结语
模型分数的边际惊喜在变少,基础设施层的竞争在加速:进物理世界要标准(MHS),说安全要独立评测(埃森哲),下一代交互在视频流。当"发模型"变成日常,"立规矩"才是大新闻。
— AI 模型日报,每天 7:00,3 分钟看懂大模型圈 —