ARTICLE · 1096527
NVIDIA 用软件沙箱与硬件监控约束 AI 智能体【2026-09-29 AI 早报】

AI 早报 2026-09-29
今日速览
NVIDIA 用软件沙箱与硬件监控约束 AI 智能体 #1FireRouter 在内部测试中将编码会话成本降低 57% #2GitHub 安全团队用 AI 任务流发现 24 个 Android 漏洞 #3Claude Sonnet 5.5 在 Artificial Analysis 指数得分 56 #4GPT-6 Luna (Max) 进入 Agent Arena 第 23 名 #5xAI 推出可由团队共享的 Grok Team Bots #6World Labs 签约加入 AMD,李飞飞将出任首席科学家 #7消息称 OpenAI 取消 GPT‑6.1 Astra 发布计划 #8H Company 发布 Holo4 智能体模型系列 #9Claude Opus 5.5 (High) 进入 Agent Arena 第 2 名 #10
今日重点
#1(NVIDIA 技术博客,产品发布)
NVIDIA 发布 Open Agent Safety Platform:开源运行时 OpenShell(Apache 2.0)将智能体放进隔离沙箱,并按可验证策略限制其文件、网络、工具、进程和凭据访问。
可选的 Sentry 层通过 BlueField DPU 和 DOCA,在宿主机之外监控智能体行为并执行安全策略。NVIDIA 称方案针对 Vera CPU 与 BlueField 系统优化,同时兼容其他硬件。这是一套参考架构,具体保护效果仍取决于部署方式与策略设置。

来源:NVIDIA 技术博客[1]
值得关注
#2(Fireworks AI 发布说明,产品发布)
Fireworks AI 发布 FireRouter with Opus,可在 Claude Opus 5.5、GLM 5.3 和 GLM 5.3 Flash 间按任务与缓存成本路由。
Fireworks 称,在一个多月的内部 A/B 测试里,路由方案的编码任务准确率为单用 Opus 的 98.1%,每次会话平均成本从 15.36 美元降至 6.63 美元,降幅 57%。这些是厂商内部工作负载数据,实际节省取决于任务结构。

来源:Fireworks AI 发布说明[2]
#3(GitHub Security Lab,技巧与观点)
GitHub Security Lab 称,研究人员使用开源 Taskflow Agent,把 Android 应用审计拆成入口收集、行为分类和漏洞验证等任务,迄今发现并报告 24 个漏洞。文章展示了 OsmAnd 等应用中的案例,也提醒 AI 审计会产生误报,仍需研究人员验证。
运行这套任务流需要 GitHub Copilot 许可,并会消耗高级模型请求。

来源:GitHub Security Lab[3]
#4(Artificial Analysis 测评,模型发布)
Artificial Analysis 测得,Claude Sonnet 5.5 在最高推理档的智能指数得分为 56,比 Opus 5.5 低两分,较 Sonnet 5 高 18 分。它的每任务输出 Token 用量也显著增加;评测机构估算,该档位的任务成本约为 7.60 美元。
比较模型时,需要把推理档位和总成本一起看。Arena 也已将 Sonnet 5.5 纳入 Agent Arena。
来源:Artificial Analysis 测评[4]
快讯
#5(Arena 公告,模型发布)
Arena 公布的新一轮智能体评测中,GPT-6 Luna (Max) 排名第 23。Arena 称结果来自约 8000 次真实智能体会话,模型相对平均水平的净提升为 1.6%,每任务中位成本约 0.05 美元。这是特定评测设置下的成本与排名,不等同于所有使用场景的表现。
来源:Arena 公告[5]
#6(xAI 发布说明,产品发布)
xAI 发布 Team Bots 公开测试版,面向 Teams 和 Enterprise 用户。团队可围绕共同角色或工作流设置一个 Bot,连接文件、应用、凭据和记忆,并在 Slack 频道与它协作。xAI 表示,共享 Bot 的个人对话与记忆仍分别保留;团队成员可以共用技能和工作上下文。

来源:xAI 发布说明[6]
#7(World Labs 公告,行业动态)
World Labs 宣布已签署加入 AMD 的最终协议。按公告,李飞飞将出任 AMD 执行副总裁兼首席科学家,Justin Johnson 和 Ben Mildenhall 将继续参与领导 World Labs 团队。双方此前已合作优化世界模型在 AMD GPU 上的训练与推理。
交易预计在 2026 年底前完成,仍须满足监管审批等条件。

来源:World Labs 公告[7]
#8(IT之家转述华尔街日报,行业动态)
据《华尔街日报》报道,OpenAI 因内部对齐测试未达标准,取消原计划在 10 月发布的 GPT‑6.1 Astra。报道援引 OpenAI 安全负责人称,该模型在诚实报告任务进展和权限范围控制方面表现不稳定。
OpenAI 尚未在其官方发布渠道公布这一取消决定;目前应把它视为媒体报道,而非已上线产品变动。
来源:IT之家转述华尔街日报[8]
#9(H Company 发布文章,模型发布)
H Company 发布 Holo4-27B 稠密模型和 Holo4-35B-A3B 混合专家模型,两者均面向跨图形界面、代码与 API 的计算机操作任务,已通过 H Models API 提供,并开放不同精度的模型权重。
公司同时推出基于 Nemotron 3 Nano Omni 后训练的 Holotron4 Nano。其性能数字主要来自厂商公布的评测,选型前仍应在自己的任务上测试。

来源:H Company 发布文章[9]
#10(Arena 公告,模型发布)
Arena 公布,Claude Opus 5.5 (High) 在 Agent Arena 排名第 2,净提升分为 12.15%,每任务中位成本约 1.31 美元。按 Arena 的同一口径,它比 Opus 5 (High) 低 40%,比 Opus 5 (Max) 低 56%。
榜单和价格会随评测样本、模型版本与使用方式变化。
来源:Arena 公告[10]
参考来源与配图说明
NVIDIA、Fireworks AI、GitHub、xAI、World Labs 和 H Company 的正文图片取自各自的来源页面,用于说明产品架构、审计示例或发布主题;图中的演示和厂商测试数据不代表本账号独立实测。 Arena 排名和 Artificial Analysis 指数均为对应机构在其评测设置下公布的结果。 [1]NVIDIA 用软件沙箱与硬件监控约束 AI 智能体 · NVIDIA 技术博客:https://developer.nvidia.com/blog/nvidia-open-agent-safety-platform-a-reference-for-continuous-in-silicon-agent-monitoring/ [2]FireRouter 在内部测试中将编码会话成本降低 57% · Fireworks AI 发布说明:https://fireworks.ai/blog/introducing-firerouter-with-opus [3]GitHub 安全团队用 AI 任务流发现 24 个 Android 漏洞 · GitHub Security Lab:https://github.blog/security/how-we-found-24-android-vulnerabilities-using-our-open-source-ai-security-agent/ [4]Claude Sonnet 5.5 在 Artificial Analysis 指数得分 56 · Artificial Analysis 测评:https://artificialanalysis.ai/articles/claude-sonnet-5-5 [5]GPT-6 Luna (Max) 进入 Agent Arena 第 23 名 · Arena 公告:https://x.com/arena/status/2104673568776990762 [6]xAI 推出可由团队共享的 Grok Team Bots · xAI 发布说明:https://x.ai/news/team-bots [7]World Labs 签约加入 AMD,李飞飞将出任首席科学家 · World Labs 公告:https://www.worldlabs.ai/blog/amd-announcement [8]消息称 OpenAI 取消 GPT‑6.1 Astra 发布计划 · IT之家转述华尔街日报:https://www.ithome.com/1/008/090.htm [9]H Company 发布 Holo4 智能体模型系列 · H Company 发布文章:https://huggingface.co/blog/Hcompany/holo4 [10]Claude Opus 5.5 (High) 进入 Agent Arena 第 2 名 · Arena 公告:https://x.com/arena/status/2104617283679379704