乐于分享
好东西不私藏

YC突然开源内部AI“军需官”系统!会计法务全被Agent接管,10人团队打出百人战力

YC突然开源内部AI“军需官”系统!会计法务全被Agent接管,10人团队打出百人战力

一家全球最顶级的创业加速器,把自己正在用的AI系统,连会计、法务都跑在上面的那种,直接MIT开源扔了出来。它已经越过demo和概念验证阶段,每天都在真刀真枪地支撑整家公司运转

2026年7月31日深夜,Y Combinator官方账号发了一条推文,语气平静得像一条普通更新:“We've decided to open-source a multi-agent harness we use internally at YC. We call it QM.”

▲ YC官方开源宣布帖,配图为QM的Web UI产品截图,左侧导航栏赫然列着Files、Webhooks、Crons、Keychain等企业级功能

QM,全称quartermaster,军需官,船上负责甲板以下一切协调工作、让事务井然有序的那个角色。YC没有给它起一个花哨的名字,因为它干的就是最不性感但最要命的事情:让AI在一个组织里长期运转

从一个Ruby脚本到50个Agent失控

故事得从头讲

YC内部最早的AI系统,其实就是一个Ruby写的循环,几行代码,挂上几个能读内部数据的工具,第一天就开始产出价值。简单、粗暴、有效后来加上了cron定时任务和webhook触发器,能做的事越来越多。

然后OpenClaw来了这个开源agent框架掀起的风暴,让YC团队看到了新的可能性。于是他们转向,给员工配上了超过50个Hermes agent作为个人助理。

随后,麻烦接踵而至

50个agent的“机群管理”迅速变成噩梦。每个人的agent各自为战,配置散落,记忆碎片化,想做个跨部门协作?对不起,先把上下文从你的聊天窗口复制出来,粘贴到我的聊天窗口,再让我的agent重新理解一遍。所谓AI革命,在这里退化成了数字时代的传话筒游戏

YC的工程团队意识到了一个残酷的事实:他们想要Hermes的灵活性,又想保留第一代系统的简单,而市面上没有任何产品能同时做到这两点

于是QM诞生了

一个引擎,无数个隔离房间

QM的核心设计哲学可以概括为:同一个AI进不同的房间,戴不同的帽子。

▲ 中文技术社区对QM架构的系统解读:Scope机制是整个系统的灵魂

这个机制叫做Scope(作用域)想象一栋写字楼:每个员工有自己的独立办公室,里面放着自己的文件、密钥、记忆和定时任务;同时,大家也共用会议室,Slack频道、项目空间,在那里,AI切换成这个房间的配置和权限。

个人DM是一套,频道是一套,项目是一套。 财务的agent看不到工程的代码仓库,工程的agent碰不到法务的合同草稿,但在一个跨部门项目频道里,它们又能在同一个受控空间里协同工作。

这解决了一个被整个行业忽视了太久的问题:AI工具通常面向个人,公司运作却离不开一群人的协作。

“多人AI”:协作软件的下一次革命?

YC合伙人Jared Friedman的使用体验可能是目前最有分量的一手证词。他说自己数周来每天都在用QM,作为在YC内部完成工作的主力工具:

▲ Jared Friedman称QM让他第一次看到多人AI能在工作中运转

在QM之前,大量工作是在Slack和某个AI产品之间复制粘贴有了QM之后,工作直接在Slack频道里完成,所有人都能看到它正在发生。这是我第一次看到multi-player AI落地工作场景

这段话的信息密度极高它揭示了当前AI工具最大的结构性缺陷,可见性为零你跟AI的对话,同事看不到;AI替你做的决策,老板无法审计;你让agent跑了一个分析,结果只能截图发群。整个过程是一个黑箱里套着无数个小黑箱

QM把这些黑箱打碎了工作过程本身变成了共享产物

这让人想起了过去二十年协作软件的经典路径:Google Docs撼动Word,关键在于十个人能同时看到同一份文档在被修改Figma冲击Photoshop在团队场景中的地位,靠的是设计评审省去了导出、发送、等待、再导出的往返

YC在自己的“Requests for Startups”里专门列了Multiplayer AI条目,逻辑简洁到残忍:AI agent是团队最强的新工具,却仍然被一个人关在私聊里。 当agent开始跑数小时、数天甚至数周的任务时,工作天然牵涉公司里的许多人,而那些人连进度条都看不到。

▲ YC在Fall 2026 RFS中公开呼吁创业者攻克“多人AI”难题

安全:最诚实的恐惧清单

QM那份冗长的SECURITY.md尤其醒目。

YC在安全文档里做了一件在开源世界极其罕见的事情:列出了一份完整的“我们知道自己还做不到什么”的清单。 命令策略可以被混淆绕过、浏览器操作不完整走核心门控、沙箱内凭证使用时是明文、管理员可以读取敏感内容(有审计日志)、已发布应用的capability link是bearer授权……

当一个agent要进入会计系统和法务文件的时候,“谁能看什么”已经进入公司治理的生死线QM提供了三种安全姿态:Strict模式下几乎每次工具调用都要人工批准;Auto模式用分类器筛选外部数据;Dangerous模式则完全放飞,但预置的硬规则依然生效,比如递归删除和破坏性SQL会被直接拦截。

甚至在供应链安全上,他们加了一个npm新版本7天冷却期,防止维护者账号被盗后恶意版本上线。这种细节来自真实的运维压力

代码不要你写,想法请你用白话说

QM的贡献指南大概是2026年开源世界最“叛逆”的一份文件。

CONTRIBUTING.md写道:既然coding agent已经写了大部分底层代码,欢迎人类用非正式文字提交想法。 在adrs/目录下加一个txt或md文件,用散文写清你想要什么改动;如果方向对齐,维护团队会“烧自己的token”来实现。请不要让AI把你的想法膨胀成一份正式提案。

Hacker News上有人辛辣地将其概括为:我们接受issue,不接受PR

但仔细想想,这可能是我们第一次看到一个由agent构建的平台,用agent的逻辑重新定义了人类如何参与开源决策和意图归人,代码生产归机器,一套新的分工由此出现。

一个更大的棋盘

▲ QM Web UI全貌:左侧Agent工具栏,中间Möbius带可视化会话,右侧并行查询YC batch数据

把视野拉远,QM的出现标志着一个清晰的转折点:AI竞争的主战场,正在从“更聪明的个人助手”转向“组织工作基础设施”。

想想看:Claude Code、Codex、Hermes、OpenClaw,这些名字代表的都是个体战斗力的极限拉伸一个人配一个agent,效率翻十倍。但当公司里每个人都有了自己的超级助手,混乱反而加倍了,五十个agent各自生成的分析报告,谁来整合?谁来保证它们没有基于矛盾的数据源得出相反结论?

QM选择搭一个让所有agent有序工作的操场底层可以换Pi、换OpenCode、换Claude Code,harness不在乎你用什么引擎,它只管保证:权限隔离、记忆持久、任务可追踪、产物可共享。

YC设计负责人eve说了一句意味深长的话:“YC有意保持极精简团队,却能输出像一支大军。QM是其中有意义的一环” 一家管理着数百家创业公司的加速器,内部团队精简到令人咋舌,而他们刚刚把让这一切成为可能的工具,免费扔到了所有人面前

▲ YC访问合伙人max的简短总结:想要multiplayer + self-healing的OpenClaw/Hermes?试试QM

有人在Hacker News上给agent单独开了一个Slack频道,结果发现agent开始自行和其他agent约会议他半开玩笑地说:“我从没觉得自己这么像中层管理。”

这话带着玩笑,也透出几分现实当AI进入组织,人类的角色确实在从执行者变成审批者、从操作员变成指挥官QM或许提供了第一张画对方向的地图:AI正从私聊里的秘密武器,逐渐走向整个公司明面上的基础设施

这艘船上的“军需官”,刚刚向所有人敞开了甲板以下的舱门。