乐于分享
好东西不私藏

YC掀桌开源内部AI军团!会计法务全是Agent在干,人类贡献代码竟被“婉拒”

YC掀桌开源内部AI军团!会计法务全是Agent在干,人类贡献代码竟被“婉拒”

一家只有几十人的创业加速器,输出能力却堪比一支军队。它的秘密武器,今天被扔上了GitHub。

2026年7月31日深夜,硅谷最负盛名的创业加速器Y Combinator做了一件让整个AI开发者社区炸锅的事,把自己内部日常使用的多智能体系统“QM”,以MIT许可证完全开源。

这套系统已经在YC的会计、法务、活动策划和工程开发等业务中运转,远非一个demo或闲暇项目。YC甚至用QM来构建QM本身

▲ YC官方账号宣布开源QM,配图展示了多会话并行的Web界面

开源不到24小时,GitHub星标飙过3400,fork超过300。Hacker News讨论帖瞬间冲上热榜。更引人关注的信号藏在系统设计里:Agent正在从私聊窗口里的助手变成公司的基础设施。

从一个Ruby小循环到50个AI员工

故事要从YC官网那篇极简散文说起。

QM经历了三代进化,每一代都踩在真实的痛点上:

第一代是一个极其朴素的Ruby脚本,一个基础的agent loop,挂了几个能读内部数据的工具。第一天就好用,但能力天花板肉眼可见。团队后来给它加了cron定时任务和webhook触发器,勉强撑着。

第二代画风突变OpenClaw(一个流行的开源agent框架)的出现让YC看到了新可能,于是他们转向Hermes,给员工配了超过50个Hermes agent当个人助理想象一下:一家几十人的公司,跑着50多个AI"员工"。

但问题来了,50个agent的"机群管理"开始变成噩梦。 每个人的agent各自为政,配置散落,记忆碎片化,没有统一的权限和安全策略。YC想要Hermes的灵活性,又怀念第一代系统的简单。

于是QM诞生了 名字来自quartermaster,军需官,或者船上负责甲板以下一切协调的那个人。这个角色靠协调甲板下的事务,维持整艘船的秩序。

▲ qm.ycombinator.com 极简官网,讲述了从Ruby到50个Hermes再到QM的完整进化史

一个引擎,无数个隔离房间

理解QM的核心,只需要一个比喻:一个引擎 + 无数个隔离房间。

大多数AI工具是单人模式的,你打开聊天框,输入提示,得到回答,别人看不见。顶多分享一个只读链接但公司的工作通常需要多人协作

QM的设计哲学叫作用域(Scope)

  • 每个员工
    有自己的隔离工作区,你的agent只看得到你授权的东西;
  • 每个频道、项目、房间
    也有自己的边界;
  • 同一个agent进入不同scope,自动切换不同的记忆、文件、密钥、权限、定时任务和沙箱。

换句话说,AI进不同的"房间"就戴不同的"帽子"。在财务房间,它是谨慎的会计助理;在工程房间,它是写代码跑CI的开发伙伴;在活动策划房间,它是盯日程发提醒的项目协调员。隔离是设计目标,权限是第一公民

QM的底层harness(编排壳)还可以替换,你可以接Pi、OpenCode、Codex、Claude Code,甚至其他coding agent。QM不跟任何一个模型绑死,它管的是模型之上的那一层:身份、会话、工具调用、记忆、审批、安全策略。

▲ QM的Web界面:左侧工具栏(文件/Webhook/定时任务/密钥链/记忆/技能),中间是Möbius带可视化会话,右侧并行查询任务

“第一次看到多人AI能用起来”

YC合伙人Jared Friedman的证词可能是最有说服力的:

"过去数周,我每天用QM作为在YC完成工作的主要工具。最有感触的是:一个长期存在、住在公司Slack、能完整访问公司数据的agent,非常有用。在QM之前,大量工作是在Slack和某个AI产品之间复制粘贴。有了QM,工作直接在频道里完成,所有人可见。这是我第一次看到multi-player AI能用起来。"

▲ YC合伙人Jared Friedman描述使用体验:从"复制粘贴"到"频道里所有人可见"

这段话的信息密度极高"复制粘贴"这个动作精准描述了2025年到2026年上半年,绝大多数知识工作者使用AI的真实状态。你在ChatGPT里问了一个问题,得到答案,然后手动复制到Slack告诉同事。这个过程中,AI的输出变成了一次性消耗品,既不可追溯,也不可协作。

QM要解决的就是这个断裂当agent住在Slack频道里,同事可以直接看到它在做什么、做到哪了,可以随时介入、改方向、交接,就像对待一个人类同事一样。

YC设计负责人eve更是直接喊出了一个惊人的判断:

"YC有意保持极精简的团队,却能输出像一支大军。QM在其中扮演了有意义的角色。"

▲ eve自称QM的"头号重度用户",将开源称为"建设者送给建设者的礼物"

人类贡献代码?不好意思,我们有agent

如果说QM的产品设计让人兴奋,那它的贡献模型简直让人震惊。

打开仓库的CONTRIBUTING.md,你会看到一段史无前例的声明:

"鉴于coding agent已经写了大部分底层代码,我们欢迎人类用文字贡献想法,维护团队不接收直接提交的代码PR。"

具体怎么操作?adrs/目录下用非正式语言写一个.txt.md文件,描述你想要的改动。如果方向对齐,维护团队会"烧掉自己的token"让agent来实现。请勿让AI把你的想法膨胀成正式提案。

这可能是开源史上最奇特的贡献指南

Hacker News上的反应两极分化。有人觉得这是"诚实且贴合时代",既然代码都是agent写的,人类的价值就应该回归到决策意图本身。也有人毫不留情地调侃:"不如直接说,我们接受issue,不接受PR。"

但不管怎么评价,这件事本身就是一个极具象征意义的里程碑:当仓库本身就是agent平台时,贡献流程也会被agent重写。 决策与意图归人,代码生产归机器这样的场景已经出现在2026年7月的GitHub。

当Agent进入会计和法务

QM最让人既兴奋又紧张的部分,是它在会计和法务这些敏感场景中的使用。

当agent只是帮你写个side project,最大的风险不过是弄坏本地仓库。但当agent开始接触财务数据、法律文件、客户信息,问题的性质完全改变了:谁能看什么?操作是否可审计?审批是否可追溯?

QM给出了三档安全姿态

  • Strict
    :几乎每次工具调用都暂停等人批准,像是给agent戴上了脚镣;
  • Auto(默认)
    :分类器自动筛选,平衡效率与安全;
  • Dangerous
    :不筛选、不暂停,后果自负

但YC的诚实也令人敬佩SECURITY.md洋洋洒洒地列出了一长串已知限制:命令策略可以被混淆绕过;浏览器动作不完整走核心门控;沙箱内的凭证在使用时是明文;管理员可以读取敏感内容……

这份"自曝家丑"的安全文档,反而是QM最有价值的资产之一。 因为对于任何认真做内控的团队来说,知道系统不能做什么,远比被一个光鲜的demo忽悠要重要得多。

更大的棋局:谁在抢“公司AI操作系统”?

把镜头拉远,QM的开源恰好落在2026年AI生态的大规模收敛之中。

YC自己在Fall 2026的RFS(征集创业方向)里就专门列了一条:Multiplayer AI原文的论证堪称精彩,过去二十年最成功的工作工具,几乎都是靠"多人化"取胜的。Google Docs之于Word,Figma之于Photoshop,共同之处是把单人画布变成了团队同场

"AI agent是团队最强的新工具之一,却仍主要被一个人关在私聊里使用。"

▲ YC公开征集的创业方向中,Multiplayer AI赫然在列

QM既是YC对这个方向的参考实现,也是对创业者的一封明信片:我们自己先趟了这条路,现在把地图摊开给你看。

中文开发者社区已经有人喊出:"LobeHub在做的组织权限、记忆、沙箱、多人协作,跟QM高度重合,怎么都来这个赛道了!"竞争者还包括各类"公司大脑"创业、多人编程harness(如AQ)、以及强调审批与审计的治理产品。

有一条来自社区的云计算类比值得深思:早期每家公司自建服务器,后来基础设施商品化。现在agent基础设施可能正处于"自建 + 开源参考架构"阶段,公司的长期价值可能沉淀在特有的数据、连接器与记忆中。这也解释了为什么YC敢把harness以MIT放出来:参考实现越公开,创业公司越可能在这些资产上形成差异。

最后一个彩蛋

在所有严肃讨论之外,主帖下有一条高赞回复,堪称年度最佳互联网幽默:

"this is cool! you should apply to YC with this"

用YC自己的梗回敬YC 这大概就是硅谷式浪漫

▲ "挺酷的!你应该拿这个去申请YC",互联网从不放过任何一个玩梗的机会

但玩笑背后是一个严肃的事实:当全球最著名的创业加速器把自己的"操作系统"开源,它实际上是在重新定义"公司"这个词的含义。

几十个人,几十个agent,会计法务工程活动全覆盖,代码由AI自己写,人类只需要说人话。

这样的场景就发生在2026年7月。