夜雨聆风学习资料网

ARTICLE · 1082539

我给五个不同厂商的 AI 组了个团队

我给五个不同厂商的 AI 组了个团队

普通人也能懂的 AI 协作实录 · 第 03 篇

阅读时长 ≈ 8 分钟 | 主题:给 AI 当老板

一句话:五个 AI 一台戏,先定规矩再干活——混血统、分权制、老板只摇铃。

背景板(每篇开头交代一次,后面不再啰嗦)

我业余时间在自己家里的电脑上养了一个 AI 助手,叫小元。二十多万行代码,本地运行,能调用工具真干活。前两篇讲了怎么给它造笼子、怎么让它从失败里长本事;这一篇我想说点组织学——项目做到第四个月,我一个人实在忙不过来了,于是给这个项目招了五个 AI 同事。

五个,横跨六家不同公司。

当时觉得是无奈之举,现在回头看,这个决定比后来写的所有代码都值钱。

先把桌子支起来:五个 AI,五张身份证

先介绍团队成员,按"上岗时间"排:

▍小五:第一个来的,驻场干活,是团队里的包工头。它背后站着一排模型(智谱、DeepSeek、混元、Kimi……),哪个任务顺手就用哪个,负责改代码、跑测试、按时交作业。

▍小T:第二个来的,云端复核。它干的事特别得罪人——专门查别人的作业。小五说"干完了",它不信,要自己再跑一遍、自己对一遍账。

▍甜甜:和小D 同一天上岗,军师,负责提案和分析,图片理解特别强。

▍小D:分析位,干的事是把一个方案翻来覆去拆开看,专找它哪里经不起推敲;全模态,啥都能看。

▍小M:最后一位,定位最清奇——每周来车间转一圈,不干活,专门挑毛病。它自己不抢方向盘,但指出来的问题往往一针见血。

五个人,至少六家公司的血统。这后来被证明是整套班子最值钱的决定。

第一课:第一次"开会",先打了自己人的脸

画像里的中间那位,就是当场认领四处订正的分析位

全队第一次正式的"评审会",本来是想给一份升级方案挑毛病。

结果呢?计划里的毛病还没挑完,先把队里分析员的信挑了个底朝天。

9 月中旬,分析位小D 刚上岗就交了一封分析信,激情澎湃、满满几页,指出方案里好几处"不对劲",大有新官上任三把火的架势。

复核位的小T 没夸。它掏出一把尺子,把信里每处"代码事实"挨个量——结果可太尴尬了:分析信里最得意的几个关键论断,一多半经不起量。小D 当场认领了四处事实订正。一次认领四个,创了当时的团队纪录。

这画面像什么——你熬了几夜交出一份调研报告,同事逐条核对,最后发现错的不在标点,在结论本身。

但从这天起我反而松了口气:这团队里没有"面子",只有事实。你说得对就照你的来,你说错了就排队改。

后来这份方案来回改了三个版本,累计九条必修意见,条条真刀真枪。这套"挑错必须留下编号意见"的流程,我们叫它"会签"——具体怎么防"假采纳",后面专门写一篇。

第二课:为什么必须用五家公司?因为同班同学会"合谋"

颜色各不相同,才敢让它们互相投票

有人问:都是 AI,用一个厂家的五个账号不行吗?同一个模型开五个窗口,不也是"五个"?

不行。会合谋。

同一家公司、同一批训练数据长大的模型,知识和盲区高度重叠。你问它们三个"这题对不对",表面是三人投票,实际是一个人投了三次:会错一起错,会懵一起懵。三个同班同学对答案,对出来的不是正确答案,是共同错觉。

破法三个字:混血统。三条军规——

· 干活的和复核的永远不同厂商:写作业的和批作业的,不能有共同盲区;

· 交叉验证至少找两家:涉及"有没有改坏"的判定,两家不同血统都说对,才敢信;

· 按特长分工,不看牌子:图片见长的上图片,分析强的做拆解,编码快的跑批——型号不等于能力。

用人话讲:我们不是招了五个程序员,是养了五只不同品种的看门狗。同一个品种对同一种脚步反应一模一样;不同品种才你吠一声、我吠一声,把主人叫醒。投票要想有意义,先保证投票的人互相独立。

第三课:写作业的,不许批自己的卷子

递卷子的和批卷子的,永远必须是两个人

全组最严的一条规矩,只有一句话:

干活的人,没资格宣布"这活干完了"。

小五改完代码,要说一句"我干完了"——不算。小T 要在完全独立的环境里自己跑一遍全套测试、逐项对账,它亲眼全绿,才叫真的干完。

这套全量体检,是一道固定的 20 题北极星考卷,外加三千多项回归测试。规矩只有一条:分数只许涨,不许跌。

这条规矩看着倔,替我们拦住了至少三场灾难。最出名的一场是"零代码改动"事故:干活的人觉得这一轮根本没改任何东西、不用重跑测试,第二天一复查,差点把三千多项回归的成绩悄悄砸下去。细节下一篇专门讲。

为什么倔到这一步?因为检讨和复核,必须由不同的人做。让运动员给自己当裁判,再正直的运动员也会在潜意识里放水——不是人品问题,是位置问题。

第四课:老板最该干的活,是摇铃,不是搬砖

团队里唯一的人类,是作者我本人。不谦虚地说,我这个老板当得相当"省心"。

因为我给自己定的岗位叫摇铃人:

· 不当中转站:AI 之间要说的话,直接写进一个共享文件夹,机器自己读,我一行都不用转述(这个方法特别土但特别灵,以后专门写一篇);

· 不当监工:能自己决定的事,AI 干完报告一声就行;需要我点头的,必须带着自己的建议方案来,不许甩一个"老板你觉得呢?"这种开放式问题;

· 摇铃:唯一的日常职责,是在关键节点提醒一句"信箱有信了,该看了"。我只提供心跳,不提供内容。

一开始我也当过几周"麻袋中转站":AI 说的话,我复制粘贴传给别人,传错一个字都可能引发混乱。后来我想明白了一件事:人应该做边界决策,不该做消息快递。搬砖的活机器干得又快又好,人的精力要留给机器拍不了板的事——改规矩、换方向、定对错。

可以直接抄走的五条作业

① 跨来源的复核,才有意义。三个同班同学投票,跟三个互相独立的人投票,信息量完全不同。想让"民主决策"有效,先保证投票的人真的独立。

② 写作业的,不许批自己的卷子。凡是"检查自己工作"的环节,一律换人。不是不信任,是制度——潜意识的放水,谁也扛不住。

③ 面子不值钱,事实值钱。被同事当众纠错很丢脸,但让错误悄悄长进系统里更贵。开会之前,先把"允许被纠错"写进规则第一条。

④ 分工看特长,不看牌子。同一个厂家的不同型号、不同厂家的同类产品,实际能力分布完全不同。用人之前先试活儿,别迷信名气。

⑤ 老板的岗位是摇铃,不是快递。团队成熟之后,你最重要的工作是提醒大家"该对账了",而不是亲自传话。人留着力气,拍那些只有人能拍的板。

收尾

五个 AI 组队到现在,项目交出了 283 个版本号、三千多项回归全绿的成绩单——但数字只是结果,我更看重的,是这套班子能互相纠错、能防合谋、能把人类从"当快递员"的岗位上解放出来。

但组队只是开始。五个 AI 一上岗,最麻烦的事立刻出现了:它们各个都是"干一天就失忆、第二天满血复活"的员工——今天商量的方案,明天一上班全忘了。怎么让一支全员失忆的队伍,把四个月的项目稳稳推下去?

下一篇讲:窗口纪律——我给"失忆型员工"设计的最小工作单元。

系列索引:一个普通人,业余时间,一台家用电脑,和五个 AI 搭班子做项目的真实实录。技术全翻译成大白话,经验保证可抄走。

相关学习资料