大家好,我是一名产品经理,也是个普通打工人。
跟你们一样,我白天开会、写需求、跟开发扯皮,偶尔(经常)加班。AI助手这东西我是真用,不是拿来玩的——是真指望它能帮我省点时间,好早点下班。
但用着用着发现一个尴尬的事:工具是好工具,架不住我往里塞了太多东西。
我是怎么把AI助手搞"胖"的
刚开始用WorkBuddy的时候,心态就跟刚搬新家差不多——看见什么都想买。
"哇,这个PRD技能好,装!"
"这个评审技能好,装!"
"这个浏览器自动化好,装!"
三个月下来,16个技能。
听起来挺厉害的?实际用起来是这个画风:
领导让我写个功能PRD,同一句话"帮我写个用户登录的需求",两次输出结构不一样。第一次6章,第二次11章。我不敢交第二次,又手动改了一遍。 评审会用AI生成标注文件,一页原型上密密麻麻标了二十几条。投屏出来的时候,开发看了半天问:"所以重点到底是哪几个?" 有个叫"开发自检清单"的功能,不知道什么时候装的,每次我让AI生成checklist它就给我出一堆前端校验项。我一个PM,给前端写什么checklist啊?
最搞笑的是,回头看才发现我的PRD区蹲了4个技能——一个"百科全书"、一个"全流程"、一个"流程编排"、一个"精炼编写"。它们四个就像四个叫"小王"的同事,我说一句"小王帮我写个PRD",四个人都站起来。
于是我决定花一个下午,把这件事理清楚。
诊断:你不需要那么多,你只需要不打架的
我先把自己当产品经理看这件事——这不就是一个"功能重复"的问题吗?多个功能抢同一个入口、输出不一致、用户体验差。
整理了张表,问题一目了然:
重叠区 | 多少个在抢 | 问题 |
PRD类 | 4个 | 核心场景,一天用五次,结果每次输出都不一样 |
浏览器类 | 2个 | 功能完全重复,我一次都没用过 |
评审类 | 3个 | 触发词串台,说"帮我评审一下"三个技能全响应 |
设计类 | 1个 | 纯设计工具,我一个PM根本用不上 |
核心问题就一个:触发词重叠。 每个技能的开发者都想多覆盖几个场景词汇,最后就是谁都能响应,但谁都不精准。
瘦身三步:合并 → 划地盘 → 互通消息
第一步:合并撞车的(省了40分钟)
对重叠区,挑一个"最靠谱"的留下,把同类的有用的东西搬过来,其他的下岗。
挑谁留下的标准就三条:输出稳、没依赖、不越界。
我的PRD区最后选了
prd-writer留下。原因是它在三个里唯一一个输出「次次一样」的。另外那个"百科全书"有40多种方法论,但每次触发词匹配都抢答——典型的"会的多但什么都不精"。我把那个工作流编排工具的"分步确认"搬过来了——这个很重要,因为之前AI经常自己脑补需求,搬过来后每一步都要等我点头:"需求确认了吗?"→我确认 →"结构确认了吗?"→我确认→"开始写吗?"
结果:PRD输出格式从此100%一致。不用再手动改。
第二步:给撞不上的画地盘(省了30分钟)
评审区的三个技能,功能不完全重叠,但边界模糊。我选择不合并,而是逼它们各认一块地盘:
我的工作阶段 | 用哪个 | 它只干这个 | 不该干的事 |
刚写完文档,自己先看一眼 | doc-review | 找阻塞性问题 | 别给我出体验建议,别帮开发写checklist |
评审会前一晚 | requirement-review | 生成投屏用的标注版 | 一页别超过12条,只标核心功能 |
开发说做完了 | pm-acceptance-test | 逐条验收、出报告 | 别越界到文档审查去 |
然后做了件狠事:把 doc-review 里的"开发自检清单"模式整个删了。这个模式PM真不该用——你让开发按你的checklist写代码,出了bug算谁的?
打工人心得:能跟开发保持边界就别越界。工具也是一样——该谁干的事就给谁干,别觉得自己"全能"。
第三步:让它们互相知道"你干完该我了"(省了20分钟)
之前最大的体验卡点是:AI帮我在一个步骤上做得挺好,但做完就没了。原型生成了,没人提醒我该同步PRD。PRD写完了,没人提醒我该查逻辑。
在这个三个技能末尾各加了一句话:
原型生成完:"是否有PRD?要同步还是生成?" PRD写完/同步完:"要不要检查可跑通性?"
就这么一句话,体验完全不一样。以前是我推着AI走,现在是AI拉着我走。
上班族实操版:你今天下班前就能搞定
别怕,不需要懂代码。照着做就行:
第一步:打开WorkBuddy,在对话里说:
"帮我列出当前所有技能,只看 name、description、触发条件"
第二步:看有没有两个技能对同一件事都会"响应"的,圈出来。
第三步:对每个重叠区,自己回答三个问题:
哪个输出最稳?→留下 其他几个有没有"独门绝技"?→搬过来再扔 不重叠的要不要合并?→不合并就划地盘
第四步:在常用的技能末尾加一句"完成后引导"。比如PRD写完加一句"是否检查可跑通性?"
验证:同一个需求让AI跑3次。输出一致,通过。
全过程大概2小时。建议找个不被打扰的下午做,比如周五下午——反正也没心思干正事。
瘦身前后的体感差距
瘦身前 | 瘦身后 | |
写PRD | 两次结果不一样,要手动改 | 跑三遍都一样,直接交 |
评审标注 | 二十几条,投屏出来大家都懵 | 6到12条,条条打中核心 |
流程衔接 | 做完一步想半天下一步干嘛 | 自动问"下一步是不是XX" |
心里感受 | "这AI怎么不听话" | "我去,这太准了" |
几句掏心窝的话
我不是AI专家,就一个普通打工人。这套方法也不是什么高级方法论,就是用产品经理那套"用户痛点→方案→验证"的思路,把自己的AI助手当产品调了一遍。
如果你也装了十几个技能但感觉越来越乱,试一下。2小时,换一个"指哪打哪"的AI助手,这笔时间投入回报率真的很高。
三句话记住就行:
技能不是越多越好,不打架才是关键 一个阶段一个人,别让三个同事同时觉得该自己上 给它们装上对讲机,干完活知道叫下一个
直接抄:几个能用的瘦身指令
- 盘点技能
:"帮我列出当前所有技能,只显示名称、一句话说明和触发条件。" - 找冲突
:"哪些技能会对同一类请求同时响应?把它们的名称和触发关键词列出来看看。" - 给建议
:"基于我的工作场景,哪个技能最该留?哪个最该删?" - 划边界
:"给我两个技能划清职责:一个负责A,一个负责B,避免互相抢话。" - 删技能
:"把『xxx』这个技能删掉,它和『yyy』重复了。" - 加引导
:"在『xxx』技能末尾加一句:『完成后,是否检查下一步?』" - 验证一致性
:"同一个需求跑3次,对比输出结果是否一致。如果不一致,指出差异点。" — 完 —
我是医疗上市公司 PM,12年工作经验,All in AI 公司里的踩坑先锋。在这里分享 AI 提效的真实经历,不贩卖理论,只讲踩过的坑和能复用的办法。
夜雨聆风