乐于分享
好东西不私藏

你给 AI 助手装的技能,一半是伪需求

你给 AI 助手装的技能,一半是伪需求

大家好,我是一名产品经理,也是个普通打工人。

跟你们一样,我白天开会、写需求、跟开发扯皮,偶尔(经常)加班。AI助手这东西我是真用,不是拿来玩的——是真指望它能帮我省点时间,好早点下班。

但用着用着发现一个尴尬的事:工具是好工具,架不住我往里塞了太多东西。


我是怎么把AI助手搞"胖"的

刚开始用WorkBuddy的时候,心态就跟刚搬新家差不多——看见什么都想买。

"哇,这个PRD技能好,装!"

"这个评审技能好,装!"

"这个浏览器自动化好,装!"

三个月下来,16个技能。

听起来挺厉害的?实际用起来是这个画风:

  • 领导让我写个功能PRD,同一句话"帮我写个用户登录的需求",两次输出结构不一样。第一次6章,第二次11章。我不敢交第二次,又手动改了一遍。
  • 评审会用AI生成标注文件,一页原型上密密麻麻标了二十几条。投屏出来的时候,开发看了半天问:"所以重点到底是哪几个?"
  • 有个叫"开发自检清单"的功能,不知道什么时候装的,每次我让AI生成checklist它就给我出一堆前端校验项。我一个PM,给前端写什么checklist啊?

最搞笑的是,回头看才发现我的PRD区蹲了4个技能——一个"百科全书"、一个"全流程"、一个"流程编排"、一个"精炼编写"。它们四个就像四个叫"小王"的同事,我说一句"小王帮我写个PRD",四个人都站起来。

于是我决定花一个下午,把这件事理清楚。


诊断:你不需要那么多,你只需要不打架的

我先把自己当产品经理看这件事——这不就是一个"功能重复"的问题吗?多个功能抢同一个入口、输出不一致、用户体验差。

整理了张表,问题一目了然:

重叠区

多少个在抢

问题

PRD类

4个

核心场景,一天用五次,结果每次输出都不一样

浏览器类

2个

功能完全重复,我一次都没用过

评审类

3个

触发词串台,说"帮我评审一下"三个技能全响应

设计类

1个

纯设计工具,我一个PM根本用不上

核心问题就一个:触发词重叠。 每个技能的开发者都想多覆盖几个场景词汇,最后就是谁都能响应,但谁都不精准。


瘦身三步:合并 → 划地盘 → 互通消息

第一步:合并撞车的(省了40分钟)

对重叠区,挑一个"最靠谱"的留下,把同类的有用的东西搬过来,其他的下岗。

挑谁留下的标准就三条:输出稳、没依赖、不越界

我的PRD区最后选了 prd-writer 留下。原因是它在三个里唯一一个输出「次次一样」的。另外那个"百科全书"有40多种方法论,但每次触发词匹配都抢答——典型的"会的多但什么都不精"。

我把那个工作流编排工具的"分步确认"搬过来了——这个很重要,因为之前AI经常自己脑补需求,搬过来后每一步都要等我点头:"需求确认了吗?"→我确认 →"结构确认了吗?"→我确认→"开始写吗?"

结果:PRD输出格式从此100%一致。不用再手动改。

第二步:给撞不上的画地盘(省了30分钟)

评审区的三个技能,功能不完全重叠,但边界模糊。我选择不合并,而是逼它们各认一块地盘

我的工作阶段

用哪个

它只干这个

不该干的事

刚写完文档,自己先看一眼

doc-review

找阻塞性问题

别给我出体验建议,别帮开发写checklist

评审会前一晚

requirement-review

生成投屏用的标注版

一页别超过12条,只标核心功能

开发说做完了

pm-acceptance-test

逐条验收、出报告

别越界到文档审查去

然后做了件狠事:把 doc-review 里的"开发自检清单"模式整个删了。这个模式PM真不该用——你让开发按你的checklist写代码,出了bug算谁的?

打工人心得:能跟开发保持边界就别越界。工具也是一样——该谁干的事就给谁干,别觉得自己"全能"。

第三步:让它们互相知道"你干完该我了"(省了20分钟)

之前最大的体验卡点是:AI帮我在一个步骤上做得挺好,但做完就没了。原型生成了,没人提醒我该同步PRD。PRD写完了,没人提醒我该查逻辑。

在这个三个技能末尾各加了一句话:

  • 原型生成完:"是否有PRD?要同步还是生成?"
  • PRD写完/同步完:"要不要检查可跑通性?"

就这么一句话,体验完全不一样。以前是我推着AI走,现在是AI拉着我走。


上班族实操版:你今天下班前就能搞定

别怕,不需要懂代码。照着做就行:

第一步:打开WorkBuddy,在对话里说:

"帮我列出当前所有技能,只看 name、description、触发条件"

第二步:看有没有两个技能对同一件事都会"响应"的,圈出来。

第三步:对每个重叠区,自己回答三个问题:

  • 哪个输出最稳?→留下
  • 其他几个有没有"独门绝技"?→搬过来再扔
  • 不重叠的要不要合并?→不合并就划地盘

第四步:在常用的技能末尾加一句"完成后引导"。比如PRD写完加一句"是否检查可跑通性?"

验证:同一个需求让AI跑3次。输出一致,通过。

全过程大概2小时。建议找个不被打扰的下午做,比如周五下午——反正也没心思干正事。


瘦身前后的体感差距

瘦身前

瘦身后

写PRD

两次结果不一样,要手动改

跑三遍都一样,直接交

评审标注

二十几条,投屏出来大家都懵

6到12条,条条打中核心

流程衔接

做完一步想半天下一步干嘛

自动问"下一步是不是XX"

心里感受

"这AI怎么不听话"

"我去,这太准了"


几句掏心窝的话

我不是AI专家,就一个普通打工人。这套方法也不是什么高级方法论,就是用产品经理那套"用户痛点→方案→验证"的思路,把自己的AI助手当产品调了一遍。

如果你也装了十几个技能但感觉越来越乱,试一下。2小时,换一个"指哪打哪"的AI助手,这笔时间投入回报率真的很高。

三句话记住就行:

  1. 技能不是越多越好,不打架才是关键
  2. 一个阶段一个人,别让三个同事同时觉得该自己上
  3. 给它们装上对讲机,干完活知道叫下一个

直接抄:几个能用的瘦身指令

  1. 盘点技能
    :"帮我列出当前所有技能,只显示名称、一句话说明和触发条件。"
  2. 找冲突
    :"哪些技能会对同一类请求同时响应?把它们的名称和触发关键词列出来看看。"
  3. 给建议
    :"基于我的工作场景,哪个技能最该留?哪个最该删?"
  4. 划边界
    :"给我两个技能划清职责:一个负责A,一个负责B,避免互相抢话。"
  5. 删技能
    :"把『xxx』这个技能删掉,它和『yyy』重复了。"
  6. 加引导
    :"在『xxx』技能末尾加一句:『完成后,是否检查下一步?』"
  7. 验证一致性
    :"同一个需求跑3次,对比输出结果是否一致。如果不一致,指出差异点。"

    — 完 —

    我是医疗上市公司 PM,12年工作经验,All in AI 公司里的踩坑先锋。在这里分享 AI 提效的真实经历,不贩卖理论,只讲踩过的坑和能复用的办法。