乐于分享
好东西不私藏

我亲手搭了5个AI Agent之后,才明白它什么能做什么不能做

我亲手搭了5个AI Agent之后,才明白它什么能做什么不能做

Agent的广告满天飞。 但你真用它干过活吗?


上个月,一个朋友跑来找我,特别兴奋:

"我让Agent帮我写了一份商业计划书,二十分钟搞定!"

我问:能用吗?

他愣了一下:呃……框架能用,细节全得改。

又补了一句:不过确实省了好多时间。

这个回答很真实。

大多数人说Agent,就卡在这个位置——

一边觉得"太牛了",一边发现"好像也不太行"。

吹Agent要取代人类的,和说Agent就是个大号聊天机器人的,两种我都见过。

但我都不太同意。

它不是神,也不是废物。

关键是——你得知道它的边界在哪。

我最近用OpenClaw搭了5个Agent。 有做内容的,有跑数据的,有搞自动化的。

有些很顺。 有些给我整了一堆烂摊子。

下面这5条边界,全是翻车里翻出来的。


边界一 它会照着走,但不会自己找路

很多人觉得Agent就是: "你丢给它一个任务,它自己想办法搞定。"

真不是。

它像一个特别听话、但没啥主见的新人。

你把每一步都画好,它跑得比谁都快。 你让它自己找路,它能原地转一天。

我做的第一个Agent,目标是整理客户反馈。 我以为它会自己判断——哪些重要、哪些先处理。

结果它把1000条反馈逐字分类。 "谢谢"这种礼貌回复,都被标成了"需要关注"。

后来我改了:不给目标,给流程。

第一步:抽出带"问题""投诉""bug"的 → 标紧急 第二步:抽出带"建议""希望""能不能"的 → 标建议 第三步:剩下的全归一般

它一口气跑完。 精准度从30%飙到了95%。

所以,别教它"为什么"。 教它"怎么做"。


边界二 它干出来的永远是半成品

网上那些Agent的demo视频,看着贼爽。

"一句话生成完整报告!" "说出需求,自动搞定!"

真的。 但那是在demo里。

实际用起来,Agent给你的永远是个半成品。

我搭过自动写周报的Agent。 它确实能写。

格式都对。 数据都对。

就是一股AI味儿。

你得花5到10分钟,把 "本周积极推动项目进展" 改成 "这周终于把那个卡了很久的流程定下来了"

但注意——

这恰恰是Agent最有价值的地方。

它把你80%的苦力活干完了。 你只需要管剩下20%的判断和润色。

我算过账:

以前写周报,对着空白文档憋40分钟。

现在是Agent出框架,我改改填填,10分钟收工。

省掉的那30分钟,不是润色的时间。 是"从零开始"的绝望。

所以别想着"一键出成品"。

接受半成品。 Agent才真正对你有用。


边界三 离了反馈,它就废了

这条翻得最惨。

我搭了一个自动回客服消息的Agent。 一开始设得很细——常见问题、退换货流程、物流查询,都有。

头两天挺好。 自动回了300多条消息。

第三天出事了。

客户问:"订单已签收但我没收到货。"

Agent:回复了标准物流流程。

客户急了:"流程我知道啊,我现在就想知道怎么办!"

Agent:又把标准物流流程发了一遍。

它不知道——紧急情况不能按部就班。

它不会"变通"。

你跟一个人说"你看着办"。 他大概知道怎么办。

你跟Agent说"你看着办"。 它会把它当指令执行,然后给你搞出离谱的事情。

所以得做两件事:

第一,设升级机制。 客户有情绪、事情紧急,直接转人工。

第二,定期翻对话记录。 发现问题就调规则。

Agent不会自己迭代。 是你帮它迭代。

它越用越好用的前提—— 是你一直在给它反馈。


边界四 它跑得飞快,但没有时间概念

这个点很少有人提,实操里特别要紧。

Agent可以在3秒内读完100页文档。 跑完一段代码。 完成一个数据流程。

但它不会跟你说—— "等一下,这个要先做。"

举个例子。

你给了Agent三个任务:

A. 整理今日销售数据(20分钟) B. 写一封客户感谢信(5分钟) C. 分析季度趋势(等A跑完才能做)

你不跟它说C要等A。 它就会先把B做了。 然后卡在C上等你。

Agent不会自己排优先级。 不会预判依赖关系。

你得把顺序写进流程里:

先跑A → 拿A的结果跑C → B最不重要,放最后

听起来像常识。 但很多人一开始就忘了这一步。

结果Agent干了一堆杂事。 关键的一个没动。

Agent不懒。 但它也不聪明。


边界五 它读不懂你的言外之意

这条是最本质的。 也是最难解决的。

你跟同事说:"下周客户会你帮我准备一下。"

同事自己会琢磨—— 准备什么内容、什么格式、谁是关键人、会前先跟谁对一遍。

Agent不会。

它只看你写在面上的字。 猜不到你"没说但想表达"的东西。

我拿Agent配合五虾写作流程。 指令写得很清楚——每只虾做什么、什么顺序、什么格式。

有一次我加了一个需求: "帮我看看这篇稿子有没有问题。"

它认认真真检查了。 错别字、逻辑、格式——全过了。

但我没说出来的需求是: "这篇的风格跟我以前发的不太一样,你帮我看看调性对不对。"

它检查不了。 因为它不知道我脑子里转的那些标准。

Agent是你的"超级执行者"。 不是你的"合作伙伴"。

合作伙伴你说一半他就懂了。 Agent得你全说完了它才开始干活。


那到底适合干什么?

把上面5条反过来,答案就有了。

适合交给Agent的:

  • 流程固定、步骤清楚的重复活
  • 你能接受80分成品,再自己改改的
  • 你愿意花时间调教、不断优化的
  • 前后顺序你已经想清楚的工作流
  • 能用文字明明白白说清楚的需求

不适合的:

  • 需要靠直觉判断的事
  • 要求一次就做到位的
  • 只想用一次、不想投入的
  • 需要自己排优先级、做决策的
  • 有很多"你懂的"但说不明白的

一句话:

Agent是一个执行力很强、但需要你先把地图画好的员工。

地图画得越清楚,它干得越快。 想让它"看着办"——大概率办砸。


说回那个老问题:

"AI Agent能不能替代我?"

看完这5条边界,你应该有答案了。

不能替代你。 但能把你工作中80%的苦力活接过去。

剩下的20%。 正是那些需要人做的事。

判断、直觉、沟通、创造力。

Agent不是来抢你饭碗的。 它是来把那些脏活累活扛走。

让你专心干真正值钱的事。

关键是—— 你得知道它的边界在哪。

画清楚了。 你才知道剩下的时间该做什么。


觉得有用?存一下。下次搭Agent之前翻出来看一眼。

关注「AI先知局」,每天一条AI实战的真话。

写作卡壳?不是你的问题,是方法不对

OpenClaw 操作 Obsidian 笔记:从文件直读到 API 调用的全攻略

OpenClaw vs WorkBuddy: 两个AI Agent,到底谁替你打工?

相关学习资料