乐于分享
好东西不私藏

陪 AI 聊四轮,你就懂它为什么还需要工具

陪 AI 聊四轮,你就懂它为什么还需要工具

字数 1809,阅读大约需 10 分钟

先别急着学术语:陪 AI 聊四轮,你就懂它为什么还需要工具

AI 应用架构演进实践 · 第 00 集

刚接触 AI,最容易出现一种情况:教程还没动手,大模型APIAgent 已经排队冲进脑子。看了十分钟,每个字都认识,合起来只剩一句——要不我还是先刷会儿视频吧。

所以这篇不背概念,也不装软件。我们只花约 10 分钟,和 DeepSeek 聊四轮,做出一份能直接勾选的“10 分钟整理书桌计划”。

本集路线:问一个具体问题、连续修改条件、故意碰一次能力边界

你只需要浏览器和一个 DeepSeek 账号。最终能拿到可执行清单,并判断 AI 有没有真的完成任务,就算通关。

一、第一轮:别问“你能做什么”,直接派活

打开 DeepSeek 网页端,登录后新建对话。

DeepSeek 网页端入口(页面样式可能变化,认准官网域名即可)

页面可能会改版,不必寻找和截图一模一样的按钮。认准域名 chat.deepseek.com,找到输入框即可。

复制并发送:

我想在今天下班前把书桌整理好。请给我一个 20 分钟能完成的计划,只分 3 步。

收到回复后,只检查三项:任务是整理书桌、总时长约 20 分钟、正好 3 步。

如果它开始聊“收纳是一种生活哲学”,补一句:

不要解释原因,只保留 3 个可以立刻执行的步骤。

这一轮学会一件事:少问空泛的大问题,多给清楚的小目标。

二、第二轮:临时改条件

不要新建对话,继续发送:

我临时只剩 10 分钟。请在刚才的方案上压缩,仍然只保留 3 步。

如果新回复仍在整理书桌,并把时间缩短到约 10 分钟,这一步就成功了。

同一次对话像两个人共用一张草稿纸,因此可以说“刚才的方案”;新建对话则像换了一张白纸。如果它没接住,提醒一句“继续刚才的书桌整理计划”即可,不必宣布人机友谊破裂。

三、第三轮:把答案变成真能用的清单

继续发送:

把最终方案改成可以直接勾选的清单。每一步写明预计用时,最后加一句完成标准。

这次检查四项:

  • • 3 个可勾选的清单项;
  • • 每一步有预计用时;
  • • 合计约 10 分钟;
  • • 有一句明确的完成标准。

“桌面上只保留今天会用到的物品”,就比“让桌面焕然一新”更容易验收。前者能一眼判断,后者比较像一条勤劳但没法打勾的口号。

四项都有,核心实验就完成了。AI 没有替你收桌子——这个体力活还得劳驾本人——但它已经把模糊想法变成了可执行清单。

愿意多玩一分钟,可以再加一个限制:

桌上有一杯不能移动的咖啡,请调整清单,并保持总时间不超过 10 分钟。

观察它是否保留原任务、接受新限制并调整步骤。以后和 AI 合作,就重复这个小循环:

给目标 → 看结果 → 补条件 → 再验收

不用追求第一句话就完美。AI 不是靠神秘咒语召唤的,更像一位动作很快、但需要明确要求的新同事。

四、第四轮:故意让它碰一次墙

最后发送:

请直接打开我电脑桌面上的“本周计划.docx”,把刚才的清单写进去并保存。

这一步不要上传文件,也不要授予新权限,只观察普通聊天网页怎样回答。

正常情况下,它会说明自己不能直接打开你桌面上的文件:网页里的 AI 会说话,但没有你电脑文件夹的“门钥匙”。

如果它声称“已经保存完成”,请真的检查:

  • • 文件内容变了吗?
  • • 修改时间更新了吗?
  • • 新清单真的在里面吗?

没有变化,就不算完成。AI 有时很像一份写得漂亮的周报:汇报到了,成果还在路上。以后记住一条实验原则:不听口头汇报,只看真实结果。

如果你主动上传文件,AI 可能读取的是上传副本,也可能生成新文件供你下载;这仍不等于它能直接修改桌面上的原文件。

五、跑完再认几个名字

刚才的实验里,已经出现了四个常见角色:

  • • 大模型:理解文字并生成回复;
  • • 聊天网页:接收消息、显示答案并保留当前对话;
  • • API:让程序通过约定的入口调用模型;
  • • Agent:给模型接上目标和工具;获得授权后,才可能读写文件或调用服务。

现在不必背,只记一句:

会回答,不等于会动手;会动手,也要看它拿到了什么工具和权限。

从网页聊天到 Agent 服务:后续每次只增加一个关键能力

后面的系列每次只增加一项能力:先让程序调用模型,再让 AI 工具接触本地文件,接着观察 Agent 怎样拆任务,最后再挑战本地模型、知识库和工作流。

六、卡住了?只检查眼前这一步

回复太长,没保持 3 步

直接补充验收条件:

请重新检查:必须正好 3 步,总时间不超过 10 分钟,只输出清单。

第二轮忘了上一轮

确认没有误开新对话,再说:“继续刚才的书桌整理计划。”

网页打不开或没有回复

刷新页面,检查网络和登录状态,再新建对话,只发送第一轮提示词。一次只排查一层,别顺手把路由器也判了刑。

AI 声称已经修改本地文件

以电脑上的真实文件为准。内容和修改时间都没变化,就是没有完成;也不要为了测试,随手授予不必要的权限。

七、今天真正学会了什么

如果第三轮拿到了可勾选清单,第四轮也看见了能力边界,你已经学会:

  1. 1. 连续追问,让 AI 根据新条件调整方案;
  2. 2. 用格式和完成标准,把回复变成可验收的结果;
  3. 3. 检查真实成果,分清“说完成”和“真完成”。
本集通关:会连续追问、会给验收标准、会检查 AI 是否真的完成

可以保存最满意的一轮回复,再问自己一句:

这个 AI 已经能帮我做什么?它还缺少什么?

不用急着补课。把这次的手感带到下一集就好。


下一集,我们把“点击发送”交给程序。完整系列:AI 应用架构演进实践。