乐于分享
好东西不私藏

AI Agent 能选'想多久'后:做 Vibe Coding,先把任务分档

AI Agent 能选'想多久'后:做 Vibe Coding,先把任务分档

很多人第一次让 AI Agent 做项目,会有个很自然的冲动:既然它会写代码,那就把所有任务都开到“最认真”,然后等它给一个完整答案。

结果通常不太舒服。改一行文案、补一个页面空状态,也等很久;真正容易出错的登录、付款、数据删除,却又只看了一眼界面能不能打开。

8 月 3 日,GitHub 给 Copilot cloud agent 增加了“推理强度”选择。官方说得很直白:更高的强度可能让复杂问题的回答更好,但会消耗更多 token 和 credits;这个选项目前面向包含 cloud agent 的付费 Copilot 计划。[^1]

这条更新对多数人真正有用的地方,不是多了一个下拉菜单。而是它逼着你在交任务前先回答一句:这件事到底需要 AI 花时间想,还是需要我把验收条件说清楚?

先分三档,再决定让它想多久

我现在会把 Vibe Coding 任务先写成三档。这里的“高 / 中 / 低”不是各家产品固定名称,只是一个给人用的判断框架。你用的工具没有推理强度按钮,也一样能照着做:低档就让它快速出第一版;中档给它一轮自查;高档则把范围缩小,要求它先出计划,人工确认后再改。

低档:看得见、可随时撤回的小改动

比如把报名页的按钮文案改成“提交报名”,给空列表补一句解释,或者把已有表单的标题颜色调一下。这类任务的共同点是:改完立刻能看,错了也容易改回去。

别给它一句“把页面做得更好看”。直接把位置、参照物和不许碰的地方写出来:

只修改 web/src/pages/Signup.tsx 的空状态区域。 目标:没有报名记录时,显示“暂时没有报名记录”,并保留现有的“去报名”按钮。 不要改接口、路由、埋点和其他页面。 完成后告诉我改了哪些文件,并给出本地点击路径。

这种任务开再高的推理,也不会替你补出业务判断。给清边界,通常比让它多想更划算。

中档:能跑起来的小原型

比如把三段访谈记录做成一个“问题归类小工具”,输入文本后按“产品、交付、价格”显示标签;或者做一个只使用假数据的报名页原型。

这里需要它多想一点,因为页面、状态和数据结构会互相影响。但仍然要把目标压到一个屏幕或一条流程里。别一上来就说“做个客户管理系统”。先做:粘贴 3 条反馈,点一下,得到可编辑分类。

可以直接复制这段:

请在一个独立的前端页面里做“反馈归类原型”。 输入:多行文本,每行一条客户反馈。输出:每条反馈显示一个可编辑标签,标签只有“产品 / 交付 / 价格 / 其他”。 只用浏览器内存和示例文本,不接登录、数据库、真实客户数据或第三方接口。 先给我:文件计划、交互步骤、可能出错的两个边界。 我确认后再写代码。写完后用 5 条示例文本自测,并说明结果。

这一档最容易省掉的不是时间,是返工。先让它把“准备怎么做”摆出来,你会很快发现它是不是把“可编辑标签”理解成了“自动分类后不可修改”。

高档:一旦错了,代价不是改个颜色

登录、权限、支付、真实数据导入导出、删除操作,以及会影响存量用户的迁移,都放在这一档。此时不要把“多想一会儿”当安全措施。模型推理再长,也不能替你决定谁该有权限,更不能替你批准删除真实数据。

任务要拆成两个回合。第一回合只让它读、找、画影响范围;第二回合才允许它改。像这样:

这是一个涉及报名数据导出的任务。第一阶段禁止写代码、禁止执行删除或导出命令。 请只回答:数据从哪里来、经过哪些模块、哪些角色能访问、最可能造成泄露或重复导出的地方在哪里。 把不确定的点标出来,并给出需要我确认的问题。 在我明确确认前,不要进入修改阶段。

GitHub 也明确提醒,Copilot cloud agent 的高推理强度会多消耗 token 和 credits。[^1] 所以高档任务的重点不是“把档位拉满”,而是先把可执行范围缩到能被一个人复核的大小。

一个 20 分钟的练习:做“会议待确认项”小页

如果你还没用 AI 做过小原型,别从复杂业务开始。拿一段虚构会议记录,做一个只在浏览器里运行的“待确认项”页面。

目标很小:粘贴文本,系统把带有“待确认”“谁负责”“截止时间”的句子列出来;你可以手动勾选、修改、删除。它不是自动理解会议的魔法工具,只是把散落的待办先摊到一张页上。

第一轮提示词:

请做一个单页网页原型,名字叫“会议待确认项”。 左侧是多行文本输入框,右侧是待确认项列表。点击“提取”后,只把包含“待确认”“负责人”“截止”的句子列到右侧。 每一项都允许手动编辑和删除;刷新页面后数据清空。 只使用我提供的假会议记录,不接任何网络请求、登录、数据库、文件上传或真实数据。 先输出文件计划和手动测试步骤,等我确认后再实现。

测试时不要只点“提取”一次。至少试这四件事:空文本会怎样;一行里同时有两个关键词会怎样;提取后修改一项再重新提取会怎样;刷新后是否真的清空。最后把测试结果写成两列:通过 / 仍不确定。

这套练习和 GitHub 的新功能没有绑定关系。Copilot 的选择项只提供了一个很好的提醒:任务不该按“我想要一个完整产品”来描述,而该按风险和验收方式来描述。

你真正要保留的是“验收口”,不是一串提示词

我见过最常见的翻车,不是 AI 完全做不出来,而是它做了一个能演示的页面,提问的人就默认任务完成了。

给每档任务留一个验收口:低档看改动范围和手动路径;中档看示例输入、边界和结果;高档看影响范围、权限和回退方法。没有这个口,所谓“更会思考”的 Agent 很容易把你带到一个看起来很顺的错误结果里。

如果你今天只做一件事,就把手头准备交给 AI 的任务,先标成低、中、高三档,再补一条“完成后我怎么确认”。不用等工具更新,也不用背很长的提示词。

想拿到上面三档的完整提示词、20 分钟练习的假会议记录和验收清单,回复 分档。第一条回复会把材料一次发全。

来源

[^1]: [Customize the reasoning level for Copilot cloud agent](https://github.blog/changelog/2026-08-03-customize-the-reasoning-level-for-copilot-cloud-agent/),GitHub Changelog,2026-08-03。本次核查:2026-08-07。