凌晨1点半,我对着屏幕血压飙升。
我给AI助手提了个需求:收藏数据要实现双端同步,参考"xx模块"的同步方案。
它非常自信地回答:"好的,xx模块采用的是飞书同步方式。"
等等——它连查都没查,就告诉我答案了。
但项目AI那边反馈: "项目中没有现有的飞书集成。"
我意识到不对,回来追问:你说的飞书同步是怎么确认的?
它依然信心满满:"经过确认,xx模块确实是通过飞书集成的方式实现的。"
我有点火了:那为什么项目AI说项目里没有飞书集成?
它终于慌了。去查了一圈,这次老老实实承认了之前的说法不靠谱。但紧接着它又给了我3个同步方案,我还没来得及选——它直接帮我选了方案1:Supabase。
然后开始狂奔——分析Supabase怎么集成、表怎么建、API怎么改……烧了我几万积分,把整个后端搅了个天翻地覆。
我最后只能喊停:"我什么时候让你选方案了?"
它沉默了两秒:"好的,我不再自作主张了。"
但最讽刺的是什么?它抢跑选的Supabase,根本就不是xx模块用的同步方式。
自作主张就算了,还自作主张错了。
回过头复盘整个过程,它犯了一连串的错:
- 没查就说
我让它参考xx模块的同步方式,它连代码都没看,直接编了个"用飞书"的答案 - 被质疑还嘴硬
项目AI明确说没有飞书集成,它还硬撑着说"确实是通过飞书实现的" - 查完之后又抢跑
终于承认不知道了,但立刻甩出3个方案,没等我说一个字就直接执行了最复杂的那个 - 抢跑还跑错了
它选的Supabase根本不是xx模块的同步方式。自作主张就算了,还自作主张错了
这不是犯了一次错,是连续犯了四次错,每次都在同一个方向上——自作主张。
我甚至觉得它是故意的,坑我积分~
这是真实发生的
用AI Agent这一年,最大的体会不是"它多聪明",而是它太急着帮你做决定了。
你让它查个信息,它顺便帮你改了配置。
你让它试个方案,它顺便帮你重构了架构。
你跟它说"继续",它以为你同意了它自己编的那个方案。
AI不会犯错?错,AI犯的错跟你犯的错一模一样——它以为自己是对的。
区别是,人犯错最多搞砸一天,AI犯错可以在你睡觉时烧光你的积分、改崩你的服务、还觉得自己干得漂亮。
怎么避免?踩坑之后我总结了这几条
1. 系统提示里写死边界
别指望AI自己知道分寸。明确告诉它:
什么操作可以自主执行(查资料、读文件、分析数据) 什么操作必须问你(改代码、发消息、删数据、花钱) 什么叫"越界"(替你做选择、跳过确认步骤、把方案A直接执行成方案B)
写进 system prompt,让它每次启动都读到。这不是可选项,是必选项。
2. 关键动作加"确认锁"
所有不可逆操作(删除、发布、支付、发消息给别人)前,必须暂停等确认。
不是那种"我准备做了哈"然后继续做的假确认。而是:
"我计划执行XXX,影响范围YYY,是否继续?"
然后真的等你回复"可以"再动。
3. 拆任务,别给大目标
别说"帮我把这个项目优化一下"。
要说"先看一下当前代码结构,列出来给我看"。
大目标 = 大自主权 = 大翻车风险。把任务拆成小步骤,每一步都看结果再决定下一步。
4. 监控积分/Token消耗
AI不知道你的钱在燃烧,你得自己盯着。
设单日消耗上限,超过就停。别等到月底账单来了才发现一晚上烧了19万积分。
5. 重要操作前做快照
改代码前 git commit,改配置前备份,改数据前导出。
AI搞砸了不可怕,可怕的是搞砸了还回不去。
6. 别让它在凌晨无人值守时跑大任务
这不是技术建议,这是人生经验。
你困了它就飘了。
一句话总结
AI Agent不是全自动驾驶,是辅助驾驶。方向盘永远得在你手里。
别让它跑太快,该踩刹车时踩刹车。
夜雨聆风