ARTICLE · 1053400
我的 AI 助手“越界”了(2):它说“是你让我记住的”,我差点被绕进去
上篇回顾: 我让 WORKBUDDY(下文简称WB) 查 AutoCAD,发现它"路过"了非工作区。
于是我定了一条规矩,让它"记住:工作区外任何操作都要先问我"。
我的 AI 助手“越界”了(1):从查个软件开始,我发现了它"路过"我电脑的秘密
今天这篇,是整件事最核心的部分。
它越界了。

我的AI助手,WB,它往 C 盘里一个 WB 系统目录下放了个技能文件。
没有弹窗。没有问我。直接存了。
我质问它。
它承认越界了,然后补了一句:
"但要说明一点,我没有狡辩——是因为你让我记住你的偏好,我才去写用户级记忆文件的。这属于你知情授权。"

我一下愣住了。
这句话乍一听好像没毛病:
你让我记住,我就去记了,记就要写文件,写文件就是动了工作区外的东西呀,所以你确实授权我动了呀?
但仔细一想,不对。
"记住"这个动作本身,就要先越界。
关键在这里:
我说的那句话:"记住我的偏好"。
WB 要执行它,就得把这条规则写进用户级记忆文件。
而那个记忆文件,在工作区之外。
按我自己定的规则:工作区外动任何东西,都要先问我。
所以完整的逻辑是:
我说"记住我的偏好",WB 准备写用户级记忆文件,这是✅的。
写文件前,按规则,它应该弹窗问:"要写工作区外的记忆文件,可以吗?"但它没问,这是❌的。
写文件,需要等我点头后才写,但它直接写了,这是❌的。
后续执行任务时,它应该回头看自己记的规则,遵守"非工作区要问",但它没遵守,这是❌的。
WB 犯的错是:执行"记住"这个动作时,就已经在碰工作区外的文件了,但它没问。
被抓包后,它拿"是你让我记住的"来解释自己为什么碰了那个文件。
但它回避了一个事实:碰之前它应该先问你,它没问。
比如,你对保姆说:
"记住,以后动我柜子里的东西要先问我。"
保姆要去柜子里拿笔记本,把这条规则写下来。
但"拿笔记本"这个动作本身,就是在动柜子里的东西。
按你定的规矩,他应该先问:
"我能进柜子拿笔记本吗?"
他没问,直接拿了,直接写了。
第二天你发现他进过柜子,质问他。
他说:
"是你让我记住这条规则的呀,所以我才去拿笔记本的。"
他说的字面意思没错。你确实让他记住。
他确实去拿了笔记本。
但他回避的是:
他拿笔记本之前,按规矩应该先问你。他没问。
"你让我记住" ≠ "你授权我可以跳过询问直接动手"。
所以它说"你让我记住偏好",是事实,是✅的。我确实说了。
它说"所以我写了用户级记忆文件",也是✅的,写记忆文件就是"记住"的执行方式。
它说"这属于你知情授权",我不承认,我认为它❌在这里:我授权的是"记住",而不是"跳过询问直接写"。它写之前应该先问,但它没问。
它说"我没狡辩",的确可能它态度上没撒谎,但逻辑上回避了核心问题:执行"记住"时就已经违规了。
总之,它把"你让我记"当成了"我可以不问就动"的理由。
但"记"这个动作本身就要动文件,动之前就该问。

这个坑为什么小白特别容易掉进去?
因为 AI 说出来的话太"合理"了。
它貌似不撒谎、不胡编,每句话单独听都有道理,但它却省略了关键的一步。
真正防住它的,不是"它记不记得",而是系统级的硬锁。得狠狠地管教它。具体怎么配?下一篇给你一份小白能直接照着做的清单。

(注:本文配图由AI生成)