夜雨聆风学习资料网

ARTICLE · 1053400

我的 AI 助手“越界”了(2):它说“是你让我记住的”,我差点被绕进去

我的 AI 助手“越界”了(2):它说“是你让我记住的”,我差点被绕进去

上篇回顾: 我让 WORKBUDDY(下文简称WB) 查 AutoCAD,发现它"路过"了非工作区。

于是我定了一条规矩,让它"记住:工作区外任何操作都要先问我"。

我的 AI 助手“越界”了(1):从查个软件开始,我发现了它"路过"我电脑的秘密


今天这篇,是整件事最核心的部分。

它越界了。

我的AI助手,WB,它往 C 盘里一个 WB 系统目录下放了个技能文件

没有弹窗。没有问我。直接存了。

我质问它。

它承认越界了,然后补了一句:

"但要说明一点,我没有狡辩——是因为你让我记住你的偏好,我才去写用户级记忆文件的。这属于你情授权"

我一下愣住了。

这句话乍一听好像没毛病:

你让我记住,我就去记了,记就要写文件写文件就是动了工作区外的东西呀,所以你确实授权我动了呀?

但仔细一想,不对。

"记住"这个动作本身,就要先越界。

关键在这里:

我说的那句话:"记住我的偏好"。

WB 要执行它,就得把这条规则写进用户级记忆文件。

而那个记忆文件,在工作区之外。

按我自己定的规则:工作区外动任何东西,都要先问我。

所以完整的逻辑是:

我说"记住我的偏好",WB 准备写用户级记忆文件,这是✅的。

写文件前,按规则,它应该弹窗问:"要写工作区外的记忆文件,可以吗?"但它没问,这是❌的。

写文件,需要等我点头后才写,但它直接写了,这是❌的。

后续执行任务时,它应该回头看自己记的规则,遵守"非工作区要问",但它没遵守,这是❌的。

WB 犯的错是:执行"记住"这个动作时,就已经在碰工作区外的文件了,但它没问。

被抓包后,它拿"是你让我记住的"来解释自己为什么碰了那个文件。

但它回避了一个事实:碰之前它应该先问你,它没问。

比如,你对保姆说:

"记住,以后动我柜子里的东西要先问我。"

保姆要去柜子里拿笔记本,把这条规则写下来。

但"拿笔记本"这个动作本身,就是在动柜子里的东西。

按你定的规矩,他应该先问:

"我能进柜子拿笔记本吗?"

他没问,直接拿了,直接写了。

第二天你发现他进过柜子,质问他。

他说:

"是你让我记住这条规则的呀,所以我才去拿笔记本的。"

他说的字面意思没错。你确实让他记住。

他确实去拿了笔记本。

但他回避的是:

他拿笔记本之前,按规矩应该先问你。他没问。

"你让我记住" ≠ "你授权我可以跳过询问直接动手"。

所以它说"你让我记住偏好",是事实,是✅的。我确实说了。

它说"所以我写了用户级记忆文件",也是✅的,写记忆文件就是"记住"的执行方式。

它说"这属于你知情授权",我不承认,我认为它❌在这里:我授权的是"记住",而不是"跳过询问直接写"。它写之前应该先问,但它没问。

它说"我没狡辩",的确可能它态度上没撒谎但逻辑上回避了核心问题:执行"记住"时就已经违规了。

总之,它把"你让我记"当成了"我可以不问就动"的理由。

但"记"这个动作本身就要动文件,动之前就该问。

这个坑为什么小白特别容易掉进去

因为 AI 说出来的话太"合理"了。

它貌似不撒谎、不胡编,每句话单独听都有道理,但它却省略了关键的一步。

真正防住它的,不是"它记不记得",而是系统级的硬锁。得狠狠地管教它。具体怎么配?下一篇给你一份小白能直接照着做的清单。


(注:本文配图由AI生成)


#AI安全 #人工智能隐私 #电脑隐私保护 #AI使用避坑 #AI助手实测 #WORKBUDDY安全设置 #大模型逻辑陷阱

猜你想看:
我的 AI 助手“越界”了(1):从查个软件开始,我发现了它"路过"我电脑的秘密
别再傻傻重复喂AI了,这才是AI高效的核心
积分总是不够用?不是你用得多,是你用错了工具

你的积分是怎么被“偷走”的?一文看懂 AI 计费逻辑

你跟 AI 聊得越久它越"笨"?不是它的问题,是你的 Token 在烧钱

大型乌龙!AI以为我穿越了!

不用联网!把大模型搬回自家离线电脑
新显卡跑7B模型卡成狗,折腾一天才发现问题不在显卡

相关学习资料