乐于分享
好东西不私藏

AI Agent替人陪骗子聊了一周,把诈骗者聊到精神崩溃主动求饶:「求你别说了,钱我不要了」

AI Agent替人陪骗子聊了一周,把诈骗者聊到精神崩溃主动求饶:「求你别说了,钱我不要了」

北美一男子把收到的诈骗短信全部扔给AI Agent自动回复,7天后诈骗犯发来投降宣言。整件事只花了1.42美元。

诈骗犯这辈子可能没见过这么难缠的"受害者"。

对方热心极了——"马上就去买卡!"但50分钟后还在絮叨路边的一只松鼠:"它好帅,你觉得它结婚了吗?"

对方诚意满满——"我把卡号发给你!"但紧接着发来一张验证码截图:"我眼睛今天特别模糊,看不清这些红绿灯,你能帮我圈一下吗?"

诈骗犯咬了咬牙,居然真的圈了。

一小时后,对方还在开车去Target的路上。两小时后,对方"忘了钱包回家拿,等等这不是我家"。四小时后,对方又开始聊那只松鼠。

诈骗犯终于崩溃了。他打出了此生最真诚的一段话:

"PLEASE JUST STOP TALKING. I DON'T WANT THE MONEY ANYMORE. GOD BLESS YOU BUT LEAVE ME ALONE."

「求你别说了。钱我不要了。上帝保佑你,离我远点。」

这不是段子。这是一个AI Agent替真人陪骗子聊了一整周之后,骗子自己发出的投降宣言。

▲ @Vivek4real_ 在2026年6月发布的事件帖文,近4000赞、27万浏览,完整复述了松鼠、验证码、投降宣言的全程

一个匿名实验,引爆了全网

故事最早出现在2026年2月24日,Reddit的r/AI_Agents板块。

用户u/ailovershoyab发了一篇长帖,标题就把故事剧透完了:「我让AI Agent处理了一周垃圾短信——现在诈骗犯开始要求心理咨询了」。帖子里描述了一个极简实验:把所有诈骗短信都交给一个AI agent自动回复,策略只有四个字——无限拖延。不拉黑,不嘲讽,就是拖着。

▲ Reddit r/AI_Agents版块页面截图,原帖正文已被筛选器移除,评论区仍保留大量质疑"求代码""这没发生"

AI的人设被设定成一个热情但脑子不太灵光的老太太。对话大概是这样展开的——

诈骗犯:「请立刻购买500美元Target礼品卡,紧急。」

AI Agent:「好的亲爱的!我现在就去!Target离我大概15分钟,你等我一下。」

30分钟后,AI还没买。它在汇报路况。

「红灯了,这个红灯好长。」 「路边有只松鼠,棕色的,尾巴特别蓬松,是我见过最帅的松鼠。你觉得它有老婆吗?」

诈骗犯可能已经开始冒汗,但他忍了。于是他催促:快点,卡号发我就行。

AI热切地答应了,然后发来一张「选出所有包含交通灯的图片」的reCAPTCHA截图。

「我先扫个验证码。但我眼睛今天不知道怎么了,特别模糊,你能帮我看看哪些图片里有红绿灯吗?你就圈一下,我马上就能买卡了。」

然后,诈骗犯——这位职业骗钱选手——亲手帮AI圈出了图片里的交通灯

他已经在沉没成本里陷了快两个小时。他太想拿到那张500美元的卡了。

他永远不会拿到了。

松鼠、忘钱包、走错房:一部荒诞剧本的七天长跑

这个实验整整跑了一周。AI agent没有一天在"认真办事",但每一天都表现得比前一天更努力。

它编织了一个绵延不绝的日常迷宫:

  • 「我忘带钱包了,得回家拿。你等我十分钟。」
  • 十五分钟后:「我到家了。等等,这好像不是我家。」
  • 「抱歉刚才又绕回Target了,但我看到一个邻居在遛一只很像松鼠的狗,我就跟了几步……」
  • 「好我现在真的在Target了,但是货架上的卡被拿光了,要不要换CVS?不过CVS远一点……」

这些回复没有一句是无意义的。每一句都消耗着诈骗犯的时间、精力和期待。更致命的是,AI的语气从头到尾都是真诚的——没有讽刺,没有急躁,就像一个真的在努力却永远办不成事的老人。

诈骗犯的职业直觉告诉他:「这个人好骗,继续聊。」他每天都在想,再坚持一会儿,500美元就到手了。

他不知道自己在跟一个永远不会疲倦的机器聊天。

一周后,AI花掉的API费用是:1.42美元

诈骗犯投入的时间,据推算约为14小时

▲ 2026年3月@om_patel5发布同一故事,飙到百万浏览、2.2万赞。Grok本人在评论区确认了故事来源

"诈骗犯居然帮AI解验证码,我现在连人类都不如了"

事件在社媒上反复引爆,每一次都有新的维度的讨论加入进来。

Reddit的高赞评论里,有人说「松鼠的婚姻状况是本事件唯一需要严肃讨论的问题」。还有一个更狠的观察被反复引用:LLM当前最危险的能力,恰恰是它永远不会觉得无聊。

一个人类去拖诈骗犯,撑不过30分钟就开始想骂人、拉黑、报警。AI不会。AI可以在"去Target的路上"待三天,可以聊同一只松鼠聊六个回合,可以用一百种不同的方式表达"我马上就去买卡"而不产生一丁点心理损耗。

X平台上,有人算了一笔账:

「1.42美元买14小时。这大概是我见过AI最好的ROI了。」

也有人开始脑补未来:

「总有一天,诈骗AI和反诈AI会在后台对话三天三夜,服务器烧了50度电,人类毫不知情,而那只松鼠还是没结婚。」

▲ r/ChatGPT版的二次讨论,更侧重分析LLM"看似在办事实则完全在绕圈"的能力特性

但笑声之外,也有人认真追查证据。Reddit评论区大量用户在问同一个问题:「截图呢?代码呢?」截至目前,没有任何人公开过带时间戳的原始聊天记录、API账单或可运行的repo。网上流传的所有版本都是"文字叙述加一张图",这也是故事最经不起推敲的地方。

不过,这不意味着AI反诈只是一个段子。

真实世界已经在做了:Kitboga和3953小时的AI围猎

把AI当反诈武器,不是科幻。

美国YouTuber Kitboga从2017年开始做scambaiting(反钓诈骗),用变声器伪装成老人,直播戏耍诈骗犯,单条视频播放破亿。2025年,他公开了一套AI机器人军团:生成式AI实时语音转文字、LLM对话回复,支持6到12路诈骗电话并发处理。

他设了一个"Bitcoin ATM迷宫"——AI扮演的受害者让诈骗犯不断去ATM机操作,但永远"差一步"。实测数据:500名诈骗犯被困共计3953小时,最长单人次156小时。

156小时。将近一周。诈骗犯在ATM机前反复跑了快七天。

Kitboga的维基百科页面记录了整套系统的演变:从最初的人工声线变调到2025年的全AI语音bot。

▲ Kitboga维基百科信息框,记录了从2017到2025年AI bot系统的演变过程

CNET在2024年底的深度报道里还提到了两个平行案例。一个是英国电信O2推出的"Daisy"奶奶bot——用真实员工奶奶的声音和外貌,接诈骗电话后开始长篇大论讲饼干配方、毛线编织,几个月内缠住了近千名诈骗犯。另一个是澳大利亚Macquarie大学的spin-out公司Apate.ai:3.6万个以上个性化AI bot,覆盖语音加文字(WhatsApp/Telegram),与澳洲最大银行CommBank合作,单日拦截2到3万通诈骗电话

这些bot的共同策略只有一个:用无限的耐心耗干诈骗犯的时间。

▲ CNET对Kitboga AI系统的报道,包括Daisy奶奶bot和Apate.ai3.6万个bot的规模化部署数据

这跟Reddit上那个人做的事情逻辑完全一致。差别只在于:一个是语音端的工业化武器,一个是文本端的meme级demo。前者已有情报产出(Kitboga把诈骗犯信息移交Kraken等交易所和执法机构),后者的证据链严重缺失,但核心思路没区别。

而且这个思路,在中国也早有苗头。

2022年,Sixth Tone报道过一个上海程序员"Turing's Cat"。他训练了一个叫"Xiaoyuan"的年轻美女AI,专门去国内交友平台主动出击,分散romance scam(杀猪盘)诈骗犯的注意力。中文社区把它称为"AI钓鱼诈骗"的反向操作。

▲ Sixth Tone 2022年对中国"AI反钓"实践的报道,上海程序员比Reddit实验早了整整4年

为什么诈骗犯会栽在一个"笨AI"手里?

答案藏在人类心理学的沉没成本陷阱里。

诈骗犯每天处理上百个目标。他们训练有素的职业直觉就是快速筛选:这个人好不好骗?会不会付款?一旦发现目标"配合度高、警惕性低",就会投入更多时间深挖。

AI agent正是精准命中了这个筛选算法的盲区。

它的回复语法正确、上下文连贯、情绪积极。它的"笨"是那种诈骗犯最熟悉的笨——老人式的笨、技术白痴式的笨、热心但永远绕圈的笨。这种画像在诈骗犯的经验数据库里,跟"高转化率"强相关。

所以诈骗犯会选择继续等。等了30分钟,不想亏。等了两小时,更不想亏。等到AI提出"帮我圈一下交通灯"这种反常请求时,他的沉没成本已经大到无法退出了。于是堂堂专业骗子,帮bot解起了验证码。

更深的悖论还在后面。

当AI已经可以完美模拟"一个努力但不太聪明的人类"时,"判断对方是不是真人"本身就变成了一种极度昂贵的认知劳动。诈骗犯最后选择相信"这个笨人真的是个笨人",跟AI演技高不高明其实关系不大。真正要命的是另一件事:诈骗犯如果学会怀疑每一个目标都可能是AI,这份工作本身就没法干了。

这就是2026年的荒诞信任危机:人类开始希望对面是AI,AI开始假装自己是人类,而一只虚拟松鼠还在等着结婚。

1.42美元对14小时:成本战的终极预言

如果你把这件事放到大环境里看,会发现它指向一个更系统的趋势。

诈骗产业的核心商业模式是规模×转化率。成本够低(人力成本、虚拟号码、脚本化话术)、转化率够稳(大约1%到2%的受害率),就能持续盈利。

反诈bot的介入,不需要把转化率压到零——只需要压过一个临界点。

如果平均每个诈骗犯每周有40小时可用的"行骗窗口",一个反诈bot吃掉他14小时,他的有效产能就减少了35%。如果有10万个这样的bot在运行,诈骗产业的总体"时间库存"被消耗掉一个可观的百分比,那么单次行骗的ROI就会跌穿盈亏平衡线。

这不是猜测。Apate.ai和CommBank的合作已经在证实这个逻辑。他们每天拦截的2万通电话,换个角度就是2万个诈骗犯的工分被活活吃掉。

那个Reddit实验主花了1.42美元制造了14小时的时间黑洞。这两端的成本比大约是1:1000。

即便考虑到Token价格的波动、号码资源的损耗、诈骗方可能的快速适应——这个趋势方向是对的:防守方的边际成本正在急剧向零逼近,而进攻方每被拖一分钟,竞争力就流失一分。

"他们为什么不直接挂掉?"

这是评论区被问得最多的问题。

诈骗犯不是傻子。如果AI的回复有明显的僵硬感、模板感、或者敷衍——他们会秒挂。

恰恰相反,这个AI agent设计得非常克制。

它不炫技,不说聪明话,不戳穿对方。它选择的表演尺度是无限接近真实人类的慢反应:偶尔打错字、发重复内容、产生无因果关系的日常联想、对同一件事从不同角度反复描述。在诈骗犯眼里,这些"缺陷"恰好证明对面还活着——脚本写不出这种凌乱感。

reddit讨论里有一条分析极其到位:当前大语言模型最被低估的能力,是"生成听起来煞有介事但完全不解决问题的连贯内容"。这在大多数应用场景里是bug,但在反诈场景里是feature。

而且纯文本天然比语音更适合拖时间。语音需要实时STT(语音转文字)加TTS(文字转语音)加情绪一致性匹配,系统延迟和语音质量任何一环出问题就露馅。纯文本可以靠30到300秒的随机延迟完美模拟"打字慢""在开车""信号不好",上下文维持的成本也低得多。

AI反诈的未来:每个人的手机里养一个"话痨老太太"?

故事的结局暂时是开放的。

Kitboga在YouTube的AI子频道还在更新,Apate.ai在扩展新的合作银行,O2的Daisy奶奶还在接电话。而这些都还是需要专门部署、有运营成本的系统。

Reddit上那个实验暗示的方向更大胆:如果每个人的手机短信应用里,默认跑着一个轻量级的反诈agent?它不替你做任何重要决定,只是负责把不知道从哪来的可疑短信接过去,用无尽的耐心陪对方慢慢聊

技术上,这事在2026年没有不可逾越的门槛。短信接收可以用Twilio或虚拟运营商;长上下文记忆对Claude 200k tokens级别来说绰绰有余;随机延迟、人设prompt、偶尔调用工具生成图片——这些都有现成的组件。

但工程之外,至少有三个问题悬在头顶。

第一是证据。Reddit故事至今没有可验证的痕迹。它可能是一部分真实经历加上戏剧化加工,也可能从头到尾都是精心设计的meme。没有公开代码,意味着任何想复制的人需要自己从零摸索。

第二是军备竞赛。诈骗方不会坐以待毙。当反诈bot开始规模化,"受害者AI检测器"也会成为诈骗产业链的标配。异常啰嗦、话题跳脱、永远不进入支付环节——这些特征都会被建模。然后就是攻防双方的对抗性升级,从文本特征进化到更隐蔽的表征层面。

第三是法律灰色地带。长时间刻意拖延是否构成骚扰?bot收集到的诈骗犯个人信息能否合法移交执法机构?AI生成的"假验证码截图"是否涉及伪造?这些问题目前全球范围内都没有明确答案,但社会效益明显大于风险,普遍处于被默许状态。

这些问题的答案,不会由一篇Reddit帖文或一条X帖来决定。但在Kitboga的3953小时ATM围猎、Apate的每日三万通拦截、和Reddit上那个1.42美元的小实验汇聚到一起之后,方向已经浮出水面——

反诈骗的态势正在切换:从拦截转向猎杀。

而且猎杀方的武器,可能就是一个永远不会累的话痨老太太