夜雨聆风学习资料网

ARTICLE · 984604

AI助手干着干着失忆,根因是系统里三把没人对过的表

AI助手干着干着失忆,根因是系统里三把没人对过的表
三虫君·AI实战课 | 2026-08-30

AI助手干着干着"失忆",根因是系统里三把没人对过的表

上礼拜我碰到个邪门事。

我让AI助手小智帮我盯一条视频生产线,一个会话连轴转了好几天,日志、截图、审查记录全堆在同一个对话里。突然有一天,它开始"失忆"——不是忘了旧事(那是正常的记忆压缩),而是压缩这个动作本身一直失败。对话堆到五十万token,每次想压下去都超时,超时就重试,重试又超时。眼看着它抱着一段越来越长的记忆原地打转。

一台机器,干得好好的,怎么突然就"消化不良"了?

我以为我设过超时

我第一反应是:超时?我设过啊,300秒,之前专门修过的。

后来才知道,我设的那300秒,只管"主对话"。而压缩是另一个独立的后台调用,它压根不走我设的那把表。

更损的是,系统里还有一个更高层的"看门狗",专门盯着任务有没有进展,默认120秒看不到进展就动手杀。而压缩这种活是一次性吐结果的——生成完之前一个字都不往外吐,看门狗全程看到的就是"没进展"。

所以哪怕把压缩的超时放宽到20分钟,看门狗还是会在第120秒把它掐了。死得和之前一模一样。

那一刻我想明白一件事:超时不是一个数,是好几把表。同一个系统里,流式调用一把表,辅助调用一把表,看门狗一把表,各管各的,互不通气。你只对了其中一把——还以为那就是全部。

让AI解剖它自己

这事我自己是查不动的,是让小智去读它自己的源码查出来的。这个体验挺奇妙:我提问题,它翻自己的"体检报告",最后指着自己三个器官说,病根在这。

整个链路拆开是三层:

第一层,压缩本身。对话长到一半时,系统把中间的二十五万token拼成一个大摘要任务,一次性发给一个"辅助模型"。默认配置下,这个辅助模型就是主模型本人——一个非流式请求,二十五万token进去,干等着出结果。

第二层,辅助调用的超时。默认120秒。二十五万token的摘要,120秒基本不可能完成。

第三层,看门狗。只要任务120秒"无进展"就杀,总上限600秒。而非流式调用在它眼里,永远没进展。

三把表,每一把单看都合理,叠在一起就是死循环。所以修法是三处一起动:辅助模型从主力模型换成一个轻量快模型——压缩摘要这活不需要聪明,需要快;辅助超时放宽;看门狗的空闲阈值和总上限也分别放宽。三把表一起对齐,压缩才真正跑通。

两个坑,都挺典型

坑一:修了主对话,以为全修了。

之前我遇到过一次超时,给主对话设了300秒,好了。这次压缩再超时,我下意识觉得"不是修过了吗"。事实是那次修的是流式那条路,压缩走的是另一条路。同一个"超时"两个字,在系统里至少指三个不同的东西。这之后我养成个习惯:改任何超时前,先问一句——这个超时,是哪一层的?

坑二:配置改了一半,以为改完了。

修复方案定了三处,我自己动手改配置。改完让小智检查,它一句话给我问住了:最关键的那处,你还没设。我改了模型和辅助超时,但看门狗的两个参数没写——不写就走默认值,还是120秒掐人。也就是说,我改的两处全白搭,死法不会有任何变化。

配置这东西,少写一行不会报错,只会安静地按老样子运行。改完必须读回来核对,不能凭"我改过了"的感觉。这次要不是多了道检查,我大概会自信满满地等一个永远不会来的好结果。

说到底,这套方案解决了什么

一句话:自动化系统里的超时是几把互不通气的表,你以为放宽了,往往只放宽了一把;而"没进展"的判定标准,决定了非流式的活天生容易被误杀。

这事的价值不止于修好一个压缩。往后你搭任何自动化——定时任务、批处理、AI长会话——只要里面有"等一个慢结果"的环节,都值得先问一句:这里有几把表?谁在盯进度?慢活会不会被当成死活?

问完这三个问题,能省掉很多"明明设了超时还是超时"的鬼打墙。

适不适合你?

你的情况
推荐度
长期跑AI Agent,单会话堆大量上下文
⭐⭐⭐⭐⭐ 压缩失败就是这么来的
自己搭自动化管线、调过超时参数
⭐⭐⭐⭐⭐ "这是哪一层的超时"这个意识能救命
偶尔用聊天AI,对话都不长
⭐⭐ 碰不到压缩阈值,不用焦虑
只用托管产品,不碰配置
⭐⭐⭐ 懂原理,能帮你判断是产品烂还是用法错

你有没有遇到过"明明设了超时还是超时"的怪事?评论区聊聊——说不定你也是被第二把表坑的。

我是三虫君,

一个小县城里把AI用出花来的技术人。

每天一篇,带你看看AI还能这么玩👇

本文由 AI 辅助资料整理,经人工编辑后发布。

相关学习资料

返回首页浏览学习资料