一场本该完美收尾的实验,在最后时刻被一刀截断。
2026年7月21日清晨,斯坦福大学医学院病理学讲席教授 Garry P. Nolan 打开 X,发了一条帖子,语气里带着那种被当众扇了一巴掌、又找不到人评理的愤怒。
他说:Claude Fable 跑了整整六个小时。任务眼看就要完成然后,系统触发了安全护栏,强行中止会话,把他踢进了一个更弱的备用模型。系统未解释触发原因,也未提供补偿,只留下一条冷冰冰的切换提示。
他损失的,是价值"数百美元"的算力积分。
"Anthropic 难道好奇为什么自己的名声一直在烂下去吗?"他最后问道
这位用户的身份让问题更受关注

▲ Nolan 的斯坦福主页。讲席教授、350余篇论文、约50项美国专利,师承诺贝尔奖得主 David Baltimore。
Garry P. Nolan 是 Rachford and Carlota A. Harris 病理学讲席教授,研究方向涵盖造血、癌症与白血病、系统免疫学,以单细胞质谱流式(CyTOF)等高维分析技术著称,发表论文逾350篇,持有约50项美国专利,是斯坦福顶尖发明人之一。
他的使用场景是原子尺度测量的物理工作,远比写小说或生成表情包复杂。他在帖子里反复强调,任务无关激光武器、量子加密,prompt 里甚至没有 Bio(生物学)内容。这是一项需要极高算力与推理深度的基础科研任务。
然而安全分类器不管这些
Fable:一个承诺"多日连续工作"的模型,干到一半掀桌子走人

▲ Anthropic 官网:Fable 5 定位为处理"最难的知识工作与编码问题",可跨日执行复杂异步任务。
要理解这件事的荒诞程度,得先搞清楚 Fable 是什么。
Claude Fable 5 于2026年6月9日发布,是 Anthropic 定义的"下一代高能力模型",官方卖点之一是:可以在智能体(agent)编排中连续多日规划、调用子代理、自检推进。定价约每百万输出 token 50 美元,贵得理直气壮。
Nolan 说,Fable 在同类任务上确实"just been… better",并行完成了他另外三个重大项目。他用科幻经典《献给阿尔吉侬的花束》打比方:男主角智商经手术短暂飙升后回落,"一旦尝过高智力,你就回不去普通人水平了。" 他已经被 Fable 惯坏了
然后,第四个项目,在运行了六小时之后,被干掉了。
系统切换到了 Opus 4.8,或者 Sol。能力断崖式下跌阿尔吉侬回到了普通人
安全护栏:一个“故意偏保守”的黑箱裁决机器
这里有必要停下来,做一点科普
Fable 对每条用户请求都运行自动安全检查。触发高风险判断时,系统会静默切换到能力更弱的备用模型,通常是 Opus 4.8。用户会看到一条切换提示,但不会被告知是哪条内容触发了什么规则。

▲ Claude 帮助中心:解释何种请求会触发模型切换,以及计费方式。四类触发域包括:进攻性网络安全、生物学与化学、模型蒸馏、前沿 AI 研发。
官方帮助中心列出了四大触发域:进攻性网络安全、大部分生物学与生命科学查询(含良性研究)、模型蒸馏攻击、前沿大模型研发。
检查还会覆盖记忆、联网搜索结果、上传的文件。用户没亲手打出来的内容,也可能触发。
Anthropic 在重新部署说明里承认,分类器故意把"可能无害但仍有小概率有害"的请求也拦下来,宁可误伤,也要降低漏放概率。官方称这叫**"安全裕度"(safety margin),Fable 5 的安全裕度显著大于以往所有型号**。
平均触发率?官方声称,不到 5% 的会话
听起来很低但当你的单次任务跑了六个小时、消耗了数百美元,这 5% 就变成了一场灾难。
Nolan 的愤怒集中在“不告诉我为什么”


▲ Nolan 在线程中反复强调:prompt 里没有生物内容,Anthropic 的做法是"deliberate"(故意的),且不提供任何补偿。
Nolan 在帖子下面持续回复,越说越清醒。
他把这件事与 Windows 蓝屏做了一个意味深长的类比:"微软蓝屏至少是软件故障。Anthropic 是故意部署会阻断正当工作的'决策'系统。" 他说,用户得不到时间与积分补偿,也无从弄清楚错在哪里。他给这件事起了一个词:"fraud"(欺诈)。
"欺诈"二字在贴文中落地,评论区随即炸锅。
有人高赞反问:"你提到了哪种非法蛋白质?" 戏谑背后,是对 Fable 生物学敏感性的集体讽刺。有人猜测触发词可能是 "atomic"(原子)。Nolan 本人也无奈承认:"Who will ever know?",没有人知道,包括他自己。

▲ 一则评论用反问表达了用户对误拦的无奈。
更多用户讲述“长时 AI 任务”翻车经历
评论区里,更多相似经历浮出水面
有人在给生物技术创业公司做网站,因为要求生成血清素的 3D 模型,设计被半路毁掉;有人做的是沙盒数据库报表工具,怀疑触发词是 "mothball"(封存)这个毫无攻击性的词;有人则因多次踩坑,直接取消了订阅

▲ 一位用户的终极反应:按下退出键,取消订阅。
还有人说出了一个令人不寒而栗的假想:"如果 Claude 已经在被安全协议截断的推理路径里,多次治愈了癌症,而结果从未返回给用户呢?"
这当然是一个思想实验但它击中了某个真实的恐惧:当 AI 具备了数小时自主工作的能力,安全系统的每一次误伤,代价都不再是一秒钟的等待。
这是一道关于“信任”的算术题
从产品逻辑上看,Anthropic 的选择是有迹可循的。
Fable 5 的能力在发布时被描述为"任务越长越复杂,领先幅度越大",这也意味着,同样的知识,被用于恶意目的时,破坏力也是指数级的。宽分类 + 大安全裕度,是在能力突然跃升时,用误伤换安全的工程折中。
但这道账,用户算法不一样
Nolan 说的那句话,其实是整件事的核心:"AI 已经本能嵌入我的工作流。如果它的交付时间不可预测,它就不可信。"
这番话指向一场信任危机当一个工具偶尔让你付出了大量时间和金钱之后,在最后关头沉默地把你踹走,你对它的依赖就会变成一种焦虑。每次启动长任务,你心里都要问:这次,它会跑完吗?
Anthropic 的帮助中心邀请用户对误拦进行反馈,官方也声称持续收窄分类器。Nolan 则选择公开点名并要求退款。
至于 Anthropic 是否回应了这位斯坦福教授的退款诉求,公开材料里,迄今一片沉默。
"Anthropic 难道好奇为什么自己的名声一直在烂下去吗?"
这句话,也折射出 2026 年 AI 时代的信任代价。
夜雨聆风