乐于分享
好东西不私藏

Claude Code创始人卸载IDE八个月,每天调度数百AI代理!Fable 5首次涌现「大模型气味」:拆解Boris Cherny的Loop开发范式

Claude Code创始人卸载IDE八个月,每天调度数百AI代理!Fable 5首次涌现「大模型气味」:拆解Boris Cherny的Loop开发范式

2026年6月10日凌晨,Anthropic Claude Code负责人Boris Cherny发了一条帖子,24小时内拿到1万+点赞、90万+阅读

帖子里他说了三件事,一件比一件狠。

第一,Fable 5是自Opus 4.5以来他感受到的最大模型飞跃。

第二,自从Opus 4.5发布后,他已经卸载了IDE,连续数周100%在终端里编码。

第三,也是帖子里最受关注的一点——Fable 5展现出了一种他从未见过的“人格”。

"It is the first model I have used that was so methodical and precise, taking measurements and adding logs then verifying that it truly fixed the issue before declaring victory."

「这是第一个我用过的模型,如此有条不紊、如此精确:先做测量、加日志,然后真正确认问题修复之后,才宣布胜利。」

▲ Boris Cherny的Fable 5体验帖。1万+点赞、90万+阅读,600+转发

“大模型气味”从何而来?

Boris特别强调了一点。

"There's nothing in claude code's prompting telling the model to do that, it's just part of its personality. It really has this 'big model smell' that I haven't felt before."

「Claude Code的提示词里没有告诉模型要这样做,这完全是它自身人格的一部分。它真的有一种我之前从未感受过的『大模型气味』。」

短短几句话,很快在开发者社区引起了讨论。

什么叫“大模型气味”(big model smell)?Boris的解释很朴素:当模型足够大的时候,某些高质量行为会自然涌现,比如在调试时主动做测量、加日志、验证修复、确认无误后再收工。

这些行为没有写进提示词清单,更像模型在实战中自己长出的能力。

就像人类工程师里,最优秀的那一批根本不需要被告诉“先查log再下结论”——这已经内化成了工作本能。Fable 5让Boris感受到的,正是这种工程方法论的自然涌现

而这一点,恰恰是“Loop开发范式”能够成立的前提。

什么是Loop开发范式?

过去两年,AI编程工具经历了三次加速:

  • 2024年
    :Copilot补全代码行,人写,AI辅助。
  • 2025年
    :Claude Code/Codex级别的Agentic编码,人描述目标,AI读代码库、跨文件编辑、运行测试、提交PR。
  • 2026年
    :Boris提出,他已经不再“写提示词”了——他写Loop

什么叫写Loop?

传统模式:人 → prompt → 读输出 → 再prompt → 再读输出……人是这个循环本身。

Loop模式:人设计一套系统(目标 + 发现机制 + 工作区隔离 + 子代理分工 + 验证闸门 + 外部工具连接),然后走开。系统自己找活、分配、执行、检查、记录、决定下一步。

Boris的原话足够直接:

"I don't prompt Claude anymore. I have loops running that prompt Claude and figuring out what to do. My job is to write loops."

「我不再手动给Claude发提示了。我有loop在跑,它们自己给Claude发指令,自己决定做什么。我的工作是写loop。」

"Going from agents to loops is as big a jump as going from code to agents."

「从代理到loop的跨越,和从代码到代理的跨越一样大。」

Fortune杂志报道了一个细节:Boris已经8个月没手写代码了。他每天早上面对的是一群正在运行的代理——有时几百个,有时上千个。绝大多数Claude Code会话里,在终端敲下指令的那个角色,早就换成了另一个Claude。

▲ 粉丝站点howborisusesclaudecode.com整理了Boris多轮分享的全部工作流技巧

Boris的Loop基础设施:13条铁律

Boris多次在X上公开自己的工作流配置,被社区整理成了一整套操作手册。核心十三条:

1. 并行5个终端Claude,每个跑在不同git worktree上,互不冲突。外加5-10个web会话,通过teleport在本地和云端之间迁移。

2. 永远从Plan Mode开始。人跟Claude先把计划迭代到满意,再切auto-accept让它执行。“好计划能避免后期大问题。”

3. CLAUDE.md是活的。这是项目根目录下的Markdown文件,存放编码规范、架构决策、历史教训。每次Claude犯错,结束时加一句“Update your CLAUDE.md so you don't make that mistake again.”团队共享,PR中自动更新,随时间“自进化”。

4. Sub-agents做Maker-Checker分离。定义专用代理——一个探索,一个实现,一个验证。不同指令、不同工具集、不同模型。验证代理独立审核实现代理的输出。

5. Hooks自动化一切。PostToolUse自动格式化代码,SessionStart加载上下文,权限路由自动分发。

6. 所有工具MCP化。Slack、BigQuery、Sentry、Jira、Google Drive都接进了Claude Code。Boris说:“Claude Code用我的所有工具自治。”

7. Verification是第一原则。给Claude一个验证闭环(测试套件、浏览器MCP、模拟器、CI),质量直接提升2-3倍。这也是Boris反复强调的#1 tip。

8. /loop命令让一切自治。按间隔重跑提示,本机持续数天。/goal带停止条件,由另一个模型验证“是否完成”。/schedule是云端cron。Routines事件驱动——GitHub PR开了就自动派代理。

9-13:/batch做交互式规划后几十个代理并行迁移;/simplify并行做代码质量提升;代码审查代理自动派发给团队;/btw让任务中途侧问不打断;auto-mode用分类器安全跳过权限提示。

▲ Google工程师Addy Osmani将Boris的实践系统化为“Loop Engineering”框架:Automations + Worktrees + Skills + Plugins + Sub-agents + State

Fable 5为什么是关键转折点?

Boris这套基础设施早在Fable 5发布前就已经搭好了。

实际上,早在2025年底Opus 4.5发布后,他就已经在这么干了。Fable 5的作用是另一层的:它让这套系统的“信任天花板”被大幅抬高了。

之前的模型需要人在loop中不断steer。Fable 5表现出的那种“方法论的、自己会验证”的人格,意味着人可以更放心地把复杂工作交给代理自己去迭代——而不需要盯着每一步。

Boris在帖子里点出了这个微妙但关键的区别:模型本身长出了工程判断力——工具变强只是表象,真正发生质变的是模型自己。

Stripe的案例提供了一个佐证:50万行Ruby代码库的迁移,原本需要一个团队干两个多月,Fable 5一天完成。Cognition FrontierCode给了它软件工程最高分。GitHub的早期测试结论是“复杂长时任务的自治可靠性超前”。

真正让Boris记住的,是一次调试经历:模型自己决定先加日志、再跑测试、确认修好之后才报告完成,那种职业感很鲜明。

▲ Anthropic官方公告:Fable 5/Mythos 5发布,并说明了访问调整与安全护栏设计

摩擦的另一面:护栏过敏、定价争议、访问门槛

Fable 5也伴随着不少争议。

Anthropic给Fable 5加了三层安全分类器——网络攻击、生物/化学风险、模型蒸馏——一旦触发就会fallback到Opus 4.8。官方数据是不到5%的会话会触发,但在开发者社区里,“过敏”的抱怨声量远大于这个比例。

有人在X上反馈,做简单的调试任务也被标记为cyber/bio风险直接拒绝。有人问生物学问题(哪怕和癌症研究相关)也被挡。安全研究员banteg的原话是:“the released version is completely unusable because of insane refusal rate.”

Boris亲自下场回复了这些抱怨:分类器确实过于敏感,团队正在改进;他推荐使用/security-review skill做预检;并帮几位用户DM debug后确认是误报。

价格也引来不少讨论。Fable 5在6月22日前包含在订阅计划中免费使用,之后按credits计费。API定价$10/$50 per million tokens。有用户抱怨“6月22日后贵了10倍”,有人形容这种关系和Anthropic是“toxic relationship”——模型太好了,但随时可能用不起。

Anthropic给出的解释是:需求预测太难,保守是不得已

▲ Claude Code产品页面首屏:强调“Agentic, not autocomplete”,并展示产品界面

Loop范式之下,工程师还剩下什么?

另一个绕不开的问题是:如果loop跑起来了,人干什么?

Boris在Lenny's Podcast和Fortune采访里的回答,指向了三个新角色:

第一,系统设计师。 人的核心工作从“写代码”变成了“设计代理系统”——定义目标、搭建验证闸门、配置sub-agent分工、维护CLAUDE.md知识库。类比从手写汇编到写编译器。

第二,品味守门人。 代理能产出大量候选方案,但“哪个方案是对的”仍然需要人的判断。Boris说Fable 5的“judgement, taste, dimensionality”(判断力、品味、维度)让他更愿意信任复杂工作的输出——但“信任”的前提是人有品味去分辨。

第三,验证架构师。 Boris的#1 tip一直是verification。loop跑得越好,验证体系就要越强。没有闭环的loop只是在加速幻觉。未来顶级开发者的核心竞争力,可能从拼手速转向了拼设计验证基础设施的能力

Addy Osmani在他的Loop Engineering文章里也提出了警告:loop越好,越容易产生“理解负债”(comprehension debt)。代码跑起来了,PR合了,但人没读过。当问题真正出现时,没有人知道为什么当初做了那个决策。

这更像一个提醒:范式迁移走到最后,考验的仍是更深层的理解;代码并不会因此退出现场。

Boris自己做过一个判断,也许最能说明这个转折:

"Loops are the future."

Loop是未来。而Fable 5,是让这个未来提前到达的那一步。