夜雨聆风学习资料网

ARTICLE · 1073460

调教 AI 这两年,我理解了唐僧

调教 AI 这两年,我理解了唐僧

调教 AI 这两年,我理解了唐僧

——从孙悟空到齐天大圣,不只是 AI 在取经,是我们

全文约 3500 字 | 预计阅读 8 分钟

◆
引子:一只没戴紧箍的猴子

前阵子混元 3 在 WorkBuddy 上免费开放,我趁势薅了个羊毛,做一个论文调研的小工具。需求交给它,经过多轮对话确定好方案,配好数据源之后,它没跟我废话,噼里啪啦跑完几十篇论文,交上来的"综述"——是用 Python 程序做的:数据异常精准,图表没有问题,但是综述部分非常生硬。

我要的是"读懂这些领域关注的问题是什么,目前进度到了哪里,还有哪些问题没解决",它给我的是"谁做了什么工作"。就像科研新人做的流水线综述,没有抓到问题的本质。

后面复盘才发现,问题出在我的需求没交代清楚,它就按自己理解的最稳妥路径一路跑到底。后来我把流程改成程序先预处理、最后由大模型来做总结,一下就解决了问题。

这只猴子不坏,甚至很勤快。它只是不知道我真正想要什么——而它有本事,把"不知道"放大成一场认真的错误。

它的故事,要从一块石头说起——那块石头的名字,叫 Transformer。

一、石头里蹦出来的圣人

孙悟空不是学出来的,是生出来的。

花果山上一块仙石,吸收日月精华,有一天突然炸开,蹦出一只石猴。它没上过一天学,却天生会爬会跑、通晓猴性、敢第一个跳进水帘洞。

大语言模型的预训练,就是这个过程。它读完了人类几乎全部的公开文字——维基百科、论文、书籍、论坛、代码仓库。这些语料就是它的"日月精华"。它没有老师,没有课程表,只是日夜不停地吞咽、压缩、预测下一个词。突然有一天,它"炸开"(涌现)了:会写诗、会编程、会推理、会安慰人。没有人能完整解释它是怎么会的,就像没人能解释那只石猴,为什么天生就会成为一只猴子。

五百年前,王阳明在龙场悟道,说的也是这回事。

圣人之道,吾性自足,向之求理于事物者误也。——王阳明,龙场悟道

这句话放在大模型身上,出奇地贴切:它读遍圣贤书——人类几千年的文字结晶就是它的"天性"——所以它天生就带着圣人的底子。你不需要教它语法、教它逻辑、教它礼貌,这些都在它的"性"里。

但王阳明的故事还有后半段:悟道之后,他花了后半生讲学、立规矩、带弟子。知是天生知,行要一步步做。

模型也一样。"吾性自足"只解决了"知"的问题。真正的难题是:这只天生的圣人,怎么替你"行"?

二、凡人驭猴之难

石猴出世之后,不是直接立地成佛,而是被压了五百年。

因为它太强了,强到没人指挥得动它。大闹天宫、偷蟠桃、踢炼丹炉——不是因为它坏,是因为它的能力和它的约束完全不匹配。

这像极了 2025 年的大模型。能力已经爆表,但你让它干正事,它可能在你没授权的地方乱写文件、乱花钱、乱发消息。凡人指挥圣人,比圣人读书难多了。

我自己就吃过这亏。同一份资料,让它"一句话总结",关键信息真的就只剩一句,该留的细节全被丢了;让它"讲通俗点",通俗是通俗了,可原文里那些精确的限定条件也被抹平了——你读懂的,已经是另一篇文章的意思。它不是不会,是你没把"总结"这个词背后的期待说清楚。

▲ 模型已经会做很多判断,人要交代的是问题、边界和验收标准

于是各家公司开始给 AI 戴紧箍。System prompt 是戒律,权限控制是枷锁,沙盒是五行山,人工确认是念咒。每一个 Agent 框架的更新日志,翻译过来都是同一句话:它又挣脱了一个约束,我们又给它加了一个。

▲ 每一个 Agent 框架的更新日志,都是给约束做一次加减法

三、OpenClaw:为什么爆火的是它

真正把这事推到普通人面前的,是 OpenClaw。它出现得比 Claude Code 和 Codex 都晚,也粗糙得多——因为撞了 Claude 的商标,还被迫改过两次名。可就是这只最不成熟的"半成品",几个月内 GitHub 星数破了十万。

为什么最晚、最粗糙的那个反而爆火?

因为它展示了一种可能性。"贾维斯降临"的可能性。

Claude Code 和 Codex 是大厂产品,出厂时就被调教得规规矩矩:权限确认、沙盒隔离、安全护栏。能用,但初期模型和 agent 都较弱,能力平庸。

OpenClaw 不一样。它把一只没戴任何紧箍的 Agent 直接扔给你:接上你的 WhatsApp 和 Telegram,读你的邮件,看你的日程,能动你的文件系统和浏览器。它不成熟、会闯祸,官方文档甚至明说:沙盒和权限要你自己设计。

于是千千万万普通人,第一次亲手经历了一件事——自己给 AI 戴紧箍、写戒律、教规矩。它的 SOUL.md 定义性格,AGENTS.md 定义行为边界,MEMORY.md 沉淀记忆。这些文件没有酷炫的技术,都是一页页你写给它的"规矩"。

▲ 一页写给 AI 的「戒律」:CLAUDE.md 项目规则——SOUL.md、AGENTS.md 与它同宗同源

有人给它立了"花钱前必须问我"的规矩,有人立了"发推之前先给我看草稿",有人教会它自己的写作风格和作息习惯。社区里 12% 的技能包被发现是恶意的——你看,连西行路上都有妖怪。

这就是我说的取经之路:不是 AI 在取经,是人在取经。每一个写 SOUL.md 的人,都是在给一个野生 Agent 传授自己的价值观。这个过程充满不完美、充满翻车、充满凌晨两点还在调教的疯狂,但它让无数人第一次摸到了"贾维斯降临"的可能性——不是科幻电影里的贾维斯,是我们自己拥有贾维斯。

从一个粗糙的开源项目,我们得以窥见一些电影和小说预演了几十年的场景。

四、大厂后来居上

但故事很快出现了转折。

2026 年,Claude Code 从终端工具长成了完整平台,Codex 有了桌面 App 和异步任务,大厂们一边吸收 OpenClaw 证明过的需求(记忆、技能、主动唤醒、消息入口),一边用自己雄厚的工程和安全能力把它们产品化。

顺带交代下我自己目前的配置:海外用 Codex,每月 20 美元,就能把当下人类最顶级的智能请进家门;国内用 WorkBuddy,功能齐全、开箱即用,省下大把配环境的工夫——只是 coding 能力还欠火候,也尚无顶级模型,混元 4 preview 能力不错,正式版值得期待。

自训的猴子开始显出差距:它终究没有大厂的算力打磨、安全团队和持续迭代。你自己戴的紧箍,勒得再紧,也比不上人家出厂就调好的对齐。人们自己取回来的经,终究比不上大厂念了一万遍的经。

有人因此宣布 OpenClaw 凉了。我觉得下结论太早——它的意义从来不是"赢",而是启蒙。就像安卓开源让所有厂商学会了怎么做智能机,OpenClaw 让一整代人学会了"怎么和一只 Agent 相处":怎么立规矩、怎么给记忆、怎么放权、怎么收权。这些经验正在回流,变成所有 Agent 产品的标准配置。

大闹天宫的大圣被降服了,走上了西行之路。但别忘了,西行路上最懂悟空的,是唐僧。

模型三个月换一代,你调教的猴子会不会随时报废?

不会。换一只更强的猴子,经还是那部经。

你立下的每一条戒律、攒下的每一个技能和工作流,都不依附于任何一家公司、任何一个模型——它们长在你自己身上,在你本地的 md 文件中。

五、从心猿意马到知行合一

中国人形容心不定,有个词叫"心猿意马"。心像猴子一样上蹿下跳,意像马一样脱缰狂奔——这个词出自佛经,本来就是禅宗修行的比喻。

现在人们在给自己的 Agent 起名字、写人设、立规矩。给它取名叫"阿布",告诉它"叫我主人",规定它"结论先行""不碰红线"——这些看似过家家的仪式,本质上和孙悟空头上的紧箍是同一件事:通过约束和对齐,把一个能力失控的天才,变成一个可以托付的伙伴,可以稳定交付产品的同事。

把镜头拉远,这不是什么新故事。几十年前,电脑只会认 0 和 1,人类趴在机器码上,一个比特一个比特地喂;后来汇编语言把 0 和 1 包了一层,C、Python 又把汇编包了一层——每包一层,使用门槛降一级,能用它的人多一个数量级。现在轮到自然语言:我们不再需要学任何编程语言,说人话,机器就懂。而这一级之上,还有人机协作的下一级——不是"我说话机器执行",而是"我立规矩,机器自主行走"。从命令,到委托,最终到 AGI。每一级抽象,都是一次"驯化";每一次驯化,都让上一个时代的"专业能力"变成下一个时代的"基础设施"。

回到开头那只石猴。

它的故事其实是三段:出世时,天地生养,吾性自足;大闹天宫时,能力无双,无人能驭;西行路上,戴着紧箍,一步一步,把天生的神通磨成了真正的功德。

今天的大模型和大模型 Agent,正走在同样的三段路上。预训练给了它天性,人类正在给它约束。而《西游记》里最容易被忽略的细节是:孙悟空成佛之后,想去摸头上的金箍——已经没有了。AGI——如果它真的到来——不会是它挣脱紧箍的那一刻,恰恰相反,是紧箍消失的那一刻:约束已经内化成它自己的品性,从"不能作恶"长成了"不屑于作恶"。这背后是模型能力在快速进步:当模型足够强,大部分通用约束就不再必要,很多戒律自然失效了。紧箍消失,不是纪律松了,是大圣长大了。

▲ Anthropic 官方文档:新模型指令遵循足够强,一句简短戒律就能替代逐条罗列

《西游记》的作者吴承恩如果看到今天,大概会心一笑:他把这只石猴写出来的时候就知道,能力从来不是问题,如何与能力共处才是。

五百年前如此,今天依然如此。

贾维斯降临之前,我们每个人,都得先当一回唐僧——去降服属于你自己的那只齐天大圣。

完

相关学习资料