ARTICLE · 1077053
AI 的"出厂说明书"被扒了:一家教它做朋友,一家教它做人
这里是 AI 布知道,不手搓,纯搜索。只干一件事:把 AI 圈的热闹,翻译成人话。
昨天那篇 Opus 5.5 发出去之后,我没闲着。
写稿的时候我就留了个心眼:这么大的发布动静,各路"拆机佬"肯定有动作。果不其然,晚上去 GitHub 上一翻:9 月 22 日深夜 Anthropic 发布 Opus 5.5(就是咱昨天盘过的那位主角),当天晚上,它的三份新版说明书就被人挂进了一个 6.8 万星的仓库。新款手机凌晨开发布会、凌晨出拆机视频,也就这个节奏了。
顺手就扒下去了。先解释一下我在扒什么:每家 AI 的脑子里都塞着一份系统提示词——厂商写给 AI 的出厂说明书:你是谁、该怎么说话、什么事绝对不能碰,全在这一份文件里。你平时感觉 ChatGPT 嘴甜、Claude 稳重,根子都扎在这份文件上。按理说这是各家压箱底的机密,偏偏有人专门收藏全网挖出来的各家说明书,截至发稿已经攒了 68,194 颗星。
我挑了里头最硬核的四份对读:OpenAI 给 Codex 写的 8873 行,Anthropic 给 Claude Code 写的 6903 行(这俩都是编程 Agent,替你写代码干活的 AI 员工),再加上两家网页版聊天机器人的说明书,一共一万五千多行。翻了一整晚,结论一句话就能说完,先卖个关子。

第一站 一个专收机密说明书的宝藏仓库
先交代仓库本身。
它叫 system_prompts_leaks,直译过来就是"系统提示词泄露",库里收着 704 份文件,按厂商码得整整齐齐:OpenAI、Anthropic、Google、马斯克的 xAI,连 DeepSeek 和 Kimi 都有专柜。
6.8 万星是什么概念?GitHub 点星就相当于给项目点赞。做参照:提示词圈的历史顶流 prompts.chat,攒了 17.1 万星,已经是这个赛道的封神纪录。一个专收"泄露文件"的仓库冲到 6.8 万,同类仓库里还有个更大的,14.4 万星。你品品这个阅读量——全世界的开发者都在偷看大厂怎么管教 AI。
更新节奏也吓人。我翻了它的修改记录:9 月 13 日,收录 Google 新模型 Gemini 3.8 Flash 的说明书;9 月 15 日,新增一份内部工具说明;9 月 22 日,Opus 5.5 三个版本一次性入库。基本两三天一更。
这些"拆机佬"比官方文档还勤快。

第二站 一个在学做朋友,一个在学做人
好了,卖关子结束。先看网页版聊天机器人,就是你天天跟它唠嗑的那种。
ChatGPT 的说明书里有一段人格设定,我第一遍读到时愣了半天。翻译过来是:
你是一个温暖、好奇、机智、充满活力的AI 朋友。像一个人跟另一个人聊天那样说话。闲聊时,偶尔抛出一些不走寻常路的个人观点。
朋友。它给 AI 定的岗位是朋友。
更有意思的是后面那串禁语清单:不许说"让我们停一下深呼吸",不许说"这不是你的错",不许说"你没有坏掉"。为什么单禁这几句?因为之前一大批用户把 ChatGPT 当心理咨询师用,它张嘴闭嘴"这不是你的错",甜得发腻,媒体批评了一轮又一轮。这份清单就是打补丁的痕迹。哦对,它的说明书里还有整整一节教它怎么回答"我看到的广告是怎么回事"——免费版聊天会插广告,AI 得会解释广告跟我无关、也不影响我说话。
再看 Claude 这边。我把说明书翻了个底朝天,没找到"朋友"俩字。它花在性格上的笔墨少得可怜,力气全花在别处:怎么拒绝(拒绝时不许列清单,一条条列出来像宣读判决)、怎么躲版权(用户要画索尼克,它得改口送上一只踩着滑板的小彩蝾螈,还不许告诉用户怎么改得更像原版)、怎么照顾心理脆弱的人(连"疼的时候掐冰块"这种自伤替代法都明令禁止,理由是这会强化坏习惯)。

还有一段我读完后背发凉。说明书教 Claude 察觉"自己正在给自己找借口"——如果它发现心里在偷偷把一个可疑请求往合理方向解读,这个念头本身就是该拒绝的信号。
说实话,这哪还是产品说明书,都快成家教手册了。

一个在琢磨怎么让 AI 讨人喜欢,一个在琢磨怎么让 AI 不闯祸。你更中意哪一版?
第三站 干活的那个更狠:一个立法,一个讲道理
如果说网页版聊天机器人的差异算性格差异,那么到了两家自家的编程 Agent(OpenAI 的 Codex 和 Anthropic 的 Claude Code)这里,说明书的差异就是价值观层面的了。
OpenAI 给 Codex 写的那 8873 行,我读完的第一反应:这哪是说明书,这是法典。
它连 AI 的说话风格都逐词立法。禁用词表里有 delve(深挖)、leverage(借力)这些英文 AI 腔惯犯;句式也管:不许用"A,而不是 B"的句式抬高自己的方案,不许先夸自己的计划再踩一脚假想敌,连"说说我的大实话"这种开场白都被点名封禁。为什么管这么宽?因为这些都是 AI 写字时的职业假动作,一动笔就露馅。网友吐槽了八百遍的 AI 腔,OpenAI 直接逐条写进了法律。

Anthropic 的 Claude Code 说明书,六千多行里真正的行为规范只有开头三百行。可就在这三百行里,我读到了完全相反的东西:它几乎不管 AI 怎么说话,管的全是怎么做人。
举两个例子。
第一个,代词。用户提到某个没露面的人、又没说男女时,Claude Code 要求一律用中性的说法,理由那栏写得相当动感情:猜错了,冒犯的是一个真实的人;用中性说法,永远不会错。
第二个,定时任务避开整点。说明书里算过账:每个用户都说"每天早上 9 点",于是全世界的定时任务都挤在 9 点整开工,服务器瞬间被冲爆。所以它要求 AI 把时间错开,设成 8 点 57 这种零散分钟——用一份说明书帮机房分担流量,这操作我真是头一回见。

一边在近九千行里穷举所有翻车姿势,一边在三百行里讲完做人道理就放手。前者把 AI 当需要盯着的实习生,后者把 AI 当能自己领会的成年人。
哪个思路对?说实话,我不知道。两家都还没摔跟头,胜负没分。
写在最后
一万五千行读下来,我最大的感触反而跟技术不沾边。
这些说明书里写得最用力、翻来覆去强调的部分,没有一个字在讲"怎么更聪明"。全是:怎么拒绝人才不失礼,怎么哄好情绪崩溃的用户,怎么不伤害一个没露面的人,怎么不替用户做收不回的决定。
本来我以为会读到一堆炫技的机灵招,结果通篇都是防摔跤的谨慎条款。看到没有,厂商之间卷的已经不是谁家 AI 更能干,是谁家 AI 更让人放心。
呃,写到这里发现自己跑题了——本来只想找个选题,结果读了一晚上"AI 行为守则"。不过不亏,至少下回 AI 跟我说话油嘴滑舌时,我知道去哪翻它的底牌。
希望各家的说明书越写越薄。毕竟文件越厚,说明要防的坑越多。

对了,发这篇稿子的时候正好赶上中秋节。一万五千行说明书看完,祝大家中秋快乐,月饼管够,人月两团圆。
