用 AI 用久了,你可能有过这种感觉:钱包在悄悄流血,但你说不清钱到底花哪了。你以为自己"问一句、花一句钱",其实完全不是这么回事
最近我盯上了一个火遍全网的开源项目,摸到了一个特别实在的省钱思路,同一件事,换个方式让 AI 干,能省下八成的钱
一个人把自己的"AI 使用秘籍"公开,一周涨了 8 万 Star
先说这个项目。作者叫Matt Pocock,在程序员圈里挺有名——TypeScript 领域的顶级教育者,YouTube 十几万订阅,大家管他叫"TypeScript 布道者"
2026 年 4 月底,他干了件事:把自己电脑里那个平时指挥 AI 干活的私人配置文件夹,原封不动推上了 GitHub,标题就一句话——"给真正工程师的技能,直接来自我的.claude 目录。"
没有博客、没有视频、没有宣传。就这么一推。结果 24 小时涨了 2.2 万颗 Star,几天后冲上 GitHub 全球热榜,现在8 万多颗 Star
为什么这么多人追?因为它戳中了所有人用 AI 的同一个痛点
它想解决的,是"AI 太能干、但太不守规矩"
Matt 在项目里说了句被反复引用的话,特别到位:
"我不是让 AI 更聪明,我是让它更守规矩。"
他把大家用 AI 写东西时最常见的翻车,总结成四种:
你想的和它做的对不上——你心里一个设计,它心里另一个设计,两边都以为在说同一件事,等结果出来才发现南辕北辙
它太啰嗦、还老要你重复解释——每开一个新对话,你都得把"我这项目里 XX 是什么意思"重讲一遍,又费钱又容易前后不一致
没有检查环节,全靠感觉——它以为做好了,你也以为做好了,用起来才发现是错的
摊子会慢慢烂掉——AI 生成代码飞快,欠的债也积得飞快,回头看已经乱成一团
他的解法,是把一套"工程规矩"打包成十几个 skill——skill 说白了在这里就是一段段提前写好、质量很高的提示词,你喊一声口令它就照着执行。比如"先写测试再写代码"的、"先把需求问清楚再动手"的、"排查 bug 走六步"的……核心就一个思路:别让 AI 撒开了随便跑,先给它立好规矩
其中一个命令,专门用来"省钱"
在他这套工具里,有一个特别对普通人胃口的,外号叫"穴居人模式"
它干的事,一句话说清:逼 AI 像原始人一样说话——别客套、别铺垫、别长篇大论,只给我要的干货
你平时让 AI 干活,它回你的话里一大半是废话:"好的!我很乐意帮您""让我们先来分析一下""首先……其次……综上所述"。这些客套和铺垫,你全都在按字掏钱
开了这个模式之后,它就变成这样——
普通模式:"好的!我很乐意帮您。您遇到的这个问题,很可能是由于……"
穴居人模式:"鉴权中间件有 bug。token 过期检查用错了。改这里。"
同一个意思,字数砍掉一大半。据项目介绍,光这一招能把消耗省下约 75%。而且它够聪明——遇到安全警告、不可逆的危险操作时会自动恢复正常、把话说清楚,不会为了省字把该提醒的省掉
前面说了,skill 本质就是一段提前写好的提示词。所以如果你想以最简单的方式来测一下,完全可以用这种最土的办法:开口前直接跟 AI 强调一句——"接下来只给结论和干货,别客套、别铺垫、别长篇大论。"大神只是把这句话打磨得更精细、还存成了能一键调的文件,效果上是一回事
我就用这个办法,动手测了一下到底能省多少
我做了个小实验,数据挺吓人
先补一个很多人不知道的常识,用个比方你就懂了:
用 AI 聊天,不像打电话按分钟,更像打车按里程
AI 没有记性。你每问一句新的,它为了接着上文回答,得把你们之前聊过的所有话、你贴给它的所有资料,全部重新拉着跑一遍。所以聊得越久、贴的东西越多,你每问一句,那趟"车"要拉的行李就越重,单价越贵。真正烧钱的,往往不是你的问题本身,而是那些被一遍遍重复运输的东西
我拿真实的 AI 接口跑了两组对比,就测这两个点:
第一组:让它别废话,能省多少?
我让 AI 写同一个小函数(判断某年是不是闰年):
放任它自由发挥:它回了一大段,又是代码又是讲解又是举例,一共 216 个 token
我加一句"只给最终代码,一个字解释都别要":它老老实实只给了代码,37 个 token
同一件事,就因为让它闭嘴少说废话,省了约 83%——和"穴居人模式"想干的是一回事
第二组:反复贴同一份资料,有多烧钱?
我准备了一份挺长的"规则文档",然后问它 5 个问题:
每问一个问题,都把整份文档重新贴一遍(很多人真是这么用的):5 个问题总共烧了 14,911 个 token
把 5 个问题攒到一起、文档只贴一遍问完:只花了 2,195 个 token
同样 5 个问题、同一份文档,就因为没让它反复运输那份文档,省了约 85%
普通人今天就能用的 4 个省钱动作
不用装任何工具,记住下面几条就行:
一、让它别啰嗦。提问时直接加一句"只给结论/只给代码,别解释、别客套"。真要解释时再单独问。这就是"穴居人模式"的平民版,输出的钱能砍一大半
二、别在一个超长对话里没完没了。聊得越久,它每次要拉着跑的历史越多、越贵。一个话题结束了就开个新对话,别让一堆旧废话一直跟着你花钱
三、别为每个小问题都重贴一遍大资料。有好几个问题要问同一份材料,就攒到一起一次问完,别一条一条来、每条都把材料重贴一遍
四、大材料只喂用得上的那部分。别习惯性把整个文件、整段记录全塞进去——它只需要相关的那一小块,剩下的都是你在白掏运费
说到底
省 token 这件事,本质不是抠门,是别让 AI 反复去干那些它根本不需要重复干的活
这跟 Matt 那句"别让 AI 更聪明,让它更守规矩"是一个道理——你把规矩定清楚,它就不瞎跑、不啰嗦、不重复劳动,活照样干好,钱还省下来了
不用把那套工具装起来,记住上面几个动作,今天就能少烧点钱
最后,顺便给我自己做的网站打个广告
我最近一直在用 AI 手搓产品,也把自己平时调用模型的需求做成了 LetAiCode。目前支持 Codex、Claude Code、Gemini 这些主流模型,我自己每天也在用
现在整体延迟比较低,稳定性也还不错,价格我也尽量做得实惠一些。毕竟网站就是我自己在做,大家真遇到问题也不用到处找人,有客服、有交流群,实在不行还能直接来找我,不至于对着一个报错干瞪眼
如果你平时也有大模型调用或者 AI 编程方面的需求,欢迎来支持一下我自己做的产品:
👉https://letaicode.cn/homepage
夜雨聆风