乐于分享
好东西不私藏

Claude 废话太多?三款去 AI 味工具横评

Claude 废话太多?三款去 AI 味工具横评

用 Claude Code 写代码,最大的痛苦不是它写不好,是它太能说了。"Here's the kicker""load-bearing"……每轮输出动辄上千 token 的解释和过渡,你只想看代码,它偏要给你讲故事。

这个痛点催生了一波"去 AI 味"工具。今天横评三款思路截然不同的方案:Caveman(prompt 层压缩)、NoBuzz(外部 LLM 改写)、Vomit(后处理裁剪),帮你选最合适的那一个。

Caveman:让 AI 像穴居人一样说话

一句话定位:在 prompt 里强制 AI 只说极简语言,省 token 为主、去味为辅。

怎么装(需 Node.js v18+):

# 输入端代理(压缩请求体)
npm install -g caveman-engine
caveman-engine start

# 输出端 skill(强制极简回复)
npx caveman-skill install --agent claude-code

核心机制:两层压缩。skill 在 CLAUDE.md 里写规则让 Claude 只保留代码和命令;代理拦截 API 请求按类型(JSON/代码/日志)压缩负载再转发。两轴可叠加。

实测数据:54 轮 Claude Code 基准,输出 token 从 1214→294(省 65%),输入减 33.2%。

:(1) skill 自身每轮增加 1–1.5k input token,简单任务可能负收益;(2) 引擎部分 BSL-1.1 许可,商业托管需授权;(3) prompt 规则随上下文增长会被 Claude "遗忘",HN 用户评价为"给猪涂口红"。

NoBuzz(Claudette):借 Gemini 做确定性改写

一句话定位:把 Claude 输出扔给 Gemini 重写,彻底杜绝 Claude 再掺私货。

怎么装

# 前置依赖
# 1. Claude Code
# 2. agy CLI(Google Antigravity CLI)+ Google 账号认证
git clone https://github.com/adnanakil/nobuzz.git
cp -r nobuzz/skills ~/.claude/skills/

核心机制:Claude 回复写临时文件 → 调 agy → Gemini 重写 → 逐字输出。三档模式:colleague(保留代码去废话)、manager(1/3 篇幅无代码)、director(3–5 句只讲结果)。

优势:不改 Claude 的 system prompt,而是用外部 LLM 做确定性改写——不依赖 Claude 自律,比纯 prompt 方案可靠。

:(1) 双倍 token 消耗——每轮 Claude 输出 + Gemini 改写,成本翻倍;(2) 依赖 Google 账号 + agy CLI,比 Caveman 多一层外部依赖;(3) Gemini 改写失败时 fallback 让 Claude 自己改写,此时标注 fallback 但效果打折。

Vomit:后处理裁剪冗余

一句话定位:Claude 输出完之后,用另一个 LLM 裁掉废话——"吐完再擦嘴"。

怎么装

# Claude Code skill 方式
# 详见 https://github.com/zachahn/vomit

核心机制:Claude 正常输出 → Vomit 拦截 → 用独立 LLM 去掉冗余解释和过渡 → 输出精简版。与 NoBuzz 的区别是:NoBuzz 在 Claude 输出过程中就改写,Vomit 是 Claude 输出完毕后再裁剪。

优势:不影响 Claude 的推理过程,完整输出先产出再精简,不会丢失 Claude 的思考链。

:(1) 同样双倍 token——原始输出 + 裁剪输出;(2) 裁剪粒度不好控制,过度裁剪会丢有价值的信息;(3) HN 讨论中关注度低于 Caveman 和 NoBuzz,社区验证不够充分。

三款对比

Caveman
NoBuzz
Vomit
思路
prompt 层压缩
外部 LLM 实时改写
后处理裁剪
额外 token
约 1–1.5k/轮(skill 开销)
约 2x(Claude + Gemini)
约 2x(原始 + 裁剪)
可靠性
中(prompt 会被遗忘)
高(外部 LLM 确定性改写)
中(裁剪粒度不确定)
上手难度
低(npm 一行)
中(需 agy + Google 认证)
中(需配置独立 LLM)
适合场景
长对话省 token
坚决去废话不管成本
想保留完整输出再精简

编辑部推荐

只想省 token、不想多花钱→ Caveman。长对话场景效果明显,简单任务可以不开 skill。

宁可花双倍也要彻底去味→ NoBuzz。外部 LLM 改写比 prompt 规则靠谱,但月账单要翻倍。

先看完整输出再精简→ Vomit。适合需要 Claude 思考链的场景,但要接受裁剪可能过度。

什么人都不用→ 如果你每天只跟 Claude 聊 5–10 轮、任务简单明确,这三款都不值得装。开个新会话、缩短上下文、自己写一句 system prompt 限制输出格式,效果不比它们差。


💬 你被 Claude 的废话折磨过吗?评论区聊聊你用什么方法对付 AI 冗长输出:

如果这篇对你有用,点个「在看」👀,把它推给更多人。 第一时间收到新工具情报 → 关注并「设为星标 ⭐」。

参考链接

  • Caveman GitHub:https://github.com/JuliusBrussee/caveman
  • NoBuzz(Claudette)GitHub:https://github.com/adnanakil/nobuzz/blob/main/README.md
  • NoBuzz HN 讨论(240 分 / 167 评论):https://news.ycombinator.com/item?id=49388752
  • Vomit GitHub:https://github.com/zachahn/vomit