我老婆问我:"你那堆PDF技术书,到底翻过几本?"
周末她收拾我电脑,看见 D 盘一个叫"技术书"的文件夹,点开密密麻麻三十多个 PDF。
"这些书你都看过吗?"
我:"都存着呢,要用的时候搜一下。"
她:"搜一下?那你上周问 AI 那个支付接口怎么接,你不是把那本 800 多页的《XXX 技术手册》整本丢进对话框了吗?转半天圈,最后 AI 跟你说'上下文超了,读不动'。"
我一时语塞。这事我干过不止一次,明明只想查第三章里面的一个接口,却把整本书喂进去,又贵又慢还读不出来。
先做个 3 条自查,看看你中几条:
① 收藏夹里技术书 PDF ≥ 10 本,真正翻完的 ≤ 1 本 ② 问 AI 时,把整本 PDF 丢进过对话框 ③ 因为"上下文超了读不出来",重开过对话框
三条全中?那你跟我是同类。今天这个 skill 就是专门治这毛病的:book-to-skill。它能把任意一本书、一份文档,变成带目录、能"按章翻"的电子手册 skill。要查哪章,它只把那一章调出来,不会把整本书从头读到尾。
这篇你读完能直接学会三样东西:一个把书变电子手册的 skill、一套零基础 4 步操作法、还有我读源码排排查出来的 6 个坑。
先给一句结论:这 skill 不是帮你"读懂"书,只帮你"找得到"书。所以你那 800 页手册,以后不用再整本塞给 AI 了。
这是我的第 10 篇 skill 分享。关注我,咱们一起,40 岁转行 AI,常分享能直接抄作业的 AI Skill。
一、它到底是什么?
book-to-skill = 把一本书/文档,重排成"带目录、可检索、按需加载"的电子手册 skill。
注意我用的词是"重排"(restructure),不是"总结"。它不替你压缩内容,而是把整本书拆成标准结构:一个 SKILL.md(核心心智模型 + 章节索引)+ 一章一个文件的 chapters/ + 术语表 + 模式清单 + 速查表。以后你问"第三章支付接口怎么接",它只把第三章那一个文件调出来回答,不会调其余的几百页。
GitHub 地址 virgiliojr94/book-to-skill,v1.3.0,MIT 协议,遵循开放的智能体技能(Agent Skills)标准。开源、可搜、可装,Claude Code / Copilot CLI / Amp 都能用。

二、用「带智能书签的电子手册」来理解
我给我老婆打比方,她一下就懂了。
我说:"你想象一本超厚的纸质工具书,比如你妈那本《家常菜大全》。平时你想查'红烧肉怎么炖',是不是得先翻到目录,再翻到对应页?这样太累拉。book-to-skill 干的事,就是给这本书每章贴好智能书签、加上电子目录。以后你说一句'查红烧肉',它直接翻到那一页递你手上,其余九百页都不会看。"
她:"哦,就是不去翻整本书,要哪页翻哪页?"
"对。而且它贴心在,别的工具是把整本书塞进 AI(又贵又容易读不出来),它是书还在架上,只把你要的那一页抽出来读。所以省 token、不爆上下文。"
她:"那它跟前两天你写的仓颉,是一样的功能吗?"
问得好。这正好接上篇。

一句话记牢:仓颉把书榨成'能用的招'(可执行技能卡),book-to-skill 把书做成'能查的手册'(可检索参考)。 上篇仓颉适合"学方法论、要 AI 自己调出对应的技能卡";今天这个适合"我有一本工具书/规范,要随时查、不想每次把整本书都塞进去"。
三、它能帮你省什么?看这几个数据
我特意看了它的文档和性能实测:
| 支持的格式 | ||
| 词元(token)节省 | 24%–51% | |
| 产出结构 | ||
| 协议 / 版本 | ||
| 安全处理 |
除了书,它还能用在任何结构化文档上:内部 ADR、runbook、上手指南、品牌/设计系统文档、论文集群+你的笔记、RFC/API 合同、合规文档。换句话说,就是你团队那堆"写了没人看、要看又找不到"的文档,都能变成随问随查的手册。
四、零基础操作步骤(4 步,每步一句话)
第 1 步:装到技能目录
git clone https://github.com/virgiliojr94/book-to-skill.git ~/.claude/skills/book-to-skill⚠️ WorkBuddy 用户注意:默认路径是
~/.claude/skills/,咱们得手动挪到~/.workbuddy/skills/book-to-skill/才能被调用(这坑前面仓颉、达尔文都提过)。
第 2 步:检查环境(确认 PDF/EPUB 等提取器装齐了没)
python3 scripts/extract.py --check缺哪个格式的工具,它会直接告诉你装什么命令。比如 MOBI 要装 Calibre,PDF 技术类用 docling、文本类用 pdftotext。
第 3 步:指向书,一键转换
/book-to-skill ./我的技术手册.pdf它在后台运行:确定性 Python 提取器(把书变成干净文本+元数据)→ 规范驱动的生成器(按 SKILL.md 重排成结构化 skill)。还支持 analyze-only(只看分析不生成)、update/fold-in(书更新了增量合并)。
第 4 步:用起来,只问章节,不看整本书
用
我的技术手册查一下第三章支付接口怎么用
它只调出第三章那一个文件(约 1000 token)回答你,而不是把 800 页全读一遍。
这 4 步建议你现在就点收藏,下次手边真有本吃灰的手册要查,扫一眼就能照着跑,不用回头重读全文。是不是异曲同工?
五、真实前后对比:同一本书,两种用法
拿那本 800 页的《XXX 技术手册》举例:
一句话:之前是"抱整本书问一句话",之后是"翻到那一页再问"。 对技术文档、规范、论文这种"要查不要背"的东西,这个差别是质的改变。
把上面那张「老办法 vs book-to-skill」的对比表截给你那个也囤了一堆技术书的同事,他一眼就懂你为啥不再整本喂书了。
六、避坑指南(我读源码+文档排的雷)
它不是"提炼方法论"的工具,别用错地方。 你要"把书里的方法论变成能主动能调用的方法",那是上篇仓颉的活。book-to-skill 只做"重排成可检索手册",不抽框架、不出可执行技能卡。想要一句总结?找错人了。
版权红线。 工具本身不携带任何书的内容,产出的是"合成衍生笔记"(不复制原文)。但你只能处理自己合法拥有的副本,而且不能把第三方书的 skill 发出去。团队内部用没问题,往外发别人的书=侵权。
提取依赖得装齐。 PDF 用
docling/pdftotext/pypdf,EPUB 用ebooklib,DOCX 用python-docx,MOBI 必须装 Calibre 的ebook-convert(不是 pip 能装的)。第 2 步的--check就是干这个,先跑。出厂路径坑(WorkBuddy 专属)。 默认
~/.claude/skills/,咱们要挪到~/.workbuddy/skills/。超大书 / 扫描差的 PDF 会有问题。 文档里面说了:章节检测可能有误判,扫描质量差的书提取精度受限。这种先用
--check看提取效果,别指望一次能完美。隐私。 提取是本地跑的、文件不上传;但生成后是 Agent 来读,如果 Agent 模型在云端,文本就走提供商的条款了。所以敏感内部文档心里要有数。
七、写在最后
我们这行有个怪圈:收藏的技术书越多,真去查的越少;每次要查,又习惯性把整本怼给 AI,又贵又爆上下文。
book-to-skill 干的一件事特别务实:它不帮你"读懂"书,它帮你"找得到"书。 仓颉负责把书变成能用的方法,book-to-skill 负责把书变成能查的手册。俩兄弟,一个造术,一个造手册,合起来才叫"把知识真正用起来"。
囤书不如用书。先把手边那本吃灰的技术手册转成 skill,下次要查,翻到那一页就行。
顺手问一句:你收藏夹里现在躺了几本压根没翻的技术书?评论区报个数,我挨个回,顺便帮你挑一本最适合的先转成 skill 的手册。
关注我,咱们一起,40 岁转行 AI,常分享能直接抄作业的 AI Skill。
码到成功
夜雨聆风