ARTICLE · 1017761
神器推荐:逐页喂 PDF、生成可追溯知识库
神器推荐:逐页喂 PDF、生成可追溯知识库
神器推荐:逐页喂 PDF、生成可追溯知识库
书架上的硬核大部头,买来就没读完过。你可能花了一周啃完 500 页,真正记住的不到 5%。
最近 GitHub 上火了个开源工具,专门治这毛病。它不搞整本书一把抓,而是让 AI 逐页拆解 PDF。遇到目录、空白页自动跳过,把知识点一页页攒进 JSON 知识库。
最实用的是双模型分工:抽知识点用便宜模型省成本,最后生成摘要再换强模型保质量。每处理 10 页就出一次阶段性总结,还能随时暂停续跑。不过它得调用 API,没 Key 又怕花钱的就算了。
要是你书架上正躺着一本“买来吃灰”的大部头,不如克隆下来先用前 5 页测个速。毕竟,你不再需要假装自己会读完整本书。
原文逐页喂 PDF、生成可追溯知识库:这款 PDF 阅读神器 GitHub 爆火
收录于开源
作者提示: 个人观点,仅供参考
广东,28分钟前,