你有没有干过这种事,把一本几百页的 PDF 直接丢给 AI,让它读、让它总结?
等它慢慢啃,token 肉眼可见地烧。文件一大,AI 还"顾头不顾尾",读一半就忘了前面。
我以前更土,用 Calibre 把书转成 txt。能转,但是转完更难受,没目录,每行后面还空一行,想跳个章节得滚半天。一本 13MB 的技术书,转出来 1135KB 的 txt,排版稀烂。
直到我试了 Firecrawl 开源的 anydoc。它干的事很简单,把 PDF、Word、PPT 这些文档转成干净的 Markdown,喂给 AI 刚刚好。我直接把它装成了 Agent Skill,在 Codex 里说一声就能用。
实测结果先放这儿。一本13MB的技术书,转成带完整目录的 Markdown,体感上几秒就出结果,转换环节一个 token 都没花。就问你,爽不爽。
01这个项目是啥
anydoc 是 Firecrawl 开源的文档转换工具,用 Rust 写的,官方直接打包成了 Agent Skill。装一个,Codex、Claude Code 这类 AI 编程工具就能自己读文档。Word、PowerPoint、Excel、OpenDocument、RTF、EPUB、CSV、PDF,8 类格式,统一转成干净的 GitHub Flavored Markdown。

你可以把它理解为"格式搬家工",不管丢进来的是老掉牙的 .doc,还是刚导出的 .pptx,还是那搞得的PDF格式,出来的都是同一套规整 Markdown,标题、表格、脚注、引用全给你保住。
这项目开源不到两天,就斩获 2700+ Star,还是 MIT 协议,代码随便用。这热度,说明踩坑的人比我们想象的多。
02效果怎么样?我拿一本 13MB 的开源电子书试了下
话不多说,直接开转。
我找了一本《深入理解 AI Agent:设计原理与工程实践》PDF格式的开源电子书,13MB多,在 Codex 里直接说"把这本书转成 Markdown",它自己就开始转换了。
1.3秒就出结果,看到输出我愣了一下,1.1MB、约 8200 行的 Markdown,带完整目录和脚注,直接能用。
带着完整目录的 Markdown,丢进 Obsidian、Trae 或者公众号排版工具里都能直接用。
顺手和 Calibre 对比了一下。同一本书,Calibre 只能转 txt,1135KB,没目录、每行空一行、排版混乱。
anydoc 转出来 1111KB 的 MD,还自带目录结构,排版也更干净。一个是毛坯房,一个是精装修,占用空间还小,谁更适合直接喂给 AI,不用我多说了吧。
03我的感受
安装那一步我是真没想到。我走的是 Agent Skill 路线,一条命令装完,Windows + Node 25,连 Rust 都没装,照样跑通。第一次运行自动把转换程序下载到本地,之后再转,体感上也就几秒。
转换全程在本地跑,不经 AI,不烧 token。说白了,它只负责把文档"拆"成文本,真正吃一点 token 的是调用这个 skill 的过程。我用 DeepSeek V4-flash 模型跑完,总共花费不到一毛钱。
不到一毛钱,买包辣条都不够。
花小钱办大事,说的就是它。
官方 Benchmark 也摆在这。100 份真实文档、14 种细分格式全覆盖,中位转换时间 4.7 毫秒,质量分 80。这不是我吹的,是项目自己测的。
04怎么装?两条命令直接抄
如果你用的是 Codex、Claude Code 这类 AI 编程工具,最省事的是装成 Agent Skill。
npx skills add firecrawl/anydoc装完之后,你直接跟 AI 说"使用/convert-documents-to-markdown,把这份 PDF 转成 Markdown",它就会自己调用。对我们这种天天用 AI 写代码的人来说,这个形态最顺手,不用记命令,文档丢过去说一声就行。
只想自己转也行,一条命令就够。
npx -y @firecrawl/anydoc 你的文件.pdf -o 输出.md唯一的门槛,需要 Node 20 以上,第一次跑得联网下载转换程序。不需要懂 Rust,也不需要手动编译。
05它也有搞不定的地方
扫描件、图片型 PDF,它本地不转,也不带 OCR,这种得走官方托管 API。PDF 必须是文本版的。提前说清楚,免得你装完骂我。
另外,文档里的嵌入图片不会直接进 Markdown,会变成 alt 文本;CSV 靠扩展名就能识别,只有管道输入或扩展名对不上的情况,才需要显式加 --format csv。
06适不适合你,你自己决定
回头回答开头的问题。给 AI 喂大 PDF,anydoc 这条路确实压平了。一行命令、本地转换、结构完整、成本不到一毛钱。
实话实说,它也有搞不定的地方。扫描件本地不转,这个要另想办法。
经常给 AI 喂文档的人、总结书中精华内容的、手上一堆格式混杂的文档要统一处理的人,直接抄上面的命令就完事了。
主要靠扫描件 PDF 的人先别指望它;完全离线、连 Node 都没有的环境,也用不上。
剩下的,装一个自己试,比我说一百句都强。
开源地址:https://github.com/firecrawl/anydoc07点击下方卡片,关注GitHub优选
这个公众号历史发布过很多有趣的开源项目,如果你懒得翻文章一个个找,你直接关注微信公众号:GitHub优选,后台对话聊天就行了:
夜雨聆风