如果你第一次读到这个号,可以这么认识我们:YouCore不做知识付费,只做能力升级。
办公文档要喂给 AI、要整理进笔记库,最劝退的是转换这一步。
Word、PPT、Excel、PDF,格式五花八门。现有工具要么装起来重、要么转得慢,在线工具还得把文件传到别人服务器上,心里总不踏实。
anydoc 是 Firecrawl 开发的开源文档转 Markdown 工具,Rust 编写,专为 LLM 和 AI Agent 场景设计。
本地运行、无需 API key、中位转换时间不到 5 毫秒,一行命令把 Word、PPT、Excel、PDF 统一转成「结构化 Markdown」。

01
安装方法
anydoc 提供四种接入方式:CLI、Python、MCP、Rust。日常用前两种就够,分三步讲清楚。
第一步、CLI 一行命令
装好 Node.js 20+ 之后,一条 npx 命令就能转:
转换结果直接输出 Markdown,配合重定向就能存成文件。换 PPT、Excel、PDF,命令一字不改。

第二步、Python 批量处理
单份用 CLI,批量就交给 Python:
两行代码,转完直接拿 Markdown 继续处理。
第三步、接入 MCP
anydoc 还提供一个本地 MCP Server,配进 Claude Code、Cursor 这类编码 Agent 就能调用。
02
核心场景
装好只是开始,真正值钱的是日常使用。四个场景覆盖最常用的需求。
场景一、把 Word/PPT/PDF 批量喂给 Claude 整理
30 份文档要统一交给 Claude 总结,逐份手动转再拖进对话框,是体力活。anydoc 转成 Markdown 后,Claude 直接读懂结构:
转完拼一起丢给 Claude,批量总结、提取要点都行。anydoc 的「统一输出」,让标题、表格、列表、引用块的 Markdown 行为一致,AI 不会因为格式差异理解错。
官方基准测试更能说明问题:100 份真实文档、14 种格式,anydoc 全部支持、综合 81 分,明显优于 LibreOffice(39 分、单份转 1 秒多)和 pandoc(56 分)。
场景二、文档转 Markdown 进笔记库
一份行业报告或培训 PPT 想存进 Obsidian。直接拖 PDF 进去没法检索、没法双链,转成 Markdown 才能拆卡、链接、全文检索。
转完的 Markdown 直接落在笔记库里,图片渲染成 alt 文本,上下文保留,正文结构一目了然。
场景三、MCP 让 AI 直接读办公文件
配好 MCP 之后,直接在 Claude Code 里说一句,AI 自己调 anydoc 读取文件:
请读取 docs 目录下的项目计划书.docx,提炼三个关键风险点。
不需要你手动转换,不需要先导出。
让 AI 直接读办公文件,转换成本从流程里消失了。
场景四、把旧报告批量转存
硬盘里躺着几百份历史文档,扩展名乱成一团:.doc 被改过名,RTF 和 PDF 混在一起。多数转换工具看扩展名办事,碰到这种就抓瞎。
anydoc 靠「内容识别格式」处理:按文件字节内容判断类型,PDF 头、RTF 开头标记、OLE 流名、ZIP 包 mimetype,扩展名错了一样能正确转换。转换失败抛类型化异常,比如 EncryptedError,统一捕获 ConvertError 就能跳过坏文件,一次跑完。
一点提醒:扫描版 PDF 本质是图片,需要先 OCR;加密文件会直接报错。

03
小结
anydoc 解决的,不是“怎么转一个文件”,而是“怎么把办公文档批量、稳定地变成 AI 和笔记库能直接用的 Markdown”。
anydoc 本地运行、无需 API key、快得几乎无感,按文件内容识别格式,把 Word、PPT、Excel、PDF 统一转成干净的结构化 Markdown。
文档转换这一步,从此不再是问题。
夜雨聆风