乐于分享
好东西不私藏

别打印PDF真题了!我把它变成了“刷题网页”

别打印PDF真题了!我把它变成了“刷题网页”

不知道你手里有没有这种资料:各种考试的 PDF 真题、扫描件。说它是电子资料吧,用起来又极其原始:只能一页页死板地翻,想搜个关键词经常失灵;更别提什么随机练习、错题记录了。偶尔发现个错别字,想改都无从下手。

很多人遇到这种情况,第一反应是“怎么把 PDF 复制到 Word 里”。

但我今天想分享一个更简单、也更爽的思路:不用做表格,不用写代码。直接用 OCR 把扫描件剥离成 Markdown,塞进 JSON,最后让 AI Agent 帮你手搓一个纯前端的刷题网页。

只要题目能变成规范的 JSON 数据,一个普通的 HTML 网页就能让你随时随地刷题。


零门槛,工具我已经开源了

为了方便大家抄作业,我把之前自己用的本地 OCR 工具做了一个“安全去隐私版”,直接开源了。大家可以放心自取。

👉 开源仓库地址:https://github.com/RZ-user/doc-scan-ocr-skill

里面还附带了一个合成样例,哪怕不看代码,点开也能看明白这套流程是怎么跑通的。


避坑指南:OCR 到底该选谁?

这一步是地基。如果第一步文字识别就一团糟,后面用 AI 网页刷题就是空中楼阁。

试了一圈,我最建议大家优先看PaddleOCR(https://aistudio.baidu.com/paddleocr),这也是我目前在用的方案:

  • 强在哪里
    :它不是硬生生把字抠出来,而是会尽力保留“文档结构”(比如标题级别、表格行列、图片位置),对识别复杂的试卷格式非常友好。
  • 怎么用
    :方法很简单,先注册或者登录百度账号,点击右上方的“API”,再点击“获取令牌”把 Token 拿到手。免费用户每天的额度足够完成我们的需求了。它本身是个异步接口,不过别担心,后面高能的来了——我们不需要自己去写代码调用它。

💡 避坑铁律:千万不要在 OCR 质量很差的前提下硬做题库,后面所有的自动化脚本都会被错别字和乱码折磨疯。


实操三步走:真题变网页
1
第一步:让 AI 配置工具,扫描 PDF 吐出 Markdown

这一步完全不需要我们自己苦哈哈地折腾环境和代码。我们可以直接使用workBuddy—— 这是一款对国内用户极其友好的 AI 智能体,用大白话交流就行。你只需要把刚才获取到的百度 API 令牌发给它,告诉它这是一个可以识别 PDF 的工具,让它帮你搞定自动化配置。

💡开挂小技巧:这时候如果把我开源的这个 skill(工具骨架)同步提供给它,work Buddy 就能直接抄作业,配置起来会更顺手、更好用!

配置完成后,AI 就会自动调用 OCR 识别,帮我们把死板的扫描件变成有结构的 Markdown 文本。理想情况下,吐出来的格式就像这样爽快:

1. 哪一项最适合作为题库 JSON 的唯一标识? A. 页面颜色 B. 稳定题目 ID C. 题目前的空格数量 D. 浏览器窗口宽度  答案:B 解析:题库需要稳定 ID 来保存作答记录和后续修订。
2
第二步:让 AI 把 Markdown 规范成题库 JSON

网页要想实现交互(比如自动判断对错、点击显示解析),必须把文本拆解成结构化的数据(JSON)。

以前这种转换得自己写脚本,现在直接跟work Buddy下指令,让 AI 把第一步生成的 Markdown 直接整理成规范的 JSON 格式。一条合格的题目数据,长这样:

{   "id": "q0001",   "type": "single",   "stem": "哪一项最适合作为题库 JSON 的唯一标识?",   "options": [     { "id": "A", "text": "页面颜色" },     { "id": "B", "text": "稳定题目 ID" }   ],   "answer": ["B"],   "explanation": "题库需要稳定 ID 来保存作答记录和后续修订。",   "source": {     "file": "sample_scan_page1.md",     "line": 3,     "originalNumber": "1"   } }

把题干、选项、正确答案、解析彻底拆开后,接下来就是见证奇迹的最后一步。

3
第三步:依据 JSON 数据,打造纯前端刷题网页

有了规范的 JSON 数据,你就拿到了全场的主动权。我们不需要懂任何前端代码。

直接让work Buddy依据这份 JSON 数据,为你量身定制一个刷题的纯前端网页:

“帮我写一个纯前端的刷题网页。不用后端,不用联网,直接双击打开 index.html 就能用。要求适配手机和电脑,能读取刚才的 JSON 题库,支持单选多选,提交后能显示对错和解析。”

只要几秒钟,AI 就能帮你吐出index.htmlapp.jsstyles.css网页三件套。我在开源仓库里其实也内置了一套写好的示例,双击 HTML 就能直接开始在手机、电脑上刷题,极其丝滑。


这套流程,适合所有人吗?

🟢 它非常适合:

  • 手里有大量小众、内部的 PDF 扫描真题或培训资料。
  • 想快速验证“做个刷题网页到底好不好用”,不想一上来就花钱买服务器、搭数据库。
  • 希望资料是“活的”,后续能持续修错、迭代。

🔴 但如果遇到这些情况,劝退:

  • 原始扫描件糊成一片,OCR 识别出来全是错别字。
  • 试题本身没有附带答案和解析。
  • 包含大量复杂的化学方程式、几何图形,需要人工介入疯狂肉眼校对。

写在最后:别迷信“全自动化”

“OCR + AI”并不是万能的。

实际情况也可能到处都是坑。

OCR 会漏字,题号会错位,选项可能和题干粘在一起。这套流程最迷人的地方,不是“全自动黑盒”,而是“分阶段可控”

因为分成了清爽的几步,哪一步出了错(是 OCR 没认出来,还是脚本没切对,或者是前端没显示好),你一目了然,修起来极快。

这也是我最近维护个人复习网站(https://muristudy.top)的心得:做网站、做内容,核心不是“发一次资料就完事了”,而是搭一套能持续维护、持续纠错的工具流。

但是如果还想要为网站增加其他的功能以及部署上线的话,还需要更加深入才行。

如果你手里也有积灰的真题 PDF,不妨先挑个 3、5 页,按照我开源仓库的思路让 AI 帮你跑个“小闭环”试试。当看到密密麻麻的 PDF 变成手机上可以点选的刷题页时,那种成就感,真的会上瘾。

🧐 聊聊吧

你手里有什么格式奇葩、极难整理的考试资料吗?你是怎么对付它们的?欢迎在评论区聊聊!