写在开头
大家好,我是kele。
事情是这样的。
前阵子做 ToB 项目,我们当乙方给甲方做系统交付,甲方扔过来 70 多个 PDF,说这些是他们的存量数据,要求全部录进新系统里。每个 PDF 里都有两三张表格,一共两百多张表,几千行数据。
我第一反应是,PDF 是导出来的吧,那原始数据应该有个 Excel 或者数据库文件,直接给我源文件不就行了。
我问了一嘴,甲方说,没了。
就这两个字。
源文件没了,只剩下这些导出来的 PDF。数据在 PDF 里是图片,不是文本,你想复制都复制不了。也就是说,这 70 多个 PDF 是这批存量数据的唯一存在形式。
我当时的表情,怎么说呢,就是那种你明明觉得不对劲,但说不出哪里不对劲的感觉。
这种活做过 ToB 的都懂,跑不掉的。甲方上系统,旧数据必须搬过来,这是明牌的工作量。不是会不会做的问题,是躲不掉。
其实数据本身不难处理。数据库导入那一步最简单,写个脚本批量执行就行。真正的噩梦在前面,把 PDF 里的数据弄出来。
PDF 里的表格不是能直接复制的文本,是图片。你得看着屏幕,一个格子一个格子地敲进 Excel。70 多个 PDF,两百多张表,几千行数据,全手工敲的话,我估计得干一个礼拜。
而且这种活特别磨人。不是不会做,是重复到极致。敲到第三天,你会开始怀疑人生,怀疑自己为什么要做这份工作。
我试了几种方案,最后找到一条性价比最高的路。今天把整个过程写下来,包括我踩过的坑,给同样要处理存量数据的乙方朋友一个参考。
我的工作场景
假设现在一个 PDF 里混着段落文字和两张表格,第一张表格有学生信息和语文成绩

第二张表格有学生信息和数学成绩,很多表格都会跨页

这些数据都是网上公开的,可以上传,我的任务就是把学生的数学成绩和语文成绩合并到一起。
一、第一条路,截图扔给豆包
最开始我想得很简单。现在的 AI 不是都能看图吗,我把表格截图扔给它,让它直接解析成表格文件不就行了。
豆包网页版,确实能干这个。你上传一张表格截图,告诉它,帮我转成 xlsx,它会直接生成一个 Excel 文件给你下载。表格结构、数据内容,识别得都挺准。
当时我心里那个爽啊,这速度,一天就能干完。

然后问题来了。
生成 xlsx 属于豆包的高级功能,免费额度很快就用完了。两百多张表,一张一张喂,额度哗啦啦地掉。

还没到一半,系统就开始提示,让我充会员才能继续用。
也不是不能充,但总觉得为了这么个一次性任务充会员,有点冤。
于是我开始找替代方案。
二、放弃高级功能,只生成文本
当时突然反应过来,这种简单的文本识别,其实不需要生成 xlsx 这样的高级功能,让它输出文本,我自己复制粘贴也可以呀。
当时我手头正好在用一个模型,DeepSeek-V4-Flash。它的网页版也是免费的,虽然是文本模型,但也有 OCR 识图能力。

我截了一张表格图扔过去,提示词跟豆包一样,让它把表格解析出来。
结果它给了我一个惊喜,也给了我一个意外。
惊喜是,它真的能把图片里的表格数据完整识别出来,一行一列都不差。意外是,它不能生成 xlsx 文件,只能输出纯文本格式的表格。
就是这种。

当时我愣了一下,这个格式,好像也够用啊。
我把这段文本复制下来,因为是制表符分隔,直接粘贴到 Excel 里就可以了。整个过程不到一分钟。

只要它能给你一份准确的文本表格,剩下的活 Excel 自己就能干。
三、完整流程,给你抄作业
把整个流程串起来,其实是这样的。
第一步,截图。打开 PDF,把表格区域截下来。这里有个关键点,如果表格跨页了,别截一半,用微信截图的滚动截屏功能,把整张表完整截下来。AI 看到完整的表格,识别准确率会高很多。
第二步,喂给 DeepSeek。网页版直接上传图片,提示词就一句话。
请把图片中的表格完整提取出来,数据使用制表符分隔,我需要粘贴到 xlsx 中。第三步,复制文本。AI 输出的表格文本,全选复制。
第四步,粘贴进 Excel。新建一个 xlsx,把文本粘贴进去。
第五步,合并入库。所有 PDF 处理完,把多个 Excel 合并成一张总表,写个脚本批量导入数据库,完事。
整个流程走下来,处理一个 PDF 平均也就几分钟,主要是截图和粘贴的时间。AI 识别本身几乎不花时间。
四、几个注意事项
这套流程跑下来,有几个坑值得说一下。
第一,跨页表格一定要用滚动截图。截半张表喂给 AI,它识别出来也是半张,还得你手动补,反而更麻烦。我用的是微信的截屏。
第二,别让 AI 生成文件,让它输出文本。文本格式粘贴进 Excel 分列,速度并不比直接下载文件慢。对一次性任务来说,免费的方案才是最优解。
第三,识别完要抽查。AI 不是百分百准确,数字密集的表格偶尔会识别错。我的做法是每处理完一个 PDF,随机抽两三行跟原图对一下。发现错了就单独重截重喂,不用整张重来。
第四,提示词越简单越好。就一句话,让它完整提取,不要遗漏。不用描述格式,不用解释背景,AI 对这种指令的理解已经非常成熟了。复杂提示词反而容易让它自由发挥。
写在结尾
其实这个思路可以推广到很多场景。只要是图片里的结构化数据,不管是表格、票据、还是截图,都可以用同样的流程,截图,扔给 AI,拿文本,粘贴整理。AI 不一定要生成最终成品,只要能准确提取内容就行,无非就是需要自己手动复制粘贴。
以上,既然看到这里了,如果觉得不错,随手点个赞、转发给你周围的朋友,你的支持就是我更新的动力~
谢谢你看我的文章,我们,下次再见。
夜雨聆风