豆包工作|实测:184页扫描PDF转Excel豆包工
豆包工作实测:184页扫描PDF转Excel,能扛下这脏活。
作者拿了个114兆的工程账单做测试。纯图片的扫描件没法直接提取文字。豆包没硬扛,而是自己换了OCR方案。
先拆块,再试跑:怕内存爆掉,它把184页拆成19份。先拿前两页试水,确认识别准了才批量跑。
按位置切列:它靠文字坐标把数据分到7列。顺手还修好了金额里的多余空格。最后把19个表拼成一个,顺带做了笔数、金额等统计。
不过这活也有坑:扫描质量决定准确率上限。不同表格得重新调列坐标,而且跑得挺慢,适合挂机。
说白了,AI不是来替你拍板的,是帮你把机械劳动干完。
其它金额
赞赏金额
¥
最低赞赏 ¥0
1
2
3
4
5
6
7
8
9
0
.
原文豆包工作|实测:184页扫描PDF转Excel豆包工作全程实测记录
福建,40分钟前,
夜雨聆风