夜雨聆风学习资料网

ARTICLE · 1017399

FawnPress v1.6.8:让 PDF 转换对异常字形

FawnPress v1.6.8:让 PDF 转换对异常字形

FawnPress v1.6.8:让 PDF 转换对异常字形

有些 PDF 看着满页字,导出来却全是乱码。更坑的是它没触发 OCR,直接把错字当正文交了差。

这次 v1.6.8 专门治这种“假有效文本”。现在不光看有没有字,还会查异常控制字符。只要发现风险,就单独拉出来转图片识别;正常的页面照样走快速通道,不拖慢速度。

要是连 OCR 都认不出字,它也不会给你留个空白页糊弄。而是老老实实保留原图,并标上提示。要是你压根没开 OCR,它也会直接告诉你哪页有问题、让你重试。

拿一份 245 页的方正排版手册测过,六百多秒吐出十二万字,没一个替换符和空结果。不过复杂公式、合并表格还是容易翻车,正式资料最好人工对一遍。

原文FawnPress v1.6.8:让 PDF 转换对异常字形更有判断力
作者提示: 个人观点,仅供参考
湖北,2小时前,

相关学习资料

返回首页浏览学习资料