ARTICLE · 1017399
FawnPress v1.6.8:让 PDF 转换对异常字形
FawnPress v1.6.8:让 PDF 转换对异常字形
FawnPress v1.6.8:让 PDF 转换对异常字形
有些 PDF 看着满页字,导出来却全是乱码。更坑的是它没触发 OCR,直接把错字当正文交了差。
这次 v1.6.8 专门治这种“假有效文本”。现在不光看有没有字,还会查异常控制字符。只要发现风险,就单独拉出来转图片识别;正常的页面照样走快速通道,不拖慢速度。
要是连 OCR 都认不出字,它也不会给你留个空白页糊弄。而是老老实实保留原图,并标上提示。要是你压根没开 OCR,它也会直接告诉你哪页有问题、让你重试。
拿一份 245 页的方正排版手册测过,六百多秒吐出十二万字,没一个替换符和空结果。不过复杂公式、合并表格还是容易翻车,正式资料最好人工对一遍。
原文FawnPress v1.6.8:让 PDF 转换对异常字形更有判断力
作者提示: 个人观点,仅供参考
湖北,2小时前,