客户甩来一张报价截图,让你整理成表格。财务转来扫描版合同,让你把条款抄进模板。
你打开输入法,一个字一个字敲,敲完还得回头核对错别字。
这活儿其实早就不用人干了。手机和电脑里"看图取字"的工具已经很成熟,中文识别准确率普遍在 95% 以上,表格、票据、手写体都能啃下来。今天按三类高频场景,把真正好用的挑出来说。
一、截图和拍照里的字,三秒就能取出来
最容易被忽略的,恰恰是你天天在用的软件。
微信聊天里长按图片,选"提取文字",识别结果可以直接复制、转发、翻译。QQ 也有一样的功能,按住图片就出来。开会时同事发来一张 PPT 拍照,不用再问他要原文件,长按取字就行。

想更专业一点,用白描。它手机端、电脑端、小程序都有,支持简体繁体、英文日语等十几种语言,竖排和手写字也认得。电脑端最实用的是截屏识别:框选屏幕上任意一块区域,文字直接进剪贴板。网页上禁止复制的内容、视频里一闪而过的字幕,都能这么拿下来。
如果不想联网,Windows 上装个 Umi-OCR,完全本地运行,免费开源,处理带敏感信息的截图更放心。截屏识别、批量识别、公式识别都齐,配合 Snipaste 一起用,效率还能再往上提一档。
有个小习惯值得养成:识别完先扫一眼数字和人名,这两处最容易出错,金额少个零就麻烦了。
二、表格和票据,别再一格一格往里录
纯文字好办,真正磨人的是表格。

白描里有个表格识别,拍一张纸质表格或者截一张图,它能认出表格线,直接生成可编辑的 Excel,合并单元格大多也能还原。月底对账、录客户名单,这一步能省掉大半天。
腾讯文档里也藏着同样的能力。新建在线表格,选"图片转表格",把照片传上去,几秒后就是一张能直接编辑的在线表。多人协作时格外方便,不用来回发文件版本。
发票、收据这类结构固定的东西,交给扫描全能王或者 TextIn。它们能自动认出发票号码、金额、日期、开票方,一沓票扫完直接导成台账。做报销的同事看到这个功能大概会沉默——以前一沓发票录两小时,现在拍完就完事。
临时救急还有免费路子:把 PDF 传进百度网盘,在线打开点右上角"转为 Word"或"转为 Excel",它会自动调 OCR 引擎,不占网盘空间也不花钱。偶尔用一次完全够。
三、整本扫描件,一次转成能改的文档
前两类解决的是碎片,真正吃时间的是整本文件。
扫描全能王的批量模式,可以把几十页纸连着拍完,自动裁边、去阴影、拉正倾斜,最后合成一份清晰 PDF 或者 Word。手机拍出来歪七扭八的照片,它处理得比较干净,边缘和暗角都能拉回来。
对格式还原要求高的场合,用 ABBYY FineReader 或者 WPS 自带的 OCR。前者支持一百多种语言,复杂排版、合并单元格的还原度在这一类里属于第一梯队;后者胜在本地处理,文件不上传服务器,碰上财务报表、合同这种材料心里更踏实。
还有一条新路子:直接把扫描件丢给豆包、Kimi 这类大模型,让它读完再回答问题。"这份合同的付款条件是什么""帮我把违约责任那几条整理成要点",它不只提取文字,还顺手帮你归纳。适合你并不需要全文、只想要几个关键信息的时候。
多提一句:涉及身份证、银行卡、员工名单的材料,优先选本地处理的工具,比如 Umi-OCR、WPS 离线 OCR,能不上传就不上传。
写在最后
这几年 OCR 的进步挺实在,从"能认字"变成了"认得准、还原得像",手动录入这件事基本可以退休了。
选工具其实很简单:随手截图用微信和白描,表格票据交给白描和扫描全能王,整本文件上 ABBYY 或 WPS,敏感材料一律走本地。
你平时手动录入最多的是什么?发票、表格,还是会议时拍的白板照片?评论区说一声,下次挑几个高频场景做详细拆解。
觉得有用就点个赞、点个在看,让天天在敲字的同事也看见。
夜雨聆风