夜雨聆风学习资料网

ARTICLE · 1142994

微信和电脑都能提取文字,图片里的文字怎么提取出来,我试了一遍

微信和电脑都能提取文字,图片里的文字怎么提取出来,我试了一遍

截图上的字,不用装任何软件就能抠下来。微信里长按图片有个入口,电脑系统里也自带。

而且不止一处。

我花了半天,把这台机器上能用的入口都跑了一遍。

先说结论吧:字能弄下来,可弄下来的东西不太干净。

每个字中间都多了一个空格。


入口一共四个,全在你已经有的东西里

微软那页官方说明写得很直白:截图工具里有个文本操作按钮,点下去就是启动 OCR,也就是光学字元辨识。它旁边还有一行小字,说所有文字辨认流程都在本机本地跑,不往云上传。这句对我挺要紧,截图里常有订单号、地址、工作群里的报价单,要是每提一次字都得先传上去,我宁可自己敲。

Windows 11 上能点的入口,我数了一下,一共四个。

先看截图工具。

按 Win 加 Shift 加 S 框住那一块,截图自动落进面板,面板上就有一个像几行字的按钮。

还有照片应用。用照片打开一张图,右下角直接有复制所有文本。

PowerToys 里有个文本提取器,也算一个。

装了它之后按 Win 加 Shift 加 T,不用先存图,直接框、直接提。

还有就是 Click to Do,快捷键 Win 加 Q。

这个只在 Copilot 加 PC 上有,我这台不是,所以没试成。

手机上更省事,微信里长按图片就能提取文字。

这个功能是 2021 年 1 月微信 8.0 那版上的,到现在四年多了。


干净图上,123 个字只错了 1 个

光数入口没用,还得看它认不认得准。

我做了一张图,1100 乘 700,用 28 号字的微软雅黑写了一段 123 个字的话,黑字白底,规规矩矩。

丢进系统自带的识别引擎,出来 7 行,去掉空格一共 118 个字符。

错了几处?一处。

盖的章被认成了盖的童。

数字认得挺准,那行里的 128 和 6 都对。

这个成绩比我想的好。


换成真实截图,错的就不是字了

我又拿手上那张软件运行日志的截图跑了一遍,1115 乘 1037,不算大。

这回出来 59 行,去掉空格 1001 个字符。

可错法变了。字母先崩。

JianyingDraft 这个词,开头的 J 被认成了一个反着的方括号,路径里的反斜杠也乱成一团。

真正让我坐直的是数字。进度那一行,原图上写着百分比,提出来只剩一个百分号,中间的数整块没了。

还有一处,原片的数量被认成了一个千分号。

问题不在字,在字号。干净图是 28 号,日志截图里那些字我量了量,顶多十一二号,还是浅色细体压在深底上。


字中间那些空格,怎么弄掉

这是很容易漏的一步,也是我一开始挺烦的一步。

这套识别出来的东西,每个汉字中间都塞了一个空格。

我那段 123 个字的话,提出来一共 235 个字符,里面有 110 个是空格。

直接粘进文档就是一串散字,读着别扭,字数统计也全乱。

动作很简单。粘贴之后按 Ctrl 加 H,查找框里敲一个空格,替换框留空,点全部替换。

一秒的事。

可要是准备发给别人的东西,替换空格之前先粘到记事本看一眼。

哪一行被断成了两行、哪里多了个逗号,这一步看得清楚。


同一套引擎,为什么两回差这么多

干净图上 123 个字错 1 个,日志截图上几百个字错得没法直接用。

我刚才是拿字号解释的,28 号对十一二号。但这只是我自己的猜测,没做过对照。

下一个要试的是,把同一段文字分别用 12 号、20 号、28 号各做一张图,跑三遍,看错字是不是只跟字号有关。

要是跟字号没关系,那就得换个说法解释了。

所以别急着把重要的单据丢进去就完事。金额、日期、电话这三类,不管用哪个工具,都得回头拿眼睛核一遍。

我一开始也以为点一下就好,结果 110 个空格教了我做人。

相关学习资料