乐于分享
好东西不私藏

一个超好用的转文字工具,图片pdf二维码批量识别,重点是免费,离线可用!!!

一个超好用的转文字工具,图片pdf二维码批量识别,重点是免费,离线可用!!!

Umi-OCR 是一款完全开源且免费的离线文字识别工具,支持 Windows 7 x64 与 Linux x64 系统。项目所有代码均开源,无需付费即可使用全部功能。软件采用解压即用的便携式设计,无需安装,双击Umi-OCR.exe即可运行,所有识别过程均在本地完成,不依赖网络连接。其内置的高效离线 OCR 引擎支持多种语言识别库,并提供了命令行、HTTP 接口等灵活的调用方式

一、核心功能亮点

截图识别:打开截图 OCR 标签页后,可通过快捷键快速唤起截图并识别图中文字。左侧预览栏支持鼠标划选复制,右侧记录栏可编辑文字并支持多记录批量复制。此外,用户也可直接粘贴剪贴板中的图片进行识别

排版解析:软件提供多种 OCR 文本后处理方案,用于整理识别结果的排版和顺序。预设方案包括“多栏-按自然段换行”(自动识别多栏布局并按段落换行)、“多栏-总是换行”(每句独立换行)、“多栏-无换行”(强制合并为单行),以及针对单栏布局的对应方案。其中“单栏-保留缩进”适用于代码截图场景,可保留行首缩进与空格。所有方案均支持横排与竖排(从右到左)的自动适配

批量识别:支持导入 jpg、png、webp、bmp、tiff 等多种格式的本地图片进行批量 OCR。识别结果可保存为 txt、jsonl、md 或 csv 格式。任务数量无上限,可一次性处理数百张图片,并支持完成后自动关机或待机。对于超长或超大像素的图片,可在“设置→文字识别→限制图像边长”中调高数值

忽略区域:批量 OCR 中的特色功能,用于排除图片中不需要的文字(如水印、LOGO)。用户可在批量识别页的右栏设置中进入编辑器,按住右键绘制多个矩形框,框内区域的文字将在识别时被忽略。需要注意的是,只有完全位于忽略区域框内的整个文本块(而非单个字符)才会被过滤

文档识别:支持 pdf、xps、epub、mobi、fb2、cbz 等格式。可对扫描件进行 OCR 识别,或提取文档中原有文本,并支持输出为双层可搜索 PDF。同样支持设定忽略区域以排除页眉页脚,并可设置任务完成后自动关机或休眠

二维码功能:支持扫码与生成码两大功能。扫码方面,可通过截图、粘贴或拖入图片读取其中的二维码或条形码,支持一图多码,兼容 Aztec、Code128、DataMatrix、QRCode、PDF417 等 19 种协议。生成码方面,支持输入文本生成二维码图片,并可调整协议类型与纠错等级等参数

文档识别:支持 pdf、xps、epub、mobi、fb2、cbz 等格式。可对扫描件进行 OCR 识别,或提取文档中原有文本,并支持输出为双层可搜索 PDF。同样支持设定忽略区域以排除页眉页脚,并可设置任务完成后自动关机或休眠

二维码功能:支持扫码与生成码两大功能。扫码方面,可通过截图、粘贴或拖入图片读取其中的二维码或条形码,支持一图多码,兼容 Aztec、Code128、DataMatrix、QRCode、PDF417 等 19 种协议。生成码方面,支持输入文本生成二维码图片,并可调整协议类型与纠错等级等参数

界面语言

Umi-OCR 支持的界面多国语言。在第一次打开软件时,将会按照你的电脑的系统设置,自动切换语言。

如果需要手动切换语言,请参考下图,全局设置语言/Language 。

二、全局设置与界面

软件首次启动时会根据系统设置自动切换界面语言,用户也可在“全局设置→语言/Language”中手动调整。Umi-OCR v2 采用标签页式布局,用户可按需打开相应标签页,标签栏左上角可切换窗口置顶,右上角可锁定标签页防止误关闭。全局设置中还支持添加快捷方式或开机自启、切换亮/暗主题、调整界面文字大小与字体、切换 OCR 插件等。若出现截屏闪烁或 UI 错位,可在“界面和外观→渲染器”中切换渲染方案或关闭硬件加速

三、使用与调用

软件发布包为.7z压缩包或.7z.exe自解压包,后者可在未安装压缩软件的电脑上直接解压。除图形界面外,Umi-OCR 还提供了完整的命令行手册与 HTTP 接口文档,便于开发者集成调用。项目源码及详细构建指南(Windows / Linux)均在 GitHub 仓库中公开

项目地址https://github.com/hiroi-sora/Umi-OCR[reference:30]


批量OCR


文档识别

文档识别

  • 支持格式:pdf, xps, epub, mobi, fb2, cbz
  • 对扫描件进行OCR,或提取原有文本。可输出为 双层可搜索PDF 。
  • 支持设定 忽略区域 ,可用于排除页眉页脚的文字。
  • 可设置任务完成后 自动关机/休眠 。

二维码

扫码

  • 截图/粘贴/拖入本地图片,读取其中的二维码、条形码。
  • 支持一图多码。
  • 支持19种协议

生成码

  • 输入文本,生成二维码图片。
  • 支持19种协议和纠错等级等参数。

全局设置

    项目地址:https://github.com/hiroi-sora/Umi-OCR