【OCR神器】Umi-OCR官网下载、安装、文字识别教程(2个版本)

Umi-OCR安装包下载:Umi-OCR安装包(源自 Github,Rapid+Paddle,放心使用)
Umi-OCR 是一款免费、开源的文字识别(OCR)工具,图片里的文字、截图里的内容、扫描版 PDF,直接能变成可复制的文字。Umi-OCR 整个识别过程都在本地电脑完成,图片不用上传到任何服务器,用起来放心。

本文系统讲解 Umi-OCR 的下载、安装和使用过程,全程实测,确保大家不会踩坑。

Umi-OCR 完全免费、开源,没有广告,也不用注册账号,主要功能包括:
同领域的 OCR 工具还有天若 OCR、微信/QQ 自带截图识别等,Umi-OCR 的核心优势是免费开源、离线本地识别,图片不外传,隐私有保障,而且截图、批量、PDF 各种场景都覆盖了。

目前 Umi-OCR 的最新版本是 2.1.5,官方在 GitHub 持续更新维护,内置了成熟的 OCR 模型,下载解压就能用,不需要自己配置环境。

Umi-OCR版本介绍

Umi-OCR 下载时提供两个引擎版本:Rapid 版和 Paddle 版,两者的区别如下:

版本 特点 适合场景
Rapid 版 体积小(约 100 MB),启动快,识别速度快,兼容性好 适合低配电脑
Paddle 版 体积较大(约 130 MB),识别精度更高,支持的语言更多 适合配置较高的电脑

两个版本除了引擎不同,其他功能完全一致,电脑配置一般的话直接选 Rapid 版最稳妥。

Umi-OCR下载

Umi-OCR安装包下载:Umi-OCR安装包(源自 Github,Rapid+Paddle,放心使用)

Umi-OCR 是绿色软件,发布包是 .7z.exe 自解压包,下载后解压就能用,不需要安装程序。

Umi-OCR安装(Windows平台)

1)双击解压 7z.exe 压缩包,建议解压到非系统盘(比如 D 盘):


2)进入解压出来的文件夹,双击 Umi-OCR.exe,程序窗口就会打开,整个过程无需联网:


3)第一次启动会按系统语言自动显示中文界面:

因为它是绿色软件,不写入系统注册表,想卸载的话直接把整个文件夹删掉就行。

Umi-OCR基础使用

1)截图识别(最常用)

打开截图 OCR 标签页,按默认快捷键 Win+Alt+c(可以在设置中修改)唤起截图,框选屏幕上想识别的区域,文字立刻出现在右侧识别记录栏里,可以直接编辑、划选复制。


平时从网页、视频、聊天记录里复制文字,这一招最快,也支持直接复制一张图片,在软件里粘贴识别。

2)批量识别(处理大量图片)

打开批量 OCR 标签页,把整个文件夹或几百张图片拖进去,支持 jpg、png、webp、bmp、tif 等常见格式,没有数量上限,点开始任务后自动逐张识别,结果可以导出为 txt、md、csv(Excel 可直接打开)等格式。

3)PDF识别

PDF 识别是办公高频需求,打开批量文档标签页,把扫描版 PDF 拖进去,软件会把每一页图片识别成文字,输出可复制的文本。

Umi-OCR新手注意事项

1)Umi-OCR 不需要安装,解压即用,但解压路径建议用英文,个别电脑在中文路径下运行可能出问题。

2)首次使用建议选 Rapid 引擎版。Paddle 版虽然识别速度快,但对 CPU 有要求,如果你的电脑使用 Paddle  版识别时报错 0xc0000142、OCR init fail,基本就是 CPU 不兼容 Paddle 引擎,换 Rapid 版就能解决。

3)软件全程离线运行,识别过程不联网、不上传,图片和文字都只在本机处理,不用担心隐私泄露。

4)Umi-OCR 没有 macOS 版本,只有 Windows 和 Linux 版,Mac 用户暂时用不了,需要用其他替代方案。

总结

Umi-OCR 是一款免费、开源的文字识别工具,截图识别、批量识别、PDF 识别都能干,识别在本地完成、图片不上传,隐私和安全都有保障,日常提取图片文字基本用它就够了。

Umi-OCR 是绿色软件,下载解压就能用,几分钟就能上手。新用户建议先装 Rapid 版,从截图识别开始用起,识别结果直接复制或导出。遇到扫描版 PDF 就用 PDF 识别功能,批量整理资料时把图片拖进去一次处理,整体使用起来没什么学习成本。