扫描件、截图里的文字,你平时是怎么“抠”出来的?

有人靠手打,有人靠付费工具,还有人用各种要登录、上传、联网的在线平台。

但如果你想找一款开源、免费、完全离线的 OCR 工具,那 Umi-OCR 值得试试。

支持截图识别、批量识别、整份文档识别、二维码识别,基础功能都很齐全。
但我觉得真正值得单独写一篇的,是它的 数学公式识别

这个功能听起来不稀奇,但真正做得好的软件其实不多。
我专门找了几道复杂公式测试,Umi-OCR 可以直接识别并转换成 LaTeX 代码

再把这些代码放到 simpletex网站里验证,最后效果很不错,识别准确率相当高。

对学生党、科研党来说,这一点真的很实用,很多原本要手动输入的公式,现在可以省下不少时间。

Umi-OCR 的界面也比较顺手,采用标签页设计,内置简体中文、繁体中文、英文等多种语言。
系统要求不高,Windows 7 x64 及以上就能运行。

导入方式也很方便,支持三种常用方法:

  • 用软件自带的截图工具直接截取
  • 把图片或文档拖进界面
  • 直接粘贴图片

识别完成后,它还支持自动排版


很多 OCR 工具只能把文字识别出来,排版却乱糟糟,后期还得自己整理。Umi-OCR 在这方面明显更省心一些。

另外,它还支持 19 种协议的二维码 / 条形码识别,实用性也很高。

需要注意的是,公式识别默认不是开启状态,需要额外安装插件。

步骤不复杂:

1、去项目 GitHub 页面下载公式插件 win7_x64_Pix2Text.v1.0.7z

(插件:
https://github.com/hiroi-sora/Umi-OCR_plugins/releases)

2、解压后放到 UmiOCR-data\plugins 目录

3、打开软件,依次点击:
全局设置 → 文字识别 → 接口改为 Pix2Text → 应用修改

设置完成后,就可以正常使用公式识别了。

还有一个小建议:
如果你主要识别公式,建议把 “启用文字识别” 关掉,这样准确率通常会更高。

Umi-OCR 提供两个版本,都是下载后解压即用:

  • Paddle 版:性能更强,但体积更大,对配置要求更高
  • Rapid 版:体积更小,更适合普通电脑

按自己的电脑配置来选就行,不用太纠结。

最后说一句

免费、离线、免安装,基础 OCR 功能齐全,连数学公式识别都做得不错——Umi-OCR 确实是一款低调但很好用的工具。
如果你平时经常处理扫描件、截图,或者有公式识别需求,这款软件很值得收藏备用。