扫描件、截图里的文字,你平时是怎么“抠”出来的?
有人靠手打,有人靠付费工具,还有人用各种要登录、上传、联网的在线平台。
但如果你想找一款开源、免费、完全离线的 OCR 工具,那 Umi-OCR 值得试试。
它支持截图识别、批量识别、整份文档识别、二维码识别,基础功能都很齐全。
但我觉得真正值得单独写一篇的,是它的 数学公式识别。
这个功能听起来不稀奇,但真正做得好的软件其实不多。
我专门找了几道复杂公式测试,Umi-OCR 可以直接识别并转换成 LaTeX 代码。
再把这些代码放到 simpletex网站里验证,最后效果很不错,识别准确率相当高。
对学生党、科研党来说,这一点真的很实用,很多原本要手动输入的公式,现在可以省下不少时间。
Umi-OCR 的界面也比较顺手,采用标签页设计,内置简体中文、繁体中文、英文等多种语言。
系统要求不高,Windows 7 x64 及以上就能运行。
导入方式也很方便,支持三种常用方法:
- 用软件自带的截图工具直接截取
- 把图片或文档拖进界面
- 直接粘贴图片
识别完成后,它还支持自动排版。
很多 OCR 工具只能把文字识别出来,排版却乱糟糟,后期还得自己整理。Umi-OCR 在这方面明显更省心一些。
另外,它还支持 19 种协议的二维码 / 条形码识别,实用性也很高。
需要注意的是,公式识别默认不是开启状态,需要额外安装插件。
步骤不复杂:
1、去项目 GitHub 页面下载公式插件 win7_x64_Pix2Text.v1.0.7z
(插件:
https://github.com/hiroi-sora/Umi-OCR_plugins/releases)
2、解压后放到 UmiOCR-data\plugins 目录
3、打开软件,依次点击:
全局设置 → 文字识别 → 接口改为 Pix2Text → 应用修改
设置完成后,就可以正常使用公式识别了。
还有一个小建议:
如果你主要识别公式,建议把 “启用文字识别” 关掉,这样准确率通常会更高。
Umi-OCR 提供两个版本,都是下载后解压即用:
- Paddle 版:性能更强,但体积更大,对配置要求更高
- Rapid 版:体积更小,更适合普通电脑
按自己的电脑配置来选就行,不用太纠结。
最后说一句
免费、离线、免安装,基础 OCR 功能齐全,连数学公式识别都做得不错——Umi-OCR 确实是一款低调但很好用的工具。
如果你平时经常处理扫描件、截图,或者有公式识别需求,这款软件很值得收藏备用。

