免费,开源,可批量的离线 OCR 软件。适用于 Windows7 x64 及 Linux x64。
免费:本项目所有代码开源,完全免费,无广告、无捆绑、无付费功能。
方便:解压即用,离线运行,无需网络,不上传任何图片到服务器。
高效:自带高效率离线 OCR 引擎,内置多种语言识别库,多线程并发处理。
灵活:支持命令行、HTTP 接口等外部调用方式,方便集成到工作流中。
Umi-OCR 提供五种主要文字识别功能,覆盖日常提取文字的绝大多数场景。所有识别过程都在本地完成,图片不会上传到任何服务器。
按下快捷键唤起截图工具,截取屏幕任意区域后自动识别图中的文字。左侧预览栏可划选局部区域,右侧识别记录栏可编辑、复制、导出。
Win + Alt + C 全局唤起txt / md一次性导入数百张图片,Umi-OCR 自动多线程并发识别,结果可批量导出。适合整理扫描件、发票、学习资料等大批量场景。
jpg png webp bmp tif 等格式txt / jsonl / md / csv导入 PDF 或扫描件图片,逐页识别文字内容,保留原文档段落结构,输出可编辑的 TXT 或 Markdown 文件。
TXT / Markdown扫描图片或截图中的二维码,识别内容可复制,支持一图多码批量提取。
识别图片中的数学公式,输出 LaTeX 格式代码,可直接粘贴到 LaTeX 编辑器或 Markdown 中使用。
Umi-OCR 提供 图形界面 与 命令行 / HTTP 接口 两种使用方式,可以根据使用场景自由选择。
解压后双击主程序即可启动。所有功能都在图形界面内完成,无需命令行操作,适合普通用户日常使用。
Umi-OCR_Rapid_v2.1.5/
├── Umi-OCR.exe # 主程序
├── config/ # 配置文件
├── models/ # 识别模型
└── README.md
提供完整的命令行接口,可脚本化批量处理图片,适合服务器端或自动化任务集成。
# 对单张图片进行 OCR
Umi-OCR.exe --path "image.png" --output "result.txt"
# 批量处理目录
Umi-OCR.exe --path "./images/" --output "./results/"
启动时可开启 HTTP 服务,通过 REST 接口调用 OCR 功能,方便与其他软件集成。
# 启动 HTTP 服务(默认端口 1224)
Umi-OCR.exe --server
# 调用接口
POST http://127.0.0.1:1224/api/ocr
Content-Type: application/json
{ "base64": "..." }
Umi-OCR 提供两个引擎版本:Paddle 版 精度更高,Rapid 版 更快更轻。可根据电脑配置与使用场景选择。
| 版本 | 体积 | 特点 | 适用场景 |
|---|---|---|---|
| Paddle 版 | 约 128 MB | 精度更高,模型更大 | 复杂文档、专业场景 |
| Rapid 版 | 约 97 MB | 速度更快,体积更小 | 快速任务、低配电脑 |
| Linux 版 | AppImage | Ubuntu / Debian / Fedora | Linux 桌面环境 |
0xc0000142,请换用 Rapid 版。
# SHA256 校验
Rapid : 4B3D... (请以 releases 页面为准)
Paddle : 8F2A... (请以 releases 页面为准)
Umi-OCR 由 hiroi-sora 发起并维护,是 GitHub 上活跃的开源 OCR 项目之一。
| GitHub Stars | 0K+ |
| 支持语言 | 0+ 种 |
| 离线运行 | 0%(不上传图片) |
| 广告与捆绑 | 0(完全免费纯净) |
| 最新版本 | v2.1.5 |
Umi-OCR 采用 MIT License 协议开源。您可以自由使用、修改、分发本项目,包括商业用途,只需保留原作者的版权声明。
项目源代码托管于 GitHub:github.com/hiroi-sora/Umi-OCR