Umi-OCR 是一款免费开源的离线文字识别(OCR)工具,解压即用、全程不联网,图片不会上传到任何服务器。它自带高效率的离线 OCR 引擎并内置多种语言识别库,支持截图识别、批量图片识别、PDF 识别、二维码识别与公式识别,还可以通过命令行或 HTTP 接口被其他程序调用,适合需要批量提取图片文字的日常办公场景。

支持 Windows 7 x64 及以上与 Linux x64。本次提供 Windows 的 Paddle 引擎自解压版(7z.exe)与免安装 zip 版,以及 Linux 的 Paddle 版 tar.xz 包。
Windows:双击 Umi-OCR_Paddle_v2.1.5.7z.exe,选择目录解压完成后双击其中的 Umi-OCR.exe 启动;也可以直接解压 Umi-OCR-2.1.5.zip 后运行。Linux:解压 Umi-OCR_Linux_Paddle_2.1.5.tar.xz,在解压出的目录中运行 Umi-OCR 即可。
「截图 OCR」页适合临时取字:点击截图按钮或按快捷键框选屏幕区域,识别结果会显示在右侧,可以直接编辑并一键复制。需要处理大量文件时切到「批量 OCR」页,把整个文件夹的图片或 PDF 拖进任务列表,设置好输出格式(txt、jsonl、csv 等)与保存目录后点击开始,软件会依次识别并写出结果文件。「全局设置」里可以切换识别语言库、调整识别精度和界面语言;如果要把识别能力接入自己的程序,可以在设置中开启 HTTP 服务,然后用接口提交图片获取文本。


需要网络放心下载