v2.1.5 · 三周年版本

免费离线 OCR
图片文字秒提取

Umi-OCR 是一款完全免费、开源的离线文字识别软件。截图、图片、扫描版 PDF 里的文字,解压即用,全程本地运行,无需联网,隐私安全有保障。

Paddle 与 Rapid 双引擎可选,内置 100+ 语言识别库,支持批量处理、排版解析、双层 PDF 输出。

100% 离线运行 MIT 开源免费 Windows / Linux

核心 功能

截图、批量、PDF、二维码,一个工具全部搞定

截图 OCR

快捷键一键截图,框选区域文字立刻出现在识别记录栏,支持编辑、复制、粘贴图片识别。

批量图片识别

支持 JPG/PNG/WEBP/TIF 等主流格式,无数量上限,拖入文件夹自动逐张识别,导出 TXT/MD/CSV。

PDF 双层文档

从扫描版 PDF 提取文字,生成可搜索的双层 PDF,保留原版外观的同时文字可选中、可复制。

二维码 / 条码识别

扫描识别图片中的二维码和 19 种条码类型,也支持生成二维码图片。

公式识别

识别数学公式,输出 LaTeX 格式,方便直接粘贴到 Markdown 或学术文档中。

∑ ∫ √x²

排版解析

自动识别多栏布局、竖排文字,按正确顺序输出。代码截图保留缩进,水印可排除。

软件 界面预览

标签页设计,功能独立,按需打开

截图OCR 批量OCR 批量文档 二维码
截图识别 粘贴图片 复制全部
发票
发票号码:00123456
开票日期:2026-09-22
金额:¥ 1,280.00
税额:¥ 166.40
合计:¥ 1,446.40
输出格式
TXT JSONL MD CSV
截图 OCR
快捷键唤起截图,框选即识别。支持从剪贴板粘贴图片,识别结果可直接编辑和复制。
批量 OCR
拖入整个文件夹自动处理,无数量限制。支持忽略区域排除水印,输出 TXT/JSONL/MD/CSV。
批量文档
处理扫描版 PDF,提取文字或生成双层可搜索 PDF。保留原始排版,文字可选中。
双引擎选择
Paddle 引擎精度更高(~128MB),Rapid 引擎兼容性更好(~98.5MB)。按电脑配置选择。
外部调用
支持命令行调用和 HTTP 接口,方便集成到自动化流程或其他软件中。

项目 数据

开源社区持续维护,稳定可靠

K+
GitHub Stars
开源社区认可
+
支持语言
中英日韩俄德法
OCR 引擎
Paddle / Rapid
%
离线运行
数据不出本机

常见 问题

关于 Umi-OCR 下载与使用的疑问解答

如何下载和安装 Umi-OCR?
点击页面中任意“立即下载”按钮获取最新版本。软件为免安装绿色版,解压后双击 Umi-OCR.exe 即可运行,无需安装过程,不写注册表。支持 Windows 7 x64 及以上和 Linux x64 系统。
Paddle 引擎版和 Rapid 引擎版怎么选?
Paddle 版精度更高、速度稍快,体积约 128MB,适合配置较高的电脑(需要 CPU 支持 AVX 指令集)。Rapid 版体积约 98.5MB,内存占用低、兼容性好,适合老旧 CPU 和低配电脑。日常使用推荐 Rapid 版。
真的完全离线吗?会上传我的图片吗?
完全离线。所有识别过程都在你的电脑本地完成,图片不会上传到任何服务器。断网状态下可以正常使用所有功能。这是 Umi-OCR 区别于在线 OCR 服务的核心优势。
支持哪些语言识别?
软件本体自带简体中文和英文识别库。通过下载多国语言扩展包,可添加繁体中文、日文、韩文、俄文、德文、法文等识别库。支持 100+ 种语言模型,详情请查看项目文档。
能识别竖排文字和代码截图吗?
支持。排版解析方案中有专门针对竖排文字(从右到左)的适配选项。代码截图可选择“单栏-保留缩进”方案,保留行首缩进和行中空格,识别结果可直接使用。
如何通过命令行或 API 调用?
Umi-OCR 支持命令行调用和 HTTP 接口两种外部调用方式。可以在软件设置中开启 HTTP 服务,或直接通过命令行参数调用。具体用法请参考项目文档中的调用说明。

免费离线 OCR,解压即用

截图秒识别 · 批量图片转文字 · PDF双层文档 · 100+语言