为效率而生的 OCR 引擎
无论是截图、图片还是 PDF,Umi-OCR 都能快速提取文字,并保留排版。完全离线,数据不出本地。六项核心能力,覆盖你日常文字识别的全部需求。
截图 OCR
按下快捷键即可截取屏幕任意区域,秒级识别文字,自动复制到剪贴板。支持多屏与高 DPI。
- 自定义快捷键
- 识别后自动复制
- 支持竖排文本
PDF 双层可搜索
将扫描版 PDF 转换为双层可搜索 PDF,保留原始图像的同时添加隐形文字层,方便检索与复制。
- 批量处理 PDF
- 保留原始排版
- 生成可搜索文档
100+ 语言支持
内置多语言识别模型,涵盖中、英、日、韩、法、德、俄、西班牙等 100 多种语言,并可混合识别。
- 中英混合识别
- 自动语言检测
- 垂直排版支持
完全离线
所有识别过程均在本地完成,无需联网,不上传任何数据。适合处理敏感信息与隐私文档。
- 无网络依赖
- 数据不出本地
- 开源透明
批量处理
支持批量导入图片或 PDF 文件夹,一键识别并导出为 TXT、JSON 或双层 PDF,大幅提升效率。
- 拖拽文件夹
- 多格式导出
- 任务队列管理
开源免费
Umi-OCR 基于开源协议发布,完全免费,无任何功能限制。社区活跃,持续更新。
- MIT 许可证
- 无广告无捆绑
- 社区驱动开发
四步完成文字识别
从导入到导出,Umi-OCR 的流程设计极简高效。无需复杂配置,开箱即用,让识别任务一气呵成。
导入内容
拖拽图片、文件夹或 PDF 到窗口,也可直接截图。支持 PNG、JPG、BMP、PDF 等常见格式。
选择语言
根据文档内容选择识别语言,支持多语言混合。系统会自动检测并优化识别模型。
一键识别
点击开始,本地引擎极速处理。进度实时可见,支持队列管理与暂停继续。
导出结果
识别结果可复制、导出为 TXT、JSON,或生成双层可搜索 PDF,保留原始排版。
覆盖多种使用场景
无论你是学生、研究人员、办公人员还是开发者,Umi-OCR 都能成为你得力的文字提取助手。
学习与研究
快速提取论文、书籍、文献中的文字,整理笔记,构建个人知识库。
办公自动化
批量识别发票、合同、扫描件,将纸质文档数字化,提升工作效率。
开发者工具
通过命令行或 API 集成 OCR 能力,自动化处理图片文字,构建智能应用。
隐私敏感场景
处理身份证、病历、财务单据等敏感信息,全程离线,杜绝数据泄露风险。
技术规格与兼容性
Umi-OCR 采用轻量级架构,对系统资源友好,同时支持多种平台与导出格式。
🖥️ 系统支持
- WindowsWindows 10 / 11
- Linux主流发行版
- 架构x64 / ARM64
- 安装方式绿色免安装
📦 导出格式
- TXT纯文本
- JSON结构化数据
- 双层 PDF可搜索文档
- 剪贴板一键复制
⚙️ 性能表现
- 单图识别0.1~0.5 秒
- 批量处理多线程加速
- 内存占用低至 200MB
- 离线运行无需网络
常见问题
关于 Umi-OCR 的离线能力、语言支持与使用方式,这里有你最关心的问题解答。
Umi-OCR 真的完全免费吗?
是的。Umi-OCR 基于 MIT 开源协议发布,所有功能完全免费,无任何隐藏收费或功能限制。你可以自由使用、修改和分发。
离线识别会影响准确率吗?
不会。Umi-OCR 内置了高性能的本地识别引擎,针对中文、英文等语言做了深度优化,准确率可与在线服务媲美,且速度更快。
支持哪些图片格式?
支持 PNG、JPG、JPEG、BMP、WebP、TIFF 等常见图片格式,以及 PDF 文档。你可以直接拖拽文件夹进行批量处理。
如何保证我的数据隐私?
所有识别过程均在本地完成,软件不会上传任何图片或文字到服务器。断网状态下依然可以正常使用,彻底杜绝数据泄露。
PDF 双层可搜索是什么意思?
识别后的 PDF 会保留原始扫描图像,同时在文字位置添加隐形文字层。这样既能保持原貌,又能被搜索、复制和选中,方便存档与检索。
是否支持命令行调用?
支持。Umi-OCR 提供命令行接口,方便开发者集成到自动化流程中,实现批量识别、定时任务等高级用法。
支持 100+ 种语言识别
无论是中文、英文、日文、韩文,还是阿拉伯语、俄语、法语、德语,Umi-OCR 都能精准识别。并支持中英混合、竖排文本等复杂场景。多语言模型可自由切换,满足国际化文档处理需求。