完全离线 · 免费开源

离线文字识别
截图·PDF·100+语言
精准极速

Umi-OCR 是一款完全离线的文字识别工具。无需联网,保护隐私。支持截图即时识别、PDF双层可搜索、批量图片转文字,内置100多种语言模型。从扫描件到屏幕截图,从单张图片到整本PDF,Umi-OCR 都能在本地瞬间完成文字提取,让信息获取从未如此简单高效。

📸 截图OCR 📄 PDF双层可搜索 🌐 100+语言 🔒 离线运行 ⚡ 批量处理
识别预览 · 实时

Umi-OCR 离线文字识别

支持截图、PDF、100+语言

免费开源 · 极速精准

为效率而生的 OCR 引擎

无论是截图、图片还是 PDF,Umi-OCR 都能快速提取文字,并保留排版。完全离线,数据不出本地。六项核心能力,覆盖你日常文字识别的全部需求。

📸

截图 OCR

按下快捷键即可截取屏幕任意区域,秒级识别文字,自动复制到剪贴板。支持多屏与高 DPI。

  • 自定义快捷键
  • 识别后自动复制
  • 支持竖排文本
📄

PDF 双层可搜索

将扫描版 PDF 转换为双层可搜索 PDF,保留原始图像的同时添加隐形文字层,方便检索与复制。

  • 批量处理 PDF
  • 保留原始排版
  • 生成可搜索文档
🌐

100+ 语言支持

内置多语言识别模型,涵盖中、英、日、韩、法、德、俄、西班牙等 100 多种语言,并可混合识别。

  • 中英混合识别
  • 自动语言检测
  • 垂直排版支持
🔒

完全离线

所有识别过程均在本地完成,无需联网,不上传任何数据。适合处理敏感信息与隐私文档。

  • 无网络依赖
  • 数据不出本地
  • 开源透明
⚡

批量处理

支持批量导入图片或 PDF 文件夹,一键识别并导出为 TXT、JSON 或双层 PDF,大幅提升效率。

  • 拖拽文件夹
  • 多格式导出
  • 任务队列管理
🎨

开源免费

Umi-OCR 基于开源协议发布,完全免费,无任何功能限制。社区活跃,持续更新。

  • MIT 许可证
  • 无广告无捆绑
  • 社区驱动开发

四步完成文字识别

从导入到导出,Umi-OCR 的流程设计极简高效。无需复杂配置,开箱即用,让识别任务一气呵成。

1

导入内容

拖拽图片、文件夹或 PDF 到窗口,也可直接截图。支持 PNG、JPG、BMP、PDF 等常见格式。

2

选择语言

根据文档内容选择识别语言,支持多语言混合。系统会自动检测并优化识别模型。

3

一键识别

点击开始,本地引擎极速处理。进度实时可见,支持队列管理与暂停继续。

4

导出结果

识别结果可复制、导出为 TXT、JSON,或生成双层可搜索 PDF,保留原始排版。

覆盖多种使用场景

无论你是学生、研究人员、办公人员还是开发者,Umi-OCR 都能成为你得力的文字提取助手。

📚

学习与研究

快速提取论文、书籍、文献中的文字,整理笔记,构建个人知识库。

💼

办公自动化

批量识别发票、合同、扫描件,将纸质文档数字化,提升工作效率。

💻

开发者工具

通过命令行或 API 集成 OCR 能力,自动化处理图片文字,构建智能应用。

🔐

隐私敏感场景

处理身份证、病历、财务单据等敏感信息,全程离线,杜绝数据泄露风险。

技术规格与兼容性

Umi-OCR 采用轻量级架构,对系统资源友好,同时支持多种平台与导出格式。

🖥️ 系统支持

  • WindowsWindows 10 / 11
  • Linux主流发行版
  • 架构x64 / ARM64
  • 安装方式绿色免安装

📦 导出格式

  • TXT纯文本
  • JSON结构化数据
  • 双层 PDF可搜索文档
  • 剪贴板一键复制

⚙️ 性能表现

  • 单图识别0.1~0.5 秒
  • 批量处理多线程加速
  • 内存占用低至 200MB
  • 离线运行无需网络

常见问题

关于 Umi-OCR 的离线能力、语言支持与使用方式,这里有你最关心的问题解答。

Umi-OCR 真的完全免费吗?

是的。Umi-OCR 基于 MIT 开源协议发布,所有功能完全免费,无任何隐藏收费或功能限制。你可以自由使用、修改和分发。

离线识别会影响准确率吗?

不会。Umi-OCR 内置了高性能的本地识别引擎,针对中文、英文等语言做了深度优化,准确率可与在线服务媲美,且速度更快。

支持哪些图片格式?

支持 PNG、JPG、JPEG、BMP、WebP、TIFF 等常见图片格式,以及 PDF 文档。你可以直接拖拽文件夹进行批量处理。

如何保证我的数据隐私?

所有识别过程均在本地完成,软件不会上传任何图片或文字到服务器。断网状态下依然可以正常使用,彻底杜绝数据泄露。

PDF 双层可搜索是什么意思?

识别后的 PDF 会保留原始扫描图像,同时在文字位置添加隐形文字层。这样既能保持原貌,又能被搜索、复制和选中,方便存档与检索。

是否支持命令行调用?

支持。Umi-OCR 提供命令行接口,方便开发者集成到自动化流程中,实现批量识别、定时任务等高级用法。

支持 100+ 种语言识别

无论是中文、英文、日文、韩文,还是阿拉伯语、俄语、法语、德语,Umi-OCR 都能精准识别。并支持中英混合、竖排文本等复杂场景。多语言模型可自由切换,满足国际化文档处理需求。

简体中文 English 日本語 한국어 Français Deutsch Русский Español العربية + 90 more
100+ 语言

立即体验 Umi-OCR

完全离线,免费开源。支持 Windows、Linux,开箱即用。释放你的生产力,让文字识别变得简单、快速、安全。

立即下载