🔒 完全离线 · 开源免费

本地 OCR 识别
截图 · PDF · 批量处理

开源离线 OCR 引擎,无需联网,截图即刻识别文字,支持 PDF 批量提取。 所有数据仅在本地处理,无隐私泄露风险。

100% 离线运行
0 数据上传
10k+ GitHub Stars
Umi-OCR 截图识别 · 实时预览
截图 发票号码: 12345678识别置信度 99.2%
PDF 批量转换 24 页文档已提取 18,432 字符
「Umi-OCR 完全离线运行, 无需网络,保护隐私。支持截图、批量图片、PDF 识别,可导出 TXT、JSON 等格式。

比想象更强大的本地 OCR 工具

Umi-OCR 提供截图识别、PDF 批量处理、二维码生成与解析等能力,所有计算均在本地完成, 无需上传任何文件,满足隐私敏感场景。

📸

截图即识文字

快捷键呼出截图,自动识别选中区域文字并复制到剪贴板。支持多语言混合识别,结果精准快速。

📄

PDF 批量识别

导入多个 PDF 或图片文件夹,一键批量提取文字。保留段落结构,支持导出 TXT、Markdown 等格式。

🔒

离线无隐私泄露

基于 PaddleOCR 等开源引擎,全程本地运算,不发送任何数据到服务器。断网也能正常使用。

🧩

二维码工具

内置二维码生成与识别功能,可批量生成二维码,或从图片中解析二维码内容,提高工作效率。

⚙️

命令行与 API

提供 HTTP 接口和命令行调用,方便集成到自动化流程中。开发者可自由调用 OCR 能力。

🎨

简洁易用界面

现代化 UI 设计,操作直观。支持深色模式,标签页管理多个识别任务,体验流畅。

为专业场景深度优化

除了基础识别,Umi-OCR 还针对排版还原、多语言、批量自动化等需求提供了进阶支持, 让文字提取更智能、更高效。

智能排版还原

普通 OCR 仅提取纯文本,而 Umi-OCR 能够分析段落、表格与列表结构, 在输出时保留原始排版逻辑。无论是合同、报告还是书籍扫描件, 识别结果都更接近原文,减少后期整理时间。

  • 自动合并断行,还原自然段落
  • 识别简单表格,支持导出为 Markdown 表格
  • 保留标题层级与缩进关系
📐

排版分析引擎

智能区分标题、正文、表格与列表,输出结构化文本。

多语言混合识别

同一张图片中若出现中文、英文、日文、韩文等多语言内容, Umi-OCR 可自动切换识别模型,无需手动指定语言。 对于跨国文档、学术论文或技术手册,识别准确率显著提升。

  • 支持中、英、日、韩、德、法等多种语言
  • 自动检测语言并切换模型,无需人工干预
  • 混合排版场景下依然保持高精度
🌐

多语言引擎

自动识别语言类型,中英日韩混合内容一键提取。

批量自动化处理

面对成百上千张图片或 PDF 文件,手动逐个识别效率极低。 Umi-OCR 支持批量导入文件夹,自动排队处理,并可预设输出格式与命名规则。 配合命令行调用,还能嵌入现有工作流,实现无人值守的自动化识别。

  • 批量导入文件夹,自动递归子目录
  • 自定义输出文件名与保存路径
  • 命令行接口,方便集成脚本与定时任务
⚡

批量处理引擎

文件夹级导入,自动排队识别,支持命令行调用。

这些场景,Umi-OCR 都能胜任

无论是日常办公、学术研究还是开发集成,本地离线 OCR 都能带来安全与效率的双重提升。

📚

学术资料整理

快速提取 PDF 论文、扫描书籍中的文字,方便引用与笔记。

💼

办公文档处理

截图识别发票、合同、报表,直接转为可编辑文本,减少手动录入。

🔐

隐私敏感场景

处理身份证、银行账单等敏感信息时,离线运行杜绝数据外泄风险。

🧑‍💻

开发与自动化

通过 API 或命令行集成 OCR 能力,构建自动化文档处理流水线。

关于 Umi-OCR 你可能想问

这里整理了一些用户最常提出的问题,帮助你快速了解这款工具。

Umi-OCR 真的完全免费吗?

是的,Umi-OCR 是开源项目,基于 MIT 协议发布,个人和商业使用均免费,无任何功能限制。

离线识别会影响准确率吗?

不会。Umi-OCR 内置了高性能的 PaddleOCR 模型,离线状态下依然保持高识别精度,与联网方案相当。

支持哪些操作系统?

目前支持 Windows 10/11 和主流 Linux 发行版,提供打包好的可执行文件,开箱即用。

可以识别手写文字吗?

Umi-OCR 主要针对印刷体优化,对于工整的手写体有一定识别能力,但复杂手写内容准确率有限。

相关热门关键词 · 推荐使用