开源离线 OCR 引擎,无需联网,截图即刻识别文字,支持 PDF 批量提取。 所有数据仅在本地处理,无隐私泄露风险。
Umi-OCR 提供截图识别、PDF 批量处理、二维码生成与解析等能力,所有计算均在本地完成, 无需上传任何文件,满足隐私敏感场景。
快捷键呼出截图,自动识别选中区域文字并复制到剪贴板。支持多语言混合识别,结果精准快速。
导入多个 PDF 或图片文件夹,一键批量提取文字。保留段落结构,支持导出 TXT、Markdown 等格式。
基于 PaddleOCR 等开源引擎,全程本地运算,不发送任何数据到服务器。断网也能正常使用。
内置二维码生成与识别功能,可批量生成二维码,或从图片中解析二维码内容,提高工作效率。
提供 HTTP 接口和命令行调用,方便集成到自动化流程中。开发者可自由调用 OCR 能力。
现代化 UI 设计,操作直观。支持深色模式,标签页管理多个识别任务,体验流畅。
除了基础识别,Umi-OCR 还针对排版还原、多语言、批量自动化等需求提供了进阶支持, 让文字提取更智能、更高效。
普通 OCR 仅提取纯文本,而 Umi-OCR 能够分析段落、表格与列表结构, 在输出时保留原始排版逻辑。无论是合同、报告还是书籍扫描件, 识别结果都更接近原文,减少后期整理时间。
智能区分标题、正文、表格与列表,输出结构化文本。
同一张图片中若出现中文、英文、日文、韩文等多语言内容, Umi-OCR 可自动切换识别模型,无需手动指定语言。 对于跨国文档、学术论文或技术手册,识别准确率显著提升。
自动识别语言类型,中英日韩混合内容一键提取。
面对成百上千张图片或 PDF 文件,手动逐个识别效率极低。 Umi-OCR 支持批量导入文件夹,自动排队处理,并可预设输出格式与命名规则。 配合命令行调用,还能嵌入现有工作流,实现无人值守的自动化识别。
文件夹级导入,自动排队识别,支持命令行调用。
无论是日常办公、学术研究还是开发集成,本地离线 OCR 都能带来安全与效率的双重提升。
快速提取 PDF 论文、扫描书籍中的文字,方便引用与笔记。
截图识别发票、合同、报表,直接转为可编辑文本,减少手动录入。
处理身份证、银行账单等敏感信息时,离线运行杜绝数据外泄风险。
通过 API 或命令行集成 OCR 能力,构建自动化文档处理流水线。
这里整理了一些用户最常提出的问题,帮助你快速了解这款工具。
是的,Umi-OCR 是开源项目,基于 MIT 协议发布,个人和商业使用均免费,无任何功能限制。
不会。Umi-OCR 内置了高性能的 PaddleOCR 模型,离线状态下依然保持高识别精度,与联网方案相当。
目前支持 Windows 10/11 和主流 Linux 发行版,提供打包好的可执行文件,开箱即用。
Umi-OCR 主要针对印刷体优化,对于工整的手写体有一定识别能力,但复杂手写内容准确率有限。