
Umi-OCR 离线OCR工具60秒本地跑起来批量识别图片文字免费又简单【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费开源的离线 OCR 工具专门解决图片里的文字怎么变成可编辑文本这个老问题。它最大的卖点完全本地运行、解压即用不用注册、不上传隐私、不限次数几分钟就能用起来。 60秒跑起来解压即用的最短路径Umi-OCR 不需要安装官方发布包是.7z压缩包或.7z.exe自解压包下载最新版本压缩包解压到任意目录双击Umi-OCR.exe启动Linux 用umi-ocr.sh打开截图OCR标签页按默认快捷键CtrlAltZ框选屏幕上任意区域文字立刻复制到剪贴板。首次打开时软件会按系统语言自动切换界面繁中、英语、日语都能用。Windows 用户也可以用 Scoop 一行装完scoop install extras/umi-ocr想基于源码构建的开发者可以克隆仓库git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR构建流程见 构建项目说明。 它到底解决了什么问题场景一屏幕上的文字复制不了。以前遇到只读截图、图片化网页只能手打或者上传云端识别既慢又有隐私顾虑。现在用 Umi-OCR 截图 OCR快捷键一按、框选、完成结果自动进剪贴板全程 3 秒。场景二几百张扫描件等着数字化。以前靠云 OCR API 按量付费或者一张一张手动录入。现在 Umi-OCR 批量 OCR 没有数量上限一次性拖入几百张图片识别完直接导出 txt、md、csv、jsonl还支持任务完成后自动关机/待机。场景三图片上全是水印和页眉页脚。以前识别出来一堆脏字符要人工清洗。现在用忽略区域功能在图上框选水印位置这些区域的文字会在任务中被直接跳过。 核心能力拆解截图 OCR 排版解析。识别结果不是一堆乱序文本软件内置文本后处理模块会按版面整理顺序多栏-按自然段换行适合报纸、论文双栏排版单栏-保留缩进适合代码截图保留行首缩进横排、竖排文字都能自动处理。批量 OCR 忽略区域。支持 jpg、png、bmp、tif、webp 等常见格式右栏设置里进入忽略区域编辑器按住右键画矩形框水印、LOGO、页码统统可以排除。文档识别。直接导入 PDF、epub 等格式既能 OCR 扫描件也能提取原有文本还能输出双层可搜索 PDF——原文档下面垫一层可检索文字。二维码与条形码。截图、粘贴或拖入图片即可读取支持一图多码、19 种协议反向也支持输入文本生成二维码图片。命令行与 HTTP 接口。所有功能都可以通过命令行或本地 HTTP 接口调用方便接入自动化流程详见 命令行手册 和 HTTP接口手册。 一条完整工作流批量数字化带水印的扫描件假设你有一整夹子扫描的合同带页眉页脚和公司水印目标是全部转成 txt把扫描图片放进一个文件夹打开批量OCR标签页把文件夹里的图片拖入任务列表支持几百张无上限进入忽略区域编辑器按住右键框选水印和页眉位置——建议框大一点完全包住水印可能出现的所有位置排版解析选多栏-按自然段换行输出格式选txt点开始任务实时看进度。识别完成后按文件名保存结果复制到 Word 做最终排版即可。整个过程不需要联网敏感文件不会离开你的电脑。⚖️ 和云 OCR 比差别在哪对比项Umi-OCR离线云端OCR服务手动录入费用免费不限次数按张/按量付费时间成本隐私文件不上传需上传到第三方无风险网络要求不需要必须联网不需要批量效率高可自动关机跑夜活高极低结论很直接对隐私敏感、批量大、断网环境Umi-OCR 是最省心的选择如果你有 GPU 集群跑超大规模任务云服务弹性更好。 适合谁不适合谁适合处理扫描件、合同、论文等敏感文档不希望上传云端的用户一次要处理几十上百张图片的办公/学生/开发者想把 OCR 接进自己脚本或工作流的人命令行 HTTP 接口现成可用。不适合需要 macOS 或移动端支持的用户目前只支持 Windows 7 x64 和 Linux x64macOS 还在远期计划里对数学公式识别精度要求极高的场景公式识别目前还比较初级表格图片直接转 Excel 的需求官方尚未实现。 进阶玩法命令行自动化。命令行入口就是主程序本身几行就能干活umi-ocr --path D:/images_folder # 批量识别整个文件夹 umi-ocr --screenshot rect50,100,300,200 # 定时截取固定区域并识别配合计划任务或快捷键工具可以实现每天定点识别屏幕某块区域这类自动化。HTTP 接口集成。软件内置本地 HTTP 服务默认开启仅本地环回通信其他程序可以直接发请求让它识别、读码、生成二维码适合做系统集成接口文档在 docs/http/README.md。切换引擎与界面。在全局设置里可以切换 RapidOCR / PaddleOCR 两个离线引擎也能改界面语言、主题、字体大小批量任务量大时记得在设置里调高限制图像边长避免超大图被截断。 下一步下载最新发行版解压双击Umi-OCR.exe先跑一次截图识别找感觉有几百张图片要处理直接照上面的批量工作流走一遍想深入阅读 命令行手册 与 HTTP接口手册了解更新历史看 CHANGE_LOG.md。离线、免费、批量、可自动化——Umi-OCR 把图片变文字这件事变成了一件几分钟上手的小事。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考