免费离线OCR软件Umi-OCR:截图识别与PDF文字提取一学就会

发布时间:2026/8/20 17:59:12
免费离线OCR软件Umi-OCR:截图识别与PDF文字提取一学就会 免费离线OCR软件Umi-OCR截图识别与PDF文字提取一学就会【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR先对号入座你有没有过这些瞬间——课件截图里的字看得清清楚楚却一个也复制不出来扫描版 PDF 翻了半天找不到想查的术语几百张手机拍的书页等着转成文字手打又太费时间。如果你担心资料上传到在线识别网站不安全又不想为偶尔一次的需求付费买软件这篇文章就是为你准备的。文章要讲的 Umi-OCR是一款完全免费、开源的离线 OCR 软件OCR 即光学字符识别通俗说就是把图片里的文字抠出来变成可编辑文本不联网、不注册就能完成截图识别、批量图片识别、PDF 文字提取和二维码扫描。先对号入座这些复制不出来的瞬间你中了几条截图里的文字没法选中、没法复制只能照着敲一遍。手里压着扫描版 PDF没有文字层翻起来像看照片。有几百张图片要转文字一张张处理能累到怀疑人生。手头的资料涉及未公开内容不敢往在线 OCR 网站上传。偶尔需要扫个二维码或者把一段文字生成二维码。上面任意一条戳中你都说明你需要一个本地运行的识别工具。下面我们从安装开始一步步把它跑起来。它是免费离线OCR工具不是云端服务一句话判断它适不适合你Umi-OCR 是解压即用、全程离线的桌面 OCR 工具适合在意资料隐私、需要批量处理、想要零成本解决问题的普通用户它不是在线网页服务不提供云端存储也不依赖账号体系不适合想要随时随地多端同步的场景。三步配置安装、启动、跑通第一次识别整个过程不需要装任何依赖全程不碰网络下载发行包从项目仓库的发行页下载.7z压缩包或.7z.exe自解压包。后者在没装压缩软件的电脑上也能直接解压。解压并启动解压后双击Umi-OCR.exeLinux 用户运行umi-ocr.sh。第一次打开会按系统语言自动切换界面。跑通第一次识别打开截图OCR标签页按下截图快捷键屏幕上出现取景框框住任意一段文字松开鼠标识别结果立刻出现在右侧记录栏。常用参数都在全局设置标签页建议第一次启动时顺手过一遍记住这张速查表配置项在哪里调推荐做法界面语言全局设置 → 语言/Language支持简体中文、繁体、英文、日文等按需切换界面主题全局设置 → 主题多套亮/暗主题可选字体与缩放全局设置 → 界面和外观界面文字看不清时调整渲染器全局设置 → 界面和外观截屏闪烁或界面错位时切换渲染方案或关闭硬件加速识别语言库内置默认多国语言库无需额外下载场景卡片截图、批量、PDF、二维码分别解决什么问题与其罗列功能不如按场景看它怎么用。场景一截屏识别几秒出一段文字适用课件、聊天记录、代码片段这类看得见复制不出的内容。操作在截图OCR页按下快捷键框选屏幕松开即出结果也可以把别处复制好的图片直接粘贴进来识别。产出右侧记录栏的文本可编辑支持划选多条一起复制。 这里有个容易被低估的设置——文本后处理里的排版解析方案识别代码截图选单栏-保留缩进行首缩进和行中空格原样保留读多栏论文页面选多栏-按自然段换行左右栏按阅读顺序输出不会交叉错乱。截图OCR页面左侧图片预览右侧识别记录划选即可复制场景二批量识别几百张图一次跑完适用手机拍的书页、成堆课件截图。操作把图片全部拖进批量OCR页的任务列表点开始任务每张图下方会标注耗时和状态。产出识别结果可导出为 txt、jsonl、md 或 csvExcel格式没有数量上限。 更实用的是忽略区域手机照片里总有时间水印、页角阴影进入忽略区域编辑器按住右键在水印可能出现的位置画矩形框任务中这些区域内的文字整块被忽略识别结果干净得多。睡前还能勾选完成后自动关机醒来直接拿成果。批量OCR页面左侧任务列表带耗时与状态右侧显示识别文本场景三扫描版PDF变可搜索文档适用没有文字层的扫描书、旧文献。操作在文档识别页导入 PDF可提取原有文本也可对扫描件做 OCR输出为双层可搜索PDF——底层保留扫描原图顶层覆盖透明文字层。出来的文件既能一页页看原貌又能全文搜索、划词复制。支持格式包括 pdf、xps、epub、mobi、fb2、cbz。处理长文档时同样可以设置忽略区域把页眉页脚排除掉避免页码和书名混进正文。场景四二维码扫描与生成二维码页面既能截图扫码支持一图多码、19 种码制协议也能输入文本生成二维码图片并可调整纠错等级。场景五进阶命令行与 HTTP 接口需要自动化的人主程序本身就是命令行入口例如umi-ocr --screenshot唤起截屏识别、umi-ocr --path D:/xxx.png指定路径识别。接口文档见命令行手册与HTTP接口说明。新手最常见的5个坑不要这样做而是这样做不要把超长图、超大图直接丢进批量任务然后抱怨识别失败而是在页面设置→文字识别→限制图像边长里调高数值。不要把忽略区域画得刚刚好而是尽量画大、完全包裹住水印所有可能出现的位置。因为只有整个文本块处于框内才会被忽略画小了水印文字照样混进结果。不要一出现截屏闪烁或界面错位就以为是系统坏了而是去全局设置→界面和外观切换渲染器或关闭硬件加速。不要同时安装自带 Rapid-OCR 和 Paddle-OCR 两个版本快捷方式可能互相覆盖而是二选一需要切换时用插件方案随时换引擎。不要用备用启动器如UmiOCR-data/RUN_GUI.bat来调命令行而是以主程序Umi-OCR.exe作为命令行入口并且保持 HTTP 服务开启默认开启主机选仅本地通信只在本地环回进行不会出网。对比表离线OCR、在线网站、商用软件怎么选维度Umi-OCR在线OCR网站商用OCR软件联网要求完全离线必须联网视产品而定资料隐私文件不出本机需上传服务器本地为主费用免费开源常有限次免费、后续收费通常付费批量处理无数量上限多受限多受限或需升级PDF文字提取支持可输出双层可搜索PDF部分支持部分支持扩展能力命令行、HTTP接口少视产品而定要点回顾与下一步下载.7z或.7z.exe包解压双击Umi-OCR.exe即用全程离线。截图识别、批量识别、PDF 转双层可搜索PDF、二维码扫描生成四个核心场景覆盖日常大部分需求。记住两个高频设置排版解析方案管输出顺序忽略区域管排除水印页眉。遇到界面异常先切渲染器处理大图先调图像边长上限。想立刻试用的读者去项目仓库下载最新发行版即可开发者可以git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR查看源码。功能演进记录见更新日志。挑一份你最头疼的文档跑一遍也许你的效率困局就从这一次双击开始松动。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考