
Umi-OCR给文字工作者的离线OCR工具免费免安装识别全在本地完成【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费开源的离线 OCR 软件。文字识别全程在你的电脑里完成文件不出机器断网照样能跑。解压就能用截图取字、批量图片转文字、扫描件变可搜索文档、二维码读写都在这一个工具里。3步打开软件先跑起来 下载发行包。分.7z压缩包和.7z.exe自解压包两种后者没装压缩软件也能用。下载渠道见 README 的「下载发行版」一节。解压到任意目录没有安装步骤。双击Umi-OCR.exe启动Linux 用户执行umi-ocr.sh脚本。首次打开时界面语言跟随你的系统设置。想换语言或浅色/深色主题进「全局设置」→「语言 / 主题」。第一眼看到的就是标签页界面截图OCR、批量OCR、全局设置按需打开。「全局设置」里还能一键添加桌面快捷方式、设置开机自启。离线识别跑在你自己的机器上机密文件不能上传网络又时断时续——Umi-OCR 凭什么还能识别答案很直白它把 RapidOCR、PaddleOCR 两套离线 OCR 引擎随软件一起打包文字检测和字符识别都在本机内存里完成图片不出机器。还有三个细节值得知道内置多国语言识别库中、英、日、韩、法、德等直接用中英混排的内容选混合语言。文档识别输出「双层可搜索PDF」原扫描图保留为图像层识别出的文字做成透明文本层叠在图上。版式不动CtrlF 能搜到文字能整段复制。引擎可切换。默认引擎对某张图效果差时可以在全局设置里切换 OCR 插件再跑一遍。用截图OCR拿走选不中的文字有的软件和 PDF 阅读器里文字锁得死死的右键选不中。打开「截图OCR」标签页。按页面快捷键在屏幕上框选那段文字。结果出现在右侧记录栏直接复制。每条记录可单独改字也可划选多条一起复制。走不通时结果差几个字先调高图片对比度或转灰度中英混排就选混合识别语言最后再换内置的另一套引擎重跑。把一文件夹图片批量转成文字几十张扫描发票躺在文件夹里手打不现实。打开「批量OCR」页把整个文件夹拖进去。等任务跑完左侧列表显示每张图的耗时和状态。勾选保存格式txt、jsonl、md、csv可直接进 Excel四种里选。输入支持 jpg、jpeg、png、webp、bmp、tif 等 9 种格式数量没有硬性上限几百张可一次排进去。走不通时每张图都带水印的话在右栏设置里按住右键在图上画矩形框框内文字在任务中直接跳过超大长图处理超时把设置里「限制图像边长」的数值调高或拆成几批排队。3步把扫描PDF变成可搜索文档扫描版 PDF 本质是一摞图片阅读器里怎么搜都搜不到。打开「文档识别」标签页把 PDF 拖入。有页眉页脚的话用「忽略区域」把固定位置框掉。任务完成后导出双层可搜索 PDF术语能搜到在第几页文字能整段复制。除 PDF 外XPS、EPUB、MOBI、FB2、CBZ 也支持任务完成后可选自动关机或休眠。走不通时某个 PDF 报无法处理先把它逐页转成图片走批量OCR路线通常能绕过去。读一批二维码反手生成一张一张图上贴了好几个码逐个扫太磨人。打开「二维码」标签页把图片拖进去。一图多码也能全部读出内容直接列出。反过来生成在「生成码」里粘贴一段文本立刻得到二维码图片。二维码、一维条码、PDF417 等共 19 种协议都能读生成时可指定宽高和纠错等级。走不通时图片数量大、要重复跑就改用脚本或 HTTP 接口批量做二维码识别见下文进阶一节。功能入口速查表 场景入口适合谁屏幕取字截图OCR 标签页屏幕上选不中文字时批量图片识别批量OCR 标签页一次几十上百张图扫描件变可搜索PDF文档识别 标签页PDF、XPS、EPUB 要能搜能抄去掉水印、页眉页脚忽略区域批量页右栏固定位置文字干扰识别整理多栏与代码缩进文本后处理设置多栏正文、代码截图二维码读写二维码 标签页19种码制、一图多码界面语言与主题全局设置 标签页简繁中、英、日等 7 种界面语言不开界面批量跑识别 ⚙️命令行入口就是主程序本身一条命令识别整个文件夹umi-ocr --path D:/images --output D:/result.txt文件夹里所有图片含子文件夹都会被识别结果写入单个文件。程序里调用时软件自带本地 HTTP 接口只走本机环回、不经过物理网卡图片识别和文档识别都能走接口。参数细节看 命令行手册 与 HTTP接口手册。先看清这些限制识别率和输入图片质量强相关艺术字、潦草手写本身有上限调参数救不了。目前只有 Windows 7 x64 和 Linux x64 发行版没有 macOS。HTTP 接口对并发不友好脚本请串行调用长时间连续调用偶发连接报错重发请求即可。大文件、超长图吃内存4GB 以下内存的机器建议减少单批数量或调低「限制图像边长」。没有 GPU 加速GPU 离线识别还在远期计划里。Umi-OCR 把截图取字、批量图片识别、扫描件变可搜索PDF、二维码读写这四件事收进了一个免费离线的小工具里。更多细节看 README功能进展看 CHANGE LOG。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考