Umi-OCR:免费的离线OCR工具,扫描文档一键变可搜索
Umi-OCR免费的离线OCR工具扫描文档一键变可搜索【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费开源的离线 OCR 软件。识别全程在本机完成文件不出机器断网也能跑。截图取字、批量图片转文字、扫描件识别、二维码读写它都能干。先花10秒搞懂它能干嘛 功能模块解决的痛点怎么触发截图OCR屏幕上的文字复制不走想原样拿走页面快捷键框选或粘贴已复制的图片批量OCR一文件夹图片要出文字一张张太慢拖入文件夹结果存 txt / csv 等格式文档识别扫描版文档搜不到字、复制不了文档识别标签页拖入 PDF 等文件二维码 / 条形码一堆码要批量读或要生成二维码图二维码标签页拖入图片或文本生成码排版解析多栏文本、代码缩进输出后乱糟糟识别页设置里切换「排版解析方案」忽略区域水印、页眉页脚干扰识别结果批量页右栏按住右键画矩形框命令行 / HTTP想写脚本批量跑或让程序直接调用umi-ocr 命令或本地 HTTP 接口功能基本围绕「识别、批量、离线」三件事展开。先看怎么把它跑起来。从下载到跑起来总共三步 下载发行包.7z压缩包或.7z.exe自解压包没装压缩软件也能直接解。解压到任意目录双击Umi-OCR.exe启动Linux 跑umi-ocr.sh。首次打开界面语言自动跟随系统想换语言或主题进「全局设置」→「语言 / 主题」即可。想从源码自己构建的克隆仓库后按 README 的构建说明走git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR四个高频场景照着走就行屏幕上的字复制不了框一下就能拿走论文阅读器、某些软件里的文字锁得死死的右键选不中想引用一段都费劲。打开「截图OCR」标签页。按页面里的快捷键在屏幕上框选那段文字。右侧记录栏出结果直接划选复制记录也能改字、多条一起复制。图片来源不局限于截屏在别处复制一张图粘贴进来同样能识别。遇到代码截图把设置里的「排版解析方案」换成「单栏-保留缩进」行首空格会原样保留。如果卡住了结果总差几个字时先把图片对比度调高或转灰度图中英混排的内容识别语言要选混合语言包实在不行换内置的另一套 OCR 引擎再跑一遍。文字拿走之后如果是一堆图片文件就该上批量模式了。一文件夹扫描图批量转成文字几十个 jpg 躺在文件夹里文字要进表格或归档手打不现实。打开「批量OCR」页把整个文件夹拖进去。等任务跑完左侧列表能看到每张图的耗时和状态。勾选保存格式txt、jsonl、md、csv可直接进 Excel四选一。jpg、png、webp、bmp、tif 都能进数量没有硬性上限几百张照排。深夜跑大任务可以勾上「完成后自动关机」。如果卡住了跑得太慢多半是图太多太大超大长图把「限制图像边长」的数值调高再拆成几批排队。每张图同一位置盖着水印 LOGO 的话进右栏设置按住右键画几个矩形把水印框住框内的整个文字块会直接跳过省掉事后清理。单页截图、整批图片都搞定了剩下最难缠的是那种「搜不到字」的扫描版文档。扫描版PDF搜不到字变一份双层可搜索PDF扫描版 PDF 本质是一摞图片阅读器里怎么搜都没有想复制一段话更是无从下手。打开「文档识别」标签页把 PDF 拖入。有固定位置的页眉页脚用忽略区域框掉。任务完成后导出拿到的就是一份双层可搜索 PDF。PDF 之外XPS、EPUB、MOBI、FB2、CBZ 也支持任务完成后可选自动关机或休眠。如果卡住了某个 PDF 报无法处理时把它逐页转成图片走批量OCR通常能绕过去绕不过去就升级软件版本兼容性问题多半在新版本里修掉。文档之外码类图片也可以批量处理。一堆带码截图批量扫出来一张图上贴了好几个码或是一摞带码截图逐个扫太磨人。打开「二维码」标签页把图片拖进去。批量读出全部内容一图多码没问题覆盖二维码、一维条码、PDF417 等 19 种协议。反过来在「生成码」里粘贴一段文本立刻得到二维码图片宽高和纠错等级都能指定。如果卡住了个别码读不出来先看原图是不是太小或太糊放大或换一张更清晰的源图再跑。可搜索PDF背后的那层透明文字 把扫描件变成可搜索文档关键在它没有重绘你的文档。原始扫描图完整保留为图像层版式、插图、字体原样不动OCR 把每页文字转成一层透明文本叠在图上。相当于在扫描件下面垫了一张印着字的透明纸你看到的还是扫描件但搜索索引指向的是那层透明文字所以 CtrlF 能定位、文字能整段复制。识别本身由内置的离线模型完成RapidOCR、PaddleOCR 两套引擎可选全程在本地跑不需要联网。不想开窗口命令行和HTTP接口也备好了 ⚙️主程序本身就是命令行入口最常用的一条把一个文件夹识别进一个文件umi-ocr --path D:/images --output D:/result.txt需要程序化调用时软件自带本地 HTTP 接口只走本机环回不出网卡图片和文档识别都能走接口详见 命令行手册 与 HTTP接口手册。这些坑提前知道少踩 ⚠️识别率跟着输入质量走艺术字、潦草手写本身有上限调参数救不了图太糊、对比度太低先修图再跑。大文件、超长图吃内存4GB 以下内存的机器减少单批数量或调低「限制图像边长」。HTTP接口对并发不友好脚本里串行调用偶尔出现连接报错重新发一次请求即可。语言包覆盖有边界识别语言包覆盖中、英、日、韩、法、德等常用语言小语种内容建议选混合语言包再识别。Umi-OCR 把截图取字、批量图片转文字、扫描件变可搜索PDF、二维码读写这四件事收进了一个免费离线的小工具里。更多细节看 README。遇到问题直接去项目仓库提 Issue维护者会跟进。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考