拓冰建站拓冰建站
首页 / 资讯中心 / 正文

Umi-OCR 离线文字识别保姆级上手指南:10分钟跑通截图、批量与PDF识别

Umi-OCR 离线文字识别保姆级上手指南10分钟跑通截图、批量与PDF识别【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR手边一份 80 页的扫描版合同想提取文字在线 OCR 网站免费额度用完续费要按年付费公司电脑装了管控软件图片传不出内网就算能传合同内容也不该离开这台电脑。Umi-OCR 是一款完全免费、解压即用的离线 OCR 软件替你把图片、截图、PDF 里的文字变成可复制、可搜索的文本全程不联网数据不出本机。30 秒看懂 Umi-OCR 值不值得装离线 OCR 对比对比维度Umi-OCR在线 OCR 网页商用 OCR 工具费用0 元开源免费额度用尽后收费按年订阅网络完全离线文件不出本机必须上传到服务器大多需要联网部署解压双击即用免安装浏览器打开安装 激活授权覆盖场景截图/批量/PDF/二维码/公式以单张图片为主功能全但价格高一句话总评把免费、离线、批量三件事同时做到多数替代方案只能占其一。从解压到第一次截图 OCR 成功10 分钟起步解压即启动。下载.7z压缩包或.7z.exe自解压包解压后双击Umi-OCR.exe。没有安装向导不装任何依赖。结果主窗口打开界面语言跟随系统自动切换中文用户零配置。做第一次截图识别。打开截图 OCR标签页按下全局快捷键唤起截图框框选屏幕上任意文字区域松手。结果几秒内右侧记录面板自动输出该区域的识别文字。把结果拿走。在记录面板里CtrlC整段复制或划选单行只复制那一句识别不准的字可以直接手动改。结果文字进入你的文档第一个 OCR 任务跑通。三步不到 10 分钟日常最高频的截图识字需求已经覆盖。按场景选择 Umi-OCR 功能批量识别、PDF 文档识别当你需要一次跑完几百张图片批量 OCR把整个图片文件夹拖进批量 OCR列表即可支持 jpg、png、webp、bmp、tif 等常见格式没有数量上限几百张可以一次导入。点开始任务顶部实时显示进度条结果可保存为 txt、jsonl、md、csv 共 4 种格式其中 csv 能被 Excel 直接打开勾选任务完成后自动关机/待机晚上挂机第二天早上直接收结果 同一页还提供排版解析方案代码截图选单栏-保留缩进行首缩进和行中空格会完整保留。当你要把扫描版 PDF 变成可搜索文档文档识别把 pdf、epub、mobi、xps、fb2、cbz 共 6 种格式拖进文档识别页原生带文本层的直接提取扫描图片走 OCR还能输出双层可搜索 PDF——旧扫描件获得一层隐形文字全文可搜索、可复制、可划选。在设置里用忽略区域按住右键画矩形框掉页眉、页脚和红章的位置注意忽略单位是整个文本块而非单个字符画框时把目标完全包进去。当你想把 OCR 接进脚本和自动化命令行与 HTTP 接口命令行入口就是主程序Umi-OCR.exe本身一条指令即可识别指定文件夹umi-ocr --path D:/scans # 识别文件夹内所有图片 umi-ocr --help # 查看全部参数HTTP 接口则把它变成可供其他程序调用的本地 OCR 引擎上传文件拿任务 ID、轮询状态、下载结果文件完整协议见 HTTP接口手册。想二次开发直接克隆源码git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR遇到问题先查这里问大长图识别总丢字是怎么回事现象网页长图、大尺寸海报识别结果残缺。原因设置里限制图像边长默认值偏小超大图先被压缩再识别。解法批量页设置 → 文字识别 → 限制图像边长从默认 960 调高到 2880是质量与速度的平衡点。问水印、页眉页脚怎么总混进结果里现象识别论文时每页顶部标题重复出现。原因没有排除干扰区域。解法在批量/文档识别页进入忽略区域按住右键把页眉页脚完整框住矩形宁大勿小。问双栏论文识别出来顺序全串了现象左栏读一半跳到右栏段落错乱。原因默认输出不区分多栏布局。解法排版解析方案改选多栏-按自然段换行按阅读顺序重排输出。问从 PDF 里复制文字为什么一片空白现象打开 PDF 选不中任何文字。原因这是纯扫描件本身没有文本层。解法文档识别页选择对整页执行 OCR而非仅提取文本层并勾选输出双层 PDF一次处理长期受益。收尾三件事就能跑起来回到开头那份 80 页合同把它拖进文档识别用忽略区域框掉两处红章几分钟就能拿到一份能搜索、能复制的双层 PDF——全程断网文件没离开过这台电脑。免费、离线、免安装同时成立就是它最大的价值。现在就做 3 件事下载.7z解压包双击Umi-OCR.exe启动用快捷键截一张图把识别结果复制出来拖一个 PDF 进文档识别页输出一份双层 PDF。命令行爱好者翻翻 命令行手册接口开发者看 HTTP接口手册版本演进参考 更新日志。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门