拓冰建站拓冰建站
首页 / 资讯中心 / 正文

Umi-OCR Linux 配置与使用:5 步跑通离线桌面 OCR

Umi-OCR Linux 配置与使用5 步跑通离线桌面 OCR【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费开源、完全离线的 Linux 桌面 OCR 工具。本文从下载解压、首次启动讲起覆盖截图即时识别、批量图片识别、结构化文档三大场景再到快捷方式、终端别名与自动化脚本最后给出排障速查和配置备份方法一次把工具跑顺。 准备与首次启动下载、解压与第一次运行发行版是.7z压缩包解压即用不需要安装步骤。仓库里也附带了一个含 RapidOCR 引擎的样例包 Umi-OCR_Rapid_v2.1.5.7z可用来熟悉目录结构。下载 Linux x64 版本解压到不含中文和空格的路径例如/opt/Umi-OCR。赋予启动脚本执行权限并首次运行chmod x /opt/Umi-OCR/umi-ocr.sh /opt/Umi-OCR/umi-ocr.sh预期弹出主窗口语言跟随系统自动切换标签页区域正常加载引擎。首启检查三件事界面是否闪烁或错位若有去“全局设置”把“渲染器”换成其他渲染方案或关闭硬件加速语言是否符合习惯之后可在“全局设置 → 语言”里手改OCR 引擎是否加载完成。首次启动按系统语言自动切换界面支持中文、英文、日文等。 三大高频场景截图、批量与结构化识别截图即时识别场景屏幕上的文字要转录下来直接用。打开“截图OCR”标签页。按全局快捷键进入截图框选Esc取消。识别后左侧是原图预览可鼠标划选直接复制右侧是识别记录列表可编辑、合并、划选多条复制。在别处复制的图片也能粘贴进来识别。预期文字落在右侧记录栏右键即有“复制”菜单。截图OCR页左侧图片预览右侧可编辑的识别记录。识别记录支持编辑、多选与复制。批量图片识别场景几十张图片要一次性转录。在“批量OCR”页导入本地图片支持jpg、png、bmp、tiff、webp等格式数量不设上限。选择结果格式txt、jsonl、mdMarkdown、csvExcel 可读。图片带固定水印或页眉页脚时进“忽略区域”编辑器用右键画出覆盖水印的矩形框框内文字不进结果。排版选一个文本后处理方案例如“多栏-按自然段换行”。开始任务等进度条走完结果按所选目录、与图片同名输出。预期任务结束后输出目录里出现对应的结果文件。批量OCR页左侧图片列表右侧引擎与输出格式设置。结构化文档代码与表格场景代码截图要保留缩进或文档是多栏排版。代码截图后处理方案选“单栏-保留缩进”保留行首缩进与行中空格。多栏文字选“多栏-按自然段换行”让阅读顺序自动理顺。表格先按文本识别输出为 CSV再用 Excel 打开逐行整理。预期代码缩进与原图一致多栏文字顺序不乱。代码截图识别缩进与换行基本保留。⚡ 效率升级快捷方式、右键菜单与终端别名桌面快捷方式.desktop文件是 Linux 桌面为应用入口准备的说明文件程序启动器靠它生成菜单项。新建~/.local/share/applications/umi-ocr.desktop写入[Desktop Entry] TypeApplication NameUmi-OCR Comment离线OCR文字识别 Exec/opt/Umi-OCR/umi-ocr.sh Terminalfalse CategoriesUtility;Office;Graphics;刷新桌面数据库chmod 644 ~/.local/share/applications/umi-ocr.desktop update-desktop-database ~/.local/share/applications预期应用程序菜单里能搜到“Umi-OCR”点击直接启动。文件管理器右键菜单不同桌面环境的机制不同GNOME 看脚本目录KDE 看服务菜单思路一致在~/.local/share/applications/下再建一个.desktop条目Exec写umi-ocr.sh --path 图片路径。声明MimeTypeimage/png;image/jpeg;等图片类型——MIME 类型相当于系统给文件贴的“类型标签”声明后图片文件就会关联到该程序。完成后右键任意图片菜单里会出现用 Umi-OCR 识别的选项。终端别名# 追加到 ~/.bashrc 或 ~/.zshrc 末尾 alias uocr/opt/Umi-OCR/umi-ocr.sh alias uocr-shotuocr --screenshot --clip alias uocr-runuocr --path预期source ~/.bashrc后终端输入uocr-shot即截图并把结果复制进剪贴板。 自动化shell 脚本批量识别目录图片命令行通过本地环回的 HTTP 服务把参数传给后台进程默认开启不出局域网参数细则见命令行手册另有HTTP接口手册可供程序调用。下面脚本逐张处理输入目录里的图片结果按同名写入输出目录#!/usr/bin/env bash # batch_ocr.sh IN_DIR$HOME/scan OUT_DIR$HOME/scan_result mkdir -p $OUT_DIR for img in $IN_DIR/*.{jpg,jpeg,png,bmp,tiff,webp}; do [ -f $img ] || continue base$(basename ${img%.*}) /opt/Umi-OCR/umi-ocr.sh --path $img --output $OUT_DIR/$base.txt done预期scan_result目录里出现与每张图同名的.txt。前一条识别结束前不要发下一条命令。两条提示先在“截图OCR”标签页关掉“显示主窗口”命令行任务才不会每次弹 GUI--path也支持直接传目录若不需要一图一文件一条--path $IN_DIR就够。 排障速查图标无响应、识别不准、批量变慢点图标没反应终端里手动执行/opt/Umi-OCR/umi-ocr.sh看具体报错。确认脚本有执行权限ls -l查看必要时chmod x。若提示缺库用ldd --version查看发行版 glibc 版本换匹配系统的发行版。识别不准在“全局设置”切换 OCR 引擎Rapid 兼容性好Paddle 速度稍快可各试一轮。图片过大时调高“页面设置 → 文字识别 → 限制图像边长”避免细节被压缩。文字顺序乱就换排版解析方案水印干扰就加忽略区域。批量识别慢分批导入别一次塞几百张。适当调低“限制图像边长”减少计算量。关闭用不到的标签页把内存和 CPU 留给引擎。 数据备份与迁移配置文件位置与迁移方法界面上做的所有设置都写在部署目录下的UmiOCR-data/.settingsini 格式里UmiOCR-data还存放引擎插件与多语言文件。备份直接复制整个UmiOCR-data目录或只备份.settings一个文件。迁移软件是绿色便携的把部署目录整体搬到新机器再运行umi-ocr.sh设置自动生效。若手改过.settings保存后执行umi-ocr --reloadv2.1.5 以上支持即可重新加载并刷新设置界面。预期迁移后语言、引擎、快捷键等设置与原来一致。收束五条最佳实践定期更新到新版发行版性能修复和新功能都在更新日志里。同类文档预先存成“页面模板”下次一键打开省去重设参数。固定水印的图片忽略区域画一次后续同批图片直接复用。把截图识别绑到顺手的热键上养成肌肉记忆。迁移或重装系统前先备份UmiOCR-data设置不丢。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门