拓冰建站拓冰建站
首页 / 资讯中心 / 正文

轻量级中文OCR库:模型总共4.7M,一条命令拿回图片里的文字

轻量级中文OCR库模型总共4.7M一条命令拿回图片里的文字【免费下载链接】chineseocr_lite超轻量级中文ocr支持竖排文字识别, 支持ncnn、mnn、tnn推理 ( dbnet(1.8M) crnn(2.5M) anglenet(378KB)) 总模型仅4.7M项目地址: https://gitcode.com/gh_mirrors/ch/chineseocr_lite一堆报销单、发票堆在桌上字还得一个个敲进表格ChineseOCR_Lite 是个轻量级中文 OCR 开源库把照片交给命令行返回的就是带坐标框的结构化文本三个模型加起来只有 4.7M。 它解决什么问题单页图片上的轻量级中文文字识别定位一句话就能说清对照片和扫描件做中文文字检测与识别输出文本、置信度和坐标框可以直接被你的程序消费。推理全程纯 CPU不需要显卡模型小到你可以在配置不高的机器上直接跑竖排文字、倒置文字也在它的处理范围内这就是它敢自称“轻量级中文 OCR”的原因。 它是怎样认出字的YOLOV3 CRNN 两阶段识别流程可以把它想象成老师批改作业先圈出需要核对的语句再逐字朗读检查。这套中文 OCR 流程也是同样两步。第一步“找字”由 YOLOV3 检测器负责网格化快速预测擅长在整张图里迅速圈出文字的位置第二步“认字”交给 CRNN卷积 循环结构擅长“按顺序认一行字”把圈出来的行逐字读出来。Tesseract 作为后备引擎处理部分非结构化文本OpenCV 则负责沿途的图像预处理。仓库里还有第三个更小的模型 AngleNet约 378KB专门判断文字是否倒置。三个模型加起来只有 4.7M 左右加载快、占用低也正因为方向判断这一步倒着拍的照片照样能认。 哪些场景能直接跑起来中文OCR开源库的四个常见需求文档数字化场景下你输入一张旧发票扫描件得到的是带序号和坐标框的文本行可以直接落进表格做归档。安防场景下你输出一帧车牌或监控截图得到结构化的数字字母组合方便入库比对。电商场景下你输入一张货架标签照片得到商品名称与价格文本能和商品库自动对账。教育场景下你输入一张试卷照片得到题目和关键词文本后续复习、抽取都省事。最短上手路径三步跑通第一张图git clone https://gitcode.com/gh_mirrors/ch/chineseocr_lite pip install -r requirements.txt chineseocr test_imgs/res.jpgCLI 直接输出稳定 JSON适合脚本、批处理和自动化任务调用加--output result.json可以把结果写进文件。Python 端在 Windows、Linux、macOS 都能跑仓库里还带了 Android、C、JVM 的参考 Demo做 App 或端侧开发可以直接抄作业。模型文件可以看 models/多端 Demo 在 cpp_projects/。下一步把 Web 示例跑起来运行python backend/main.py终端打印出端口号后浏览器打开对应地址就是一个可以上传图片、当场看到中文 OCR 结果的页面。先跑通一张图觉得顺手就给项目点个 Star这是二次开发最好的起点。【免费下载链接】chineseocr_lite超轻量级中文ocr支持竖排文字识别, 支持ncnn、mnn、tnn推理 ( dbnet(1.8M) crnn(2.5M) anglenet(378KB)) 总模型仅4.7M项目地址: https://gitcode.com/gh_mirrors/ch/chineseocr_lite创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门