【案例】python集成OCR识别工具调研

一、前言

因项目需要OCR识别能力,且要支持私有化部署。本文将对比市场一些开源的OCR识别工具,从中选择适合项目需要的OCR,且后续进一步研究/训练对应OCR模型。
主要OCR识别有:Tesseract_OCR、PaddleOCR、EasyOCR、dddd_ocr、CnOCR
备注说明:后面的图片测试使用如下
请添加图片描述

二、Tesseract_OCR

Pillow是一个免费开源的图像处理库,它可以用来读取、操作和保存各种各样的图片文件。Tesseract-OCR则是一个强大的光学字符识别引擎,可以离线识别,可以准确地识别图像中的文字,要配合本地安装tesseract-ocr.exe文件一起使用。
Tesseract-OCR特点:

  • Tesseract支持UTF-8编码格式,并且可以“开箱即用”地识别100多种语言
  • Tesseract支持多种输出格式:纯文本,hOCR(HTML),PDF等
  • 官方建议,为了获得更好的OCR结果,最好提供给高质量的图像
  • Tesseract进行识别其他语言的训练,具体的训练方式请参考官方提供的文档:https://tesseract-ocr.github.io/tessdoc/

2.1、安装过程

安装环境

相关推荐

  1. python调用微信自带OCR实现内容识别(全)

    2024-07-11 01:44:04       14 阅读
  2. python图片字符识别Tessreact库OCR

    2024-07-11 01:44:04       21 阅读
  3. Ocr识别

    2024-07-11 01:44:04       17 阅读

最近更新

  1. 基于python的时空地理加权回归(GTWR)模型

    2024-07-11 01:44:04       0 阅读
  2. c++端的类,作为组件在qml端使用

    2024-07-11 01:44:04       0 阅读
  3. Python笔记(3)

    2024-07-11 01:44:04       0 阅读
  4. 生成表的DDL语句没有字段描述和表名描述

    2024-07-11 01:44:04       0 阅读
  5. bitset和set总结

    2024-07-11 01:44:04       1 阅读
  6. Flask校验

    2024-07-11 01:44:04       1 阅读
  7. 基带成型(脉冲成形)

    2024-07-11 01:44:04       1 阅读

热门阅读

  1. Spring源码(二) refresh () 方法

    2024-07-11 01:44:04       7 阅读
  2. GraalVM简介及使用

    2024-07-11 01:44:04       6 阅读
  3. 徐州服务器租用:论带宽的作用有哪些

    2024-07-11 01:44:04       7 阅读
  4. 1. Go 九九乘法表

    2024-07-11 01:44:04       7 阅读
  5. Perl词法作用域:自定义编程环境的构建术

    2024-07-11 01:44:04       6 阅读
  6. SQL Server 设置端口详解

    2024-07-11 01:44:04       6 阅读
  7. MyBatis 框架核心及面试知识要点

    2024-07-11 01:44:04       7 阅读