tesseract-ocr一站式安装与使用

2024-04-06 03:12

本文主要是介绍tesseract-ocr一站式安装与使用,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

目录

前言

安装tesseract-ocr

添加环境变量

1、在path中添加

2、在系統變量中添加

3、验证是否添加成功

添加语言包

更多语言包下载

示例程序


前言

如果你遇到了:make sure the TESSDATA_PREFIX Failed loading language \‘chi_sim

那么就是语言包缺少这个!chi_sim!!!请看下面内容

首先,你得找一篇文章了解tesseract-ocr

Tesseract-OCR 是一个开源的光学字符识别引擎,可以用于从图像中提取文本信息。它最初由惠普实验室开发,后来被谷歌收购并开源。Tesseract 可以识别多种语言,并且在处理复杂的文档布局时表现良好。

Tesseract 使用的是深度学习和模式识别算法来识别图像中的字符,并将其转换成计算机可处理的文本数据。它支持多种操作系统,包括 Windows、Linux 和 macOS,并提供了多种编程语言的接口,比如 Python、Java 和 C++,使得开发者可以方便地集成到各种应用程序中进行文字识别。

Tesseract-OCR 被广泛应用于文档处理、图像识别、自动化办公、数字化档案等领域,为用户提供了快速、准确地从图像中提取文本的能力。

今天给同学跑项目,他的项目用到了tesseract-ocr

结果搞半天,百度出来的CSDN链接,下载那些包,还全部要钱,大无语...

总结:

1、直接开着梯子去GitHub下载最新版的【tesseract-ocr】
2、然后直接选择需要识别的语言类型(一般我们需要识别中文的,就选择一下中文就行了)


安装包+中文识别语言包,我都放在蓝奏云了,可以直接安装,然后跑demo

跟着下面教程内容走就行了

最后就可以直接跑demo了!

安装tesseract-ocr

Releases · UB-Mannheim/tesseract (github.com) 直接进去下载最新版即可

安装包——蓝奏云备份:

tesseract-ocr-w64-setup-5.3.3.20231005.zip - 蓝奏云文件大小:47.8 M|icon-default.png?t=N7T8https://wwm.lanzout.com/i8bPj1tzz21e

接下来一路ok就行了——就只有在语言下载那里,需要开梯子

需要开梯子

需要开梯子

需要开梯子

不然会下载语言包失败!!!

不然会下载语言包失败!!!

不然会下载语言包失败!!!

注意这里!!!

注意这里!!!

注意这里!!!

自己记着安装路径——以后要加环境变量

自己记着安装路径——以后要加环境变量

自己记着安装路径——以后要加环境变量

添加环境变量

1、在path中添加

 tesseract-ocr ——【找到自己的安装路径】

我的:D:\Tesseract-OCR

2、在系統變量中添加

变量名:TESSDATA_PREFIX

变量值:D:\Tesseract-OCR\tessdata

3、验证是否添加成功

打开cmd ->输入命令

tesseract -v

添加语言包

语言包下载

如果你没有梯子,在这里下载失败了,就可以单独下载语言包

如果你没有梯子,在这里下载失败了,就可以单独下载语言包

如果你没有梯子,在这里下载失败了,就可以单独下载语言包

蓝奏云备份(这里是中文语言包):

tessdata语言包-中文+英文.zip - 蓝奏云文件大小:7.4 M|icon-default.png?t=N7T8https://wwm.lanzout.com/iT9K41u00y2d把语言包——放在这里面就行了!!!

把语言包——放在这里面就行了!!!

把语言包——放在这里面就行了!!!

更多语言包下载

GitCode - 开发者的代码家园icon-default.png?t=N7T8https://gitcode.com/tesseract-ocr/tessdata/tree/main

示例程序

pip install Pillow pytesseract
from PIL import Image
import pytesseract# 使用 pytesseract 进行文字识别,lang 参数指定识别语言为简体中文
text = pytesseract.image_to_string(Image.open(r'D:\333.png'),lang='chi_sim')
print(text)

其他

from PIL import Image
import pytesseract# 设置 Tesseract 路径(根据你的安装路径修改)
pytesseract.pytesseract.tesseract_cmd = r"C:\Program Files (x86)\Tesseract-OCR\tesseract.exe"# 打开图像文件
image_path = r'D:\333.png'
image = Image.open(image_path)# 使用 pytesseract 进行文字识别,lang 参数指定识别语言为简体中文
text = pytesseract.image_to_string(image, lang='chi_sim')# 打印识别结果
print(text)

这篇关于tesseract-ocr一站式安装与使用的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/878859

相关文章

从零教你安装pytorch并在pycharm中使用

《从零教你安装pytorch并在pycharm中使用》本文详细介绍了如何使用Anaconda包管理工具创建虚拟环境,并安装CUDA加速平台和PyTorch库,同时在PyCharm中配置和使用PyTor... 目录背景介绍安装Anaconda安装CUDA安装pytorch报错解决——fbgemm.dll连接p

Vue项目的甘特图组件之dhtmlx-gantt使用教程和实现效果展示(推荐)

《Vue项目的甘特图组件之dhtmlx-gantt使用教程和实现效果展示(推荐)》文章介绍了如何使用dhtmlx-gantt组件来实现公司的甘特图需求,并提供了一个简单的Vue组件示例,文章还分享了一... 目录一、首先 npm 安装插件二、创建一个vue组件三、业务页面内 引用自定义组件:四、dhtmlx

使用Python创建一个能够筛选文件的PDF合并工具

《使用Python创建一个能够筛选文件的PDF合并工具》这篇文章主要为大家详细介绍了如何使用Python创建一个能够筛选文件的PDF合并工具,文中的示例代码讲解详细,感兴趣的小伙伴可以了解下... 目录背景主要功能全部代码代码解析1. 初始化 wx.Frame 窗口2. 创建工具栏3. 创建布局和界面控件4

一文详解如何在Python中使用Requests库

《一文详解如何在Python中使用Requests库》:本文主要介绍如何在Python中使用Requests库的相关资料,Requests库是Python中常用的第三方库,用于简化HTTP请求的发... 目录前言1. 安装Requests库2. 发起GET请求3. 发送带有查询参数的GET请求4. 发起PO

Java中的Cursor使用详解

《Java中的Cursor使用详解》本文介绍了Java中的Cursor接口及其在大数据集处理中的优势,包括逐行读取、分页处理、流控制、动态改变查询、并发控制和减少网络流量等,感兴趣的朋友一起看看吧... 最近看代码,有一段代码涉及到Cursor,感觉写法挺有意思的。注意是Cursor,而不是Consumer

Node.js net模块的使用示例

《Node.jsnet模块的使用示例》本文主要介绍了Node.jsnet模块的使用示例,net模块支持TCP通信,处理TCP连接和数据传输,具有一定的参考价值,感兴趣的可以了解一下... 目录简介引入 net 模块核心概念TCP (传输控制协议)Socket服务器TCP 服务器创建基本服务器服务器配置选项服

mac安装nvm(node.js)多版本管理实践步骤

《mac安装nvm(node.js)多版本管理实践步骤》:本文主要介绍mac安装nvm(node.js)多版本管理的相关资料,NVM是一个用于管理多个Node.js版本的命令行工具,它允许开发者在... 目录NVM功能简介MAC安装实践一、下载nvm二、安装nvm三、安装node.js总结NVM功能简介N

如何使用CSS3实现波浪式图片墙

《如何使用CSS3实现波浪式图片墙》:本文主要介绍了如何使用CSS3的transform属性和动画技巧实现波浪式图片墙,通过设置图片的垂直偏移量,并使用动画使其周期性地改变位置,可以创建出动态且具有波浪效果的图片墙,同时,还强调了响应式设计的重要性,以确保图片墙在不同设备上都能良好显示,详细内容请阅读本文,希望能对你有所帮助...

Rust中的注释使用解读

《Rust中的注释使用解读》本文介绍了Rust中的行注释、块注释和文档注释的使用方法,通过示例展示了如何在实际代码中应用这些注释,以提高代码的可读性和可维护性... 目录Rust 中的注释使用指南1. 行注释示例:行注释2. 块注释示例:块注释3. 文档注释示例:文档注释4. 综合示例总结Rust 中的注释

python安装whl包并解决依赖关系的实现

《python安装whl包并解决依赖关系的实现》本文主要介绍了python安装whl包并解决依赖关系的实现,文中通过图文示例介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面... 目录一、什么是whl文件?二、我们为什么需要使用whl文件来安装python库?三、我们应该去哪儿下