python怎么读取图片中的文字？（Python图片提取文字）-FinClip官网

python怎么读取图片中的文字？（Python图片提取文字）

网友投稿 3016 2022-08-18

python怎么读取图片中的文字？（Python图片提取文字）

一、前言

不知道大家有没有遇到过这样的问题，就是在某个软件或者某个网页里面有一篇文章，你非常喜欢，但是不能复制。或者像百度文档一样，只能复制一部分，这个时候我们就会选择截图保存。但是当我们想用到里面的文字时，还是要一个字一个字打出来。那么我们能不能直接用Python识别图片中的文字呢？答案是肯定的。

二、Tesseract

文字识别是ORC的一部分内容，ORC的意思是光学字符识别，通俗讲就是文字识别。Tesseract是一个用于文字识别的工具，我们结合Python使用可以很快的实现文字识别。但是在此之前我们需要完成一个繁琐的工作。

（1）Tesseract的安装及配置

Tesseract的安装我们可以移步到该网址 https://digi.bib.uni-mannheim.de/tesseract/，我们可以看到如下界面：

有很多版本供大家选择，大家可以根据自己的需求选择。其中w32表示32位系统，w64表示64位系统，大家选择合适的版本即可，可能-速度比较慢，大家可以选择链接：https://pan.baidu.com/s/1YQCMnx-wCeNrJEE3wcEnQA 提取码：rbc6-。安装时我们需要知道我们安装的位置，将安装目录配置到系统path变量当中，我们路径是D:\CodeField\Tesseract-OCR。

我们右击我的电脑/此电脑->属性->高级系统设置->环境变量->Path->编辑->新建然后将我们的路径复制进去即可。添加好系统变量后后我们还需要依次点确定，这样才算配置好了。

（2）-语言包

Tesseract默认是不支持中文的，如果想要识别中文或者其它语言需要-相应的语言包，-如下： https://tesseract-ocr.github.io/tessdoc/Data-Files ，进入网站后我们往下翻：

其中有两个中文语言包，一个Chinese-Simplified和Chinese-Traditional，它们分别是简体中文和繁体中文，我们选择需要的-即可。-完成后我们需要放到Tesseract的路径下的tessdata目录下，我们路径是D:\CodeField\Tesseract-OCR\tessdata。

（3）其它模块-

除了上面的步骤，我们还需要-两个模块：

pip install pytesseract

pip install pillow

第一个是用于文字识别的，第二个是用于图片读取的。接下来我们就可以进行文字识别了。

三、文字识别

（1）单张图片识别

接下来的操作就要简单的多，下面是我们要识别的图片：

接下来就是我们文字识别的代码：

importpytesseract

fromPILimportImage

# 读取图片

im=Image.open('sentence.jpg')

# 识别文字

string=pytesseract.image_to_string(im)

print(string)

识别结果如下：

Do not go gentle into that good night!

因为默认是支持英文的，所以我们可以直接识别，但是当我们要识别中文或其它语言时就需要做些修改：

importpytesseract

fromPILimportImage

# 读取图片

im=Image.open('sentence.png')

# 识别文字，并指定语言

string=pytesseract.image_to_string(im, lang='chi_sim')

print(string)

在识别时，我们设置lang='chi_sim'，也就是把语言设置为简体中文，只有当你的tessdata目录下有简体中文包该设置才会生效。下面是我们用来识别的图片：

识别结果如下：

不要温顺的走进那个良夜

图片内容被准确识别出来了。有一点我们需要知道，在我们将语言设置为简体中文或其它语言后，Tesseract还是可以识别出英文字符。

（2）批量图片识别

既然我们把单张图片识别列出来了，就肯定还有批量图片识别这个功能，这就需要我们准备一个txt文件了，比如我有text.txt文件，内容如下：

sentence1.jpg

sentence2.jpg

我们将代码修改为如下：

importpytesseract

# 识别文字

string=pytesseract.image_to_string('text.txt', lang='chi_sim')

print(string)

但是这样自己写一个txt文件难免有些麻烦，因此我们又可以进行如下修改：

import os

import pytesseract

# 文字图片的路径

path = 'text_img/'

# 获取图片路径列表

imgs = [path + i for i in os.listdir(path)]

# 打开文件

f = open('text.txt', 'w+', encoding='utf-8')

# 将各个图片的路径写入text.txt文件当中

for img in imgs:

f.write(img + '\n')

# 关闭文件

f.close()

# 文字识别

string = pytesseract.image_to_string('text.txt', lang='chi_sim')

print(string)

这样我们只需要传入一个文字图片的根目录就可以批量进行识别了。在测试过程中发现，Tesseract对手写体、行楷等飘逸的字体识别不准确，对一些复杂的字识别也有待提升。但是宋体、印刷体等笔画严谨的字体识别准确率很高。另外如果图片的倾斜大于一定的角度，识别结果也会有很大差别。

前后端分离了，然后呢？（什么前后端分离）

3016 2022-08-18

python怎么读取图片中的文字？（Python图片提取文字）

前后端分离了，然后呢？（什么前后端分离）

Android开发套路收集整理与讨论

论文笔记：Inception Single Shot MultiBox Detector for object detection

最近发表

更多内容

小程序SDK

Finclip技术文档

小程序开发

小程序容器

小程序框架

Finclip小程序平台

Finclip用户投稿

车联网

推荐文章

小程序SDK是什么意思？小程序sdk和插件有什么区别？

小程序支付功能怎么实现？

企业app开发流程是什么？

app运营模式有哪些？

小程序多端引流怎么做？

小程序生态分析的机会和威胁

Flutter入门这一篇效率文章就够了

原生与跨平台解决方案分析,跨平台软件开发技术方案

热更新技术：让软件更新变得更加轻松快速

解决方案

银行解决方案

证券解决方案

互联网解决方案

政企OA解决方案

科技解决方案

loT解决方案

信任解决方案

热评文章

AppCan:基于混合模式的移动应用开发,移动混合模

Hybrid App混合模式开发的了解

小程序容器技术助力券商数字营销突围，小程序容器化的意

用mpvue开发微信小程序基础知识（vue.js开发

小程序多端框架全面测评对比，强烈推荐！

券商app架构 - 解析券商应用程序的构建与设计