python如何實(shí)現(xiàn)圖片轉(zhuǎn)文字
python圖片轉(zhuǎn)文字
用python+Tesseract-OCR做了一個圖片轉(zhuǎn)文字的小工具,GUI設(shè)計使用tkinter庫的控件
界面及效果見下圖:


#進(jìn)一步優(yōu)化 1. 底部添加label 2.對識別后的文本處理,去空格
from PIL import Image as PImage
from PIL import ImageTk
import pytesseract
from tkinter import *
from tkinter import filedialog
from tkinter.scrolledtext import ScrolledText
import re
# 將圖片內(nèi)容翻譯為文字,顯示在文本框內(nèi)
def trans():
contents.delete('1.0', END)
transTxt = pytesseract.image_to_string(PImage.open(filePath.get()),lang='chi_sim')
#對transTxt進(jìn)行處理 去空格,換行符去重
transTxt = transTxt.strip('\n\r') #無參數(shù)可以刪除開頭結(jié)尾的空格\n\t\r
print(transTxt)
contents.insert( INSERT, transTxt.replace(' ','').replace('\n\n','\n').replace('\r',''))
#打開圖片文件,顯示路徑,并將圖片展現(xiàn)
def openfile():
filename.delete('1.0', END)
filePath.set(filedialog.askopenfilename())
filename.insert(1.0,filePath.get())
org_img = PImage.open(filePath.get())
#調(diào)整圖片顯示大小 600*800
w,h = org_img.size
if w>600:
h=int(h*600/w)
w=600
if h>800:
w=int(w*800/h)
h=800
img = ImageTk.PhotoImage(org_img.resize((w,h)))
showPic.config(image=img)
showPic.image = img #保持一個引用才能顯示圖片,tkinter的BUG
#設(shè)置主窗口
top = Tk()
top.title("OCR圖片轉(zhuǎn)文字 引擎:Tesseract-OCR Made by: kaivis")
#top.iconbitmap("./pic/y1.ico")
top.geometry("1200x800")
filePath=StringVar()
bt_img1 = ImageTk.PhotoImage( file= "./pic/Outbox1.png")
bt_img2 = ImageTk.PhotoImage( file= "./pic/bt_img2.png")
#第一個窗體
frame1 = Frame (top, relief=RAISED, borderwidth=2)
frame1.pack(side=TOP, fill=BOTH, ipady=5, expand=0)
Label(frame1,height=1,text="圖片路徑:").pack(side=LEFT)
filename = Text(frame1,height=2)
filename.pack(side=LEFT,padx=1, pady=0,expand=True, fill=X)
Button(frame1,text="打開文件", image=bt_img1, command=openfile).pack(side=LEFT,padx=5, pady=0)
Button(frame1,text="中文識別", image=bt_img2, command=trans).pack(side=LEFT,padx=5, pady=0)
#第二個窗體
frame2 = Frame (top, relief=RAISED, borderwidth=2)
frame2.pack (side=LEFT, fill=BOTH, expand=1)
Label(frame2,text='圖片顯示:',borderwidth=5).pack(side=TOP,padx=20,pady=5)
showPic = Label(frame2,text='圖片顯示區(qū)')
showPic.pack(side=BOTTOM,expand=1,fill=BOTH)
#第三個窗體
frame3 = Frame (top)
frame3.pack (side=RIGHT, fill=BOTH, expand=1)
#contents = ScrolledText(frame3)
Label(frame3,text='識別結(jié)果:',borderwidth=5).pack(side=TOP,padx=20,pady=10)
contents = Text(frame3,font=('Arial',15))
contents.pack(side=TOP,expand=1,fill=BOTH)
Label(frame3,text='Copyright 2021 baidu.com ALL Rights Reserved',borderwidth=5).pack(side=BOTTOM,padx=20,pady=10)
top.mainloop()
存在的問題:
- 識別率不高,對緊密型的漢字更是難以做到較高的準(zhǔn)確率,有沒有更好的OCR引擎呢
- 識別后的文字已經(jīng)做了去空格處理 ,文本可以進(jìn)一步優(yōu)化,特別是多余的換行符需要處理
python截圖轉(zhuǎn)文字功能
由于在網(wǎng)上找資料時,經(jīng)常遇到文章無法復(fù)制的情況,為了能夠快速copy想要的文字,于是就想寫一個python程序去實(shí)現(xiàn)截圖轉(zhuǎn)文字的功能。

1. 思路
首先要有記錄鍵盤的功能(讓程序知道你在截圖) - keyboard庫截圖后需要接收圖像 - ImageGrab庫獲取圖像后要進(jìn)行文字識別 - 百度AI文字識別API
2. 實(shí)現(xiàn)
2.1 導(dǎo)入相關(guān)庫

2.2 創(chuàng)建類,并編寫實(shí)現(xiàn)截圖保存的函數(shù)
由于我使用的是win10自帶的截圖軟件,所以截圖熱鍵為‘win+shift+s’,大家可以根據(jù)截圖軟件的不同自由更改。

2.3 編寫圖片轉(zhuǎn)文字的函數(shù)
先去百度智能云官網(wǎng)申請一個圖像識別的API。

將參數(shù)寫入程序:

編寫轉(zhuǎn)文字函數(shù):

2.5 運(yùn)行
使用時創(chuàng)建類,調(diào)用兩個函數(shù)即可:

2.6 效果
運(yùn)行程序,隨意在百度文庫的一篇文章里截一張圖:

結(jié)果如下:

注意:
由2.6運(yùn)行結(jié)果可知,效果還是不錯的。完美解決了我當(dāng)前的需求。
總結(jié)
以上為個人經(jīng)驗(yàn),希望能給大家一個參考,也希望大家多多支持腳本之家。
相關(guān)文章
使用pyshp包進(jìn)行shapefile文件修改的例子
今天小編就為大家分享一篇使用pyshp包進(jìn)行shapefile文件修改的例子,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧2019-12-12
Python-pip配置國內(nèi)鏡像源快速下載包的方法詳解
pip如果不配置國內(nèi)鏡像源的話,下載包的速度非常慢,畢竟默認(rèn)的源在國外呢,這篇文章主要介紹了Python-pip配置國內(nèi)鏡像源快速下載包的方法詳解,需要的朋友可以參考下2024-01-01
天翼開放平臺免費(fèi)短信驗(yàn)證碼接口使用實(shí)例
天翼開放平臺提供了一個免費(fèi)的短信驗(yàn)證碼API,下面看看使用方法吧,我們用python開發(fā)接口2013-12-12
tensorflow基于CNN實(shí)戰(zhàn)mnist手寫識別(小白必看)
這篇文章主要介紹了tensorflow基于CNN實(shí)戰(zhàn)mnist手寫識別(小白必看),文中通過示例代碼介紹的非常詳細(xì),對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價值,需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧2020-07-07
python中的數(shù)據(jù)結(jié)構(gòu)比較
這篇文章主要介紹了python中的數(shù)據(jù)結(jié)構(gòu)比較,本文給大家介紹的非常詳細(xì),具有一定的參考借鑒價值,需要的朋友可以參考下2019-05-05
詳解Python如何實(shí)現(xiàn)惰性導(dǎo)入-lazy import
如果你的 Python 程序程序有大量的 import,而且啟動非常慢,那么你應(yīng)該嘗試懶導(dǎo)入,本文分享一種實(shí)現(xiàn)惰性導(dǎo)入的一種方法,需要的可以參考一下2022-10-10

