python如何實現(xiàn)圖片轉(zhuǎn)文字

更新時間：2023年03月25日 09:18:50 作者：kaivis_new

這篇文章主要介紹了python如何實現(xiàn)圖片轉(zhuǎn)文字問題，具有很好的參考價值，希望對大家有所幫助。如有錯誤或未考慮完全的地方，望不吝賜教

python圖片轉(zhuǎn)文字

用python+Tesseract-OCR做了一個圖片轉(zhuǎn)文字的小工具，GUI設(shè)計使用tkinter庫的控件

界面及效果見下圖：

#進(jìn)一步優(yōu)化  1. 底部添加label   2.對識別后的文本處理，去空格


from PIL import Image as PImage
from PIL import ImageTk
import pytesseract
from tkinter import *
from tkinter import filedialog
from tkinter.scrolledtext import ScrolledText
import re

# 將圖片內(nèi)容翻譯為文字，顯示在文本框內(nèi)
def trans():
    contents.delete('1.0', END)
    transTxt = pytesseract.image_to_string(PImage.open(filePath.get()),lang='chi_sim')
    #對transTxt進(jìn)行處理  去空格，換行符去重
    transTxt = transTxt.strip('\n\r')   #無參數(shù)可以刪除開頭結(jié)尾的空格\n\t\r
    print(transTxt)
    contents.insert( INSERT, transTxt.replace(' ','').replace('\n\n','\n').replace('\r',''))

#打開圖片文件，顯示路徑，并將圖片展現(xiàn)
def openfile():
    filename.delete('1.0', END)
    filePath.set(filedialog.askopenfilename())
    filename.insert(1.0,filePath.get())
    org_img = PImage.open(filePath.get())
    #調(diào)整圖片顯示大小 600*800
    w,h = org_img.size
    if w>600:
        h=int(h*600/w)
        w=600
    if h>800:
        w=int(w*800/h)
        h=800
    img = ImageTk.PhotoImage(org_img.resize((w,h)))
    showPic.config(image=img)
    showPic.image = img       #保持一個引用才能顯示圖片，tkinter的BUG
    

#設(shè)置主窗口
top = Tk()
top.title("OCR圖片轉(zhuǎn)文字  引擎：Tesseract-OCR  Made by: kaivis")
#top.iconbitmap("./pic/y1.ico")
top.geometry("1200x800")

filePath=StringVar()

bt_img1 = ImageTk.PhotoImage( file= "./pic/Outbox1.png")
bt_img2 = ImageTk.PhotoImage( file= "./pic/bt_img2.png")

#第一個窗體
frame1 = Frame (top, relief=RAISED, borderwidth=2)
frame1.pack(side=TOP, fill=BOTH,  ipady=5, expand=0)
Label(frame1,height=1,text="圖片路徑：").pack(side=LEFT)
filename = Text(frame1,height=2)
filename.pack(side=LEFT,padx=1, pady=0,expand=True, fill=X)
Button(frame1,text="打開文件", image=bt_img1, command=openfile).pack(side=LEFT,padx=5, pady=0)
Button(frame1,text="中文識別", image=bt_img2, command=trans).pack(side=LEFT,padx=5, pady=0)

#第二個窗體
frame2 = Frame (top, relief=RAISED, borderwidth=2)
frame2.pack (side=LEFT, fill=BOTH,  expand=1)
Label(frame2,text='圖片顯示：',borderwidth=5).pack(side=TOP,padx=20,pady=5)
showPic = Label(frame2,text='圖片顯示區(qū)')
showPic.pack(side=BOTTOM,expand=1,fill=BOTH)

#第三個窗體
frame3 = Frame (top)
frame3.pack (side=RIGHT, fill=BOTH,  expand=1)
#contents = ScrolledText(frame3)
Label(frame3,text='識別結(jié)果：',borderwidth=5).pack(side=TOP,padx=20,pady=10)
contents = Text(frame3,font=('Arial',15))
contents.pack(side=TOP,expand=1,fill=BOTH)
Label(frame3,text='Copyright 2021 baidu.com ALL Rights Reserved',borderwidth=5).pack(side=BOTTOM,padx=20,pady=10)

top.mainloop()

存在的問題：