欧美bbbwbbbw肥妇,免费乱码人妻系列日韩,一级黄片

python如何實現(xiàn)圖片轉文字

 更新時間:2023年03月25日 09:18:50   作者:kaivis_new  
這篇文章主要介紹了python如何實現(xiàn)圖片轉文字問題,具有很好的參考價值,希望對大家有所幫助。如有錯誤或未考慮完全的地方,望不吝賜教

python圖片轉文字

用python+Tesseract-OCR做了一個圖片轉文字的小工具,GUI設計使用tkinter庫的控件

界面及效果見下圖:

#進一步優(yōu)化  1. 底部添加label   2.對識別后的文本處理,去空格


from PIL import Image as PImage
from PIL import ImageTk
import pytesseract
from tkinter import *
from tkinter import filedialog
from tkinter.scrolledtext import ScrolledText
import re

# 將圖片內(nèi)容翻譯為文字,顯示在文本框內(nèi)
def trans():
    contents.delete('1.0', END)
    transTxt = pytesseract.image_to_string(PImage.open(filePath.get()),lang='chi_sim')
    #對transTxt進行處理  去空格,換行符去重
    transTxt = transTxt.strip('\n\r')   #無參數(shù)可以刪除開頭結尾的空格\n\t\r
    print(transTxt)
    contents.insert( INSERT, transTxt.replace(' ','').replace('\n\n','\n').replace('\r',''))

#打開圖片文件,顯示路徑,并將圖片展現(xiàn)
def openfile():
    filename.delete('1.0', END)
    filePath.set(filedialog.askopenfilename())
    filename.insert(1.0,filePath.get())
    org_img = PImage.open(filePath.get())
    #調(diào)整圖片顯示大小 600*800
    w,h = org_img.size
    if w>600:
        h=int(h*600/w)
        w=600
    if h>800:
        w=int(w*800/h)
        h=800
    img = ImageTk.PhotoImage(org_img.resize((w,h)))
    showPic.config(image=img)
    showPic.image = img       #保持一個引用才能顯示圖片,tkinter的BUG
    

#設置主窗口
top = Tk()
top.title("OCR圖片轉文字  引擎:Tesseract-OCR  Made by: kaivis")
#top.iconbitmap("./pic/y1.ico")
top.geometry("1200x800")

filePath=StringVar()

bt_img1 = ImageTk.PhotoImage( file= "./pic/Outbox1.png")
bt_img2 = ImageTk.PhotoImage( file= "./pic/bt_img2.png")

#第一個窗體
frame1 = Frame (top, relief=RAISED, borderwidth=2)
frame1.pack(side=TOP, fill=BOTH,  ipady=5, expand=0)
Label(frame1,height=1,text="圖片路徑:").pack(side=LEFT)
filename = Text(frame1,height=2)
filename.pack(side=LEFT,padx=1, pady=0,expand=True, fill=X)
Button(frame1,text="打開文件", image=bt_img1, command=openfile).pack(side=LEFT,padx=5, pady=0)
Button(frame1,text="中文識別", image=bt_img2, command=trans).pack(side=LEFT,padx=5, pady=0)

#第二個窗體
frame2 = Frame (top, relief=RAISED, borderwidth=2)
frame2.pack (side=LEFT, fill=BOTH,  expand=1)
Label(frame2,text='圖片顯示:',borderwidth=5).pack(side=TOP,padx=20,pady=5)
showPic = Label(frame2,text='圖片顯示區(qū)')
showPic.pack(side=BOTTOM,expand=1,fill=BOTH)

#第三個窗體
frame3 = Frame (top)
frame3.pack (side=RIGHT, fill=BOTH,  expand=1)
#contents = ScrolledText(frame3)
Label(frame3,text='識別結果:',borderwidth=5).pack(side=TOP,padx=20,pady=10)
contents = Text(frame3,font=('Arial',15))
contents.pack(side=TOP,expand=1,fill=BOTH)
Label(frame3,text='Copyright 2021 baidu.com ALL Rights Reserved',borderwidth=5).pack(side=BOTTOM,padx=20,pady=10)

top.mainloop()

存在的問題:

  • 識別率不高,對緊密型的漢字更是難以做到較高的準確率,有沒有更好的OCR引擎呢
  • 識別后的文字已經(jīng)做了去空格處理 ,文本可以進一步優(yōu)化,特別是多余的換行符需要處理

python截圖轉文字功能

由于在網(wǎng)上找資料時,經(jīng)常遇到文章無法復制的情況,為了能夠快速copy想要的文字,于是就想寫一個python程序去實現(xiàn)截圖轉文字的功能。

1. 思路

首先要有記錄鍵盤的功能(讓程序知道你在截圖) - keyboard庫截圖后需要接收圖像 - ImageGrab庫獲取圖像后要進行文字識別 - 百度AI文字識別API

2. 實現(xiàn)

2.1 導入相關庫

2.2 創(chuàng)建類,并編寫實現(xiàn)截圖保存的函數(shù)

由于我使用的是win10自帶的截圖軟件,所以截圖熱鍵為‘win+shift+s’,大家可以根據(jù)截圖軟件的不同自由更改。

2.3 編寫圖片轉文字的函數(shù)

先去百度智能云官網(wǎng)申請一個圖像識別的API。

將參數(shù)寫入程序:

編寫轉文字函數(shù):

2.5 運行

使用時創(chuàng)建類,調(diào)用兩個函數(shù)即可:

2.6 效果

運行程序,隨意在百度文庫的一篇文章里截一張圖:

結果如下:

注意:

由2.6運行結果可知,效果還是不錯的。完美解決了我當前的需求。

總結

以上為個人經(jīng)驗,希望能給大家一個參考,也希望大家多多支持腳本之家。

相關文章

  • 離線安裝Pyecharts的步驟以及依賴包流程

    離線安裝Pyecharts的步驟以及依賴包流程

    這篇文章主要介紹了離線安裝Pyecharts的步驟以及依賴包流程,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2017-03-03
  • 6個實用的Python自動化腳本詳解

    6個實用的Python自動化腳本詳解

    每天你都可能會執(zhí)行許多重復的任務,例如閱讀 pdf、播放音樂、查看天氣、打開書簽、清理文件夾等等,使用自動化腳本,就無需手動一次又一次地完成這些任務,非常方便??旄S小編一起試一試吧
    2022-01-01
  • PyTorch的Debug指南

    PyTorch的Debug指南

    這篇文章主要介紹了PyTorch的Debug的相關資料,幫助大家更好的理解和學習使用PyTorch,感興趣的朋友可以了解下
    2021-05-05
  • Python Tkinter Entry和Text的添加與使用詳解

    Python Tkinter Entry和Text的添加與使用詳解

    這篇文章主要介紹了Python Tkinter Entry和Text的添加與使用詳解,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2020-03-03
  • python實現(xiàn)在列表中查找某個元素的下標示例

    python實現(xiàn)在列表中查找某個元素的下標示例

    這篇文章主要介紹了python實現(xiàn)在列表中查找某個元素的下標示例,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧
    2020-11-11
  • pandas組內(nèi)排序,并在每個分組內(nèi)按序打上序號的操作

    pandas組內(nèi)排序,并在每個分組內(nèi)按序打上序號的操作

    這篇文章主要介紹了pandas組內(nèi)排序,并在每個分組內(nèi)按序打上序號的操作,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2021-03-03
  • Python json格式化打印實現(xiàn)過程解析

    Python json格式化打印實現(xiàn)過程解析

    這篇文章主要介紹了Python json格式化打印實現(xiàn)過程解析,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友可以參考下
    2020-07-07
  • Python基于回溯法子集樹模板解決0-1背包問題實例

    Python基于回溯法子集樹模板解決0-1背包問題實例

    這篇文章主要介紹了Python基于回溯法子集樹模板解決0-1背包問題,簡單描述了0-1背包問題并結合具體實例形式分析了Python使用回溯法子集樹模板解決0-背包問題的具體實現(xiàn)技巧,需要的朋友可以參考下
    2017-09-09
  • Python入門教程(三十)Python的PIP

    Python入門教程(三十)Python的PIP

    這篇文章主要介紹了Python入門教程(三十)Python的PIP,PIP是Python 包或模塊的包管理器,本章帶你們看一下如何使用PIP命令,需要的朋友可以參考下
    2023-04-04
  • Python PyTorch實現(xiàn)Timer計時器

    Python PyTorch實現(xiàn)Timer計時器

    這篇文章主要為大家詳細介紹了Python PyTorch如何實現(xiàn)簡單的Timer計時器,文中的示例代碼講解詳細,感興趣的小伙伴可以跟隨小編一起學習一下
    2023-08-08

最新評論