Python爬蟲將爬取的圖片寫入world文檔的方法
作為初學(xué)爬蟲的我,無(wú)論是爬取文字還是圖片,都可以游刃有余的做到,但是爬蟲所爬取的內(nèi)容往往不是單獨(dú)的圖片或者文字,于是我就想是否可以將圖文保存至world文檔里,一開(kāi)始使用了如下方法保存圖片:
with open('123.doc','wb')as file: file.write(response.content) file.close()
結(jié)果就是,world文檔里出現(xiàn)了一堆亂碼,此法不同,我就開(kāi)始另尋他法,找了很久也沒(méi)有找到,只找到了關(guān)于Python操作world的方法。
于是我就開(kāi)始了新的思路:使用原來(lái)的方法將圖片保存下來(lái),再將圖片添加到world文檔里,最后將圖片刪除。這里使用的是python-dox庫(kù),代碼如下:
import requests from bs4 import BeautifulSoup import os import docx from docx import Document from docx.shared import Inches url = 'https://www.qiushibaike.com/article/119757360' html = requests.get(url).content soup = BeautifulSoup(html,'html.parser') wen = soup.find('div',{"class":"content"}).text img = str(soup.find('div',{"class":"thumb"})).split('src="')[1].split('"/')[0] tu = 'https:' + img img_name = img.split('/')[-1] #保存圖片至本地 with open(img_name,'wb')as f: response = requests.get(tu).content f.write(response) f.close() document = Document() document.add_paragraph(wen)#向文檔里添加文字 document.add_picture(img_name)#向文檔里添加圖片 document.save('tuwen.doc')#保存文檔 os.remove(img_name)#刪除保存在本地的圖片
最后,還是實(shí)現(xiàn)了將圖文保存在了world文檔里,盡管方法有些笨……
以上這篇Python爬蟲將爬取的圖片寫入world文檔的方法就是小編分享給大家的全部?jī)?nèi)容了,希望能給大家一個(gè)參考,也希望大家多多支持腳本之家。
相關(guān)文章
解決在keras中使用model.save()函數(shù)保存模型失敗的問(wèn)題
這篇文章主要介紹了解決在keras中使用model.save()函數(shù)保存模型失敗的問(wèn)題,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧2020-05-05python實(shí)現(xiàn)購(gòu)物車小程序
這篇文章主要為大家詳細(xì)介紹了python實(shí)現(xiàn)購(gòu)物車小程序,文中示例代碼介紹的非常詳細(xì),具有一定的參考價(jià)值,感興趣的小伙伴們可以參考一下2022-02-02python GUI庫(kù)圖形界面開(kāi)發(fā)之PyQt5下拉列表框控件QComboBox詳細(xì)使用方法與實(shí)例
這篇文章主要介紹了python GUI庫(kù)圖形界面開(kāi)發(fā)之PyQt5下拉列表框控件QComboBox詳細(xì)使用方法與實(shí)例,需要的朋友可以參考下2020-02-02pycharm debug功能實(shí)現(xiàn)跳到循環(huán)末尾的方法
今天小編就為大家分享一篇pycharm debug功能實(shí)現(xiàn)跳到循環(huán)末尾的方法,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧2018-11-11python3 對(duì)list中每個(gè)元素進(jìn)行處理的方法
今天小編就為大家分享一篇python3 對(duì)list中每個(gè)元素進(jìn)行處理的方法,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧2018-06-06Python中Pytest測(cè)試框架的fixture使用詳解
這篇文章主要介紹了Python中Pytest測(cè)試框架的fixture使用詳解,Pytest的fixture的目的是提供一個(gè)測(cè)試的基線,在此基線基礎(chǔ)上,可以更可靠的進(jìn)行重復(fù)測(cè)試,需要的朋友可以參考下2023-08-08python 循環(huán)讀取txt文檔 并轉(zhuǎn)換成csv的方法
今天小編就為大家分享一篇python 循環(huán)讀取txt文檔 并轉(zhuǎn)換成csv的方法,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧2018-10-10python靜態(tài)web服務(wù)器實(shí)現(xiàn)方法及代碼詳解
在本篇內(nèi)容里小編給大家分享了一篇關(guān)于python靜態(tài)web服務(wù)器實(shí)現(xiàn)方法,有需要的朋友們可以參考下。2022-11-11Python中的魔術(shù)方法Magic?Methods使用實(shí)例全面指南
在Python中,魔術(shù)方法Magic?Methods是一種特殊的方法,它們以雙下劃線開(kāi)頭和結(jié)尾,如__init__、__str__等,這些方法允許定制類的行為,使得對(duì)象更具有靈活性和可定制性,本文將深入探討Python中一些常用的魔術(shù)方法,以及如何使用它們來(lái)定制類與對(duì)象2024-01-01利用Python制作一個(gè)MOOC公開(kāi)課下載器
為了幫助大家更好地在假期內(nèi)卷,本文將利用Python制作一個(gè)中國(guó)大學(xué)MOOC的公開(kāi)課下載器。文中的示例代碼講解詳細(xì),感興趣的小伙伴可以學(xué)習(xí)一下2022-03-03