欧美bbbwbbbw肥妇,免费乱码人妻系列日韩,一级黄片

Python爬蟲將爬取的圖片寫入world文檔的方法

 更新時(shí)間:2018年11月07日 10:52:23   作者:霜之哀傷彡  
今天小編就為大家分享一篇Python爬蟲將爬取的圖片寫入world文檔的方法,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧

作為初學(xué)爬蟲的我,無(wú)論是爬取文字還是圖片,都可以游刃有余的做到,但是爬蟲所爬取的內(nèi)容往往不是單獨(dú)的圖片或者文字,于是我就想是否可以將圖文保存至world文檔里,一開(kāi)始使用了如下方法保存圖片:

 with open('123.doc','wb')as file:
  file.write(response.content)
  file.close() 

結(jié)果就是,world文檔里出現(xiàn)了一堆亂碼,此法不同,我就開(kāi)始另尋他法,找了很久也沒(méi)有找到,只找到了關(guān)于Python操作world的方法。

于是我就開(kāi)始了新的思路:使用原來(lái)的方法將圖片保存下來(lái),再將圖片添加到world文檔里,最后將圖片刪除。這里使用的是python-dox庫(kù),代碼如下:

import requests
from bs4 import BeautifulSoup
import os
import docx
from docx import Document
from docx.shared import Inches

url = 'https://www.qiushibaike.com/article/119757360'
html = requests.get(url).content
soup = BeautifulSoup(html,'html.parser')
wen = soup.find('div',{"class":"content"}).text
img = str(soup.find('div',{"class":"thumb"})).split('src="')[1].split('"/')[0]
tu = 'https:' + img
img_name = img.split('/')[-1]

#保存圖片至本地
with open(img_name,'wb')as f:
 response = requests.get(tu).content
 f.write(response)
 f.close()

document = Document()
document.add_paragraph(wen)#向文檔里添加文字
document.add_picture(img_name)#向文檔里添加圖片
document.save('tuwen.doc')#保存文檔
os.remove(img_name)#刪除保存在本地的圖片

最后,還是實(shí)現(xiàn)了將圖文保存在了world文檔里,盡管方法有些笨……

以上這篇Python爬蟲將爬取的圖片寫入world文檔的方法就是小編分享給大家的全部?jī)?nèi)容了,希望能給大家一個(gè)參考,也希望大家多多支持腳本之家。

相關(guān)文章

最新評(píng)論