python爬蟲入門教程之點點美女圖片爬蟲代碼分享
更新時間:2014年09月02日 11:01:43 投稿:junjie
這篇文章主要介紹了python爬蟲入門教程之點點美女圖片爬蟲代碼分享,本文以采集抓取點點網(wǎng)美女圖片為例,需要的朋友可以參考下
繼續(xù)鼓搗爬蟲,今天貼出一個代碼,爬取點點網(wǎng)「美女」標簽下的圖片,原圖。
# -*- coding: utf-8 -*- #--------------------------------------- # 程序:點點美女圖片爬蟲 # 版本:0.2 # 作者:zippera # 日期:2013-07-26 # 語言:Python 2.7 # 說明:能設置下載的頁數(shù) #--------------------------------------- import urllib2 import urllib import re pat = re.compile('<div class="feed-big-img">\n.*?imgsrc="(ht.*?)\".*?') nexturl1 = "http://www.diandian.com/tag/%E7%BE%8E%E5%A5%B3?page=" count = 1 while count < 2: print "Page " + str(count) + "\n" myurl = nexturl1 + str(count) myres = urllib2.urlopen(myurl) mypage = myres.read() ucpage = mypage.decode("utf-8") #轉碼 mat = pat.findall(ucpage) if len(mat): cnt = 1 for item in mat: print "Page" + str(count) + " No." + str(cnt) + " url: " + item + "\n" cnt += 1 fnp = re.compile('(\w{10}\.\w+)$') fnr = fnp.findall(item) if fnr: fname = fnr[0] urllib.urlretrieve(item, fname) else: print "no data" count += 1
使用方法:新建一個文件夾,把代碼保存為name.py文件,運行python name.py就可以把圖片下載到文件夾。
相關文章
python json 遞歸打印所有json子節(jié)點信息的例子
今天小編就為大家分享一篇python json 遞歸打印所有json子節(jié)點信息的例子,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧2020-02-02python機器學習樸素貝葉斯算法及模型的選擇和調(diào)優(yōu)詳解
這篇文章主要為大家介紹了python機器學習樸素貝葉斯及模型的選擇和調(diào)優(yōu)示例詳解,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進步2021-11-11在linux系統(tǒng)中安裝python3.8.1?并卸載?python3.6.2?更新python3引導到3.8.1的
這篇文章主要介紹了如何在linux系統(tǒng)中安裝python3.8.1?并卸載?python3.6.2?更新python3引導到3.8.1,本文分步驟給大家介紹的非常詳細,對大家的學習或工作具有一定的參考借鑒價值,需要的朋友可以參考下2023-11-11使用python?matplotlib?contour畫等高線圖的詳細過程講解
最近學習了matplotlib中的高線圖的繪制,所以下面這篇文章主要給大家介紹了關于使用python?matplotlib?contour畫等高線圖的相關資料,文中通過實例代碼介紹的非常詳細,需要的朋友可以參考下2022-08-08win10環(huán)境下python3.5安裝步驟圖文教程
本文通過圖文并茂的形式給大家介紹了win10環(huán)境下python3.5安裝步驟,需要的朋友可以參考下2017-02-02