python urllib爬取百度云連接的實例代碼
翻看自己以前寫的程序,發(fā)現(xiàn)寫過一個爬取盤多多百度云資源的東西,完全是當(dāng)時想看變形金剛才自己寫的,而且當(dāng)時第一次接觸python大概寫了有2天才搞出來這個程序,學(xué)習(xí)python語言,可以看得出來那時候的代碼寫的真的low。雖然現(xiàn)在也不怎么樣,哈哈,一直學(xué)習(xí)中,不做過多解釋,上圖上代碼,因為變量的聲明是什么我自己也忘了(手動傲嬌),連寫入文件當(dāng)時都不會哈哈哈哈哈哈哈哈,也不知道class中可以通過init初始化,唉學(xué)習(xí)python原來我學(xué)到了這么多東西,感謝python
from bs4 import BeautifulSoup import urllib import requests import re adr =[] ''''對搜素資源名字進行url編碼''' search_text =raw_input('請輸入搜索資源名:') search_text = search_text.decode('gbk') search_text = search_text.encode('utf-8') search_text = urllib.quote(search_text) ''''獲取文件地址''' home = urllib.urlopen('http://www.panduoduo.net/s/name/'+search_text) '''獲取百度云地址''' def getbaidu(adr): for i in adr: url = urllib.urlopen('http://www.panduoduo.net'+i) bs = BeautifulSoup(url) bs1 = bs.select('.dbutton2') href = re.compile('http\%(\%|\d|\w|\/\/|\/|\.)*') b = href.search(str(bs1)) name = str(bs.select('.center')).decode('utf-8') text1 = re.compile('\<h1\sclass\=\"center"\>[\d|\w|\D|\W]*\</h1\>') text2 = text1.search(name) rag1 = re.compile('\>[\d|\w|\D|\W]*\<') if text2: text3 = rag1.search(text2.group()) if text3: print text3.group() if b: text = urllib.unquote(str(b.group())).decode('utf-8') print text '''初始化''' def init(adr): soup = BeautifulSoup(home) soup = soup.select('.row') pattern = re.compile('\/r\/\d+') for i in soup: i = str(i) adress = pattern.search(i) adress = adress.group() adr.append(adress) print 'running---------' init(adr) getbaidu(adr)
以上就是本文的全部內(nèi)容,希望對大家的學(xué)習(xí)有所幫助,也希望大家多多支持腳本之家。
- 用python下載百度文庫的代碼
- Python爬蟲:通過關(guān)鍵字爬取百度圖片
- python爬蟲教程之爬取百度貼吧并下載的示例
- 教你用python3根據(jù)關(guān)鍵詞爬取百度百科的內(nèi)容
- Python3實現(xiàn)爬取指定百度貼吧頁面并保存頁面數(shù)據(jù)生成本地文檔的方法
- Python實現(xiàn)爬取百度貼吧帖子所有樓層圖片的爬蟲示例
- python爬取網(wǎng)站數(shù)據(jù)保存使用的方法
- Python實現(xiàn)爬取知乎神回復(fù)簡單爬蟲代碼分享
- python爬蟲實戰(zhàn)之爬取京東商城實例教程
- Python實現(xiàn)的爬取百度文庫功能示例
相關(guān)文章
Python利用字典和列表實現(xiàn)學(xué)生信息管理系統(tǒng)
這篇文章主要為大家詳細(xì)介紹了Python如何利用字典和列表實現(xiàn)一個簡易的學(xué)生信息管理系統(tǒng),文中詳細(xì)注釋,方便理解,需要的可以參考一下2022-06-06python環(huán)境下OPenCV處理視頻流局部區(qū)域像素值
這篇文章主要為大家介紹了python環(huán)境下OPenCV處理視頻流局部區(qū)域像素值的實現(xiàn)示例,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進步2021-11-11Python選擇網(wǎng)卡發(fā)包及接收數(shù)據(jù)包
今天小編就為大家分享一篇關(guān)于Python選擇網(wǎng)卡發(fā)包及接收數(shù)據(jù)包,小編覺得內(nèi)容挺不錯的,現(xiàn)在分享給大家,具有很好的參考價值,需要的朋友一起跟隨小編來看看吧2019-04-04Python實現(xiàn)批量更換指定目錄下文件擴展名的方法
這篇文章主要介紹了Python實現(xiàn)批量更換指定目錄下文件擴展名的方法,結(jié)合完整實例分析了Python批量修改文件擴展名的技巧,并對比分析了shell命令及scandir的兼容性代碼,需要的朋友可以參考下2016-09-09