python urllib爬取百度云連接的實(shí)例代碼
翻看自己以前寫(xiě)的程序,發(fā)現(xiàn)寫(xiě)過(guò)一個(gè)爬取盤(pán)多多百度云資源的東西,完全是當(dāng)時(shí)想看變形金剛才自己寫(xiě)的,而且當(dāng)時(shí)第一次接觸python大概寫(xiě)了有2天才搞出來(lái)這個(gè)程序,學(xué)習(xí)python語(yǔ)言,可以看得出來(lái)那時(shí)候的代碼寫(xiě)的真的low。雖然現(xiàn)在也不怎么樣,哈哈,一直學(xué)習(xí)中,不做過(guò)多解釋,上圖上代碼,因?yàn)樽兞康穆暶魇鞘裁次易约阂餐耍ㄊ謩?dòng)傲嬌),連寫(xiě)入文件當(dāng)時(shí)都不會(huì)哈哈哈哈哈哈哈哈,也不知道class中可以通過(guò)init初始化,唉學(xué)習(xí)python原來(lái)我學(xué)到了這么多東西,感謝python

from bs4 import BeautifulSoup
import urllib
import requests
import re
adr =[]
''''對(duì)搜素資源名字進(jìn)行url編碼'''
search_text =raw_input('請(qǐng)輸入搜索資源名:')
search_text = search_text.decode('gbk')
search_text = search_text.encode('utf-8')
search_text = urllib.quote(search_text)
''''獲取文件地址'''
home = urllib.urlopen('http://www.panduoduo.net/s/name/'+search_text)
'''獲取百度云地址'''
def getbaidu(adr):
for i in adr:
url = urllib.urlopen('http://www.panduoduo.net'+i)
bs = BeautifulSoup(url)
bs1 = bs.select('.dbutton2')
href = re.compile('http\%(\%|\d|\w|\/\/|\/|\.)*')
b = href.search(str(bs1))
name = str(bs.select('.center')).decode('utf-8')
text1 = re.compile('\<h1\sclass\=\"center"\>[\d|\w|\D|\W]*\</h1\>')
text2 = text1.search(name)
rag1 = re.compile('\>[\d|\w|\D|\W]*\<')
if text2:
text3 = rag1.search(text2.group())
if text3:
print text3.group()
if b:
text = urllib.unquote(str(b.group())).decode('utf-8')
print text
'''初始化'''
def init(adr):
soup = BeautifulSoup(home)
soup = soup.select('.row')
pattern = re.compile('\/r\/\d+')
for i in soup:
i = str(i)
adress = pattern.search(i)
adress = adress.group()
adr.append(adress)
print 'running---------'
init(adr)
getbaidu(adr)
以上就是本文的全部?jī)?nèi)容,希望對(duì)大家的學(xué)習(xí)有所幫助,也希望大家多多支持腳本之家。
- 用python下載百度文庫(kù)的代碼
- Python爬蟲(chóng):通過(guò)關(guān)鍵字爬取百度圖片
- python爬蟲(chóng)教程之爬取百度貼吧并下載的示例
- 教你用python3根據(jù)關(guān)鍵詞爬取百度百科的內(nèi)容
- Python3實(shí)現(xiàn)爬取指定百度貼吧頁(yè)面并保存頁(yè)面數(shù)據(jù)生成本地文檔的方法
- Python實(shí)現(xiàn)爬取百度貼吧帖子所有樓層圖片的爬蟲(chóng)示例
- python爬取網(wǎng)站數(shù)據(jù)保存使用的方法
- Python實(shí)現(xiàn)爬取知乎神回復(fù)簡(jiǎn)單爬蟲(chóng)代碼分享
- python爬蟲(chóng)實(shí)戰(zhàn)之爬取京東商城實(shí)例教程
- Python實(shí)現(xiàn)的爬取百度文庫(kù)功能示例
相關(guān)文章
Python Queue模塊詳細(xì)介紹及實(shí)例
這篇文章主要介紹了Python Queue模塊詳細(xì)介紹及實(shí)例的相關(guān)資料,需要的朋友可以參考下2016-12-12
Python configparser模塊配置文件過(guò)程解析
這篇文章主要介紹了Python configparser模塊配置文件過(guò)程解析,文中通過(guò)示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友可以參考下2020-03-03
Python多進(jìn)程Process和管道Pipe的使用方式
這篇文章主要介紹了Python多進(jìn)程Process和管道Pipe的使用方式,具有很好的參考價(jià)值,希望對(duì)大家有所幫助,如有錯(cuò)誤或未考慮完全的地方,望不吝賜教2024-02-02
Python利用字典和列表實(shí)現(xiàn)學(xué)生信息管理系統(tǒng)
這篇文章主要為大家詳細(xì)介紹了Python如何利用字典和列表實(shí)現(xiàn)一個(gè)簡(jiǎn)易的學(xué)生信息管理系統(tǒng),文中詳細(xì)注釋,方便理解,需要的可以參考一下2022-06-06
python環(huán)境下OPenCV處理視頻流局部區(qū)域像素值
這篇文章主要為大家介紹了python環(huán)境下OPenCV處理視頻流局部區(qū)域像素值的實(shí)現(xiàn)示例,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步2021-11-11
Python選擇網(wǎng)卡發(fā)包及接收數(shù)據(jù)包
今天小編就為大家分享一篇關(guān)于Python選擇網(wǎng)卡發(fā)包及接收數(shù)據(jù)包,小編覺(jué)得內(nèi)容挺不錯(cuò)的,現(xiàn)在分享給大家,具有很好的參考價(jià)值,需要的朋友一起跟隨小編來(lái)看看吧2019-04-04
Python實(shí)現(xiàn)批量更換指定目錄下文件擴(kuò)展名的方法
這篇文章主要介紹了Python實(shí)現(xiàn)批量更換指定目錄下文件擴(kuò)展名的方法,結(jié)合完整實(shí)例分析了Python批量修改文件擴(kuò)展名的技巧,并對(duì)比分析了shell命令及scandir的兼容性代碼,需要的朋友可以參考下2016-09-09

