欧美bbbwbbbw肥妇,免费乱码人妻系列日韩,一级黄片

php抓取并保存網(wǎng)站圖片的實(shí)現(xiàn)代碼

 更新時(shí)間:2015年10月28日 14:30:45   投稿:lijiao  
這篇文章主要介紹了php抓取并保存網(wǎng)站圖片的實(shí)現(xiàn)代碼,網(wǎng)頁(yè)源代碼捕獲,圖片鏈接獲取、分析、并將同樣的圖片鏈接合并功能。功能很全面,需要的朋友可以參考下

此程序?qū)崿F(xiàn)了網(wǎng)頁(yè)源代碼捕獲,圖片鏈接獲取、分析、并將同樣的圖片鏈接合并功能,實(shí)現(xiàn)了圖片抓取功能。利用php強(qiáng)大的網(wǎng)絡(luò)內(nèi)容處理函數(shù)將指定的網(wǎng)站上的所有圖片抓取下來(lái),保存在當(dāng)前目錄下,以下為代碼:

<?php 
/*完成網(wǎng)頁(yè)內(nèi)容捕獲功能*/ 
function get_img_url($site_name){ 
 $site_fd = fopen($site_name, "r"); 
 $site_content = ""; 
 while (!feof($site_fd)) { 
  $site_content .= fread($site_fd, 1024); 
 } 
 /*利用正則表達(dá)式得到圖片鏈接*/ 
 $reg_tag = '/<img.*?\"([^\"]*(jpg|bmp|jpeg|gif)).*?>/'; 
 $ret = preg_match_all($reg_tag, $site_content, $match_result); 
 fclose($site_fd); 
 return $match_result[1]; 
} 
 
/* 對(duì)圖片鏈接進(jìn)行修正 */ 
function revise_site($site_list, $base_site){ 
 foreach($site_list as $site_item) { 
  if (preg_match('/^http/', $site_item)) { 
   $return_list[] = $site_item; 
  }else{ 
   $return_list[] = $base_site."/".$site_item; 
 } 
 } 
 return $return_list; 
} 
 
/*得到圖片名字,并將其保存在指定位置*/ 
function get_pic_file($pic_url_array, $pos){ 
 $reg_tag = '/.*\/(.*?)$/'; 
 $count = 0; 
 foreach($pic_url_array as $pic_item){ 
  $ret = preg_match_all($reg_tag,$pic_item,$t_pic_name); 
  $pic_name = $pos.$t_pic_name[1][0]; 
  $pic_url = $pic_item; 
 print("Downloading ".$pic_url." "); 
  $img_read_fd = fopen($pic_url,"r"); 
  $img_write_fd = fopen($pic_name,"w"); 
  $img_content = ""; 
  while(!feof($img_read_fd)){ 
   $img_content .= fread($img_read_fd,1024); 
   
  } 
  fwrite($img_write_fd,$img_content); 
  fclose($img_read_fd); 
  fclose($img_write_fd); 
  print("[OK] "); 
 } 
 return 0; 
} 
 
function main(){ 
/* 待抓取圖片的網(wǎng)頁(yè)地址 */ 
 $site_name = "http://www.dbjr.com.cn/sheying/391528.html"; 
 $img_url = get_img_url($site_name); 
 $img_url_revised = revise_site($img_url, $site_name); 
 $img_url_unique = array_unique($img_url_revised); //unique array 
 get_pic_file($img_url_unique,"./"); 
} 
 
main(); 
?> 

此程序還有待完善的地方是,如果圖片在網(wǎng)站服務(wù)器上不同目錄下但文件名是相同的,此時(shí)圖片有可能是不一樣的,但在最后保存時(shí),后面得到的圖片會(huì)將前面已經(jīng)保存的圖片覆蓋掉,解決方法是在每次保存前先檢索當(dāng)前目錄下是否已有此文件名,有的話對(duì)將要保存的圖片重新命名即可。

以上就是為大家分享的php抓取并保存網(wǎng)站圖片的方法,以及在實(shí)踐過(guò)程中修正程序不完善的地方,希望這篇文章對(duì)大家的學(xué)習(xí)有所幫助。

相關(guān)文章

最新評(píng)論