php 正則表達式提取網(wǎng)頁超級鏈接url的函數(shù)
更新時間:2010年01月02日 12:05:39 作者:
php 正則表達式提取網(wǎng)頁超級鏈接url的函數(shù)
復(fù)制代碼 代碼如下:
function match_links($document) {
preg_match_all("'<\s*a\s.*?href\s*=\s*([\"\'])?(?(1)(.*?)\\1|([^\s\>]+))[^>]*>?(.*?)</a>'isx",$document,$links);
while(list($key,$val) = each($links[2])) {
if(!empty($val))
$match['link'][] = $val;
}
while(list($key,$val) = each($links[3])) {
if(!empty($val))
$match['link'][] = $val;
}
while(list($key,$val) = each($links[4])) {
if(!empty($val))
$match['content'][] = $val;
}
while(list($key,$val) = each($links[0])) {
if(!empty($val))
$match['all'][] = $val;
}
return $match;
}
主要是正則的問題,下面給出個asp.net下的,多測試正則
獲取頁面的鏈接正則
復(fù)制代碼 代碼如下:
public string GetHref(string HtmlCode)
{
string MatchVale = "";
string Reg = @"(h|H)(r|R)(e|E)(f|F) *= *('|"")?((\w|\\|\/|\.|:|-|_)+)('|""| *|>)?";
foreach (Match m in Regex.Matches(HtmlCode, Reg))
{
MatchVale += (m.Value).ToLower().Replace("href=", "").Trim() + "||";
}
return MatchVale;
}
相關(guān)文章
學會Python正則表達式,就看這20個例子(腳本之家修正版)
這篇文章主要介紹了學會Python正則表達式,就看這20個例子,需要的朋友可以參考下2020-03-03vbs:能算出一個字符在一字段里共出現(xiàn)有幾次的函數(shù)
vbs:能算出一個字符在一字段里共出現(xiàn)有幾次的函數(shù)...2007-04-04