php 正则表达式提取网页超级链接url的函数

代码如下:

function match_links($document) {

preg_match_all(“‘<s*as.*?hrefs*=s*([“‘])?(?(1)(.*?)\1|([^s>]+))[^>]*>?(.*?)</a>’isx”,$document,$links);

while(list($key,$val) = each($links[2])) {

if(!empty($val))

$match[‘link’][] = $val;

}

while(list($key,$val) = each($links[3])) {

if(!empty($val))

$match[‘link’][] = $val;

}

while(list($key,$val) = each($links[4])) {

if(!empty($val))

$match[‘content’][] = $val;

}

while(list($key,$val) = each($links[0])) {

if(!empty($val))

$match[‘all’][] = $val;

}

return $match;

}

主要是正则的问题,下面给出个asp.net下的,多测试正则

获取页面的链接正则

代码如下:

public string GetHref(string HtmlCode)

{

string MatchVale = “”;

string Reg = @”(h|H)(r|R)(e|E)(f|F) *= *(‘|””)?((w|\|/|.|:|-|_)+)(‘|””| *|>)?”;

foreach (Match m in Regex.Matches(HtmlCode, Reg))

{

MatchVale += (m.Value).ToLower().Replace(“href=”, “”).Trim() + “||”;

}

return MatchVale;

}

转载请注明:代码学堂>编程开发 > 正则学习 > php 正则表达式提取网页超级链接url的函数

1. 本站所有资源来源于用户上传和网络,因此不包含技术服务请大家谅解!如有侵权请邮件联系客服!10210454@qq.com
2. 本站不保证所提供所有下载的资源的准确性、安全性和完整性,资源仅供下载学习之用!如有链接无法下载、失效或广告,请联系客服处理,有奖励!
3. 您必须在下载后的24个小时之内,从您的电脑中彻底删除上述内容资源!如用于商业或者非法用途,与本站无关,一切后果请用户自负!
4. 如果您也有好的资源或教程,您可以投稿发布,成功分享后有RB奖励和额外RMB收入!

磊宇堂正在使用的服务器 维护管理由磊宇云服务器提供支持

磊宇堂 » php 正则表达式提取网页超级链接url的函数

提供最优质的资源集合

立即查看 了解详情