php 正则表达式提取网页超级链接url的函数
function match_links($document) {
preg_match_all("'<s*as.*?hrefs*=s*(["'])?(?(1)(.*?)\1|([^s>]+))[^>]*>?(.*?)</a>'isx",$document,$links);
while(list($key,$val) = each($links[2])) {
if(!empty($val))
$match['link'][] = $val;
}
while(list($key,$val) = each($links[3])) {
if(!empty($val))
$match['link'][] = $val;
}
while(list($key,$val) = each($links[4])) {
if(!empty($val))
$match['content'][] = $val;
}
while(list($key,$val) = each($links[0])) {
if(!empty($val))
$match['all'][] = $val;
}
return $match;
}
主要是正则的问题,下面给出个asp.net下的,多测试正则
获取页面的链接正则
public string GetHref(string HtmlCode)
{
string MatchVale = "";
string Reg = @"(h|H)(r|R)(e|E)(f|F) *= *('|"")?((w|\|/|.|:|-|_)+)('|""| *|>)?";
foreach (Match m in Regex.Matches(HtmlCode, Reg))
{
MatchVale += (m.Value).ToLower().Replace("href=", "").Trim() + "||";
}
return MatchVale;
}
ASP超级链接和HTML函数正则表达式 修正版
过滤超级链接FunctionRegRemoveHref(HTMLstr)Setra=NewRegExpra.IgnoreCase=Truera.Global=Truera.Pattern="A[^]+(.+?)/A"RegRemoveHref=ra.replace(HTMLstr,"$1")ENDFunction过滤所有HTML代码Function
javascript 获取url参数的正则表达式(用来获取某个参数值)
例子://javascript传参数(多个)varurl="B.aspx?txtA="+document.getElementById("txtName").value;url+="&txtB="+document.getElementById("txtAge").value;window.open(url,'xWindow','width=640,height=400
PHP 正则表达式后面接的/isU, /is, /s含义
i匹配大小写s模式中的圆点元字符(.)匹配所有的字符,包括换行符x模式中的空白字符除了被转义的或在字符类中的以外完全被忽略,在未转义的字符
标签:字符,正则,参数,正则表达式,超级链接