分享
 
 
 

取得页面所有不重复连接的函数

王朝other·作者佚名  2006-11-24
窄屏简体版  字體: |||超大  

由于需要我做了个函数,实现取得页面连接放到数组里

思路:1,取得静态+不带参数的:

htm html asp php jsp cgi

a,包含绝对路径的处理:直接取得

preg_match_all ()?

b,包含相对路径的,路径得到处理参数:

根据情况(. 或 .. )处理得到绝对路径

2,取得带参数的:

3,经过筛选:选择了一些可以读的后缀比如asp,php,html等

连接重复的进行删除。

4,直接运行代码就把 落伍者论坛 » 网站建设专栏

第一页面的连接拿下来到数组$e中,$e[o][0]为第一个连接;$e[o][1]为第2个

Code:

<?

$e=clinchgeturl("http://im286.com/forumdisplay.php?fid=1");

var_dump($e);

function clinchgeturl($url)

{

//$url="http://127.0.0.1/1.htm";

//$rootpath="http://fsrootpathfsfsf/yyyyyy/";

//var_dump($rrr);

if(eregi('(.)*[\.](.)*',$url)){

$roopath=split("\/",$url);

$rootpath="http://".$roopath[2]."/";

$nnn=count($roopath)-1;for($yu=3;$yu<$nnn;$yu++){$rootpath.=$roopath[$yu]."/";}

// var_dump($rootpath); //http: ,'',127.0.0.1,xnml,index.php

}

else{$rootpath=$url;//var_dump($rootpath);

}

if(isset($url)){

echo "$url 有下列裢接:<br>";

$fcontents = file($url);

while(list(,$line)=each($fcontents)){

while(eregi('(href[[:space:]]*=[[:space:]]*"?[[:alnum:]:@/._-]+[\?]?[^\"]*"?)',$line,$regs)){

//$regs[1] = eregi_replace('(href[[:space:]]*=[[:space:]]*\"?)([[:alnum:]:@/._-]+)(\"?)',"\\2",$regs[1]);

$regs[1] = eregi_replace('(href[[:space:]]*=[[:space:]]*[\"]?)([[:alnum:]:@/._-]+[\?]?[^\"]*)(\.*)[^\"\/]*([\"]?)',"\\2",$regs[1]);

if(!eregi('^http:\/\/',$regs[1])){

if(eregi('^\.\.',$regs[1])){

// $roopath=eregi_replace('(http:\/\/)?([[:alnum:]:@/._-]+)[[:alnum:]+](\.*)[[:alnum:]+]',"http:\/\/\\2",$url);

$roopath=split("\/",$rootpath);

$rootpath="http://".$roopath[2]."/";

//echo "这是根本d :"."\n";

$nnn=count($roopath)-1;for($yu=3;$yu<$nnn;$yu++){$rootpath.=$roopath[$yu]."/";}

//var_dump($rootpath);

if(eregi('^\.\.[\/[:alnum:]]',$regs[1])){

//echo "这是../目录/ :"."\n";

//$regs[1]="../xx/xxxxxx.xx";

// $rr=split("\/",$regs[1]);

//for($oooi=1;$oooi<count($rr);$oooi++)

$rrr=$regs[1];

// {$rrr.="/".$rr[$oooi];

$rrr = eregi_replace("^[\.][\.][\/]",'',$rrr); //}

$regs[1]=$rootpath.$rrr;

}

}else{

if(eregi('^[[:alnum:]]',$regs[1])){ $regs[1]=$rootpath.$regs[1]; }

else{ $regs[1] = eregi_replace("^[\/]",'',$regs[1]);$regs[1]=$rootpath.$regs[1];}

}

}

$line = $regs[2];

if(eregi('(.)*[\.](htm|shtm|html|asp|aspx|php|jsp|cgi)(.)*',$regs[1])){

$out[0][]=$regs[1]; }

}

}

}for ($ouou=0;$ouou<count($out[0]);$ouou++)

{

if($out[0][$ouou]==$out[0][$ouou+1]){

$sameurlsum=1;

//echo "sameurlsum=1:";

for($sameurl=1;$sameurl<count($out[0]);$sameurl++){

if($out[0][$ouou+$sameurl]==$out[0][$ouou+$sameurl+1]){$sameurlsum++;}

else{break;}

}

for($p=$ouou;$p<count($out[0]);$p++)

{ $out[0][$p]=$out[0][$p+$sameurlsum];}

}

}

$i=0;

while($out[0][++$i]) {

//echo $root.$out[0][$i]."\r\n";

$outed[0][$i]=$out[0][$i];

}

unset($out);

$out=$outed; return $out;

}

?>

 
 
 
免责声明:本文为网络用户发布,其观点仅代表作者个人观点,与本站无关,本站仅提供信息存储服务。文中陈述内容未经本站证实,其真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。
2023年上半年GDP全球前十五强
 百态   2023-10-24
美众议院议长启动对拜登的弹劾调查
 百态   2023-09-13
上海、济南、武汉等多地出现不明坠落物
 探索   2023-09-06
印度或要将国名改为“巴拉特”
 百态   2023-09-06
男子为女友送行,买票不登机被捕
 百态   2023-08-20
手机地震预警功能怎么开?
 干货   2023-08-06
女子4年卖2套房花700多万做美容:不但没变美脸,面部还出现变形
 百态   2023-08-04
住户一楼被水淹 还冲来8头猪
 百态   2023-07-31
女子体内爬出大量瓜子状活虫
 百态   2023-07-25
地球连续35年收到神秘规律性信号,网友:不要回答!
 探索   2023-07-21
全球镓价格本周大涨27%
 探索   2023-07-09
钱都流向了那些不缺钱的人,苦都留给了能吃苦的人
 探索   2023-07-02
倩女手游刀客魅者强控制(强混乱强眩晕强睡眠)和对应控制抗性的关系
 百态   2020-08-20
美国5月9日最新疫情:美国确诊人数突破131万
 百态   2020-05-09
荷兰政府宣布将集体辞职
 干货   2020-04-30
倩女幽魂手游师徒任务情义春秋猜成语答案逍遥观:鹏程万里
 干货   2019-11-12
倩女幽魂手游师徒任务情义春秋猜成语答案神机营:射石饮羽
 干货   2019-11-12
倩女幽魂手游师徒任务情义春秋猜成语答案昆仑山:拔刀相助
 干货   2019-11-12
倩女幽魂手游师徒任务情义春秋猜成语答案天工阁:鬼斧神工
 干货   2019-11-12
倩女幽魂手游师徒任务情义春秋猜成语答案丝路古道:单枪匹马
 干货   2019-11-12
倩女幽魂手游师徒任务情义春秋猜成语答案镇郊荒野:与虎谋皮
 干货   2019-11-12
倩女幽魂手游师徒任务情义春秋猜成语答案镇郊荒野:李代桃僵
 干货   2019-11-12
倩女幽魂手游师徒任务情义春秋猜成语答案镇郊荒野:指鹿为马
 干货   2019-11-12
倩女幽魂手游师徒任务情义春秋猜成语答案金陵:小鸟依人
 干货   2019-11-12
倩女幽魂手游师徒任务情义春秋猜成语答案金陵:千金买邻
 干货   2019-11-12
 
推荐阅读
 
 
 
>>返回首頁<<
 
靜靜地坐在廢墟上,四周的荒凉一望無際,忽然覺得,淒涼也很美
© 2005- 王朝網路 版權所有