分享一个记录蜘蛛爬行记录的php程序 wordpress 可用

这个记录蜘蛛爬行记录的php程序的程序跟那个wp-log-robots插件的功能差不多,都是记录搜索引擎蜘蛛来访记录的。


1.首先,在wordpress主题根目录建立一个robots.php文件,写入以下内容:

<cc lang="php"">

<?php
function get_naps_bot()
{
$useragent = strtolower($_SERVER[\’HTTP_USER_AGENT\’]);
if (strpos($useragent, \’googlebot\’) !== false){
return \’Googlebot\’;
}
if (strpos($useragent, \’msnbot\’) !== false){
return \’MSNbot\’;
}
if (strpos($useragent, \’slurp\’) !== false){
return \’Yahoobot\’;
}
if (strpos($useragent, \’baiduspider\’) !== false){
return \’Baiduspider\’;
}
if (strpos($useragent, \’sohu-search\’) !== false){
return \’Sohubot\’;
}
if (strpos($useragent, \’lycos\’) !== false){
return \’Lycos\’;
}
if (strpos($useragent, \’robozilla\’) !== false){
return \’Robozilla\’;
}
return false;
}
function nowtime(){
$date=gmdate(\”Y-n-j H:i:s\”,time()+8*3600);
return $date;
}
$searchbot = get_naps_bot();
if ($searchbot) {
$tlc_thispage = addslashes($_SERVER[\’HTTP_USER_AGENT\’]);
$url=$_SERVER[\’HTTP_REFERER\’];
$file=\”robotslogs.txt\”;
$time=nowtime();
$data=fopen($file,\”a\”);
fwrite($data,\”Time:$time robot:$searchbot URL:$tlc_thispage\\n\”);
fclose($data);
}
?></cc”>

将其上传于你的主题目录内。

2.在Footer.php或header.php的适当位置添加以下代码调用robots.php。

<?php include(\’robots.php\’) ?>

程序原理:通过对蜘蛛标识符(如Baiduspider、Googlebot)的判断,记录蜘蛛爬行时间,并生成日志文件robotslogs.txt于根目录。
程序缺点:无法记录蜘蛛爬行的页面,功能较为简单。

发表评论

电子邮件地址不会被公开。 必填项已用*标注