利用php抓取蜘蛛爬虫痕迹的示例代码_php实例

前言

相信许多的站长、博主可能最关心的无非就是自己网站的收录情况，一般情况下我们可以通过查看空间服务器的日志文件来查看搜索引擎到底爬取了我们哪些个页面，不过，如果用php代码分析web日志中蜘蛛爬虫痕迹，是比较好又比较直观方便操作的！下面是示例代码，有需要的朋友们下面来一起看看吧。

示例代码

<?php
//获取蜘蛛爬虫名或防采集
function isSpider(){
  $bots = array(
          'Google'  => 'googlebot',
          'Baidu'    => 'baiduspider',
          'Yahoo'    => 'yahoo slurp',
          'Soso'    => 'sosospider',
          'Msn'    => 'msnbot',
          'Altavista'  => 'scooter ',
          'Sogou'    => 'sogou spider',
          'Yodao'    => 'yodaobot'
      );
  $userAgent = strtolower($_SERVER['HTTP_USER_AGENT']);
  foreach ($bots as $k => $v){
    if (strstr($v,$userAgent)){
      return $k;
      break;
    }
  }
  return false;
}
//获取哪种蜘蛛爬虫后保存蜘蛛痕迹。
//根据采集时HTTP_USER_AGENT是否为空来防止采集
//抓蜘蛛爬虫
$spi  = isSpider();
if($spi){
  $tlc_thispage  = addslashes($_SERVER['HTTP_USER_AGENT']);
  $file      = 'robot.txt';
  $time      = date('Y-m-d H:i:s',mktime());
  $handle      = fopen($file,'a+');
  $PR        = $_SERVER['REQUEST_URI'];
  fwrite($handle, "Time:{$time} ROBOT:{$spi} AGENT:{$tlc_thispage} URL:{$PR} \n\r");
  fclose($handle);
}
?>

总结

以上就是这篇文章的全部内容了，希望本文的内容对大家的学习或者工作能带来一定的帮助，如果有问题大家可以留言交流。

以上是小编为您精心准备的的内容，在的博客、问答、公众号、人物、课程等栏目也有的相关内容，欢迎继续使用右上角搜索按钮进行搜索php
，蜘蛛爬虫
，爬虫获取数据
php蜘蛛爬行记录
java爬虫抓取网页数据、爬虫抓取、python爬虫抓取图片、python爬虫抓取数据、java爬虫抓取网页图片，以便于您获取更多的相关知识。

时间： 2025-01-21 06:58:01

利用php抓取蜘蛛爬虫痕迹的示例代码_php实例

利用php抓取蜘蛛爬虫痕迹的示例代码_php实例的相关文章

利用php抓取蜘蛛爬虫痕迹的示例代码

利用curl抓取远程页面内容的示例代码_php技巧

利用curl抓取远程页面内容的示例代码

利用PHP抓取百度阅读的方法示例_php技巧

利用PHP和AJAX创建RSS聚合器的代码_php实例

php利用腾讯ip分享计划获取地理位置示例分享_php实例

PHP利用MySQL保存session的实现思路及示例代码_php技巧

苏宁易购屏蔽一淘网抓取蜘蛛

详解JAVA抓取网页的图片,JAVA利用正则表达式抓取网站图片_java