石家庄SEO、网络营销及建站,我们更专业!
电话:0311-68022200 / QQ:10343829

百度蜘蛛访问记录

搜索引擎蜘蛛爬行统计分析的必要性:

蜘蛛顺利爬行网页是网页被搜索引擎收录的前提条件,搜索引擎是否已爬行了网站,爬行了哪些页面以及返回哪些信息给蜘蛛,掌握了这些情况我们才能对网站进行有针对性的优化改良,因此查看蜘蛛爬行日志是一件非常重要但却非常痛苦的工作,尤其是SEOER及新站站长来说。比如从网上看到蜘蛛爬行某个页面后如果返回200 0 64 ,则表示此网页极有可能要被搜索引擎删除,HEAD 请求返回404也表示要删除网页,如果我们能根据日志及时发现此现象就能根据实际情况及时做出调整。又如,蜘蛛爬行返回的301,302重定向及404错误等信息,也是网站管理员需要关心的问题。因此可以看出分析蜘蛛爬行日志的必要性。下面示例:
2009-02-10 00:09:12 sadfsdfsd 173.236.151.0GET /index.html – 80 – 61.135.168.39 Baiduspider+

(+http://www.baidu.com/search/spider.htm) 200 0 64

1、173.236.151.0就是搜索引擎蜘蛛防问的网站ip!       2、61.135.168.39 Baiduspider代表,百度搜索引擎蜘蛛的ip是61.135.168.39,

3、代码中的/index.html 就代表搜索引擎蜘蛛防问的网页 4、2009-02-10 00:09:12代表搜索引擎蜘蛛爬行的日期与时间

5、代码中的200就代表搜索引擎蜘蛛爬行后返回代码代表,代码中可以了解蜘蛛爬行后的反映.   6、sadfsdfsd代表网站日志所在的文件夹

石家庄seo收集一些常见的日志代码.供大家参考

  2xx 成功

  200 正常;请求已完成。

  201 正常;紧接 POST 命令。

  202 正常;已接受用于处理,但处理尚未完成。

  203 正常;部分信息 — 返回的信息只是一部分。

  204 正常;无响应 — 已接收请求,但不存在要回送的信息。

  3xx 重定向

  301 已移动 — 请求的数据具有新的位置且更改是永久的。(301重定向)

  302 已找到 — 请求的数据临时具有不同 URI。

  303 请参阅其它 — 可在另一 URI 下找到对请求的响应,且应使用 GET 方法检索此响应。

  304 未修改 — 未按预期修改文档。

  305 使用代理 — 必须通过位置字段中提供的代理来访问请求的资源。

  306 未使用 — 不再使用;保留此代码以便将来使用。

  4xx 客户机中出现的错误

  400 错误请求 — 请求中有语法问题,或不能满足请求。

  401 未授权 — 未授权客户机访问数据。

  402 需要付款 — 表示计费系统已有效。

  403 禁止 — 即使有授权也不需要访问。

  404 找不到 — 服务器找不到给定的资源;文档不存在。

  407 代理认证请求 — 客户机首先必须使用代理认证自身。

  410 请求的网页不存在(永久);

  415 介质类型不受支持 — 服务器拒绝服务请求,因为不支持请求实体的格式。

  5xx 服务器中出现的错误

  500 内部错误 — 因为意外情况,服务器不能完成请求。

  501 未执行 — 服务器不支持请求的工具。

  502 错误网关 — 服务器接收到来自上游服务器的无效响应。

  503 无法获得服务 — 由于临时过载或维护,服务器无法处理请求。

分享到:更多 ()

评论 5

  1. #3

    我到现在还是不清楚怎么看蜘蛛来的记录!

    电子烟品牌8年前 (2010-11-15)回复
    • 这道简单,你可以在你的站点后台安装一个蜘蛛统计系统,有很多的在百度上百度一下就可以了,很多虚拟主机也是支持网站日志查询的

      pppooo1378年前 (2010-11-21)回复
  2. #2

    最近几天都发现百度蜘蛛都勤劳的过来了
    不过收录的页面还是没有变化 只是一个空首页

    爱新奇8年前 (2010-11-30)回复
    • 这只是百度的一个效应,你的数据实际已经被采集走了,等你的站过一段时间稳定后就会被放出来
      ,通常放出来后日期都是以前的持续更新这时候添加外链适当的,慢慢就会被收录

      pppooo1378年前 (2010-11-30)回复
  3. #1

    支持了,但是用什么记录呢?

    南宁科士威7年前 (2011-07-30)回复