始创于2000年 股票代码:831685
咨询热线:0371-60135900 注册有礼 登录
  • 挂牌上市企业
  • 60秒人工响应
  • 99.99%连通率
  • 7*24h人工
  • 故障100倍补偿
您的位置: 网站首页 > 帮助中心>文章内容

百度抓取异常问答

发布时间:  2012/9/22 11:09:02
 百度抓取异常问答
1、什么是抓取异常
对于互联网中可正常访问的页面,百度蜘蛛抓取的内容应与普通用户访问到的内容是一致的,除此以外的
 
情况,就是抓取异常。 
 
2、抓取异常对网站的影响有哪些
若网站中有大量抓取异常的网页存在,搜索引擎会认为网站存在用户体验上的缺陷,并降低对网站的评价
 
,最终影响到网站在百度搜索引擎中的表现。 
 
3、什么是死链
页面已经无效,无法对用户提供任何有价值信息的页面就是死链接,包括协议死链和内容死链两种形式。
协议死链:页面的TCP协议状态/HTTP协议状态明确表示的死链,常见的如404、403、503状态等。
内容死链:服务器返回状态是正常的,但内容已经变更为不存在、已删除或需要权限等与原内容无关的信
 
息页面。
对于死链,建议及时修复死链数据,或进行死链数据推送,以便搜索引擎更快地发现死链,减少死链对用
 
户以及搜索引擎的影响。 
 
4、什么是IP禁封
限制网络的出口IP地址,禁止该IP段的使用者进行内容访问,即为IP禁封。 
 
5、什么是UA禁封
UA即为用户代理(User-Agent),服务器通过UA识别访问者的身份。当网站针对指定UA的访问,返回异常
 
页面(如403,500)或跳转到其他页面的情况,即为UA禁封。 
 
6、什么是异常重定向
将网络请求重新指向其他位置即为重定向。常见的重定向有两种:永久重定向(301跳转协议)和暂时重
 
定向(302跳转协议),目前百度都可以识别和支持。
对于长时间跳转到其他域名的情况,如网站更换域名,建议您使用301跳转协议。
 
7、还有哪些其他异常
针对百度refer的作弊:网页针对来自百度的refer返回不同于正常内容的行为。
针对百度ua的作弊:网页对百度UA返回不同于页面原内容的行为。
JS跳转作弊:网页加载了百度无法识别的JS跳转代码,使得用户通过搜索结果进入页面后发生了跳转的情
 
况。
压力过大引起的偶然禁封:百度会根据站点的规模,访问量等信息,自动设定一个合理的抓取压力。但是
 
在异常情况下,如压力控制失常时,服务器会根据自身负荷进行保护性的偶然封禁。这种情况下,请在返
 
回码中返回503(其含义是 “Service Unavailable”),百度蜘蛛会过段时间再来尝试抓取这个链接,如
 
果网站已空闲,则会被成功抓取。

本文出自:亿恩科技【www.enkj.com】

服务器租用/服务器托管中国五强!虚拟主机域名注册顶级提供商!15年品质保障!--亿恩科技[ENKJ.COM]

  • 您可能在找
  • 亿恩北京公司:
  • 经营性ICP/ISP证:京B2-20150015
  • 亿恩郑州公司:
  • 经营性ICP/ISP/IDC证:豫B1.B2-20060070
  • 亿恩南昌公司:
  • 经营性ICP/ISP证:赣B2-20080012
  • 服务器/云主机 24小时售后服务电话:0371-60135900
  • 虚拟主机/智能建站 24小时售后服务电话:0371-60135900
  • 专注服务器托管17年
    扫扫关注-微信公众号
    0371-60135900
    Copyright© 1999-2019 ENKJ All Rights Reserved 亿恩科技 版权所有  地址:郑州市高新区翠竹街1号总部企业基地亿恩大厦  法律顾问:河南亚太人律师事务所郝建锋、杜慧月律师   京公网安备41019702002023号
      0
     
     
     
     

    0371-60135900
    7*24小时客服服务热线