• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • dedecms
  • ecshop
  • z-blog
  • UcHome
  • UCenter
  • drupal
  • WordPress
  • 帝国cms
  • phpcms
  • 动易cms
  • phpwind
  • discuz
  • 科汛cms
  • 风讯cms
  • 建站教程
  • 运营技巧
您的位置:首页 > CMS教程 >运营技巧 > 浅谈百度爬虫的HTTP状态码返回机制

浅谈百度爬虫的HTTP状态码返回机制

作者:查字典编辑 字体:[增加 减小] 来源:互联网

查字典编辑向大家介绍了浅谈百度爬虫的HTTP状态码返回机制,自学教程,网站运营教程等相关知识,希望对您有所帮助

研究seo的一定很了解下面这些返回码的含义了,对于这些不是很熟悉的朋友也应该了解一下基本的比如200是请求成功,301重定向,404找不到等等。下面首先会介绍一下百度对于各个状态吗的处理逻辑。

百度 spider 对常用的 http 返回码的处理逻辑是这样的 :

404
404返回码的含义是“NOT FOUND”,百度会认为网页已经失效,那么通常会从搜索结果中删除,并且短期内spider再次发现这条url也不会抓取。

503
503返回码的含义是“Service Unavailable”,百度会认为该网页临时不可访问,通常网站临时关闭,带宽有限等会产生这种情况。对于网页返回503,百度spider不会把这条url直接删除,短期内会再访问。届时如果网页已恢复,则正常抓取;如果继续返回503,短期内还会反复访问几次。但是如果网页长期返回503,那么这个url仍会被百度认为是失效链接,从搜索结果中删除。

403
403返回码的含义是“Forbidden”,百度会认为网页当前禁止访问。对于这种情况,如果是新发现的url,百度spider暂不 会抓取,短期内会再次检查;如果是百度已收录url,当前也不 会直接删除,短期内同样会再访问。届时如果网页允许访问, 则正常抓取;如果仍不允许访问,短期内还会反复访问几次。 但是如果网页长期返回403,百度也会认为是失效链接,从搜索结果中删除。

301
301返回码的含义是“Moved Permanently”,百度会认为 网页当前跳转至新url。当遇到站点迁移,域名更换、站点改版的情况时,推荐使用301返回码,尽量减少改版带来的流量损 失。虽然百度spider现在对301跳转的响应周期较长,但我们 还是推荐大家这么做。

如果站点临时关闭,当网页不能打开时,不要立即返回404,建议使用503状态。503可以告知百度spider该页面临时不可访问,请过段时间再重试。
如果百度spider对您的站点抓取压力过大,请尽量不要使用404,同样建议返回503。这样百度spider会过段时间再来尝试抓取这个链接,如果那个时间站点空闲,那它就会被成功抓取了。
有一些网站希望百度只收录部分内容,例如审核后的内容,累积一段时间的新用户页等等。在这种情况,建议新发内容暂时返回403,等审核或做好处理之后,再返回正常状态的返回码。
站点迁移,或域名更换时,请使用301返回码。


分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • 浅谈百度爬虫的HTTP状态码返回机制

相关文章

  • 移动站点站内优化Checklist
  • 两种mysql对自增id重新从1排序的方法
  • 关键词黄金比例如何分配才合适
  • 草根如何在二线城市将地方门户做出名堂?
  • 怎么兼顾SEO优化和网站用户体验
  • 分析事件营销的20个核心技巧
  • 网站收录,各项问题汇总解答
  • 为什么你的网络推广没有效果
  • 快速排名的方法:一个礼拜权重从0到2
  • 一毛钱的成本,从0爆增50000+粉丝的

文章分类

  • dedecms
  • ecshop
  • z-blog
  • UcHome
  • UCenter
  • drupal
  • WordPress
  • 帝国cms
  • phpcms
  • 动易cms
  • phpwind
  • discuz
  • 科汛cms
  • 风讯cms
  • 建站教程
  • 运营技巧

最近更新的内容

    • 用Javascript评估用户输入密码的强度
    • 腾讯云服务器CVM的购买及简单评测分析
    • 利于网站优化的SEO基础设置
    • 如何判断SEO关键词优化难易
    • 单页面网站的利弊和seo优化技巧
    • 营销网站服务器日志怎么看?
    • 万网域名怎么解析? 万网域名解析图文教程
    • 网站在优化过程中排名不稳定的原因分析和解决方法
    • 百度索引量下降原因分析及解决方案
    • 如何进行网站流量管理

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有