怎么利用robots文件做好网站优化让蜘蛛更好的抓取网站?
robots文件存在于网站根目录,是用来告诉百度蜘蛛那些应该抓取,那些不应该抓取。正确使用robots文件有助于做好seo优化,robots文件的核心词汇就是allow和disallow用法。百度官网是认可这个文件的,在百度站长平台上也有robots这个栏目,点击进入,就可以看到你网站robots文件是否编写正确了。
百度robots文件使用说明
1、robots.txt可以告诉百度您网站的哪些页面可以被抓取,哪些页面不可以被抓取。
2、您可以通过Robots工具来创建、校验、更新您的robots.txt文件,或查看您网站robots.txt文件在百度生效的情况。
3、Robots工具暂不支持https站点。
4、Robots工具目前支持48k的文件内容检测,请保证您的robots.txt文件不要过大,目录最长不超过250个字符。
上图我给的一个例子中,disallow语句有问题,原因是把英文的冒号写成了中文的冒号。
当然直接输入网站根目录加上robtots.txt文件也可以
User-agent:* 是用来置顶那些搜索引擎蜘蛛可以抓取的,一般默认设置
Disallow:/category/*/page/ 分类目录下面翻页后的链接,比如,进入校赚网分类目录 "推广运营经验"目录后,在翻页一次,就成了 stcash.com/category/tuiguangyunying/page/2形式了
Disallow:/?s=* Disallow:/*/?s=* 搜索结果页面和分类目录搜索结果页面,这里没必要再次抓取。
Disallow:/wp-admin/ Disallow:/wp-content/ Disallow:/wp-includes/ 这三个目录是系统目录,一般都是屏蔽蜘蛛抓取
Disallow:/*/trackback trackback的链接
Disallow:/feed Disallow:/*/feed Disallow:/comments/feed 订阅链接
Disallow:/?p=* 文章短链接,会自动301跳转到长连接
例如,朱海涛博客之前就被收录过短连接
Disallow:/*/comment-page-* Disallow:/*?replytocom* 这两个我在之前文章有过说明,来自于评论链接,很容易造成重复收录。
在robots.txt文件的最后还可以制定sitemap文件 Sitemap:http://***.com/sitemap.txt
sitemap地址指令,主流是txt和xml格式。在这里分享一段张戈所写txt格式的simemap文件。
将上述代码保存到txt文件,上传到根目录,并且在robots.txt文件中指定即可
这里给大家共享下我的robots.txt文件
复制内容到剪贴板- User-agent: *
- Disallow:/wp-admin/
- Disallow: /*/comment-page-*
- Disallow: /*?replytocom*
- Disallow: /wp-content/
- Disallow: /wp-includes/
- Disallow: /category/*/page/
- Disallow: /*/trackback
- Disallow: /feed
- Disallow: /*/feed
- Disallow: /comments/feed
- Disallow: /?s=*
- Disallow: /*/?s=*
- Disallow: /attachment/
- Disallow: /tag/*/page/
- Sitemap: http://www.stcash.com/sitemap.xml
上一篇:百度将逐步取消referer 流量与关键词工具升级在即
栏 目:网站优化
本文标题:怎么利用robots文件做好网站优化让蜘蛛更好的抓取网站?
本文地址:https://idc91.com/wangzhanyunying/1045.html
您可能感兴趣的文章
- 05-26前端开发人员SEO优化技术方案
- 05-26新站如何优化 网站收录/关键词排名等问题解答
- 05-26如何快速收录网站内容 想要快速收录网站内容的注意事项
- 05-26网站优化如何提高用户的信任度?
- 05-262020年如何利用SEO增加流量?
- 05-26怎么防止优化好的关键词忽然排名下降
- 05-26老网站突然不收录了为什么 多年的老网站突然不收录的原因及解决方法
- 05-26企业网站被降权的具体原因有那些 企业网站被降权的原因分析
- 05-26网站如何提高百度权重?网站seo优化
- 05-26教你如何搭建及优化站点
阅读排行
推荐教程
- 11-22到底SEO逻辑是什么?SEO有没有未来呢?
- 11-22阿里云删除快照策略以及快照禁止自动计费
- 11-22哪些类型的网站并不需要高技能的SEO专员?
- 11-22百度上线“闪电算法”,移动页面首屏加速迫在
- 11-22抓取诊断工具常见错误类型解析
- 11-22网站被挂木马与777权限的奥妙
- 05-262020年如何利用SEO增加流量?
- 11-22为什么写的原创文章不被百度收录?
- 05-26怎么防止优化好的关键词忽然排名下降
- 05-26前端开发人员SEO优化技术方案