WordPress博客优化的Robots.txt规则以及规则各项的具体作用-搬瓦工VPS

说明：我们有时候页面有些内容由于某些因素，都要防止被搜索引擎收录，而禁止搜索引擎收录比较简单的办法是在Robots.txt里设置规则，Robots协议（也称为爬虫协议、机器人协议等）的全称是“网络爬虫排除标准”（Robots ExclusiON Protocol），网站通过Robots协议告诉搜索引擎哪些页面可以抓取，哪些页面不能抓取。这里说下方法。

这里以WordPress博客网站为例，在网站根目录Robots.txt里添加如下规则：

User-agent: *
Disallow: /wp-admin/
Disallow: /wp-content/
Disallow: /wp-includes/
Disallow: /*/comment-page-*
Disallow: /*?replytocom=*
Disallow: /category/*/page/
Disallow: /tag/*/page/
Disallow: /*/trackback
Disallow: /feed
Disallow: /*/feed
Disallow: /comments/feed
Disallow: /?s=*
Disallow: /*/?s=*\
Disallow: /attachment/

下面分别解释一下各项的作用：

1、Disallow: /wp-admin/、Disallow: /wp-content/和Disallow: /wp-includes/
用于告诉搜索引擎不要抓取后台程序文件页面。

2、Disallow: /*/comment-page-*和Disallow: /*?replytocom=*禁止搜索引擎抓取评论分页等相关链接。

3、Disallow: /category/*/page/和Disallow: /tag/*/page/
禁止搜索引擎抓取收录分类和标签的分页。

4、Disallow: /*/trackback
禁止搜索引擎抓取收录trackback等垃圾信息

5、Disallow: /feed、Disallow: /*/feed和Disallow: /comments/feed
禁止搜索引擎抓取收录feed链接，feed只用于订阅本站，与搜索引擎无关。

6、Disallow: /?s=*和Disallow: /*/?s=*\
禁止搜索引擎抓取站内搜索结果

7、Disallow: /attachment/
禁止搜索引擎抓取附件页面，比如毫无意义的图片附件页面。

上面只是些基本的写法，当然还有很多，不过够用了。当然像Typecho、Emlog，zblog这些博客就自己看着办，方法一样。

未经允许不得转载：搬瓦工VPS_美国VPS » WordPress博客优化的Robots.txt规则以及规则各项的具体作用

WordPress博客优化的Robots.txt规则以及规则各项的具体作用

相关推荐

评论 0

BandwagonHost搬瓦工VPS优惠券码（优惠6.58%）

Just My Socks终身循环5.2%优惠码： JMS9272283

Justmysocks教程攻略

分类

猜你喜欢

觉得文章有用就打赏一下文章作者

支付宝扫一扫打赏

微信扫一扫打赏