WordPress 博客 robots 的写法与用法设置问题-初馨分享

在百度搜索引擎检测自己的博客时，蜘蛛出于优化的惯性，会先对博客的 Rbots 进行检测，以下内容教你如何去善用 robots.txt 对 wordpress 博客进行优化。

一、先来普及下 robots.txt 的概念：

robots.txt(统一小写) 是一种存放于网站根目录下的 ASCII 编码的文本文件，它通常告诉网络搜索引擎的漫游器 (又称网络蜘蛛)，此网站中的哪些内容是不能被搜索引擎的漫游器获取的，哪些是可以被 (漫游器) 获取的。这个文件用于指定 spider 在您网站上的抓取范围，一定程度上保护站点的安全和隐私。同时也是网站优化利器，例如屏蔽捉取站点的重复内容页面。

robots.txt 目前并不是一种标准，只是一种协议! 所以现在很多搜索引擎对 robots.txt 里的指令参数都有不同的看待。

二、使用 robots.txt 需要注意的几点地方：

1 、指令区分大小写，忽略未知指令，下图是本博客的 robots.txt 文件在 Google 管理员工具里的测试结果;

2 、每一行代表一个指令，空白和隔行会被忽略;

3 、「#」号后的字符参数会被忽略;

4 、有独立 User-agent 的规则，会排除在通配「*」Useragent 的规则之外;

5 、可以写入 sitemap 文件的链接，方便搜索引擎蜘蛛爬行整站内容。

6 、尽量少用 Allow 指令，因为不同的搜索引擎对不同位置的 Allow 指令会有不同看待。

三、 Wordpress 的 robots.txt 优化设置

1 、 User-agent：*

一般博客的 robots.txt 指令设置都是面对所有 spider 程序，用通配符「*」即可。如果有独立 User-agent 的指令规则，尽量放在通配「*」Useragent 规则的上方。

2 、 Disallow：/wp-admin/

Disallow：/wp-content/

Disallow：/wp-includes/

屏蔽 spider 捉取程序文件，同时也节约了搜索引擎蜘蛛资源。

3 、 Disallow：/*/trackback

每个默认的文章页面代码里，都有一段 trackback 的链接，如果不屏蔽让蜘蛛去捉取，网站会出现重复页面内容问题。

4 、 Disallow：/feed

Disallow：/*/feed

Disallow：/comments/feed

头部代码里的 feed 链接主要是提示浏览器用户可以订阅本站，而一般的站点都有 RSS 输出和网站地图，故屏蔽搜索引擎捉取这些链接，节约蜘蛛资源。

5 、 Disallow：/?s=*

Disallow：/*/?s=*

这个就不用解释了，屏蔽捉取站内搜索结果。站内没出现这些链接不代表站外没有，如果收录了会造成和 TAG 等页面的内容相近。

6 、 Disallow：/?r=*

屏蔽留言链接插件留下的变形留言链接。 (没安装相关插件当然不用这条指令)

7 、 Disallow：/*.jpg$

Disallow：/*.jpeg$

Disallow：/*.gif$

Disallow：/*.png$

Disallow：/*.bmp$

屏蔽捉取任何图片文件，在这里主要是想节约点宽带，不同的网站管理员可以按照喜好和需要设置这几条指令。

8 、 Disallow：/?p=*

屏蔽捉取短链接。默认头部里的短链接，百度等搜索引擎蜘蛛会试图捉取，虽然最终短链接会 301 重定向到固定链接，但这样依然造成蜘蛛资源的浪费。

9 、 Disallow：/*/comment-page-*

Disallow：/*?replytocom*

屏蔽捉取留言信息链接。一般不会收录到这样的链接，但为了节约蜘蛛资源，也屏蔽之。

10 、 Disallow：/a/date/

Disallow：/a/author/

Disallow：/a/category/

Disallow：/?p=*&preview=true

Disallow：/?page_id=*&preview=true

Disallow：/wp-login.php

屏蔽其他的一些形形色色的链接，避免造成重复内容和隐私问题。

10 、 Sitemap:http://***.com/sitemap.txt

网站地图地址指令，主流是 txt 和 xml 格式。告诉搜索引擎网站地图地址，方便搜索引擎捉取全站内容，当然你可以设置多个地图地址。要注意的就是 Sitemap 的 S 要用大写，地图地址也要用绝对地址。

上面的这些 Disallow 指令都不是强制要求的，可以按需写入。也建议站点开通谷歌管理员工具，检查站点的 robots.txt 是否规范。

好了，以上就是对利用 robots.txt 对 wordpress 博客进行优化的详细内容，希望可以帮助刚接触 wordpress 博客的同学。

声明：本站所有文章，如无特殊说明或标注，均为本站原创发布。任何个人或组织，在未征得本站同意时，禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益，可联系我们进行处理。

WordPress 博客 robots 的写法与用法设置问题

一、先来普及下 robots.txt 的概念：

二、使用 robots.txt 需要注意的几点地方：

三、 Wordpress 的 robots.txt 优化设置

评论 (0)

提示：请文明发言取消回复

作者信息

WordPress 博客 robots 的写法与用法设置问题

一、先来普及下 robots.txt 的概念：

二、使用 robots.txt 需要注意的几点地方：

三、 Wordpress 的 robots.txt 优化设置

评论 (0)

提示：请文明发言 取消回复

相关文章

草根 SEOer 需要熟知的 8 大基础知识

wordpress 优化之腾讯云 CDN 加速，2022 最详细 wordpress 博客建站教程！

网站不收录怎么办，试试这几招！

作者信息

标签云

提示：请文明发言取消回复