Categories


Tags


常见的robots.txt文件用法实例

常见的robots.txt文件用法实例:

1、禁止所有搜索引擎抓取网站的任何部分

User-agent: *

Disallow: /

这是禁止所有目录和文件被所有搜索引擎收录。网站还没上线时,有的会先屏蔽所有蜘蛛抓取。

2、允许所有的spider抓取(或者也可以建一个空的robots.txt文件)

User-agent: *

Allow: /

这是允许所有搜索引擎抓取网站的任何部分,既然是允许所有文件被抓取,可以不用创建robtos.txt文件,即默认全部允许抓取。

3、禁止spider抓取特定目录

User-agent: *

Disallow: /a/

Disallow: /b/

Disallow: /c/

这是禁止所有的spider抓取a、b、c目录。这个规则我们最常用到,比如网站的程序后台、程序目录等都可以禁止spider抓取,以减少spider无意义的浪费我们的空间资源。

4、禁止spider抓取搜索结果页面

User-agent: *

Disallow: /so_article?*

如果你网站的搜索结果页面URL格式如:/so_article?keyword=搜索关键字,则按以上格式进行屏蔽,注意最后带了一个星号*,代表屏蔽so_article?带头的所有URL。

对于大部分网站,常用的就是以上4种情况。

来源:搜外网


Public @ 2010-05-21 16:09:23

一句话次导航是什么?为什么要做一句话次导航?

一句话次导航是什么次导航:在网站的页脚,用首页的目标关键词打上锚文本指向给首页。目的是增加目标关键词的内链,提高URL的权重。一句话次导航:编辑一句完整话语,在里面出现多个关键词,给每个关键词添上首页链接,这个就是一句话次导航。为什么要做一句话次导航每个网站首页可以做3-5个目标关键词,栏目页面可以做1-3个关键词。但往往首页上的几个关键词,还有栏目上的关键词无法都放到主导航上,甚至可能主导航上的

Public @ 2022-01-29 16:11:46

站点地图的重要性

站点地图是一种网站页面,它列出了所有网站页面的链接列表,以方便用户查找和导航网站。站点地图包含的信息包括网站的结构,主要链接,页面层次结构,重要更新等。以下是站点地图的几个重要性: 1. 改善用户体验:站点地图为用户提供了一个完整的网站目录,使他们能够轻松地浏览网站并查找所需信息。 2. 提高搜索引擎优化:搜索引擎爬虫可以更轻松地索引站点地图。站点地图是向搜索引擎发送网站的重要信号。 3.

Public @ 2023-04-29 19:00:10

robots里这样写,就能避免蜘蛛爬这个“index.htm”这个首页?

我robots这样写是不是就能避免蜘蛛爬这个“index.htm”这个首页?User-agent: *Disallow: /index.htm11-30.我的index.htm是现在默认的首页,想屏蔽蜘蛛抓取。让蜘蛛爬另一个文档,主要是规避备案巡查我的网站和我备案的不一样,服务器那边要求改,我就整了个htm文档来规避下。写法没有问题。但正常的不建议屏蔽首页地址,,“index.htm”这个后缀地址

Public @ 2019-12-16 16:09:25

我希望我的网站内容被百度索引但不被保存快照,我该怎么做?

我希望我的网站内容被百度索引但不被保存快照,我该怎么做?Baiduspider遵守互联网meta robots协议。您可以利用网页meta的设置,使百度显示只对该网页建索引,但并不在搜索结果中显示该网页的快照。和robots的更新一样,因为搜索引擎索引数据库的更新需要时间,所以虽然您已经在网页中通过meta禁止了百度在搜索结果中显示该网页的快照,但百度搜索引擎数据库中如果已经建立了网页索引信息,可

Public @ 2014-06-20 16:08:58

更多您感兴趣的搜索

0.469021s