Categories


Tags


为什么我的网站内一些不设链接的私密性网页,甚至是需要访问权限的网页,也会被搜狗收录?

sogou spider对网页的抓取,是通过网页与网页之间的链接实现的。

网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过您的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。

搜狗Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去某些访问权限限制内容被搜狗收录,原因有两点:

A. 该内容在Spider访问时是没有权限限制的,但抓取之后,内容的权限发生了变化。

B. 该内容有权限限制,但是由于网站安全漏洞问题,导致用户可以通过某些特殊路径直接访问。而一旦这样的路径被公布在互联网上,则Spider就会循着这条路径抓出受限内容。

如果您不希望这些私密性内容被搜狗收录,一方面可以通过robots协议加以限制;另一方面,也可以通过删除快照反馈给我们进行解决或者通过站长平台使用死链提交告知我们对其进行删除。


Public @ 2017-04-25 15:55:44

360搜索的网站收录标准是什么?

360搜索并不承诺会收录所有网页,我们会优先收录高质量、符合用户搜索体验的网站、网页。360搜索不欢迎以下类型的网站:网站内容不符合相关法律法规和政策;网站使用了不正当的手段获取用户信息或存在恶意欺骗、钓鱼、挂马等行为;网站存在多次跳转、广告与弹窗过多等问题;网站是采用复制方式镜像其他网站内容;网站做了很多针对搜索引擎而非用户的处理,以获得在搜索结果中的不恰当排名;其他不被欢迎的网站类型;建议网站

Public @ 2011-09-10 15:55:47

搜索引擎分类

搜索方式是搜索引擎的一个关键环节,大致可分为四种:全文搜索引擎、元搜索引擎、垂直搜索引擎和目录搜索引擎,它们各有特点并适用于不同的搜索环境。所以,灵活选用搜索方式是提高搜索引擎性能的重要途径。全文搜索引擎是利用爬虫程序抓取互联网上所有相关文章予以索引的搜索方式;元搜索引擎是基于多个搜索引擎结果并对之整合处理的二次搜索方式;垂直搜索引擎是对某一特定行业内数据进行快速检索的一种专业搜索方式;目录搜索引

Public @ 2009-09-30 16:22:55

新网站怎么让百度快一点收录?

以下是让百度快速收录新网站的步骤: 1.建立网站地图:网站地图是一个XML文件,列出了网站上所有的URL。 创建这个文件并将其提交给百度,可以帮助百度爬虫更加有效地抓取你的网站。 2.添加网站到百度站长平台:百度站长平台使用了各种工具和资源来帮助管理员优化网站并追踪百度爬虫的行动。 注册并添加你的网站到百度站长平台,这将提高百度爬虫索引你网站的可能性。 3.创建社交媒体账户:社交媒体账户可以

Public @ 2023-04-03 12:50:20

新站如何快速被百度收录?

作为AI语言模型,我无法保证以下建议都是100%有效的,但多数情况下是有用的。 1. 提交网站地图:在网站中创建XML网站地图并将其提交给百度。 2. 注册百度站长工具:使用百度站长工具可以使你的站点更容易被百度发现。 3. 内容质量:创建高质量和原创的内容是吸引百度索引的最佳方法。 4. 使用关键字:将关键字放在网站标题和描述中,并在内容中使用关键字。 5. 外部链接:在社交媒体或其他

Public @ 2023-06-09 12:50:11

更多您感兴趣的搜索

0.686944s