我希望我的网站内容被搜狗索引但不被保存快照，我该怎么做？_威海佰年网络技术有限公司_网站建设_软件开发_私有云_商标注册_公众号_小程序_APP_物联网

我希望我的网站内容被搜狗索引但不被保存快照，我该怎么做？

威海Spider 威海sogou spider
3405

sogou spider遵守互联网meta robots协议。您可以利用网页meta的设置，使搜狗显示只对该网页建索引，但并不在搜索结果中显示该网页的快照。

和robots的更新一样，因为搜索引擎索引数据库的更新需要时间，虽然您已经在网页中通过meta禁止了搜狗在搜索结果中显示该网页的快照，但搜狗搜索引擎数据库中如果已经建立了网页索引信息，可能需要二至四周才会在线上生效。

Public @ 2019-12-28 15:38:55

搜索引擎蜘蛛可以简单的理解为页面信息采集工具，不需要人工去采集，它会自动根据URL链接一个一个爬行过去，然后再抓取页面的信息，然后再存到服务器的列队中，为用户提供目标主题所需要的数据资源，搜索引擎蜘蛛不是所有的页面都会抓取的，主要有三个原因：一是技术上的原因。二是服务器存储方面的原因。三是提供用户搜索数据量太大，会影响效率。所以说，搜索引擎蜘蛛一般只是抓取那些重要的网页，而在抓取的时候评价重要性主

Public @ 2017-10-04 16:22:29

什么是模拟蜘蛛抓取

威海Spider 威海Spider
3009

模拟蜘蛛抓取是指通过计算机程序对蜘蛛行为进行模拟，实现自动化抓取网页内容的过程。蜘蛛抓取通常用于搜索引擎、数据挖掘、网络爬虫等应用，通过模拟蜘蛛的方式，可以自动遍历互联网上的网页，提取其中的信息，例如网页的标题、正文内容、链接等。模拟蜘蛛抓取的过程通常分为以下几个步骤： 1. 初始URL列表：确定起始的URL列表，作为开始抓取的入口。 2. 发送HTTP请求：程序向目标URL发送HTTP请求，

Public @ 2023-07-24 01:00:31

如何让 sogou spider 不抓我的网站

威海Spider 威海sogou spider
2438

sogou spider 支持 robots 协议，您可以在网站的根目录放置 robots.txt。robots.txt 的规则请参阅 http://www.robotstxt.org/。需要注意的是，最新更新的 robots.txt 可能需要几个星期才能体现出效果来，另外，被您禁止 sogou spider 收录的网页将不能在搜狗搜索引擎上检索到。

Public @ 2011-12-05 15:38:56

如何让 sogou spider 解除对我网站的封锁？

威海Spider 威海sogou spider
2509

在您的网站的问题改正之后，点此提交申请解封

Public @ 2021-08-22 15:38:54

Categories

Tags