Categories


Tags


浅谈404问题

今天为什么要说一下404问题呢,最近看case过程中发现个很有意思的网站,该网站被灌了大量的垃圾信息,被其发现后及时地进行了删除,这一点是值得肯定的。通常情况下,正常网站将自动返回404状态码,搜索引擎进行更新并删除,避免对网站用户及搜索引擎带来负面影响。但问题来了,该网站只删除了内容,没有任何主体内容的页面被保存了下来,未做404处理。当然,存在一类网站只删除内容后返回正常200状态码,提醒一句“该内容已删除”,但其都没有。可以发现目前这个搜藏中的url仍然正常返回200,http://cang.baidu.com/Lee/snap/3b0a0cc8e7d7899facd36fad.html,造成的后果:搜索引擎将花费大量的资源在这种无效页面上,那么,同等耗损下用在重要页面上的资源将被大量挤占,可想而知,正常优质页面在搜索引擎的部分表现将受到影响。经过我们运营同学的多方沟通下至今仍未进一步处理。我觉得,21世纪第二个十年了,这种问题不应该再存在了的。

好吧,承认我被打败了。简单说一下:

404状态码代表‘Not Found’,spider更新时会认为该页面已失效,此时呢将在索引库中删除,短期内spider再次发现该url不再会抓取。因此,出来了两类问题:第一,网页临时性打不开;第二,页面永远无法打开。针对第一类问题,我建议不要立刻返回404,而是使用503。503等同于告诉spider该页面临时访问不了,过段时间再来光临。关于503,spider会认为该网页临时无法访问,短期内会再光临。如果网页已经恢复,即刻正常抓取;如果继续返回503,短期内还会再光临几次,但如果该页面长时间返回503,该url仍会被认作失效链接,从索引库中删除。针对第二类问题,永远无法打开的页面,404,不用考虑。各种web2类页面删除后同样需要返回404告知搜索引擎该页面已失效。

回归之前那个网站,删除内容后该页面没有任何价值。最恰当的处理是:

1、直接做死链处理并返回404;

2、在百度站长平台死链提交工具中提交死链sitemap。

最后呢,提醒一下各位站长朋友,当您的网站存在被发布大量垃圾信息时,请:

1、及时删除相关垃圾页面,并做404处理;

2、制作符合要求的死链sitemap;

3、登录百度站长平台,进入死链提交工具提交死链sitemap。

如果大家对404问题还有别的疑问,大家可以到[学堂同学汇][学习讨论]《浅谈404问题》讨论贴中发表自己的看法,我们的工作人员会关注这里并与大家进行探讨。

来源:百度搜索资源平台 百度搜索学堂


Public @ 2014-09-24 16:09:54

nofollow标签的使用方法和作用

读者”睡不着”在Google的数据中心们这篇帖子里留了评论,ZAC解释一下,我在你的帖子回复里面看到说在你的博客里回复帖子签名的链接可以算外部链接的,刚刚仔细看了一下,你的代码a xhref=’http://www.itqy.net’ rel=’external nofollow’这样子,根本就不能算外部链接的了,这样子做是不是不太厚道啊!希望ZAC出来解释一下!要解释这个问题不是一句两句能说清的

Public @ 2015-11-16 16:08:46

合理的网站结构优化

我们一直在谈论如何给网站做外部优化,比如如何增加外链、到那里推广,但很多站长朋友并不注重网站结构的优化,也就是内部优化,这方面我也很忽略。而这段时间卢松松一直在优化网站结构,也来谈谈如何做好网站结构的优化,本文列举了很多我常见的问题,希望对大家有用。合理的网站结构优化 SEO优化 网站优化 SEO推广 第1张(网站结构优化示意图)1:URL规范化URL规范化是指搜索引擎会挑选最合适的URL作为真正

Public @ 2012-05-08 16:12:06

原来404页面可以这样做

404页面可以以一种创意的方式来设计,以吸引用户的注意力并提供更好的用户体验。以下是一些原创404页面设计的建议: 1. 创意图像或动画:使用有趣和引人注目的图像或动画,以吸引用户的眼球。这可以是一个有趣的插图、卡通形象,或者是一个有趣的动画效果。 2. 幽默和诙谐语句:在404页面上添加一些幽默和诙谐的语句,可以缓解用户的失望情绪,并加强用户与网站的联系感。 3. 搜索功能:在404页面上

Public @ 2023-07-21 01:50:37

Apache IIS/.net 制作404页面

Apache为Apache Server设置 404错误页面的方法很简单,只需:(1)在.htaccess文件中加入如下内容:ErrorDocument 404 /notfound.php,将.htaccess文件上传到网站根目录。(2)制作一个404页面,随便您设计,命名为notfound.php,同样上传到网站根目录。注意:(1).切记不要将404错误转向到网站主页,否则可能会出现主页在搜索引

Public @ 2021-06-13 16:10:00

更多您感兴趣的搜索

0.509579s