百度官方站长帮助点评-网页收录问题
这次百度更新前一天,搜钱site网站的时候发现
提示:找到的相关网页数是估算值,不代表真实结果数,仅供参考。站长帮助
这个站长帮助很值得一读,百度新增这一句也有提醒大家之意。但是据我所知,很多做SEO的,甚至是百度SEO的人都没有认真去研读过,因此搜钱觉得有必要带着大家去读一读,同时做点评。
至于为什么要读?举个例子。你知道国内国外那些研究中国时事政治的人必须读的是什么?是《人民日报》!因为人民日报是最权威的官方报纸。特别是人民日报的社论。
那么我们一起来读下百度站长帮助,全称百度搜索帮助中心-网页搜索帮助-站长FAQ,网址:http://www.baidu.com/search/guide.html
今天的内容是网页收录问题,强调部分是搜钱SEO的点评。
如何让我的网站(独立网站或者blog)被百度收录?如何查看我的网站是否被百度收录?
看这个标题,网站的解释是独立网站或者blog.这里的blog指的是站长在各大博客网站开的博客。以前百度对这种博客的权重比较高,特别是百度空间和新浪博客。但是最近百度把这种博客权重降得比较低了。如果要用博客,还是用独立博客比较好。
百度会收录符合用户搜索体验的网站和网页。
这句话其实回答了上面那个问题。符合用户搜索体验是关键。同时这里提到了网站和网页。那么搜钱强调下收录是有两个层次的,一是网站收录,主要衡量是收录了主域名,如www.seolabs.net.cn;二是收录了单个网页。
为促使百度Spider更快的发现您的站点,您也可以向我们提交一下您的网站的入口网址。提交地址是:http://www.baidu.com/search/url_submit.html。您只需提交首页即可,无需提交详细的内容页面。
/这句话告诉大家要去百度登陆入口提交自己的网站。更快二字说明即使你不去提交,也可能被收录,只要百度蜘蛛能顺着某种路径达到你的网站。
百度的网页收录机制,只和网页价值有关,与竞价排名等商业因素没有任何关联。
之所以声明,是因为普遍认为百度的自然搜索有猫腻。
百度是否已经收录您的网站可以通过执行site语法查看,直接在百度搜索中输入site:您的域名,如site:www.baidu.com,如果site语法查询可以查询到结果,那您的网站就已经被百度收录。
site语法得到的搜索结果数,只是一个估算的数值,仅供参考。
这句话很重要。一是告诉你怎么判断自己的站被没被收录,用site语法。有些网友直接输入自己的网站的域名,发现没被收录就妄自下结论说自己的站没被收录或者被K之类,记住site才能说明问题。二是这个例子site:www.baidu.com,这里必须提到site:www.baidu.com和site:baidu.com是不一样的。原因是不带www的和带www的是两个域名。一般site:baidu.com这样的结果页包括了site:www.baidu.com和其他子域名的收录情况。三是 只是一个估算的数值,仅供参考,这句话是真话,但是实际上没用,我们不看site还能看什么?
如何让我的网页不被百度收录?
这个问题大家关心得不是很多,因为很多站是百度根本不收录。
百度严格遵循搜索引擎Robots协议(详细内容,参见http://www.robotstxt.org/)。
您可以设置一个Robots文件以限制您的网站全部网页或者部分目录下网页不被百度收录。具体写法,参见:如何撰写Robots文件。
如果您的网站在被百度收录之后才设置Robots文件禁止抓取,那么新的Robots文件通常会在48小时内生效,生效以后的新网页,将不再建入索引。需要注意的是,robots.txt禁止收录以前百度已收录的内容,从搜索结果中去除可能需要数月的时间。
这句话回答了为什么有些网址不存在了,在百度上还能存在几个月。这方面google做得很好,他支持用户自己删除收录页面。
如果您的拒绝被收录需求非常急迫,也可以发邮件给webmaster@baidu.com请求处理。
为什么我的网站内一些不设链接的私密性网页,甚至是需要访问权限的网页,也会被百度收录?
这个问题的重要之处其实是回答了有些站为什么没做外链和内链也能被收录。
百度Spider对网页的抓取,是通过网页与网页之间的链接实现的。
网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过您的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。
之所以被收录是存在这样的链接路径。不一定是你能容易发现的。个人认为百度会参考域名解析的数据来爬行。所以有些人说自己的站没做链接百度也收录了,好像自己多牛的样子。其实是你没发现,链接的路径肯定有的。难道百度蜘蛛空降么?
百度Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去某些访问权限限制内容被百度收录,原因有两点:
A. 该内容在Spider访问时是没有权限限制的,但抓取之后,内容的权限发生了变化
B. 该内容有权限限制,但是由于网站安全漏洞问题,导致用户可以通过某些特殊路径直接访问。而一旦这样的路径被公布在互联网上,则Spider就会循着这条路径抓出受限内容
如果您不希望这些私密性内容被百度收录,一方面可以通过Robots协议加以限制;另一方面,也可以联系webmaster@baidu.com进行解决。
为什么我的网站收录数量越来越少?
那些经常被百度收录问题困扰的站长必看。
您的网站所在的服务器不稳定,Spider在检查更新时抓取不到网页而被暂时去除。
您的网站不符合用户的搜索体验。
第一句告诉你服务器稳定对收录来说很重要,但是也告诉你这是暂时的,等你服务器稳定了会回来。所以出现这种问题的站长要马上解决服务器问题,然后就是心态要好,因为会回来的。第二句还是用户体验问题,后面详谈。
我的网页为什么会从百度搜索结果中消失?
每个做百度的人必看。做百度被K是正常的事情,必须好好研究被K的原因,如果不符合以下的情况,那么心态好点,会回来的。
百度并不允诺所有网页都可从百度搜索到。
如果您的网页长时间无法从百度搜索到,或者突然从百度的搜索结果中消失,可能的原因有:
这实际上有两个问题,一是新站百度不收录;二是被百度K掉。
A. 您的网页不符合用户的搜索体验
B. 您的网站所在服务器不稳定,被百度暂时性去除,稳定之后,问题会得到解决
C. 您的网页内容有不符合国家法律和法规规定的地方
D. 其他技术性问题
A先不说,B又提到服务器问题,那么提醒大家服务器空间稳定永远是第一位的,在这个前提下再考虑速度。C就是内容问题了,黄赌毒反动在国内是不行的。就算百度勉强收录,也会被备案搞死。D。其他技术问题,其实很多时候是百度的问题,百度技术不如Google,本身就不稳定。
以下的说法是错误的和毫无根据的:
A. 参与了百度竞价排名但未续费,会从百度搜索结果中消失
B. 参与了其他搜索引擎的广告项目,会从百度搜索结果中消失
C. 与百度旗下网站产生了竞争,会从百度搜索结果中消失
D. 从百度获得的流量太大,会从百度搜索结果中消失
这些东西我就不说了,据说有猫腻。
什么样的网页会被百度认为是没有价值而不被百度收录或者从现有搜索结果中消失?
这一段实际上是对符合用户体验的反例说明。
百度只收录对用户有价值的网页。任何网页在搜索结果中的去留变化,都是机器算法计算和调整的结果。下述类型的网页,百度明确不会欢迎:
一,有价值是用户体验的本质;二,都是机器算法计算和调整的结果这句我不赞同,百度人工干预很严重。三是明确二字告诉大家下面的是雷区不要去碰。
A.网页做了很多针对搜索引擎而非用户的处理,使得用户从搜索结果中看到的内容与页面实际内容完全不同,或者使得网页在搜索结果中获得了不恰当的排名,从而导致用户产生受欺骗感觉。
如果您的网站中有较多这种页面,那么这可能会使您的整个网站的页面收录和排序受到影响。
B. 网页是复制自互联网上的高度重复性的内容。
C. 网页中有不符合中国法律和法规的内容。
A是不要作弊。B是不要自己拷贝,至少伪原创。C是内容合法。
如果我的网站因为作弊行为而从百度搜索结果中消失,是否还有被重新收录可能?
凡是作出完全修正的网站,都有机会被百度重新收录。百度会定期对被处理站点进行自动评估,并对符合条件者重新收录。
告诉了作弊被K的站长还是有机会的。但是定期二字就告诉你重新被收录的时间可以没准,因为你不知道他怎么定期的。
需要说明的是,百度技术和产品部门只对用户搜索体验负责。以下的说法都是错误的和毫无根据的:
A. 我成为百度的广告客户或者联盟网站,就可以重新被收录
B. 我给百度若干钞票,就可以重新被收录
C. 我认识百度的某某人,就可以重新被收录
我的网站更新了,可是百度收录的内容还没更新怎么办?
百度会定期自动更新所有网页(包括去除死链接,更新域名变化,更新内容变化)。因此请耐心等一段时间,您的网站上的变化就会被百度察觉并修正。
百度更新问题。提到一个定期二字。其实就是我们讲的更新规律。目前来看每周四小更新,月底那个周四是大更新。比如5月28日是5月底的周四。
为什么我的网站在百度收录的数量和其他搜索引擎相比相差很多?
通常情况下,这是正常的现象,不同的搜索引擎判断网页价值的算法不同。
所以很多人也要老问搜钱,为什么自己的站百度收录比Google还多,或者还少,原因就是算法不一样。
搜钱SEO会在接下来的时间里面继续点评百度站长帮助,结束之后将整理成电子书与大家分享。
转载请注明来自SEO实验室。