百度与谷歌如何判断网站文章是否原创试析
关于百度对于原创内容判断的分析
大量复制内容网站有的时候会影响关键字的排名。
比如说原本是你写的文章,本来应该排名很好,但是其他人抄袭或转载你的文章,而且搜索引擎不幸的判断那篇被抄袭或转载的网页是原始出处的话,你应有的排名就会被那个网页夺走。
那么搜索引擎怎样才能从多个网页中挑出哪一个是原始出处呢?可能有以下几个考虑:
1)网页PR值。网页PR值越高,被认为是原始版本的可能性就越大。
2)网页第一次被收录的时间。网页被搜索引擎收录的时候越早,相比后发现的相同内容的网页来说,被当作原始出处的可能性就越大。
3)域名注册时间。越老的域名上面的网页被当成原始出处的可能性也越大。
4)网站的权威度。这就有点说不清了,可能包含前面3个因素,还有很多其他因素。
但到目前为止,无论以哪一个因素为主,或怎样组合这些因素,都不可能完全正确从多个网页中挑出原始出处。
比如说我这个博客就很新,域名也很新,文章被收录的时间有的时候也不一定是最早的,就权威地位和被信任度来说,也肯定比不上很多中文网站。但我的博客新,我的域名新,并不意味着我的内容就不是原始出处,实际上我的所有博客都是原创。
我最近也发现了很多网站都转载,有的时候是抄袭我的博客内容,很多网站的规模,历史,PR值都比我的网站要高的多。
基于个人博客,谷歌更多给予内容权重
1、谷歌比百度收录更快,更能辨别原出处
今天网友有说,此前我写的一文,谷歌的搜索结果中,原文出去就是我的博客地址,排在第一位。
其实,谷歌对于中文信息抓取速度之快,我早有切身感受。使用火狐浏览器以来,安装了谷歌工具条,默认的搜索引擎就是谷歌。自己也常常就新写的博客日志进行搜索,发现谷歌收录的速度很快,有时半小时就可以收录。
文章评论 本文章有个评论