首页>>学生风采>>山西大学商务学院王建军>>观点>> 蜘蛛怎么辨别文章是否原创?

蜘蛛怎么辨别文章是否原创?

作者:王建军
日期:2011/11/29 15:27:31

在大多数的个人网站流量都来自于搜索引擎,要想流量提高,让你网站的收录量提高是必须的,那么我们要怎么做才能让搜索引擎快速收录你的页面并判断是有质量的页面?今天就和大家分享一下吧!

一、首先要明确一个概念: 伪原创和原创
伪原创:就是从网站找来资料进行二次加工,二次修改之后的内容,如修改标题,修改内容,增加些文字或者减少一些文字等。
原创:简单说就是第一次在网络上发表的内容,而以前没有出现过的内容。
那么搜索引擎对于原创的判断是如何进行的呢?

一般来讲有以下几个方面的因素决定:
1、快照日期。
2、蜘蛛抓取日期。
3、页面外链的多少。
4、文章修改的程度。

最近在做医疗网站,解放军102医院骨科 ,开始自己也是相当的模糊,但是只能盯着头皮上了,没办法。慢慢慢慢的逐步积累一些心得,自己才能有所成长。
举个例子如果你在站长站上发布了一片文章内容。搜索引擎来到这个网站并且抓取到了这篇文章,放到数据库,并且在收录数据库中没有发现类似内容,那么就会被认为是原创。
在这点上有个细节需要注意:

1:文章必须被收录,如果没有被收录,肯定是在搜索数据库中是找不到的,搜索引擎根本就找不到这篇文章,更谈不上什么原创了。

2:文章被转载

如果刚发表的一篇文章被其它转载了,那么谁是原创呢?那要看谁更先被搜索引擎抓取到,也就是更新周期的问题了。如果a站发表,b站转载,如果先抓取到a站,那么归a,如果先抓取b站,那么原创就归b站了,所以不是说你先发表了,原创就是你的,这个得看搜索引擎什么时间收录了你的内容。所以比如常州102医院 网站(http://www.gk102.com),做外链的时候就注意要等文章被搜索引擎收录了后才进行外部转载,以增加外链。

3、访问时间

如果蜘蛛先访问了B站呢?
1、当然权重给B站,一般的情况下都会这样!
2、如果B站转载的文章带了A站的原文章页面链接呢?
3、这就很明白了,刚收录的时候,如果排名,两条结果一起出现,有可能还是B站的排名好一点。
当然,文章转载次数多了以后,A站的链接越多,对A站的文章越有好处,排名会慢慢变成A站在前面。
如果另外转载的文章带的是B站页面的链接呢?
它们如果判断不好,就变成了一个链接流行度的比赛了。
不过,如果都有很多外部链接,并且相差不大,那么判断的规则应该回到原点,谁先被收录谁就是原创。

4、快照日期

快照日期显示时间最早的,一般就是原创了吧
不一定,这个说法要在一个更新周期之内,比如说文章发表后一周内,快照时间越早的地址将越有被认可为原创的可能。
但如果文章都发表了几个月了,说不定搜索引擎已经重新获取过快照了,快照的日期就变了!

还有其它的可能吗?
有,一般比如百度收录,他可能会有一个收录的数据库,经过过滤后,收录的内容才会到搜索结果里来。在这个期间就有一些问题了,比如A站首次发表,B站转载。蜘蛛先访问A站再访问B站。而后可能先把B站的结果放出来了,而A站还在数据库里。

所以说搜索引擎没有收录并不表示搜索引擎蜘蛛没有访问过这些内容,也许在搜索引擎的库存里已经有记录了,只是你查的时间没有放出来而已,就像25号才放出来的内容,但是快照是20号的,这就是搜索引擎的库存内容,同时这也是检验原创的核心时间点。

这种情况一般出现在新站与老站之间,A站发表,B站转载,但A站在搜索引擎的信任度并不高的时候。不过只要是A站先被访问到的,原创权还是A站的,这是最难分出来的情况,因为我们不知道蜘蛛先访问哪个站,除非你知道两个站的网站空间日志内容,能看到搜索引擎对两个页面的访问时间。
原文地址:http://www.zxcmz.com,谢谢关注。
http://www.8383.com

分享