您的位置:首页-> 网络营销文库-> 网站运营-> 搜索引擎优化-> 搜索引擎如何确定你的就是原创内容

GoogleAdwords热线电话
雅虎竞价热线电话HotDMA2007:网络营销伴侣

搜索引擎优化

网站运营
搜索引擎优化

本类阅读TOP10

·百度排名NO.1是怎样SEO成功的
·网络营销导向的企业网站优化及推广方案——保健品企业运用典型案例
·网站建设优化心得
·细谈网页、网站优化
·Flash视频的SEO优化
·最重要的页面优化--标题标签
·25种能马上改善网站、提高浏览量的方法
·HAO123的迷思--谈谈SEO
·Blog搜索引擎优化之站内SEO
·搜索引擎优化(SEO)黑皮书
搜索引擎如何确定你的就是原创内容

作者:小胖 来源:未知 网络营销手册www.tomx.com 加入时间:2008-6-17 

TOMX正式发布网络营销专家社区

您的社区激活码:tomxclub
社区加入地址:http://club.tomx.com
仅限前1000位,请赶快来加入网络营销专家社区。
  • 认识更多网络营销专家并获得咨询服务
  • 分享及学习各种网络营销知识及案例
  • 认识更多同行朋友,拓展人脉关系
  • 获得各种商业合作及活动机会
  • 现在加入还可以获得200积分,兑换各种服务
注:本社区为私有社区,必须输入激活码或好友邀请才能加入

  很多人在群里聊到一些事情,比如原创是如何被搜索引擎确定的?核桃今天分享一下自己对搜索引擎确定原创内容的看法。

  首先我们明确两个概念:原创与伪原创

  原创:简单地理解就是第一次在网络上发表的内容。

  伪原创:就是对原创进行的第二次或者第N次经过修改的转载发表。比如修改标题,增加摘要,转载不完整内容等等。

  搜索引擎对于原创的判断是如何进行的呢?

  一般来讲有以下几个方面的因素决定:

  1、快照日期。

  2、蜘蛛抓取日期。

  3、页面外链的多少。

  4、文章修改的程度。

  举例:如果一篇标题为《搜索引擎如何确定你的就是原创内容》的文章在今天10点第一次发表在一个博客或者网站上。会有什么结果呢?

  搜索引擎蜘蛛来到这个博客或者网站,发现这个页面,分析内容,放入数据库,并且被确定为首次发现,这肯定就是原创了!

  那么这个收录与判断的过程中间有几个细节方面问题:

  1、必要条件

  ——假如这个网站没有被收录,这篇文章会认为是原创吗?

  ——当然不是!因为它根本不可能出现在搜索数据库里!

  ——如何让它成为原创内容?

  ——第一个条件,网站必须有被搜索引擎收录。

  ——假如这个网站收录了,但是不经常更新呢?

  ——很简单,如果不经常更新,发表的文章到收录的时候也会认为是原创的。

  3、转载与采集

  ——如果文章被转载了呢?

  ——如果文章被转载,那么看转载这篇文章的站更新周期与首次发表站的更新周期哪个更快。

  ——不太明白更新周期。

  ——比如在A站发表,B站转载,如果蜘蛛先访问了A站,发现了文章,再来到B站发现了文章,很明显的,原创权重归A站。

  ——采集的情况是否符合这种情况?

  ——是的,采集的情况一样。如果B采集A,但B收录比A早,B就可能变成原创喽!

  4、访问时间

  ——如果蜘蛛先访问了B站呢?

  ——当然权重给B站,一般的情况下都会这样!

  ——如果B站转载的文章带了A站的原文章页面链接呢?

  ——这就很明白了,刚收录的时候,如果排名,两条结果一起出现,有可能还是B站的排名好一点。

  当然,文章转载次数多了以后,A站的链接越多,对A站的文章越有好处,排名会慢慢变成A站在前面。

  ——如果另外转载的文章带的是B站页面的链接呢?

  ——这种情况就搞笑了,给搜索引擎开了个玩笑,但它们如果判断不好,就变成了一个链接流行度的比赛了。

  不过,如果都有很多外部链接,并且相差不大,那么判断的规则应该回到原点,谁先被收录谁就是原创。

  5、快照日期

  ——快照日期显示时间最早的,一般就是原创了吧!

  ——不一定,这个说法要在一个更新周期之内,比如说文章发表后一周内,快照时间越早的地址将越有被认可为原创的可能。

  但如果文章都发表了几个月了,说不定搜索引擎已经重新获取过快照了,快照的日期就变了!

  ——还有其它的可能吗?

  ——有,一般比如百度收录,他可能会有一个收录的数据库,经过过滤后,收录的内容才会到搜索结果里来。在这个期间就有一些问题了,比如A站首次发表,B站转载。蜘蛛先访问A站再访问B站。而后可能先把B站的结果放出来了,而A站还在数据库里。

  所以说搜索引擎没有收录并不表示搜索引擎蜘蛛没有访问过这些内容,也许在搜索引擎的库存里已经有记录了,只是你查的时间没有放出来而已,就像25号才放出来的内容,但是快照是20号的,这就是搜索引擎的库存内容,同时这也是检验原创的核心时间点。

  这种情况一般出现在新站与老站之间,A站发表,B站转载,但A站在搜索引擎的信任度并不高的时候。不过只要是A站先被访问到的,原创权还是A站的,这是最难分出来的情况,因为我们不知道蜘蛛先访问哪个站,除非你知道两个站的网站空间日志内容,能看到搜索引擎对两个页面的访问时间。

  6、伪原创

  ——伪原创也会被认为是原创?

  ——大多时候是这样的,搜索引擎蜘蛛智力相当于三岁小孩子一样,不能明确分别这些东西,因为它的思维太程式化了。如果你的标题改过,文章的段落改过,那么蜘蛛将很难确定这篇文章是否有过收录,也许它可以确定有部分内容是重复的,但它也不能因为这些而将这篇文章确认为是转载!当然,随着搜索引擎程式设计的提高,应该会有一个相似度的东西出来,比如文字内容相似度超过百分之几就会被认为是转载。

  这样分析下来,相信大家应该了解了吧。只是核桃自己的看法,希望大家吸收自己想要的东西,不认同的了也来提下自己的意见!

  另外提几个建议:

  1、如果你的站是新站,权重不高,如何让蜘蛛首页找到你的页面并放入数据库?其实很简单:用网摘、百度收藏这些工具让蜘蛛更快的找到你的页面!

  2、大家都有过建议,就是加上自己的版权及内容页面的地址,别人采集的时候你就爽了,收录虽然不会快,但最后链接多了,你依然是原创内容。

  3、发表文章等到自己收录以后再去其它的站点进行发表,同时加上自己的原文地址,这种办法很有保障!大站被采的机率很大! 



相关文章

  • 1978到2008年间的12次暴富机遇,你抓住了几次?
  • 80后十大痛惑
  • 看看乞丐是如何用swot分析市场的
  • 巴菲特名言语录
  • 企业营销谈--聚焦营销
  • 怎样让友情链接更加有效果
  • 太聪明的人往往创业不成功
  • 一个好的企业网站将成为企业销售的重要渠道
  • 我在华为工作十年的感悟
  • 网上如何卖货卖的更多:商品第一、性价比
  • 【声明】:
      以上文章或资料除注明为网络营销手册自创或编辑整理外,均为各方收集或网友推荐所得。其中摘录的内容以共享、研究为目的,不存在任何商业考虑。
      目前网站上有些文章未注明作者或出处,甚至标注错误,此类情况出现并非不尊重作者及出处网站,而是因为有些资料来源的不规范。如果有了解作者或出处的原作者或网友,请告知,本网站将立即更正注明,并公开向作者或出处单位道歉。
      被摘录的对象如有任何异议,请与本站联系,联系方式见页尾,本站确认后将立即撤下。谢谢您的支持与理解!
      本站为最大的网络营销信息和资源网站,若您觉得您的文章在本站发布对于网络营销行业有益,同时能扩大您的影响力,请到本站会员中心进行注册,登录会员中心后,即可发表您的大作。