• 我们的专业品牌服务商:网站建设、品牌策划设计、网站优化、网站推广等业务
    • 龙诚微博
    • 站点导航
    • 免费建站
专业的互联网络解决方案、完善的售后服务体系 —— 龙诚互联(温州网络公司 温州网站建设),当前IP:
龙诚简介 | 企业文化 | 我们的优势 | 龙诚人 | 招兵募马
龙诚动态 | 行业新闻 | 我们的观点 | 公司公告
标准企业站 | 外贸商务站| 商城门户站 | 品牌动画站 | 在线订制
网站制作流程 | 建站知识 | 网站SEO优化 | 域名&空间 | 网站备案 | 下载中心
联系方式 | 留言反馈
  • 新闻中心
    • 龙诚动态
      行业新闻
      我们的观点
      公司公告
      建站技术
      网站SEO优化
      网站制作流程
      产品报价
      联系我们
      • 联系电话:0577-55882408
      • 传真号码:0577-55882411
      • 联系手机:15224122065
      • 联系地址:温州市瓯海站南商贸城C幢306
      • 新闻中心 首页-新闻中心-我们的观点
      • 百度蜘蛛如何爬行和判断文章是否原创
      • 发布时间:2012-4-8 13:49:12 ‖ 
      • 一、首先要明确一个概念:原创 伪原创

        原创:简单地理解就是第一次在网络上发表的内容,以前没有出现过的内容。

        伪原创:就是从网站找来资料进行二次加工,二次修改之后的内容,如修改标题,修改内容,增加些文字或者减少一些文字等。

        那么搜索引擎对于原创的判断是如何进行的呢?

        一般来讲有以下几个方面的因素决定:

        1、快照日期。
        2、蜘蛛抓取日期。
        3、页面外链的多少。
        4、文章修改的程度。

        二、举个例子如果你在www.lcnt.net这个网站上发布了一片文章内容。搜索引擎来到这个网站并且抓取到了这篇文章,放到数据库,并且在收录数据库中没有发现类似内容,那么就会被认为是原创。

        在这点上有个细节需要注意:

        1:文章必须被收录,如果没有被收录,肯定是在搜索数据库中石找不到的,搜索引擎根本就找不到这篇文章,更谈不上什么原创了。

        2:文章被转载

        如果刚发表的一篇文章被其它转载了,那么谁是原创呢?那要看谁更先被搜索引擎抓取到,也就是更新周期的问题了。如果a站发表,b站转载,如果先抓取到a站,那么归a,如果先抓取b站,那么原创就归b站了,所以不是说你先发表了,原创就是你的,这个得看搜索引擎什么时间收录了你的内容。

        3、访问时间

        如果蜘蛛先访问了B站呢?

        1、当然权重给B站,一般的情况下都会这样!
        2、如果B站转载的文章带了A站的原文章页面链接呢?
        3、这就很明白了,刚收录的时候,如果排名,两条结果一起出现,有可能还是B站的排名好一点。

        当然,文章转载次数多了以后,A站的链接越多,对A站的文章越有好处,排名会慢慢变成A站在前面。

        如果另外转载的文章带的是B站页面的链接呢?

        它们如果判断不好,就变成了一个链接流行度的比赛了。

        不过,如果都有很多外部链接,并且相差不大,那么判断的规则应该回到原点,谁先被收录谁就是原创。

        4、快照日期

        快照日期显示时间最早的,一般就是原创了吧!

        不一定,这个说法要在一个更新周期之内,比如说文章发表后一周内,快照时间越早的地址将越有被认可为原创的可能。

        但如果文章都发表了几个月了,说不定搜索引擎已经重新获取过快照了,快照的日期就变了!

        还有其它的可能吗?

        有,一般比如百度收录,他可能会有一个收录的数据库,经过过滤后,收录的内容才会到搜索结果里来。在这个期间就有一些问题了,比如A站首次发表,B站转载。蜘蛛先访问A站再访问B站。而后可能先把B站的结果放出来了,而A站还在数据库里。

        所以说搜索引擎没有收录并不表示搜索引擎蜘蛛没有访问过这些内容,也许在搜索引擎的库存里已经有记录了,只是你查的时间没有放出来而已,就像25号才放出来的内容,但是快照是20号的,这就是搜索引擎的库存内容,同时这也是检验原创的核心时间点。

        这种情况一般出现在新站与老站之间,A站发表,B站转载,但A站在搜索引擎的信任度并不高的时候。不过只要是A站先被访问到的,原创权还是A站的,这是最难分出来的情况,因为我们不知道蜘蛛先访问哪个站,除非你知道两个站的网站空间日志内容,能看到搜索引擎对两个页面的访问时间。

        5、伪原创

        伪原创也会被认为是原创?

        大多时候是这样的,搜索引擎蜘蛛不能明确分别这些东西,因为它的思维太程式化了。如果你的标题改过,文章的段落改过,那么蜘蛛将很难确定这篇文章是否有过收录,也许它可以确定有部分内容是重复的,但它也不能因为这些而将这篇文章确认为是转载!当然,随着搜索引擎程式设计的提高,应该会有一个相似度的东西出来,比如文字内容相似度超过百分之几就会被认为是转载。

        这样分析下来,相信大家应该了解了吧。只是核桃自己的看法,希望大家吸收自己想要的东西,不认同的了也来提下自己的意见!

        另外提几个建议:

        1、如果你的站是新站,权重不高,如何让蜘蛛首页找到你的页面并放入数据库?其实很简单:用网摘、百度收藏这些工具让蜘蛛更快的找到你的页面!

        2、大家都有过建议,就是加上自己的版权及内容页面的地址,别人采集的时候你就爽了,收录虽然不会快,但最后链接多了,你依然是原创内容。

        3、发表文章等到自己收录以后再去其它的站点进行发表,同时加上自己的原文地址,这种办法很有保障!
        转载请注明:原文出自 http://www.lcnt.net/news_show/lcnt_details_3_823.html
        上一篇:关于那些google不喜欢的SEO黑帽技术
        下一篇:
        三个月做一个网站的优化的经验分享
        【置顶】 【关闭本页】 【打印本页】
      分享到: QQ空间 新浪微博 人人网 开心网 更多


  • 地址:温州市瓯海区站南商贸城C幢306室
    总机:0577-55882408;传真:0577-55882411
    E-mail:115047027@qq.com
  • 业务咨询:0577-55882401
    售后热线:0577-55882408
    技术咨询:0577-55882411
  • 龙诚互联在线服务
    龙诚互联在线服务
    龙诚互联在线服务
  • copyright © 温州龙诚互联 版权所有
    浙ICP备11044124号-1
    您是第 位访客