美文网首页
电子商务:淘宝为什么禁止搜索引擎蜘蛛爬行抓取内容

电子商务:淘宝为什么禁止搜索引擎蜘蛛爬行抓取内容

作者: 老朱seo | 来源:发表于2017-11-26 23:30 被阅读0次

我们都知道在国内如果买东西的话去淘宝购买就好了,对于普通网名来说他们不会在浏览器中搜索域名进入淘宝网站,更多的是在搜索引擎中搜索“淘宝”,我们可以看到淘宝网屏蔽搜索引擎的蜘蛛爬虫,淘宝网在网站根目录下的robots.txt文件中设置相关命令,禁止搜索引擎蜘蛛获取网页信息。

这个“robots.txt”是什么呢?

robots.txt(小写字母)是一种存放在一些网站的服务器根目录下的ASCII编码的文本文件。它的作用是告诉搜索引擎的爬虫机器人(又称网络蜘蛛、漫游器)该网站中的哪些内容是不允许被搜索引擎爬虫抓取的,哪些是允许被抓取的。由于在一些系统中URL大小写敏感,因此robots.txt的文件名均统一为小写。robots.txt放置在网站的根目录下。

淘宝为什么要这样做呢?

网上的说法有很多种,在我看来有2个重要的原因:

1、保护用户的信息

搜索引擎对动态页面的抓取技术越来越成熟,在没屏蔽爬虫的情况下,爬虫是可以抓取到用户登陆之后的信息的,抓取之后是有可能在搜索引擎中搜索时候展现出来的,基于这种前提淘宝考虑屏蔽。

2、抢夺流量入口

可以试想一下如果在百度搜索中,搜索淘宝的一家店铺名字能够展现出来这个淘宝店铺的话,会有多少人直接用百度搜索淘宝店铺购买想要的东西了,而不会先进入到淘宝网再对淘宝店铺进行搜索了?那么这一部分本来就属于淘宝的流量被百度给抢走了,淘宝能干嘛?

再试想一下,这些流量都被百度抢走之后淘宝网首页的大图推荐还能卖多少钱?淘宝的直通车还能赚钱吗?淘宝自己开发的那么多产品不都是通过流量来变现的吗?这些流量被百度拿走了对淘宝来说是一个巨大的损失。

综合这2点重要的因素我们了解到淘宝通过禁止搜索引擎爬虫的抓取,抢夺到一大批的流量,同时淘宝还在搜索引擎上购买流量,如下图:

天猫本身是屏蔽蜘蛛抓取的,但是他们在百度付费推广做广告,等于是在付费购买百度搜索引擎的流量。

淘宝在拥有大流量大数据的情况下开发出各种针对商家的产品,让商家对这自己需要的部分流量进行付费买单,从而实现流量变现。

https://www.leosem.com/

相关文章

  • 电子商务:淘宝为什么禁止搜索引擎蜘蛛爬行抓取内容

    我们都知道在国内如果买东西的话去淘宝购买就好了,对于普通网名来说他们不会在浏览器中搜索域名进入淘宝网站,更多的是在...

  • 你所不了解的搜索引擎

    搜索引擎指的是蜘蛛程序沿着链接爬行和抓取网上的大量网页内容,存入数据库,经过复杂的算法进行预处理,建立网站索引目录...

  • SEO优化

    SEO优化 禁止蜘蛛爬行和传递权重,为了减少垃圾链接对搜索引擎的影响 rel="nofollow"

  • SEO怎么优化?

    搜索引擎优化实际上就是“蜘蛛”在互联网中不断爬行,利用抓取网页放入索引库中通过搜索引擎用来分析用户的搜索意图...

  • 简谈网站布局

    网站布局就相当于蜘蛛爬行的网,搜索引擎进行一步的抓取和创新。如果不去维持这段网,便无法在进行爬行,只能选择被淘汰。...

  • SEO实战密码解读二

    搜索引擎与目录的区别 搜索引擎是由蜘蛛程序沿着链接爬行和抓取网上的大量页面,存进数据库,经过预处理,用户在搜索框输...

  • SEO实战密码解读五

    搜索引擎工作原理简介 搜索引擎工作过程大体上可以分为三个阶段: 爬行抓取--预处理--排名 1.爬行和抓取 1.1...

  • SEO优化:robots.txt协议文件相关

    1. 什么是robots.txt文件 用于指令搜索引擎禁止抓取网站某些内容或者指定抓取网站某些内容的。只有需要在禁...

  • 【石家站seo】如何提高网站蜘蛛抓取的频率?

    很多人都想让自己的网站收录更快些,想了各种方式来提高搜索引擎蜘蛛抓取的次数,而只有更多的网页爬行,才有可能获得更好...

  • 网站 robots.txt 文件配置方法 | 如何禁止搜索引擎收

    前言 搜索引擎通过网络蜘蛛抓取网页的内容,并展示在相关的搜索结果中。但是有些网页内容我们可能并不想被搜索引擎收录和...

网友评论

      本文标题:电子商务:淘宝为什么禁止搜索引擎蜘蛛爬行抓取内容

      本文链接:https://www.haomeiwen.com/subject/nkalbxtx.html