当前位置: 首页 > 图文教程 > 网站运营 > 网站优化 > 搜索引擎真的遵守robots.txt协议吗?

网站优化
网络推广经验谈 浅谈交换友情链接中存在的若干陷阱
网页优化中Meta Keywords已经没有必要了!
SEO案例分析 alimama做SEO引流量的方法
百度快照 不更新的原因分析
友情链接不要太在意对方PR值
打造IP流量上万的五个网站推广技巧
正确的学习搜索引擎优化SEO
网站被搜索引擎惩罚主要的原因分析
黑帽 SEO到底有没有用
SEO与用户体验的关系
友情链接页与频道目录页的链接区别分析
针对搜索做网站用二级域名还是用一级目录?
搜索引擎最近的变化说明
SEO 大流量网站思路
SEO理论知识分享 SEO思想的转变
SEO教程 使网页代码尽量符合WEB标准
SEO入门技巧 学好SEO
做好百度优化的几个因素
Seo nofollow和Web标准化
SEO Globalsources应用锚文本和关键字

网站优化 中的 搜索引擎真的遵守robots.txt协议吗?


出处:互联网   整理: 软晨网(RuanChen.com)   发布: 2009-10-17   浏览: 86 ::
收藏到网摘: n/a

 我们都知道robots.txt文件是搜索引擎遵守的一个抓取协议,但是是不是真的有效果呢?

搜索引擎真的会遵循这个协议吗?

让我们首先来看看

下面这段 [这是我南昌SEO站点的robots.txt设置:允许GG 百度、ALEXA 抓取,屏蔽了其他一切引擎禁止!]

User-agent:Googlebot

Disallow:

User-agent:baiduspider

Disallow:

User-agent:ia_archiver

Disallow:

User-agent:*

Disallow:/

从理论上来说 这样的设置就屏蔽了其他一切引擎,但实际上这种方法并不能完全屏蔽SOSO YAHOO MSN之类的爬虫,在YAHOO上输入site:www.seo-jx.cn还是可以看到内容以及索引的!
遵守robots协议与否当然是由他们自己说了算的!所以要想完全屏蔽搜索引擎的爬虫,需要在.htaccess中加入限制语句才行,这里我们介绍2种最简单的方法:
1:

RewriteEngine on
RewriteCond %{HTTP_USER_AGENT} ^MSNBOT [NC]
RewriteRule .* - [F]

 

2:

SetEnvIfNoCase User-Agent "^MSNBOT" bad_bot

<Limit GET POST>
Order Allow,Deny
Allow from all
Deny from env=bad_bot
</Limit>

注:MSNBOT 为MSN蜘蛛机器人代码 ,如果想要真正屏蔽某个搜索引擎 把其中的红色部分[MSNBOT]
换成你想要屏蔽的蜘蛛机器人代码即可!
请不要随意添写 否则造成损失与本人无关!
SEO小林发布,转载请注明出处:江西南昌SEO http://www.seo-jx.cn/