<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>英文SEO-英文SEM-高手在武汉的外贸搜索引擎营销博客 &#187; 搜索引擎收录</title>
	<atom:link href="http://www.hieoem.cn/tag/%e6%90%9c%e7%b4%a2%e5%bc%95%e6%93%8e%e6%94%b6%e5%bd%95/feed/" rel="self" type="application/rss+xml" />
	<link>http://www.hieoem.cn</link>
	<description>分析研究英文SEO和英文SEM搜索引擎营销技术，阐述英文网店SEO(搜索引擎优化)技术, SEM（搜索引擎营销），网络营销的技巧</description>
	<lastBuildDate>Thu, 30 Jun 2011 07:24:48 +0000</lastBuildDate>
	<language>en</language>
	<sy:updatePeriod>hourly</sy:updatePeriod>
	<sy:updateFrequency>1</sy:updateFrequency>
	<generator>http://wordpress.org/?v=3.3.1</generator>
		<item>
		<title>禁止搜索引擎收录网站</title>
		<link>http://www.hieoem.cn/robots-txt/</link>
		<comments>http://www.hieoem.cn/robots-txt/#comments</comments>
		<pubDate>Wed, 16 Sep 2009 13:21:55 +0000</pubDate>
		<dc:creator>admin</dc:creator>
				<category><![CDATA[个人随笔]]></category>
		<category><![CDATA[robots]]></category>
		<category><![CDATA[搜索引擎]]></category>
		<category><![CDATA[搜索引擎收录]]></category>

		<guid isPermaLink="false">http://www.hieoem.cn/?p=194</guid>
		<description><![CDATA[<p>禁止搜索引擎收录的方法。<a title="最常用的搜索引擎官方资源" href="http://www.hieoem.cn/guangfangseo/"><strong>最常用的搜索引擎官方资源</strong></a>,有很多种，首先给大家介绍什么是robots.txt文件? 搜索引擎使用spider程序自动访问互联网上的网页并获取网页信息。spider在访问一个网站时，会首先会检查该网站的根域下是否有一个叫做 robots.txt的纯文本文件，这个文件用于指定spider在您网站上的抓取范围。您可以在您的网站中创建一个robots.txt，在文件中声明该网站中不想被搜索引擎收录的部分或者指定搜索引擎只收录特定的部分。</p>
<p><span id="more-194"></span></p>
<p>请注意，仅当您的网站包含不希望被搜索引擎收录的内容时，才需要使用robots.txt文件。如果您希望搜索引擎收录网站上所有内容，请勿建立robots.txt文件。</p>
<p>robots.txt文件放在哪里?  robots.txt 文件应该放置在网站根目录下。举例来说，当spider访问一个网站（比如http://www.abc.com）时，首先会检查该网站中是否存在 http://www.abc.com/robots.txt这个文件，如果Spider找到这个文件，它就会根据这个文件的内容，来确定它访问权限的范围。</p>
<p>我在robots.txt中设置了禁止搜索引擎收录我网站的内容，为何还出现在搜索引擎搜索结果中？ 如果其他网站链接了您robots.txt文件中设置的禁止收录的网页，那么这些网页仍然可能会出现在搜索引擎的搜索结果中，但您的网页上的内容不会被抓取、建入索引和显示，搜索引擎搜索结果中展示的仅是其他网站对您相关网页的描述。</p>
<p>禁止搜索引擎在搜索结果中显示网页快照，而只对网页建索引？搜索引擎支持通过设置网页的meta，防止搜索引擎显示网站的快照。方法如下：<br />
要防止所有搜索引擎显示您网站的快照，请将此元标记置入网页的 &#60;HEAD&#62; 部分：<br />
&#60;meta name=”robots” content=”noarchive”&#62;<br />
要允许其他搜索引擎显示快照，但仅防止搜索引擎显示，请使用以下标记：<br />
&#60;meta name=”Baiduspider” content=”noarchive”&#62;<br />
注：此标记只是禁止百度显示该网页的快照，搜索引擎会继续为网页建索引，并在搜索结果中显示网页摘要。</p>
<p>我想禁止搜索引擎图片搜索收录某些图片，该如何设置？ 禁止Baiduspider抓取网站上所有图片、禁止或允许Baiduspider抓取网站上的某种特定格式的图片文件可以通过设置robots实现，请参考“robots.txt文件用法举例”中的例10、11、12。</p>
<p>在robots.txt中设置了禁止搜索引擎收录我网站的内容，为何还出现在搜索引擎搜索结果中？如果其他网站链接了您robots.txt文件中设置的禁止收录的网页，那么这些网页仍然可能会出现在搜索引擎的搜索结果中，但您的网页上的内容不会被抓取、建入索引和显示，搜索引擎搜索结果中展示的仅是其他网站对您相关网页的描述。<br />
“robots.txt”文件包含一条或更多的记录，这些记录通过空行分开（以CR,CR/NL, or NL作为结束符），每一条记录的格式如下所示：<br />
“&#60;field&#62;:&#60;optionalspace&#62;&#60;value&#62;&#60;optionalspace&#62;”。<br />
User-agent:<br />
该项的值用于描述搜索引擎robot的名字。在”robots.txt”文件中，如果有多条User-agent记录说明有多个robot会受到”robots.txt”的限制，对该文件来说，至少要有一条User-agent记录。如果该项的值设为*，则对任何robot均有效，在”robots.txt”文件中，”User-agent:*”这样的记录只能有一条。如果在”robots.txt”文件中，加入”User- agent:SomeBot”和若干Disallow、Allow行，那么名为”SomeBot”只受到”User-agent:SomeBot”后面的&#8230;</p>]]></description>
		<wfw:commentRss>http://www.hieoem.cn/robots-txt/feed/</wfw:commentRss>
		<slash:comments>0</slash:comments>
		</item>
	</channel>
</rss>

