亚洲精品少妇久久久久久,24小时最新更新免费观看,宝宝我找到你的敏感点了

作為一個(gè)網(wǎng)站建設(shè)加優(yōu)化的公司，是必須要回的就是robots.txt文件，所以我們就來(lái)看看這個(gè)文件的意思

robots.txt是一個(gè)純文本文件，用于聲明該網(wǎng)站中不想被蜘蛛訪問(wèn)的部分，或者指定蜘蛛抓取的部分。不是規(guī)定，而是一種約定，需要蜘蛛自覺(jué)遵守的一種習(xí)俗

當(dāng)蜘蛛訪問(wèn)一個(gè)站點(diǎn)時(shí)，它會(huì)首先檢查該站點(diǎn)是否存在robots.txt

如果找到，蜘蛛就會(huì)按照該文件中的內(nèi)容來(lái)確定抓取的范圍

如果該文件不存在，那么蜘蛛就沿著鏈接直接抓取

網(wǎng)站建設(shè)

robots.txt的作用

1、防止私密或重要內(nèi)容被搜索引擎抓取

2、節(jié)省服務(wù)器資源，從而提高服務(wù)質(zhì)量

3、減少重復(fù)抓取，提高網(wǎng)站質(zhì)量

4、指定sitemap文件位置

robots.txt是什么

User-agent: *

針對(duì)哪個(gè)搜索引擎蜘蛛

這里的*代表搜索引擎種類，*是通配符

Allow

定義的是允許蜘蛛抓取某個(gè)欄目或文件

Allow: /cgi-bin/

這里定義是允許訪問(wèn)cgi-bin目錄

Allow:/* .htm$

允許訪問(wèn)以".htm"為后綴的URL

$指的是匹配行結(jié)束符

*指的是匹配任何字符

網(wǎng)站建設(shè)

Disallow

定義的是禁止蜘蛛抓取某個(gè)欄目或文件

Disallow: /admin/

這里定義是禁止抓取admin目錄

Disallow: /cgi-bin/*.htm

禁止抓取/cgi-bin/目錄下的所有以".htm"為后綴的URL

Disallow: /*?*

禁止抓取網(wǎng)站中所有包含問(wèn)號(hào) “?”的網(wǎng)址 robots.txt是什么

用法：sitemap: http://www.google.com/sitemap.xml

sitemap：URL全稱（包含http://部分）

告訴搜索引擎蜘蛛這個(gè)頁(yè)面是網(wǎng)站地圖

robots.txt文件主要是限制整個(gè)站點(diǎn)或者目錄的蜘蛛訪問(wèn)情況，而robots meta標(biāo)簽則主要是針對(duì)某個(gè)具體的頁(yè)面

上一篇：關(guān)于網(wǎng)站建設(shè)科普知識(shí)

下一篇：網(wǎng)站遷移需要注意什么，怎么降低損失

返回列表頁(yè)>

robots.txt是什么？怎么運(yùn)用