PC站长网 欢迎您的到来

TOP

什么是robots.txt(十七)
2017-01-03 22:04:37 来源: 作者: 【 】 浏览:462次 评论:0

  什么是robots文件?

  robots文件简单的来说就是给你的网站做一个权限清单,一般是针对做SEO优化的。在这个文件里面写上哪些文件、哪些形式的链接允许搜索引擎抓取,哪些不允许。

  为什么要放这个文件?放哪里?

  在你的网站还没有调整好的时候,不想让搜索引擎收录,可以通过这个文件屏蔽搜索引擎。就像QQ你隐身了别人就看不到你。

  这个文件的名字就是robots.txt,是固定的,不管哪个网站要放这个都是这个名字。一般我们会把robots.txt放到FTP根目录下。

  如何屏蔽搜索引擎?

  robots.txt就是一个记事本,所以只要在里面写上如下内容就可以屏蔽。

  User-agent: *

  Disallow:/

  WP网站如何写robots.txt?

  最简单的这样写就行了。

  User-agent: *

  Disallow: /wp-*

  #Allow: /wp-content/uploads/

  Disallow: /*.php$

  Disallow: /*.inc$

  Disallow: /*.js$

  Disallow: /*.css$

  Disallow: /?s=

  robots.txt的写法规则

  User-agent: * 这里的*代表的所有的搜索引擎种类,*是一个通配符

  Disallow: /admin/ 这里定义是禁止爬寻admin目录下面的目录

  Disallow: /require/ 这里定义是禁止爬寻require目录下面的目录

  Disallow: /ABC/ 这里定义是禁止爬寻ABC整个目录

  Disallow: /cgi-bin/*.htm 禁止访问/cgi-bin/目录下的所有以".htm"为后缀的URL(包含子目录)。

  Disallow: /*?* 禁止访问网站中所有的动态页面

  Disallow: /jpg$ 禁止抓取网页所有的.jpg格式的图片

  Disallow:/ab/adc.html 禁止爬去ab文件夹下面的adc.html文件。

  User-agent: * 这里的*代表的所有的搜索引擎种类,*是一个通配符

  Allow: /cgi-bin/ 这里定义是允许爬寻cgi-bin目录下面的目录

  Allow: /tmp 这里定义是允许爬寻tmp的整个目录

  Allow: .htm$ 仅允许访问以".htm"为后缀的URL。

  Allow: .gif$ 允许抓取网页和gif格式图片robots.txt文件用法举例

您看到此篇文章时的感受是:
Tags:什么 robots.txt 十七 责任编辑:pczzw
】【打印繁体】【投稿】【收藏】 【推荐】【举报】【评论】 【关闭】 【返回顶部
上一篇http返回状态代码(十八) 下一篇什么是本地环境搭建(十六)

论坛推荐图文

评论

帐  号: 密码: (新用户注册)
验 证 码:
表  情:
内  容:

相关栏目

最新文章

热门文章

推荐文章

相关文章