学做网站培训课程介绍

当前位置:

什么是robots协议

以下为学做网站论坛关于“什么是robots协议”讲解视频教程。

选择课程播放速度:

什么是robots协议?

robots文件简单的来说就是给你的网站做一个权限清单,一般是针对做SEO优化的。在这个文件里面写上哪些文件、哪些形式的链接允许搜索引擎抓取,哪些不允许。

robots文件常用写法:


User-agent: *
Disallow:/*?*

robots协议放哪里?

在你的网站还没有调整好的时候,不想让搜索引擎收录,可以通过这个文件屏蔽搜索引擎。就像QQ你隐身了别人就看不到你。

这个文件的名字就是robots.txt,是固定的,不管哪个网站要放这个都是这个名字。一般我们会把robots.txt放到FTP根目录下。

robots协议如何屏蔽搜索引擎?

robots.txt就是一个记事本,所以只要在里面写上如下内容就可以屏蔽。
User-agent: *
Disallow:/

WP网站如何写robots.txt?

最简单的这样写就行了。
User-agent: *
Disallow: /wp-*
Allow: /wp-content/uploads/
Disallow: /*.php$
Disallow: /*.inc$
Disallow: /*.js$
Disallow: /*.css$
Disallow: /?s=

robots.txt的写法规则

User-agent: * 这里的*代表的所有的搜索引擎种类,*是一个通配符
Disallow: /admin/ 这里定义是禁止爬寻admin目录下面的目录
Disallow: /require/ 这里定义是禁止爬寻require目录下面的目录
Disallow: /ABC/ 这里定义是禁止爬寻ABC整个目录
Disallow: /cgi-bin/*.htm 禁止访问/cgi-bin/目录下的所有以".htm"为后缀的URL(包含子目录)。
Disallow: /*?* 禁止访问网站中所有的动态页面
Disallow: /jpg$ 禁止抓取网页所有的.jpg格式的图片
Disallow:/ab/adc.html 禁止爬去ab文件夹下面的adc.html文件。
User-agent: * 这里的*代表的所有的搜索引擎种类,*是一个通配符
Allow: /cgi-bin/ 这里定义是允许爬寻cgi-bin目录下面的目录
Allow: /tmp 这里定义是允许爬寻tmp的整个目录
Allow: .htm$ 仅允许访问以".htm"为后缀的URL。
Allow: .gif$ 允许抓取网页和gif格式图片robots.txt文件用法举例

《“什么是robots协议”》 有 2 条评论

  1. 学习建网站学员 小师说道:

    #Allow: /wp-content/uploads/

    这一行是不是错了,搜了很多资料,都没看到前面加 # 号是什么意思~~~

    • 学做网站论坛讲师 学做网站讲师说道:

      #表示注释,代码这一行不起作用。一般不需要写的,Allow 表示允许抓取某个目录

发表评论

您的电子邮箱地址不会被公开。 必填项已用*标注

相关教程

  • robots文件写法与作用 视频教程 (128907 次浏览)
    更多SEO优化实战课程:https://www.xuewangzhan.com/vip/forum.php?gid=88什么是robots文件robots文件是一个协议,而不是一个命令。robots.txt是
  • 什么是robots协议 视频教程 (1185108 次浏览)
    什么是robots协议?robots文件简单的来说就是给你的网站做一个权限清单,一般是针对做SEO优化的。在这个文件里面写上哪些文件、哪些形式的链接允许