gpt4 book ai didi

什么是robots.txt?robots文件怎么写

转载 作者:qq735679552 更新时间:2022-09-28 22:32:09 31 4
gpt4 key购买 nike

CFSDN坚持开源创造价值,我们致力于搭建一个资源共享平台,让每一个IT人在这里找到属于你的精彩世界.

这篇CFSDN的博客文章什么是robots.txt?robots文件怎么写由作者收集整理,如果你对这篇文章有兴趣,记得点赞哟.

什么是robots.txt?robots文件怎么写

什么是robots.txt?robots文件怎么写 。

robots文件简单的来说就是给你的网站做一个权限清单,一般是针对做SEO优化的。在这个文件里面写上哪些文件、哪些形式的链接允许搜索引擎抓取,哪些不允许.

为什么要放这个文件?放哪里?

在你的网站还没有调整好的时候,不想让搜索引擎收录,可以通过这个文件屏蔽搜索引擎。就像QQ你隐身了别人就看不到你.

这个文件的名字就是robots.txt,是固定的,不管哪个网站要放这个都是这个名字。一般我们会把robots.txt放到FTP根目录下.

如何屏蔽搜索引擎?

robots.txt就是一个记事本,所以只要在里面写上如下内容就可以屏蔽.

User-agent: * 。

Disallow:/ 。

WP网站如何写robots.txt?

最简单的这样写就行了.

User-agent: * 。

Disallow: /wp-* 。

#Allow: /wp-content/uploads/ 。

Disallow: /*.php$ 。

Disallow: /*.inc$ 。

Disallow: /*.js$ 。

Disallow: /*.css$ 。

Disallow: /?s= 。

robots.txt的写法规则 。

User-agent: * 这里的*代表的所有的搜索引擎种类,*是一个通配符 。

Disallow: /admin/ 这里定义是禁止爬寻admin目录下面的目录 。

Disallow: /require/ 这里定义是禁止爬寻require目录下面的目录 。

Disallow: /ABC/ 这里定义是禁止爬寻ABC整个目录 。

Disallow: /cgi-bin/*.htm 禁止访问/cgi-bin/目录下的所有以”.htm”为后缀的URL(包含子目录).

Disallow: /*?* 禁止访问网站中所有的动态页面 。

Disallow: /jpg$ 禁止抓取网页所有的.jpg格式的图片 。

Disallow:/ab/adc.html 禁止爬去ab文件夹下面的adc.html文件.

User-agent: * 这里的*代表的所有的搜索引擎种类,*是一个通配符 。

Allow: /cgi-bin/ 这里定义是允许爬寻cgi-bin目录下面的目录 。

Allow: /tmp 这里定义是允许爬寻tmp的整个目录 。

Allow: .htm$ 仅允许访问以”.htm”为后缀的URL.

Allow: .gif$ 允许抓取网页和gif格式图片robots.txt文件用法举例 。

最后此篇关于什么是robots.txt?robots文件怎么写的文章就讲到这里了,如果你想了解更多关于什么是robots.txt?robots文件怎么写的内容请搜索CFSDN的文章或继续浏览相关文章,希望大家以后支持我的博客! 。

31 4 0
Copyright 2021 - 2024 cfsdn All Rights Reserved 蜀ICP备2022000587号
广告合作:1813099741@qq.com 6ren.com