1、robots.txt 文件必须放在网站 根目录 下,文件名必须是:robots.txt (小写,无后缀)
2、生效规则:上传后搜索引擎爬虫会自动识别,一般1-24小时内生效,无需提交
3、核心语法:User-agent: 爬虫标识 | Allow: 允许抓取的路径 | Disallow: 禁止抓取的路径 | Sitemap: 站点地图地址
4、User-agent: * 代表 所有爬虫,优先级低于单独配置的爬虫规则
5、禁止全站:只需要写 User-agent: * + Disallow: / 即可
6、允许全站:只需要写 User-agent: * + Allow: / 即可
7、本工具生成的规则完全符合搜索引擎官方协议,百度/谷歌等均完美兼容