Skip to content

robots.txt 生成器 - 在线 Robots 文件生成

100% 本地网络

免费在线 robots.txt 生成器,配置 User-agent 和 Allow/Disallow 规则,一键生成标准 robots.txt 文件。

此工具完全在您的浏览器中运行。打开 DevTools → Network 面板,搜索您的输入内容——它不会出现在任何请求中。

使用指南

robots.txt 放在网站根目录,告诉爬虫「哪里可以抓、哪里别去」——它是搜索引擎优化的第一份配置文件。本工具按分组(User-agent)+ 规则(Allow/Disallow)+ Sitemap 的结构可视化生成,实时预览结果。

1. 生成一份 robots.txt

  1. 添加分组:通配符 * 管住所有爬虫;针对特定爬虫(如 GPTBot、Googlebot)单独建组。
  2. 按组添加 Allow/Disallow 规则:路径以前缀匹配,如 /admin/。
  3. 填入 sitemap 地址(帮助搜索引擎快速定位全站 URL 列表),复制结果存为根目录下的 robots.txt。

2. 必须先建立的正确认知

  • robots.txt 是「请求」不是「墙」:守规矩的搜索引擎遵守,恶意爬虫直接无视——真正的私有内容必须靠登录认证,robots 只是减少无意义的抓取。
  • robots.txt 全网公开:Disallow 的路径等于昭告天下「这里有东西」——后台地址写进去反而是给攻击者递地图。
  • 「禁止抓取」≠「禁止收录」:被 Disallow 的 URL 如果有外链指向,仍可能出现在搜索结果里(只是没有摘要)。真要阻止收录用 noindex。

3. 两个代价最大的事故

上线前把测试环境的 Disallow: / 带到了生产——全站从搜索结果消失,恢复要数周;以为 Disallow 就不收录,结果页面以无摘要形式出现在搜索里。上线流程里给 robots.txt 加一道检查,比事后补救便宜得多。

常见问题

完全免费,无需注册。规则配置与文件生成全部在浏览器本地完成。

支持按 User-agent 配置 Allow/Disallow 规则、Crawl-delay 抓取延迟,并可声明 Sitemap 地址。

可以。输出符合 robots.txt 标准语法,下载后放到网站根目录即可生效。

相关工具

相关文章

开发者推荐

推广