使用便捷的预设,构建带 allow/disallow 规则、crawl-delay 和 sitemap 指令的正确 robots.txt。免费,在您的浏览器中运行。

直接在您的浏览器中构建一个整洁的 robots.txt。不会上传任何内容——所有内容均在本地生成。

构建器
快捷预设
User-agent 分组
站点地图
robots.txt

						

请将此文件放在网站根目录,以便可通过 https://your-site.com/robots.txt 访问


关于 robots.txt 生成器

这个 robots.txt 生成器可根据用户代理(user-agent)分组构建语法正确的 robots.txt 文件,每个分组都有自己的 Allow 和 Disallow 路径,以及可选的 Crawl-delay。你可以添加任意数量的分组——为所有爬虫设置的通配符 * 分组,加上针对特定爬虫的规则——并在末尾列出一个或多个 Sitemap 指令。

快捷预设涵盖了常见的起点配置:允许全部、禁止全部、合理的 WordPress 配置,以及常见爬虫的屏蔽列表。从预设开始,再根据你的站点结构调整路径。

该文件在你的浏览器中本地生成,绝不会被上传。复制输出内容或下载 robots.txt,然后将其放在站点根目录,这样爬虫就能在 https://your-site.com/robots.txt 找到它——这是搜索引擎唯一会检查的确切位置。

如何使用 robots.txt 生成器

  1. 可选择从预设开始:允许全部、禁止全部、WordPress,或屏蔽常见爬虫。
  2. 编辑每个分组的用户代理(例如 * 或 Googlebot),并添加 Disallow 和 Allow 路径。
  3. 设置可选的 Crawl-delay(以秒为单位),如需要可为其他爬虫添加更多分组。
  4. 添加你的站点地图链接,以便爬虫能够发现它们。
  5. 复制结果或下载 robots.txt,并上传到你的站点根目录。

常见问题

必须放在主机的根目录下,例如 https://example.com/robots.txt。爬虫只会请求这个路径——放在子目录中的 robots.txt 会被忽略。

Disallow 会阻止该用户代理分组对匹配路径的抓取;Allow 则可在被禁止的区域中重新允许某个子路径,例如在禁止 /admin/ 的同时允许 /admin/help/。

不一定可靠。它只能阻止抓取,但已被搜索引擎收录的 URL 仍可能在没有摘要的情况下出现。要将页面彻底排除在索引之外,应使用 noindex robots 元标签并允许其被抓取。

不会。一些爬虫会遵守该指令,但 Googlebot 会忽略它——Google 的抓取频率是通过 Search Console 来管理的。不过它对其他爬虫仍然有用。

免费,且文件完全在你的浏览器中生成——你输入的规则永远不会发送到服务器。

需要帮助?
使用此工具时遇到问题?请告诉我们的团队。
报告问题

将此免费工具添加到你自己的网站 — 复制并粘贴下面的代码。