免费注册

Robots.txt 生成器

逐个设置要放行和屏蔽的蜘蛛,填好目录和网站地图,马上得到可以上传的 robots.txt。

关于Robots.txt 生成器

用 Robots.txt 生成器写好的 robots.txt 放在网站根目录,告诉各家蜘蛛哪些目录可以抓、哪些不要抓。新站上线、后台目录不想被抓取、测试站不希望蜘蛛来访,或者不想让文章被拿去训练 AI,都用得上它。先选对所有爬虫的默认规则:全部放行或全部屏蔽;再把要屏蔽的目录一行一个填进去,比如 /admin/、/cart/;加上 Sitemap 地址,需要时再设抓取间隔。生成结果随填随变。还没有 sitemap 的话,可以先用网站地图 Sitemap 生成器生成一个。

每个爬虫都有单独的开关:搜索引擎有百度、谷歌、必应、360、搜狗、神马、Yandex 和 DuckDuckGo 八家的蜘蛛;AI 爬虫有 GPTBot、ClaudeBot、Google-Extended、字节跳动的 Bytespider 等 9 个,另有一键屏蔽 AI 训练爬虫的预设。复制或下载 robots.txt,上传到网站根目录,再用 Robots.txt 检测试试具体网址对各家蜘蛛是否放行。全程在浏览器里完成,不上传任何内容。

Robots.txt 生成器怎么用

  1. 1
    选默认规则

    先决定对所有爬虫默认全部放行,还是全部屏蔽。

  2. 2
    填目录和网站地图

    要屏蔽的目录一行一个,再填 Sitemap 地址,需要时加上抓取间隔。

  3. 3
    逐个设置蜘蛛

    按需开关百度、谷歌等搜索引擎和各家 AI 爬虫,也可以一键屏蔽 AI 训练爬虫。

  4. 4
    下载并上传

    复制或下载 robots.txt,放到网站根目录,再用 Robots.txt 检测验证。

为什么用熊仔工匠

  • 国内蜘蛛都有

    百度、360、搜狗、神马,以及谷歌、必应、Yandex、DuckDuckGo 的爬虫都能单独设置。

  • 9 个 AI 爬虫

    GPTBot、ClaudeBot、Google-Extended、CCBot、PerplexityBot、Bytespider 等逐个开关。

  • 一键屏蔽 AI 训练

    不用自己写规则,点一下就屏蔽收集训练数据的 AI 爬虫。

  • 本地实时生成

    在浏览器里随填随生成,不上传、不占次数,页面打开后断网也能用。

常见问题

Robots.txt 生成器常见问题

robots.txt 应该放在哪里?
放在网站根目录,能通过 https://你的域名/robots.txt 打开。蜘蛛不会去子目录里找,每个子域名(比如 m. 开头的手机站)也要单独放一份。
用 robots.txt 屏蔽了,页面就不会被收录吗?
不一定。robots.txt 管的是抓取,在谷歌里,如果别的网页链接到这个网址,它仍可能只以网址的形式出现在搜索结果里。想让页面不被收录,应该允许抓取,并在页面上加 noindex 标签。noindex 标签可以用 Meta 标签生成器生成。
怎么屏蔽 GPTBot 等 AI 爬虫?
在 AI 爬虫里关掉不想放行的,或者用一键屏蔽 AI 训练爬虫的预设。屏蔽 Google-Extended 不影响网站在谷歌搜索里的收录和排名。
Crawl-delay 对百度和谷歌有用吗?
谷歌不认 Crawl-delay,百度一般也不按它执行,必应会遵守。服务器没有被抓取拖慢的话,留空就好。
Robots.txt 生成器要收费吗?
免费,不用注册,也不占每日次数。整个过程在浏览器里完成,页面打开后断网也能用。
把Robots.txt 生成器分享给朋友打开浏览器就能用,对方不注册也能先试。

相关工具

XML 网站地图 Sitemap 生成器自动抓取网站或粘贴网址列表,生成 XML 网站地图。
HTML Meta 标签生成器编写标题、描述和 robots 标签,实时检查长度并预览。
JSON 结构化数据生成器生成常见问题、文章、商品、组织等类型的 JSON-LD 结构化数据。
HTML 社交分享标签生成器生成 Open Graph 和 Twitter Card 标签,并预览分享卡片。
CONF 301 重定向代码生成器生成 Apache、Nginx、IIS、PHP 和 HTML 的跳转规则。
URL UTM 链接生成器给链接加上 UTM 参数,在统计工具里区分推广渠道。
HTML hreflang 多语言标签生成器为网页的各个语言版本生成 hreflang 标签。
CONF Htpasswd 密码文件生成器生成 Apache、Nginx 基本认证用的 .htpasswd 内容。