關於Robots.txt 生成器
用 Robots.txt 生成器寫好的 robots.txt 放在網站根目錄,告訴各家蜘蛛哪些目錄可以抓、哪些不要抓。新站上線、後臺目錄不想被抓取、測試站不希望蜘蛛來訪,或者不想讓文章被拿去訓練 AI,都用得上它。先選對所有爬蟲的預設規則:全部放行或全部遮蔽;再把要遮蔽的目錄一行一個填進去,比如 /admin/、/cart/;加上 Sitemap 地址,需要時再設抓取間隔。生成結果隨填隨變。還沒有 sitemap 的話,可以先用網站地圖 Sitemap 生成器生成一個。
每個爬蟲都有單獨的開關:搜尋引擎有百度、谷歌、必應、360、搜狗、神馬、Yandex 和 DuckDuckGo 八家的蜘蛛;AI 爬蟲有 GPTBot、ClaudeBot、Google-Extended、位元組跳動的 Bytespider 等 9 個,另有一鍵遮蔽 AI 訓練爬蟲的預設。複製或下載 robots.txt,上傳到網站根目錄,再用 Robots.txt 檢測試試具體網址對各家蜘蛛是否放行。全程在瀏覽器裡完成,不上傳任何內容。
Robots.txt 生成器怎麼用
- 1選預設規則
先決定對所有爬蟲預設全部放行,還是全部遮蔽。
- 2填目錄和網站地圖
要遮蔽的目錄一行一個,再填 Sitemap 地址,需要時加上抓取間隔。
- 3逐個設定蜘蛛
按需開關百度、谷歌等搜尋引擎和各家 AI 爬蟲,也可以一鍵遮蔽 AI 訓練爬蟲。
- 4下載並上傳
複製或下載 robots.txt,放到網站根目錄,再用 Robots.txt 檢測驗證。
為什麼用熊仔工匠
- 國內蜘蛛都有
百度、360、搜狗、神馬,以及谷歌、必應、Yandex、DuckDuckGo 的爬蟲都能單獨設定。
- 9 個 AI 爬蟲
GPTBot、ClaudeBot、Google-Extended、CCBot、PerplexityBot、Bytespider 等逐個開關。
- 一鍵遮蔽 AI 訓練
不用自己寫規則,點一下就遮蔽收集訓練資料的 AI 爬蟲。
- 本地實時生成
在瀏覽器裡隨填隨生成,不上傳、不佔次數,頁面開啟後斷網也能用。