免費註冊

Robots.txt 檢測

測試一個網址對 20 個搜尋引擎和 AI 爬蟲是否放行,找出起作用的那條規則。

關於Robots.txt 檢測

robots.txt 寫錯一行,整站都可能從搜尋結果裡消失,所以要做 robots.txt 檢測。上傳新規則前、頁面從百度或谷歌掉出去時、想知道 AI 爬蟲能否抓你的內容時,都可以測一測。輸入完整的頁面網址,點開始測試;預設讀取線上的 robots.txt,也可以貼上草稿先試。

規則按谷歌的做法和 RFC 9309 解析:支援 * 萬用字元和 $ 結尾,最長的匹配規則生效,一樣長時 Allow 優先,並選用最具體的 user-agent 分組。路徑會對 20 個爬蟲逐一測試,包括百度蜘蛛、谷歌蜘蛛、必應、360、搜狗、神馬和 GPTBot 等 AI 爬蟲,也可以加自定義爬蟲。每一行顯示放行還是禁止和起作用的規則,檔案裡對應的行會高亮。全站 Disallow: /、遮蔽 CSS 或 JS、語法錯誤、缺少 Sitemap 行、Crawl-delay、檔案超過 500 KB 或返回錯誤狀態碼,都會提醒。新規則可以用 Robots.txt 生成器生成。

Robots.txt 檢測怎麼用

  1. 1
    輸入頁面網址

    填要測試的完整網址,而不只是域名。

  2. 2
    加爬蟲或草稿

    可以填自定義爬蟲名稱,或貼上規則草稿代替線上檔案。

  3. 3
    點“開始測試”

    每個爬蟲都得到放行或禁止的結論。

  4. 4
    看起作用的行

    在檔案檢視裡找到高亮的規則,按需修改。

為什麼用熊仔工匠

  • 按谷歌規則判斷

    萬用字元、$ 結尾、最長匹配、Allow 優先,遵循 RFC 9309。

  • 20 個爬蟲一起測

    百度、谷歌、360、搜狗、神馬等搜尋引擎,加上主流 AI 爬蟲。

  • 上線前測草稿

    貼上規則先測試,確認無誤再上傳。

  • 常見錯誤提醒

    全站遮蔽、遮蔽 CSS/JS、語法錯誤、缺少 Sitemap 行。

常見問題

Robots.txt 檢測常見問題

robots.txt 裡 Disallow 了,頁面就不會被收錄嗎?
不一定。Disallow 只是不讓抓取,如果別的頁面鏈向它,這個網址仍可能被收錄,只是沒有內容摘要。想讓頁面不出現在搜尋結果裡,應允許抓取並加 noindex。改好後,可以用網頁可收錄檢測分別確認百度和谷歌的結論。
谷歌支援 Crawl-delay 嗎?
不支援,谷歌會忽略這一行,所以工具會提示。百度的抓取頻次可以在百度搜尋資源平臺裡調整。
robots.txt 返回 404 或 500 會怎樣?
404 等 4xx 表示沒有規則,蜘蛛可以抓取全部內容;5xx 伺服器錯誤會讓谷歌暫時把整站當作禁止抓取,所以工具會報警。
能在上傳前測試 robots.txt 嗎?
能。展開“測試你自己寫的規則(不讀取線上的 robots.txt)”,貼上草稿後點“開始測試”,同一個網址和所有爬蟲都會按你的草稿判斷。
怎麼遮蔽 GPTBot 這類 AI 爬蟲?
為每個爬蟲單獨寫一組規則,比如 User-agent: GPTBot 下一行寫 Disallow: /。本工具會測試 GPTBot、ClaudeBot、Google-Extended、CCBot 和 PerplexityBot,AI 爬蟲訪問檢測則覆蓋 25 個 AI 爬蟲。
把Robots.txt 檢測分享給朋友開啟瀏覽器就能用,對方不註冊也能先試。

相關工具

SEO 死鏈檢測檢查一個網頁上的全部連結,列出失效和跳轉的連結。
SEO 網站 SEO 檢測一次檢查 40 多項頁面和技術 SEO,每個問題都給出改法。
SEO 網頁可收錄檢測一次查清網頁能不能被收錄:狀態碼、robots、noindex 和 canonical。
SEO 關鍵詞密度檢測統計網頁或文章裡出現最多的詞和短語,以及各自的佔比。
SEO Meta 標籤檢測檢視網頁的標題、描述、robots、canonical 和分享標籤,並檢查長度。
SEO 搜尋引擎蜘蛛模擬抓取以百度蜘蛛、谷歌機器人的身份抓取網頁,看它們看到的內容和普通訪客是否一樣。
TXT 廣告法違禁詞檢測標出文案裡違反《廣告法》的極限詞和違禁用語。
SEO AI 爬蟲訪問檢測看網站的 robots.txt 放行了哪些 AI 爬蟲(GPTBot、ClaudeBot、Google-Extended 等)。