免費註冊

AI 爬蟲訪問檢測

看看你的 robots.txt 放行了哪些 AI 爬蟲,以及網站有沒有 llms.txt。

關於AI 爬蟲訪問檢測

AI 公司抓取網頁,一是訓練模型,二是在回答問題時實時引用,AI 爬蟲訪問檢測幫你查清哪些 AI 爬蟲能訪問你的網站。想禁止 AI 訓練、發現 CDN 或外掛替你加了 AI 規則、網站從沒出現在 AI 搜尋回答裡時,都可以查一查。輸入網站地址,點“開始檢測”。

工具按 robots.txt 判斷 25 個 AI 爬蟲能否訪問,包括 GPTBot、ClaudeBot、Google-Extended,以及 Perplexity、位元組跳動、Meta、亞馬遜、華為盤古等公司的爬蟲。每個爬蟲都標明用途(AI 訓練、AI 搜尋或替使用者抓取)、放行還是禁止、起作用的規則,以及檔案裡有沒有單獨寫它。還會查詢 llms.txt 和 llms-full.txt,並檢查首頁的 noai 標記。遮蔽了 AI 搜尋爬蟲時會提醒你:網站可能從 AI 搜尋的回答裡消失。規則和 llms.txt 可以分別用 Robots.txt 生成器和 llms.txt 生成器來寫。

AI 爬蟲訪問檢測怎麼用

  1. 1
    輸入網站

    填域名或網站上任意一個網址。

  2. 2
    點“開始檢測”

    讀取 robots.txt、llms.txt、llms-full.txt 和首頁。

  3. 3
    看結果表

    每個 AI 爬蟲的用途、是否放行和起作用的規則。

  4. 4
    決定並調整

    可以只禁 AI 訓練;想被 AI 搜尋引用,就放行 AI 搜尋爬蟲。

為什麼用熊仔工匠

  • 25 個 AI 爬蟲

    OpenAI、Anthropic、谷歌、蘋果、Perplexity、Meta、亞馬遜、位元組跳動等。

  • 標明用途

    AI 訓練、AI 搜尋、替使用者抓取,分得清清楚楚。

  • llms.txt 檢查

    查詢 llms.txt 和 llms-full.txt,顯示開頭內容。

  • noai 標記

    檢查 meta robots 和 X-Robots-Tag 裡的 noai、noimageai。

常見問題

AI 爬蟲訪問檢測常見問題

AI 訓練爬蟲和 AI 搜尋爬蟲有什麼區別?
GPTBot、CCBot 這類訓練爬蟲收集網頁來訓練模型;OAI-SearchBot、PerplexityBot 這類 AI 搜尋爬蟲抓取網頁,在回答裡引用。兩類可以分開設定,比如禁止訓練、允許搜尋。
遮蔽 Google-Extended 會影響谷歌搜尋排名嗎?
不會。它只決定谷歌能否把你的內容用於 Gemini 等 AI 模型,谷歌搜尋的抓取和排名不受影響。
llms.txt 是什麼?
放在網站根目錄 /llms.txt 的 Markdown 檔案,用簡短的介紹和重點連結告訴 AI 助手你的網站是做什麼的。它是一種提議中的做法,不是正式標準,但已有 AI 工具會讀取。
AI 爬蟲會遵守 robots.txt 嗎?
GPTBot、ClaudeBot、PerplexityBot 等主流爬蟲都宣告會遵守。但 robots.txt 只是約定,不是鎖,真正攔住只能靠伺服器或防火牆。按 IP 遮蔽前,先用百度真假蜘蛛識別核對一下,別誤傷真蜘蛛。
AI 爬蟲訪問檢測收費嗎?
免費,不佔每日次數。檔案在你點選時抓取,結果不儲存。
把AI 爬蟲訪問檢測分享給朋友開啟瀏覽器就能用,對方不註冊也能先試。

相關工具

SEO 死鏈檢測檢查一個網頁上的全部連結,列出失效和跳轉的連結。
SEO 網站 SEO 檢測一次檢查 40 多項頁面和技術 SEO,每個問題都給出改法。
SEO 網頁可收錄檢測一次查清網頁能不能被收錄:狀態碼、robots、noindex 和 canonical。
SEO 關鍵詞密度檢測統計網頁或文章裡出現最多的詞和短語,以及各自的佔比。
SEO Meta 標籤檢測檢視網頁的標題、描述、robots、canonical 和分享標籤,並檢查長度。
SEO Robots.txt 檢測讀取網站的 robots.txt,測試某個網址對各個爬蟲是否放行。
SEO 搜尋引擎蜘蛛模擬抓取以百度蜘蛛、谷歌機器人的身份抓取網頁,看它們看到的內容和普通訪客是否一樣。
TXT 廣告法違禁詞檢測標出文案裡違反《廣告法》的極限詞和違禁用語。