免费注册

网页可收录检测

查清百度和谷歌能不能收录一个页面,不能的话原因都列出来。

关于网页可收录检测

页面迟迟不出现在搜索结果里,先要用网页可收录检测弄清:搜索引擎到底能不能收录它。新页面没流量、网站改版迁移之后、百度搜索资源平台或 Google Search Console 提示页面被排除时,都可以用网页可收录检测查一下。输入网址,点“开始检测”。

工具以谷歌蜘蛛和百度蜘蛛两个身份抓取页面并读取 robots.txt,分别给出谷歌和百度的结论。不能收录时,所有原因都会列出来:发生跳转、状态码不是 200、被 robots.txt 禁止或 robots.txt 返回服务器错误、meta 标签或 X-Robots-Tag 响应头里有 noindex、canonical 指向其他页面、不是 HTML、软 404。页面上的按钮可以直接到百度和谷歌做 site: 查询。它不能告诉你页面现在是否已被收录,这只有搜索引擎知道,请用 site: 查询或到百度搜索资源平台查看。要细查规则,用 Robots.txt 检测。

网页可收录检测怎么用

  1. 1
    输入网址

    填希望被收录的完整网址。

  2. 2
    点“开始检测”

    以谷歌蜘蛛和百度蜘蛛身份抓取,并读取 robots.txt。

  3. 3
    看两个结论

    谷歌、百度各自给出可以收录或无法收录,以及原因。

  4. 4
    到搜索引擎核对

    用 site: 查询按钮核对,改完原因再检测一次。

为什么用熊仔工匠

  • 百度谷歌分开判断

    规则和蜘蛛可能不同,所以给出两个结论。

  • 原因全列出

    跳转、状态码、robots.txt、noindex、canonical、软 404 等。

  • 响应头也检查

    X-Robots-Tag 和针对某个蜘蛛的 meta 标签都会读。

  • site: 快捷查询

    一键到百度或谷歌搜索这个网址。

常见问题

网页可收录检测常见问题

能查页面有没有被收录吗?
不能。这里查的是“能不能被收录”。是否已经收录只有搜索引擎知道,请用 site: 查询按钮,或在百度搜索资源平台、Google Search Console 里查看。
为什么百度能收录、谷歌不能?
可能页面只对 googlebot 写了 noindex,robots.txt 为某个蜘蛛单独设了规则,或者服务器对两个蜘蛛的返回不同。原因列表会写明是哪一条。想对比两个蜘蛛各自拿到的内容,用搜索引擎蜘蛛模拟抓取。
软 404 页面是什么意思?
页面内容写着“找不到”或“404”,状态码却是 200。搜索引擎会把它当错误页,应该直接返回 404 或 410。
canonical 指向别的网址会影响收录吗?
会。它等于告诉搜索引擎去收录另一个网址,这个地址通常就不会出现在结果里。重复页面这样做没问题,想要排名的页面就不能这样写。canonical 和其他 head 标签,可以用 Meta 标签检测一起查看。
网页可收录检测收费吗?
免费,不用注册,不占每日次数,结果不保存。
把网页可收录检测分享给朋友打开浏览器就能用,对方不注册也能先试。

相关工具

SEO 死链检测检查一个网页上的全部链接,列出失效和跳转的链接。
SEO 网站 SEO 检测一次检查 40 多项页面和技术 SEO,每个问题都给出改法。
SEO 关键词密度检测统计网页或文章里出现最多的词和短语,以及各自的占比。
SEO Meta 标签检测查看网页的标题、描述、robots、canonical 和分享标签,并检查长度。
SEO Robots.txt 检测读取网站的 robots.txt,测试某个网址对各个爬虫是否放行。
SEO 搜索引擎蜘蛛模拟抓取以百度蜘蛛、谷歌机器人的身份抓取网页,看它们看到的内容和普通访客是否一样。
TXT 广告法违禁词检测标出文案里违反《广告法》的极限词和违禁用语。
SEO AI 爬虫访问检测看网站的 robots.txt 放行了哪些 AI 爬虫(GPTBot、ClaudeBot、Google-Extended 等)。