免费注册

网站地图 Sitemap 生成器

自动抓取你的网站或粘贴现成的网址列表,排除不想收录的网址,下载可以直接提交的网站地图。

关于网站地图 Sitemap 生成器

Sitemap 生成器做出的网站地图 sitemap.xml,把你希望被收录的网页列给搜索引擎,新站、大站和内链少的深层页面最需要它。选自动抓取网站,输入首页地址,我们的服务器沿同一主机下的内链逐页抓取:默认“遵守 robots.txt”并“跳过 noindex 页面”,遇到跳转或 canonical 改用目标网址,出错的页面不收入,PDF、CSS、JS 等文件也不收入。lastmod 取自服务器返回的修改时间,优先级按离起始页的点击层级递减。每次抓取访客最多 100 个网页,免费会员 500 个,VIP 5000 个,最长 8 分钟,算 1 次任务。抓取只认 HTML 里的链接,靠 JS 加载或只能站内搜索到的页面可能漏掉。

在“不收录的网址”里每行填一个片段,最多 50 个,比如 /tag/ 或 ?sort=,网址里包含它就不收录,跳转或 canonical 指向这些网址的页面也一并排除。勾选“同时列出每页的图片”,每页最多 10 张图片会按 Google 图片网站地图的格式写进文件。除了“下载 sitemap.xml”,还可以单独下载 sitemap.txt 和 sitemap.html:前者一行一个网址,是百度等搜索引擎提交网址时接受的纯文本列表;后者是列出全站网页、给访客浏览的页面。抓取统计会显示排除了多少个网址、列出了多少张图片。只想用现成的网址,可以选粘贴网址列表:在浏览器里生成 sitemap.xml,数量不限,不算次数,可选 lastmod、更新频率和优先级。生成后上传到网站根目录,提交到百度搜索资源平台和 Google Search Console,也可以先用 网站地图检测检查。

网站地图 Sitemap 生成器怎么用

  1. 1
    选抓取方式

    “自动抓取网站”帮你找出网页,“粘贴网址列表”用你手上已有的网址。

  2. 2
    设置并开始抓取

    输入首页地址,保持勾选“遵守 robots.txt”和“跳过 noindex 页面”,按需填写不收录的网址、勾选列出图片,再点“开始抓取”。

  3. 3
    下载网站地图

    看一遍抓取到的网页列表(可导出 CSV),再下载 sitemap.xml,需要时把 sitemap.txt 和 sitemap.html 也下载下来。

  4. 4
    上传并提交

    放到网站根目录,在 robots.txt 里写上 Sitemap 地址,并提交到百度搜索资源平台和 Google Search Console。

为什么用熊仔工匠

  • 真实抓取

    从起始页沿内链抓取,遵守 robots.txt,跳过 noindex,按 canonical 取规范网址,日期取自 Last-Modified。

  • 排除指定网址

    每行一个片段,最多 50 个,* 代表任意字符(如 /page/*),跳转或 canonical 指向它们的页面也一并排除。

  • 图片网站地图

    可选列出每页的图片,每页最多 10 张,采用 Google 图片网站地图格式,统计里显示图片数量。

  • XML、TXT、HTML 三种格式

    sitemap.txt 一行一个网址,方便提交百度;sitemap.html 给访客浏览;各有单独的下载按钮。

常见问题

网站地图 Sitemap 生成器常见问题

网站地图生成器最多能抓多少个网页?
每次抓取访客最多 100 个网页,免费会员 500 个,VIP 会员 5000 个;抓取最长 8 分钟,到了上限结果里会提示。每次抓取算 1 次任务:不注册共可用 2 次,免费会员每天 2 次,VIP 不限次数。粘贴网址列表的方式在浏览器里生成,不算次数,也不限数量。
怎样让标签页、翻页和排序网址不进网站地图?
在“不收录的网址”里每行填一个片段,最多 50 个。网址里包含这个片段就不收录,* 代表任意字符,比如 /tag/、/page/*、?sort= 分别对应标签页、翻页和排序后的重复页面。跳转或 canonical 指向这些网址的页面也会排除,抓取统计里会显示排除的数量。
sitemap.txt 和 sitemap.html 有什么用?
sitemap.txt 一行一个网址,是百度等搜索引擎提交网址时接受的纯文本格式;sitemap.html 是列出全站网页的页面,给访客浏览用。每次自动抓取都会和 sitemap.xml 一起生成,各有单独的下载按钮。
为什么有些网页没有抓到?
抓取只沿着 HTML 里的链接走。被 robots.txt 屏蔽、设了 noindex 或匹配了“不收录的网址”的页面会跳过,跳转和 canonical 指向别处的页面会换成目标网址,数量到上限也会停止。漏掉的网页可以用粘贴模式补上。
sitemap.xml 生成后怎么提交给百度和谷歌?
上传到网站根目录,在 robots.txt 里加一行 Sitemap 地址,再到百度搜索资源平台的普通收录和 Google Search Console 里提交这个网址。这行 Sitemap 可以用 Robots.txt 生成器一起生成。
把网站地图 Sitemap 生成器分享给朋友打开浏览器就能用,对方不注册也能先试。

相关工具

HTML Meta 标签生成器编写标题、描述和 robots 标签,实时检查长度并预览。
TXT Robots.txt 生成器生成 robots.txt,搜索引擎和 AI 爬虫都有预设。
JSON 结构化数据生成器生成常见问题、文章、商品、组织等类型的 JSON-LD 结构化数据。
HTML 社交分享标签生成器生成 Open Graph 和 Twitter Card 标签,并预览分享卡片。
CONF 301 重定向代码生成器生成 Apache、Nginx、IIS、PHP 和 HTML 的跳转规则。
URL UTM 链接生成器给链接加上 UTM 参数,在统计工具里区分推广渠道。
HTML hreflang 多语言标签生成器为网页的各个语言版本生成 hreflang 标签。
CONF Htpasswd 密码文件生成器生成 Apache、Nginx 基本认证用的 .htpasswd 内容。