免費註冊

網站地圖 Sitemap 生成器

自動抓取你的網站或貼上現成的網址列表,排除不想收錄的網址,下載可以直接提交的網站地圖。

關於網站地圖 Sitemap 生成器

Sitemap 生成器做出的網站地圖 sitemap.xml,把你希望被收錄的網頁列給搜尋引擎,新站、大站和內鏈少的深層頁面最需要它。選自動抓取網站,輸入首頁地址,我們的伺服器沿同一主機下的內鏈逐頁抓取:預設“遵守 robots.txt”並“跳過 noindex 頁面”,遇到跳轉或 canonical 改用目標網址,出錯的頁面不收入,PDF、CSS、JS 等檔案也不收入。lastmod 取自伺服器返回的修改時間,優先順序按離起始頁的點選層級遞減。每次抓取訪客最多 100 個網頁,免費會員 500 個,VIP 5000 個,最長 8 分鐘,算 1 次任務。抓取只認 HTML 裡的連結,靠 JS 載入或只能站內搜尋到的頁面可能漏掉。

在“不收錄的網址”裡每行填一個片段,最多 50 個,比如 /tag/ 或 ?sort=,網址裡包含它就不收錄,跳轉或 canonical 指向這些網址的頁面也一併排除。勾選“同時列出每頁的圖片”,每頁最多 10 張圖片會按 Google 圖片網站地圖的格式寫進檔案。除了“下載 sitemap.xml”,還可以單獨下載 sitemap.txt 和 sitemap.html:前者一行一個網址,是百度等搜尋引擎提交網址時接受的純文字列表;後者是列出全站網頁、給訪客瀏覽的頁面。抓取統計會顯示排除了多少個網址、列出了多少張圖片。只想用現成的網址,可以選貼上網址列表:在瀏覽器裡生成 sitemap.xml,數量不限,不算次數,可選 lastmod、更新頻率和優先順序。生成後上傳到網站根目錄,提交到百度搜尋資源平臺和 Google Search Console,也可以先用 網站地圖檢測檢查。

網站地圖 Sitemap 生成器怎麼用

  1. 1
    選抓取方式

    “自動抓取網站”幫你找出網頁,“貼上網址列表”用你手上已有的網址。

  2. 2
    設定並開始抓取

    輸入首頁地址,保持勾選“遵守 robots.txt”和“跳過 noindex 頁面”,按需填寫不收錄的網址、勾選列出圖片,再點“開始抓取”。

  3. 3
    下載網站地圖

    看一遍抓取到的網頁列表(可匯出 CSV),再下載 sitemap.xml,需要時把 sitemap.txt 和 sitemap.html 也下載下來。

  4. 4
    上傳並提交

    放到網站根目錄,在 robots.txt 裡寫上 Sitemap 地址,並提交到百度搜尋資源平臺和 Google Search Console。

為什麼用熊仔工匠

  • 真實抓取

    從起始頁沿內鏈抓取,遵守 robots.txt,跳過 noindex,按 canonical 取規範網址,日期取自 Last-Modified。

  • 排除指定網址

    每行一個片段,最多 50 個,* 代表任意字元(如 /page/*),跳轉或 canonical 指向它們的頁面也一併排除。

  • 圖片網站地圖

    可選列出每頁的圖片,每頁最多 10 張,採用 Google 圖片網站地圖格式,統計裡顯示圖片數量。

  • XML、TXT、HTML 三種格式

    sitemap.txt 一行一個網址,方便提交百度;sitemap.html 給訪客瀏覽;各有單獨的下載按鈕。

常見問題

網站地圖 Sitemap 生成器常見問題

網站地圖生成器最多能抓多少個網頁?
每次抓取訪客最多 100 個網頁,免費會員 500 個,VIP 會員 5000 個;抓取最長 8 分鐘,到了上限結果裡會提示。每次抓取算 1 次任務:不註冊共可用 2 次,免費會員每天 2 次,VIP 不限次數。貼上網址列表的方式在瀏覽器裡生成,不算次數,也不限數量。
怎樣讓標籤頁、翻頁和排序網址不進網站地圖?
在“不收錄的網址”裡每行填一個片段,最多 50 個。網址裡包含這個片段就不收錄,* 代表任意字元,比如 /tag/、/page/*、?sort= 分別對應標籤頁、翻頁和排序後的重複頁面。跳轉或 canonical 指向這些網址的頁面也會排除,抓取統計裡會顯示排除的數量。
sitemap.txt 和 sitemap.html 有什麼用?
sitemap.txt 一行一個網址,是百度等搜尋引擎提交網址時接受的純文字格式;sitemap.html 是列出全站網頁的頁面,給訪客瀏覽用。每次自動抓取都會和 sitemap.xml 一起生成,各有單獨的下載按鈕。
為什麼有些網頁沒有抓到?
抓取只沿著 HTML 裡的連結走。被 robots.txt 遮蔽、設了 noindex 或匹配了“不收錄的網址”的頁面會跳過,跳轉和 canonical 指向別處的頁面會換成目標網址,數量到上限也會停止。漏掉的網頁可以用貼上模式補上。
sitemap.xml 生成後怎麼提交給百度和谷歌?
上傳到網站根目錄,在 robots.txt 里加一行 Sitemap 地址,再到百度搜尋資源平臺的普通收錄和 Google Search Console 裡提交這個網址。這行 Sitemap 可以用 Robots.txt 生成器一起生成。
把網站地圖 Sitemap 生成器分享給朋友開啟瀏覽器就能用,對方不註冊也能先試。

相關工具

HTML Meta 標籤生成器編寫標題、描述和 robots 標籤,實時檢查長度並預覽。
TXT Robots.txt 生成器生成 robots.txt,搜尋引擎和 AI 爬蟲都有預設。
JSON 結構化資料生成器生成常見問題、文章、商品、組織等型別的 JSON-LD 結構化資料。
HTML 社交分享標籤生成器生成 Open Graph 和 Twitter Card 標籤,並預覽分享卡片。
CONF 301 重定向程式碼生成器生成 Apache、Nginx、IIS、PHP 和 HTML 的跳轉規則。
URL UTM 連結生成器給連結加上 UTM 引數,在統計工具裡區分推廣渠道。
HTML hreflang 多語言標籤生成器為網頁的各個語言版本生成 hreflang 標籤。
CONF Htpasswd 密碼檔案生成器生成 Apache、Nginx 基本認證用的 .htpasswd 內容。