關於網站地圖 Sitemap 生成器
Sitemap 生成器做出的網站地圖 sitemap.xml,把你希望被收錄的網頁列給搜尋引擎,新站、大站和內鏈少的深層頁面最需要它。選自動抓取網站,輸入首頁地址,我們的伺服器沿同一主機下的內鏈逐頁抓取:預設“遵守 robots.txt”並“跳過 noindex 頁面”,遇到跳轉或 canonical 改用目標網址,出錯的頁面不收入,PDF、CSS、JS 等檔案也不收入。lastmod 取自伺服器返回的修改時間,優先順序按離起始頁的點選層級遞減。每次抓取訪客最多 100 個網頁,免費會員 500 個,VIP 5000 個,最長 8 分鐘,算 1 次任務。抓取只認 HTML 裡的連結,靠 JS 載入或只能站內搜尋到的頁面可能漏掉。
在“不收錄的網址”裡每行填一個片段,最多 50 個,比如 /tag/ 或 ?sort=,網址裡包含它就不收錄,跳轉或 canonical 指向這些網址的頁面也一併排除。勾選“同時列出每頁的圖片”,每頁最多 10 張圖片會按 Google 圖片網站地圖的格式寫進檔案。除了“下載 sitemap.xml”,還可以單獨下載 sitemap.txt 和 sitemap.html:前者一行一個網址,是百度等搜尋引擎提交網址時接受的純文字列表;後者是列出全站網頁、給訪客瀏覽的頁面。抓取統計會顯示排除了多少個網址、列出了多少張圖片。只想用現成的網址,可以選貼上網址列表:在瀏覽器裡生成 sitemap.xml,數量不限,不算次數,可選 lastmod、更新頻率和優先順序。生成後上傳到網站根目錄,提交到百度搜尋資源平臺和 Google Search Console,也可以先用 網站地圖檢測檢查。
網站地圖 Sitemap 生成器怎麼用
- 1選抓取方式
“自動抓取網站”幫你找出網頁,“貼上網址列表”用你手上已有的網址。
- 2設定並開始抓取
輸入首頁地址,保持勾選“遵守 robots.txt”和“跳過 noindex 頁面”,按需填寫不收錄的網址、勾選列出圖片,再點“開始抓取”。
- 3下載網站地圖
看一遍抓取到的網頁列表(可匯出 CSV),再下載 sitemap.xml,需要時把 sitemap.txt 和 sitemap.html 也下載下來。
- 4上傳並提交
放到網站根目錄,在 robots.txt 裡寫上 Sitemap 地址,並提交到百度搜尋資源平臺和 Google Search Console。
為什麼用熊仔工匠
- 真實抓取
從起始頁沿內鏈抓取,遵守 robots.txt,跳過 noindex,按 canonical 取規範網址,日期取自 Last-Modified。
- 排除指定網址
每行一個片段,最多 50 個,* 代表任意字元(如 /page/*),跳轉或 canonical 指向它們的頁面也一併排除。
- 圖片網站地圖
可選列出每頁的圖片,每頁最多 10 張,採用 Google 圖片網站地圖格式,統計裡顯示圖片數量。
- XML、TXT、HTML 三種格式
sitemap.txt 一行一個網址,方便提交百度;sitemap.html 給訪客瀏覽;各有單獨的下載按鈕。