規模化管理分面導覽的 SEO 風險與作法
來源聲明:本文根據 Matt Hollingshead〈Managing faceted navigation at scale〉(Oncrawl,2025-11-04)編譯整理,不是逐句翻譯。原文連結:https://oncrawl.com/technical-seo/managing-faceted-navigation-scale。頁面未見開放授權。文中「編輯解讀」為本站觀點。
分面導覽(faceted navigation)讓使用者用品牌、尺寸、價格等多個篩選條件縮小結果。對人很方便;對搜尋引擎,每個篩選狀態若產生新 URL,就可能變成另一個要決定是否抓取、是否索引的頁面。
Matt Hollingshead 以電商男鞋為例:類型、品牌、尺寸、版型、顏色一組合,參數 URL 很快變成成千上萬甚至上百萬種組合。Booking.com、Amazon 等大型站也普遍使用類似機制。
主要 SEO 風險
浪費抓取預算:Googlebot 若長時間卡在近似篩選頁,可能較晚發現新產品或新文章。抓取預算是搜尋引擎分配給一站的抓取資源上限1。
近似重複與關鍵字互相搶:例如「9 號慢跑鞋」與「10 號慢跑鞋」內容幾乎一樣,搜尋引擎更難判斷主版本。
索引膨脹:大量低價值頁進索引,可能讓網站看起來單薄或重複。
連結權重被稀釋:若篩選以一般 連結實作,內部連結會在大量變體之間分散。
稽核步驟(濃縮)
1. 弄清 URL 怎麼長出來:單一篩選用參數、路徑還是 # 片段?多篩選時參數順序是否會產生不同 URL?篩選是連結還是 ?無庫存組合是 200 還是 404? 2. 檢查既有控管是否打架:robots.txt、noindex、canonical、sitemap、內部連結是否互相矛盾(例如 robots 擋掉卻又 noindex、sitemap 仍列 noindex URL 等)。 3. 用 Google 與 Search Console 看膨脹:site: 與「已索引但未提交到 sitemap」、「已抓取-目前未建立索引」、Crawl Stats 是否被分面 URL 占滿。 4. 日誌分析:確認 Googlebot 實際是否把力氣花在沒流量、沒搜尋價值的篩選頁。
作者以 Adidas 為例:參數會加入 URL,但篩選多為非傳統連結元素,無庫存選項會停用,手動改成無結果參數時站點回傳 404。
常見處理方法
文中整理多種手段,並標出前兩項為 Google 建議方向:
- robots.txt Disallow:直接減少對分面 URL 的抓取;但若他處有連結,URL 仍可能出現在結果中。
- URL 片段
#:爬蟲通常忽略#之後,使用者仍可篩選,卻不產生新的可抓取 URL。 - noindex:控索引膨脹,但頁面仍需被抓到才能讀到指令;常與後續再 Disallow 搭配。
- canonical 指回主分類:合併訊號,但是建議而非強制,也不省初次抓取。
- 對分面連結加 nofollow:提示勿跟隨,須涵蓋所有內部指入;他處發現仍可能造訪。
從零做系統時,作者傾向用 JavaScript/Fetch 更新結果、篩選用非 元素,並用 History API 更新可分享 URL,降低爬蟲發現海量組合的機會;主列表(未套篩選)仍須可抓取。
若要搶長尾,不要盲目讓所有組合可索引。用分析挑有流量、有庫存支撐的組合,做成有獨特標題、H1、內容與自我指涉 canonical 的子分類,並小範圍測試。
實務原則
只做使用者真的會用的篩選;依品類顯示相關篩選;避免零結果可點;參數可讀且順序固定;用分析持續調整。沒有單一完美方案,稽核、選策略、監控要循環。
常見問題
- 分面導覽為什麼會變成 SEO 問題?每個篩選組合常產生新 URL,搜尋引擎會當成不同頁。大規模時可能浪費抓取預算、造成近似重複、索引膨脹,並稀釋內部連結權重。
- Google 公開建議過哪些管控方向?文中把 robots.txt 禁止抓取特定分面 URL,以及改用 URL 片段(#)讓爬蟲忽略篩選狀態,列為 Google 建議方向;另也說明 noindex、canonical、nofollow 等補充手段與限制。
- 稽核時要先看哪些訊號?看參數順序是否產生重複 URL、篩選是連結還是按鈕、空結果是否回 404、既有 robots/canonical/noindex 是否互相衝突,並用 site: 與 Search Console 檢查索引膨脹。
- 什麼時候該讓某個篩選組合可被索引?作者建議用分析找出使用者真的會用、又有足夠商品支撐的組合,做成有獨特內容與中繼資料的子分類頁,並先小批量測試。
編輯解讀
一句話重點:分面導覽的 SEO 本質是「哪些組合值得當獨立頁,其餘如何不被抓、不被索引」。
這對你的網站意味著什麼:
- 先畫出參數規則與空結果狀態碼,再談工具掃描。
- 主分類與少數高需求組合可索引;其餘用一致策略擋抓或擋索引。
- 爬蟲設定要包含帶參數 URL,否則問題會被低估。
- 修復後用 Crawl Stats/日誌確認 Googlebot 是否回到錢頁。
適用與不適用的情境:電商、旅遊、房仲、大型檔案庫最相關。篩選很少、幾乎不產生新 URL 的小站,優先級較低。
需要注意的限制:發布者 Oncrawl 可能在銷售技術 SEO 與日誌分析產品;文中工具截圖與品牌範例僅供說明。
延伸閱讀:
- 〈理解 JavaScript SEO 基礎〉 https://seogeohq.com/understand-javascript-seo-basics-google-search-central/
- 〈Google 支援的 meta 標籤〉 https://seogeohq.com/meta-tags-and-attributes-that-google-supports-google-search/
名詞與資料來源
1. 抓取預算 — Google Search Central:〈Manage crawl budget for large sites〉 https://developers.google.com/search/docs/crawling-indexing/large-site-managing-crawl-budget(檢索日期:2026-09-30) 2. 重複 URL 與 canonical — Google Search Central:〈How to consolidate duplicate URLs〉 https://developers.google.com/search/docs/crawling-indexing/consolidate-duplicate-urls(檢索日期:2026-09-30) 3. robots.txt — Google Search Central:〈Introduction to robots.txt〉 https://developers.google.com/search/docs/crawling-indexing/robots/intro(檢索日期:2026-09-30)