很多站点把面包屑導航当成頁面顶部的装饰,觉得它對用戶可有可無,更谈不上對抓取有什么帮助。實际恰好相反:面包屑是站点层級结构在具体頁面上的投影。蜘蛛進入一個陌生頁面时,能讀到的结构信号並不多,一條位置稳定、連結完整的面包屑,往往比頁面底部那堆“相關推荐”更有信息量。
面包屑對蜘蛛到底意味着什么
它至少传递三類信息:頁面属于哪個栏目、栏目之間是什么關系、目前頁面在整站中的大致深度。配合锚文本,還能让蜘蛛確認栏目頁的主题。對于目錄层級較深、詳情頁數量大的站点,面包屑是帮助蜘蛛理解“這個頁面不是孤岛”的低成本手段。
自查清單
1. 层級與真實目錄是否一致
頁面的 URL 路径、面包屑层級、栏目實际归属,三者最好能對上。如果面包屑顯示“首頁 > 教程 > 進阶”,而 URL 却在 /news/ 下面,蜘蛛會拿到两套互相矛盾的结构信号。不一致不一定會立刻出問题,但排查抓取異常时,這類矛盾會让人很难判断。
2. 每一級是否都是可抓取的連結
常见的错誤是把中間层級寫成纯文本,只给最後一級加連結,或者反過来,中間层級是連結、目前頁也做成連結。建议除了目前頁面本身,其余层級都使用标准 a 标簽指向對應的栏目頁,並确保這些栏目頁返回 200。如果某級栏目已经下线,不要留一個空壳节点,直接去掉或指向有效替代頁面。
3. 首頁和目前頁怎么處理
首頁連結是常規做法,一般保留。“目前位置”的最後一級不必加連結,避免制造自我循环。這里没有强制标准,但全站要保持统一,不要一部分頁面最後一級可点、一部分不可点。
4. 移動端和折叠狀態下還在不在
有的站点在窄屏下直接隐藏面包屑,有的用脚本動態生成。如果面包屑只在特定视口或用戶交互後才出現,蜘蛛未必能看到。更稳妥的做法是让它始终存在于 HTML 中,用 CSS 控制顯示方式。
几個常见誤区
- 面包屑里的栏目名和栏目頁标题完全對不上,锚文本與目标頁主题脱节。
- 把所有层級都指向首頁,形式上有面包屑,實际上没有层級信息。
- 面包屑由前端根據浏览歷史生成,不同入口進入同一頁面看到的路径不同。
- 只在结构化資料里寫 BreadcrumbList,頁面上却没有對應的可见導航。
结构化資料要與頁面一致
如果使用 BreadcrumbList 标记,名稱、連結和顺序應與頁面上可见的面包屑保持一致。只寫标记、頁面不顯示,或者两者层級不同,都属于给蜘蛛添乱。改版或調整栏目後,记得同步更新标记,別让结构化資料停留在舊结构上。
把它纳入日常巡检
面包屑的問题通常不會立刻表現為抓取量下降,但會慢慢影响蜘蛛對站点结构的判断。做站点巡检时,可以抽几個不同深度的頁面,從首頁開始按面包屑一路点進去,確認每一級都能打開、层級正确、没有重定向鏈。搜尋日誌中如果發現栏目頁很少被抓、詳情頁却频繁出現,也值得回头看看面包屑和内部連結是否把蜘蛛引到了正确的位置。
面包屑不是装饰,它是给蜘蛛和用戶同时看的一張结构简图。结构一旦調整,這張图就要跟着改。