站点运营

站点运营:分頁與列表頁自查,別让翻頁變成蜘蛛绕着走的走廊

列表頁和翻頁連結常被忽略,却同时影响訪客浏览和 URL 發現。本文梳理几種常见的分頁寫法带来的問题,给出一份可照着做的自查清單,並說明在 rel=next/prev 失效之後,如何用 canonical、邊界設定和列表排序,让分頁保持干净、有限、路径明确。

站点运营

站点运营:分頁與列表頁自查,別让翻頁變成蜘蛛绕着走的走廊

列表頁和分頁是很多站点流量结构里被忽略的一块。首頁、栏目頁、文章頁往往有人盯着,而第 3 頁、第 8 頁的翻頁連結,常常是建站时随手生成、之後几年没人再看的地方。蜘蛛顺着這些連結走,訪客也顺着這些連結翻,两邊都在這條路上花時間。

分頁為什么容易出問题

分頁天然带着“重复”和“無限”两個属性。同一個栏目下的内容,會被首頁、第 2 頁、标簽頁、归档頁反复列出;而只要不设邊界,翻頁連結可以一直往下生成。對訪客来说,翻到第 20 頁已经很难找到東西;對蜘蛛来说,那是一串内容相似、價值递减的地址。

几種常见的分頁寫法,各有各的麻烦

  • 全量展開式:列表頁一次性輸出几百條連結,頁面体积大,連結權重被摊薄,新内容淹没在舊内容里。
  • ?page=1 與栏目首頁並存:两個地址展示完全相同的列表,没有 canonical 或跳轉区分,容易被当成重复頁面。
  • 無限滚動:訪客体驗不错,但後續内容靠脚本加载,如果連結没有落到 HTML 里,蜘蛛往往只看到第一屏。
  • 翻頁連結用相對路径或脚本跳轉:路径层級算错,或者必须点击才能触發,抓取路径就断了。
  • 空结果頁也返回 200:翻到超出范围时返回一個空白列表頁,蜘蛛會繼續往里走。

一份可以照着做的自查清單

  1. 打開栏目第一頁,查看源碼里翻頁連結是不是标准的 <a href>,路径是否為绝對地址。
  2. 確認第 1 頁與栏目首頁的關系:保留一個規范地址,另一個用 301 或 canonical 指向它。
  3. 给分頁設定上限。内容量不大的栏目,翻到一定頁數後返回 404,或干脆不輸出下一頁連結。
  4. 检查每頁輸出多少條。常见的 10 到 30 條比較稳妥,具体看頁面体积和栏目更新频率。
  5. 列表頁上的标题、摘要最好和文章頁保持区別,不要整段複製正文開头。
  6. 翻頁地址里不要叠加跟踪參數,否則每翻一頁都會生成一批新地址。
  7. 如果用了無限滚動,確認後續内容有可被抓取的連結入口,比如“查看全部”的分頁版本。
  8. 在日誌里看蜘蛛對分頁地址的抓取占比。如果大量抓取停在深頁碼,說明邊界没设好。

關于 rel="next" 和 rel="prev"

這两個标簽曾被用来标记分頁序列,後来主流搜尋引擎已经不再把它們当作索引信号。現在更實际的做法是:让分頁地址本身可抓取、可訪問,同时用 canonical 把重复的列表内容归拢到規范地址,必要时用 noindex 處理没有獨立價值的翻頁頁。不同站点情况不同,先小范围试,再看日誌和索引資料的變化。

分頁的设計目标不是“让蜘蛛翻得更深”,而是让需要被看到的内容有一個清楚、有限的路径。

分頁和 URL 發現的關系

站在 URL 發現的角度,列表頁是最主要的入口之一。新内容發布後,能不能通過栏目第一頁被找到,比能不能通過第 15 頁被找到重要得多。所以列表排序逻辑值得留意:按發布時間倒序,让新内容出現在靠前的位置;同时避免把一堆長期不更新的舊條目反复推到列表顶部。如果站点同时使用站点地图、站内推荐位、相關阅讀等多個入口,分頁只要做到“干净、有邊界、路径明确”,就已经完成它的任務了。

定期回看的两個動作

  • 每季度抽查几個主要栏目的分頁,看有没有栏目因為内容下线出現空頁或断裂。
  • 结合蜘蛛日誌和索引資料,观察翻頁地址的抓取與收錄比例,發現異常再調整,不必频繁改動。