網站收錄

收錄數涨了流量却没動:先分清有效收錄和凑數頁面

收錄數增長不等于站点變好。本文给出一個可操作的分层方法:先定义有效收錄的三條标准,再排查空结果頁、參數變体、模板詳情頁等凑數頁面,最後按目錄與模板盘点,先收口新增、再處理存量。

網站收錄

收錄數涨了流量却没動:先分清有效收錄和凑數頁面

後台看收錄數一直往上走,搜尋流量却几乎没變化,這是很常见的一種错觉。收錄數只是搜尋引擎愿意把這些 URL 放進索引的計數,它不区分頁面有没有内容、有没有人搜、有没有導航價值。等哪天索引清理,掉下来的往往就是這批頁面。

先把有效收錄说清楚

有效收錄不是官方指标,是我們自己给頁面做的一次分類,判断标准大致有三條:

  • 能被搜到:頁面在索引里,且用頁面核心词能查到,而不是只有輸入完整 URL 才出現。
  • 有人需要:有真實搜尋需求,或者承担站内導航、承接内鏈的作用。
  • 内容不重复:和站内其他頁面表達的是同一件事,只是參數、排序或模板不同。

三條都满足,才算工作頁面;缺一條,就要评估它是不是在给索引凑數。

最容易凑數的几類頁面

  • 空结果頁與篩選空頁:條件组合後没有任何结果,只剩一句暂無内容。
  • 排序、追踪參數生成的變体:同一份内容被拆成几十個 URL。
  • 只有标题和一段模板文案的詳情頁:資料缺失时仍然生成頁面。
  • 大量相似的分頁列表:列表頁本身没有獨立信息,只是把詳情頁重复了一遍。
  • 内鏈孤岛:只在 sitemap 里出現,站内没有任何入口。

這些頁面被收錄,不代表站点健康,反而會分散抓取額度、稀释质量判断。

按目錄和模板做一次盘点

不要逐個 URL 看,效率太低。按下面顺序分层,一两天内就能看出大概:

  1. 按目錄統計收錄量,看哪個目錄占比異常高。
  2. 按模板分组,比如列表、詳情、篩選、标簽、站内搜尋,比較各组的收錄占比。
  3. 每组抽取十到二十個样本,人工判断是否属于有效收錄。
  4. 對可疑分组做一次需求核對:這個東西到底有没有人搜。

處理顺序:先收口,再清理

很多站点一發現問题就批量删頁面,结果反而制造大量 404 和索引波動。更稳妥的顺序是先停止新增,再處理存量。

停止新增

  • 無结果、無資料的頁面不要生成,或者生成後返回合适的 404、410。
  • 篩選參數组合加限制,超過阈值就收敛,不让任意组合都能产出 URL。
  • 把不值得收錄的頁面從 sitemap 里去掉,避免主動邀請抓取。

處理存量

按價值分三档:有搜尋需求和導航價值的保留;内容重复的统一 URL 規范或合並;纯粹無價值的再考虑下线。下线優先用 301 指向最近的替代頁,确實没有替代頁时再用 410。

收錄數不是越高越好。索引里躺着一堆没人搜、也不承担導航的頁面,只會让抓取額度被無效消耗。

观察窗口別太短

調整之後至少观察两到四周。索引更新是渐進的,短期内收錄數下降属于正常波動;如果同时看到有效頁面的抓取比例上升、搜尋展現集中到少數核心頁,方向就是對的。

反過来,如果只是把頁面從 sitemap 移除,但站内連結和模板仍然源源不断产出這些 URL,收錄數往往還會回来。收口要收在生成环节,而不是收在提交环节。