收錄量出現下滑,最忌讳的是立刻去改 robots、重新提交 sitemap,或者把内容批量重發一遍。多數情况下,下滑只是統計口径變化或正常淘汰,先按下面的顺序核對,可以避免把本来能恢复的問题改得更糟。
一、先確認是真掉了還是看起来掉了
不同入口给出的數字本来就不一样,直接横向對比很容易誤判。
- 統計對象不同:有的报表把“已發現未索引”也算進去,有的只統計曾经展示過的頁面。
- 時間窗口不同:报表存在延迟,最近几天的資料往往還没补齐。
- 抽样方式不同:site 查询只返回部分结果,數量本身就是一個估算值。
比較稳妥的做法是固定一個口径、固定一個查询時間点,例如每周同一天的同一时段,只看趋势變化,不纠结單次绝對值。
二、按三類原因分组排查
1. 正常淘汰
低质聚合頁、過期活動頁、空结果頁、參數變体,本来就不该長期留在索引里。這類頁面减少通常不影响有效流量,甚至會让索引结构更干净。判断方式很简單:看自然流量是否同步下滑。數量降了但流量稳定,一般不必處理。
2. URL 變更或收敛
改版、目錄調整、canonical 指向變化、參數收敛、末尾斜杠與大小寫统一,都會让舊 URL 逐步登出索引,新 URL 再慢慢進入。這個過程里數量先降後升属于常態。核對重点是:新 URL 有没有被抓取、舊 URL 是否 301 到新地址、站内連結有没有全部改指新地址。
3. 索引重建或異常
模板改動導致主体内容變薄、誤加的 noindex、robots.txt 拦住了整段目錄、服務器長時間返回 5xx、證书或解析異常,都會造成一批頁面集中登出。這類問题的特征是時間点明确、涉及范围成批、和内容质量關系不大。
三、抽样核對的具体動作
- 選一到两個主要模板,例如文章頁、商品頁,各抽 5 到 10 條近期掉出索引的 URL。
- 用 URL 检查工具查看目前狀態:能否抓取、返回什么狀態碼、是否被 noindex 拦截。
- 對照服務器日誌,確認蜘蛛最近一次訪問這些 URL 的時間和响應碼,看抓取是否還在繼續。
- 检查頁面本身有没有實质變化:正文是否被折叠、是否變成登入可见、是否和同站其他頁面高度重复。
- 最後看内鏈:這些 URL 還有没有站内入口,還是已经變成孤岛頁面。
如果掉落集中在某一個時間点、某一個目錄下,優先怀疑模板或配置改動,而不是内容质量問题。反過来,如果掉落分散在不同目錄、不同時間,則更可能是内容层面的自然篩選。
四、處理顺序與观察方式
確認原因之前,不建议同时動 robots、canonical、内鏈和内容。一次只改一處,才能知道是哪一步起了作用。修复之後也不要每天刷新报表,抓取、重新入库再到展示本来就有周期,通常按周观察更合适。
观察时记錄三類資料:抓取频次、索引狀態、自然流量。三者同向變化,才算真正恢复。如果數量没有回到原来的水平,也不一定代表失敗。改版之後舊 URL 登出、新 URL 進入,總量持平或略降属于正常结果,關键還是看有效頁面带来的流量是否稳定。