網站收錄

站点改版後的收錄衔接:舊 URL、跳轉與遗留入口怎么收尾

改版上线只是開始,舊 URL 的去向才是影响後續收錄的關键。本文按保留、跳轉、下线三類梳理舊地址,說明 301 目标怎么選、遗留入口怎么清、過渡期该核對哪些資料,以及上线时常踩的几個坑。

網站收錄

站点改版後的收錄衔接:舊 URL、跳轉與遗留入口怎么收尾

改版、換目錄结构、換域名這類動作,最容易被忽略的不是頁面本身,而是 URL 變化带来的一整套衔接工作。设計稿上线、模板切換通常有明确的時間点,但搜尋引擎那邊對舊地址的记忆會持續很久。改版之後收錄出現波動,很多情况下不是新頁面寫得不好,而是舊 URL 没有交代清楚。

先给舊 URL 分三類

動手之前,把改版前的 URL 表拉出来,逐條标注去向:

  • 保留:URL 不變,只是模板或内容調整。這類不需要額外處理,但要確認頁面仍能正常返回 200。
  • 跳轉:頁面還在,地址變了,用 301 指到新地址。
  • 下线:内容不再提供,返回 404 或 410,而不是跳去首頁。

分類不清就會出現最常见的错誤:一批已经下线的頁面被统一跳轉到首頁。這種做法等于把大量舊 URL 都指向同一個頁面,既浪費抓取,也让搜尋引擎难以判断這些地址的真實狀態。

跳轉關系要一對一確認

301 的目标頁面,最好是内容最接近的那一頁,而不是分類頁或首頁。分類頁和詳情頁混着跳,容易让新頁面繼承到不相關的信号。

几個要核對的点

  • 跳轉鏈不要超過一跳,A→B→C 的情况尽量压成 A→C,否則抓取和信号传递都會打折。
  • 跳轉目标本身不能是 404、noindex 或被 robots.txt 拦截的地址。
  • 大小寫、结尾斜杠、參數寫法要和舊地址被收錄时的形態對齐,別只處理了主 URL。

遗留入口要一並清理

URL 換了,但指向舊地址的入口還在,爬虫就會一直撞到舊連結。常见来源有:

  1. 站内導航、面包屑、正文内鏈里寫死的老地址;
  2. sitemap 里還没更新的舊 URL;
  3. 友鏈、投稿、外部平台留下的老連結;
  4. 站内搜尋结果、列表頁模板里拼接的歷史參數。

站内可控的部分優先改,外部連結不强求全部回收,靠 301 承接即可,但至少要保證跳轉長期有效,不要過几個月就撤掉。

過渡期看什么

改版後的两到四周,重点不是盯着收錄總量涨跌,而是看新 URL 是否開始被正常抓取和索引。抽查方式:拿一批新地址,在搜尋框里查 URL,看索引结果指向的是新版還是舊版;再對比抓取日誌里新舊地址的請求比例,如果舊地址請求量長期不降,說明還有入口没清干净。

改版期間最常见的問题不是收錄變慢,而是舊地址没有被明确交代,導致新舊两套 URL 長期並存。

几個容易踩的坑

  • 上线时用 robots.txt 全站屏蔽,忘了撤,整個改版窗口期都没有被正常抓取;
  • 新頁面還带着測試环境的 canonical,指向了内網或占位域名;
  • 跳轉只在服務端配了一半,静態资源或带參數版本仍然返回 200 的舊内容;
  • 改版後立刻大量提交新 URL,但頁面结构還没稳定,抓取回来反复變動。

改版不是一次性動作,URL 的收尾工作往往要持續一两個月。把舊 URL 的去向表维護好,配合跳轉配置和 sitemap 更新,收錄恢复的過程通常會平稳一些。