網站收錄

網站改版後新舊地址並存:迁移清單與收錄過渡的核對要点

網站改版後,舊地址還能打開、新地址也開始被訪問,索引里两邊都有记錄。本文把迁移拆成舊地址清單、新舊對應表、跳轉規則和迁移後的观察信号几步,說明内鏈、sitemap 與 canonical 需要同步調整的地方,以及改版期間最容易踩的几個坑。

網站收錄

網站改版後新舊地址並存:迁移清單與收錄過渡的核對要点

網站改版後最常见的情况不是内容丢了,而是新舊两套地址同时存在:舊連結還能打開、新連結也開始被訪問,索引里两邊都有记錄。這时候真正要處理的不是“让新頁面被收錄”,而是把收錄归属收敛到一套地址上。

先分清是哪一種改版

不同改版的迁移成本差別很大,動手前先归類:

  • 只換皮:模板和样式變了,URL 结构不動,正文位置也基本一致。這種情况風險最小,重点核對有没有顺手把标题、正文容器改掉。
  • 換结构:目錄层級、文件名規則變了,一個舊地址對應一個新地址。這是需要做映射表的一類。
  • 換域名或換协议:整站搬迁,涉及跨域跳轉,收敛周期通常更長。
  • 合並拆分:多個頁面合並成一個,或一個頁面拆成多個。這類没有一對一映射,需要人工判断每個舊地址指向哪個新地址,指向最相關的那一個即可。

迁移前的清單要落到文件上

口头约定容易漏,最好落成两份表:

  1. 舊地址清單,来源包括 sitemap、服務器訪問日誌、站長後台的已收錄列表,以及内鏈里出現過的地址。只靠 sitemap 會漏掉歷史遗留的參數頁。
  2. 新舊對應表,一行一個舊地址,寫清目标地址和跳轉類型。没有對應頁面的,明确是返回 410 還是跳到最近的上級栏目。
判断标准很简單:如果這張表交给一個不了解項目的人,他能不能照着把規則配出来。做不到,說明還没整理完。

跳轉規則落地时的几個细节

用 301,別用 302 或脚本跳轉

临时跳轉和 JS 跳轉都可能让舊地址繼續留在索引里。整站迁移用 301,並尽量跳轉到内容最接近的頁面,而不是一律跳首頁。

跳轉鏈不要超過一跳

A 跳到 B,B 又跳到 C,會拖慢收敛。出現這種情况通常是因為改版分了几批做,中間层没清理。迁移結束後回头把鏈式跳轉压平成直接跳轉。

内鏈和 sitemap 同步換新

如果站内連結還指向舊地址,蜘蛛會不断從内鏈回到舊地址,等于自己给自己制造重复入口。站内導航、面包屑、相關推荐、分頁連結都要一起改。sitemap 只放新地址,舊地址是否保留在 sitemap 里意义不大,用跳轉規則處理更可靠。

canonical 指向新地址

如果舊頁面短期内還保留着内容,比如為了照顾某些合作方,頁面上的 canonical 應指向新地址,避免两套頁面互相声明自己是正本。

迁移之後看什么

观察期内重点看三類信号,而不是只盯收錄量:

  • 舊地址的訪問量是否在下降,說明跳轉被正常识別,用戶和蜘蛛都在走新路径。
  • 新地址的抓取频次是否上升,可以通過日誌里的請求量看趋势。
  • 索引里的舊地址是否在减少,這個過程按周看即可,不要按天判断。

如果几周後舊地址仍然大量留在索引里,先回到跳轉規則本身检查,而不是急着做其他操作:確認狀態碼是 301、確認跳轉目标可正常訪問且返回 200、確認没有被 robots.txt 挡住。

几個容易踩的坑

  • 改版同时改内容:URL 迁移和内容大改一起做,出問题时很难判断是哪一步造成的。條件允许的话分開進行。
  • 保留舊目錄做兼容:舊目錄繼續可訪問、内容也一样,實际上就是制造了两套重复頁面。
  • 測試环境被收錄:迁移期間常出現測試域名可訪問的情况,记得加訪問限制或 noindex。
  • 只處理首頁:首頁跳轉正常不等于内頁正常,抽查时要覆盖不同层級和不同類型的頁面。

收錄過渡是按周計的過程,能控制的是迁移清單是否完整、跳轉規則是否干净、站内入口是否统一指向新地址。這三点做到位,剩下的交给時間。至于收錄速度和最终收錄结果,取决于站点整体情况和搜尋引擎的抓取安排,没有可以保證的固定周期。