网站收录

站点换域名或大改版:收录迁移的先后顺序与常见漏项

换域名或整站改版时,301 映射只是其中一步。本文按迁移前的抓取检查、跳转设置、页面信号同步、旧域名保留时长和上线后的数据对账顺序,梳理收录迁移中容易被忽略的环节,包括资源地址、站点地图和参数 URL 的处理。

网站收录

站点换域名或大改版:收录迁移的先后顺序与常见漏项

换域名、改目录结构或者整站更换内容管理系统,把新站上线只是第一步。真正麻烦的是:搜索引擎需要把旧地址的收录和信号转移到新地址,这个过程需要时间,也需要顺序。顺序做错,常见的后果是旧地址长期留在索引里、新地址迟迟不出现,或者两边同时被抓取,变成内容重复。

迁移前:先确认新站本身可以被抓取

很多迁移问题其实不是迁移造成的,而是新站上线时就带着抓取障碍。正式切换前,先把这几件事确认一遍:

  • 新域名能正常访问,没有全站登录墙、验证码或 IP 限制;
  • robots.txt 没有沿用测试环境里的屏蔽规则,这是最常见的低级错误;
  • 服务器响应稳定,在新站流量突然增加时不会频繁超时;
  • HTTPS 证书有效,http 与 https、带 www 与不带 www 只保留一个主版本,其余做跳转;
  • 页面内容与旧站基本一致。迁移不是改版重写的时机,两件事一起做,出问题时很难判断是哪一边的原因。

301 映射:一对一,别批量跳首页

旧 URL 到新 URL 的对应关系要尽量精确。几种做法里,只有一对一映射是可以接受的:

  • 一对一映射:旧文章页跳到新文章页,旧栏目页跳到新栏目页,主题尽量对上;
  • 批量跳首页:所有旧地址都 301 到新站首页。这会把大量不相关的信号集中到首页,旧内容原有多少相关性很难保留;
  • 链式跳转:旧地址跳到中间地址,再跳到新地址。跳转链越长,被正确跟随的概率越低。

另外,跳转要用服务端 301,不要用 JS 跳转或 meta refresh。前者是明确的永久迁移信号,后者更接近一个普通页面行为。

页面上要同步修改的地方

跳转只解决了“用户和爬虫从旧地址过来”这一半问题,新页面自身发出的信号也要一致:

  • canonical 指向新域名下的自身地址,不要还写着旧域名;
  • 站内链接全部换成新域名,不要依赖旧域名的跳转;
  • 重新生成站点地图,只放新域名下的 URL,旧站点地图尽快下线;
  • hreflang、结构化数据里的 URL、分享图和资源文件地址一并更新;
  • 如果用了 CDN 或独立图片域名,资源地址也在迁移范围内,图片收录同样会受影响。

旧域名保留多久

没有统一答案,但方向是宁可留久一点。半年内直接停用或让旧域名返回 404,是比较常见的失分操作。旧域名只要还有外链指向,就仍然有做跳转的价值。真正下线前,建议先看日志:如果旧域名上还有稳定的爬虫访问和真实外部流量,就先不适合彻底关闭。

迁移后按什么顺序看数据

  1. 先看旧域名的跳转是否被正常抓取,日志里应出现对新地址的访问;
  2. 再看新域名的抓取量是否逐步上升,同时旧域名的抓取量下降;
  3. 然后对账索引量:新域名收录数上升、旧域名收录数下降,两条曲线方向相反属于正常过程,两边都不动才需要排查;
  4. 最后看流量与转化。索引量恢复不等于流量恢复,这个时间差是正常的。

如果新域名上线两周,日志里几乎没有爬虫访问新地址,先回头检查 robots、证书和跳转配置,而不是急着反复提交站点地图。

容易漏掉的几类地址

  • 图片、PDF、附件等非 HTML 资源的旧地址;
  • 分页和筛选参数生成的旧 URL;
  • 子域名与移动端域名;
  • 外部合作方、广告落地页、邮件模板里写死的旧链接;
  • 旧站点地图文件与 RSS 地址。
迁移的难点不在技术动作,而在顺序和一致性:旧地址负责把人送过来,新页面本身还要说清楚“我就是这一份”。