两套地址,两个索引入口
有些站点把移动端和 PC 端拆成两个域名,例如 m.example.com 和 www.example.com。从搜索引擎的角度看,这是两条独立可抓取的 URL,各自都能被抓取,也各自可能进入索引。所以当你核对“这个页面收录了吗”,先要回答的是:是哪一端被收录,另一端现在是什么状态。只说“收录了”或“没收录”,往往会掩盖真正的问题。
三种常见部署方式
响应式或动态适配
同一个 URL 返回适配不同设备的同一份内容,收录只有一条地址,维护成本最低,也最不容易出现两端不一致的情况。
独立移动站加适配声明
两端各自返回页面,需要在 PC 页与移动页之间互相标注对应关系。两端都允许抓取,索引通常会收敛到其中一端,但收敛过程需要时间,中间状态可能是两端都在索引里。
移动端被整体屏蔽
如果 robots.txt 或 noindex 把移动端全部挡住,移动端不会进索引,PC 端仍可能被收录。移动用户点进来看到的页面,与索引里那一版的体验并不一致,这是一类容易被忽略的错配。
核对收录时的顺序
- 先用 URL 检查工具分别查 PC 端和移动端的地址,看各自处于什么状态。
- 确认两端的适配声明是否成对、是否指向真实存在的地址。
- 检查移动端能否正常抓取:状态码、robots 规则、跳转链是否过长。
- 最后再确认索引里实际留下的是哪一条,以及另一条是否还在索引中。
几个容易踩的坑
- 只在一端写适配声明,另一端漏掉,形成单向关系。
- 移动端用脚本跳到 PC 端,PC 端又跳回移动端,形成循环。
- 移动页面内容明显少于 PC 端,正文缺失大半。
- 用临时跳转把移动端全量指向 PC 端,却没有声明适配,两套 URL 频繁进出于索引。
适配声明是给搜索引擎的参考,不是强制指令。它帮助系统判断两套地址是不是同一份内容,但最终选择哪一条,还取决于两端的内容、可抓取性和链接指向。
如果只想保留一套地址
最省事的做法是不拆站,让同一 URL 适配所有设备。如果出于历史原因必须拆,至少保证两端都能抓取、正文内容基本一致、互相声明对应关系,并让跳转保持单向、可预期。不要一边屏蔽移动端,一边期待移动端有正常的搜索表现。
自查清单
- 两端是否都返回正常状态码,而不是一端 200、另一端 404 或 302。
- 适配声明是否成对出现,且指向当前真实存在的地址。
- 移动端正文是否与 PC 端大体一致,而不是只剩标题和导航。
- robots.txt 是否意外挡住了其中某一端。
- 两端的自指声明是否自相冲突,导致系统无法判断主版本。
把两端当成一组来处理,收录核对时的很多“莫名其妙”就会变成有迹可循的排查步骤。