网站收录

移动端与桌面端URL各一套时:收录核对先从哪个版本入手

移动端与桌面端各有一套URL时,收录核对容易把两版混在一起看。本文按站点类型分开,给出从抓取UA、正文对照、互指标记到索引版本确认的核对顺序,并列出几个容易搞反的处理方式。

网站收录

移动端与桌面端URL各一套时:收录核对先从哪个版本入手

不少站点为了适配手机,会把移动端单独拆成一套 URL,比如 m.example.com 或 /mobile/ 路径。移动优先索引铺开之后,这类站点最常见的问题不是“没收录”,而是两套 URL 一套被索引、一套被忽略,或者两边都被收录却互相抢版本。核对的时候,顺序比结论更重要。

先分清你的站点属于哪一种

同样是“两套 URL”,处理方式差别很大:

  • 响应式设计:桌面和手机共用同一套 URL,由 CSS 断点负责显示。这种情况不存在两套 URL 的核对问题。
  • 独立移动站:m. 子域或独立域名,和桌面站各自一套 URL,内容基本对应。
  • 动态服务:同一个 URL,服务端按 UA 返回不同的 HTML,URL 只有一套。
  • 跳转式:移动端访问时用 301 或 302 跳到另一套 URL。

先确认自己落在哪一类,再决定要不要做“两版对照”。第一类和第三类只需要检查渲染结果是否一致,第二类才是真正容易出问题的。

独立移动站的收录核对顺序

第一步:确认蜘蛛抓的是哪一版

日志里筛出移动 UA(比如带上 Mobile、Android、iPhone 字段的 Googlebot)和桌面 UA,看它们分别请求了什么 URL。如果移动 UA 只抓了桌面页,说明分流配置或 robots 规则可能在拦它;如果移动 UA 抓了 m 站却拿到桌面内容,问题就出在服务端判断逻辑。

第二步:对照两版的正文主体

把同一篇文章的两版 HTML 取下来,去掉导航、广告、相关推荐,只看正文。常见差异有三种:移动版正文被截断、移动版缺了关键段落、移动版把正文塞进了需要点开才能看到的折叠块。第三种在早期移动站里很常见,需要改成默认展开,或者保证 HTML 里直接存在正文。

第三步:检查互指的标记

两个版本应当互相声明对应关系:桌面版指向移动版,移动版指回桌面版。如果只有单向,或者写成自己指自己,搜索引擎容易把两边当成两个独立页面,各自算一份内容。同时确认 canonical 指的是内容主版本,而不是随手写成本页 URL。

第四步:看索引里最终留下的是哪个版本

用站点查询或索引报表,分别搜两版的标题和一段独有正文,看哪个 URL 出现。理想结果是只留下一个,且那个版本的正文完整。如果两套都出现,说明前面的标记没起到收敛作用;如果一个都没出现,问题就不在版本选择,而要回到抓取和索引本身的状态去查。

第五步:差异收口

确认问题后按影响面处理:能改成响应式的,长期看最省事;暂时保留两套的,至少保证正文一致、互指标记双向、robots 不误拦移动 UA。改完之后留出重访周期再复看,别当天改完当天就下结论。

几个容易搞反的地方

  • 把移动版当成次要版本直接 noindex。移动优先索引下,被你屏蔽的那一版,可能正是搜索引擎主要参考的那一版。
  • 用 302 长期跳转代替对应标记,跳转目标不稳定时会带来额外的判断成本。
  • 只对比可见文字,忽略结构化数据和图片替代文本的差异。
  • 两版正文相同但 URL 不同,却没有互指标记,这是最典型的“自己和自己重复”。
移动端和桌面端的核对,本质是回答一个问题:搜索引擎应该把哪一个 URL 当成这份内容的代表。先把这个问题答清楚,再谈索引和展现。

最后提醒一句:收录核对只是起点。两版合并成一个之后,页面能不能获得展现,还取决于内容质量、需求匹配和内链结构,这些不在本次核对范围内,但值得单独做一轮。