移动端流量占比持续走高之后,搜索引擎对站点移动适配的重视程度也随之提升。对于同时维护PC版和移动版的站点来说,搜索蜘蛛在抓取URL时,会通过User-Agent、页面中的rel alternate与canonical、以及跳转关系来判断该把哪个URL视为首选。如果这些信号彼此矛盾,蜘蛛的抓取行为就容易出现“来回跑”“重复抓”甚至“放弃抓取”的情况。
移动适配与URL发现的关系
URL发现不只是从站内链接或Sitemap里看到地址,还包括确认这个地址在当前设备的语义下是否应当被索引。搜索蜘蛛在移动优先索引环境下,通常会更重视移动页面,但它在抓取之前仍然需要先找到正确的入口。
如果站点的移动适配代码没有问题,蜘蛛会顺着PC页面的rel alternate发现移动版URL,同时根据canonical确认移动页面的规范地址。这样,两个版本的URL都会被纳入抓取队列,但权重信号会聚焦到规范地址上。
问题恰恰容易出现在代码不一致的时候。比如PC页面声明了alternate,移动页面却没有或者反向声明错误;又比如移动页面跳转到PC页面,而PC页面又自动跳转回移动页面。这种循环跳转并不会提高页面的适配清晰度,反而会消耗蜘蛛的抓取预算,让蜘蛛在几个URL之间来回试探。
常见适配失误对蜘蛛抓取的影响
仅做跳转,不做双向声明
部分站点为了简单,只在移动页面设置automatic jump回PC版页面,却不在PC版页面上声明对应的移动版地址。搜索蜘蛛在识别移动版时,如果没有看到明确信号,很可能只抓取PC版而忽略移动版;或者在移动优先环境下抓取了一个仍在跳转的移动地址,最终无法获得有效内容。
页面内容不同步
有些站点的PC版和移动版内容差异很大,移动版可能被简化,甚至关键段落与正文结构被折叠。为了满足移动用户体验,适当精简是合理的,但如果连大致文本都与PC版不一致,蜘蛛在移动优先索引时可能认为移动页面独立且不完整,从而降低对其重要性的判断。
同一URL同时适合多种设备,却保留两套模板
如果站点使用响应式设计,理论上只有一个URL。但很多老站点把PC版和移动版做成两套模板,并安装了适用范围很广的User-Agent判断。由于不同搜索蜘蛛的抓取UA不同,有些UA不在你预设的范围内,于是它看到的总是PC版URL。这时候,移动版URL的收录和抓取就会很不稳定。
如何自查URL层面的适配配置
检查反向链接与canonical
打开PC版URL,查看源码中的link rel alternate是否存在,并且指向的移动版地址是否可以被正常访问。再去移动版URL的源码中查看canonical是否写回PC版URL。这种互相指向是基础。若是响应式页面,那么只需通过viewport和media queries控制,不需要alternate,也不要在桌面URL上做无谓的跳转。
避免使用JS跳转
搜索蜘蛛在初抓阶段不一定执行全部JavaScript。如果移动版跳转通过JS完成,蜘蛛可能看不到真实落地页面,反而把中间跳转页当成内容。建议通过HTTP响应头或标准meta refresh处理,同时确保移动版URL本身是可达的。
查看抓取日志中的UA与StatusCode
在蜘蛛池的日志统计里,筛选搜索引擎UA,观察它们访问的是哪一种URL模板。如果你看到同一个UA在PC版URL与移动版URL之间频繁切换,并且多数是301或302,说明当前设置已经引起蜘蛛的困惑。此时应优先检查跳转目标是否一致,并确认两条URL上的alternate与canonical是否成对出现。
调整时避免造成抓取浪费
当需要大规模改变移动适配方式时,不要在一天内同时删除和新增大量URL。推荐的做法是:先保留旧移动URL,并在新旧URL之间设置301跳转;同时统一两边页面的canonical声明。给搜索蜘蛛留出重新抓取的时间,再逐步下线无效地址。
如果站点本身是独立移动站模式,最好把URL层级做得清晰,比如m.example.com与www.example.com之间一一对应,不要出现多个移动URL对应同一个PCURL,也不要把PC页面全部301到移动首页。对应关系越整齐,蜘蛛越容易理解URL之间的等价性。
利用Search Console或百度搜索资源平台验证
如果是面向Google的蜘蛛,可以在Search Console里检查“移动设备易用性”报告,里面会指出哪些页面存在“内容宽度超过屏幕”或“文字太小”之类的问题,这些问题间接影响蜘蛛对页面质量和适配方式的判断。如果是面向百度蜘蛛,也可以借助抓取诊断工具,直接输入PC或移动URL,观察蜘蛛实际返回的页面内容属于哪个版本。
没有完美适配,也能保持抓取稳定
虽然适配越规范越省心,但有些站点由于历史原因暂时做不到完全分离或合并URL,这时至少要保持三件套稳定:移动URL能够直接返回内容,不依赖跳转;PCURL与移动URL有互相指向的alternate链接;canonical指向当前模板对应的规范地址。做到这三点,搜索蜘蛛在发现URL时就可以少绕弯路。至于最终哪个URL被选中为索引主版本,搜索引擎会结合用户语言、设备类型与自身算法来决定,站长能做的,是把每个版本的对应关系解释清楚。
基础的自查并不复杂:每周抽查几条URL,分别用桌面UA和移动UA去访问一遍,看返回的状态码与落地页面是否一致,同时打开源码确认适配标记没有发生错乱。只要这些环节不出问题,搜索蜘蛛对URL的抓取就会稳定很多,移动端的URL发现也能持续保持顺畅。