移動端流量占比持續走高之後,搜尋引擎對站点移動适配的重视程度也随之提升。對于同时维護PC版和移動版的站点来说,搜尋蜘蛛在抓取URL时,會通過User-Agent、頁面中的rel alternate與canonical、以及跳轉關系来判断该把哪個URL视為首選。如果這些信号彼此矛盾,蜘蛛的抓取行為就容易出現“来回跑”“重复抓”甚至“放弃抓取”的情况。
移動适配與URL發現的關系
URL發現不只是從站内連結或Sitemap里看到地址,還包括確認這個地址在目前设备的语义下是否應当被索引。搜尋蜘蛛在移動優先索引环境下,通常會更重视移動頁面,但它在抓取之前仍然需要先找到正确的入口。
如果站点的移動适配代碼没有問题,蜘蛛會顺着PC頁面的rel alternate發現移動版URL,同时根據canonical確認移動頁面的規范地址。這样,两個版本的URL都會被纳入抓取队列,但權重信号會聚焦到規范地址上。
問题恰恰容易出現在代碼不一致的时候。比如PC頁面声明了alternate,移動頁面却没有或者反向声明错誤;又比如移動頁面跳轉到PC頁面,而PC頁面又自動跳轉回移動頁面。這種循环跳轉並不會提高頁面的适配清晰度,反而會消耗蜘蛛的抓取预算,让蜘蛛在几個URL之間来回试探。
常见适配失誤對蜘蛛抓取的影响
僅做跳轉,不做双向声明
部分站点為了简單,只在移動頁面設定automatic jump回PC版頁面,却不在PC版頁面上声明對應的移動版地址。搜尋蜘蛛在识別移動版时,如果没有看到明确信号,很可能只抓取PC版而忽略移動版;或者在移動優先环境下抓取了一個仍在跳轉的移動地址,最终無法获得有效内容。
頁面内容不同步
有些站点的PC版和移動版内容差异很大,移動版可能被简化,甚至關键段落與正文结构被折叠。為了满足移動用戶体驗,适当精简是合理的,但如果连大致文本都與PC版不一致,蜘蛛在移動優先索引时可能認為移動頁面獨立且不完整,從而降低對其重要性的判断。
同一URL同时适合多種设备,却保留两套模板
如果站点使用响應式设計,理论上只有一個URL。但很多老站点把PC版和移動版做成两套模板,並安装了适用范围很广的User-Agent判断。由于不同搜尋蜘蛛的抓取UA不同,有些UA不在你预设的范围内,于是它看到的總是PC版URL。這时候,移動版URL的收錄和抓取就會很不稳定。
如何自查URL层面的适配配置
检查反向連結與canonical
打開PC版URL,查看源碼中的link rel alternate是否存在,並且指向的移動版地址是否可以被正常訪問。再去移動版URL的源碼中查看canonical是否寫回PC版URL。這種互相指向是基础。若是响應式頁面,那么只需通過viewport和media queries控制,不需要alternate,也不要在桌面URL上做無谓的跳轉。
避免使用JS跳轉
搜尋蜘蛛在初抓阶段不一定执行全部JavaScript。如果移動版跳轉通過JS完成,蜘蛛可能看不到真實落地頁面,反而把中間跳轉頁当成内容。建议通過HTTP响應头或标准meta refresh處理,同时确保移動版URL本身是可達的。
查看抓取日誌中的UA與StatusCode
在蜘蛛池的日誌統計里,篩選搜尋引擎UA,观察它們訪問的是哪一種URL模板。如果你看到同一個UA在PC版URL與移動版URL之間频繁切換,並且多數是301或302,說明目前設定已经引起蜘蛛的困惑。此时應優先检查跳轉目标是否一致,並確認两條URL上的alternate與canonical是否成對出現。
調整时避免造成抓取浪費
当需要大規模改變移動适配方式时,不要在一天内同时刪除和新增大量URL。推荐的做法是:先保留舊移動URL,並在新舊URL之間設定301跳轉;同时统一两邊頁面的canonical声明。给搜尋蜘蛛留出重新抓取的時間,再逐步下线無效地址。
如果站点本身是獨立移動站模式,最好把URL层級做得清晰,比如m.example.com與www.example.com之間一一對應,不要出現多個移動URL對應同一個PCURL,也不要把PC頁面全部301到移動首頁。對應關系越整齐,蜘蛛越容易理解URL之間的等價性。
利用Search Console或百度搜尋资源平台驗證
如果是面向Google的蜘蛛,可以在Search Console里检查“移動设备易用性”报告,里面會指出哪些頁面存在“内容宽度超過屏幕”或“文字太小”之類的問题,這些問题間接影响蜘蛛對頁面质量和适配方式的判断。如果是面向百度蜘蛛,也可以借助抓取诊断工具,直接輸入PC或移動URL,观察蜘蛛實际返回的頁面内容属于哪個版本。
没有完美适配,也能保持抓取稳定
虽然适配越規范越省心,但有些站点由于歷史原因暂时做不到完全分离或合並URL,這时至少要保持三件套稳定:移動URL能够直接返回内容,不依赖跳轉;PCURL與移動URL有互相指向的alternate連結;canonical指向目前模板對應的規范地址。做到這三点,搜尋蜘蛛在發現URL时就可以少绕弯路。至于最终哪個URL被選中為索引主版本,搜尋引擎會结合用戶語言、设备類型與自身算法来决定,站長能做的,是把每個版本的對應關系解释清楚。
基础的自查並不复杂:每周抽查几條URL,分別用桌面UA和移動UA去訪問一遍,看返回的狀態碼與落地頁面是否一致,同时打開源碼確認适配标记没有發生错乱。只要這些环节不出問题,搜尋蜘蛛對URL的抓取就會稳定很多,移動端的URL發現也能持續保持顺畅。