移动优先之后,蜘蛛先读的是移动版
现在主流搜索引擎在抓取和索引时,默认以移动版 HTML 为主要依据。PC 版页面仍然会被抓取,但要发现新链接、理解页面结构,很多环节先看移动版。也就是说,移动版里没有出现的导航、分页和相关推荐,在 URL 发现这条链路上基本等于不存在。
这件事的麻烦之处在于:移动版通常是被“优化”过的那一版,空间小、元素少,减法做得越彻底,交出去的发现入口就越少。
移动版做减法时,最容易丢掉的几条通道
移动端屏幕窄,很多站点会给页面做减法:导航收进汉堡菜单,相关阅读只留三条,列表页改成无限滚动。对用户来说体验可能更好,但对 URL 发现是另一回事。
- 汉堡菜单:如果菜单展开后链接本来就写在 HTML 里,蜘蛛一般能读到;如果是点击后由脚本才插入 DOM,就容易被漏掉。
- 无限滚动:只有用户滚动时才请求后续数据,列表尾部的 URL 不会出现在首屏 HTML 里。
- 相关阅读被截断:深页面的内链数量下降,被发现的概率也随之降低。
- 移动版没有引用 Sitemap:或者 robots.txt 里误屏蔽了移动版路径,等于主动关掉一条申报通道。
三种移动实现方式,检查重点不同
响应式布局
同一套 HTML,只是 CSS 断点不同,这类站点风险最小。重点看隐藏规则:用样式隐藏的链接,多数引擎仍会解析;用脚本把节点从 DOM 里移除的,就不一定了。
独立移动域名
以 m 开头或类似结构的移动域,需要确认移动版有完整的导航与分页、指向自身的规范地址,以及与 PC 版正确对应。如果移动版只保留了首页和少量栏目,发现能力就被砍掉大半。Sitemap 里同样应包含移动版 URL,或按引擎要求标注对应关系。
动态服务,同一 URL 返回不同 HTML
服务端按 User-Agent 返回不同版本时,要小心别把移动版蜘蛛当成陌生客户端拦下。部分 CDN 或 WAF 会按 UA 做限流,结果是移动版蜘蛛拿不到完整页面,链接自然也就发现不了。
检查移动版发现通道是否完整的几个动作
- 用移动端 UA 抓取首页和几个栏目页,数一数返回 HTML 里有多少可点击链接,和 PC 版对比差异。
- 关掉脚本再抓一次,看导航、分页、相关阅读还剩多少。剩得太少,说明发现路径严重依赖脚本。
- 检查 Sitemap 是否包含移动版路径,robots.txt 是否误屏蔽。
- 在服务器日志里筛选移动蜘蛛的 UA,看它抓取的 URL 数量与桌面蜘蛛的比例,是否长期只停留在首页和热门页。
- 用渲染测试工具确认渲染完成后的 DOM 里确实存在链接节点。
判断标准可以简单一点:把脚本关掉,从移动版 HTML 出发还能不能走到你的重点新页面。走得到,发现通道基本没问题;走不到,就该补一条静态内链或 Sitemap 入口。
把移动版放进日常巡检
不少站点的 PC 版内链结构做得不错,移动版却因为改版、AB 测试、模板差异慢慢退化。建议在周报里固定看两个数字:移动蜘蛛抓取的 URL 数量,以及新地址从发布到首次被抓的间隔。如果移动版抓取量明显低于桌面版,而流量结构并非如此,通常说明移动版的链接通道出了问题。
最后提醒一句:这些调整只能提高 URL 被发现的概率,并不能保证收录或排名。发现之后还有抓取预算、内容质量、重复度等环节,任何一环都可能让一个地址停在队列里。