搜尋引擎現在主要以移動版頁面作為抓取和建立索引的基准。蜘蛛看到的是移動端渲染出来的那份内容,而不是你在桌面端浏览器里看到的那一份。如果桌面版有完整正文,移動版因為改版、模板差异或加载策略只剩下标题和一小段摘要,索引里能记錄的也就只有這些。這谈不上惩罚,只是它确實没看到。
移動版和桌面版不一致的常见场景
- 獨立的 m 站或子域名,模板由不同团队维護,正文区块的更新经常不同步;
- 响應式站点但用 CSS 隐藏了部分内容,比如 display:none、visibility:hidden、高度為 0 的折叠容器;
- 移動端為提速做了内容裁剪,只放前两百字加一個"展開全文"按钮,而展開依赖点击後的脚本請求;
- 懒加载或無限滚動,蜘蛛滚動不到的部分其實没有進入 DOM;
- 移動端單獨設定了更嚴格的 robots 規則,或者誤加了 noindex。
被 CSS 隐藏的内容算不算數
用样式隐藏、但仍存在于 HTML 里且用戶点击可展開的内容,通常還是會被讀到,只是在内容權重的判断上會打折。真正麻烦的是内容压根不在移動端 HTML 里:例如需要第二次异步請求才能拿到,或者必须登入、必须交互才會注入。這類内容對蜘蛛来说等同于不存在。
判断方法不复杂。用移動端 UA 抓一次頁面,看原始 HTML 里有没有你要的正文文字,再對比渲染後的 DOM,两者差异就是需要處理的地方。
一套可执行的自查顺序
- 用移動端 UA 获取 HTML,確認目标正文文字是否出現在源碼和渲染结果中;
- 對比移動版與桌面版的 title、H1、正文首段、主要内鏈位置是否一致;
- 检查移動版是否有自引用 canonical,有没有誤指向桌面版地址;
- 检查 robots meta、X-Robots-Tag 與 robots.txt 在移動端是否和桌面端一致;
- 確認索引里被選中的是移動版還是桌面版 URL,與你的预期是否相符;
- 翻日誌,看移動端蜘蛛的抓取量、狀態碼分布和抓取到的頁面体积是否異常偏小。
几個容易踩的点
一是 m 站與桌面站的 canonical 寫反,两邊互相指错,结果索引里的 URL 和實际被抓取的版本對不上,排查时會顯得非常混乱。二是移動端把结构化資料、面包屑、發布日期整块去掉,這主要影响展現形態,和能不能被收錄是两件事,不要混在一起讨论。
三是"展開全文"的處理方式。如果只是 CSS 收起,問题一般不大;如果点击後才發請求再渲染,最好让正文預設就存在于 HTML 中,折叠只作為视觉手段。
先確認蜘蛛在移動端能拿到什么,再去讨论内容质量和收錄结果。移動端 HTML 里没有的東西,後面的優化都無從谈起。
小结
移動優先並不是多加了一道门槛,而是把"蜘蛛看到的版本"直接換成了移動版。自查的重点只有一個:你在桌面端引以為傲的那部分内容,在移動端 HTML 里是否真實存在,並且和桌面端保持一致。把這一步做扎實,再去看索引狀態和展現情况,判断會清晰很多。