移動優先索引之後,搜尋引擎抓取和评估的通常是移動版内容。如果站点用响應式设計,PC 和手机共用一個 URL,這件事基本不用操心;但不少老站或特定架构仍然保留獨立的 m 站,PC 和移動端各有一套地址。這时收錄就變成两個 URL 的問题:能不能归並成一份,以及由谁代表這一頁。
先分清三種移動适配方式
- 响應式:同一個 URL,靠 CSS 适配。收錄只需要處理一個地址。
- 動態服務:同一個 URL,根據 UA 返回不同的 HTML。URL 层面仍然是同一個。
- 獨立 m 站:如 m.example.com 或 /mobile/ 目錄,PC 和移動各有一個地址,需要顯式建立對應關系。
前两種的收錄問题一般出在内容一致性上,第三種才會出現同一頁面被收錄两次的情况,也是需要額外處理的一種。
归並的關键是 canonical 指向一致
對獨立 m 站,常见做法是两套頁面都設定 canonical,指向同一個代表版本。方向可以選 PC,也可以選移動,重点是两邊的声明不要互相打架。
- PC 頁面 canonical 指向自己,移動頁面 canonical 指向 PC 地址:這是最常见的一種组合,代表版本是 PC 地址。
- PC 頁面 canonical 指向移動版:如果站点打算完全以移動版為准,也可以,但要保證 PC 頁面也這么声明,而不是只有移動端單方面声明。
- 两套頁面各自 canonical 指自己,同时又互相加 alternate:這是最容易出問题的寫法,相当于告诉搜尋引擎两個都是正本。
如果站点支持 alternate 标记,例如在 PC 頁面寫 rel="alternate" 並带上 media 條件,它表達的是「這两個地址是同一頁的不同呈現」,可以和 canonical 配合使用,但两者方向必须一致。各家搜尋引擎對這類标记的支持程度不同,用之前最好先在日誌和索引里驗證實际效果。
移動版被屏蔽或内容被裁剪,是更常见的坑
有些站点出于性能或歷史原因,把 m 站寫進 robots.txt 的 Disallow 里,或者给移動頁面加了 noindex。在移動優先索引下,這等于让搜尋引擎看不到真正的移動内容,PC 版本也可能因此拿不到及时的更新索引。
另一種情况是移動版内容被大幅裁剪:正文只留前两段、结构化資料没有同步、關键内鏈被删掉。搜尋引擎评估的是移動版,看到的内容比用戶實际能获取的少,收錄结果自然會受影响。
- 检查 m 站是否被 robots.txt 或 noindex 拦下。
- 對比两版的正文、标题、结构化資料是否一致。
- 確認移動版的内鏈没有大量丢失。
跳轉方式也會影响抓到的版本
用 UA 判断做 JS 跳轉,或者用 302 临时跳轉,會让蜘蛛在不同情况下看到不同结果。如果一定要跳,建议用服務端跳轉並保持規則清晰:從 PC 到移動是單向的,不要让两邊互跳,否則容易形成循环,蜘蛛最後可能只抓到一個空壳頁。
自查顺序
- 用移動 UA 和桌面 UA 各抓一次两個 URL,把返回的 HTML 儲存下来做對比。
- 检查两邊的 canonical、alternate 是否自洽。
- 检查 robots.txt、meta robots、X-Robots-Tag 有没有誤伤移動版。
- 在蜘蛛日誌里確認两個 URL 都有正常抓取记錄,狀態碼正常。
- 观察一段時間内的收錄结果,看是否仍然存在两份副本。
移動适配不是配置一次就完事的工作。改版、新增模板、CDN 規則變動,都可能让两邊的内容重新分叉。定期用同样的方法复查一遍,比等到索引里出現两份副本再补救要省力。