網站收錄

移動版和桌面版分成了两個 URL:收錄该怎么归並

獨立 m 站和 PC 站各有一套 URL 时,收錄容易出現两份副本。本文梳理响應式、動態服務和獨立移動站的差別,說明 canonical 與 alternate 的指向原則、移動版被 robots 或 noindex 誤伤的常见情况,以及用双 UA 抓取自查的顺序。

網站收錄

移動版和桌面版分成了两個 URL:收錄该怎么归並

移動優先索引之後,搜尋引擎抓取和评估的通常是移動版内容。如果站点用响應式设計,PC 和手机共用一個 URL,這件事基本不用操心;但不少老站或特定架构仍然保留獨立的 m 站,PC 和移動端各有一套地址。這时收錄就變成两個 URL 的問题:能不能归並成一份,以及由谁代表這一頁。

先分清三種移動适配方式

  • 响應式:同一個 URL,靠 CSS 适配。收錄只需要處理一個地址。
  • 動態服務:同一個 URL,根據 UA 返回不同的 HTML。URL 层面仍然是同一個。
  • 獨立 m 站:如 m.example.com 或 /mobile/ 目錄,PC 和移動各有一個地址,需要顯式建立對應關系。

前两種的收錄問题一般出在内容一致性上,第三種才會出現同一頁面被收錄两次的情况,也是需要額外處理的一種。

归並的關键是 canonical 指向一致

對獨立 m 站,常见做法是两套頁面都設定 canonical,指向同一個代表版本。方向可以選 PC,也可以選移動,重点是两邊的声明不要互相打架

  • PC 頁面 canonical 指向自己,移動頁面 canonical 指向 PC 地址:這是最常见的一種组合,代表版本是 PC 地址。
  • PC 頁面 canonical 指向移動版:如果站点打算完全以移動版為准,也可以,但要保證 PC 頁面也這么声明,而不是只有移動端單方面声明。
  • 两套頁面各自 canonical 指自己,同时又互相加 alternate:這是最容易出問题的寫法,相当于告诉搜尋引擎两個都是正本。

如果站点支持 alternate 标记,例如在 PC 頁面寫 rel="alternate" 並带上 media 條件,它表達的是「這两個地址是同一頁的不同呈現」,可以和 canonical 配合使用,但两者方向必须一致。各家搜尋引擎對這類标记的支持程度不同,用之前最好先在日誌和索引里驗證實际效果。

移動版被屏蔽或内容被裁剪,是更常见的坑

有些站点出于性能或歷史原因,把 m 站寫進 robots.txt 的 Disallow 里,或者给移動頁面加了 noindex。在移動優先索引下,這等于让搜尋引擎看不到真正的移動内容,PC 版本也可能因此拿不到及时的更新索引。

另一種情况是移動版内容被大幅裁剪:正文只留前两段、结构化資料没有同步、關键内鏈被删掉。搜尋引擎评估的是移動版,看到的内容比用戶實际能获取的少,收錄结果自然會受影响。

  • 检查 m 站是否被 robots.txt 或 noindex 拦下。
  • 對比两版的正文、标题、结构化資料是否一致。
  • 確認移動版的内鏈没有大量丢失。

跳轉方式也會影响抓到的版本

用 UA 判断做 JS 跳轉,或者用 302 临时跳轉,會让蜘蛛在不同情况下看到不同结果。如果一定要跳,建议用服務端跳轉並保持規則清晰:從 PC 到移動是單向的,不要让两邊互跳,否則容易形成循环,蜘蛛最後可能只抓到一個空壳頁。

自查顺序

  1. 用移動 UA 和桌面 UA 各抓一次两個 URL,把返回的 HTML 儲存下来做對比。
  2. 检查两邊的 canonical、alternate 是否自洽。
  3. 检查 robots.txt、meta robots、X-Robots-Tag 有没有誤伤移動版。
  4. 在蜘蛛日誌里確認两個 URL 都有正常抓取记錄,狀態碼正常。
  5. 观察一段時間内的收錄结果,看是否仍然存在两份副本。
移動适配不是配置一次就完事的工作。改版、新增模板、CDN 規則變動,都可能让两邊的内容重新分叉。定期用同样的方法复查一遍,比等到索引里出現两份副本再补救要省力。