有些站点為了加载速度或歷史原因,會保留一套獨立的移動端地址,比如 m.example.com,而不是用响應式布局。這样一来,同一篇内容就有了两個 URL:电脑端一個,手机端一個。收錄层面最容易出現的問题不是收不到,而是两個地址来回争抢同一份内容的归属。
两套 URL 的常见形態
- 子域名獨立站:m.example.com 或 wap.example.com
- 獨立目錄:/m/ 或 /mobile/ 下的另一套頁面
- 精简版本:同一内容的轻量頁面或 AMP 頁
它們的共同点是正文大体相同,模板结构、模块數量可能不同,這也是後續判断的难点。
搜尋引擎按哪一版算
現在主流搜尋引擎基本以移動端版本作為主要的索引来源。也就是说,蜘蛛更可能拿手机版頁面来理解你的内容,並在结果里展示這一版,前提是這一版能被正常抓取、内容完整。
如果你把移動版做成了阉割版——标题简化、正文只留前两段、列表只给一部分——那被拿去索引的就是這份不完整的内容,桌面版寫得再全也补不回来。
需要逐項核對的地方
1. 双方的 canonical 是否自指
目前比較稳妥的做法是两邊各自自指:移動版指向移動版自己,桌面版指向自己,再通過内容等價来表明這是同一份内容。早期常见的移動版指向桌面版寫法,與移動優先索引的判断可能产生冲突,容易让信号變得模糊。如果不确定用哪種,先確認两版正文是否真的等價,再决定标注方式。
2. 内容是否一致
最容易被忽略的是那些移動端特有的删减:為了省流量把表格、參數列表、常见問题整块去掉,把長图文換成摘要。搜尋引擎看到的移動版就是它理解的頁面,缺失的部分不會自動從桌面版补回来。
3. 是否按 UA 分流
靠 User-Agent 判断设备返回不同 HTML,本身不算违規,但如果蜘蛛拿到的版本和用戶看到的差距過大,就存在内容不一致的風險。稳妥做法是让蜘蛛無论用哪種 UA 訪問,都能拿到與移動用戶一致的完整内容。
4. 内鏈指向哪一版
站内連結如果一會儿指桌面版、一會儿指移動版,URL 發現會變得分散。建议统一口径:移動版之間的内鏈指向移動版,桌面版之間指向桌面版,不要在同一套模板里混用。
出現異常时的排查顺序
- 用移動端 UA 抓取目标頁面,確認返回的是完整的移動版 HTML,而不是空壳或中途重定向。
- 對比两版正文文本,找出被删掉的模块和段落。
- 检查 canonical:是否互指、是否指向第三方、是否两邊都指向同一個地址。
- 確認移動版没有被 robots.txt 或 noindex 挡住。
- 看服務器日誌,確認移動蜘蛛抓的是哪一套地址,频次是否正常。
更省事的方案
如果條件允许,用响應式布局只保留一套 URL,能省掉上面大部分比對工作。已经存在獨立移動站、又短期無法改造的,至少先保證三件事:两版内容等價、canonical 不自相矛盾、移動版可被正常抓取。
判断标准很简單:把移動版 HTML 里的正文和導航單獨抽出来看,如果它已经能完整表達這篇内容,归属問题通常不會太大;如果抽掉一半只剩标题和图片,那被索引的自然也是這一半。
收錄归属這類問题很少一次解决,更多是随着模板改版反复复查。建议把两版内容是否等價纳入每次上线的检查項,比事後翻日誌追查要省力得多。