網站收錄

同一站点有多個域名能打開:收錄归並前先定規范域

有些站点用 www、不带 www、舊域名或临时域名都能打開同一套内容,時間一長,這些地址可能各自進入索引,權重和流量也被拆開。本文按確認規范域、统一跳轉、清理入口、核對索引的顺序,整理一套可执行的核對流程,帮你把分散的收錄逐步收敛到主域名上。

網站收錄

同一站点有多個域名能打開:收錄归並前先定規范域

很多站点在早期為了省事,會让 www 域名、不带 www 的裸域、甚至一個舊域名都指向同一套内容,訪問哪個都能打開。短期看不出問题,時間一長却發現:搜尋结果里同一篇内容出現好几個地址,外鏈分散在多個域名上,收錄資料也分成了几份。要處理這類問题,核心不是删掉重复頁面,而是先把唯一規范域确定下来,再让其他入口逐步归並過去。

為什么會出現一套内容多個地址

同一個站点能被多個地址訪問,通常来自几類配置:

  • www 與裸域同时解析,且都能直接打開;
  • 早期使用過的舊域名没有做跳轉,仍然可訪問;
  • 測試域名、预览地址在上线後没有收口;
  • CDN 或對象存储分配的域名被直接引用;
  • http 與 https、大小寫、结尾斜杠等寫法差异。

這些地址本身不是错誤頁面,它們返回 200、内容完整,被抓取和收錄都属正常。真正的問题是同一份内容被拆成多個候選 URL,權重和点击被分散。

第一步:确定唯一規范域

規范域的選擇通常看三個因素:品牌主域是否清晰、歷史上积累外鏈最多的那個地址、以及是否長期稳定。确定之後尽量不要频繁更換,否則每次切換都會带来一轮索引波動。

判断方法不复杂:查一下各域名被引用的連結數量,再结合自己的推廣记錄,基本能看出哪個地址最值得保留。

第二步:让非規范域返回 301

确定規范域之後,其他域名應当全部 301 跳轉到規范域,而且要做到路径級別的對應,而不是把整站都跳到首頁。

跳轉细节容易被忽略

  • 舊地址的路径要一一對應,例如舊域名下的栏目頁應跳到新域名同名栏目頁,而不是统一跳首頁;
  • 優先使用 301,避免長期用 302、307 代替;
  • 跳轉鏈尽量压到一跳,不要让 301 再指向另一個 301;
  • 带參數的地址也要有對應規則,否則參數頁會繼續以舊域名被抓取。

第三步:清理站内與站外的入口

跳轉只是兜底,真正决定長期收錄的是入口。站内需要统一的部分包括:

  • 導航、面包屑、正文内鏈是否都指向規范域;
  • 頁面的 canonical 标簽是否與規范域一致;
  • sitemap 里是否還残留舊域名的地址;
  • 图片、脚本、样式等资源引用是否仍在用舊域名或 CDN 域名。

站外連結無法直接修改,但只要有 301 在,連結價值仍會传递到規范域,不需要逐條联系對方更換。

第四步:核對索引狀態,给足時間

完成跳轉和入口清理後,可以通過站内查询、索引报告和服務器日誌三個口径观察變化:舊域名的抓取是否在减少,規范域的收錄是否在增加。索引更新本身有滞後,短期内舊地址仍可能出現在结果里,用它判断趋势即可,不要因為一次查询没變化就反复調整配置。

多域名归並是收敛過程,不是開關。配置改對之後,剩下的主要是等待重新抓取和重新計算,中間出現反复属于常见現象。

几處容易漏掉的入口

  • IP 直接訪問:服務器 IP 能直接打開站点时,也可能被当作一個地址;
  • 协议差异:http 與 https 同时可用,需要统一到其中一個;
  • CDN 域名:资源域名若被当成頁面入口,容易产生額外抓取;
  • 大小寫與结尾斜杠:服務器未做统一时,會形成多個等價地址。

一份可执行的核對清單

  1. 列出目前所有能打開站点内容的域名與协议;
  2. 統計各地址的外部引用情况,确定唯一規范域;
  3. 為非規范域配置路径級 301,並压到一跳;
  4. 统一站内連結、canonical 與 sitemap;
  5. 检查资源引用以及 IP、CDN 等旁路入口;
  6. 用查询、索引报告、日誌三個口径观察一至數周;
  7. 確認收敛趋势後,再處理下一批低價值入口。

多域名带来的收錄分散,本质上是入口没有收口。先把規范域定下来,再让跳轉和入口逐步统一,收錄資料才會慢慢合到一起。過程中不必追求一步到位,按顺序核對、观察趋势,比频繁改配置更稳妥。