经常有人問:一個頁面寫多少字才够?搜尋引擎没有公開過最低字數,也不會因為“只有 200 字”就拒绝收錄。真正影响收錄的,是這個頁面相對于用戶和搜尋结果而言,提供了多少別處没有的信息。
“薄”不是按字數算的
同样是 300 字,一段产品參數表可能比一篇凑出来的“介绍”更有價值。判断頁面是否偏薄,可以看几個更實际的维度:
- 拿掉導航、頁脚、免责声明這些全站共有的部分之後,頁面獨有的内容還剩多少;
- 這個頁面回答的問题,是否已经在站内另一個頁面上完整回答過;
- 用戶搜到它之後,是否還需要再点開別的頁面才能得到答案。
如果三條都不太乐观,那么這個頁面在抓取和索引环节被排在後面的概率就比較高。注意,這不是惩罚,而是同類候選太多时,系統會優先處理信息更完整的那些。
收錄上常见的几種表現
- 已抓取但未编入索引:抓取本身没問题,但在索引阶段被判定為價值不足或與其他頁面重复。
- 收錄後偶尔消失:頁面本身没坏,但站内同類頁面太多,索引狀態在波動中反复。
- 抓取频率很低:大量薄頁面占用了抓取预算,真正重要的頁面反而更新得更慢。
這几種情况往往不是單個頁面造成的,而是“一批相似頁面”共同作用的结果。
三種處理方向
1. 补齐:把獨有的信息加進去
适合本身有真實需求、只是目前寫得敷衍的頁面。重点不是加字數,而是补上別處没有的東西:具体資料、适用條件、常见問题、真實示例。如果补完之後和其他頁面仍然高度相似,說明問题不在長度。
2. 合並:把几個薄頁面並成一個厚頁面
站内经常出現“一個型号一頁、每個只有两行參數”的情况。這類頁面單獨看信息量都不够,合並成一個對比頁或匯總頁,通常比强行维護几十個薄頁面更合适。合並後记得给舊 URL 做跳轉,並把内鏈指向新頁面。
3. 明确不收錄:用 noindex 而不是靠 robots.txt
有些頁面确實有用,但不需要出現在搜尋结果里,比如内部查询结果頁、感谢頁、測試頁。這類頁面用 noindex 更合适,因為 robots.txt 只是禁止抓取,被禁止抓取的頁面反而無法讀取 noindex,仍可能以舊信息或纯連結形式留在索引里。
處理薄内容的顺序建议是:先判断有没有真實需求,再决定补齐還是合並,最後才考虑不收錄。直接一批批地 noindex,容易把本来有机會做起来的頁面也一起否掉。
一個简單的自查顺序
- 從索引覆盖率报告里筛出“已抓取但未编入索引”的 URL,按目錄归類。
- 看同一目錄下有多少個结构相似的頁面,判断是否属于批量生成。
- 抽查几個頁面,去掉全站模板後還剩多少獨有内容。
- 對每個目錄确定一個方向:补齐、合並,還是 noindex。
- 改完之後观察一批頁面的狀態變化,而不是盯着單個 URL 的即时结果。
收錄數量本身不是目标。索引里多一個没有信息量的頁面,不會带来額外收益,反而會分散抓取和评估的注意力。把頁面质量的底线抬上去,收錄表現通常會更稳定。