站点运营

站点运营:分页与翻页导航自查,别让深页内容只靠翻页被发现

列表页是站点里数量最多、却最容易被忽略的一类页面。分页地址写法、翻页链接的可点击性、分页页面的标题与 canonical 设置、深分页带来的抓取消耗,都会影响内容能否被正常访问和发现。这篇文章整理了一份分页自查思路,帮你把列表深处的页面重新拉回视野。

站点运营

站点运营:分页与翻页导航自查,别让深页内容只靠翻页被发现

列表页往往是站点里数量最多的一类页面,但它通常被当成“能翻就行”。等到栏目里的内容越堆越多,才发现翻页地址五花八门、深页内容长期没人访问,甚至连自己都很难找到第五页之后写了什么。分页本身不是大问题,问题是没人定期去看它现在的样子。

先看分页地址长什么样

把主要栏目的第二页、第三页地址复制出来,对照下面几种常见写法:

  • 路径式:… 例如 /category/page/2/,结构清晰,便于判断层级。
  • 参数式:例如 /category/?page=2,实现简单,但参数顺序、大小写不一致时容易产生多个地址。
  • 锚点式:例如 /category/#page2,地址变了,页面内容却没变,实际只是前端滚动位置不同。
  • 纯前端加载:点击“加载更多”后 URL 完全不变,内容靠脚本追加。

同一站内最好只保留一种分页写法,混合使用会让地址数量成倍增加,也让后续的规范链接设置变得麻烦。

翻页链接要真的能被点到

分页导航里的“下一页”“2、3、4”应该使用带 href 的链接,而不是绑定点击事件的按钮或 span。判断方法很简单:在浏览器里禁用 JavaScript 后刷新页面,如果翻页控件还在、点击后地址仍然会变化,那基本是可抓取的;如果整块导航消失或点了没反应,说明它只服务于浏览器环境。

另外注意两点:不要在分页导航上加 nofollow,也不要在 robots 规则里把分页路径整段屏蔽。分页页面通常承担着把新内容串起来的角色,挡住它,等于让列表深处的页面少了一条被发现的路径。

分页页面的标题与描述

第二页往后的标题如果和第一页完全一样,多页内容在搜索结果里就容易看起来像同一篇。可以给分页页面的标题加上页码或区间提示,但不必堆砌关键词,写成人能看懂的顺序就好。描述标签同理,与其复制第一页的文案,不如让它保持简短、与当前页内容大致对应。

canonical 和翻页指令怎么处理

分页页面建议把 canonical 指向它自己,而不是统一指向第一页。把所有分页都指向列表首页,会让这些页面失去被单独索引的可能,列表深处的内容也更难被找到。

至于早年常见的 rel=prev / rel=next,主流搜索引擎已经不再把它们当作索引信号使用,保留不影响解析,但不必再指望它们承担什么作用。真正需要确认的还是:链接是否可点、地址是否稳定、canonical 是否指向自身。

深分页、加载更多与查看全部

页数越多,越靠后的页面被访问到的机会越小,抓取时也更容易把资源花在重复的列表结构上。几种常见做法各有取舍:

  • 每页条数:太少会让页数迅速膨胀,太多会让单页体积变大。可以观察实际停留和点击情况再定。
  • 加载更多 / 无限滚动:对搜索引擎的渲染依赖更高,最好同时保留一套可点击的分页地址作为兜底。
  • 查看全部页:方便访客一次看完,但它与分页页面的内容高度重叠,需要留意重复关系,不必每个栏目都开。

如果某个栏目长期只有个位数的内容,却还保留着分页结构,也可以考虑合并或调整展示方式,减少无意义的空页。

一份可以照着做的自查清单

  1. 随机打开三个栏目,把第二页、最后一页的地址复制出来,确认写法是否统一。
  2. 禁用 JavaScript,检查翻页控件是否仍然可用。
  3. 查看分页页面的 title 和 description,确认不是逐字复制第一页。
  4. 检查分页页面的 canonical,确认指向自身而非列表首页。
  5. 确认分页路径没有被 robots 规则或 nofollow 整体屏蔽。
  6. 翻到列表最深处,看看那里的内容是否还有正常入口。
  7. 在服务器日志或抓取记录里,观察分页地址的访问分布是否长期只集中在前两页。
分页是站点的骨架,不是装饰。它不需要多花哨,只需要地址稳定、链接可点、每页都能被正常打开——做到这几点,列表深处的内容才不至于只剩翻页这一条路。