站点运营

站点运营:分页与列表页翻页,别让蜘蛛在翻页里绕圈

列表页翻页看似只是加个页码,实际会影响用户路径和蜘蛛抓取。本文梳理参数分页、路径分页、滚动加载三种形态的常见问题,从链接可用性、地址收敛、canonical 用法到列表页内容质量,给出一份可执行的自查清单,帮运营把分页这件事想清楚。

站点运营

站点运营:分页与列表页翻页,别让蜘蛛在翻页里绕圈

列表页和分页是内容站很常见的结构:一个栏目下内容多了,自然要翻页。但翻页一旦设计得随意,很容易出现两个问题——用户点不到想看的,蜘蛛在一个个翻页地址里绕圈,抓取配额被大量低价值页面消耗掉。

先弄清楚你的分页是哪一种

常见分页大致有三类,处理思路并不相同:

  • 带参数的分页,例如 list?page=2。实现简单,但要留意参数处理,别让同一页出现多个地址变体。
  • 路径式分页,例如 /list/page/2/。地址更像静态页面,便于识别,需要保证每个分页地址都能正常访问,而不是只有第一页能打开。
  • 点击加载与无限滚动。用户滚动时自动追加内容,地址栏不变。这类页面里,后面的内容往往只有一个入口,蜘蛛不一定能发现。

翻页链接要能被正常点击和跟随

不少人用 JavaScript 绑定点击事件来做翻页,页面上没有真正的 a 标签。用户能点,但蜘蛛拿不到指向下一页的链接。更稳妥的做法是保留可点击的 a 标签,href 指向真实地址,需要时再用脚本做体验增强。

同时检查翻页链接的完整性:首页、上一页、下一页、末页是否都在;当前页是否为不可点击的纯文本;首尾页的链接是否写成了空地址。这些细节看似琐碎,却决定了蜘蛛能不能顺着列表继续走。

分页地址的重复与自我竞争

排序方式、每页显示条数、来源追踪参数,都可能在分页地址上叠加,形成类似 page=2 加 sort、加 from 的组合。同一批内容裂成多个地址,既浪费抓取,也让权重分散。建议对这类参数做统一收敛:排序、视图等非内容参数尽量用固定规则处理,必要时借助 robots 或 canonical 指回规范地址。

canonical 在分页上的用法要谨慎:不要把第 2 页、第 3 页都指向第 1 页。分页之间内容不同,属于各自独立的页面,互相指认反而会让搜索引擎难以判断该展示哪一页。

查看全部和无限滚动怎么取舍

如果某一类列表内容总量不大,用“查看全部”一次性展开更省事,用户也少点几次。但如果一个列表有几百条内容,全部展开会让单页变得很长、加载变慢,反而不利于阅读。此时保留分页、每页控制在合理条数,或者按时间、分类做归档页,通常更均衡。

无限滚动适合浏览型场景,但要给它留好后路:提供一个可访问的下一页地址,或者分页归档入口,让没有脚本执行能力的访问者也能拿到后续内容。否则一旦脚本不执行,后面的内容就消失了。

分页自查清单

  1. 翻页链接是真实的 a 标签,href 可访问,不是空地址或脚本伪链接。
  2. 每个分页地址能独立打开,不依赖前一页的会话状态或临时缓存。
  3. 列表每一条都有标题和可进入的入口,而不是只堆一串图片或空占位。
  4. 分页参数不叠加排序、来源等无关变量,或已有明确的收敛规则。
  5. 不要把第 2 页以后 canonical 到第 1 页。
  6. 改版后旧的分页地址仍可访问,或跳转到对应的归档位置。

列表页本身也要有内容感

列表页承担的是“找到入口”的职责,但页面上只有标题串、没有任何摘要和栏目说明时,它和一页链接堆的差别并不大。适当加上栏目说明、时间、摘要或缩略图,既方便用户判断是否值得点,也让页面本身有一点可读的内容。注意别为了填充而重复堆砌同一段话,模板文字在几十个分页上反复出现,实际作用很有限。

分页不是把内容切成很多块就完事。想清楚每一页为什么存在、用户和蜘蛛分别怎么走到它,很多问题会在上线前就暴露出来。