站内链接是蜘蛛发现新 URL 最常用的通道。给链接加上 rel="nofollow" 之后,这条通道还算不算数,是很多站长在做内链时反复纠结的问题。要回答它,需要把“发现 URL”和“传递信号”两件事分开看。
一、nofollow 阻止的是哪一步
早期搜索引擎把 nofollow 当作硬性指令:看到这个属性的链接,就不再顺着它去抓取目标地址。后来主流引擎陆续修改了处理方式,把它降级为“提示”(hint),即不再绝对保证不抓取、也不绝对保证不传递信号,具体怎么处理由引擎自己判断。
这意味着一个现实:加了 nofollow 的链接,目标 URL 仍然有可能被发现和抓取,只是概率和优先级通常低于普通链接。把 nofollow 当成“彻底断掉这条发现通道”的开关,容易做出错误判断。
二、站内链接上的 nofollow 要慎用
- 导航、面包屑、正文里的编辑链接,一般不加 nofollow,它们是蜘蛛理解站点结构的主干。
- 确实不想被跟进的内容,比如登录后页面、临时活动页,优先用 robots.txt 的 Disallow 或 noindex 处理,而不是靠 nofollow。
- 不要把 nofollow 当成控制抓取预算的工具。真正吃预算的是大量低价值 URL 被反复抓取,需要从站点结构上减少,而不是逐个链接加属性。
三、ugc 与 sponsored:语义更明确的两种属性
rel="ugc" 用于用户生成内容里的链接,比如评论区、论坛帖子;rel="sponsored" 用于付费或广告性质的链接。它们和 nofollow 一样,属于对链接性质的标注,而不是对目标 URL 的封杀。用户评论里的外链被标注之后,通常不会给站点带来额外风险,但也不会有正向帮助。
需要提醒的是,不同搜索引擎对这三个属性的处理细节并不一致,也不公开完整规则。因此不要把某一条经验当成通用结论,尤其是在做大规模内链调整之前。
四、真正决定 URL 能否被发现的,是这几件事
- 链接是否出现在 HTML 里,而不是只存在于 JS 点击事件中。
- 页面本身是否可以被抓取,robots.txt 是否放行。
- 链接所在的页面是否被抓取过,以及抓取频率如何。
- Sitemap 是否覆盖了这批 URL,作为爬行之外的补充申报通道。
- 服务器是否稳定响应,抓取时不会超时或返回异常状态码。
一句话:nofollow 影响的是蜘蛛愿不愿意顺着这条链接走,而不是目标 URL 存不存在、能不能被抓。
五、实操建议
如果你的目的是让重要页面尽快被发现,把 nofollow 从站内链接上拿掉,让链接以普通形式存在,通常更稳妥。如果目的只是标注链接性质(广告、用户投稿),保留 sponsored 或 ugc 即可,不必再额外叠加 nofollow。
同时检查两件事:一是新页面有没有至少一条来自已抓取页面的普通链接;二是这些 URL 是否已经进入 Sitemap。两条通道都覆盖,URL 被发现的速度和稳定性通常比只靠其中一条更好。
最后,别把链接属性的调整当成一次性动作。站点结构调整、模板改版、评论区开放或关闭,都会改变链接的形态,建议定期抽查关键页面的 HTML 源码,确认链接是否按预期输出。