不少人把结构化数据当成一个开关:加上标记,就等着富摘要出现。实际上它更像一份写给搜索引擎的说明——页面上有什么,标记里就写什么。说明写错、写多、写得和页面内容对不上,麻烦往往比收益先到。
一、标记必须和用户看到的内容对齐
搜索引擎的底线是“标记与可见内容一致”。很多问题不是标签写错,而是页面改了、标记没跟着改:
- 评分和评论数写死在模板里,页面上其实并没有评论区;
- 价格、库存状态随时间变化,标记还停留在上架当天;
- 标记里的作者是运营账号,页面上显示的是另一位作者;
- 发布日期用脚本取当前时间,每次抓取都变成“今天发布”。
这类不一致一旦被确认,轻则该条标记失去效果,重则整站相关类型的标记都不被采信。
二、先做哪几种类型
不必一次性把能想到的类型都铺满。按页面实际形态,从下面几类开始通常更稳:
- 文章类:Article 或 BlogPosting,写清标题、作者、发布时间与修改时间;
- 面包屑:BreadcrumbList,和页面上的导航路径保持一致;
- 站点与主体:Organization、WebSite,放在首页,描述站点本身;
- 业务类:Product、FAQ、HowTo 等,只在确实存在对应内容的页面上用。
类型不是越多越好。一个页面同时声明互相矛盾的多种类型,反而让判断变得困难。
三、模板批量生成时的自查项
- 抽查十个不同类型的页面,把 JSON-LD 复制出来,逐字对照页面可见文字;
- 检查由程序自动填充的字段,尤其是日期、作者、分类、图片地址;
- 确认标记里的图片、链接都是可访问的真实地址,不是占位图或空字符串;
- 翻一遍历史内容,看有没有早年遗留的旧版本标记还留在页面上;
- 同一页面只保留一套主要标记,删掉已经废弃的重复块。
四、几个常见的坑
第一是“给蜘蛛看、不给用户看”。页面上没有的评分、奖项、认证,只写在标记里,这种做法一旦被识别,处理结果通常不理想。第二是日期自动更新,把老文章伪装成新发布,短期看似活跃,长期会让时间信息失去参考价值。第三是改版时只迁移了页面,忘了把标记模板一起更新,新页面带着老结构上线。第四是把结构化数据当成收录手段,它并不解决内容本身是否有价值的问题。
标记是说明,不是承诺。它把页面信息说清楚,剩下的事交给内容质量。
五、上线后怎么维护
发布前用官方提供的结构化数据测试工具跑一遍,看有没有报错和警告;上线后在站长平台关注对应报告,看哪些页面被识别、哪些被忽略。每次改版、换模板、调整作者体系之后,重新抽查一轮。频率不用很高,但要固定进流程,而不是等反馈出现才回头找。
把结构化数据当成页面的一部分来维护,和标题、正文、内链是一个道理:内容变了,说明也要跟着变。