结构化資料(Schema 标记、JSON-LD 等)在很多站点里属于“上线时加過一次,之後没人再管”的東西。它不影响頁面能不能被打開,但影响机器能否准确理解這個頁面讲的是什么、属于哪一類内容。当頁面改版、栏目調整、模板替換之後,残留的舊标记就可能和實际内容對不上。這類問题不报错、不白屏,只在内容理解和富媒体结果上慢慢体現出来,所以值得定期自查。
先明确一点:标记是描述,不是装饰
标记的作用是把你頁面上已经存在的信息,用统一的方式复述一遍。它不能凭空创造内容,也不该出現頁面上看不到的信息。判断一處标记是否合格,最简單的标准就是:如果一個完全不了解你站点的人只看标记,他得到的理解是否和真實頁面一致。凡是两者對不上的地方,都是隐患。
第一步:盘点頁面上到底存在哪些标记
很多人以為站点只有一套标记,實际情况往往是同时存在三四個来源:
- 模板里寫死的全局标记,例如站点名、组织信息、站内搜尋框;
- 各類頁面模板自動輸出的标记,例如文章、商品、問答、视频;
- CMS 或插件自動生成、並在後台悄悄更新的标记;
- 运营人員手工粘贴進正文区块的标记。
先把它們逐個列出来,标注来源和负责的模板,再判断有没有重复、有没有互相矛盾。這一步做完,後面的排查會快很多。
常见错誤逐條核對
语法层面:能不能被正常解析
JSON-LD 是最省事的形式,也最容易因為一個多余逗号、一個中文引号、一段被轉义的正文而整体失效。检查方法很朴素:把頁面源代碼里的 JSON-LD 複製出来,放進校驗工具或本地解析器跑一遍。只要有一處解析失敗,整块标记通常都會被忽略,而且不會有任何提示。
字段與實际内容不一致
- 标题、作者、發布時間、更新時間與頁面可见文字不一致;
- 把列表頁、聚合頁标记成單篇内容或單一商品;
- 评分、價格、库存、活動時間等字段長期没有更新;
- 面包屑标记里的层級和頁面實际的導航路径不符。
其中“時間字段”最容易出問题:編輯改稿後只改了正文,标记里的更新時間還停在几年前的日期。
關键属性缺失
每種類型都有必须提供的属性,缺一項就可能整條都用不上。與其追求覆盖類型多,不如先把和站点内容最匹配的两三種做完整、做准确。字段越少越准确,反而比堆一堆半成品更可靠。
重复與冲突
同一頁面出現两段同類标记——比如插件輸出一份、模板又輸出一份,机器無法判断该信任哪個。原則是:同一實体只保留一份,来源唯一。發現重复时,先確認哪一份和頁面内容更贴合,再關掉另一份的生成逻辑,而不是两邊都留着。
一份可以照着走的自查流程
- 整理全站頁面模板清單,标注每個模板會輸出哪些标记;
- 從每個模板各挑一個有代表性的 URL,抓取完整源代碼;
- 用校驗工具跑一遍,记錄错誤與警告,区分“必须修”和“可選修”;
- 對照頁面可见内容逐字段核對,重点看标题、作者、時間、分類;
- 確認同一頁面没有重复的同類标记;
- 改版、換模板、調整栏目之後,重新跑一遍;
- 把结论记進运营文档,下次直接复用,不必從头猜。
改版與迁移时最容易出事
模板替換後忘记迁移标记、栏目改名但面包屑還指向舊路径、文章批量改标题而标记里的标题字段没同步,這些都是高频情况。建议在改版清單里固定留一行“结构化資料回归检查”,和重定向检查、内鏈检查放在同一個环节做,避免上线後才發現問题却没人负责。
不要把标记当成捷径
结构化資料的作用是帮助理解,不是获得展示的保證。内容本身不完整、頁面打不開、信息前後矛盾时,再規范的标记也救不回来。把它当作内容质量的一部分来長期维護,而不是一次性的上线條目。
标记寫對不會让頁面自動變好,但寫错一定让机器更难理解你的頁面。
最後提醒一点:不必追求把每種類型都加上。選和站点内容真正匹配的两三種,做准确、保持更新,比满頁面塞标记更稳妥。每季度抽半小时,按模板抓几個頁面跑一遍校驗,成本很低,能避免不少長期积累的偏差。