结构化資料(Schema.org、JSON-LD 等)的作用,是让搜尋蜘蛛在抓取頁面时多一份“說明书”。它不直接决定排名,但如果标记寫错、字段缺失或與頁面内容不一致,反而可能让搜尋引擎對頁面主题产生誤判。栏目改版、模板調整、批量發布之後,花十几分钟做一次结构化資料自查,比事後從日誌里找異常更省事。
先確認哪些頁面真的需要标记
並不是每個頁面都必须加结构化資料。優先處理以下几類:
- 文章詳情頁:Article 或 NewsArticle,标记标题、作者、發布時間、更新時間。
- 栏目列表頁:BreadcrumbList,帮助蜘蛛理解层級關系。
- 产品頁或服務頁:Product、Service,但字段要與頁面可见内容一致。
- 组织信息頁:Organization,用于說明站点主体。
如果頁面本身内容很薄,硬加一堆标记並不會让它變得更有價值。标记應该跟着内容走,而不是反過来。
常见的标记错誤
1. 语法错誤導致整段失效
JSON-LD 的逗号、引号、括号不匹配,會让整段标记無法解析。最稳妥的方式是用官方校驗工具跑一遍,或者至少用 JSON 格式化工具检查语法。模板拼接时尤其容易出現尾随逗号。
2. 必填字段缺失
比如 Article 缺少 headline 或 datePublished,BreadcrumbList 的 itemListElement 里缺 position 或 name。字段缺失不一定报错,但可能让标记無法生效。
3. 标记與頁面内容不一致
頁面上寫的是“2024 年更新”,标记里寫的是 2023 年;頁面标题是 A,标记 headline 是 B。這種不一致會削弱标记的可信度。批量更新内容後,记得同步更新结构化資料。
4. 面包屑层級與真實 URL 结构不符
面包屑标记應当反映頁面的實际归属。如果栏目已经調整,但面包屑還指向舊路径,蜘蛛顺着标记走可能會遇到重定向或 404。
5. 重复标记
同一頁面出現多段相同類型的 JSON-LD,比如模板和插件各輸出一次 Article。重复不一定被惩罚,但會增加解析负担,也容易产生字段冲突。建议合並成一段。
自查步骤
- 打開頁面源代碼,搜尋 application/ld+json,確認标记數量與類型。
- 複製 JSON-LD 内容到格式化工具,检查语法是否完整。
- 對照頁面可见内容,核對标题、時間、作者、面包屑路径。
- 用搜尋引擎官方的富媒体測試工具或校驗工具跑一遍,看是否有错誤或警告。
- 抽查栏目頁、詳情頁、聚合頁各两到三個,確認模板輸出一致。
- 在搜尋结果中观察富摘要展示情况,但不要因為一两天没變化就频繁改動。
修复时的几個原則
先修错誤,再补字段。语法错誤和必填字段缺失優先處理,扩展字段可以逐步完善。
與頁面内容保持同步。内容更新时,把结构化資料当成模板的一部分一起检查。可以让編輯流程里加一條“更新标记時間”的提醒。
不要為了富摘要硬凑内容。比如頁面没有评分,就不要加 aggregateRating。虚假标记一旦被识別,影响的是整個站点的信任度。
结构化資料是辅助理解,不是排名開關。它的價值在于让搜尋蜘蛛更快、更准地讀懂頁面,而不是制造頁面本身没有的信息。
和蜘蛛池、URL 發現的關系
蜘蛛池或 URL 發現工具的作用是让新頁面更快被蜘蛛知道,但蜘蛛来了之後,能不能正确理解頁面,取决于頁面自身的结构。结构化資料、面包屑、内鏈、标题描述,這些基础信息越清楚,蜘蛛對頁面的判断就越稳定。反過来,如果标记混乱,即使 URL 被频繁抓取,也可能只是反复消耗抓取预算。
建议把结构化資料自查放進站点运营的例行清單:栏目改版後查一次,模板調整後查一次,批量内容更新後抽查一次。不需要每天做,但不要在出了明顯異常後才回头翻代碼。