结构化数据解决的是一个很具体的问题:页面上写着「深圳市大乐网络科技有限公司,电话 17722562362」,人一眼就知道哪个是公司名、哪个是电话;机器需要你把这层语义显式标出来。

一、Organization:先把「你是谁」说清楚

这是优先级最高的一块,因为它回答的是模型最基础的问题 —— 这个名字对应的是哪一个真实存在的实体。

必填的几项:`name`(品牌名)、`legalName`(法人主体全称)、`url`、`logo`、`telephone`、`address`。

有两点值得强调:

  • 法人主体要写全称,因为它可以在工商系统里核对。只写品牌名,模型无法把你和一个可核查的登记主体对应起来。
  • `sameAs` 只放真实存在的官方主页。 编一个不存在的地址比不写更糟:模型顺着链接抓不到东西,整组实体信息的可信度都会被拖低。

二、FAQPage:被整段引用概率最高的形态

生成式引擎在组织答案时,最省力的素材就是「一个问题 + 一个完整答案」。FAQ 结构化数据正好是这个形状。

配置时注意:

  • 答案要能独立成立。「详见上文」「请咨询客服」这种答案,标了也不会被用。
  • 问题用用户的原话,不要写成内部术语。「多久见效」比「服务周期说明」有用得多。
  • 页面上必须真的有这段问答。标记和可见内容对不上,属于明确违规。

三、Article:给内容加上时间与作者

文章页配 `Article`,把 `datePublished`、`dateModified`、`author`、`publisher` 填上。

`dateModified` 值得单独说:老文章更新之后,这个字段是告诉搜索引擎与 AI 引擎「该重抓了」的主要信号。很多站点所有页面都写同一个构建时间,等于把这个信号作废 —— 真正更新过的页面反而失去了优先级。

作者尽量挂真人。可核验的 `Person` 比一个机构名更能支撑内容的可信度。

四、BreadcrumbList 与页面关系

面包屑标记成本极低,作用是让模型知道这一页在站点结构中的位置 —— 一篇讲「FAQ 怎么写」的文章,挂在「博客 / 技术百科」下面和孤零零一页,含义是不一样的。

五、最容易出错的三个地方

  1. 标记和页面内容不一致。 页面上没有的评分、没有的价格、没有的问答,都不要标。
  2. 实体信息跨页打架。 首页写「成立于 2014 年」,关于页写「深耕行业十余年」,词条上又是另一个年份 —— 模型会因此降低对整个实体的确信度。
  3. 只在首页配。 结构化数据是按页生效的,文章页、服务页各自都要有。

怎么验证

配完不要凭感觉。用公开的结构化数据检测工具跑一遍,确认解析出来的字段和你想表达的一致;再把页面的实体信息和工商登记、备案信息核对一次。

这一块的投入产出在所有 GEO 动作里是最高的:一次性配置,长期生效,而且是模型能直接读到的、最没有歧义的一层信息。