结构化数据解决的是一个很具体的问题:页面上写着「深圳市大乐网络科技有限公司,电话 17722562362」,人一眼就知道哪个是公司名、哪个是电话;机器需要你把这层语义显式标出来。
一、Organization:先把「你是谁」说清楚
这是优先级最高的一块,因为它回答的是模型最基础的问题 —— 这个名字对应的是哪一个真实存在的实体。
必填的几项:`name`(品牌名)、`legalName`(法人主体全称)、`url`、`logo`、`telephone`、`address`。
有两点值得强调:
- 法人主体要写全称,因为它可以在工商系统里核对。只写品牌名,模型无法把你和一个可核查的登记主体对应起来。
- `sameAs` 只放真实存在的官方主页。 编一个不存在的地址比不写更糟:模型顺着链接抓不到东西,整组实体信息的可信度都会被拖低。
二、FAQPage:被整段引用概率最高的形态
生成式引擎在组织答案时,最省力的素材就是「一个问题 + 一个完整答案」。FAQ 结构化数据正好是这个形状。
配置时注意:
- 答案要能独立成立。「详见上文」「请咨询客服」这种答案,标了也不会被用。
- 问题用用户的原话,不要写成内部术语。「多久见效」比「服务周期说明」有用得多。
- 页面上必须真的有这段问答。标记和可见内容对不上,属于明确违规。
三、Article:给内容加上时间与作者
文章页配 `Article`,把 `datePublished`、`dateModified`、`author`、`publisher` 填上。
`dateModified` 值得单独说:老文章更新之后,这个字段是告诉搜索引擎与 AI 引擎「该重抓了」的主要信号。很多站点所有页面都写同一个构建时间,等于把这个信号作废 —— 真正更新过的页面反而失去了优先级。
作者尽量挂真人。可核验的 `Person` 比一个机构名更能支撑内容的可信度。
四、BreadcrumbList 与页面关系
面包屑标记成本极低,作用是让模型知道这一页在站点结构中的位置 —— 一篇讲「FAQ 怎么写」的文章,挂在「博客 / 技术百科」下面和孤零零一页,含义是不一样的。
五、最容易出错的三个地方
- 标记和页面内容不一致。 页面上没有的评分、没有的价格、没有的问答,都不要标。
- 实体信息跨页打架。 首页写「成立于 2014 年」,关于页写「深耕行业十余年」,词条上又是另一个年份 —— 模型会因此降低对整个实体的确信度。
- 只在首页配。 结构化数据是按页生效的,文章页、服务页各自都要有。
怎么验证
配完不要凭感觉。用公开的结构化数据检测工具跑一遍,确认解析出来的字段和你想表达的一致;再把页面的实体信息和工商登记、备案信息核对一次。
这一块的投入产出在所有 GEO 动作里是最高的:一次性配置,长期生效,而且是模型能直接读到的、最没有歧义的一层信息。