基线是什么
基线是在作出任何改动之前完成的一次完整测量:将一组客户真实会问的固定问题,在其使用的平台上执行一轮,并原样记录测量结果。
缺少基线,后续任何关于提升的说法均无法核对。这不是流程形式问题:它是 GEO 项目最终产生争议的最常见原因。
第一步:建问题集
三个来源,按有用程度排序:
- 销售与客服的对话记录。客户的原始表述即存在于其中,这是最佳来源。
- AI 助手本身。提出一个宽泛问题,观察其答案中引出了哪些后续问题。
- 竞品内容。竞品正在解释的内容,通常即为客户正在提出的问题。
目标数量为 15 至 30 条,覆盖认知、对比、决策三类意图。须写成问题而非关键词,因为模型匹配的对象是问题。原因见语义词体系构建指南。
第二步:冻结
将清单连同标点一并写定,并与用于内容规划的词表分开存放。词表可以扩展,用于测量的清单不得修改。
在两轮之间更换问题集,是 GEO 汇报失去意义的最常见原因,且多数情况下属于无意为之。
第三步:统一执行条件
- 联网与非联网结果分别记录,不作平均。
- 账号状态保持一致:统一登录或统一不登录。
- 单轮测量集中在一至两天内完成,不应延续数周。
- 每题在每个平台至少测量三次,并记录出现比例。生成式答案存在波动,仅测量一次不构成有效测量。
第四步:仅记录四个字段
每个「问题 × 平台」组合记:
- 是否被点名
- 点名语境:正面、中性、负面
- 同一条答案里出现的其他品牌
- 答案引用的来源域名
字段数量再增加,执行到第三轮时便会走样。以上四项足以支撑所有值得作出的结论。
第五步:计算三项指标
- 被点名率:出现次数除以组合总数。
- 声量份额:本品牌提及次数除以全部品牌的提及总次数,可排除品类整体波动的影响。
- 来源覆盖率:被引用域名中属于本品牌的比例。该指标通常早于被点名率发生变化,是有效的先行信号。
须按平台分别报告。将各家平台取平均,会掩盖具体是哪一环节产生了作用。
两条容易被突破的规则
负面提及不计为有效结果。被描述为低价选项,或与投诉一同被提及的情形,必须单独计数,否则会出现汇总数据上升而商业效果下降的情况。
对称计数。对竞品与自身采用同一套匹配规则,并排除提示词中已包含自家名称的问题:此类问题不构成竞争。