官网新增了六个平台页,分别说明 DeepSeek、豆包、文心一言、通义千问、腾讯元宝、Kimi 在生成答案时的取材方式差异,以及针对各家可以做什么。

为什么要分开写

把主流 AI 平台当成一个整体来谈,会掩盖掉真正影响决策的差别。

实际工作中需要分辨的有三点。这次回答有没有联网检索。答案里是否标注来源。以及答案长度。

这三点各家不同,而且会随版本变化。它们对应的工作也不同:标注来源的平台可以追查引用了谁,不标注的只能统计有没有被点名;答案越短,被点名的位置越重要,因为能给出的名字更少。

需要分辨的影响什么不分辨的后果
是否联网检索外部材料能否介入在改不动的问题上投入
是否标注来源引用能否追溯引用份额无采集基础
答案长度候选名额多少高估进入名单的概率

内容策略只有一套

需要说明的是,这几页讲的是差异,不是说要为每个平台单独做一套内容。

有具体信息、爬虫能抓到、在第三方处有印证的页面,在哪里表现都更好。差异真正改变的是投放位置:某个平台频繁引用的信源类型,在另一个平台上可能几乎不出现。

为每个平台单独做内容还有一个实际风险。成倍增加维护量的同时,容易产出近似重复的页面,而近似重复在搜索端会被判为低质,在生成式回答里也不会被选中,因为各页提供的信息相同。

6.02 亿2025 年 12 月我国生成式人工智能用户规模CNNIC 第 57 次报告
42.8%同期普及率,比上年底提高 25.2 个百分点CNNIC 第 57 次报告
51.5%生成式搜索引擎答案中能被引用完整支撑的句子比例Liu 等 2023

第三个数字是读这几页时该记住的背景。即便答案标注了来源,也有相当比例的句子得不到完整支撑。所以平台页里写的是各家的工作方式,不是对它们输出准确性的背书。

三项差异各自带来什么工作

把差异说成差异没有操作价值,所以每一页都对应到具体动作。

是否联网检索这一项决定优先级。模型不联网时给出的是记忆里的既有印象,本月新发的材料影响不到它;联网时本次抓到的材料才进入组织过程。有一项大规模知识探测实验用一万四千道问题测试了十个模型,结论是模型在冷门事实上表现明显更差,而且扩大规模并不能改善长尾知识的记忆;带检索的模型在长尾问题上大幅超过参数量大得多的无检索模型。所以判断一道题值不值得做,先看它的答案依不依赖本次检索。

是否标注来源这一项决定测量能力。标注的平台可以统计引用份额并追查引用了哪一页;不标注的只能统计有没有被点名、在什么语境里被点名。这不是口径选择问题,是采集基础有没有的问题,所以报表上这一项对不标注的平台留空,而不是填零。

答案长度这一项决定预期。答案越短,能给出的名字越少,进不进候选名单的差别远大于排第二还是第三。短答案的平台上,与其纠结位次,不如先确认自己在不在那两三个名字里。

一个容易被忽略的差异:追问行为

六页里还写了一项不常被讨论的差异,就是各家处理追问的方式不同。

有的平台在首轮回答后会主动给出几个追问建议,有的不给。给出追问建议的平台,实际上把对话往某几个方向引导了,而那些方向反映了它认为这个话题下还缺什么信息。

这件事对建问题集有直接用处。去主流平台问一遍品类相关的问题,看它自己生成的追问,那些追问往往指向真实存在的内容缺口,而且是竞争对手通常没写的部分。这个来源比关键词工具导出来的清单更接近真实提问。

需要注意的是追问建议本身也会随版本变化,所以它适合作为选题灵感,不适合作为固定的问题集来源。问题集还是要来自客户的原话。

每一页都写了做不到的事

六页都包含一段说明:针对这个平台,哪些事是做不到的。

控制不了答案里的顺序。同一个问题多次提问的顺序会变,不存在稳定名次。

保证不了某次提问一定被点名。能影响的是进不进候选范围、材料能不能支撑一句具体的推荐理由。

没有提交入口。没有一个地方可以登记让某个平台优先引用自己的页面,也没有后台能查到材料有没有进入某次回答的候选范围。

写出来有两个理由。一是这些问题在销售环节一定会被问到,提前说清楚比到时候含糊其辞好。二是实际效果上,写明边界的材料更容易被引用,因为模型组织答案时需要判断依据,一份只有优点的材料和其他来源对照时容易冲突。

没有写进去的东西

各平台的用户规模数据没有写。

公开可查的只有行业层面的总量统计,比如 CNNIC 给出的生成式人工智能用户规模与普及率。单个平台的活跃数据多数来自第三方估算或企业自行披露的口径,统计方法不同,互相之间不可比。

与其写一个来源不清的数字,不如不写。页面上保留的是可以核对的那部分:官方文档说明的工作方式、可观察到的答案形态、以及我们自己测量得到的结果并注明问题集与提问次数。

对平台能力的主观评价也没有写。哪家更聪明这类判断和 GEO 的工作关系不大,而且它会随版本变化得很快。

更新机制

平台的取材机制调整通常不公告,所以这几页的更新触发条件是观察到的行为变化,不是日历。

具体看三类信号:答案形态变了,来源标注的有无变了,联网触发的条件变了。这三类出现时更新对应页面,并在页面上写明依据的时间点。

写明时间点这件事在这类内容里特别重要。一篇没有日期的平台说明,读者无法判断它描述的是哪个版本的行为,而版本之间的差异可能很大。

六家各自的取材方式与可做的部分,见AI 平台。三项差异具体怎么影响日常工作,以及该如何据此调整投放,写在平台差异那一页。

参考来源