真正要紧的差异

按实际影响排序有三条。这次回答有没有联网检索,这一点会因问题而异,有时甚至因运行次数而异。答案里是否标注来源,还是完全不标。答案有多长 —— 短答案点名的品牌更少,位置的影响也更大。

每一次运行都记录联网状态

依据训练数据组织的答案,与依据实时检索组织的答案,是两种不同的测量。混在一起会产生这样一条曲线:提升时隐时现,而原因与你做的事毫无关系。应当逐次记录是否联网 —— 如果平台不暴露这一点,就记录你使用的设置。

引用:只算答案标注出来的

有些平台会在答案旁列出它查阅过的页面。那是检索候选池,不是引用集合 —— 其中大部分并未被使用。把候选池当引用统计,会让数值虚高数倍,也会让一个糟糕的信源看起来很有影响力。只统计答案正文真正标注的来源。

不因平台而异的是什么

内容工作本身。一个有具体信息、爬虫能抓到、在别处有印证的页面,在哪里表现都更好。不存在某个平台上薄内容管用,也不存在能替代事实底座的平台专属技巧。

差异确实会改变的决策

投放。各平台对信源的侧重不同,某个平台频繁取回的媒体,在另一个平台上可能根本不出现。如果测量显示某个平台上持续落后,应当去看该平台在你这个品类里确实引用了哪些信源并投到那里,而不是把同样的内容再写一遍。