两批监测结果能不能放在一起比,取决于条件。至少要同时满足四条:同一个平台和同一个模式;同样的登录状态、界面语言与地区;同一份问题集、同样的采集次数;时间窗内没有发生平台改版或模型更新。缺一条,两轮之间的差异就可能是条件造成的,而不是品牌信息或内容变化造成的。这时能写的是"观察记录",不能写"变化趋势"。
条件一:把平台和模式写成一个整体
同一个品牌名,在 AI Overviews 和 AI Mode 里得到的回答与链接可能不一样。Google 的说明里写得很直接:AI Mode 与 AI Overviews 可能使用不同的模型与技术,所以展示的回答和链接集合会变化。这句话有两个用法,一是别把两个功能的样本混进同一个分母,二是记录里要写清"平台 + 模式 + 是否联网 + 是否登录",A 轮和 B 轮这四个字段一致,才谈得上是同一件事的两次测量。
容易被漏掉的还有入口和界面语言。从搜索结果页进入 AI Mode,和在独立入口里提问,看到的回答长度和引用位置常常不同;界面语言换成另一种语言,回答的语言和引用的页面也会跟着变。

条件二:地区、语言和账号状态属于测量条件
Search Console 的生成式 AI 性能报告按"搜索发起的国家"分组,提供页面、国家、日期、设备四个维度,所有日期统一使用太平洋时间。平台自己就是这样切分数据的,团队记录时按同样的维度拆开,才不会把不同国家的结果混成一列。
做跨境业务时这一点尤其明显:同一条英文问题在德国、美国和新加坡得到的回答常常不同,引用来源也不同。把三个国家的样本合起来算一个百分比,等于把三种分布搅在一起,后面无论怎么解释都站不住。合理的做法是每个"语言 + 地区"独立成一行,样本不足时只记录观察,不合并统计。
条件三:样本太小,只能说"出现过"
Search Console 会把两三个月内只有少数用户问过的查询做匿名化处理:这些查询的明细不展示,但计入图表总数。原因不复杂,样本太小,明细既不稳定也不足以保护隐私。监测问题集面对的是同一个问题:一个问题每轮只问两次三次,算出来的百分比随时可能翻倍或者腰斩。
可以给自己定一条门槛,例如单轮采集次数低于某个值的问题只进观察清单,高于门槛的才进比率计算。门槛写进口径页,复测时不要临时调整;确实要改,就在报告里说明从哪一轮开始改、影响哪些指标。
条件四:时间窗和平台更新要单列
Search Console 明确提示最新数据可能是初步数据,还在收集中,随后几小时会变化。AI 回答的不稳定性比这更高:同一个问题隔一段时间再问,回答长度、语气和引用都可能不同。所以两轮之间如果发生过平台改版、模型切换或产品入口调整,报告里要单独写一段"条件变化",把这一轮的可比范围说清楚,而不是直接给出涨跌。
把这些条件写成一页口径
条件固定之后,最省事的做法是写一页口径文件,并在每份报告里附上同一页。这一页通常包含:平台清单与模式(是否联网、是否登录);界面语言与地区;每问题的采集次数,以及判定为有效回答的规则;样本量门槛;统计周期与轮次编号;发生变更时的记录方式。口径页的价值在交接环节:换人执行、更换平台、增加市场时,只要这一页没变,数字就可以继续放在同一条线上看。
口径页本身也要有版本号。调整口径不等于数据造假,但必须在报告里说明从哪一轮开始调整、影响哪些指标。把"改了剔除规则"和"表现变好了"写在同一条结论里的报告,读者无从判断究竟发生了什么。
不可比的时候,可以这样写
- 描述性记录:只写这一轮看到了什么,不做对比。例如"本轮在约定平台中,有四个平台的回答提到了品牌名,其中一处引用了官网的技术手册页"。
- 同轮横向对比:只在同一轮内部比较不同平台、不同问题的表现,条件天然一致,这种对比最稳。
- 跨轮对比并注明条件差异:例如"本轮新增德语问题集,因此提及总数上升,不代表原口径改善"。
把条件写进记录(教学样例)
下面是一段教学样例,用来演示字段怎么填,不对应任何真实客户的监测记录。条件块:平台与模式(联网搜索开启)、登录状态(未登录)、界面语言(英语-美国)、地区(美国)、采集时间(具体到小时,并标注时区)、每问题采集次数、问题集版本号。结论块:本轮可作为基线;暂不与上一轮对比,因为上一轮没有记录地区与登录状态。
这段样例想说明的只有一件事:条件块不完整,结论块里就写不了对比。
采样条件固定之后,才是算指标的问题。分母怎么定、分子包含什么,见品牌提及率与引用率怎么算;要不要把竞品放进同一轮对照,见竞品对照监测;问题集本身怎么分层,见固定问题集怎么设计。需要把采样与复测口径写进项目文件时,可以从光算 GEO 服务的现状诊断开始,平台范围、采样次数和报告周期按项目实际情况确定。
这几篇回答的是相邻的问题:国内GEO怎么验收:用固定问题集记录品牌提及、引用来源和事实偏差。
参考来源
- AI features and your website — AI Mode 与 AI Overviews 使用不同模型和技术,展示的回答与链接会变化,两者不能当成同一个测量单位。
- Generative AI performance report (Search) - Search Console Help — 官方报告按国家、日期、设备、页面拆分,日期统一使用太平洋时间,说明地区与时间本身就是测量维度。
- A deep dive into Search Console performance data filtering and limits — 低量查询会被匿名化处理,明细不展示;低样本量的结果不适合做明细对比。
- Performance report (Search results) - Search Console Help — 最新数据可能是初步数据,随后几小时会变化,读取时间要写进记录。