GEO 项目最容易出问题的地方不是执行,而是衡量。做了三个月,团队说「感觉好一些了」,但拿不出证据,预算就没法继续要。

解决这件事的关键是:一开始就定好指标和复测节奏。

六个该盯的指标

前排上榜率 —— 进入 AI 推荐前几位的关键词占比。这是最贴近商业价值的指标,因为用户真正会点开看的,就是前几个。建议作为主指标。

平均排位 —— 被提及时的排位平均值。这个指标要跟前排上榜率一起看:上榜率上升但平均排位下降,说明进入了名单但位置边缘。

关键词覆盖率 —— 目标问题里有多少条的回答提到了品牌。这个指标反映的是覆盖面,适合评估「内容铺设」这类动作的效果。

平台覆盖数 —— 有多少个平台提到了品牌。这是抗风险指标。只在一个平台被推荐的状态很脆弱,平台覆盖数上升比单平台分数上升更有价值。

负面句占比 —— 涉及品牌的语句里负面表述的占比。这个指标是安全线,涨了就要立刻查原因。

竞品相对位置 —— 同一批问题里,你和竞品分别被提及的次数。这个指标最有说服力,因为 AI 的推荐名单长度有限,你进去通常意味着别人出来。

别只看总分

系统的 GEO 总分是六个维度的加权结果,适合看整体趋势,但不适合单独作为考核依据。

原因是总分会把问题平均掉。一个典型场景:品牌在四个平台表现优秀,在两个平台完全没曝光,总分可能仍然显示良好。但实际情况是那两个平台上的客户完全看不到你。

正确的用法是:总分看趋势,分维度找问题。

总分比上季度涨了 8 分 —— 这是趋势。涨的原因是平台覆盖从 6 个变成 8 个,但前排上榜率没动 —— 这说明内容铺开了但没有形成竞争力,接下来的重点是把已有曝光转化成前排位置。这才是可执行的信息。

复测节奏怎么定

频率取决于你在做什么阶段:

刚起步、正在大量产出内容 —— 每两到三周复测一次。这个阶段变化快,间隔太长会错过反馈。

内容产出稳定、在做精细调整 —— 每月一次。这个阶段的动作效果需要时间体现,太频繁只会看到 AI 的随机波动。

已经稳定上榜、转向防守 —— 每季度一次,重点盯竞品相对位置和负面句占比。

复测时的三个纪律

第一,关键词不能换。 复测必须用同一套关键词,否则数据没法比。要加新词,就单独建一组,不要混进原来的基线里。

第二,同一时间段测。 AI 的回答会受近期热点影响。如果第一轮在月初测、第二轮在月末测,中间的舆情波动会污染对比结果。尽量保持相似的测试时点。

第三,记录异常。 复测时遇到大面积异常(比如所有平台同时大幅下滑),先查外部原因:是不是有突发负面舆情,是不是某个平台做了模型更新。这类波动不是优化失败,但如果不记录,下一次复盘时会被误读。

给自己留一份基线

最重要的一条:第一轮检测的数据一定要存档

没有基线,后面所有的变化都无法被证明。你说品牌表现变好了,好到什么程度、好在哪里,都必须拿第一轮的数据来对照。

这也是为什么我们把每一轮的完整结果都留档 —— 包括原始回答和截图。报告可以重做,原始的检测证据丢了就补不回来了。