- GEO 的核心指标是提及率:在固定问题集中,你被 AI 提到的次数占总提问次数的比例。
- 除提及率外,还要看描述准确度、在名单中的位置、被引用的自有页面和第三方来源。
- AI 回答天然有波动,至少要看三个月以上的趋势,单月升降不说明问题。
- 询盘表单增加“你是怎么找到我们的”选项,是追踪AI带来实际业务的最直接方法。
GEO 效果主要看一个核心指标:提及率,也就是在一组固定问题中,AI 回答提到你的次数占总提问次数的比例。再配合描述准确度、引用来源和询盘来源三类辅助数据,就能比较完整地判断 GEO 工作有没有进展。
需要先接受一个事实:AI 的回答每次都可能不同,也没有人能保证你在某个 AI 里“排第一”。所以 GEO 的衡量方式更像做抽样调查,看的是趋势,而不是某一次的截图。
GEO 效果的指标体系
| 指标 | 怎么算 | 说明什么 | 频率 |
|---|---|---|---|
| 提及率 | 被提及次数除以总提问次数 | AI 是否认识并推荐你 | 每月 |
| 平均位置 | 被提及时在名单中的平均排序 | 推荐时的优先程度 | 每月 |
| 描述准确度 | 回答中关于你的事实,正确条数占总条数的比例 | 实体信息是否统一 | 每月 |
| 自有页面被引用次数 | 引用来源中出现你官网页面的次数 | 官网内容是否被采用 | 每月 |
| 第三方信源覆盖 | AI 常引用的网站中,提到你的有几个 | 外部背书是否在增加 | 每季度 |
| AI 来源询盘 | 询盘中注明来自 AI 工具的数量 | 是否带来实际业务 | 每月 |
提及率:怎么测才可比
- 问题集固定:30~50 个问题定下来后不随意修改,搭建方法见如何测试品牌在AI中的可见度。
- 平台固定:选定三到四个平台,比如 ChatGPT、Perplexity、Gemini、谷歌AI概览,面向国内市场的再加 DeepSeek、豆包。
- 次数固定:每题每平台问三次,用新对话,关闭记忆。
- 分平台记录:各平台差异很大,不要只看合计。
- 同时记录竞争对手:挑三到五家主要对手,看你和他们的差距在缩小还是扩大。
描述准确度:常被忽略的指标
被提及但被说错,可能比不被提及更麻烦。检查时把 AI 回答中关于你的每一个事实拆开核对:
- 业务类型(制造商还是贸易商)
- 主营产品
- 所在地
- 规模、成立年份
- 认证
错误集中在哪一项,就回头检查那一项在各平台的写法,参考实体信息一致性检查方法。
GEO 没有保证排名,只有可以持续测量的提及率。测量方法稳定,趋势才有意义。
询盘来源:连接到业务结果
很多买家从 AI 得知你后,会直接搜索你的公司名或输入网址,网站统计里显示为直接访问或品牌词搜索,看不出和 AI 的关系。最直接的补救办法:
- 在询盘表单加一个选填项“你是怎么找到我们的”,选项里包含“AI 工具(ChatGPT 等)”。
- 业务员首次回复时顺带问一句,并在客户管理系统里记录。
- 在网站统计中观察来自 AI 平台的引荐访问,部分平台会带来可识别的来源。
- 留意品牌词搜索量的变化,它往往和 AI 提及同步变化。
怎么解读数据
正常的波动
平台模型更新、联网检索结果变化,都可能让提及率在某个月突然升降。单月变化不要急着下结论,至少看三个月的趋势。
需要关注的信号
- 连续几个月下降,且竞争对手上升:检查对手最近在哪些信源上有新动作。
- 提及率上升但描述准确度下降:新增的信源里可能有错误信息。
- 某个平台长期为零:检查该平台的爬虫是否被网站挡住。
一份简单的月度报告模板
- 本月总提及率和各平台提及率,与上月、三个月前对比。
- 与主要竞争对手的提及率对比。
- 描述错误清单和处理进度。
- 本月新增的第三方信源和官网内容更新。
- 来自 AI 工具的询盘数量和质量。
GEO 工作和指标的对应关系
为了知道哪项工作起了作用,可以把每月做的事情和指标变化放在一起看:
| 本月做的工作 | 最可能先反映在哪个指标 |
|---|---|
| 统一各平台公司信息 | 描述准确度 |
| 改写产品页和问答内容 | 自有页面被引用次数 |
| 新增目录收录和媒体报道 | 第三方信源覆盖,随后是提及率 |
| 放行被误拦的AI爬虫 | 对应平台的提及率和引用 |
这种对应只是大致规律,不能当作严格的因果关系。但坚持记录几个月后,你会对自己所在行业里哪类工作更有效形成判断。
不建议用来衡量 GEO 的指标
- 单次截图:一次提到或没提到,受随机性影响太大。
- 网站总流量:影响因素太多,和 GEO 工作之间关系不直接。
- 发布了多少篇内容:这是工作量,不是结果。
- 第三方工具给出的单一“AI 可见度分数”:可以参考,但要了解它测了哪些问题、用什么方法,否则无法判断是否符合你的业务。
衡量指标要能回答两个问题:AI 是否更常、更准确地提到你;这些提及是否带来了买家。
最后,报告要写给看得懂的人。给老板看的版本突出趋势、竞争对手对比和询盘;给执行人员看的版本则要细到每个问题、每个平台的变化。两份报告用同一份原始数据,只是呈现的角度不同,这样可以避免不同部门对效果的理解出现偏差。
下一步
如果还没有基准数据,这个月就先完成第一轮测试,把结果存档。三个月后你就能看到第一条趋势线。需要一套现成的记录表格或希望由专人执行测试,可以联系我们,或了解我们的GEO 优化服务。
常见问题
提及率多少算好?
没有通用标准,和行业竞争程度、问题难度都有关。更有意义的是看自己的变化趋势,以及和主要竞争对手的差距。
GEO 效果能直接换算成询盘数吗?
很难精确换算,因为买家从AI得知你后,常通过搜索公司名或直接访问官网联系你。可以通过询盘表单来源选项和业务员询问来部分追踪。
多久测一次比较合适?
一般每月一次。更频繁的测试会被随机波动干扰,间隔太长又难以及时发现问题。平台有重大更新时,可以加测一次。
