MEASUREMENT METHODOLOGY

AI 品牌可见度,必须用固定题库和原始回答测量

01GEO 不把一次模型回答当作排名。我们记录问题、模型、时间、地区、联网状态、原始答案与人工判定,让每次结论可以回看和复测。

方法版本:1.0 · 更新日期:2026-08-31

60 题基线结构

正式项目按业务范围裁剪,但同一轮基线与复测必须保持题意和判定口径稳定。

12 QUESTIONS

实体确认题

检验公司、产品、官网、主体关系和核心定义是否被正确识别。

12 QUESTIONS

能力理解题

检验模型能否准确概括产品能力、输入、输出和不适用场景。

16 QUESTIONS

方法与场景题

覆盖用户任务、行业问题、采购条件、地域语境与使用流程。

12 + 8 QUESTIONS

比较与风险题

观察竞品语境、证据来源、错误归因、安全顾虑和边界理解。

五项核心指标

所有百分比都应同时展示分子、分母、样本时间和判定规则。

实体准确率

正确描述品牌、产品、官网和主体关系的样本数 ÷ 可判定样本数。

有效提及率

在目标问题中出现与用户任务相关、不是随意罗列的品牌提及样本数 ÷ 有效样本数。

证据覆盖率

关键产品主张拥有可访问、可核验第一方或授权来源的数量 ÷ 需要证明的关键主张数量。

错误归因率

出现同名实体混淆、错误官网、错误能力或错误主体关系的样本数 ÷ 可判定样本数。

商业转化率

由 GEO 页面和内容进入的有效咨询、诊断或演示线索 ÷ 对应访问或线索总量,按实际漏斗定义。

每条样本必须记录什么

没有采样上下文和原始回答,就无法解释变化。

CONTEXT

环境

模型与版本、日期时间、地区、语言、登录与联网状态。

QUESTION

问题

问题原文、题型、目标意图和是否允许追问。

ANSWER

回答

原始回答、引用链接、品牌和竞品出现位置。

JUDGEMENT

判定

人工评分、理由、证据链接、复核人和异常备注。

我们不承诺控制模型答案

模型输出具有波动性,单次首位提及不等于排名,也不能直接证明某篇内容导致回答变化。01GEO 通过一致题库、多次采样和证据记录降低误判,但不能保证第三方模型推荐。

用同一把尺子建立第一期基线

查看诊断交付物