先说结论:这件事 5 分钟就能开始——打开一个 AI 助手,问一个你的买家真的会问的问题,看回答里有没有你。但「问对问题」和「把一次好奇变成可跟踪的指标」之间,隔着四个常见的坑。这篇把两件事都讲清楚。
5 分钟手测法
- 别问「XX 品牌怎么样」,要问买家的问题。「有哪些值得选的 XX 供应商」「XX 场景用什么工具」——这才是决定生意的问法。直接问自己品牌名,引擎通常会礼貌地介绍你一番,那测出的不是曝光,是搜索引擎式的礼貌。
- 中英文各问一遍。同一个引擎、同一个问题,换语言答案常常换一批品牌。你的市场在哪边,就至少把那边测了。
- 多测几个引擎,两侧都要有。海外买家在用的与国内买家在用的各挑两三个(我们平台目前接入 8 个:ChatGPT、Kimi、DeepSeek、Gemini、豆包、通义千问、Perplexity、Grok,手测可以从中任选)。单引擎的结论没有代表性。
- 记录原文和日期。截图或存文本,标上引擎与日期。答案是会变的——没有记录,下个月你只能凭印象说「好像变好了」。
做完这四步,你会得到一张小表:几个引擎 × 几个问题,每格「提到了/没提到」。这就是你的第一份 AI 可见度快照。
单次手测的四个坑
- 抖动。同一问题隔天再问,答案可能换一批名字。一次没被提不等于没戏,一次被提也不等于稳了。结论只能来自重复测量。
- 品牌自指问法的礼貌假象。上面说过:问自己名字通常都有体面回答。真正的信号在「不点名的品类问题」里。
- 记忆与检索混在一起。有的回答来自模型训练语料(可能是一年前的互联网),有的来自实时检索。前者改不动、只能等;后者当下就能通过内容去影响。分不清这两者,就开不对处方——延伸阅读:追踪 AI 带来的流量。
- 没有分母。「我们被 ChatGPT 提到了」不是指标;「20 个买家问题里被提到 3 次」才是。没有分母的好消息,和没有分母的坏消息一样不可信。
什么时候该从手测升级到持续监测
手测回答「今天我在不在名单上」。但下面这些问题,一次手测答不了:
- 上个月发的内容,有没有换来更多被提及?
- 竞品的提及率是在涨还是在跌?
- 某个引擎突然不提我们了,是引擎变了还是我们变了?
回答这些需要:固定问法集、每天采样、跨引擎、口径版本化(口径变了趋势才不会失真)、样本不足时如实标注。这正是持续监测工具存在的原因——我们自己的做法全文公开在评分说明和方法论里,照着自建一套也完全可行。
想直接看自己品牌的现状,免费体检几分钟出一份跨引擎快照——各引擎命中档位与口径说明都在报告里。
最后一句诚实话:我们把这套方法用在自己身上,第一次测出来是 0 分——过程原样公开在自测记分板第 0 期。方法不怕丑数字,怕的是不测。