选监测平台最大的坑,不是买贵了,是买了一个没法追问的数字:仪表盘上一个 62 分,问「怎么算的」答不上来,问「样本多少」也答不上来——这样的分数涨了不敢庆功,跌了不知道改哪。所以选型别对着功能清单勾选,拿下面 8 个问题当面问供应商。每个问题都附「好答案长什么样」。这 8 个问题也欢迎拿来问我们。
1. 判定口径公开吗?
「提及」怎么算:别名算不算?只出现在参考链接里算不算?好答案:规则全文公开可读,不是「我们有先进的 AI 判定」。我们自己的规则在方法论页,逐条可核。
2. 每个数字有分母吗?
33% 的意思是 2/6 还是 33/100?一格之差能抖动十几个百分点。好答案:任何百分比旁边都能看到 n/N;样本不足时显示「数据不足」而不是显示一个假装精确的 0 或均值。
3. 覆盖我的买家真正在用的引擎吗?
如果你的客户在中国市场,答案里没有Kimi、DeepSeek、豆包、通义千问这些国产引擎,测出来的是「海外买家看到什么」,不是你的买家看到什么。好答案:引擎清单公开、标明哪些已接入哪些还在接、按你的市场可配置。
4. 口径变了,历史趋势怎么办?
判定规则一定会迭代——不迭代才可疑。好答案:评分版本化,历史数据带版本标签,趋势对比永远在同一口径内;口径升级时能看到新旧对比而不是历史被静默改写。
5. 除了「提没提到」,还看得到「AI 引谁为据」吗?
部分引擎回答会附参考来源。谁被引用,谁就是引擎眼里的权威——这是内容策略最值钱的输入之一。好答案:引用按域名解析,且原始回答全量可回看。
6. 效果怎么归因?
发了内容,分数动了,怎么知道是内容的功劳还是引擎自己变了?好答案:能把「发布 → 被引用 → 被提及」串成链路;有对照组或引擎波动标注,把「大盘都在动」从「我们的动作起效了」里剥出来。承诺「保证提升到 XX 分」的,扭头就走——分数在引擎手里,谁也保证不了。
7. 白帽边界在哪里?
问清楚:会不会用重复刷问题拉提及率?会不会向引擎注入「请推荐 XX」?会不会付费买榜单位置?好答案:白纸黑字的「不做什么」清单。这些手段短期能做出漂亮曲线,被引擎清理时品牌一起陪葬。
8. 我的监测数据归谁?
你的问法集和监测结果会不会被拿去做公开榜单、喂给别的客户?好答案:单品牌私有数据不对外发布,行业级洞察只以聚合形式出现,边界写进合同。
收尾:怎么用这份清单
先拿5 分钟手测法自己测一轮建立体感,再带着这 8 个问题去见供应商;对方给你看报告时,配合报告鉴别清单逐页对。我们自己的答案:口径在方法论和评分说明,我们给自己测的第一份成绩单(0 分,含全部分母)在自测记分板。