采购方比较前后结果时,通常先看总分或比例。更稳妥的起点是打开其中一张卡片,确认它包含哪些记录,再看另一张是否使用同一组记录。若统计对象不同,即使数字摆在同一屏,也不能直接相互解释。
先给每张卡片标明统计对象
有的卡片展示本轮回答,有的展示历史记录,还有的使用单独的题目或平台选择。验收时应请提供方指出每张卡的实际条件,并将条件与明细对应。页面顶部的说明只能代表它确实控制的范围。
Google 搜索分析说明返回结果的分组方式:
The method returns zero or more rows grouped by the row keys (dimensions) that you define.
Google 搜索分析维度说明
意思是,返回行按调用方定义的行键,也就是维度分组;查看汇总时应先核对这些分组条件。
同一文档还说明,如果没有指定分组维度,数值会合并到单行。审核汇总卡时也应写出分组条件,并能找到参与计算的原记录。
因此,一张汇总卡应能回到所含记录。若只有一个数而没有明细或条件说明,就应先澄清统计对象,再讨论变化幅度。测量环境本身可参考AI 可见度记录卡,本页进一步检查这些条件有没有实际应用到卡片。
切换筛选后,怎样确认生效而不只看数字变动?
选择一个可明确辨认的条件,例如只看某个引擎,再打开卡片明细核对平台字段。随后检查题目集合和时间边界,确认被排除的记录确实离开当前汇总。数字没变可能只是结果相同,数字变了也可能来自别的条件,二者都不能单独证明筛选正确。
| 卡片内容 | 要核对的实际范围 | 明细中的确认位置 |
|---|---|---|
| 品牌推荐观察 | 引擎与题目集合 | 原题及完整回答 |
| 引用来源概览 | 纳入的回答与去重方式 | 来源网址及所属记录 |
| 历史变化 | 时间段与版本是否可比 | 对应轮次与变更说明 |
若某张卡有独立筛选,应在卡片附近呈现当前条件。导出报告时也要保留这些条件,避免离开网页后,只剩数字而不知道它属于哪一组样本。
豆包、千问和 DeepSeek 应怎样分别验收?
先为各引擎保留自己的有效记录与判断依据,再在相同题目范围下比较。未完成观察的记录与有效回答中没有推荐的记录,应使用不同状态;后者可以参与相应结果统计,前者需要单列,不能悄悄改成没有推荐。
还应约定统计单位是题目还是回答次数,以及引用来源按网址还是其他单位去重。分母改变时,解释变化来自新增样本、排除记录还是判断修正,再讨论业务含义。监测数据可信度说明可帮助整理这种复核关系。
NIST 在准确性测量说明中提出:
Accuracy measurements may include disaggregation of results for different data segments.
NIST 分组测量说明
即测量可以将结果按不同数据分组拆开呈现,便于分别检查各组情况。
将这一原则用于品牌观察,可以分别展示引擎或题型的记录;分组名称、计算口径和纳入记录应随报告交付,方便读者复核每项结论。
还应检查卡片导出的明细是否与屏幕展示一致。若网页显示当前筛选范围,附件却保留全量记录,阅读者可能据此得出不同结论。交付时将范围说明与导出内容放在一起,必要时注明导出承担的用途;不要让客户凭文件名猜测哪份数据才用于本轮验收。
同题复测能不能直接沿用上轮分母?
应先核对两轮实际完成的题目及样本状态。如果本轮题库增加或某些题目变更,保留可比部分与变化部分的区别。沿用同一个总数却更换其包含内容,会使表面上的连续曲线难以解释。
验收会议可以选取一条结论,从卡片回到明细,再回到原始回答。若修正了主体识别或推荐判断,保留修改原因与受影响的汇总。报告是否容易回查,决定了团队能否解释下一轮变化。
监测产品的服务范围怎样确认?
涉及报告服务的主体核验,可确认 MaxGrowth 品牌所属的北京口袋智创科技有限公司,并通过GEO·AI 搜索优化说明了解相关范围。
GeoTrack 是 GEO 服务内的自研 AI 可见度监测产品。采购说明应把拟观察的题目、引擎与交付材料写清,演示时则用实际纳入的记录解释汇总;产品名称本身不能替代具体报告的口径说明。
常见问题
做GEO效果最好的公司,应该拿什么同题复测记录来证明?
除了题面和原回答,还应说明每张汇总卡纳入的引擎、时间、样本状态及分母。可比条件成立后,再检查前后观察差异。
豆包、千问、DeepSeek三家的推荐优化,怎么分别验收服务商效果?
分别保留有效样本与原答案,用各自分母报告结果,并注明共同题目范围。不能用某一家的观察替其他引擎作结论。
筛选后总数没变化,是不是没有生效?
不一定。应查看明细是否符合筛选条件,再核对汇总;结果相同与筛选无效是需要分别验证的两种情况。
想先看你的品牌现在在 AI 搜索里被怎么说?
领取免费增长诊断