01

向 GEO 服务商索取怎样的重试证据?

索取每个题格的全部尝试、事前确定的选取规则、被选答案及判定历史。让 GEO 服务商用同一份原始记录重建“交付时的结果”和“更正后的结果”,并列出受影响题格。若选取、判定和可比条件都成立,结果仍无改善,就如实记为没有进展,并按事前约定的继续或停止条件处理。

建议在采集前写下截止时刻、可用答案条件和选取规则。例如采用截止前第一个符合条件的答案时,要按时间顺序逐次判断资格;“符合条件”不能包含是否出现目标品牌。若改为取最后一次或综合多次观察,应在下一轮开始前定好,保留规则版本。

题格用 cell_id 标识预定观察;一次请求产生一个 attempt_id;对某份答案的一次判断产生一个 judgment_id。重试挂在原题格下,重新判定挂在原答案下。按计划重复提问则各有题格,不能混成故障补跑。

02

豆包、千问、DeepSeek 的验收记录怎样分别对平?

豆包、千问、DeepSeek 各交一张题格清单和对应的尝试、判定明细,分别列出规则版本、被选尝试及排除原因。验收时逐平台检查被选答案是否由同一规则产生,再按该平台的当前状态对平;一个平台的补跑或改判不能改写另一个平台的结果。

题格身份同时包含题库版本、题号、平台、通路与预定重复序号;实际模型、搜索条件和采集时刻另存到测量环境记录卡。条件不符的尝试仍可保留,但不自动补进原来的可比集合。

03

账本怎样从尝试推导出七种当前状态?

按顺序检查下表,直到命中一个状态。状态属于题格在特定报表版本中的投影,尝试历史另存;旧报表要能还原当时的选取结果。

当前状态判定入口
NOT_RUN没有采集尝试
COLLECTION_ERROR有尝试,但未得到可读完整答案
INELIGIBLE有可读答案,但没有符合约定环境的答案
JUDGMENT_PENDING已选定合格答案,尚未判定
JUDGMENT_ERROR所选答案的判定执行失败
MENTION_YES所选答案完成判定,确认出现目标品牌
MENTION_NO所选答案完成判定,确认未出现目标品牌

没有可用答案和有效答案中未提及的基础区别,见报表分母说明。账本导出还要区分缺字段与未知值:JSON Schema 区分值为 null 的属性与不存在的属性。JSON Schema 对象说明

可约定每条判定记录都包含结果字段,未决填空值并附状态,完成后的否定结果才填 false。这是账本自身的校验规则;CSV 空白也应保留相邻状态列。

04

复算用的等式与指标名

以各平台计划题格数为 P,七种当前状态的计数之和应等于 P;尝试条数不进入此式。所选答案具有当前完成判定的有提及和未提及题格分别为 Y、N,则 J = Y + N。

指标名固定为“判定完成度” J/P、“已判定样本内提及率” Y/J;若保留 Y/P,名称为“计划题格中已确认提及的占比”。分母为零时对应比值标为不适用。这些是计算定义,不是实测效果数。

05

人工更正怎样产生可复核的差异?

对同一答案改判时,新建判定记录,指向旧 judgment_id,写明原值、新值、原答案中的证据位置、改判理由、复核人和时间。原答案不变;如果换用了另一次采集,必须同时记录尝试选取的变化,不能包装成单纯改判。

更正报告附上原报告版本、修订版本和受影响题格列表。先逐格比较被选尝试及判定,再重算状态计数与指标;没有变化的题格不重复计入。实际判定错误类型可参照监测判定复核说明中的公开说明,账本保留的则是这次修正所对应的证据。

06

常见问题

迟到的有效答案应该放在哪里?

放入后续观察,或按明确的更正规则形成新报告版本。先检查迟到答案的环境是否仍符合原规则;不符合就不能仅凭“补齐了”替换原题格。修订说明同时列出原截止时刻和实际补跑时间。

本文由 AI 辅助创作,发布前经人工审核。

07

想先看你的品牌现在在 AI 搜索里被怎么说?

领取免费增长诊断