来源类别钥匙
来源类别只描述来路而不自动等于正确
阻止类别标签成为权威结论。 本文给出可复核步骤、状态边界、脱敏记录方法与复核路径。
来源类别只说明资料来自哪类流程,不能自动推出内容正确。组织文档可能过期,供应记录可能缺字段,编辑摘录可能转写错误;相反,一个类别标签较普通的记录也可能拥有完整证据。验证必须回到字段定义、版本、时间、适用范围和交叉材料,类别与验证状态始终分栏。
目前没有可核来源,正确性结论为UNKNOWN。合成案例中,组织类只给日期,供应类给具体时刻,两者可能是精度不同,而非一方错误。编辑先比较原文、时区和更新时间,再决定等价、冲突或待核。任何“更像权威”的感觉都不能写进判定。验证事件可以分四层:结构是否可解析、字段是否符合定义、关系是否自洽、独立旁证是否相符。一个值通过前三层仍可能缺独立旁证,状态不能被简化为绝对正确。相反,格式失败也许源于解析器不支持本地表达,并非来源事实错误。来源完整度指标只统计明确字段,分母要按该来源声称覆盖的范围计算,不能要求规则文档提供分钟事件。跨来源互证时,先检查它们是否独立;大量页面复制同一上游并不增加证据数量。抓取时间接近不等于发布时间一致,缓存页也可能显示旧文档。任何自动评分必须公开特征和局限,并且不得直接驱动resolved_value。审阅者可写“当前材料支持该字段在此范围内使用”,不能写“该类别可靠”。
把类别标签和验证状态拆开
每条source_record有source_class,每个字段断言另有validation_status。类别可为组织、供应、编辑或UNKNOWN;状态可为未核、通过、失败、冲突和不确定。一个组织类值完全可以未核,一个编辑值也可能通过可复现转换。
数据库与页面都不能用类别推导状态默认值。导入新来源时状态从未核开始。验证事件包含规则、证据和时间,变化通过事件追加。统计来源数量与通过字段数量分别展示。
- 类别与验证状态独立存储
- 导入不预填通过
- 统计分别展示两类指标
以字段定义判断能否比较
两个来源都写“时间”,可能一个是计划开始,一个是页面更新时间。比较前读取field_definition、precision、timezone和scope。定义不同就并列显示,不建立数值冲突。
定义卡缺失时comparability为UNKNOWN。不能只因字段名相同就相减。编辑转换后的值需回到原值和公式。真正可比时才执行格式、范围和关系校验,结果引用规则版本。
- 比较前核对字段定义
- 定义不同不制造冲突
- 定义缺失标comparability UNKNOWN
检查版本和适用时间
较新的发布日期不保证适用于目标赛季,旧文档也可能正是历史记录所需。每个值带published_at、valid_period和observed_at。缺生效区间时不称当前。
来源更新可更正旧值,也可能只改版式。没有变更说明时比较字段指纹。时间较新仅是一个线索,不能自动覆盖旧值。历史页面按当时版本解释,当前页面显示最新复核状态。
- 发布日期生效期观察时间分开
- 较新来源不自动覆盖
- 历史记录调用当时版本
评价完整度而不包装成权威分
可以计算字段完整度、时间可追溯率和规则覆盖率,但指标只描述明确维度。总分若把多个指标混合,会隐藏缺失,故页面优先展示分项。没有证据的字段不因来源类别获得加分。
完整不代表正确,一份填满的错误记录仍会失败。通过校验也不代表未来有效。指标公式、分母和时间窗公开,无法计算时显示UNKNOWN。颜色只作辅助,文字状态必须可读。指标卡旁列出它不能证明的事项,并允许展开样本构成,防止读者把覆盖率误读为准确率。
- 质量指标使用明确维度
- 完整度不等于正确性
- 公式分母和时间窗公开
在冲突中拒绝类别排序
组织与供应值冲突时,不预设谁胜出。冲突卡并列原值、定义、版本、时间、覆盖和来源证据。可能一方是规则计划,一方是实际事件,角色不同会解释差异。
无法裁决就resolved_value为UNKNOWN。获得明确修订或规则后新增解决事件,保留未采用值。类别排序若是某字段的正式规则,也必须有来源、适用范围和版本,不能来自编辑习惯。季度复核专门抽取高分却后来更正的记录,按解析、映射、时区、复制链和规则过期归因。改进应落到具体失效环节,而不是给整个来源类别加减信誉。
- 冲突不按类别先验裁决
- 未解决值保持UNKNOWN
- 优先规则也需来源版本
测试界面不会暗示保证
可用性测试让审阅者只看徽标,询问其是否误以为某类一定正确。若颜色、盾牌或文案造成这种理解,改为中性类别说明,并将验证状态放在独立栏。
读屏文本必须读出“来源类别”而非“可信”。排序默认按时间或字段,不按所谓权威等级。合成冲突样例检查两类值都能展开来源。界面测试结果保存版本。评估报告应展示每类样本的可复核比例、字段一致率和UNKNOWN比例,却明确这些数字不能推导下一条记录正确。抽样脚本按字段和时间分层,复制同一上游的页面先聚为一组。自动模型若使用类别特征,必须保存特征贡献并接受消融测试;去掉类别后合理证据仍应主导结果。任何类别级“可靠”标签都视为设计缺陷。
- 徽标进行误读测试
- 读屏文案保持中性
- 默认排序不按权威等级
发布来路、证据和未知项
页面为每个字段显示来源类别、原值、定义、时间、验证状态和限制。类别解释责任边界,验证事件解释为何可用。没有材料时明确UNKNOWN,不用徽标填补。
公开前另做字段级校准审计,不再重复类别说明。审计冻结evaluation_id、样本编号、字段输入指纹、人工判定规范、模型版本与解析器版本;共享同一上游指纹的转载先聚为一簇,再按簇切分校准集和留出集,防止相近副本同时出现在两边。日期、分钟时刻、实体身份、赛事状态与规则解释分别绘制分数区间和人工结论的可靠性表,每个区间同时报告样本数、冲突率、无法复核率、校准差与选择性放弃比例,样本过少的区间直接标UNKNOWN。消融包含四个固定变体:完整特征、遮蔽source_class、在证据相同组内随机置换类别、只保留字段证据的基线;四组使用完全相同的样本顺序和输入版本。反事实对再提供更严格的检查:证据逐字相同而只改类别时,字段状态不应翻转;类别相同但证据强弱不同,结果必须允许分开。阈值按字段用途和错误代价设定,不能用一个总准确率覆盖实体误并与时间误差。高分误判、低分正确和后来更正的记录进入独立误差册,分别标记标签泄漏、复制链、解析、映射或规则漂移。语言、赛事族或资料新旧任一分层的校准差超过预设门槛时,页面只发布证据范围和人工状态,自动分数留在审计层,相关字段继续显示UNKNOWN,直至新一轮留出测试通过。审计结论还保存下一次复测所需的最小新增样本类型与数量。
- 字段页并列类别与状态
- 缺证据明确UNKNOWN
- 页面、导出和结构化字段只显示证据范围与复核时间,不使用权威实时保证,也不暗示来源类别等于正确


