KNOWLEDGE CATALOG / VALIDATION SET

从 100 个真实问题,
建立公共可信知识坐标。

问题候选用于冻结覆盖面;完整知识单元必须完成来源核验和人工签发,才进入机器目录。

100问题候选0已签发公开
KNOWLEDGE UNITS

知识单元

这里只展示已审核发布、可被机器接口读取的版本。

该分类暂无知识单元

问题候选仍可在下方查看,内容需完成来源和签发后上线。

QUESTION BACKLOG

测量与验证 · 20 问

候选问题不是已验证答案;优先级用于安排六周内的内容签发顺序。

  1. measure-01
    如何计算平台—问题引用覆盖率?测量与验证 · 测量
    P0
  2. measure-02
    如何计算不同知识单元被引用的数量?测量与验证 · 测量
    P0
  3. measure-03
    金标检索问题集应该如何构建?测量与验证 · 方法
    P0
  4. measure-04
    Top-1 和 Top-3 命中率分别说明什么?测量与验证 · 测量
    P0
  5. measure-05
    如何定义一次有效的 AI 平台观察?测量与验证 · 测量
    P0
  6. measure-06
    平台超时或拒答应该如何计入样本?测量与验证 · 测量
    P0
  7. measure-07
    如何区分引用、提及和无链接观点采纳?测量与验证 · 比较
    P0
  8. measure-08
    引用基线应该在上线前何时采集?测量与验证 · 方法
    P1
  9. measure-09
    D+14 可索引覆盖率应如何计算?测量与验证 · 测量
    P1
  10. measure-10
    D+30 引用目标如何根据基线校准?测量与验证 · 测量
    P1
  11. measure-11
    D+60 有效咨询线索如何人工确认?测量与验证 · 测量
    P1
  12. measure-12
    怎样降低 AI 回答随机性对实验的影响?测量与验证 · 方法
    P0
  13. measure-13
    引用监测应该多久重复一次?测量与验证 · 方法
    P2
  14. measure-14
    如何把抓取日志与引用结果关联?测量与验证 · 测量
    P1
  15. measure-15
    如何监测知识单元来源链接失效?测量与验证 · 方法
    P0
  16. measure-16
    如何识别检索中的不相关高分结果?测量与验证 · 风险
    P0
  17. measure-17
    中文别名检索为什么需要字词混合召回?测量与验证 · 概念
    P1
  18. measure-18
    发布前性能验收应关注哪些指标?测量与验证 · 测量
    P1
  19. measure-19
    如何验证 JSON-LD 与页面正文一致?测量与验证 · 方法
    P0
  20. measure-20
    没有引用时应优先检查哪些原因?测量与验证 · 风险
    P0