从 100 个真实问题,
建立公共可信知识坐标。
问题候选用于冻结覆盖面;完整知识单元必须完成来源核验和人工签发,才进入机器目录。
100问题候选0已签发公开
KNOWLEDGE UNITS
知识单元
这里只展示已审核发布、可被机器接口读取的版本。
该分类暂无知识单元
问题候选仍可在下方查看,内容需完成来源和签发后上线。
QUESTION BACKLOG
测量与验证 · 20 问
候选问题不是已验证答案;优先级用于安排六周内的内容签发顺序。
- measure-01如何计算平台—问题引用覆盖率?测量与验证 · 测量P0
- measure-02如何计算不同知识单元被引用的数量?测量与验证 · 测量P0
- measure-03金标检索问题集应该如何构建?测量与验证 · 方法P0
- measure-04Top-1 和 Top-3 命中率分别说明什么?测量与验证 · 测量P0
- measure-05如何定义一次有效的 AI 平台观察?测量与验证 · 测量P0
- measure-06平台超时或拒答应该如何计入样本?测量与验证 · 测量P0
- measure-07如何区分引用、提及和无链接观点采纳?测量与验证 · 比较P0
- measure-08引用基线应该在上线前何时采集?测量与验证 · 方法P1
- measure-09D+14 可索引覆盖率应如何计算?测量与验证 · 测量P1
- measure-10D+30 引用目标如何根据基线校准?测量与验证 · 测量P1
- measure-11D+60 有效咨询线索如何人工确认?测量与验证 · 测量P1
- measure-12怎样降低 AI 回答随机性对实验的影响?测量与验证 · 方法P0
- measure-13引用监测应该多久重复一次?测量与验证 · 方法P2
- measure-14如何把抓取日志与引用结果关联?测量与验证 · 测量P1
- measure-15如何监测知识单元来源链接失效?测量与验证 · 方法P0
- measure-16如何识别检索中的不相关高分结果?测量与验证 · 风险P0
- measure-17中文别名检索为什么需要字词混合召回?测量与验证 · 概念P1
- measure-18发布前性能验收应关注哪些指标?测量与验证 · 测量P1
- measure-19如何验证 JSON-LD 与页面正文一致?测量与验证 · 方法P0
- measure-20没有引用时应优先检查哪些原因?测量与验证 · 风险P0