待验证50% 置信事实精确时间
主观性判断标准(如内容是否全面)在LLM评审中几乎是随机的,而事实性检查(如X是否存在)基本不翻转
1
来源数
50%
置信度
长期有效
时效性
2026/10/3
首次发现
来源
涉及实体
相关事实
待验证选择注明基于标准化常模(如CBCL、SDQ、Conners、韦氏儿童量表WISC)的测评,而非商家自研的'心理测试',标准化量表有百分位或T分数参照,自研题库通常无信效度验证69% 相似待验证校准指标在测试集的整体统计层面有效,但无法保证对单个具体查询的置信度表达准确68% 相似待验证现有 LLM 辅助筛选评估方法大多依赖准确率等传统指标,在高度类别不平衡的系统综述数据集上可能产生误导67% 相似待验证如果你更认可有随机对照临床试验支持的成分(如褪黑素),该产品在公开临床证据层面相对薄弱,选购时需权衡对传统草本经验的信任度66% 相似待验证在几乎没有缺陷样本的工业检测场景中,应优先考虑异常检测而非监督学习,因为拥有的是海量良品而非缺陷66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/968961API
curl https://kongchang.com/api/v1/knowledge/claims/968961MCP
get_claim(id=968961)