待验证50% 置信事实精确时间
传统监督学习的理论假设是训练数据和测试数据来自同一分布(i.i.d.假设),但现实中几乎从不成立
1
来源数
50%
置信度
长期有效
时效性
2026/9/1
首次发现
来源
涉及实体
相关事实
已验证当模型训练数据包含评测集题目或高度相似内容时,模型可能通过记忆而非真正理解获得高分72% 相似待验证模型本身对准确性毫无概念,它只是模仿训练数据中观察到的统计分布71% 相似待验证标准的 McNemar 检验假设比较的是两个确定性模型在单一固定测试集上的预测结果,而随机种子引入的是模型训练本身的变异性,这两种不确定性来源在概念上属于不同层次69% 相似待验证蒸馏训练范式导致开源模型学习到经过高度过滤、几乎不包含失败和纠错过程的数据分布,使模型形成不愿自我纠正的性格68% 相似已验证微调是在通用预训练模型基础上用特定领域数据进行二次训练,使模型能将领域知识内化为参数,推理时无需额外检索步骤,延迟更低68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/838966API
curl https://kongchang.com/api/v1/knowledge/claims/838966MCP
get_claim(id=838966)