Unverified50% confidenceTradeoffExact time
多种子实验中检验对象从单样本预测分歧变为多次运行的准确率序列时,通常已不再适用McNemar检验
1
Sources
50%
Confidence
Long-term
Relevance
7/14/2026
First Seen
Sources
McNemar检验对比机器学习模型:随机种子下的正确用法
redditr/learnmachinelearning7/11/2026
Related Claims
UnverifiedMcNemar 检验要求两个模型在完全相同的测试集上评估,任何测试集的不一致都会使检验失效79% similarUnverified多种子重复实验中可使用配对t检验或Wilcoxon符号秩检验比较两组准确率分布,其中Wilcoxon检验因不依赖正态性假设更适合小样本77% similarUnverified当比较两个具体训练模型的预测行为差异时应固定种子使用同一测试集运行McNemar检验,当评估方法整体优越性时应用多种子重复实验配合配对t检验或非参数检验77% similarUnverifiedMcNemar检验是一种专门用于配对二分类数据的非参数检验方法76% similarUnverified通过打乱测试执行顺序并多次运行,若某测试仅在特定顺序下失败,可推断其与其他测试存在状态污染或隐性依赖75% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/503212API
curl https://kongchang.com/api/v1/knowledge/claims/503212MCP
get_claim(id=503212)