Unverified50% confidenceFactExact time
困惑度是测试集上每个token平均负对数似然的指数,值越低代表模型对语料的预测越准确
1
Sources
50%
Confidence
Long-term
Relevance
7/14/2026
First Seen
Sources
不到350元训练亿参数模型:SmoLLM从零构建全记录
redditr/learnmachinelearning7/12/2026
Related Claims
Unverified对比学习中的推远操作只要求负样本相似度低于正样本,并不要求达到-1的极端值77% similarUnverified多重比较问题指同时测试多个模型变体时,即使每个单独检验显著性水平设为0.05,整体假阳性率也会急剧膨胀76% similarUnverified在正负样本极度不均衡的场景(如欺诈检测)中,单纯看准确率作为评估指标毫无意义72% similarUnverified评估基准测试质量的关键指标是假阳性率和假阴性率,理想基准应将两者控制在较低水平71% similarUnverifiedInfoNCE 损失通过在一批候选中最大化正样本对相似度、最小化负样本对相似度进行训练,温度超参数τ越小分布越集中71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/503156API
curl https://kongchang.com/api/v1/knowledge/claims/503156MCP
get_claim(id=503156)