Unverified50% confidenceBenchmarkExact time
2018年之前的模型与2019年后采用Margin-based Loss的模型在同一基准上准确率可能相差5-10个百分点
1
Sources
50%
Confidence
Long-term
Relevance
8/7/2026
First Seen
Sources
Related Claims
UnverifiedLLM新模型的平均评估指标可能优于旧模型,但会在小众关键场景中出现退化67% similarUnverified经过良好校准的FP8推理,模型输出质量损失通常可控制在1%以内67% similarUnverified2024年多项研究发现,部分模型在去污染版本的评测集上得分下降幅度可达10-20个百分点66% similarUnverified测试损失与计算量之间的幂律指数约为0.05,意味着计算量每增加10倍,模型性能提升约12%66% similarUnverified据行业估算,2023年至2025年间,同等质量的LLM推理成本下降了约10-50倍66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/705639API
curl https://kongchang.com/api/v1/knowledge/claims/705639MCP
get_claim(id=705639)