Unverified50% confidenceBenchmarkExact time
使用多智能体验证流程时MARCH的准确率被压低到4.4%,而同一模型被直接问哪个更好时准确率能达到43.7%
1
Sources
50%
Confidence
Long-term
Relevance
9/28/2026
First Seen
Sources
Related Entities
Related Claims
Unverified4比特量化相较于FP16通常会导致0.5-2%的基准测试精度下降77% similarUnverified当向模型提供完整公司记录时,严格准确率反而从41%下降到18%,同时召回率上升,精确率崩溃76% similarVerified如果每步准确率为95%,经过20步循环后整体准确率会降至约36%75% similarVerified研究表明在 Q4 及以上精度时,大多数任务的性能损失在 1–3% 以内75% similarUnverified在标准行人检测数据集(如MOTChallenge)上训练的模型,在俯视视角下的检测精度(mAP)通常下降40%-60%75% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/955489API
curl https://kongchang.com/api/v1/knowledge/claims/955489MCP
get_claim(id=955489)