待验证50% 置信事实精确时间
修复前模型每约29次下一token预测中约有1次的选择与数学上应有结果不同
1
来源数
50%
置信度
长期有效
时效性
2026/7/25
首次发现
来源
三行代码修复:Tesla P100在llama.cpp中精度提升2300倍
redditr/LocalLLaMA2026/7/12
相关事实
待验证马尔可夫头仅需记录前一个token状态即可推导下一token修正概率,参数量通常不超过原模型的0.1%71% 相似待验证2023年多项独立研究表明部分顶级模型在标准数学推理测试中分数极高,但在等价的重新表述版本上成绩大幅下滑,表明模型学习的是测试模式而非真正的推理能力67% 相似待验证该研究发现同一模型不同部署时间点在代码生成和逻辑推理任务上通过率可能出现10%至20%的显著波动,且方向不总是单向改善67% 相似待验证同一个基座模型在不同系统提示词下的表现差异可以高达30-50个百分点65% 相似待验证在8个模型均随机猜测的假设下,单次二元预测中至少有一个押中的概率约99.6%65% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/613155API
curl https://kongchang.com/api/v1/knowledge/claims/613155MCP
get_claim(id=613155)