待验证50% 置信基准精确时间
在RULER-16K数据集的等预算对照实验中,KVFetch使逐字拷贝得分从0.8恢复到78.4
1
来源数
50%
置信度
长期有效
时效性
2026/10/8
首次发现
来源
涉及实体
相关事实
待验证在RULER-16K实验中,KVFetch使13项任务的平均分提升了+8.4,增益主要集中在需要顺序访问的任务上65% 相似待验证经验内化微调把Qwen3-8B-27B的一次性得分从37.07提升到48.22,同时生成Token从641万降到57万(减少11倍)59% 相似待验证使用Reflective Recovery,DeepSeek-R1-Distill-Qwen-7B在AIME 2025上准确率从30.0%提升至37.5%59% 相似待验证该量化模型相较于BF16全精度版本保留了约77%的准确率58% 相似待验证在分歧富集数据集上,gpt-4o-mini裁判与两位作者共同确认的黄金标准之间的Cohen's kappa一致性系数仅为0.0458% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/986758API
curl https://kongchang.com/api/v1/knowledge/claims/986758MCP
get_claim(id=986758)