Unverified50% confidenceBenchmarkExact time
模型在篇章级排序任务中的标准准确率仅为 0% 到 13%
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
9/18/2026
First Seen
Valid until: 12/17/2026
Sources
Related Entities
Related Claims
Unverified领域微调后的7B模型在任务准确率上往往超越未经微调的70B通用模型,同时推理成本降低一个数量级72% similarUnverified对于 7B 模型,使用求解器准确率为 75.31%,直接计算为 72.02%,配对提升 +3.29 个百分点,95% 聚类区间为 [-3.49, 10.38] 跨越零点,优势不显著72% similarUnverified在实验中,零样本生成任务解决率为17%,通用自我纠错为27%,仅错误反馈为23%,诊断性反例反馈(A-CEGIS)达到90%71% similarUnverified业界仿真精度评估通常要求吞吐量误差小于15%70% similarUnverified对于代码补全、语法检查等结构化任务,7B-13B参数量的小模型可达到90%以上准确率,推理成本仅为顶级模型的1/50甚至更低69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/931189API
curl https://kongchang.com/api/v1/knowledge/claims/931189MCP
get_claim(id=931189)