Unverified50% confidenceCautionExact time
ROUGE指标存在长度偏差:生成较短摘要的模型在精确率占优,较长摘要模型在召回率占优,且ROUGE不能衡量事实一致性
1
Sources
50%
Confidence
Long-term
Relevance
9/23/2026
First Seen
Sources
Related Entities
Related Claims
Unverified长提示词存在执行衰减问题:约束条件越多,实际输出与文本描述的偏差越大,提示词写得越细不等于模型执行得越准75% similarUnverified少步数生成方案存在质量与速度的权衡:步数过少时模型难以修正早期误差,可能导致细节模糊或运动不自然74% similarUnverified研究揭示LLM并不像理想的贝叶斯智能体那样根据证据可靠性进行合理加权更新,而是表现出接近分布倾斜的行为模式,其影响与证据真实可靠性的关联比贝叶斯框架预期的弱74% similarUnverified探针准确率的高低反映的是信息的线性可分离程度,而非模型是否有意表征该概念73% similarUnverified提示词越模糊,模型输出越向高概率区域坍缩,一致性越强73% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/942882API
curl https://kongchang.com/api/v1/knowledge/claims/942882MCP
get_claim(id=942882)