待验证50% 置信观点精确时间
长上下文模型在自我审查场景中因锚定效应可能带来更大偏差,早期生成内容对后续注意力计算影响越显著
1
来源数
50%
置信度
长期有效
时效性
2026/7/25
首次发现
来源
Codex插件接入Claude Code:双Agent协作审查代码的新范式
bilibili锋芒AI2026/7/12
相关事实
待验证提示词中靠前的词汇对生成结果影响更大,因为交叉注意力机制对序列开头的token赋予略高的注意力分数79% 相似待验证不同大模型对长上下文中内容位置的敏感度不同,有些对靠前内容更敏感(首因效应),有些对靠后内容更敏感(近因效应),这影响Gotcha追加位置的生效概率79% 相似待验证人类标注者在评估答案时存在信息越丰富越好的认知偏差,导致奖励模型将篇幅与质量隐性挂钩,是模型冗余的成因之一74% 相似待验证同一模型既生成内容又审查内容时存在自我评估偏差(self-evaluation bias)问题72% 相似待验证注意力权重作为可解释性依据存在争议,高注意力权重并不总是对应高因果影响72% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/613222API
curl https://kongchang.com/api/v1/knowledge/claims/613222MCP
get_claim(id=613222)