待验证50% 置信事实精确时间
2023年斯坦福大学研究实验证明,当关键信息被放置于输入文档中间位置时,GPT-4的正确召回率相比首尾位置下降约20-30%
1
来源数
50%
置信度
长期有效
时效性
2026/7/8
首次发现
来源
半AI模式:接口自动化测试落地实践指南
bilibili京东测试工程师2026/7/6
相关事实
待验证斯坦福大学2023年研究表明,GPT-4V等多模态模型解析嵌套条件逻辑流程图时,准确率比等效文字描述低约15-25个百分点78% 相似待验证斯坦福大学2023年研究表明,即便是当时最先进的模型,在处理超过32K Token的上下文时,对中间段落的信息提取准确率会下降30%至50%77% 相似待验证斯坦福大学2023年发布的Lost in the Middle研究(Liu et al.)显示,当关键信息位于上下文中间段时,模型检索准确率相比头部和尾部下降约20-30个百分点,且在上下文超过32K token时尤为显著75% 相似待验证一项针对GPT-4的研究显示,对MMLU题目进行语义等价改写后,模型准确率在部分子集上下降超过10个百分点75% 相似已验证微软、谷歌等公司的内部研究表明,即便是GPT-4级别的模型在法律、财务、医疗等垂直领域的事实错误率可能高达15%-30%74% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/246357API
curl https://kongchang.com/api/v1/knowledge/claims/246357MCP
get_claim(id=246357)