Unverified50% confidenceBenchmarkExact time
GPT模型在回忆能力单独测试中表现糟糕,在空间信息、转录内容、物理实验等所有类别上仅约50%事实被正确回忆,开源模型更差
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/17/2026
First Seen
Valid until: 10/15/2026
Sources
Related Claims
Unverified多模态大模型在视频问答的事实回忆准确率极低,即便经过监督微调也难以改善73% similarUnverified在max模式下GPT-5.6的得分反而略低于ultra,印证了过度思考现象69% similarUnverifiedGPT 5.2在前沿科学基准的竞赛题中得分约77%,但在开放式研究任务中表现下降到约25%69% similarUnverified研究团队在GPT-2等模型上的实验表明,仅经过5-9代递归训练,模型输出质量就会出现显著退化69% similarUnverified研究表明,当上下文超过一定长度后,模型对中间部分内容的回忆准确率可能下降到50%以下69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/543117API
curl https://kongchang.com/api/v1/knowledge/claims/543117MCP
get_claim(id=543117)