待验证50% 置信事实精确时间
纯大模型存在知识截止问题和幻觉问题两大天然缺陷,GPT-4的训练数据存在明确的截止日期
1
来源数
50%
置信度
长期有效
时效性
2026/7/6
首次发现
来源
Dify构建RAG问答工作流实战:四步搭建企业知识库机器人
bilibiliAI大模型大课堂2026/6/30
相关事实
待验证GPT-4、Claude、Gemini等主流模型在知识截止日期之后的问题、多跳推理任务和长尾知识领域,其置信度与准确率之间存在显著偏差82% 相似待验证主流大模型(包括GPT-4、DeepSeek、Claude等)均基于静态语料库训练,存在明确的知识截止日期80% 相似待验证GPT-4等大模型在参数规模突破某一阈值后自发涌现出逻辑推理、代码生成等未经专门训练的能力,这一现象称为涌现能力80% 相似待验证GPT-4和Claude等主流模型的训练数据截止于某个特定时间点,对此后发生的事件一无所知79% 相似待验证OpenAI的API端点名称不变时底层模型权重可能被静默更新,2023年Stanford和UC Berkeley联合研究发现GPT-4在不同时期对相同prompt的表现存在显著差异,某些任务准确率从97%骤降到2%73% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/115301API
curl https://kongchang.com/api/v1/knowledge/claims/115301MCP
get_claim(id=115301)