Unverified45% confidenceFactTime unknown
GPT-5.4相对于GPT-5.2,单独声明出错的概率降低了33%,整个回复包含任何错误的概率降低了18%
1
Sources
45%
Confidence
Medium-term (~90 days)
Relevance
5/31/2026
First Seen
Valid until: 8/29/2026
Sources
GPT-5.4深度评测:原生计算机使用、推理编程合体,OpenAI重回王座
bilibiliTerminator-AI
Related Entities
Related Claims
Unverified一项针对GPT-4的研究显示,对MMLU题目进行语义等价改写后,模型准确率在部分子集上下降超过10个百分点74% similarVerified从GPT-4到GPT-5.4,每token推理成本下降了约97%,这一变化发生在两年内73% similarUnverified斯坦福大学2023年研究表明,GPT-4V等多模态模型解析嵌套条件逻辑流程图时,准确率比等效文字描述低约15-25个百分点73% similarVerified微软、谷歌等公司的内部研究表明,即便是GPT-4级别的模型在法律、财务、医疗等垂直领域的事实错误率可能高达15%-30%71% similarUnverified2023年斯坦福大学研究实验证明,当关键信息被放置于输入文档中间位置时,GPT-4的正确召回率相比首尾位置下降约20-30%71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/13760API
curl https://kongchang.com/api/v1/knowledge/claims/13760MCP
get_claim(id=13760)