Unverified50% confidenceBenchmarkExact time
斯坦福大学2023年的研究表明,GPT-4在开放域问答任务上的准确率比传统NLU系统高出约40个百分点
1
Sources
50%
Confidence
Long-term
Relevance
7/12/2026
First Seen
Sources
OpenAI布局家庭市场:ChatGPT如何成为全家人的AI助手
rss7/11/2026
Related Claims
UnverifiedOpenAI的API端点名称不变时底层模型权重可能被静默更新,2023年Stanford和UC Berkeley联合研究发现GPT-4在不同时期对相同prompt的表现存在显著差异,某些任务准确率从97%骤降到2%79% similarVerified斯坦福大学曾发布研究报告,记录了GPT-4在特定任务上跨时间段的性能波动79% similarUnverified斯坦福大学2024年的AgentBench基准测试显示,GPT-4级别模型在需要跨系统协调的复杂任务中端到端成功率低于30%77% similarUnverifiedGPT-4在面对包含5个以上具体领域细节的提示时,任务完成率比模糊提示高出约40%76% similarUnverified经过优化的提示词可以将GPT-4在特定任务上的准确率从60%提升至95%以上75% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/492616API
curl https://kongchang.com/api/v1/knowledge/claims/492616MCP
get_claim(id=492616)