待验证50% 置信基准精确时间
2024年下半年,Meta的Llama系列、DeepSeek、智谱GLM等开源模型的ELO积分已逼近GPT-4o和Claude 3.5的区间,分差压缩至个位数
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/22
首次发现
有效期至:2026/10/20
来源
相关事实
待验证2024年下半年以来,开源模型的性能已高度逼近闭源模型,Llama、DeepSeek、智谱GLM等开源模型的ELO积分已逼近GPT-4o和Claude 3.584% 相似待验证GPT-4o、Claude 3.5、DeepSeek V3等主流大模型之间的整体能力差距已缩小至5%以内72% 相似已验证2023年至2024年间,GPT-4、Claude 3、Gemini Ultra等主流大语言模型在基准测试上的差距持续收窄,在多数通用任务上已难分伯仲71% 相似待验证2023年末开源模型与 GPT-4 的编程能力差距显著,到2024-2025年 DeepSeek Coder、Qwen Coder、Kimi K 系列等国内开源模型已大幅缩小差距71% 相似待验证智能模型路由概念在2023年后随着GPT-4、Claude、Gemini等旗舰模型与Llama、Mistral等开源小模型的能力差异被基准测试量化后才具备工程化条件71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/592667API
curl https://kongchang.com/api/v1/knowledge/claims/592667MCP
get_claim(id=592667)