Unverified50% confidenceBenchmarkExact time
2024年下半年,Meta的Llama系列、DeepSeek、智谱GLM等开源模型的ELO积分已逼近GPT-4o和Claude 3.5的区间,分差压缩至个位数
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/22/2026
First Seen
Valid until: 10/20/2026
Sources
Related Claims
Unverified2024年下半年以来,开源模型的性能已高度逼近闭源模型,Llama、DeepSeek、智谱GLM等开源模型的ELO积分已逼近GPT-4o和Claude 3.584% similarUnverifiedGPT-4o、Claude 3.5、DeepSeek V3等主流大模型之间的整体能力差距已缩小至5%以内72% similarVerified2023年至2024年间,GPT-4、Claude 3、Gemini Ultra等主流大语言模型在基准测试上的差距持续收窄,在多数通用任务上已难分伯仲71% similarUnverified2023年末开源模型与 GPT-4 的编程能力差距显著,到2024-2025年 DeepSeek Coder、Qwen Coder、Kimi K 系列等国内开源模型已大幅缩小差距71% similarUnverified智能模型路由概念在2023年后随着GPT-4、Claude、Gemini等旗舰模型与Llama、Mistral等开源小模型的能力差异被基准测试量化后才具备工程化条件71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/592667API
curl https://kongchang.com/api/v1/knowledge/claims/592667MCP
get_claim(id=592667)