待验证50% 置信事实精确时间
2023年末开源模型与 GPT-4 的编程能力差距显著,到2024-2025年 DeepSeek Coder、Qwen Coder、Kimi K 系列等国内开源模型已大幅缩小差距
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/7
首次发现
有效期至:2026/10/5
来源
Kimi K2.7 Code实测:High Speed模式跟手感如何?
bilibili御风大世界2026/6/23
相关事实
待验证2023年末开源模型在 SWE-bench 上与 GPT-4 差距显著,闭源模型解决率约为开源模型的2-3倍82% 相似待验证2024年下半年以来,开源模型的性能已高度逼近闭源模型,Llama、DeepSeek、智谱GLM等开源模型的ELO积分已逼近GPT-4o和Claude 3.576% 相似待验证以Qwen、DeepSeek、Llama为代表的开源/开放权重模型阵营正快速缩小与GPT-4o、Claude等顶级闭源模型的差距76% 相似待验证Meta的Llama 3.1系列、DeepSeek-V3、阿里的Qwen2.5-Coder等开源模型在HumanEval、SWE-bench等代码生成基准上与GPT-4级别模型差距显著收窄75% 相似待验证2024年下半年,Meta的Llama系列、DeepSeek、智谱GLM等开源模型的ELO积分已逼近GPT-4o和Claude 3.5的区间,分差压缩至个位数71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/164262API
curl https://kongchang.com/api/v1/knowledge/claims/164262MCP
get_claim(id=164262)