待验证50% 置信观点精确时间
以Qwen、DeepSeek、Llama为代表的开源/开放权重模型阵营正快速缩小与GPT-4o、Claude等顶级闭源模型的差距
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/5
首次发现
有效期至:2026/11/3
来源
相关事实
待验证Meta的Llama 3.1系列、DeepSeek-V3、阿里的Qwen2.5-Coder等开源模型在HumanEval、SWE-bench等代码生成基准上与GPT-4级别模型差距显著收窄77% 相似待验证2024年下半年以来,开源模型的性能已高度逼近闭源模型,Llama、DeepSeek、智谱GLM等开源模型的ELO积分已逼近GPT-4o和Claude 3.577% 相似待验证2023年末开源模型与 GPT-4 的编程能力差距显著,到2024-2025年 DeepSeek Coder、Qwen Coder、Kimi K 系列等国内开源模型已大幅缩小差距76% 相似待验证成熟的开发者应同时掌握国内的DeepSeek、Qwen以及国外的OpenAI GPT-4o、o3、Claude 3.5/3.7/4.0等多个模型76% 相似待验证GPT-4o、Claude 3.5、DeepSeek V3等主流大模型之间的整体能力差距已缩小至5%以内76% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/687617API
curl https://kongchang.com/api/v1/knowledge/claims/687617MCP
get_claim(id=687617)