Unverified50% confidenceFactExact time
2023年末开源模型在 SWE-bench 上与 GPT-4 差距显著,闭源模型解决率约为开源模型的2-3倍
1
Sources
50%
Confidence
Long-term
Relevance
7/7/2026
First Seen
Sources
Kimi K2.7 Code实测:High Speed模式跟手感如何?
bilibili御风大世界6/23/2026
Related Claims
Unverified2023年末开源模型与 GPT-4 的编程能力差距显著,到2024-2025年 DeepSeek Coder、Qwen Coder、Kimi K 系列等国内开源模型已大幅缩小差距82% similarUnverified2024年下半年以来,开源模型的性能已高度逼近闭源模型,Llama、DeepSeek、智谱GLM等开源模型的ELO积分已逼近GPT-4o和Claude 3.581% similarUnverified以GPT-4发布为节点,闭源模型曾一度领先开源阵营超过一年78% similarUnverified以Qwen、DeepSeek、Llama为代表的开源/开放权重模型阵营正快速缩小与GPT-4o、Claude等顶级闭源模型的差距73% similarVerifiedGPT-5.5是OpenAI于2025年中期发布的模型,相比GPT-4o在推理深度和上下文理解方面有显著提升72% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/168427API
curl https://kongchang.com/api/v1/knowledge/claims/168427MCP
get_claim(id=168427)