待验证50% 置信事实精确时间
2023年末开源模型在 SWE-bench 上与 GPT-4 差距显著,闭源模型解决率约为开源模型的2-3倍
1
来源数
50%
置信度
长期有效
时效性
2026/7/7
首次发现
来源
Kimi K2.7 Code实测:High Speed模式跟手感如何?
bilibili御风大世界2026/6/23
相关事实
待验证2023年末开源模型与 GPT-4 的编程能力差距显著,到2024-2025年 DeepSeek Coder、Qwen Coder、Kimi K 系列等国内开源模型已大幅缩小差距82% 相似待验证2024年下半年以来,开源模型的性能已高度逼近闭源模型,Llama、DeepSeek、智谱GLM等开源模型的ELO积分已逼近GPT-4o和Claude 3.581% 相似待验证以GPT-4发布为节点,闭源模型曾一度领先开源阵营超过一年78% 相似待验证以Qwen、DeepSeek、Llama为代表的开源/开放权重模型阵营正快速缩小与GPT-4o、Claude等顶级闭源模型的差距73% 相似已验证GPT-5.5是OpenAI于2025年中期发布的模型,相比GPT-4o在推理深度和上下文理解方面有显著提升72% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/168427API
curl https://kongchang.com/api/v1/knowledge/claims/168427MCP
get_claim(id=168427)