待验证50% 置信基准精确时间
CLM-8B经过轻量微调后在DeepSWE等智能体编程基准上创下81.6%的新SOTA(Pass@1)
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/30
首次发现
有效期至:2026/12/29
来源
涉及实体
相关事实
待验证DeepSeek的编程智能体DeepSWE在SWE-bench基准测试中从预览版的12.8分提升至62.7分66% 相似待验证DeepSeek发布了蒸馏版模型DeepSeek-R1-0528-Qwen3-8B,用R1-0528蒸馏千问三8B得到,支持深度思考、Function Calling并对MCP做了专项优化63% 相似待验证DeepSeek反推模型提供1B和7B两个版本62% 相似待验证DeepSeek-Math 7B是7B参数的开源数学大模型,其RL版本加工具调用在MATH基准上能达到约60%准确率,接近GPT-4水平61% 相似待验证DeepSeek V4.1 Flash在Deep SWE软件工程代码测试上拿到74分,是UP主见过的第一个在Deep SWE上达到74分的开放权重模型61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/960775API
curl https://kongchang.com/api/v1/knowledge/claims/960775MCP
get_claim(id=960775)