待验证50% 置信基准精确时间
豆包2.1 Pro在仓库级代码生成评测中得分47.0
1
来源数
50%
置信度
长期有效
时效性
2026/9/16
首次发现
来源
涉及实体
相关事实
待验证豆包2.1 Pro在科学计算代码评测SciCode中得到59.8分79% 相似待验证SWE-2在FrontierCode 1.1 Main基准测试上取得了50.0%的成绩70% 相似待验证根据SWE-Bench Verified基准测试,Qwen 2.5 Coder 32B的编码能力评分达到61.7分65% 相似待验证GLM-5.3在六项评测中的成绩为:终端编程基准3.0得28.3、深度软件工程基准得66.9、智能体中场考试得28.5、自动化基准得48.2、带工具的人类终极考试得62.5、GDP价值评估AA2版得17.6963% 相似待验证Fable 5.1 在 Terminal Bench Science 0.1 基准测试中得分 52.6%,相比上一代翻了一倍多63% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/925845API
curl https://kongchang.com/api/v1/knowledge/claims/925845MCP
get_claim(id=925845)