待验证80% 置信事实时间未知
Kimi K2.5在AMM5 2025综合能力测试中获得96.1分,在GPQA Diamond高难度问题测试中获得87.6分
1
来源数
80%
置信度
中期 (~90 天)
时效性
2026/6/1
首次发现
有效期至:2026/8/30
来源
Kimi K2.5深度测评:性能逼近GPT-5却只要1/4价格
bilibili闲人与杂谈
涉及实体
相关事实
待验证Kimi K2.7与GLM 5.2在FrontierCode Extended基准测试中均取得优异成绩69% 相似待验证Kimi K2.6在SWE-Bench Pro测试中获得58.6%的分数,位居开源模型第一67% 相似待验证Kimi K2.7 Code在MCP Mark Verified基准测试上得分81.1,相比K2.6的72.8提升11.4%65% 相似已验证Kimi K2.6采用混合专家(MoE)架构,总参数量达1万亿级别,实际激活参数仅32B64% 相似待验证Kimi K2.6在SWE Bench Pro、深度搜索问答和Humanity's Last Exam等顶级基准测试上与GPT 5.4、Claude Opus 4.6和Gemini 3.1 Pro等闭源模型竞争64% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/24245API
curl https://kongchang.com/api/v1/knowledge/claims/24245MCP
get_claim(id=24245)