Unverified75% confidenceFactTime unknown
在Velse AI 4月23日的最新排名中,Kimi K2.6排第一,DeepSeek V4排第二,两者仅差0.07个百分点
1
Sources
75%
Confidence
Medium-term (~90 days)
Relevance
5/31/2026
First Seen
Valid until: 8/29/2026
Sources
DeepSeek V4编码实测:榜单第一Kimi翻车,Claude稳居最强
bilibiliAGI_Ananas
Related Entities
Related Claims
UnverifiedKimi K2.6和Claude在SWE-Bench上的性能差距不到1%,但价格差了7倍(Kimi每百万tokens 0.8美金,Claude 5美金)65% similarUnverified在综合性能排名中,Kimi K2.5得分64%,排名第五,前四名分别是Gemini 3 Pro(100%)、Claude Opus 4.5 Max(74%+)、GLM 4.7(65%)和GPT-5.2X(65%)65% similarUnverifiedKimi K2.5的Token用量比排名第二、第三的Gemini和Claude小模型高出50%64% similarUnverifiedK2.7 Code目前尚未公布SWE-Bench成绩,所有性能数据均为月之暗面自报,此前K2.6曾出现自报成绩与第三方复现相差15-20个百分点的情况63% similarUnverified在独立测试者的综合排名中,Claude 4.5 Haiku分别排在第34和第37位,是主流AI实验室新一代模型中得分最低的一个63% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/13852API
curl https://kongchang.com/api/v1/knowledge/claims/13852MCP
get_claim(id=13852)