待验证60% 置信事实时间未知
Composer的基准测试数据是内部闭源基准,未与Claude、GPT-5或Gemini直接对比,也未出现在LM Arena或SWE-Bench等外部基准上
2
来源数
60%
置信度
中期 (~90 天)
时效性
2026/6/2
首次发现
有效期至:2026/8/31(已过期)
来源
Cursor 2.0 深度解析:自研模型Composer与五大核心功能全面升级
bilibili留给时间检验
涉及实体
相关事实
待验证Composer 2.5在Terminal Bench 2.0、Suite Bench Multilingual和Cursor Bench等基准测试中,某些测试上已超越Opus和GPT 5.570% 相似待验证Composer 2.5在SweepBench多语言测试中与Claude Opus 4.7和GPT 5.5属于同一梯队70% 相似待验证根据Cursor内部Benchmark数据,Composer 2.5的能力仅次于OPPO 4.7 Max和GPT 5.5 Extra High66% 相似待验证测试者评价GPT-5.6在前端设计上已具备类似Kimi和Gemini的审美水准66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/36962API
curl https://kongchang.com/api/v1/knowledge/claims/36962MCP
get_claim(id=36962)