Unverified50% confidenceFactExact time
Cursor used RLHF (Reinforcement Learning from Human Feedback) training on the open-source Kimi K2 model using data from real user programming interactions to produce Composer 2.5.
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/2/2026
First Seen
Valid until: 9/30/2026
Sources
Related Claims
UnverifiedCursor利用用户在IDE中接受或拒绝代码建议、修改AI生成代码等隐式反馈作为RLHF训练信号,对Kimi K2进行强化训练78% similarVerifiedCursor团队正式发布了自研编程模型Composer 2.5,基于Kimi K2.5开源检查点训练73% similarUnverifiedCursor的Composer2是基于Kimi 2.5训练的,Kimi 2.5是一个拥有1万亿参数的混合专家模型,活跃参数为300亿72% similarUnverifiedCursor在Kimi KR基础上进行了强化学习微调,用大量高质量编程任务数据对模型进行专业化训练70% similarUnverifiedCursor与Fireworks合作构建了Composer2的分布式强化学习基础设施63% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/43941API
curl https://kongchang.com/api/v1/knowledge/claims/43941MCP
get_claim(id=43941)