Unverified50% confidenceFactExact time
SWE-2基于Kimi K3进行后训练(post-trained),并采用强化学习(RL)方法,同时对成本与能力两个维度进行优化
1
Sources
50%
Confidence
Long-term
Relevance
9/13/2026
First Seen
Sources
Related Entities
Related Claims
Unverified月之暗面称Kimi K3的框架和数据训练方法使整体扩展效率较上一代Kimi K2提升约2.5倍72% similarUnverifiedKimi K3的智能水平并非依赖堆算力路线,而是通过更精巧的架构与训练策略实现71% similarUnverifiedHY3引入了改进的抗幻觉技术、更可靠的工具调用能力,并使用更高质量后训练数据和强化的强化学习策略68% similarUnverifiedKimi K2.6能根据问题复杂度自适应调整输出长度,这一能力通过Post Training阶段的长度校准技术实现67% similarUnverified后训练优化包括指令微调、RLHF或DPO策略调整、系统提示词工程改进及工具调用和多模态融合能力强化66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/918904API
curl https://kongchang.com/api/v1/knowledge/claims/918904MCP
get_claim(id=918904)