待验证50% 置信事实精确时间
一些推理增强型模型(如DeepSeek-R1、Kimi K3)会生成非常长的思维链,有时推理过程的Token数量是最终答案的数十倍
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/26
首次发现
有效期至:2026/11/24
来源
涉及实体
相关事实
待验证推理模型以OpenAI o系列、DeepSeek-R1、Kimi K系列为代表,在输出前进行思维链过程,对问题进行多步拆解、自我验证和逐步推导80% 相似待验证推理模型(如OpenAI的o1/o3系列、Anthropic的Claude with extended thinking、DeepSeek-R1)在生成最终答案前会先输出思考过程(thinking tokens)79% 相似待验证Kimi模型在使用思维链推理时偶尔会陷入冗长的推理token循环,在两个相互矛盾的结论之间来回摇摆78% 相似待验证Kimi K3属于推理模型类别,通过强化学习训练使模型在生成最终答案前进行显式思维链推演77% 相似待验证Kimi K3内置常开的思考模式,默认在生成回答前进行推理链条思考76% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/804746API
curl https://kongchang.com/api/v1/knowledge/claims/804746MCP
get_claim(id=804746)