[KongchangAI]
Unverified50% confidenceFactExact time

2023年多项独立研究表明部分顶级模型在标准数学推理测试中分数极高,但在等价的重新表述版本上成绩大幅下滑,表明模型学习的是测试模式而非真正的推理能力

1
Sources
50%
Confidence
Long-term
Relevance
7/15/2026
First Seen

Sources

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/515034
API
curl https://kongchang.com/api/v1/knowledge/claims/515034
MCP
get_claim(id=515034)