Unverified50% confidenceBenchmarkExact time
o1单次请求成本是常规对话的5-10倍,在数学奥林匹克竞赛、Codeforces编程竞赛等任务上表现优于GPT-4
1
Sources
50%
Confidence
Long-term
Relevance
9/9/2026
First Seen
Sources
Related Entities
Related Claims
Unverifiedo1模型在国际数学奥林匹克预选题上的表现接近金牌水平,在Codeforces编程竞赛中达到了89百分位66% similarUnverified在业务自动化评测中,相同单任务成本下Opus 5的通过率约为次优模型的1.5倍65% similarUnverified据业内估算,一次高强度推理请求的计算成本可能是普通请求的5-10倍64% similarUnverifiedo1在国际数学奥林匹克级别问题上正确率超过80%,远高于GPT-4的约13%63% similarUnverified一个浏览器控制Agent任务可能需要模型进行10-50次连续推理,其单位成本远高于普通问答查询61% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/881594API
curl https://kongchang.com/api/v1/knowledge/claims/881594MCP
get_claim(id=881594)