Unverified50% confidenceBenchmarkExact time
在T3代码改进任务中,GPT-6.1 Sol以87.4分击败Astra(83.8)和Grok 4.7(80.7),成本仅2.15美元
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
10/1/2026
First Seen
Valid until: 12/30/2026
Sources
Related Entities
Related Claims
Partially VerifiedGPT-6.1 Sol的API输入和输出token标准价格仅为Astra的五分之一79% similarUnverifiedGPT-6.1 Sol 是所有单任务成本低于 0.30 美元的模型中得分最高者76% similarUnverified在 DeepSWE 1.1 测试中,GPT-6.1 Sol 得 75.2%,Astra 为 74.8%,Cloud Sonnet 5.5 为 71.0%,GPT-6 Sol 最高 68.8%72% similarUnverifiedSol 是三款模型中能力最强的,价格与 GPT-5.5 持平,适合复杂 coding 与长任务场景72% similarUnverifiedGPT-5.6 Sol在BrowseComp浏览任务基准上达到92.2%71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/964502API
curl https://kongchang.com/api/v1/knowledge/claims/964502MCP
get_claim(id=964502)