待验证50% 置信基准精确时间
在T3代码改进任务中,GPT-6.1 Sol以87.4分击败Astra(83.8)和Grok 4.7(80.7),成本仅2.15美元
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/10/1
首次发现
有效期至:2026/12/30
来源
涉及实体
相关事实
部分验证GPT-6.1 Sol的API输入和输出token标准价格仅为Astra的五分之一79% 相似待验证GPT-6.1 Sol 是所有单任务成本低于 0.30 美元的模型中得分最高者76% 相似待验证在 DeepSWE 1.1 测试中,GPT-6.1 Sol 得 75.2%,Astra 为 74.8%,Cloud Sonnet 5.5 为 71.0%,GPT-6 Sol 最高 68.8%72% 相似待验证Sol 是三款模型中能力最强的,价格与 GPT-5.5 持平,适合复杂 coding 与长任务场景72% 相似待验证GPT-5.6 Sol在BrowseComp浏览任务基准上达到92.2%71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/964502API
curl https://kongchang.com/api/v1/knowledge/claims/964502MCP
get_claim(id=964502)