待验证50% 置信事实精确时间
GPT系模型的Token利用率远高于对手,Sol通常仅用约三分之一的Token量完成同等任务
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/12
首次发现
有效期至:2026/10/10
来源
GPT-5.6实测对比:便宜20倍但创意能力输给旗舰模型
bilibili小牛AI_XNAI2026/7/10
相关事实
部分验证三个 GPT-5.6 模型在长程代理微调任务上均拿满分 10 分,而 GPT-5.5 和 Opus 4.7 在该任务只能拿两三分77% 相似待验证在数学难题上SOL和TERRA均拿到满分10分,在自适应微调任务上三款GPT-5.6模型全部满分,而此前GPT-5.5和Opus 4.7在同一任务上仅能拿到两三分74% 相似待验证官方称Sol在完成同类任务时相比GPT-5.5消耗的Token更少74% 相似待验证GPT-5.6 Sol在BrowseComp浏览任务基准上达到92.2%73% 相似待验证Sol 是三款模型中能力最强的,价格与 GPT-5.5 持平,适合复杂 coding 与长任务场景71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/492232API
curl https://kongchang.com/api/v1/knowledge/claims/492232MCP
get_claim(id=492232)