待验证50% 置信基准精确时间
在性能模型代码构建任务上,GPT-5.6 Sol通过率超过80%
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/11
首次发现
有效期至:2026/12/10
来源
涉及实体
相关事实
待验证GPT-5.6 Sol在BrowseComp浏览任务基准上达到92.2%79% 相似待验证在OpenAI内部基准中,GPT-5.6 Sol在递归自我改进(模型改进任务)上领先GPT-5.5约16分,AI基础设施优化(芯片设计流程)较5.5提升31%77% 相似待验证GPT-5.6 Sol具备持续运行数天的长周期任务能力,只需给定目标即可反复迭代产出详尽结果,且UI生成质量显著提升76% 相似待验证GPT-5.6 Sol在ExploitBench网络安全基准上从GPT-5.5的40%跃升至73.5%75% 相似待验证GPT-5.6 Sol在ARC-AGI-2上取得92.5%的成绩75% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/902746API
curl https://kongchang.com/api/v1/knowledge/claims/902746MCP
get_claim(id=902746)