待验证50% 置信基准精确时间
Soul标准模式得分88.8%,开启Ultra后跃升至91.9%,比Max模式多涨2.7个百分点
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/8
首次发现
有效期至:2026/10/6
来源
GPT-5.6编程基准91.9%:三档模型选择与Ultra模式避坑指南
bilibili费曼学AI2026/6/28
相关事实
待验证旗舰Soul在Terminal Bench 2.1基准上取得91.9%的成绩70% 相似待验证在Health Bench Professional上,Soul达到60.5分,比GPT-5.5高出8.7分68% 相似待验证在Agent's Last Exam基准测试中,GPT-5.6 Soul(extra high档)得分近54%,Fable(max档)为45%61% 相似待验证在Artificial Analysis的Omniscience幻觉指标上,GPT-5.6 Sol Max高达89%,高于Claude Fable的55%和GLM 5.2的28%61% 相似待验证在前端与视觉任务上Soul只能拿到六到七分,而Fable五能拿到九到十分61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/230625API
curl https://kongchang.com/api/v1/knowledge/claims/230625MCP
get_claim(id=230625)