Unverified50% confidenceBenchmarkExact time
在数学难题上SOL和TERRA均拿到满分10分,在自适应微调任务上三款GPT-5.6模型全部满分,而此前GPT-5.5和Opus 4.7在同一任务上仅能拿到两三分
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/11/2026
First Seen
Valid until: 10/9/2026
Sources
GPT-5.6三款模型深度实测:SOL/TERRA/LUNA性能与定价全解析
bilibili薛定猫AI7/9/2026
Related Claims
Partially Verified三个 GPT-5.6 模型在长程代理微调任务上均拿满分 10 分,而 GPT-5.5 和 Opus 4.7 在该任务只能拿两三分85% similarUnverifiedSam Altman表示由于推理能力提升,GPT-5.5每个任务实际消耗的Token数量少于GPT-5.476% similarUnverifiedOpenAI 官方称 GPT-5.6 索拉纳执行同等复杂度编程任务时仅消耗 GPT-5.5 三分之一的 Token75% similarVerifiedSOL的基准分数几乎是上一代GPT-5.5的两倍,实现了代际跃升,但整体仍落后于Fable 574% similarUnverifiedGPT系模型的Token利用率远高于对手,Sol通常仅用约三分之一的Token量完成同等任务74% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/488171API
curl https://kongchang.com/api/v1/knowledge/claims/488171MCP
get_claim(id=488171)