Unverified50% confidenceBenchmarkExact time
一个早期迭代版本在IFEval指令遵循基准测试上比Huihui母模型低了五个百分点
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
9/12/2026
First Seen
Valid until: 12/11/2026
Sources
Related Entities
Related Claims
Unverified在Artificial Analysis智能指数综合测试中,GPT-5.6性能比Claude Opus 4.5略低约0.9分,但成本几乎减半70% similarUnverified在MATH数据集的Level 5竞赛级难题上,前沿模型准确率仍低于60%67% similarUnverified通过一系列策略调整,Opus 5 的使用成本最多可降低 80%,且在部分基准测试中仍能跑赢 Opus 4.867% similarUnverified轻量版模型单次推理的算力消耗往往只有旗舰版本的十分之一甚至更低66% similarVerified对于参数量大于30B的模型,4-bit量化造成的性能损失通常在基准测试中下降1-3%,但对小模型影响更显著65% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/913195API
curl https://kongchang.com/api/v1/knowledge/claims/913195MCP
get_claim(id=913195)