待验证80% 置信基准精确时间
Claude Opus 5 approaches Fable-level performance on the FrontierCode 1.1 benchmark while costing only half as much
1
来源数
80%
置信度
中期 (~90 天)
时效性
2026/7/23
首次发现
来源
涉及实体
相关事实
待验证在 Frontier Code 准确率与成本基准测试中,低档位花费约 5 美元可达约 11% 得分,而 Opus 4.8 Max 花费约 11 美元才拿到相同得分76% 相似待验证Claude Opus 5能力接近上一代旗舰Opus水平,但推理成本显著降低68% 相似已验证Claude Opus 4.8的输入/输出token比价为1:568% 相似待验证Opus 5 在 Low Effort 下的通过率约为 60%,超过了 Opus 4.8 在 Max 级别下的 59%,后者单任务成本高达 13 美元66% 相似待验证上一代Claude OPUS在某高难度榜单上的成功率仅为1.4%,而Fable 5达到约30%,提升超过20倍65% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/680219API
curl https://kongchang.com/api/v1/knowledge/claims/680219MCP
get_claim(id=680219)