待验证50% 置信基准精确时间
Claude Opus 5.5在'max'最高思考强度下生成鹈鹕SVG时撞上128,000 token的最大输出上限而未能返回结果
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/23
首次发现
有效期至:2026/12/22
来源
涉及实体
相关事实
待验证Claude Opus 4.8在智能体实战跑分中拿下1890分,比上一代高出137分,甩开GPT 5.5达121分71% 相似待验证Opus 4.7每次解题的中位输出token数为60,000,而GPT 5.5仅需16,00070% 相似待验证Opus 5 在 Low Effort 下的通过率约为 60%,超过了 Opus 4.8 在 Max 级别下的 59%,后者单任务成本高达 13 美元69% 相似部分验证Claude Opus 4.8在SWE-bench基准测试中得分69.2%,GPT 5.5为58.6%,Google Gemini为54.2%67% 相似待验证在纯SVG等角投影微型城市绘制任务中,Claude Opus 4.8获得7/10分,为五个模型中最高分66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/942281API
curl https://kongchang.com/api/v1/knowledge/claims/942281MCP
get_claim(id=942281)