待验证50% 置信基准精确时间
模型探测工具三分钟即可完成约 28 个模型的探测,支持模型池包括 Opus 5、Opus 5.5、GPT-6 Astra、Sonnet 5 等
1
来源数
50%
置信度
短期 (~14 天)
时效性
2026/9/29
首次发现
有效期至:2026/10/13
来源
涉及实体
相关事实
待验证在图片隐藏虫子识别测试中,Sonnet 5的Max模式花费约10分钟并识别结果完全正确,而Gemini顶配模型只找到4只,GPT-5.5 X-High未能检测出68% 相似待验证本次测试选取了五款AI模型:DeepSeek R1、Claude Sonnet 3.7、ChatGPT o3 Mini、Grok 3、通义千问2.5 Max,通过统一提示词让它们各自生成可运行的网页版贪吃蛇游戏64% 相似待验证在智能体搜索测试中,Sonnet 5 各 effort level 下均优于 Sonnet 4.6,但整体性能低于 Opus 4.8,综合约在 Opus 4.7 级别63% 相似待验证在苏州博物馆Three.js场景任务中,Sonnet 5 Max搭配Claude官方Harness花了超过一小时仍未完成,但地面材质、盆景倒影等质感在测试过的所有模型中最好62% 相似待验证Codex模型列表包含5.3 Codex、5.4 Mini、5.4、5.5及三个5.6模型,从5.4开始的模型均带有Fast加速标记61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/958675API
curl https://kongchang.com/api/v1/knowledge/claims/958675MCP
get_claim(id=958675)