待验证60% 置信观点精确时间
实测者认为在SVG生成任务上Sonnet 5表现远不及Opus,其设计品味甚至不及开源模型GLM 5.2
2
来源数
60%
置信度
中期 (~90 天)
时效性
2026/7/6
首次发现
有效期至:2026/10/4
来源
Claude Sonnet 5实测:隐藏的Token陷阱让「低价」成幻觉
bilibili浮生千山路w2026/6/30
相关事实
待验证Muse Spark 1.1能力大致对标Anthropic的Sonnet 4.5或GLM 5.2,某些内部基准逼近Opus级别67% 相似待验证目前具备任务拆分给子智能体能力的模型只有 5.6 Sol、Fable 5/Mythos 和 Sonnet 563% 相似待验证Gemini 3.2 Pro的UI生成能力表现薄弱,相比SVG方面的提升并不明显62% 相似待验证此前的PokeAgent挑战证明,即使是GPT-4V、Gemini等顶级多模态模型,在没有专门设计的辅助框架时,几乎无法在宝可梦RPG中取得任何进展59% 相似待验证GPT 5.5 Image 2.0与Gemini Pro在科研绘图场景下的差距是'能用vs不能用'的本质区别59% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/113027API
curl https://kongchang.com/api/v1/knowledge/claims/113027MCP
get_claim(id=113027)