Sonnet 5.5
Anthropic推出的Claude Sonnet系列新版本,属于Claude模型家族中的中端产品线
Core Facts
Timeline (last 90 days)
Anthropic的Opus和Sonnet 5.5取消了无推理选项,Haiku 5.5保留了该选项但在该模式下表现不好
Anthropic官方已确认Sonnet 5.5将在未来几周内到来
Haiku 5.5可以作为子代理(sub-agent)与Claude Opus 5.5和Sonnet 5.5搭配完成编程工作
OpenTandem 把 Claude Code 的使用方式从命令行搬到了网页和手机上,让非技术背景用户也能调用 Sonnet 5.5,并在不同设备间衔接任务
Gemini 4 Argon 在 Vals Dex 榜单上排名第一,超越 Sonnet 5.5 和 Claude Opus 5.5
开发者Kun Chen认为Sonnet适合执行任务、Opus适合规划有歧义的产品难题
Anthropic先推出Opus 5.5随后推出性能接近但价格仅一半的Sonnet 5.5,OpenAI用GPT 6.1 Sol复刻了同样的打法
有用户使用 Sonnet 5.5 完成 Jellyfin 自定义插件的 JS 重写等复杂任务
Theo建议应避开low档和Max档,使用medium档大致够用
Sonnet 5.5在前端设计上明显不如Opus,远不如Fable,而Theo认为Fable 5.1是最佳设计模型
40 more timeline events
All Facts (20)
Claude Sonnet 5.5 在终端(Terminal)基准上达到 70.6%,而上一代仅有 10.3%
75%VerifiedGPT-6.1 Sol与Sonnet 5.5每百万Token价格一致,均为输入2美元、输出10美元
70%Verified官方称Sonnet 5在推理、工具使用、编码和知识工作方面相比Sonnet 4.6均有显著提升,整体性能已逼近OPUS 4.8但价格更低
70%VerifiedSonnet 5.5的缓存读取成本维持在每百万token 20美分没有下降,而Fable 5.1砍了90%、Opus砍了约60%
65%Partially VerifiedMax模式抬高推理token的下限而非上限,强制模型达到一定推理量才算完成,常常损害性能
65%Partially VerifiedSonnet 5.5在网络攻防能力上与Opus 5.5处于同一水准,是Sonnet系列中首款采用同等网络安全防护机制的模型
65%Partially VerifiedOpus 5.5 在输出 token 上比 Sonnet 5.5 多出约 49%,对应的 API 等价成本几乎贵了一半
65%UnverifiedSonnet 5.5成为首个仅通过截图读取和操作就通关《精灵宝可梦红》的Sonnet模型
60%UnverifiedAnthropic的Opus和Sonnet 5.5取消了无推理选项,Haiku 5.5保留了该选项但在该模式下表现不好
50%UnverifiedHaiku 5.5可以作为子代理(sub-agent)与Claude Opus 5.5和Sonnet 5.5搭配完成编程工作
50%UnverifiedOpenTandem 把 Claude Code 的使用方式从命令行搬到了网页和手机上,让非技术背景用户也能调用 Sonnet 5.5,并在不同设备间衔接任务
50%UnverifiedGemini 4 Argon 在 Vals Dex 榜单上排名第一,超越 Sonnet 5.5 和 Claude Opus 5.5
50%Unverified开发者Kun Chen认为Sonnet适合执行任务、Opus适合规划有歧义的产品难题
50%UnverifiedAnthropic先推出Opus 5.5随后推出性能接近但价格仅一半的Sonnet 5.5,OpenAI用GPT 6.1 Sol复刻了同样的打法
50%UnverifiedTheo建议应避开low档和Max档,使用medium档大致够用
50%Unverified在代码库深度审计基准中,Sonnet 5.5表现略优于Opus,价格只有Opus的一半,仅花约5分钟,而Opus耗时近两倍、Astra耗时近三倍
50%UnverifiedSonnet 5.5在前端设计上明显不如Opus,远不如Fable,而Theo认为Fable 5.1是最佳设计模型
50%UnverifiedSonnet 5.5的推理档位分为low/medium/high/x-high/Max,从low到x-high的token用量仅增加5%至8%,但从x-high跳到Max token用量暴涨约1500%(15倍)
50%Unverified在Cursor Bench上Sonnet 5.5单任务消耗271,920个token,超过Opus的218k和Gemini 3.8 Flash的162k
50%Unverified在代码库审计基准任务中,Sonnet成本约为Opus一半但得分略高,每分成本最佳,且Sonnet仅用约5分钟而Opus用了近两倍时间
50%