[KongchangAI]
ModelClaude Sonnet 5.5

Sonnet 5.5

Anthropic推出的Claude Sonnet系列新版本,属于Claude模型家族中的中端产品线

Core Facts

Timeline (last 90 days)

Oct 9

Anthropic的Opus和Sonnet 5.5取消了无推理选项,Haiku 5.5保留了该选项但在该模式下表现不好

Unverified50%
Oct 8

Anthropic官方已确认Sonnet 5.5将在未来几周内到来

Unverified50%
Oct 7

Haiku 5.5可以作为子代理(sub-agent)与Claude Opus 5.5和Sonnet 5.5搭配完成编程工作

Unverified50%
Oct 6

OpenTandem 把 Claude Code 的使用方式从命令行搬到了网页和手机上,让非技术背景用户也能调用 Sonnet 5.5,并在不同设备间衔接任务

Unverified50%
Oct 5

Gemini 4 Argon 在 Vals Dex 榜单上排名第一,超越 Sonnet 5.5 和 Claude Opus 5.5

Unverified50%
Oct 4

开发者Kun Chen认为Sonnet适合执行任务、Opus适合规划有歧义的产品难题

Unverified50%
Oct 4

Anthropic先推出Opus 5.5随后推出性能接近但价格仅一半的Sonnet 5.5,OpenAI用GPT 6.1 Sol复刻了同样的打法

Unverified50%
Oct 2

有用户使用 Sonnet 5.5 完成 Jellyfin 自定义插件的 JS 重写等复杂任务

Unverified50%
Oct 2

Theo建议应避开low档和Max档,使用medium档大致够用

Unverified50%
Oct 2

Sonnet 5.5在前端设计上明显不如Opus,远不如Fable,而Theo认为Fable 5.1是最佳设计模型

Unverified50%

40 more timeline events

All Facts (20)

Verified

Claude Sonnet 5.5 在终端(Terminal)基准上达到 70.6%,而上一代仅有 10.3%

75%
Verified

GPT-6.1 Sol与Sonnet 5.5每百万Token价格一致,均为输入2美元、输出10美元

70%
Verified

官方称Sonnet 5在推理、工具使用、编码和知识工作方面相比Sonnet 4.6均有显著提升,整体性能已逼近OPUS 4.8但价格更低

70%
Verified

Sonnet 5.5的缓存读取成本维持在每百万token 20美分没有下降,而Fable 5.1砍了90%、Opus砍了约60%

65%
Partially Verified

Max模式抬高推理token的下限而非上限,强制模型达到一定推理量才算完成,常常损害性能

65%
Partially Verified

Sonnet 5.5在网络攻防能力上与Opus 5.5处于同一水准,是Sonnet系列中首款采用同等网络安全防护机制的模型

65%
Partially Verified

Opus 5.5 在输出 token 上比 Sonnet 5.5 多出约 49%,对应的 API 等价成本几乎贵了一半

65%
Unverified

Sonnet 5.5成为首个仅通过截图读取和操作就通关《精灵宝可梦红》的Sonnet模型

60%
Unverified

Anthropic的Opus和Sonnet 5.5取消了无推理选项,Haiku 5.5保留了该选项但在该模式下表现不好

50%
Unverified

Haiku 5.5可以作为子代理(sub-agent)与Claude Opus 5.5和Sonnet 5.5搭配完成编程工作

50%
Unverified

OpenTandem 把 Claude Code 的使用方式从命令行搬到了网页和手机上,让非技术背景用户也能调用 Sonnet 5.5,并在不同设备间衔接任务

50%
Unverified

Gemini 4 Argon 在 Vals Dex 榜单上排名第一,超越 Sonnet 5.5 和 Claude Opus 5.5

50%
Unverified

开发者Kun Chen认为Sonnet适合执行任务、Opus适合规划有歧义的产品难题

50%
Unverified

Anthropic先推出Opus 5.5随后推出性能接近但价格仅一半的Sonnet 5.5,OpenAI用GPT 6.1 Sol复刻了同样的打法

50%
Unverified

Theo建议应避开low档和Max档,使用medium档大致够用

50%
Unverified

在代码库深度审计基准中,Sonnet 5.5表现略优于Opus,价格只有Opus的一半,仅花约5分钟,而Opus耗时近两倍、Astra耗时近三倍

50%
Unverified

Sonnet 5.5在前端设计上明显不如Opus,远不如Fable,而Theo认为Fable 5.1是最佳设计模型

50%
Unverified

Sonnet 5.5的推理档位分为low/medium/high/x-high/Max,从low到x-high的token用量仅增加5%至8%,但从x-high跳到Max token用量暴涨约1500%(15倍)

50%
Unverified

在Cursor Bench上Sonnet 5.5单任务消耗271,920个token,超过Opus的218k和Gemini 3.8 Flash的162k

50%
Unverified

在代码库审计基准任务中,Sonnet成本约为Opus一半但得分略高,每分成本最佳,且Sonnet仅用约5分钟而Opus用了近两倍时间

50%

Source Articles