Haiku 5.5
Anthropic Claude 5.5系列轻量级模型,面向大批量、对成本敏感的应用场景,是Claude系列中最经济的选项
Core Facts
Timeline (last 90 days)
配合Design Skill技能后Haiku的前端设计能力远超Grok 4.7,但关掉该技能后退回平庸水准
在创作者的benchmark中,Haiku 5.5的Terminal Bench成绩从Haiku 4.5的0分提升到接近40%
Haiku 5.5在Computer Use任务上比GPT-6 Luna高出约40%
Haiku 5.5在不同供应商处可跑到100到200 TPS,创作者用Claude Code测试稳定在约180 TPS
开着推理用Haiku 5.5效果好,关闭推理时不如用GPT的Jev或Luna
Anthropic的Opus和Sonnet 5.5取消了无推理选项,Haiku 5.5保留了该选项但在该模式下表现不好
在Anthropic官方demo中,Opus单独完成鸡蛋降落任务用时3.5分钟、25次尝试、花费47美分;Opus搭配10个Haiku子agent则用时不到1分钟、86次尝试、仅花费14美分
Haiku 5.5最佳使用方式是让agent和应用去调用它作为子agent,而非在UI里手动选用它写代码
Anthropic发布了Haiku 5.5,称其为公司发布过的最便宜、最快、能力最强的小模型
一旦超过10万token上下文,Haiku 5.5价格直接涨5倍:输出从50美分升到2.5美元/百万,输入从10美分升到50美分
7 more timeline events
All Facts (16)
与Claude Haiku 4.5相比,Haiku 5.5运行成本平均降低约75%
80%Unverified配合Design Skill技能后Haiku的前端设计能力远超Grok 4.7,但关掉该技能后退回平庸水准
50%UnverifiedHaiku 5.5在Computer Use任务上比GPT-6 Luna高出约40%
50%UnverifiedHaiku 5.5在不同供应商处可跑到100到200 TPS,创作者用Claude Code测试稳定在约180 TPS
50%Unverified开着推理用Haiku 5.5效果好,关闭推理时不如用GPT的Jev或Luna
50%UnverifiedAnthropic的Opus和Sonnet 5.5取消了无推理选项,Haiku 5.5保留了该选项但在该模式下表现不好
50%Unverified在Anthropic官方demo中,Opus单独完成鸡蛋降落任务用时3.5分钟、25次尝试、花费47美分;Opus搭配10个Haiku子agent则用时不到1分钟、86次尝试、仅花费14美分
50%UnverifiedHaiku 5.5最佳使用方式是让agent和应用去调用它作为子agent,而非在UI里手动选用它写代码
50%Unverified一旦超过10万token上下文,Haiku 5.5价格直接涨5倍:输出从50美分升到2.5美元/百万,输入从10美分升到50美分
50%Unverified在创作者的benchmark中,Haiku 5.5的Terminal Bench成绩从Haiku 4.5的0分提升到接近40%
50%UnverifiedAnthropic发布了Haiku 5.5,称其为公司发布过的最便宜、最快、能力最强的小模型
50%UnverifiedAnthropic预告Haiku 5.5将在未来几周加入该模型家族,面向高并发、成本敏感场景
50%Unverified据爆料人 Lira 消息,Claude Sonnet 5.5 已在合作伙伴范围内秘密测试,并开放 24 小时访问权限,Haiku 5.5 预计与 Sonnet 5.5 同步发布
50%Unverified按跑分推测,Haiku 5.5 可能会与 Astra 处在同一水平(约 53 分)
50%UnverifiedAnthropic近期被曝同时推出Opus 5.5与Sonnet 5.5两款模型
50%UnverifiedAnthropic 在公告中表示更轻量的 Haiku 5.5 将在未来几周内上线
50%