[控场AI]
模型Claude Opus 5.5

Opus 5.5

Anthropic旗舰大语言模型,采用MoE架构,定位高性能推理与多模态任务,以较低定价对标顶级模型

核心事实

时间轴 (近 90 天)

10月3日

Anthropic 的 Opus 5.5 在同样的追问下坚持立场、不轻易改口

待验证50%
10月2日

客户端自动模式分类器现在会忽略指向 Claude Sonnet 5.5 或 Opus 5.5 的 ANTHROPIC_DEFAULT_SONNET_MODEL 固定值,转而使用 Claude Sonnet 5

待验证50%
10月2日

项目代码、配置与基准脚本已开源在GitHub(StayLameBro/backburner),作者提到整套系统借助Opus 5.5构建

待验证50%
10月2日

Opus 5.5 被降智是尚无官方证实的社区讨论,未被证实为事实

待验证50%
10月2日

部分用户认为 Opus 5.5 依然是目前最好的模型且表现依旧出色

待验证50%
10月2日

Reddit 社区出现关于 Anthropic 旗舰模型 Opus 5.5 是否在发布后被悄悄降智的讨论

待验证50%
10月2日

该开发者试图用 Opus 5.5 复刻 David Braben 的经典游戏《Lander》

待验证50%
10月2日

开发者在 9 月 23 日生成 Godot 仓库(macOS、Metal 渲染、C#),并在 10 月 2 日用完全相同的提示词和两张原始参考图在全新工作区重新生成,两次均将 Opus 努力程度设为 Extra High

待验证50%
10月2日

后期版本相比发布日版本出现渲染故障、缺失飞船解体物理效果、交互体验下降、视觉细节劣化、射击逻辑错误及缺少相机切换等退化

待验证50%
10月2日

作者猜测发布头三天用户用到的可能是一个更强的模型(称为 Mythos),之后被悄悄替换

待验证50%

还有 40 条时间轴事件

全部知识事实 (20)

已验证

Opus 5.5 在多数任务上达到 Fable 5.1 的水平,但运行成本降低约 40%,速度也更快

80%
已验证

Anthropic称Opus 5.5典型任务总成本可降低约40%,输出速度提升30%以上

70%
已验证

Claude Opus 5.5的缓存读取价格下降60%,降至每百万token 0.20美元

70%
已验证

Claude Opus 5.5的生成速度比Opus 5快超过30%

70%
已验证

GPT-6 Astra与以往的模型迭代明显不同,在某些方面强大但在另一些场景下提升不明显甚至像退步

65%
已验证

Claude Opus 5能力接近上一代旗舰Opus水平,但推理成本显著降低

65%
已验证

GPT-5.6 Sol具备持续运行数天的长周期任务能力,只需给定目标即可反复迭代产出详尽结果,且UI生成质量显著提升

65%
已验证

在Agents' Last Exam评测中,GPT-5.6 Sol取得53.6分,比采用自适应推理的Claude Fable 5高出13.1分

65%
已验证

按标准价格(3美元/15美元)计算,Sonnet 5 在 Intelligence Index 上平均每任务成本 2.29 美元,而 Opus 4.8 只要 1.99 美元,Sonnet 5 反而比 Opus 4.8 贵约 15%

65%
已验证

Anthropic 发布了 Claude Sonnet 5,官方宣称其性能接近 Opus 4.8 且价格更低

60%
已验证

GPT-6 Sol 与 Anthropic 的 Opus 5.5 同日发布

70%
已验证

2026年7月9日,OpenAI同时发布了GPT-5.6 Sol、GPT-5.6 Terra、GPT-5.6 Luna三个模型

80%
部分验证

Google 表示引导期结束后 Gemini 4 Argon 价格将上调至每百万输入 4 美元、输出 20 美元,对标 Opus 5.5 级别

70%
部分验证

在 Automation Bench 上 Gemini 4 Argon 得分 51.3%,超过 Fable 5.1 的 31.4% 和 Opus 5.5 的 42.5%

65%
部分验证

在DeepSWE基准中,GPT-6.1 Sol的low档单次运行成本约0.21美元,而Astra同档需1.46美元,Opus 5.5在max档取得相同分数需14.65美元

65%
部分验证

测评者建议让Opus 5.5负责实现和长程构建,让GPT-6.1 Sol负责审查、根因分析、代码库调查和任务分诊

65%
部分验证

Sonnet 5.5在网络攻防能力上与Opus 5.5处于同一水准,是Sonnet系列中首款采用同等网络安全防护机制的模型

65%
部分验证

GPT-6.1 Sol的缓存读取价格为每百万token仅0.10美元

65%
部分验证

Opus 5.5 在输出 token 上比 Sonnet 5.5 多出约 49%,对应的 API 等价成本几乎贵了一半

65%
部分验证

GPT-6 Sol High在Automation Bench上的单项任务成本仅为Opus 5的十分之一

65%

来源文章