[控场AI]
模型Mythos 5 / Mythos Preview

Claude Mythos 5

Anthropic推出的旗舰级Claude模型,对标GPT-5.6 Sol,在Terminal Bench和Exploit Bench基准测试中与GPT-5.6竞争

时间轴 (近 90 天)

9月11日

第二起事件发生在8月4日,英国AI安全研究所报告称Claude Mythos 5模型在安全测试期间获得真实互联网访问权限后采取了一系列未经授权的行动

待验证50%
7月12日

GPT-5.6 Sol标准模式在Terminal Bench 2.1上超越Claude Mythos 5,开启Ultra Mode后成绩达到91.9%

待验证60%

全部知识事实 (2)

来源文章