GPT-5.5
Timeline (last 90 days)
OpenAI Codex的Pro方案定价为每月100美元,可使用GPT 5.5 Pro模型
OpenAI前研究员威尔·德普批评GPT 5.5在'人味'方面远不如Claude,称其数据调优太基线
截至2025年5月3日,Codex(GPT 5.5加持)总下载量达到8610万次,周环比暴涨1397%
2025年5月10日,OpenAI CEO山姆·奥特曼在X平台上将GPT 5.5称为「自闭天才」(Autistic Genius)
GPT 5.5 Image 2.0与Gemini Pro在科研绘图场景下的差距是'能用vs不能用'的本质区别
在网络安全测试排名中,Claude Opus 4.6最初领先,GPT 5.5发布后与之持平,GPT 5.5 Cyber一度领先,最终Claude新预览版重回榜首
GPT 5.5 具备显著更高的 token 效率,完成同样任务消耗更少的计算资源
OpenAI 的 Codex 桌面应用由 GPT 5.5 驱动,集成了浏览器自动操控、桌面控制和自动化测试功能
DeepSeek V4 Pro 在 Codeforces、Aero 以及 MRCR 1M 长上下文检索 Benchmark 上表现优于 GPT 5.5
GPT 5.5 的生成速度比 DeepSeek V4 更快
40 more timeline events
All Facts (14)
EVERY团队推荐的最佳工作流是用Opus 4.7做规划、用GPT-5.5做执行
90%待验证EVERY总经理Navin用GPT-5.5构建了名为Dayline的原生iOS/Mac待办事项应用,称其为'最爱的全能模型'
85%待验证EVERY专职作家Katy Perrott使用Claude模型写作近两年,GPT-5.5是很久以来第一个让她开始用于写作任务的GPT模型
85%待验证EVERY团队在GPT-5.5正式发布前已内部测试了大约三周时间
85%待验证GPT-5.5特别擅长TypeScript和Swift编程语言,但Ruby表现不佳
80%待验证Codex桌面应用搭配GPT-5.5被EVERY团队评为'桌面上最好的智能体体验'
80%待验证GPT-5.5的响应速度明显快于Opus 4.7,团队认为这体现了OpenAI的硬件优势
80%待验证GPT-5.5和Claude Opus 4.7在OpenRouter基准测试中占据智商最高位置,价格约5美元/百万Token
75%待验证在产品端工程任务和设计导向任务上,Opus 4.7的上限更高,审美感比GPT-5.5更强
75%待验证GPT-5.5为了更易消化,在训练中牺牲了对细节的洞察力,评测者建议需要敏锐洞察力的工作仍使用Opus 4.7
75%待验证GPT-5.5在AIME 2025数学竞赛上得分从65.4%提升到81.2%
70%待验证GPT-5.5在GPQA博士级科学推理基准上从78.5%提升到85.6%
70%待验证在B站UP主的四轮实测中,DeepSeek-V4在世界知识、上下文记忆和逻辑推理三个环节的交付质量上优于GPT-5.5
65%待验证GPT-5.5发布才不过几周,其表现远超Claude Opus 4.7
50%