[控场AI]
模型codex-1模型

codex-1

OpenAI开发的编程专用模型,是经过强化学习优化的o3变体,作为OpenAI Codex产品的底层模型

核心事实

时间轴 (近 90 天)

9月2日

codex-1引入了RLEF(基于执行反馈的强化学习),模型生成的代码会被实际执行,测试结果作为奖励信号反馈给模型

待验证50%
9月2日

codex-1在SWE-bench等软件工程基准测试中的表现大幅领先于仅经过对话优化的通用模型

待验证50%
9月2日

codex-1在训练过程中使用了真实代码仓库、测试用例执行反馈和代码审查数据

待验证50%

全部知识事实 (4)

来源文章