[控场AI]
模型gpt-oss-120b

gpt-oss-120b

OpenAI发布的120亿参数量级开源权重大语言模型,具备广泛的通用能力,在综合基准测试上表现优异

时间轴 (近 90 天)

10月1日

gpt-oss 以 load_in_4bit = False 加载时保留 MXFP4 专家,使 gpt-oss-120b 能在单张 B200 上训练

待验证50%
9月12日

在规则归纳(Rule Induction)任务上,TwIL-LM3 得分96.4,gpt-oss-120b 得分65.2

待验证50%
9月12日

在吞吐量方面,TwIL-LM3 达到 32.9 answers/sec,gpt-oss-120b 为 12.6 answers/sec

待验证50%
9月12日

在更广泛的综合基准聚合分数上,120B 模型仍然领先于 TwIL-LM3

待验证50%
9月11日

在4张B200上运行gpt-oss-120b纯预填充测试中,DWDP4在MNT 32K/ISL 32K配置下相比DEP4达到1.92倍加速,饱和状态下实现506K对329K tok/s(1.54倍)吞吐提升

待验证50%

全部知识事实 (5)

来源文章