模型gpt-oss-120b
gpt-oss-120b
OpenAI发布的120亿参数量级开源权重大语言模型,具备广泛的通用能力,在综合基准测试上表现优异
时间轴 (近 90 天)
10月1日
gpt-oss 以 load_in_4bit = False 加载时保留 MXFP4 专家,使 gpt-oss-120b 能在单张 B200 上训练
待验证50%
9月12日
在规则归纳(Rule Induction)任务上,TwIL-LM3 得分96.4,gpt-oss-120b 得分65.2
待验证50%
9月12日
在吞吐量方面,TwIL-LM3 达到 32.9 answers/sec,gpt-oss-120b 为 12.6 answers/sec
待验证50%
9月12日
在更广泛的综合基准聚合分数上,120B 模型仍然领先于 TwIL-LM3
待验证50%
9月11日
在4张B200上运行gpt-oss-120b纯预填充测试中,DWDP4在MNT 32K/ISL 32K配置下相比DEP4达到1.92倍加速,饱和状态下实现506K对329K tok/s(1.54倍)吞吐提升
待验证50%
全部知识事实 (5)
待验证
gpt-oss 以 load_in_4bit = False 加载时保留 MXFP4 专家,使 gpt-oss-120b 能在单张 B200 上训练
50%待验证在规则归纳(Rule Induction)任务上,TwIL-LM3 得分96.4,gpt-oss-120b 得分65.2
50%待验证在吞吐量方面,TwIL-LM3 达到 32.9 answers/sec,gpt-oss-120b 为 12.6 answers/sec
50%待验证在更广泛的综合基准聚合分数上,120B 模型仍然领先于 TwIL-LM3
50%待验证在4张B200上运行gpt-oss-120b纯预填充测试中,DWDP4在MNT 32K/ISL 32K配置下相比DEP4达到1.92倍加速,饱和状态下实现506K对329K tok/s(1.54倍)吞吐提升
50%