[控场AI]
模型OpenAI GPT-OSS 120B

GPT-OSS 120B

GPT-OSS 120B是OpenAI发布的一款拥有1200亿参数的开源大语言模型,面向开发者和研究者开放权重。该模型具备强大的自然语言理解与生成能力,支持多种下游任务的微调与部署,兼顾高性能与开放性,可在多种平台和环境中自由使用与集成。

时间轴 (近 90 天)

9月24日

OpenAI使用Semi-Analysis的公开基准InferenceX,在GPT-OSS 120B、DeepSeek R1 670B和Kimi K2 1T三个开放模型上测试Jalapeño

待验证50%
9月24日

在 gpt-oss 120B 测试中,Jalapeño 峰值每瓦吞吐约 85,448,对标 GB200 的 44,960,约 1.9 倍;端到端延迟从 1.80 秒压到 1.03 秒;最低 TBT 从 1.87 毫秒降到 0.69 毫秒

待验证60%
9月24日

Jalapeño运行GPT-OSS 120B模型时峰值可达1500 tokens/秒,约为次优方案的两倍

待验证50%
9月24日

Jalapeño基准同时运行了GPT-OSS 120B、DeepSeek R1和Kimi K2.5三种采用不同MoE和注意力机制的模型

待验证50%
9月23日

在1200亿参数的GPT-OSS 120B上token生成从90提升到130 tokens/s,PP从约1300提升到约3200 tokens/s

待验证50%

全部知识事实 (7)

来源文章