Step 5
阶跃星辰推出的大语言模型,支持多模态理解、代码生成和逻辑推理,具备多档思考模式(low/medium/high),体量较同类旗舰模型更小,采用Apache 2许可的开源友好传统
时间轴 (近 90 天)
阶跃星辰(Step Fun AI)推出了 Step 5 预览版模型
在 Artificial Analysis 榜单中,Step 5 预览版的智能分数达到 44 分,超过约 2.8 万亿参数的 Kimi K3 和 GLM,仅次于 Astra 与 Opus 5
Step 5 的模型体量远小于同类旗舰竞品
Step 5 模型仅在发布当天开放约一小时便被下架,官方计划下月正式推出
Step 5 部分复杂任务在 Q4 量化下会频繁触发运行时错误,需要提高到 Q5 等更高量化精度才能稳定输出
Step 5 官方提供 low、medium、high 三级思考模式,并非暴力思考型模型
Step 5 具备多模态能力,能识别图片中的橘色虎斑猫并生成 Three.js 3D 模型和体素风格模型
Step 5 在逻辑与陷阱题测试中表现稳定,正确解答了橙子分配问题和外科医生陷阱题,未落入训练偏见
Step 5 会拒绝生成核武器相关代码,输入被判定为无效
Step 5 在GTA风格城市生成、卡丁车赛车、3D人体解剖等任务中表现较差,存在道路穿墙、心脏位置错误等问题
还有 1 条时间轴事件
全部知识事实 (11)
截至测试时 Step 5 尚未上架 Hugging Face,无法公开下载,官方预计下月正式发布
50%待验证在 Artificial Analysis 榜单中,Step 5 预览版的智能分数达到 44 分,超过约 2.8 万亿参数的 Kimi K3 和 GLM,仅次于 Astra 与 Opus 5
50%待验证Step 5 的模型体量远小于同类旗舰竞品
50%待验证Step 5 会拒绝生成核武器相关代码,输入被判定为无效
50%待验证Step 5 在GTA风格城市生成、卡丁车赛车、3D人体解剖等任务中表现较差,存在道路穿墙、心脏位置错误等问题
50%待验证Step 5 部分复杂任务在 Q4 量化下会频繁触发运行时错误,需要提高到 Q5 等更高量化精度才能稳定输出
50%待验证Step 5 官方提供 low、medium、high 三级思考模式,并非暴力思考型模型
50%待验证Step 5 具备多模态能力,能识别图片中的橘色虎斑猫并生成 Three.js 3D 模型和体素风格模型
50%待验证Step 5 在逻辑与陷阱题测试中表现稳定,正确解答了橙子分配问题和外科医生陷阱题,未落入训练偏见
50%待验证Step 5 模型仅在发布当天开放约一小时便被下架,官方计划下月正式推出
50%待验证阶跃星辰(Step Fun AI)推出了 Step 5 预览版模型
50%