待验证50% 置信基准精确时间
StepFun官方图表称Step5 Preview对标GLM-5.3与Qwen同级模型,每项任务成本约降低65%
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/23
首次发现
有效期至:2026/12/22
来源
涉及实体
相关事实
待验证模型路由核心思想是并非所有任务都需要最强模型,简单任务可用GPT-4o-mini、Claude 3 Haiku或Llama 3.1 8B等轻量级模型,成本可能仅为旗舰模型的1/50甚至1/10059% 相似待验证Qwen3.8-Flash-Next在多项基准测试中性能反超Qwen3.8-27B稠密模型,同时降低了推理与训练开销57% 相似待验证在 FrontierCode 评测基准上,Fusion harness 表现匹配 Fable 5.1 而成本降低了 47%57% 相似待验证Grok 4.6 在 WANDR 上能够匹配 Fable 5 的测试结果,而成本降低了 60% 以上56% 相似已验证Qwen3.5的参数激活率为4.3%,而DeepSeek V3的671B模型激活率为5.5%56% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/942574API
curl https://kongchang.com/api/v1/knowledge/claims/942574MCP
get_claim(id=942574)