待验证50% 置信基准精确时间
Swift版在保持几乎同等质量的前提下,把推理token消耗和耗时都压缩到了基础版Qwen3.8-Flash-Next的40%左右
1
来源数
50%
置信度
长期有效
时效性
2026/9/25
首次发现
来源
涉及实体
相关事实
待验证在Aider基准中,Swift-1.5-Flash-Next (xhigh)首次通过率为41.1%,略高于Qwen3.8-Flash-Next的40.2%70% 相似待验证在C++语言测试中Swift的token用量仅为基础版的29%,但6次质量损失中占了3次67% 相似待验证Qwen3.8-Flash-Next在多项基准测试中性能反超Qwen3.8-27B稠密模型,同时降低了推理与训练开销65% 相似待验证Swift-27B 在 AIME 2026 上准确率从 98.7% 下降到 94.0%,下降 4.6%,团队承认这是训练中一个关键数学推理 token 被误惩罚的 bug63% 相似待验证作者运行Qwen3系列27B模型时速度未达预期,改用Qwen3-Next-Flash后性能大为改观62% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/951060API
curl https://kongchang.com/api/v1/knowledge/claims/951060MCP
get_claim(id=951060)