待验证50% 置信基准精确时间
完成250案例测试,FP8 27B用时36分27秒,Flash-Next IQ4_XS用时2小时05分47秒,相差约3.5倍
1
来源数
50%
置信度
短期 (~14 天)
时效性
2026/9/25
首次发现
有效期至:2026/10/9
来源
涉及实体
相关事实
待验证260 亿参数的 Gemma(MoE)实测速度接近 31 Token/秒,比 GPT-OSS 20B 快约三分之一68% 相似待验证混合精度训练中,FP16 每个参数占 2 字节显存,FP32 每个参数占 4 字节显存67% 相似待验证Qwen3 27B在256K长上下文记忆检索测试(大海捞针)中取得100%通过率,15次运行全部准确66% 相似待验证在 Theo 的 skate bench 测试中,X high 档平均每次响应 338 个 token、耗时 6 秒、最慢 31 秒66% 相似待验证在SVG小黄鸭骑车生成测试中,千问35B-A3B综合表现最优,生成耗时约4分钟66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/949602API
curl https://kongchang.com/api/v1/knowledge/claims/949602MCP
get_claim(id=949602)