待验证50% 置信基准精确时间
在FP16精度4K×4K×4K转置矩阵乘法任务中,启用Neural Accelerator的M5 Ultra算力突破107 TFLOPS,是自身非加速状态的3.51倍,达到M3 Ultra的4.79倍
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/23
首次发现
有效期至:2026/12/22
来源
涉及实体
相关事实
已验证M4芯片的Neural Engine峰值算力达到38 TOPS(每秒38万亿次运算)74% 相似待验证RTX 3060的INT4 Tensor Core理论峰值算力约为101 TOPS,而FP16仅约12.7 TFLOPS,差距达8倍以上73% 相似待验证M5 Ultra整机AI峰值算力比M3 Ultra高出4倍以上71% 相似待验证通过--quantization quark_mxfp4,SGLang在加载时将NVFP4权重解量化并重新量化为MXFP4,在MiniMax-M2.7、GLM-5.1等模型上GSM8K准确率恢复达97.5%-100.2%68% 相似待验证NVFP4量化方案相比BF16基线实现了1.5倍的推理加速,同时在top-1准确率上保留了92%到97%的水平67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/945110API
curl https://kongchang.com/api/v1/knowledge/claims/945110MCP
get_claim(id=945110)