待验证50% 置信基准精确时间
Blackwell 的第五代 NVLink、HBM3e 显存和专用 FP4 张量核心使其在推理密集型场景下相较 H100 可获得2-4倍吞吐量提升
1
来源数
50%
置信度
长期有效
时效性
2026/7/9
首次发现
来源
Unsloth重磅更新:支持NVFP4量化导出与DeepSeek-V4训练
rss2026/7/7
相关事实
待验证Blackwell架构引入第五代张量核心,原生支持FP4×FP4矩阵乘加运算,累加器使用FP32或FP16精度73% 相似部分验证NVFP4是NVIDIA推出的4位浮点(FP4)量化格式,专为Blackwell架构GPU的硬件加速能力设计68% 相似待验证Blackwell将FP4引入推理,并以GB200 NVL72机柜形态将72颗GPU统一寻址为单一计算池68% 相似待验证Blackwell是NVIDIA继Hopper和Ada Lovelace之后的新一代微架构,引入第五代Tensor Core以提升FP4/FP6推理效率68% 相似待验证Blackwell架构核心创新包括第二代Transformer引擎(支持FP4精度)、NVLink Switch系统(支持576块GPU互联)、20 petaFLOPS的FP4算力和192GB HBM3e显存(带宽达8TB/s)67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/336767API
curl https://kongchang.com/api/v1/knowledge/claims/336767MCP
get_claim(id=336767)