Unverified50% confidenceBenchmarkExact time
Blackwell 的第五代 NVLink、HBM3e 显存和专用 FP4 张量核心使其在推理密集型场景下相较 H100 可获得2-4倍吞吐量提升
1
Sources
50%
Confidence
Long-term
Relevance
7/9/2026
First Seen
Sources
Unsloth重磅更新:支持NVFP4量化导出与DeepSeek-V4训练
rss7/7/2026
Related Claims
UnverifiedBlackwell架构引入第五代张量核心,原生支持FP4×FP4矩阵乘加运算,累加器使用FP32或FP16精度73% similarPartially VerifiedNVFP4是NVIDIA推出的4位浮点(FP4)量化格式,专为Blackwell架构GPU的硬件加速能力设计68% similarUnverifiedBlackwell将FP4引入推理,并以GB200 NVL72机柜形态将72颗GPU统一寻址为单一计算池68% similarUnverifiedBlackwell是NVIDIA继Hopper和Ada Lovelace之后的新一代微架构,引入第五代Tensor Core以提升FP4/FP6推理效率68% similarUnverifiedBlackwell架构核心创新包括第二代Transformer引擎(支持FP4精度)、NVLink Switch系统(支持576块GPU互联)、20 petaFLOPS的FP4算力和192GB HBM3e显存(带宽达8TB/s)67% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/336767API
curl https://kongchang.com/api/v1/knowledge/claims/336767MCP
get_claim(id=336767)