Blackwell
Blackwell是NVIDIA推出的一代GPU微架构,面向高性能计算、人工智能训练与推理等应用场景。该架构在前代架构基础上提升了计算吞吐量与能效比,支持大规模并行计算任务,并针对大型语言模型等AI工作负载进行了专项优化。Blackwell架构被应用于NVIDIA旗下多款面向数据中心和专业计算领域的GPU产品线。
Core Facts
NVIDIA Blackwell 架构于2024年发布,是继 Hopper(H100)之后的新一代数据中心 GPU 架构
英伟达H100/H200系列GPU在AI训练和推理市场占据超过80%的份额
Blackwell架构核心创新包括第二代Transformer引擎(支持FP4精度)、NVLink Switch系统(支持576块GPU互联)、20 petaFLOPS的FP4算力和192GB HBM3e显存(带宽达8TB/s)
Timeline (last 90 days)
相比Hopper架构,Blackwell在AI训练性能上提升约2-3倍,推理性能提升可达5倍以上
NVFP4在NVIDIA Blackwell架构的Tensor Core中获得了原生硬件支持,无需额外的反量化计算开销
RTX 5090基于Blackwell架构,配备32GB GDDR7显存,带宽达1.79TB/s,相比RTX 4090的1TB/s有显著跃升
Blackwell架构核心创新包括第二代Transformer引擎(支持FP4精度)、NVLink Switch系统(支持576块GPU互联)、20 petaFLOPS的FP4算力和192GB HBM3e显存(带宽达8TB/s)
英伟达Blackwell架构于2024年发布,代表产品包括GB200和B100
NVIDIA Blackwell 架构于2024年发布,是继 Hopper(H100)之后的新一代数据中心 GPU 架构
英伟达H100/H200系列GPU在AI训练和推理市场占据超过80%的份额
All Facts (7)
NVIDIA Blackwell 架构于2024年发布,是继 Hopper(H100)之后的新一代数据中心 GPU 架构
75%Verified英伟达H100/H200系列GPU在AI训练和推理市场占据超过80%的份额
75%VerifiedBlackwell架构核心创新包括第二代Transformer引擎(支持FP4精度)、NVLink Switch系统(支持576块GPU互联)、20 petaFLOPS的FP4算力和192GB HBM3e显存(带宽达8TB/s)
65%Unverified相比Hopper架构,Blackwell在AI训练性能上提升约2-3倍,推理性能提升可达5倍以上
50%UnverifiedNVFP4在NVIDIA Blackwell架构的Tensor Core中获得了原生硬件支持,无需额外的反量化计算开销
50%UnverifiedRTX 5090基于Blackwell架构,配备32GB GDDR7显存,带宽达1.79TB/s,相比RTX 4090的1TB/s有显著跃升
50%Unverified英伟达Blackwell架构于2024年发布,代表产品包括GB200和B100
50%