待验证50% 置信基准精确时间
B200采用Blackwell架构,引入第二代Transformer Engine和FP4精度支持,推理吞吐量较H100提升最高30倍
1
来源数
50%
置信度
长期有效
时效性
2026/8/28
首次发现
来源
涉及实体
相关事实
待验证Blackwell的第二代Transformer Engine新增FP4精度支持,理论上可将Transformer模型的训练吞吐量相比H100提升2-4倍80% 相似待验证H100 GPU基于Hopper架构,其Transformer引擎能在FP8和FP16精度间动态切换,将吞吐量提升至A100的约2-3倍72% 相似已验证Blackwell架构核心创新包括第二代Transformer引擎(支持FP4精度)、NVLink Switch系统(支持576块GPU互联)、20 petaFLOPS的FP4算力和192GB HBM3e显存(带宽达8TB/s)72% 相似待验证H100的Hopper架构引入了专门的Transformer Engine,支持FP8精度计算72% 相似已验证NVIDIA H100采用专为AI工作负载设计的Transformer Engine,在FP8精度下实现近4000 TFLOPS算力,比A100提升约3倍72% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/811461API
curl https://kongchang.com/api/v1/knowledge/claims/811461MCP
get_claim(id=811461)