待验证50% 置信事实精确时间
H100的Transformer Engine支持FP8精度,张量核心在FP8模式下峰值算力可达3958 TFLOPS,FP16为1979 TFLOPS
1
来源数
50%
置信度
长期有效
时效性
2026/7/20
首次发现
来源
相关事实
待验证H100的Hopper架构引入了专门的Transformer Engine,支持FP8精度计算82% 相似待验证H100的第四代Tensor Core原生支持FP8,峰值算力达3958 TFLOPS,是FP16的两倍79% 相似已验证NVIDIA H100采用专为AI工作负载设计的Transformer Engine,在FP8精度下实现近4000 TFLOPS算力,比A100提升约3倍79% 相似待验证H100 GPU基于Hopper架构,其Transformer引擎能在FP8和FP16精度间动态切换,将吞吐量提升至A100的约2-3倍74% 相似已验证H100 GPU采用英伟达Hopper架构,单卡峰值算力达3,958 TFLOPS(FP16精度)74% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/575341API
curl https://kongchang.com/api/v1/knowledge/claims/575341MCP
get_claim(id=575341)