待验证50% 置信事实精确时间
原生 FP8 硬件加速最早在 NVIDIA Hopper 架构(H100,2022年)的第四代 Tensor Core 中实现,峰值算力达 3958 TFLOPS
1
来源数
50%
置信度
长期有效
时效性
2026/7/22
首次发现
来源
相关事实
已验证NVIDIA Hopper架构(H100/H200)首次加入FP8 Tensor Core,并引入Transformer Engine自动管理精度转换80% 相似已验证在配备 Tensor Core 的 NVIDIA GPU(如 A100、H100)上,FP16/BF16 矩阵运算的吞吐量可以达到 FP32 的 2-8 倍78% 相似待验证V100的Tensor Core在FP16精度下峰值算力可达125 TFLOPS,是前代Pascal架构的5倍以上77% 相似已验证NVIDIA A100拥有6912个CUDA核心和432个Tensor Core,理论峰值算力达到312 TFLOPS(BF16)76% 相似待验证H100的第四代Tensor Core原生支持FP8,峰值算力达3958 TFLOPS,是FP16的两倍74% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/586474API
curl https://kongchang.com/api/v1/knowledge/claims/586474MCP
get_claim(id=586474)