Unverified50% confidenceFactExact time
原生 FP8 硬件加速最早在 NVIDIA Hopper 架构(H100,2022年)的第四代 Tensor Core 中实现,峰值算力达 3958 TFLOPS
1
Sources
50%
Confidence
Long-term
Relevance
7/22/2026
First Seen
Sources
Related Claims
VerifiedNVIDIA Hopper架构(H100/H200)首次加入FP8 Tensor Core,并引入Transformer Engine自动管理精度转换80% similarVerified在配备 Tensor Core 的 NVIDIA GPU(如 A100、H100)上,FP16/BF16 矩阵运算的吞吐量可以达到 FP32 的 2-8 倍78% similarUnverifiedV100的Tensor Core在FP16精度下峰值算力可达125 TFLOPS,是前代Pascal架构的5倍以上77% similarVerifiedNVIDIA A100拥有6912个CUDA核心和432个Tensor Core,理论峰值算力达到312 TFLOPS(BF16)76% similarUnverifiedH100的第四代Tensor Core原生支持FP8,峰值算力达3958 TFLOPS,是FP16的两倍74% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/586474API
curl https://kongchang.com/api/v1/knowledge/claims/586474MCP
get_claim(id=586474)