Verified65% confidenceFactTime unknown
NVIDIA Hopper架构(H100/H200)首次加入FP8 Tensor Core,并引入Transformer Engine自动管理精度转换
3
Sources
65%
Confidence
Medium-term (~90 days)
Relevance
7/2/2026
First Seen
Valid until: 9/30/2026
Sources
微软Tutel:MoE模型加速库深度解析,支持FP4/FP8低精度计算
githubmicrosoft
Related Claims
Unverified原生 FP8 硬件加速最早在 NVIDIA Hopper 架构(H100,2022年)的第四代 Tensor Core 中实现,峰值算力达 3958 TFLOPS80% similarVerifiedNVIDIA H100采用专为AI工作负载设计的Transformer Engine,在FP8精度下实现近4000 TFLOPS算力,比A100提升约3倍78% similarUnverifiedH100的Hopper架构引入了专门的Transformer Engine,支持FP8精度计算77% similarUnverifiedNVIDIA B200采用Blackwell架构,于2024年发布,是H100的继任者,引入第五代NVLink、支持FP4精度的新一代Tensor Core以及Transformer Engine 2.076% similarUnverifiedNVIDIA Ampere 架构引入了异步内存拷贝和稀疏矩阵加速单元,Hopper 架构引入了 Transformer Engine 专用硬件75% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/61135API
curl https://kongchang.com/api/v1/knowledge/claims/61135MCP
get_claim(id=61135)