待验证50% 置信基准精确时间
V100的Tensor Core在FP16精度下峰值算力可达125 TFLOPS,是前代Pascal架构的5倍以上
1
来源数
50%
置信度
长期有效
时效性
2026/7/22
首次发现
来源
相关事实
待验证H100的第四代Tensor Core原生支持FP8,峰值算力达3958 TFLOPS,是FP16的两倍80% 相似已验证H100 GPU采用英伟达Hopper架构,单卡峰值算力达3,958 TFLOPS(FP16精度)79% 相似待验证原生 FP8 硬件加速最早在 NVIDIA Hopper 架构(H100,2022年)的第四代 Tensor Core 中实现,峰值算力达 3958 TFLOPS77% 相似待验证cuBLAS库的矩阵乘法实现可以接近V100 GPU理论峰值的125 TFLOPS,与朴素三重循环实现相差超过100倍75% 相似待验证TensorRT支持FP32/FP16/INT8/FP8多种精度校准75% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/586043API
curl https://kongchang.com/api/v1/knowledge/claims/586043MCP
get_claim(id=586043)