待验证50% 置信事实精确时间
现代GPU如NVIDIA H100、H800原生支持FP8计算,理论上可实现约2倍吞吐量提升
1
来源数
50%
置信度
长期有效
时效性
2026/7/10
首次发现
来源
腾讯混元3开源:295B MoE架构全解析,256K上下文成最大短板
bilibili鲲鹏Talk2026/7/6
相关事实
待验证NVIDIA H100 GPU原生支持FP8格式,其吞吐量相较FP16提升约2倍79% 相似待验证英伟达H100、H800在FP8精度下的理论推理吞吐相比A100提升了3-4倍73% 相似待验证H100 GPU基于Hopper架构,其Transformer引擎能在FP8和FP16精度间动态切换,将吞吐量提升至A100的约2-3倍73% 相似待验证FP32到FP16的转换在现代GPU的Tensor Core上可实现2-4倍的吞吐量提升71% 相似待验证英伟达GB300 Blackwell Ultra GPU集成两颗GPU芯片与一颗Grace CPU,通过NVLink-C2C互联,内存带宽可达8TB/s以上,推理性能相比H100提升4至5倍70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/465619API
curl https://kongchang.com/api/v1/knowledge/claims/465619MCP
get_claim(id=465619)