待验证80% 置信事实时间未知
TensorRT-LLM专门为Blackwell引入了FP4量化推理路径,并针对Blackwell的新型Tensor Core单元重写了GEMM内核
1
来源数
80%
置信度
长期有效
时效性
2026/5/31
首次发现
来源
涉及实体
相关事实
待验证Blackwell是NVIDIA继Hopper和Ada Lovelace之后的新一代微架构,引入第五代Tensor Core以提升FP4/FP6推理效率69% 相似待验证NVIDIA 在 Blackwell 架构(SM 100/103,如 B100、B200 系列)中为 NVFP4 设计了专用 Tensor Core 指令 mma.kind::mxf4,并采用每 16 个元素为一组的 FP8 缩放因子机制68% 相似待验证FP8是Blackwell架构原生支持的低精度计算格式,包含E4M3和E5M2两种变体,Tensor Core的FP8计算吞吐是FP16的两倍66% 相似待验证NVIDIA Blackwell架构(B200/GB200)支持FP4计算,理论上将Tensor Core吞吐量再次翻倍65% 相似待验证Blackwell架构的第五代RT Core将光线追踪性能提升约2倍,Tensor Core支持FP4精度运算使AI推理吞吐量翻倍62% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/4501API
curl https://kongchang.com/api/v1/knowledge/claims/4501MCP
get_claim(id=4501)