Unverified80% confidenceFactTime unknown
TensorRT-LLM专门为Blackwell引入了FP4量化推理路径,并针对Blackwell的新型Tensor Core单元重写了GEMM内核
1
Sources
80%
Confidence
Long-term
Relevance
5/31/2026
First Seen
Sources
Related Entities
Related Claims
UnverifiedBlackwell是NVIDIA继Hopper和Ada Lovelace之后的新一代微架构,引入第五代Tensor Core以提升FP4/FP6推理效率69% similarUnverifiedNVIDIA 在 Blackwell 架构(SM 100/103,如 B100、B200 系列)中为 NVFP4 设计了专用 Tensor Core 指令 mma.kind::mxf4,并采用每 16 个元素为一组的 FP8 缩放因子机制68% similarUnverifiedFP8是Blackwell架构原生支持的低精度计算格式,包含E4M3和E5M2两种变体,Tensor Core的FP8计算吞吐是FP16的两倍66% similarUnverifiedNVIDIA Blackwell架构(B200/GB200)支持FP4计算,理论上将Tensor Core吞吐量再次翻倍65% similarUnverifiedBlackwell架构的第五代RT Core将光线追踪性能提升约2倍,Tensor Core支持FP4精度运算使AI推理吞吐量翻倍62% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/4501API
curl https://kongchang.com/api/v1/knowledge/claims/4501MCP
get_claim(id=4501)