Unverified50% confidenceFactExact time
NVIDIA 在 Blackwell 架构(SM 100/103,如 B100、B200 系列)中为 NVFP4 设计了专用 Tensor Core 指令 mma.kind::mxf4,并采用每 16 个元素为一组的 FP8 缩放因子机制
1
Sources
50%
Confidence
Long-term
Relevance
7/10/2026
First Seen
Sources
Unsloth重磅更新:DeepSeek-V4支持与NVFP4量化导出全解析
rss7/8/2026
Related Claims
UnverifiedNVIDIA Blackwell架构(GB200/B200系列)在硬件层面引入了原生FP4张量核心81% similarUnverifiedNVIDIA Blackwell架构(B200/GB200)支持FP4计算,理论上将Tensor Core吞吐量再次翻倍81% similarVerified在配备 Tensor Core 的 NVIDIA GPU(如 A100、H100)上,FP16/BF16 矩阵运算的吞吐量可以达到 FP32 的 2-8 倍80% similarUnverifiedNVIDIA的Blackwell架构(B100/B200)在硬件层面原生支持MXFP4格式的矩阵运算,吞吐量相比FP8可提升近一倍79% similarPartially VerifiedNVFP4是NVIDIA推出的4位浮点(FP4)量化格式,专为Blackwell架构GPU的硬件加速能力设计78% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/431228API
curl https://kongchang.com/api/v1/knowledge/claims/431228MCP
get_claim(id=431228)