已验证90% 置信事实精确时间
Llama-3 70B模型在FP16精度下仅权重就需要约140GB显存
6
来源数
90%
置信度
长期有效
时效性
2026/7/7
首次发现
来源
NVFP4量化实战:NVIDIA模型优化器压缩大模型指南
rss2026/6/26
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/187832API
curl https://kongchang.com/api/v1/knowledge/claims/187832MCP
get_claim(id=187832)