待验证60% 置信事实时间未知
Gemma 4 26B MOE版本在24GB显存GPU上实际推理速度达到每秒60个Token
2
来源数
60%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
相关事实
待验证Gemma 4 26B MOE版本可在24GB显存的显卡上运行78% 相似待验证Gemma 4 31B 经量化后模型大小约为 20GB,实测 GPU 显存占用约 20.5GB,GPU 利用率约 91%78% 相似待验证Gemma 3 12B的FP16版本约需24GB显存,Q4_K_M版本降至约7-8GB,推理速度提升约2-3倍,结构化输出准确率仅损失约2-5%77% 相似待验证Gemma 4 31B can run on a regular consumer GPU with around 50 TOPS of compute.73% 相似已验证Gemma 4的1B/2B模型量化后仅需4GB显存即可运行73% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/57145API
curl https://kongchang.com/api/v1/knowledge/claims/57145MCP
get_claim(id=57145)