待验证50% 置信解决方案精确时间
MiniMax H3标准工作流最低16G显存即可运行,6G显卡通过FP8、INT4量化和分块推理Tiling等优化也能参与部分流程
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/26
首次发现
有效期至:2026/11/24
来源
涉及实体
相关事实
待验证RTX 4070及以下(12GB及更低)运行MiniMax H3可能需要全量模型卸载到CPU、降低分辨率、减少帧数等极限优化78% 相似待验证MiniMax M3主打轻量化,单卡即可运行,适合小微企业客服和简单问答场景77% 相似待验证12GB显存是运行Turbo模型较为舒适的下限,显存更小的显卡可能需要降低分辨率或采用更激进的量化方案如INT473% 相似待验证LLM推理/训练选卡看显存优先于算力:7B模型微调至少需24GB显存(RTX 4090/A5000),13B需A100 40GB,70B全参数训练需A100 80GB×4或H100集群71% 相似待验证该模型最低 6G 显存即可运行,IQ2_M 版本约 10G 面向 6G/8G 显存设备70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/803431API
curl https://kongchang.com/api/v1/knowledge/claims/803431MCP
get_claim(id=803431)