Unverified50% confidenceSolutionExact time
MiniMax H3标准工作流最低16G显存即可运行,6G显卡通过FP8、INT4量化和分块推理Tiling等优化也能参与部分流程
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
8/26/2026
First Seen
Valid until: 11/24/2026
Sources
Related Entities
Related Claims
UnverifiedRTX 4070及以下(12GB及更低)运行MiniMax H3可能需要全量模型卸载到CPU、降低分辨率、减少帧数等极限优化78% similarUnverifiedMiniMax M3主打轻量化,单卡即可运行,适合小微企业客服和简单问答场景77% similarUnverified12GB显存是运行Turbo模型较为舒适的下限,显存更小的显卡可能需要降低分辨率或采用更激进的量化方案如INT473% similarUnverifiedLLM推理/训练选卡看显存优先于算力:7B模型微调至少需24GB显存(RTX 4090/A5000),13B需A100 40GB,70B全参数训练需A100 80GB×4或H100集群71% similarUnverified该模型最低 6G 显存即可运行,IQ2_M 版本约 10G 面向 6G/8G 显存设备70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/803431API
curl https://kongchang.com/api/v1/knowledge/claims/803431MCP
get_claim(id=803431)