待验证50% 置信基准精确时间
MiniMax-H3 模型的首帧渲染最多可提前约一分钟完成,并在 A100、B200 和 RTX PRO 6000 上降低了 25–29 GiB 的峰值显存占用
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/28
首次发现
有效期至:2026/12/27
来源
涉及实体
相关事实
待验证MiniMax H3 REF 在一张 RTX 5060 Ti 16GB 显卡上以 18 步采样完成 4096×1536 原生分辨率出图,耗时约 1 分钟75% 相似待验证RTX 4070及以下(12GB及更低)运行MiniMax H3可能需要全量模型卸载到CPU、降低分辨率、减少帧数等极限优化74% 相似待验证在NVIDIA RTX 5090显卡上,完整的MiniMax H3融合工作流完成一次生成大约需要198.40秒71% 相似待验证MiniMax H3标准工作流最低16G显存即可运行,6G显卡通过FP8、INT4量化和分块推理Tiling等优化也能参与部分流程68% 相似待验证在显存充足、模型完整驻留GPU时,RTX 4090跑Q4量化的27B模型通常可达15~30 tokens/s;触发CPU卸载后速度可能骤降至1~2 tokens/s甚至更低66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/956830API
curl https://kongchang.com/api/v1/knowledge/claims/956830MCP
get_claim(id=956830)