[KongchangAI]
ModelMiniMax H3

MiniMax-H3

MiniMax发布的多模态视频生成模型,能够在单次请求中同时生成视频和同步立体声音轨,支持文本转视频加音频、首尾帧条件生成、图像/视频/音频参考条件生成等多种任务模式

Core Facts

Timeline (last 90 days)

Oct 3

MiniMax-H3 可通过 SGLang Diffusion 在 ComfyUI 中运行

Unverified50%
Sep 28

MiniMax-H3 模型的首帧渲染最多可提前约一分钟完成,并在 A100、B200 和 RTX PRO 6000 上降低了 25–29 GiB 的峰值显存占用

Unverified50%
Sep 18

Kijai更新了MiniMax-H3(MH3)的VAE模型,采用int8量化版本,在几乎不损失画质的前提下显著降低显存占用

Unverified50%
Sep 18

更新后的VAE已托管在Hugging Face的Comfy-Org仓库中(huggingface.co/Comfy-Org/MiniMax-H3),用户可下载替换原有VAE文件

Unverified50%
Sep 18

更新后的VAE模型文件名为minimax_h3_video_vae_int8_convrot.safetensors

Unverified50%
Sep 18

作者在制作约四分之三进度时转用了社区用户PlagueKind的工作流,配合快速版模型后效率提升且整体质量有所提升

Unverified50%
Sep 18

MiniMax-H3视频生成中,写实度与生成时的百万像素(MP)规模强相关,分辨率越高画面越真实

Unverified50%
Sep 18

在一块5070 Ti显卡上,使用快速版模型生成一段1MP、10秒的片段仅需8步、耗时不到6分钟

Unverified50%
Sep 18

MiniMax-H3对常规运动的处理出色,但快速运动是明显的限制

Unverified50%
Sep 18

生成像样的战斗画面需要一两个专用LoRA的加持,纯靠提示词难以逼出高质量战斗镜头

Unverified50%

16 more timeline events

All Facts (20)

Verified

在RTX 5080 16GB显卡上使用LTX 2.3生成一段8秒视频片段的平均耗时约为2至3分钟

80%
Unverified

MiniMax-H3 可通过 SGLang Diffusion 在 ComfyUI 中运行

50%
Unverified

MiniMax-H3 模型的首帧渲染最多可提前约一分钟完成,并在 A100、B200 和 RTX PRO 6000 上降低了 25–29 GiB 的峰值显存占用

50%
Unverified

更新后的VAE已托管在Hugging Face的Comfy-Org仓库中(huggingface.co/Comfy-Org/MiniMax-H3),用户可下载替换原有VAE文件

50%
Unverified

更新后的VAE模型文件名为minimax_h3_video_vae_int8_convrot.safetensors

50%
Unverified

控制表情的方法是准备一张带目标表情的参考图,加入retention_analysis并在镜头描述中点名调用,可大幅改善表情表现

50%
Unverified

通过将破损墙面镜头裁剪作为参考图并在retention_analysis中指示模型注意,可以在不同镜头间保持环境破坏的一致性

50%
Unverified

使用retention_analysis保持环境连续性时,唯一瑕疵是偶尔会把损伤错误地复制到另一面墙上

50%
Unverified

retention_analysis是MiniMax-H3工作流中用于指示模型在生成新镜头时保留参考图中特定视觉元素状态的机制

50%
Unverified

在一块5070 Ti显卡上,使用快速版模型生成一段1MP、10秒的片段仅需8步、耗时不到6分钟

50%
Unverified

MiniMax-H3视频生成中,写实度与生成时的百万像素(MP)规模强相关,分辨率越高画面越真实

50%
Unverified

MiniMax-H3对常规运动的处理出色,但快速运动是明显的限制

50%
Unverified

生成像样的战斗画面需要一两个专用LoRA的加持,纯靠提示词难以逼出高质量战斗镜头

50%
Unverified

远景拍摄时MiniMax-H3对面部的处理会明显退化,FaceRefine工具可改善但在单一主体时效果最好,多人场景表现打折扣

50%
Unverified

固体在倾倒时的行为比液体更加多样化和离散,模型需根据物体隐含材质属性选择不同的物理响应模式

50%
Unverified

MiniMax-H3在处理多个物体发生重叠(overlap)的场景时表现明显下降,依然挣扎很多

50%
Unverified

通过保持场景不变、只替换关键对象的对比实验,可以在受控条件下观察模型的物理推理能力

50%
Unverified

该物理测试的方法是使用公开的倒水视频,将画面中的水替换成不同物质,观察模型处理这些物质被倾倒时的行为

50%
Unverified

作者指出相较于其他开源权重模型,MiniMax-H3的表现是一次大的飞跃(a big leap forward)

50%
Unverified

SGLang v0.5.17提供对Kimi K3和MiniMax-H3等前沿模型的零日(day-0)支持

50%

Source Articles