MiniMax-H3
MiniMax发布的多模态视频生成模型,能够在单次请求中同时生成视频和同步立体声音轨,支持文本转视频加音频、首尾帧条件生成、图像/视频/音频参考条件生成等多种任务模式
时间轴 (近 90 天)
一位Reddit用户发布了针对MiniMax-H3的第二轮物理知识测试
该物理测试的方法是使用公开的倒水视频,将画面中的水替换成不同物质,观察模型处理这些物质被倾倒时的行为
第一轮实验聚焦于液体换液体,第二轮实验将测试对象升级为固体甚至活体对象
固体在倾倒时的行为比液体更加多样化和离散,模型需根据物体隐含材质属性选择不同的物理响应模式
作者指出相较于其他开源权重模型,MiniMax-H3的表现是一次大的飞跃(a big leap forward)
MiniMax-H3在处理多个物体发生重叠(overlap)的场景时表现明显下降,依然挣扎很多
通过保持场景不变、只替换关键对象的对比实验,可以在受控条件下观察模型的物理推理能力
作者表示仍在深入探索该模型,并计划发布更多实验,下次不再使用水
全部知识事实 (8)
通过保持场景不变、只替换关键对象的对比实验,可以在受控条件下观察模型的物理推理能力
50%待验证该物理测试的方法是使用公开的倒水视频,将画面中的水替换成不同物质,观察模型处理这些物质被倾倒时的行为
50%待验证第一轮实验聚焦于液体换液体,第二轮实验将测试对象升级为固体甚至活体对象
50%待验证固体在倾倒时的行为比液体更加多样化和离散,模型需根据物体隐含材质属性选择不同的物理响应模式
50%待验证作者指出相较于其他开源权重模型,MiniMax-H3的表现是一次大的飞跃(a big leap forward)
50%待验证MiniMax-H3在处理多个物体发生重叠(overlap)的场景时表现明显下降,依然挣扎很多
50%待验证作者表示仍在深入探索该模型,并计划发布更多实验,下次不再使用水
50%待验证一位Reddit用户发布了针对MiniMax-H3的第二轮物理知识测试
50%