待验证50% 置信事实精确时间
该 LoRA 属于视频到视频(Video-to-Video, V2V)类型,核心能力是在保留原始画面主体内容的前提下重新解算出不同的相机路径
1
来源数
50%
置信度
长期有效
时效性
2026/9/20
首次发现
来源
涉及实体
相关事实
待验证该 LoRA 基于 MiniMax H3 视频模型微调而来,采用参考帧引导(Ref2VA)的思路完成跨视角变换75% 相似待验证视频VQ-VAE、3D卷积、均匀采样关键帧后用ViT编码是主流的视频token化方法72% 相似待验证VideoViT 是将 Vision Transformer 架构扩展至视频域的技术路线,通过在时间维度引入注意力机制建模帧间关系,并使用 Tubelet Embedding 将连续帧时空体素化为三维 patch69% 相似待验证rv2v 是角色替换最常用的任务模式,代表 Reference + Video69% 相似待验证一位 Reddit 用户对 WAN 2.1 图生视频模型上的 11 款物理动效类 LoRA 进行了控制变量式横评68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/937577API
curl https://kongchang.com/api/v1/knowledge/claims/937577MCP
get_claim(id=937577)