Unverified50% confidenceFactExact time
参考视频在技术层面充当「结构先验」角色,纹理细节和光照风格由文本提示词和模型自身预训练知识填充
1
Sources
50%
Confidence
Long-term
Relevance
7/12/2026
First Seen
Sources
深度图与OpenPose提取工作流:AI视频可控生成实战指南
redditr/comfyui7/11/2026
Related Claims
Unverified参考驱动式视频生成的学术代表性工作包括Animate Anyone、Champ、MimicMotion等,它们通过引入专用参考编码器(ReferenceNet)或外观注意力机制实现身份与运动的分离79% similarUnverified参考视频模板通过提取运动信息(如光流、姿态骨架、深度信息)作为生成过程的条件约束,常见实现方式包括ControlNet、IP-Adapter、Motion LoRA73% similarUnverified有效的视频生成提示词通常需涵盖主体描述、环境描述、镜头语言及画质关键词四个维度73% similarUnverifiedIC-LoRA 借鉴大语言模型的 In-Context Learning 范式,将参考图像或视频帧作为条件信号,通过跨注意力机制影响目标帧的生成72% similarUnverified该实验使用DiffusionGemma自定义节点搭配LTX 2.3视频生成模型,输入为一张静态参考图、一段参考视频和一句自然语言提示词72% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/490437API
curl https://kongchang.com/api/v1/knowledge/claims/490437MCP
get_claim(id=490437)