[控场AI]
模型Qwen Image 2.1 Edit

Qwen Image 2.1 Edit

阿里通义千问团队推出的多图参考图像编辑模型,支持通过占位符语法引用多张图片,实现姿态迁移、纹理替换、光照迁移、风格迁移等精细化图像编辑操作

时间轴 (近 90 天)

9月21日

姿态迁移提示词可写作 replace the pose of <image 1> with the pose of <image 2>, keep the character of <image 1>,构成「主体+参考+保留项」三段式结构

待验证50%
9月21日

多模态大语言模型(MLLM)将图像编码为 token 序列,每张图像对应独立的 token 序列,提示词中的 <image N> 标记使模型能将语义指令与特定图像 token 流对齐

待验证50%
9月21日

Qwen Image 2.1 Edit 支持纹理替换、光照与背景替换等属性替换类编辑,通过点名要替换的属性实现解耦编辑

待验证50%
9月21日

当多个约束之间存在冲突时,模型可能在不同约束间随机倾向,导致输出稳定性下降

待验证50%
9月21日

Qwen Image 2.1 Edit 能理解摄影术语如 right side view、low-angle shot、medium shot、backlight 来控制镜头视角

待验证50%
9月21日

当两张参考图的拍摄角度、光线或风格差异较大时,跨图合成结果的自然度会显著下降,这是当前多图编辑模型普遍面临的瓶颈

待验证50%
9月21日

多图编辑提示词的使用心得是:提示词越结构化、约束越明确,输出越可控

待验证50%

全部知识事实 (7)

来源文章