[控场AI]
模型

Ming UniVision

Ming UniVision是由蚂蚁集团开发并开源的视觉语言大模型,旨在统一图像理解、图像生成与图像编辑三类任务于单一模型框架之中。该模型能够处理多模态输入,支持基于自然语言指令的图像内容分析与创作,适用于视觉问答、图像描述生成及图像修改等场景,是多模态人工智能领域的开源实践之一。

来源文章