[控场AI]
模型

Nanosaur 2

轻量级开源图像生成模型,采用DiT(Diffusion Transformer)架构,拥有670M参数,配套270M参数文本编码器和全新VAE,支持自然语言与标签两种输入方式,基于动漫风格数据集训练

时间轴 (近 90 天)

9月26日

Nanosaur 2 是一款拥有 6.7 亿(670M)参数的开源图像生成模型

待验证50%
9月26日

Nanosaur 2 在 Reddit 社区正式发布

待验证50%
9月26日

Nanosaur 2 的核心是一个 670M 参数的 DiT(Diffusion Transformer)结构,配套一个全新的 VAE 以及一个 270M 参数的文本编码器

待验证50%
9月26日

Nanosaur 2 基于 e6 与 danbooru 全量数据集训练,规模约 1400 万张图像

待验证50%
9月26日

Nanosaur 2 支持自然语言描述与标签(tags)两种输入方式

待验证50%
9月26日

据发布者描述,Nanosaur 2 在与 SDXL 模型的对比中很多时候能够胜出,尽管其参数量远小于 SDXL

待验证50%
9月26日

Nanosaur 2 模型本体约 1.3GB,加载文本编码器和 VAE 后总体积约 2GB

待验证50%
9月26日

Nanosaur 2 提供 int8 量化版和 w4a8 量化版,其中 w4a8 可将 DiT 部分压缩到最低约 388MB

待验证50%
9月26日

发布者将 w4a8 量化版本标注为 not recommended(不推荐),因其可能在画质上有明显损失

待验证50%
9月26日

Nanosaur 2 标注为 uncensored(无审查),不设内置内容过滤限制

待验证50%

还有 2 条时间轴事件

全部知识事实 (12)

来源文章