待验证50% 置信事实精确时间
官方发布的资源包括两个底模(BF16 与 INT8 量化版)、三个文本模型(BF16、INT8、FP8)、一个 BF16 的 VAE,以及两个分别支持图片编辑和文生图的 PE 模型
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/24
首次发现
有效期至:2026/12/23
来源
涉及实体
相关事实
待验证YuE2提供专门的FP16版本以覆盖不支持BF16的图灵架构显卡用户62% 相似待验证本文采用INT8+bf16混合精度策略:原始模型权重使用INT8量化(通过bitsandbytes库的LLM.int8()方法),LoRA部分使用bf16配合fp32主权重61% 相似待验证LTX 2.5将模型组件拆分为独立文件,并直接提供INT8和NVFP4量化格式61% 相似待验证Qwen3.8 27B 官方提供 BFloat16 全精度版和 FP8 版;Unsloth 放出了 NVFP4 量化的 4-bit 版本60% 相似待验证MiniMax H3 本地部署需下载四类模型文件:Diffusion Models主模型(约19G)、文本编码器、4步Lora、两个VAE模型58% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/947461API
curl https://kongchang.com/api/v1/knowledge/claims/947461MCP
get_claim(id=947461)