待验证50% 置信发布精确时间
Unsloth 的 save_pretrained_merged 现已支持压缩的 FP8/FP4 导出,Studio 导出 UI 新增了 imatrix GGUF 与压缩导出选项
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/10
首次发现
有效期至:2026/10/8
来源
Unsloth重磅更新:DeepSeek-V4支持与NVFP4量化导出全解析
rss2026/7/8
相关事实
待验证Unsloth Studio 现已支持训练后导出 NVFP4、FP8、imatrix GGUF 等多种量化格式75% 相似待验证Unsloth 新增对 NVFP4 量化导出的支持64% 相似待验证主流本地部署框架包括Ollama、llama.cpp、LM Studio等,支持在消费级硬件上运行经量化压缩(如GGUF格式4-bit量化)的模型63% 相似待验证对于图灵架构显卡用户,llama.cpp的GGUF量化格式是兼容性更好的替代方案,因为不依赖FP8 Tensor Core支持60% 相似待验证Ollama 底层集成了 llama.cpp 框架,通过 GGUF 量化格式压缩模型权重,使模型能在普通 CPU 或苹果 M 系列芯片上运行59% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/431230API
curl https://kongchang.com/api/v1/knowledge/claims/431230MCP
get_claim(id=431230)