Unverified50% confidenceReleaseExact time
Unsloth 的 save_pretrained_merged 现已支持压缩的 FP8/FP4 导出,Studio 导出 UI 新增了 imatrix GGUF 与压缩导出选项
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/10/2026
First Seen
Valid until: 10/8/2026
Sources
Unsloth重磅更新:DeepSeek-V4支持与NVFP4量化导出全解析
rss7/8/2026
Related Claims
UnverifiedUnsloth Studio 现已支持训练后导出 NVFP4、FP8、imatrix GGUF 等多种量化格式75% similarUnverifiedUnsloth 新增对 NVFP4 量化导出的支持64% similarUnverified主流本地部署框架包括Ollama、llama.cpp、LM Studio等,支持在消费级硬件上运行经量化压缩(如GGUF格式4-bit量化)的模型63% similarUnverified对于图灵架构显卡用户,llama.cpp的GGUF量化格式是兼容性更好的替代方案,因为不依赖FP8 Tensor Core支持60% similarUnverifiedOllama 底层集成了 llama.cpp 框架,通过 GGUF 量化格式压缩模型权重,使模型能在普通 CPU 或苹果 M 系列芯片上运行59% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/431230API
curl https://kongchang.com/api/v1/knowledge/claims/431230MCP
get_claim(id=431230)