Unverified60% confidenceFactExact time
QLoRA 在 LoRA 基础上引入 NF4(Normal Float 4)4-bit量化格式,并采用双量化和分页优化器,可在24GB RTX 4090单张消费级显卡上微调7B模型
2
Sources
60%
Confidence
Long-term
Relevance
7/16/2026
First Seen
Sources
Related Claims
VerifiedQLoRA引入4-bit量化技术,使得在单张24GB显存的RTX 3090/4090上微调650亿参数级别的模型成为可能80% similarPartially VerifiedQLoRA论文验证了NF4量化配合LoRA微调可在65B参数模型上将显存需求从780GB降至48GB,同时保持接近全精度微调的性能74% similarUnverified使用IQ4_XS配合-fa 1 -ctk q8_0 -ctv q8_0对KV缓存进行q8_0量化后,可加载完整32k上下文,常驻内存约16.6GB72% similarUnverifiedLlama 3 70B量化版(Q4精度)仍需约35GB内存71% similarUnverified使用QLoRA在RTX 4090上微调Llama 7B模型,显存占用约5-8GB71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/527823API
curl https://kongchang.com/api/v1/knowledge/claims/527823MCP
get_claim(id=527823)