待验证50% 置信基准精确时间
实测在RTX 3060(6GB显存)、32GB RAM上运行预量化Krea2 Turbo,1024×1024分辨率8步Euler采样,速度为1.78 s/it,总耗时17.64秒
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/12
首次发现
有效期至:2026/10/10
来源
ComfyUI-INT4-Fast:6GB显卡流畅运行Flux大模型实测
redditr/StableDiffusion2026/7/10
相关事实
待验证开发者公布在RTX 3050 Laptop(4GB)上微调Llama-3.1-8B的实测结果为训练速度119.6 tok/s,峰值显存3.32 GB80% 相似待验证RTX 5090上Qwen3.6 27B模型预填充速度从174提升到253 token/s,显存占用约18GB76% 相似待验证6GB显存的RTX 3060可以流畅运行基于Flux的Krea2 Turbo大模型74% 相似待验证RTX 5090上Qwen3.6 35B-A3B推理速度达220 token/s,显存占用约23GB73% 相似待验证Llama 3.1 8B Instruct在配备RTX 3090(24GB显存)的服务器上即可流畅运行,推理延迟通常在数秒以内73% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/489327API
curl https://kongchang.com/api/v1/knowledge/claims/489327MCP
get_claim(id=489327)