待验证50% 置信解决方案精确时间
ComfyUI-INT4-Fast支持原生混合精度检查点,按逐层粒度决定计算路径:主干模块路由至INT4 Tensor Core,敏感层(patch projection)以INT8格式导向Triton的INT8执行路径
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/12
首次发现
有效期至:2026/10/10
来源
ComfyUI-INT4-Fast:6GB显卡流畅运行Flux大模型实测
redditr/StableDiffusion2026/7/10
相关事实
待验证ComfyUI-INT4-Fast在BobJohnson24的ComfyUI-INT8-Fast基础上独立改进而来,底层依托comfy-kitchen调用GPU的Tensor Core75% 相似待验证节点采用逐层动态路由机制:主干模块路由至INT4 Tensor Core执行,敏感层(patch projection层)以INT8格式存储并导向Triton的INT8执行路径73% 相似待验证TensorRT支持FP32/FP16/INT8/FP8多种精度校准72% 相似待验证RTX 6000 Ada的第四代Tensor Core支持FP8精度运算69% 相似待验证TensorRT-LLM内置对NVFP4等量化格式的端到端支持,包括量化权重自动解包、混合精度推理调度及算子融合优化69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/489746API
curl https://kongchang.com/api/v1/knowledge/claims/489746MCP
get_claim(id=489746)