待验证50% 置信事实精确时间
CrofAI声称用Vast租用的RTX Pro 6000运行Kimi K3,但即便采用Q2_K量化该模型也需约802GiB显存,而Vast上最大8卡RTX PRO 6000机器仅有765GiB显存
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/15
首次发现
有效期至:2026/12/14
来源
涉及实体
相关事实
待验证6GB显存的RTX 3060可以流畅运行基于Flux的Krea2 Turbo大模型72% 相似待验证实测在RTX A6000(48GB显存)机器上,将10亿参数草稿模型挂载到Qwen3的3.4B目标模型进行测试70% 相似待验证将8个请求合并批处理时,单张RTX PRO 6000能够达到约220 output tok/s的聚合吞吐量,而两张RTX 3090的旧配置只有约19 tok/s70% 相似待验证UP主的测试环境为RTX 5070显卡(12GB显存)、Qwen3系列9B参数模型、64K上下文长度69% 相似待验证使用QLoRA在RTX 4090上微调Llama 7B模型,显存占用约5-8GB69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/922187API
curl https://kongchang.com/api/v1/knowledge/claims/922187MCP
get_claim(id=922187)