待验证50% 置信事实精确时间
UP主的测试环境为RTX 5070显卡(12GB显存)、Qwen3系列9B参数模型、64K上下文长度
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/25
首次发现
有效期至:2026/11/23
来源
涉及实体
相关事实
待验证实测在RTX A6000(48GB显存)机器上,将10亿参数草稿模型挂载到Qwen3的3.4B目标模型进行测试77% 相似待验证普通消费级显卡(如RTX 3060/4060)即可流畅运行Llama 3、Qwen2.5、Mistral等70亿参数级别模型74% 相似待验证Qwen 4B 和 7B 版本在 8GB 显存的 RTX 3060 等入门级显卡上即可流畅运行74% 相似待验证拥有8GB以上显存的显卡(如RTX 3060/4060及以上)可流畅运行7B-14B参数量的开源模型74% 相似待验证在RTX 5070(12GB显存)配置下,本地Qwen3 9B模型的输出速度达到约70-76 token/秒73% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/798208API
curl https://kongchang.com/api/v1/knowledge/claims/798208MCP
get_claim(id=798208)