待验证50% 置信事件精确时间
一位Reddit用户让Qwen 3.8 27B(4bit量化版本,100K上下文窗口)在一张RTX 3090显卡上连续自主运行63小时,生成超过5000万tokens,尝试证明黎曼猜想
1
来源数
50%
置信度
短期 (~14 天)
时效性
2026/9/17
首次发现
有效期至:2026/10/1
来源
涉及实体
相关事实
已验证Qwen2.5-Coder-32B在RTX 4090上以Q4量化运行,推理速度可达每秒40-60个token75% 相似待验证在RTX 5060 Ti 16GB + 64GB内存环境下,Qwen3 27B生成响应式个人网站耗时1小时10分钟,平均每秒生成6.42个Token74% 相似待验证约25GB的Q3模型完全在RTX 4090显存(带宽约1TB/s)运行理论上每秒约40个token,而在DDR5内存(约80GB/s)中运行降至每秒1-3个token74% 相似待验证实测在RTX A6000(48GB显存)机器上,将10亿参数草稿模型挂载到Qwen3的3.4B目标模型进行测试72% 相似已验证QLoRA引入4-bit量化技术,使得在单张24GB显存的RTX 3090/4090上微调650亿参数级别的模型成为可能72% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/928574API
curl https://kongchang.com/api/v1/knowledge/claims/928574MCP
get_claim(id=928574)