待验证50% 置信基准精确时间
在AMD 7900XT显卡上从Ollama换用LM Studio并重新调参后,token生成速度从每秒5提升到36
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/6
首次发现
有效期至:2026/10/4
来源
AMD显卡跑本地大模型:卸载Ollama换LM Studio,速度翻7倍
bilibili人工智能打老虎2026/7/2
相关事实
待验证Anthros MLX 6bit + Diflash方案运行Qwen3.6-27B的生成速度约为22 tok/s71% 相似待验证AMD锐龙平台DDR5甜点频率是6000MHz,此时内存控制器(UCLK)与内存(MCLK)保持1:1同步;超过6400MHz会强制降为2:1分频反而掉延迟性能70% 相似待验证RTX 4060生成速度可达GTX 1060的3-5倍69% 相似待验证AMD官方基准宣称Halo在GLM Flash 30B的Token生成快40%、Qwen 3.5 122B快12%、GPT-OSS 120B快7%,图像生成比Apple M4 Pro快3到7倍69% 相似待验证AMD AM5平台(7000/9000系)内存甜点位是DDR5-6000 CL30,超过6400MHz需切换FCLK异步模式会导致延迟不降反增,性价比最优先选EXPO 6000 CL30套条69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/116132API
curl https://kongchang.com/api/v1/knowledge/claims/116132MCP
get_claim(id=116132)