待验证60% 置信基准精确时间
在16GB M4 Mac Mini上,Ornith 9B GGUF版本加载后6.2GB用于模型权重,最大上下文长度可达26万tokens
2
来源数
60%
置信度
中期 (~90 天)
时效性
2026/7/7
首次发现
有效期至:2026/10/5
来源
Ornith 9B实测:16GB Mac Mini能否胜任本地AI编码?
bilibili四月的尾巴_2026/7/4
相关事实
待验证27B稠密模型在24GB M4 Pro Mac mini上使用4-bit量化可以运行,速度约为11 tok/s78% 相似待验证Llama 3.3 70B经过4-bit量化后模型大小约为40GB,可在配备64GB内存的Mac Studio或单张48GB显存的专业GPU上运行77% 相似待验证在16GB内存硬件条件下只能容纳5GB以内的模型,因此该开发者使用了体积约4.8GB的Qwen 2.5 7B 4bit量化模型,配8K上下文窗口72% 相似待验证测试在一台36GB内存的MacBook上进行,模型以128K上下文大小和Q8 KV缓存加载71% 相似待验证Ornith 35B(4bit MLX)在Mac Studio上生成速度约100 tokens/秒,比9B在Mac Mini上快近5倍71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/176264API
curl https://kongchang.com/api/v1/knowledge/claims/176264MCP
get_claim(id=176264)