待验证50% 置信基准精确时间
在 AMD RX 7900 显卡实测中,Ornith 35B 总体准确率 85%(21 项通过 18 项),生成速度 74 tokens/秒,提示词处理 850 tokens/秒,显存占用 20GB
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/12
首次发现
有效期至:2026/12/11
来源
涉及实体
相关事实
待验证Gemma量化模型在高性能笔记本电脑上Token生成速度可达每秒20-50个,纯CPU推理约5-15 tokens/秒,INT4量化下NVIDIA RTX 4060/4070可将推理速度提升3-5倍74% 相似待验证Ling 3.0 Tiny在M4 Pro的MacBook上推理速度约为每秒86-90 tokens,在8K上下文下峰值内存约8.34 GiB72% 相似待验证在配备96GB显存的M2 Max上以1-bit精度运行时,简单任务生成速度稳定在约28-30 tokens/秒71% 相似待验证Ornith 35B(4bit MLX)在Mac Studio上生成速度约100 tokens/秒,比9B在Mac Mini上快近5倍71% 相似已验证9600波特率下UART每秒可传输约960个字节(每字节需10个比特:1起始位+8数据位+1停止位)71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/914948API
curl https://kongchang.com/api/v1/knowledge/claims/914948MCP
get_claim(id=914948)