待验证50% 置信基准精确时间
旗舰模型Sol运行于Cerebras晶圆级芯片上,推理速度达750 Token/秒,约为上一代的15倍
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/8
首次发现
有效期至:2026/10/6
来源
GPT-5.6作弊率史上最高:METR报告揭示AI安全危机
bilibili照观AI2026/6/27
相关事实
待验证So将在Cerebras平台上线,推理速度可达每秒约750个Token,约为传统GPU集群的3-5倍74% 相似待验证8月13日OpenAI预览了Ultrafast,一个全新API层级,运行旗舰模型速度最高可达常规14倍,约每秒输出750个Token,运行在Cerebras硬件上69% 相似待验证配备NVIDIA GPU并使用CUDA加速,7B模型可以达到50-100+ token/s的推理速度65% 相似待验证分析推测该模型分布在约70到100个Cerebras晶圆级芯片上,每个芯片承载一个神经网络层,总计70到90层65% 相似待验证Ollama CPU 推理模式下生成速度会从 GPU 的每秒 30-80 个 Token 降至每秒 2-8 个 Token64% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/230831API
curl https://kongchang.com/api/v1/knowledge/claims/230831MCP
get_claim(id=230831)