待验证50% 置信基准精确时间
在 8 块 AMD Instinct MI355X 加速卡上,借助 vLLM 推理框架,GLM-5.3 模型实现了 469 tok/s 的单用户解码速度
1
来源数
50%
置信度
短期 (~14 天)
时效性
2026/10/4
首次发现
有效期至:2026/10/18
来源
涉及实体
相关事实
待验证AMD MI355X运行GLM5.2时实现了单节点2626 tokens/秒的推理吞吐量74% 相似待验证AMD 与 EmbeddedLLM 联合发布博客,记录了在 Instinct MI355X 硬件上优化 MiniMax M3 推理服务的过程71% 相似待验证AMD MI300X是AMD面向AI训练与推理的旗舰加速器,采用Chiplet封装,集成192GB HBM3统一内存,单卡峰值BF16算力约为1.3 PFLOPS69% 相似待验证该基准测试在Gemma、Qwen、Kimi、MiniMax四类模型上,基于AMD Instinct MI300X与MI355X硬件进行68% 相似已验证MI355X属于AMD Instinct系列数据中心加速卡,基于CDNA架构演进而来68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/972278API
curl https://kongchang.com/api/v1/knowledge/claims/972278MCP
get_claim(id=972278)