[控场AI]
产品Dynamo

NVIDIA Dynamo

NVIDIA推出的分布式推理框架,专为大语言模型在多GPU、多节点集群上的高效服务而设计,核心能力包括KV Cache跨节点调度与复用、请求动态路由及与Kubernetes等编排系统的集成

时间轴 (近 90 天)

9月22日

NVIDIA Dynamo 是 NVIDIA 推出的分布式推理框架,专为大语言模型在多 GPU、多节点集群上的高效服务而设计

待验证50%
9月22日

NVIDIA Dynamo 的核心能力包括 KV Cache 的跨节点调度与复用、请求的动态路由,以及与 Kubernetes 等编排系统的集成

待验证50%
9月22日

Topograph 可结合 NVIDIA Dynamo,使推理请求被路由到与已缓存 KV 数据物理距离最近的 GPU 节点,减少缓存迁移带来的通信开销

待验证50%
9月10日

NVIDIA Dynamo基于NATS和etcd实现分布式请求路由与服务发现,支持基于NIXL的高效GPU间数据传输,并与TensorRT-LLM和vLLM等推理后端兼容

待验证50%

全部知识事实 (4)

来源文章