Unverified50% confidenceFactExact time
张量并行把单个层内的矩阵运算切分到多张GPU上并行计算
1
Sources
50%
Confidence
Long-term
Relevance
10/6/2026
First Seen
Sources
Related Entities
Related Claims
Unverified张量并行是将单个层的计算(如矩阵乘法)拆分到多个GPU上并行执行,通信频率高,通常要求GPU之间有高带宽互联如NVLink77% similarVerified大模型推理本质上是大量矩阵乘法运算,GPU拥有数千个并行计算核心适合这类任务76% similarUnverified多节点管理在架构上类似轻量级 GPU 集群调度,通过统一控制面汇聚多台机器算力并按需分发推理任务74% similarVerifiedTensorRT的算子融合将计算图中多个连续的小算子合并为一个大算子,减少GPU内核启动次数和中间结果的内存读写;典型融合操作可将卷积、批归一化和激活函数三步合并为单次GPU内核调用74% similarUnverified张量并行(Tensor Parallelism)是将单个模型层的权重矩阵切分到多块 GPU 上并行计算,适用于模型参数超出单卡显存的场景73% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/982620API
curl https://kongchang.com/api/v1/knowledge/claims/982620MCP
get_claim(id=982620)