[控场AI]
公司Advanced Micro Devices

AMD

Advanced Micro Devices(AMD)是一家美国半导体公司,总部位于加利福尼亚州圣克拉拉,主要设计和销售微处理器(CPU)、图形处理器(GPU)及相关芯片产品。其产品广泛应用于个人电脑、服务器、游戏主机及数据中心等领域。AMD采用无晶圆厂模式,专注于芯片架构研发,是全球x86处理器和独立显卡市场的主要供应商之一。

核心事实

时间轴 (近 90 天)

10月4日

RCCL(ROCm Collective Communications Library)是AMD为ROCm平台开发的集合通信库,功能上对标NVIDIA的NCCL

待验证50%
10月4日

AMD工程师Rishi指出缩短通信耗时能够显著提升端到端性能

待验证50%
10月4日

AMD的硬件互联技术为xGMI/Infinity Fabric,NVIDIA的为NVLink

待验证50%
10月4日

AMD表示将在即将举行的PyTorch Conference(PTC)上进一步分享这项工作的细节

待验证50%
10月4日

AMD将GIN应用于TorchTitan的all-to-all操作后,端到端整体训练性能提升12%到15%

待验证50%
10月4日

AMD团队将RCCL团队在GPU发起网络方面的成果集成到TorchTitan中

待验证50%
10月4日

AMD将GIN应用于TorchTitan的all-to-all操作后,内核层面性能提升最高可达30%

待验证50%
10月4日

AMD的Liz Li与Jia Hui认为没有任何单一的内核生成后端能够在所有算子、芯片和架构上都做到最优

待验证50%
10月4日

FlyDSL是AMD推出的Python原生、基于MLIR的GPU内核DSL(领域特定语言)

待验证50%
10月4日

AMD通过FlyDSL为PyTorch带来了GEMM、Group GEMM以及Flex Attention等优化内核

待验证50%

还有 40 条时间轴事件

全部知识事实 (20)

已验证

ROCm是AMD面向高性能计算和AI工作负载的开源软件平台,包含HIP编程接口,允许CUDA代码以较低成本移植到AMD GPU

90%
已验证

llama.cpp是一个高度优化的C++推理引擎,支持Apple Silicon的Metal加速、NVIDIA的CUDA加速以及AMD的ROCm加速

80%
已验证

AI硬件竞争已从单纯的芯片算力比拼转向内存、互连、系统架构的全面协同优化

75%
已验证

AMD的ROCm和Intel的oneAPI在生态完整度、社区支持和性能调优工具方面与CUDA仍存在显著差距

75%
已验证

Unsloth Desktop支持CPU以及多GPU配置,覆盖NVIDIA、AMD、Intel以及Mac等硬件平台

75%
已验证

MI355X属于AMD Instinct系列数据中心加速卡,基于CDNA架构演进而来

75%
已验证

On x86 architectures, SIMD evolved from SSE (128-bit) to AVX-512 (512-bit), while ARM has NEON and SVE instruction sets

65%
已验证

ROCm是AMD于2016年推出的开源GPU计算平台,当前ROCm 6.x版本已对PyTorch、TensorFlow提供官方支持

65%
已验证

AMD的ROCm平台自2016年启动,提供HIP作为CUDA的兼容层,PyTorch官方已提供ROCm预编译包

65%
已验证

ROCm的核心组件HIP提供与CUDA高度相似的API,使CUDA代码可通过hipify工具转换后在AMD GPU上运行,ROCm版PyTorch复用torch.cuda命名空间

65%
已验证

AMD R7-H255基于Zen 5架构,隶属AMD Ryzen AI 200系列(代号Strix Point)

65%
已验证

Ryzen 7 5800X3D额外堆叠的64MB SRAM使L3缓存总量从32MB翻倍至96MB

65%
已验证

AMD Ryzen 7 5800X3D于2022年首次引入3D V-Cache技术

65%
已验证

当前主流指令集架构包括x86/x86-64(Intel/AMD)、ARM、RISC-V、MIPS和PowerPC

65%
已验证

绝大多数Windows台式机和笔记本电脑使用Intel或AMD处理器,对应amd64架构

65%
已验证

Unsloth 现已在 Docker Hub(unsloth/unsloth)发布全新镜像,涵盖从 Turing 到 Blackwell 各代 NVIDIA GPU,并提供原生 AMD64 与 ARM64 架构镜像

75%
已验证

AMD自2017年推出基于Zen架构的锐龙(Ryzen)处理器

65%
待验证

3D V-Cache技术最早在2022年随Ryzen 7 5800X3D亮相

95%
待验证

现代Intel和AMD处理器支持在系统启动时通过BIOS/UEFI加载微码更新补丁

95%
待验证

AMD已在EPYC产品线中部署3D V-Cache技术,EPYC 9004系列(代号Genoa-X)中的EPYC 9684X等型号配备了高达1152MB(1.1GB)的L3缓存

90%

来源文章