Vulkan
Khronos Group制定的跨平台低级GPU图形与计算API,提供对GPU硬件的直接控制能力,具有低CPU开销、高并行性和跨平台特性,广泛用于游戏、图形渲染和GPU计算领域。
Core Facts
Timeline (last 90 days)
wgpu 是基于 WebGPU 标准的跨平台图形 API 库,可在 Vulkan、Metal、DirectX 12 等底层后端上运行 GPU 计算与渲染
MESA 26.1 驱动使 B70 在 Qwen3 30B-A3B 类 MoE 模型上的 Vulkan 路径从 38 翻倍到 76 tokens/s,接近 R9700 的约 77 tokens/s
开发者MAAN用Vulkan重写并开源了DLSS 5的神经渲染网络,项目名为OpenDLSS NR,采用MIT协议
Valve 基于 Wine 开发的 Proton 集成了 DXVK(DirectX 到 Vulkan 的转译层)等组件,是 Steam Deck 的核心技术基础
将 GNM 调用映射到 Vulkan 是逆向工程社区普遍认为最可行的路径,因为 Vulkan 同样是显式控制 GPU 的底层 API
OpenDLSS 是一个用 Vulkan 对英伟达 DLSS 5 的神经渲染网络进行重新实现的开源项目
重实现在开源社区有先例,如 Wine 对 Windows API 的重实现、Mesa 对 OpenGL/Vulkan 驱动的开源实现;法律上重实现本身通常被认为合法,只要未直接复制受版权保护的代码或二进制权重
Ollama的KV Cache支持三档量化:F16、Q8_0、Q4_0,硬件抽象层覆盖CUDA、ROCm、Vulkan、Metal四条线
不接3090时该机器可变身低功耗服务器,仅靠7840U、64GB内存、Vulkan后端和llama.cpp跑小模型
Colibri后端支持CUDA、Metal、Vulkan、NUMA共用一套引擎
31 more timeline events
All Facts (20)
llama.cpp支持Metal、CUDA、Vulkan和SYCL等GPU加速后端
80%VerifiedGPUI 采用 Metal(macOS)和 Vulkan(跨平台)作为渲染后端
80%Verifiedllama.cpp支持NVIDIA GPU通过CUDA、AMD GPU通过ROCm、Apple Silicon通过Metal GPU加速,也支持纯CPU推理
70%UnverifiedGodot引擎本身使用C++编写,核心代码约150万行,支持Vulkan、OpenGL ES 3.0和兼容性渲染器三种渲染后端
80%Unverified当 ROCm 版本无法运行时,系统会回退到 Vulkan 的 sd.cpp 构建
70%UnverifiedSwiftShader是Google开发的高性能CPU渲染器,支持Vulkan和WebGPU
70%UnverifiedWebGPU 引入了对标 Vulkan/Metal/D3D12 的计算着色器能力,可执行通用GPU计算(GPGPU)
60%Unverifiedwgpu 是基于 WebGPU 标准的跨平台图形 API 库,可在 Vulkan、Metal、DirectX 12 等底层后端上运行 GPU 计算与渲染
50%UnverifiedMESA 26.1 驱动使 B70 在 Qwen3 30B-A3B 类 MoE 模型上的 Vulkan 路径从 38 翻倍到 76 tokens/s,接近 R9700 的约 77 tokens/s
50%UnverifiedValve 基于 Wine 开发的 Proton 集成了 DXVK(DirectX 到 Vulkan 的转译层)等组件,是 Steam Deck 的核心技术基础
50%Unverified将 GNM 调用映射到 Vulkan 是逆向工程社区普遍认为最可行的路径,因为 Vulkan 同样是显式控制 GPU 的底层 API
50%Unverified重实现在开源社区有先例,如 Wine 对 Windows API 的重实现、Mesa 对 OpenGL/Vulkan 驱动的开源实现;法律上重实现本身通常被认为合法,只要未直接复制受版权保护的代码或二进制权重
50%UnverifiedOpenDLSS 是一个用 Vulkan 对英伟达 DLSS 5 的神经渲染网络进行重新实现的开源项目
50%UnverifiedOllama的KV Cache支持三档量化:F16、Q8_0、Q4_0,硬件抽象层覆盖CUDA、ROCm、Vulkan、Metal四条线
50%Unverified不接3090时该机器可变身低功耗服务器,仅靠7840U、64GB内存、Vulkan后端和llama.cpp跑小模型
50%UnverifiedColibri后端支持CUDA、Metal、Vulkan、NUMA共用一套引擎
50%UnverifiedWebGPU 对标现代图形API(Vulkan、Metal、DX12),提供更低驱动开销、计算着色器支持和更显式的资源管理
50%UnverifiedInferBench 聚焦于在 AMD 硬件上比较 Vulkan 后端与 HIP 后端的推理性能
50%UnverifiedVulkan 是跨平台图形与计算 API,被 llama.cpp 等项目用作通用 GPU 推理后端,优势是兼容性广、部署简单、几乎不依赖厂商专用驱动栈
50%Unverifiedllama.cpp 的 Vulkan 后端让支持 Vulkan 1.2+ 的 GPU 用户(包括部分 AMD 老款显卡甚至 Intel 集显)都能获得 GPU 加速
50%