Unverified50% confidenceFactExact time
CPU、GPU、NPU的协同调度由英特尔的OpenVINO框架统一管理
1
Sources
50%
Confidence
Long-term
Relevance
7/6/2026
First Seen
Sources
AI本地Agent实测:自动录制世界杯高光,告别熬夜看球
bilibili吟惋兮7/4/2026
Related Claims
Unverifiedllama.cpp 支持 CPU+GPU 混合推理,通过 --n-gpu-layers 参数控制卸载到 GPU 的层数,并内置兼容 OpenAI API 格式的 HTTP 服务端72% similarUnverifiedIntel的oneAPI将SYCL定位为统一CPU、GPU、FPGA和AI加速器Gaudi系列的编程接口72% similarUnverifiedInductor 后端针对 CPU 生成 OpenMP 代码,针对 GPU 生成优化的 Triton kernel72% similarUnverifiedNVLink-C2C技术实现了CPU与GPU之间的高速互联70% similarVerifiedllama.cpp支持CPU与GPU的混合推理(层卸载),可将模型部分层加载到GPU显存、其余层保留在内存69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/113488API
curl https://kongchang.com/api/v1/knowledge/claims/113488MCP
get_claim(id=113488)