待验证50% 置信事实精确时间
CPU、GPU、NPU的协同调度由英特尔的OpenVINO框架统一管理
1
来源数
50%
置信度
长期有效
时效性
2026/7/6
首次发现
来源
AI本地Agent实测:自动录制世界杯高光,告别熬夜看球
bilibili吟惋兮2026/7/4
相关事实
待验证llama.cpp 支持 CPU+GPU 混合推理,通过 --n-gpu-layers 参数控制卸载到 GPU 的层数,并内置兼容 OpenAI API 格式的 HTTP 服务端72% 相似待验证Intel的oneAPI将SYCL定位为统一CPU、GPU、FPGA和AI加速器Gaudi系列的编程接口72% 相似待验证Inductor 后端针对 CPU 生成 OpenMP 代码,针对 GPU 生成优化的 Triton kernel72% 相似待验证NVLink-C2C技术实现了CPU与GPU之间的高速互联70% 相似已验证llama.cpp支持CPU与GPU的混合推理(层卸载),可将模型部分层加载到GPU显存、其余层保留在内存69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/113488API
curl https://kongchang.com/api/v1/knowledge/claims/113488MCP
get_claim(id=113488)