已确认事实
llama.cpp 在 GitHub Releases 发布 b10077。发布说明显示,该版本为 OpenVINO 后端加入 GGML_BACKEND_DL_IMPL() 宏调用;说明称该调用此前在其他后端已存在,并称该改动可修复 issue #25586 所涉问题。
该版本提供 macOS、iOS 与多种 Linux 平台的预构建包,包括 CPU、Vulkan、ROCm 和 OpenVINO 等变体。
为什么重要
这一改动针对 OpenVINO 后端的动态加载实现,有助于改善使用该后端进行本地模型推理时的兼容性。
仍待确认
发布说明未提供对不同硬件和工作负载的性能测试结果。