AGENT PULSESJCPal Special EditionAI 行业证据与趋势
2026年7月30日 · llama.cpp

b10192

发生了什么

llama.cpp 发布 b10192 版本,支持 macOS Apple Silicon (arm64) 及 KleidiAI 加速、Linux x64/arm64 (CPU/Vulkan/ROCm/OpenVINO/SYCL)、Android arm64 (CPU)、Windows x64/arm64 (CPU/OpenCL/CUDA/Vulkan/OpenVINO/SYCL/HIP)、openEuler x86/aarch64 等平台,并提供 UI。

EVENT STORY

发展脉络

  1. 首次出现b10192llama.cpp
  2. 当前判断llama.cpp 作为最流行的本地推理引擎之一,其版本更新反映了开源社区对跨平台、多后端推理的需求。支持国产 openEuler 操作系统,可能推动 AI 推理在信创场景的落地。Agent Pulse · 分析
改变了什么

llama.cpp 发布 b10192 版本,扩展了多平台支持,包括 macOS Apple Silicon (arm64) 并启用 KleidiAI 加速,Linux 支持 x64 和 arm64 的 CPU、Vulkan、ROCm 7.2、OpenVINO、SYCL FP32/FP16,Android arm64 CPU,Windows 支持 x64 和 arm64 的 CPU、OpenCL Adreno、CUDA 12.4/13.3、Vulkan、OpenVINO、SYCL、HIP,以及 openEuler x86 和 aarch64 的 310p 和 910b (ACL Graph) 平台。同时提供 UI 界面。

能力边界怎么变了

该版本新增对 KleidiAI 加速的支持,表明 llama.cpp 在 ARM 架构上的推理优化持续深入。多平台覆盖包括 ROCm、CUDA、Vulkan、OpenVINO、SYCL、HIP 等,体现了对主流 GPU 和加速器的广泛兼容。openEuler 平台的支持则指向国产化生态适配。

为什么重要

llama.cpp 作为最流行的本地推理引擎之一,其版本更新反映了开源社区对跨平台、多后端推理的需求。支持国产 openEuler 操作系统,可能推动 AI 推理在信创场景的落地。

对谁有影响

对于依赖本地推理的开发者,该版本降低了在多种硬件和操作系统上部署 LLM 的门槛,尤其利好 ARM Mac 和国产化环境。

接下来观察

后续可关注 KleidiAI 加速在更多 ARM 设备上的性能数据,以及 openEuler 平台在政企市场的采用情况。