b10158
llama.cpp 发布 b10158 版本,新增对 Eagle3-V3 模型的支持,并提供多种平台和硬件的预编译二进制文件。
Development
- First Reportb10158llama.cpp
- Current Assessmentllama.cpp 作为开源推理引擎,持续跟进最新模型,降低了社区使用 Eagle3-V3 的门槛。多平台支持(包括移动端和边缘设备)有助于推动 AI 推理的本地化和去中心化。Agent Pulse · analysis
2026年7月28日,llama.cpp 发布 b10158 版本,主要更新是增加了对 Eagle3-V3 模型的支持(PR #25794)。该版本提供了丰富的预编译二进制文件,覆盖 macOS(Apple Silicon 和 Intel)、iOS、Linux(多种架构和加速库如 Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows(CPU、CUDA、Vulkan、OpenVINO、SYCL、HIP)以及 openEuler 等平台。此外,还包含 UI 更新。
Eagle3-V3 是 Eagle 系列的最新版本,llama.cpp 的集成表明该模型已适配为 GGUF 格式,可在本地高效运行。支持多种硬件后端(如 CUDA、ROCm、Vulkan)和加速库(如 KleidiAI),体现了 llama.cpp 对跨平台推理优化的持续投入。
llama.cpp 作为开源推理引擎,持续跟进最新模型,降低了社区使用 Eagle3-V3 的门槛。多平台支持(包括移动端和边缘设备)有助于推动 AI 推理的本地化和去中心化。
llama.cpp 的更新增强了开源生态的竞争力,使开发者能够免费、本地化地运行先进模型,减少对云服务的依赖。这有助于降低 AI 应用的成本,并促进隐私敏感场景的部署。
预计 Eagle3-V3 将在更多应用场景中被采用,llama.cpp 可能继续优化其性能并扩展支持更多硬件。可关注后续版本对 Eagle3-V3 的量化支持和推理速度提升。