b10195
llama.cpp 发布 b10195 版本,包含测试优化(避免多次构建 get-model.cpp)、修复量化类型选择,并提供 macOS、Linux、Windows、Android、iOS 等多平台二进制下载。
发展脉络
- 首次出现b10195llama.cpp
- 当前判断llama.cpp 持续高频发布,保持对多平台(包括 s390x、openEuler 等小众架构)的支持,体现了开源社区对推理部署广泛兼容性的重视。Agent Pulse · 分析
llama.cpp 项目发布 b10195 版本,主要变更包括:测试方面避免多次构建 get-model.cpp(#26317)、移除 get-model.cpp、修复量化类型选择。该版本提供多平台支持:macOS Apple Silicon(arm64,含 KleidiAI 加速)、macOS Intel(x64,已禁用)、iOS XCFramework;Linux Ubuntu x64(CPU)、Ubuntu arm64(CPU)、Ubuntu s390x(CPU)、Ubuntu x64(Vulkan)、Ubuntu arm64(Vulkan)、Ubuntu x64(ROCm 7.2)、Ubuntu x64(OpenVINO)、Ubuntu x64(SYCL FP32/FP16);Android arm64(CPU);Windows x64(CPU)、Windows arm64(CPU)、Windows arm64(OpenCL Adreno)、Windows x64(CUDA 12/13、Vulkan、OpenVINO、SYCL、HIP);openEuler x86(310p、910b ACL Graph)和 aarch64(310p、910b ACL Graph)已禁用。此外还包含 UI 组件。
该版本主要聚焦测试基础设施优化和量化选择修复,未引入新模型或架构变更。避免多次构建 get-model.cpp 可缩短 CI 时间,修复量化类型选择可能影响低比特推理的正确性。
llama.cpp 持续高频发布,保持对多平台(包括 s390x、openEuler 等小众架构)的支持,体现了开源社区对推理部署广泛兼容性的重视。
对于依赖 llama.cpp 进行本地推理的开发者,该版本提升了 CI 效率和量化稳定性,降低了维护成本。
后续版本可能继续优化构建速度和测试覆盖,并可能引入新的量化方法或硬件加速后端。