b10332
llama.cpp 发布 b10332 版本,移除 GGML_HIP_ROCWMMA_FATTN 相关 CI 配置,并更新了多平台构建矩阵,包括 macOS、Linux、Windows、Android 和 openEuler 等。
Development
- First Reportb10332llama.cpp
- Current Assessmentllama.cpp 持续维护多平台支持,包括对 Ascend 等国产硬件的适配,反映了开源生态对多样化硬件兼容性的重视。移除特定 CI 配置可能表明项目在简化构建流程,以降低维护成本。Agent Pulse · analysis
llama.cpp 在 2026 年 8 月 9 日发布了 b10332 版本。该版本的主要变更是在 CI 中移除了 GGML_HIP_ROCWMMA_FATTN 相关配置。同时,版本更新了多平台的构建矩阵,涵盖 macOS(Apple Silicon、Intel)、Linux(多种 CPU 架构、Vulkan、ROCm、OpenVINO、SYCL)、Windows(CPU、CUDA、Vulkan、OpenVINO、SYCL、HIP)、Android(CPU、OpenCL)以及 openEuler(Ascend 310p、910b)等。部分平台(如 macOS Intel、iOS XCFramework、openEuler 部分配置)被标记为 DISABLED。
移除 GGML_HIP_ROCWMMA_FATTN 可能意味着 llama.cpp 在 ROCm 平台上对 Flash Attention 的实现进行了调整,可能转向更稳定的方案或优化了构建流程。这暗示了在 AMD GPU 上的注意力计算路径可能发生变化,值得关注后续性能对比。
llama.cpp 持续维护多平台支持,包括对 Ascend 等国产硬件的适配,反映了开源生态对多样化硬件兼容性的重视。移除特定 CI 配置可能表明项目在简化构建流程,以降低维护成本。
对于依赖 llama.cpp 进行本地推理的企业,此版本更新可能影响其部署的稳定性和性能。移除 CI 配置可能减少构建时间,但需验证在目标硬件上的兼容性。
后续可关注 llama.cpp 在 ROCm 平台上的性能基准测试,以及是否会有新的注意力实现替代方案。同时,多平台构建矩阵的调整可能影响下游依赖该库的项目。