b10299
llama.cpp 发布 b10299 版本,修复了 MSL 中 threadgroup 矩阵数组实例化导致的编译错误,改用 POD threadgroup half 数组并转换为 threadgroup half4x4* 进行矩阵索引。
Development
- First Reportb10299llama.cpp
- Current Assessmentllama.cpp 持续维护跨平台 GPU 支持,此修复确保 Apple 平台上的 Metal 后端稳定。这反映了开源推理框架对多平台兼容性的重视,可能影响依赖 llama.cpp 的本地推理应用。Agent Pulse · analysis
llama.cpp 在 2026 年 8 月 7 日发布 b10299 版本,修复了 Metal Shading Language (MSL) 中声明 threadgroup 矩阵数组(如 threadgroup half4x4)时出现的编译错误。该错误源于 MSL 矩阵类型没有零参数默认构造函数,且 threadgroup 变量不能有初始化器。修复方案是声明一个 POD threadgroup half 数组,并转换为 threadgroup half4x4* 进行矩阵索引。此修复影响 Apple Silicon 和 Intel 平台的 macOS/iOS 构建。
此修复针对 MSL 中 threadgroup 内存的矩阵数组使用,通过 POD 数组和指针转换绕过 MSL 对矩阵类型构造的限制。这暗示在 GPU 内核中,矩阵数组的声明方式需要谨慎处理,可能影响性能优化。下一步可观察是否引入性能回归或进一步优化。
llama.cpp 持续维护跨平台 GPU 支持,此修复确保 Apple 平台上的 Metal 后端稳定。这反映了开源推理框架对多平台兼容性的重视,可能影响依赖 llama.cpp 的本地推理应用。
此修复提升了 llama.cpp 在 Apple 设备上的稳定性,对依赖该框架的开发者工具和本地推理产品有积极影响,可能促进 Apple 生态中的 AI 应用开发。
未来可能看到更多针对 MSL 或其他 GPU 语言的兼容性修复,以及 llama.cpp 对 Apple 平台的持续优化。可关注后续版本是否引入新的矩阵操作优化。