AGENT PULSESJCPal Special EditionAI Industry Evidence & Trends
Jul 29, 2026 · llama.cpp

b10175

What Happened

llama.cpp 发布 b10175 版本,新增 RDNA3.5 和 RDNA3 的 mmq 配置,支持独立调优。

EVENT STORY

Development

  1. First Reportb10175llama.cpp
  2. Current Assessmentllama.cpp 持续扩展硬件支持,尤其是 AMD GPU 的优化,反映了开源推理框架对多样化硬件生态的重视,可能推动 AMD GPU 在 AI 推理中的采用。Agent Pulse · analysis
What Changed

llama.cpp 发布 b10175 版本,主要更新包括为 AMD RDNA3.5 和 RDNA3 架构添加独立的 mmq(混合量化)配置,使其可以独立调优。该版本支持多种平台和硬件后端,包括 macOS Apple Silicon、Linux x64/arm64(CPU、Vulkan、ROCm 7.2、OpenVINO、SYCL)、Windows x64(CPU、CUDA 12/13、Vulkan、OpenVINO、SYCL、HIP)、Android arm64、openEuler 等。

How the Capability Boundary Shifted

新增 RDNA3.5 和 RDNA3 的独立 mmq 配置,表明 llama.cpp 正在细化对不同 GPU 架构的量化优化支持,可能提升 AMD GPU 上的推理性能。

Why It Matters

llama.cpp 持续扩展硬件支持,尤其是 AMD GPU 的优化,反映了开源推理框架对多样化硬件生态的重视,可能推动 AMD GPU 在 AI 推理中的采用。

Who It Affects

对于使用 AMD GPU 进行推理的开发者,独立 mmq 配置可带来性能提升,降低推理成本,增强 llama.cpp 在 AMD 生态中的竞争力。

What to Watch Next

后续可关注 llama.cpp 是否进一步优化 RDNA4 或 Intel GPU 的 mmq 配置,以及这些优化对实际推理吞吐量的影响。