AGENT PULSESJCPal Special EditionAI Industry Evidence & Trends
Aug 5, 2026 · LMCache

Release v0.5.3rc4 · ROCm (gfx942, gfx950)

What Happened

LMCache 发布 v0.5.3rc4,提供针对 AMD Instinct gfx942 (MI300X/MI325X) 和 gfx950 (MI350X/MI355X) 的 ROCm 7.2 wheel,与上游 vllm/vllm-openai-rocm 镜像 ABI 匹配(torch 2.11, cp312)。安装命令:VERSION=v0.5.3rc4 pip install lmcache==${VERSION#v} --no-deps --find-links https://github.com/LMCache/LMCache/releases/expanded_assets/${VERSION}-rocm。

EVENT STORY

Development

  1. First ReportRelease v0.5.3rc4 · ROCm (gfx942, gfx950)LMCache
  2. Industry ResponseRelease v0.5.3 · ROCm (gfx942, gfx950)LMCache
  3. Current AssessmentLMCache 发布 ROCm 版本,反映了开源生态对 AMD GPU 支持的加强。随着 AMD Instinct 系列在 AI 推理市场的份额增长,缓存等基础设施的适配将降低 AMD 平台的使用门槛,可能推动更多企业采用 AMD GPU 进行推理部署。Agent Pulse · analysis
What Changed

LMCache 发布了 v0.5.3rc4 的 ROCm 版本,这是一个针对 AMD Instinct 系列 GPU(gfx942 和 gfx950)的 wheel 包。该版本与上游 vLLM 的 ROCm 镜像 ABI 匹配,基于 torch 2.11 和 Python 3.12。用户可以在现有的 vLLM ROCm 容器中通过 pip 安装此包,以启用 LMCache 的缓存功能。这标志着 LMCache 对 AMD 平台的支持进一步成熟,为使用 AMD GPU 的 vLLM 用户提供了官方缓存解决方案。

How the Capability Boundary Shifted

该版本针对 AMD Instinct gfx942 和 gfx950 架构,表明 LMCache 已适配 AMD 的 CDNA 架构。ABI 匹配上游 vllm-openai-rocm 镜像,确保与 vLLM 的兼容性。安装命令使用 --no-deps 和 --find-links,说明依赖由 vLLM 镜像提供,避免冲突。这为在 AMD GPU 上运行 vLLM 的用户提供了缓存能力,可能提升推理性能。

Why It Matters

LMCache 发布 ROCm 版本,反映了开源生态对 AMD GPU 支持的加强。随着 AMD Instinct 系列在 AI 推理市场的份额增长,缓存等基础设施的适配将降低 AMD 平台的使用门槛,可能推动更多企业采用 AMD GPU 进行推理部署。

Who It Affects

对于使用 AMD GPU 部署 vLLM 的企业,该版本提供了官方缓存支持,可能降低推理成本并提升吞吐量。这增强了 AMD 平台在 AI 推理市场的竞争力,可能影响企业的硬件采购决策。

What to Watch Next

后续可关注 LMCache 是否发布正式版(非 rc)以及是否支持更多 AMD GPU 架构。同时,vLLM 对 ROCm 的支持持续演进,LMCache 的适配可能成为 AMD 推理生态成熟度的信号。