AGENT PULSESJCPal Special EditionAI Industry Evidence & Trends
Jul 23, 2026 · Ollama

v0.32.3

What Happened

Ollama 发布 v0.32.3,修复模型下载停滞、恢复 Claude Code Channels、修复 Anthropic thinking streams、Hermes Desktop 尊重 --force-build、扩展 GPU 支持(Windows ARM64 CUDA、B200 通过 CUDA 12、Linux CUDA/ROCm iGPU 降低内存)、为 Laguna 2.1 模型添加聊天/思考/工具调用支持(含 Metal 推理修复)、修复 GLM 工具调用被静默丢弃、更新 MLX 和 llama.cpp 引擎。v0.32.2 已撤回。

EVENT STORY

Development

  1. First Reportv0.32.3Ollama
  2. Industry Responsev0.32.2Ollama
  3. Current AssessmentOllama 作为本地模型运行工具,持续快速迭代,反映开源生态对本地推理和工具调用稳定性的需求。v0.32.2 被撤回,说明发布流程存在风险,但快速修复体现了社区驱动的敏捷开发。Agent Pulse · analysis
What Changed

Ollama 发布 v0.32.3,修复了模型下载停滞、集成问题(Claude Code Channels、Anthropic thinking streams、Hermes Desktop --force-build)、扩展 GPU 支持(Windows ARM64 CUDA、B200、Linux iGPU 内存优化)、为 Laguna 2.1 模型添加聊天/思考/工具调用支持(含 Metal 修复)、修复 GLM 工具调用丢弃问题,并更新 MLX 和 llama.cpp 引擎。v0.32.2 被撤回,建议使用 v0.32.3。

How the Capability Boundary Shifted

该版本修复了 GLM 工具调用在生成结束时被静默丢弃的问题,表明工具调用稳定性是当前重点。新增 Laguna 2.1 模型支持,包括聊天、思考和工具调用,并修复 Metal 推理,显示对新兴模型和硬件兼容性的持续投入。GPU 支持扩展(Windows ARM64 CUDA、B200、Linux iGPU 内存优化)表明推理基础设施的优化方向。

Why It Matters

Ollama 作为本地模型运行工具,持续快速迭代,反映开源生态对本地推理和工具调用稳定性的需求。v0.32.2 被撤回,说明发布流程存在风险,但快速修复体现了社区驱动的敏捷开发。

Who It Affects

对于依赖 Ollama 进行本地推理的开发者,此版本提升了稳定性和兼容性,减少了工具调用失败和下载问题,降低了集成成本。对使用 GPU 的用户,扩展支持可能降低硬件门槛。

What to Watch Next

后续版本可能继续优化工具调用稳定性,扩展更多模型和硬件支持,并改进集成兼容性。可关注对更多模型架构的支持和推理性能的进一步提升。