AGENT PULSESJCPal Special EditionAI 行业证据与趋势
2026年7月23日 · Ollama

v0.32.3

发生了什么

Ollama 发布 v0.32.3,修复模型下载停滞、恢复 Claude Code Channels、修复 Anthropic thinking streams、Hermes Desktop 尊重 --force-build、扩展 GPU 支持(Windows ARM64 CUDA、B200 通过 CUDA 12、Linux CUDA/ROCm iGPU 降低内存)、为 Laguna 2.1 模型添加聊天/思考/工具调用支持(含 Metal 推理修复)、修复 GLM 工具调用被静默丢弃、更新 MLX 和 llama.cpp 引擎。v0.32.2 已撤回。

EVENT STORY

发展脉络

  1. 首次出现v0.32.3Ollama
  2. 行业反馈v0.32.2Ollama
  3. 当前判断Ollama 作为本地模型运行工具,持续快速迭代,反映开源生态对本地推理和工具调用稳定性的需求。v0.32.2 被撤回,说明发布流程存在风险,但快速修复体现了社区驱动的敏捷开发。Agent Pulse · 分析
改变了什么

Ollama 发布 v0.32.3,修复了模型下载停滞、集成问题(Claude Code Channels、Anthropic thinking streams、Hermes Desktop --force-build)、扩展 GPU 支持(Windows ARM64 CUDA、B200、Linux iGPU 内存优化)、为 Laguna 2.1 模型添加聊天/思考/工具调用支持(含 Metal 修复)、修复 GLM 工具调用丢弃问题,并更新 MLX 和 llama.cpp 引擎。v0.32.2 被撤回,建议使用 v0.32.3。

能力边界怎么变了

该版本修复了 GLM 工具调用在生成结束时被静默丢弃的问题,表明工具调用稳定性是当前重点。新增 Laguna 2.1 模型支持,包括聊天、思考和工具调用,并修复 Metal 推理,显示对新兴模型和硬件兼容性的持续投入。GPU 支持扩展(Windows ARM64 CUDA、B200、Linux iGPU 内存优化)表明推理基础设施的优化方向。

为什么重要

Ollama 作为本地模型运行工具,持续快速迭代,反映开源生态对本地推理和工具调用稳定性的需求。v0.32.2 被撤回,说明发布流程存在风险,但快速修复体现了社区驱动的敏捷开发。

对谁有影响

对于依赖 Ollama 进行本地推理的开发者,此版本提升了稳定性和兼容性,减少了工具调用失败和下载问题,降低了集成成本。对使用 GPU 的用户,扩展支持可能降低硬件门槛。

接下来观察

后续版本可能继续优化工具调用稳定性,扩展更多模型和硬件支持,并改进集成兼容性。可关注对更多模型架构的支持和推理性能的进一步提升。