AGENT PULSESJCPal Special EditionAI Industry Evidence & Trends
Sep 18, 2026 · MPSInductor

viable/strict/1789721576: [MPSInductor] Add some of the missing ops in mps inductor (#197403)

What Happened

PyTorch 合并 PR #197403,为 MPSInductor 补齐此前在 MPS 上编译会抛 NotImplementedError 的算子:sinh、cosh、asinh、acosh、hypot、copysign、logical_xor、frexp、ldexp。该变更同时出现在 viable/strict/1789721576 与 trunk/15a004da3fcc9e4a24a809622c7aa188add714d1 两个发布标签中,由 malfet 批准。

EVENT STORY

Development

  1. First Reportviable/strict/1789721576: [MPSInductor] Add some of the missing ops in mps inductor (#197403)PyTorch Core
  2. Industry Responsetrunk/15a004da3fcc9e4a24a809622c7aa188add714d1: [MPSInductor] Add some of the missing ops in mps inductor (#197403)PyTorch Core
  3. Current Assessment这是 PyTorch 对 Apple 芯片后端持续补课的常规维护动作,说明 MPS 生态的算子覆盖仍在追赶 CUDA,而非出现新的能力跃迁。判断:对以 Mac 作为本地开发或小规模推理环境的团队,后端成熟度是选型变量之一,但单次算子补齐不足以改变整体格局。可验证下一信号:后续若干版本中 MPSInductor 的 NotImplementedError 类 issue 数量是否持续下降。Agent Pulse · analysis
What Changed

PyTorch 的 MPSInductor 后端此前在编译 sinh、cosh、asinh、acosh、hypot、copysign、logical_xor、frexp、ldexp 这些算子时会抛出 NotImplementedError,PR #197403 将其补齐。证据来自 PyTorch Core 的两个发布标签(viable/strict/1789721576 与 trunk/15a004da3fcc9e4a24a809622c7aa188add714d1),发布时间均为 2026-09-18,批准者为 malfet。这是 Apple MPS 后端算子覆盖度的增量修复,未涉及新模型、新硬件或性能数据。

How the Capability Boundary Shifted

从算子清单看,补齐的是双曲/反双曲函数、hypot、copysign、logical_xor 以及 frexp/ldexp 这类指数分解与位级操作,属于数值与逐元素路径的覆盖缺口,而非核心矩阵运算。判断:这类缺口通常只在特定模型或自定义 kernel 落到 MPS 后端时才暴露,因此修复的价值在于减少 fallback 到 CPU 或直接报错的路径。可验证下一信号:在 MPS 上跑含上述算子的模型,确认不再抛 NotImplementedError,并观察是否仍存在隐式 device 回退。

Why It Matters

这是 PyTorch 对 Apple 芯片后端持续补课的常规维护动作,说明 MPS 生态的算子覆盖仍在追赶 CUDA,而非出现新的能力跃迁。判断:对以 Mac 作为本地开发或小规模推理环境的团队,后端成熟度是选型变量之一,但单次算子补齐不足以改变整体格局。可验证下一信号:后续若干版本中 MPSInductor 的 NotImplementedError 类 issue 数量是否持续下降。

Who It Affects

对依赖 Mac 做本地开发或端侧推理的团队,减少 NotImplementedError 意味着更少的手写 fallback 与更短的调试链路,属于降低工程摩擦而非直接降本。判断:其商业价值体现在开发效率与可移植性,而非单位算力成本。可验证下一信号:团队在 MPS 上运行目标模型时,是否仍需为上述算子维护自定义实现或强制 CPU 路径。

What to Watch Next

若此类补齐持续,MPS 后端可覆盖的模型范围会缓慢扩大,本地 Mac 训练与推理的可用性随之提升。但证据未给出性能、精度或覆盖率的量化结果,因此不宜推断速度或成本改善。可验证下一信号:PyTorch 后续 release note 中 MPSInductor 相关条目是否从「补算子」转向性能与精度优化。