viable/strict/1788427814: Update torch-xpu-ops commit pin (#195708)
PyTorch 更新了 torch-xpu-ops 的 commit 到 intel/torch-xpu-ops@b32054,修复了 safe-softmax 错误清零含 NaN 行、_weight_int4pack_mm_xpu 的 int4 打包矩阵乘法结果,以及 LoadWithCastFP 中的 -Wswitch 构建警告。
Development
- First Reportviable/strict/1788427814: Update torch-xpu-ops commit pin (#195708)PyTorch Core
- Industry Responsetrunk/484ff351d0f7b9e949d0974c0bcd1b356b4b214f: Update torch-xpu-ops commit pin (#195708)PyTorch Core
- Current AssessmentPyTorch 对 XPU 后端的持续更新表明 Intel 硬件在 AI 训练和推理中的支持正在加强,但修复数值正确性问题也说明 XPU 生态仍处于完善阶段。Agent Pulse · analysis
PyTorch 在 2026 年 9 月 3 日更新了 torch-xpu-ops 的 commit 到 intel/torch-xpu-ops@b32054。该更新包含三个修复:修复 safe-softmax 错误清零含 NaN 行的问题,修复 _weight_int4pack_mm_xpu 的 int4 打包矩阵乘法结果,以及抑制 LoadWithCastFP 中的 -Wswitch 警告以解决构建警告。这些修复针对 XPU 后端,涉及数值正确性和构建稳定性。
safe-softmax 的错误清零含 NaN 行可能影响注意力机制在异常输入下的行为,修复后能更正确处理 NaN。_weight_int4pack_mm_xpu 的修复表明 int4 量化矩阵乘法在 XPU 上存在正确性问题,修复后结果更准确。构建警告的抑制有助于减少编译噪音。
PyTorch 对 XPU 后端的持续更新表明 Intel 硬件在 AI 训练和推理中的支持正在加强,但修复数值正确性问题也说明 XPU 生态仍处于完善阶段。
对于使用 Intel XPU 进行 AI 推理的团队,此修复可提高模型输出的正确性,减少因数值错误导致的调试成本。
后续可关注 PyTorch 对 XPU 后端的更多修复,以及 int4 量化在 XPU 上的性能表现。