viable/strict/1788784700
PyTorch 发布了一个名为 viable/strict/1788784700 的版本,其中包含 Inductor 和 FlyDSL 的更新,新增了针对 gfx950 的 FlyDSL Grouped GEMM 以及 F.grouped_mm 功能。
Development
- First Reportviable/strict/1788784700PyTorch Core
- Industry Responseviable/strict/1788794812PyTorch Core
- Industry Responseviable/strict/1788863288PyTorch Core
- Industry Responseviable/strict/1788954639PyTorch Core
- Industry Responseviable/strict/1789022478PyTorch Core
- Industry Responseviable/strict/1789033813PyTorch Core
- Industry Responseviable/strict/1789041127PyTorch Core
- Industry Responseviable/strict/1789105823PyTorch Core
- Current AssessmentPyTorch 对 AMD gfx950 的优化表明 AMD 在 AI 加速器市场的地位正在提升,PyTorch 生态正在更广泛地支持非 NVIDIA 硬件,这可能推动更多企业考虑 AMD 作为替代方案。Agent Pulse · analysis
PyTorch 在 2026 年 9 月 7 日发布了版本 viable/strict/1788784700,该版本为 Inductor 和 FlyDSL 添加了针对 AMD gfx950 的 Grouped GEMM 支持,并引入了 F.grouped_mm 操作。这一更新表明 PyTorch 正在扩展对 AMD GPU 架构的优化,特别是针对 gfx950 的矩阵乘法运算。
该版本新增了 FlyDSL Grouped GEMM 和 F.grouped_mm,可能用于优化多个矩阵乘法操作的批处理执行,减少内核启动开销并提高 GPU 利用率。对于使用 AMD gfx950 的开发者,这可能意味着更高效的推理和训练性能。
PyTorch 对 AMD gfx950 的优化表明 AMD 在 AI 加速器市场的地位正在提升,PyTorch 生态正在更广泛地支持非 NVIDIA 硬件,这可能推动更多企业考虑 AMD 作为替代方案。
对于使用 AMD GPU 的 AI 公司,此更新可能降低推理成本并提高性能,增强 PyTorch 在 AMD 平台上的竞争力。
未来可关注 PyTorch 对 gfx950 的进一步优化,以及 F.grouped_mm 在其他硬件上的支持情况。