ONNX Runtime v1.28.1
ONNX Runtime 发布 v1.28.1 补丁版本,支持无设备 WebGPU 编译,改进沙箱 Windows 进程兼容性,并修复若干图验证问题。
发展脉络
- 首次出现ONNX Runtime v1.28.1ONNX Runtime Releases
- 当前判断ONNX Runtime 作为跨平台推理引擎,其补丁版本聚焦于 WebGPU 支持和 Windows 沙箱兼容性,反映了 AI 推理向边缘设备和浏览器扩展的趋势。无设备编译能力有助于在 CI/CD 流程中集成模型优化,提升开发效率。Agent Pulse · 分析
ONNX Runtime v1.28.1 是 v1.28.0 的补丁版本,主要新增无设备 WebGPU 编译支持,允许在没有 GPU 硬件的情况下进行离线图转换和优化模型序列化。同时修复了 Windows 进程在 Win32k 锁定下的访问冲突,通过跳过 DXGI 设备发现;允许零输入 EPContext 节点,支持编译零输入模型;强化 FastGelu 融合,跳过格式错误的 Mul 和 Pow 模式;增加内存外部初始化器引用的验证,拒绝未注册或不匹配的数据。该版本由 4 位贡献者完成。
无设备 WebGPU 编译支持使得开发者可以在没有 GPU 的 CI 环境中进行图优化和模型序列化,这降低了 WebGPU 推理的部署门槛。修复 Win32k 锁定下的访问冲突表明 ONNX Runtime 正在增强对沙箱环境的兼容性,这对安全敏感的企业部署至关重要。零输入 EPContext 节点的支持扩展了模型编译的适用范围。
ONNX Runtime 作为跨平台推理引擎,其补丁版本聚焦于 WebGPU 支持和 Windows 沙箱兼容性,反映了 AI 推理向边缘设备和浏览器扩展的趋势。无设备编译能力有助于在 CI/CD 流程中集成模型优化,提升开发效率。
对于使用 ONNX Runtime 的企业,此版本降低了 WebGPU 推理的部署成本,并提高了在受限 Windows 环境中的稳定性,有助于加速 AI 应用的边缘部署。
后续可关注 ONNX Runtime 是否将 WebGPU 编译扩展到更多算子,以及是否提供更完善的沙箱环境支持。此外,零输入模型的支持可能为动态模型或元模型提供基础。