Distributing Security Controls Through Harness Engineering
SHarD (Secure Harness Distribution) 是一个基于 Pi agent harness 构建的可分发安全控制框架,通过 OS 沙箱、技能扫描和工具限制三类控制,在 23 项 OWASP Top 10 for Agentic Applications 测试中达到 100% 调整得分,并可通过单条安装命令分发。
发展脉络
- 首次出现Distributing Security Controls Through Harness EngineeringarXiv cs.AI
- 当前判断该方案表明安全控制可以从代理供应商解耦,由企业或平台团队自行分发,降低了对单一供应商的依赖。这可能会推动企业采用更灵活的代理安全策略,而非等待供应商内置安全功能。可验证的下一信号:是否有企业安全团队开始基于类似 harness 架构构建内部代理安全平台。Agent Pulse · 分析
AI 编码代理正以历史速度被采用,但安全和风险问题仍是规模化部署的主要障碍。现有安全控制未系统性地分发给工程团队,且供应商原生方案引入生态依赖。本文研究了是否可以在商业 AI 编码代理上实现现成的安全控制,并通过自定义代理 harness 扩展到分布式用户群。采用分阶段测试方法,在四种代理配置(两种商业代理有无控制、基线 harness 和安全强化 harness)上使用源自 OWASP Top 10 for Agentic Applications 的 23 项测试套件进行评估。SHarD 基于 Pi agent harness 构建,嵌入了 OS 沙箱、技能扫描和工具限制三类安全控制,可通过单条安装命令分发,同时保持与直接安装在商业代理上等效的效果,调整得分为 100%。
SHarD 通过将安全控制嵌入 agent harness 层而非代理本身,实现了安全策略的集中分发和独立更新。其三类控制(OS 沙箱、技能扫描、工具限制)覆盖了 OWASP Top 10 for Agentic Applications 中的关键风险,且不依赖特定商业代理的 API 或插件机制。可验证的下一信号:是否有其他研究复现 SHarD 在更多代理(如 Claude Code、GitHub Copilot)上的效果,或是否有开源项目采用类似架构。
该方案表明安全控制可以从代理供应商解耦,由企业或平台团队自行分发,降低了对单一供应商的依赖。这可能会推动企业采用更灵活的代理安全策略,而非等待供应商内置安全功能。可验证的下一信号:是否有企业安全团队开始基于类似 harness 架构构建内部代理安全平台。
对于采用 AI 编码代理的企业,SHarD 提供了一种低成本、可快速部署的安全方案,无需等待代理供应商更新安全功能。这可以加速代理在安全敏感环境(如金融、医疗)中的采用。可验证的下一信号:是否有企业公开部署 SHarD 或类似方案并报告安全事件减少。
如果 SHarD 模式被广泛采用,代理安全将从“代理内置”转向“平台层控制”,类似 Web 应用中的 WAF 或 RASP。这可能会催生新的安全工具类别,专注于 agent harness 的安全增强。可验证的下一信号:是否有安全厂商推出商业化的 agent harness 安全产品。