AGENT PULSESJCPal Special EditionAI 行业证据与趋势
2026年8月17日 · NVIDIA

NVIDIA Nemotron 3.5 Lightning now available in Amazon SageMaker JumpStart

发生了什么

NVIDIA Nemotron 3.5 Lightning,一个为高容量代理工作负载构建的开放模型,现已在 Amazon SageMaker JumpStart 中可用。该模型为 30B Mixture-of-Experts(3B 激活),据称可为常驻代理提供高达 4 倍的吞吐量和高达 30% 更快的任务完成速度。

EVENT STORY

发展脉络

  1. 首次出现NVIDIA Nemotron 3.5 Lightning now available in Amazon SageMaker JumpStartAWS Machine Learning Blog
  2. 当前判断NVIDIA 与 AWS 合作,通过 SageMaker JumpStart 分发其开放模型,这表明模型提供商与云平台之间的合作日益增多,以简化企业部署。此举可能加剧与 Anthropic、Meta 等公司的竞争,并推动代理工作负载的标准化。可验证的下一信号是:其他云平台(如 Google Cloud 或 Azure)是否也会提供该模型,以及企业采用率是否上升。Agent Pulse · 分析
改变了什么

NVIDIA Nemotron 3.5 Lightning 是一个开放模型,专为高容量代理工作负载设计,现已在 Amazon SageMaker JumpStart 中提供。该模型采用 30B Mixture-of-Experts 架构,激活参数为 3B,据称可为常驻代理提供高达 4 倍的吞吐量和高达 30% 更快的任务完成速度。AWS 博客文章展示了如何部署该模型,并强调了其在代理场景中的性能优势。

能力边界怎么变了

Nemotron 3.5 Lightning 采用 MoE 架构,30B 总参数但仅激活 3B,这解释了其高吞吐量。4 倍吞吐量和 30% 更快任务完成的声称表明,该模型针对推理效率进行了优化,可能通过稀疏激活和优化内核实现。对于代理工作负载,低延迟和高吞吐量至关重要,因此该模型可能采用量化或蒸馏技术。下一步可验证的信号是:独立基准测试或用户报告是否证实这些性能数字,以及模型在长上下文或多轮对话中的表现。

为什么重要

NVIDIA 与 AWS 合作,通过 SageMaker JumpStart 分发其开放模型,这表明模型提供商与云平台之间的合作日益增多,以简化企业部署。此举可能加剧与 Anthropic、Meta 等公司的竞争,并推动代理工作负载的标准化。可验证的下一信号是:其他云平台(如 Google Cloud 或 Azure)是否也会提供该模型,以及企业采用率是否上升。

对谁有影响

对于企业,该模型提供了高吞吐量和低延迟,可能降低代理工作负载的推理成本。通过 SageMaker JumpStart 的集成,企业可以快速部署,减少基础设施开销。可验证的下一信号是:企业案例研究或成本分析是否显示总拥有成本降低。

接下来观察

随着代理工作负载的增长,对高效推理模型的需求将增加。Nemotron 3.5 Lightning 的可用性可能促使更多企业部署常驻代理,并推动 MoE 架构在代理场景中的采用。未来可关注该模型的后续版本或竞争对手的类似产品。