NVIDIA Nemotron 3.5 Lightning 模型现已在 Amazon SageMaker JumpStart 中推出
发布于: 2026年8月11日
NVIDIA 的 Nemotron 3.5 Lightning 模型现已在 Amazon SageMaker JumpStart 中推出,可为 AWS 客户提供该类别中最快的开源模型,适用于持久化智能体工作负载和快速任务执行。
Nemotron 3.5 Lightning 模型专为持久化智能体与高吞吐量企业级自动化而构建,涵盖个人助理、金融文档处理、网络安全分诊以及电信运营等领域。该模型基于混合专家(MoE)架构打造,总参数量为 300 亿,每次前向传播仅激活 30 亿参数,吞吐量可达同类模型的 4 倍(约 410 个词元/秒),任务完成速度提升 30%。它基于 Nemotron 3 Ultra 进行了蒸馏处理,可借助 DFlash 投机解码处理高达 100 万个词元的上下文,并且可直接与主流代理框架集成。该模型全部采用开放数据集训练而成,企业可针对自有工具、工作流和策略开展后训练,并可在边缘、本地或云基础设施上部署,享有完整所有权。
借助 SageMaker JumpStart,客户只需点击几下即可部署该模型,以支持特定的 AI 工作负载。
要开始使用这些模型,请导航到 SageMaker 控制台中的 SageMaker JumpStart 模型目录,或使用 SageMaker Python SDK 将模型部署到您的 AWS 账户。有关在 SageMaker JumpStart 中部署和使用基础模型的更多信息,请参阅 Amazon SageMaker JumpStart 文档。