NVIDIA Nemotron 3.5 Lightning 模型現已適用於 Amazon SageMaker JumpStart

張貼日期: 2026年8月11日

NVIDIA Nemotron 3.5 Lightning 現已適用於 Amazon SageMaker JumpStart,使 AWS 客戶得以存取同類中速度最快的開放式模型,從而用於持久性代理程式工作負載和快速執行任務。

Nemotron 3.5 Lightning 專為持久性代理程式和高輸送量企業自動化作業而設計,適用範圍涵蓋個人助理、財務文件處理、網路安全分級和電信營運等領域。該模型採用混合專家 (MoE) 架構,具有 30B 總參數,每次前向傳遞僅使用 3B 參數,可達到高達 4 倍的輸送量 (約 410 個字符/秒),並且任務完成速度提升 30%。該模型由 Nemotron 3 Ultra 蒸餾而成,透過 DFlash 推測解碼來處理多達 1M 的內容字符,並直接與常用的代理執行框架整合。該模型是完全使用開放式資料集訓練而成,從而允許企業對自有工具、工作流程和政策進行後期訓練,並在邊緣、內部部署或雲端基礎結構中以完整擁有權進行部署。

有了 SageMaker JumpStart,客戶只需按幾下滑鼠即可部署此模型,從而為特定 AI 工作負載提供支援。

若要開始使用這些模型,請前往 SageMaker 主控台中的 SageMaker JumpStart 模型目錄,或使用 SageMaker Python SDK 將模型部署至您的 AWS 帳戶。如需在 SageMaker JumpStart 中部署與使用基礎模型的詳細資訊,請參閱 Amazon SageMaker JumpStart 文件