AWS Neuron 2.32 為 Trn2 和 Trn 擴充 NKI 程式設計、MXFP8 培訓核心,以及可變大小的集合運算
張貼日期: 2026年8月21日
AWS Neuron 2.32.0 現已推出,導入 NKI 0.6.0,包含裝置上 top-K 指令、適用於各 rank 持有不同大小張量之核心的可變長度 `all-gather `,以及用於資料相依迭代的新迴圈建構模組。
此版本還為專家混合 (MoE) 培訓和稀疏注意力導入 13 個新的 NKI Library 核心,以及新的 Neuron 代理程式式開發技能,可將變壓器模型移植至 vLLM Neuron 外掛程式。NKI Library 核心涵蓋 DeepSeek-V3.2 稀疏多頭潛在注意力的上下文編碼、解碼步驟的 MXFP8 注意力,以及相符的 MXFP8 前向和反向傳播,讓區塊式 MoE 層能以 MXFP8 端到端培訓,另提供 22 個其他核心的 PyTorch 參考實作。
Neuron Runtime 在 Trn2 和 Trn3 上新增可變大小的 all-gather、reduce-scatter 和 all-to-all 集合運算,讓每個 rank 貢獻或接收不同數量的元素。vLLM Neuron 外掛程式升級至 vLLM 0.24.0,並包含於所有 Neuron 深度學習 AMI 和深度學習容器中。Neuron Compiler 新增對 64 位元整數編譯的明確控制,而 Neuron Explorer 則在 System Trace Viewer 中新增每個核心的主機 CPU 使用率。
AWS Neuron 適用於提供 Amazon EC2 Trn1、Trn2、Trn3、Inf2 和 Inf1 執行個體的所有 AWS 區域。如需區域可用性的詳細資訊,請參閱 AWS 區域表。
請參閱以下資源開始使用: