宣布擴展 SageMaker AI 推論上的 G7e 執行個體區域
張貼日期:
2026年7月23日
我們很高興宣布,Amazon EC2 G7e 執行個體現已在 Amazon SageMaker AI 推論的亞太地區 (首爾)、歐洲 (倫敦) 和亞太地區 (東京) 提供。G7e 執行個體配備最多 8 個 NVIDIA RTX PRO 6000 Blackwell Server Edition GPU,每個 GPU 具備 96 GB 記憶體、第 5 代 Intel Xeon 處理器,以及最高 1,600 Gbps 的 Elastic Fabric Adapter 網路頻寬;與前一代 G6e 執行個體相比,推論效能最高可提升 2.3 倍。
透過此次區域擴展,您現在可在更靠近亞洲和歐洲終端使用者的位置,於 G7e 執行個體上部署推論端點,降低生成式 AI 工作負載的延遲。G7e 執行個體在單一執行個體上提供最高 768 GB 的總 GPU 記憶體,讓您無需多節點組態,即可使用 FP8 精確度服務最高 700 億個參數的中大型語言模型。這些執行個體非常適合需要高 GPU 記憶體容量和頻寬的 LLM 推論、影像和影片生成、空間運算及科學運算工作負載。
除了先前支援的區域外,適用於 SageMaker AI 推論的 G7e 執行個體現已在亞太地區 (首爾)、歐洲 (倫敦) 和亞太地區 (東京) 提供。如需這些執行個體的定價資訊,請瀏覽我們的定價頁面。