Amazon SageMaker AI 現在支援訓練和處理任務的執行個體偏好清單
張貼日期: 2026年9月15日
今天,Amazon SageMaker AI 宣布推出訓練和處理任務的執行個體偏好清單,讓您更輕鬆、更快速地為工作負載找到運算容量。許多 AI 訓練、微調和資料處理工作負載在數種執行個體類型或大小上的執行效能都相當。然而,在此之前,您在提交任務時只能指定一種執行個體類型,並等待 SageMaker 為您的任務找到該特定執行個體。對於尖峰期間的高需求 GPU,由於等待時間難以預測,客戶有時必須建立複雜的重試邏輯,或同時提交多個使用不同執行個體類型的任務,以找到第一個可用的選項。現在,您只要提供工作負載可接受的執行個體類型優先順序清單,SageMaker 就會自動依您的偏好,在第一個可用組態上執行您的任務。有了這項解決方案,您的訓練或處理任務很可能會更快開始。
如要使用此功能,請在提交訓練或處理任務時,依優先順序指定您的執行個體類型和數量偏好。例如,您的清單可能包含偏好兩個 ml.g6.48xlarge 執行個體或四個 ml.g5.48xlarge 執行個體。SageMaker 會依序查看清單,並在第一個有可用容量的組態上啟動您的任務。您也可以在同一次任務提交中,設定運算容量來源是要使用隨需來源,還是您預留的 SageMaker Flexible Training Plans。此功能可簡化在高需求期間為任務取得運算的流程,並減少您原本必須進行的無差異手動重試,而且全都在您已在使用的 SageMaker 訓練和處理任務 API 中完成。
SageMaker 訓練和處理任務的執行個體偏好清單即日起已在所有可透過 SageMaker CLI、API、SDK 和主控台 UI 使用 SageMaker 的 AWS 區域推出。如要進一步了解,請參閱我們的文件或發布部落格。