Amazon SageMaker AI Batch Transform unterstützt jetzt G6e-Instances
Amazon SageMaker AI unterstützt jetzt Amazon-EC2-G6e-Instances für Batch Transform. Mit Batch Transform können Sie Prognosen für in Amazon S3 gespeicherte Datensätze vornehmen. Es eignet sich auch für große Datensätze, die keinen dauerhaften Inferenzendpunkt benötigen.
Amazon-EC2-G6e-Instances werden von bis zu 8 NVDIA-L40S-Tensor-Core-GPUs mit 48 GB Arbeitsspeicher pro GPU und AMD-EPYC-Prozessoren der dritten Generation angetrieben. G6e-Instances bieten eine verbesserte Leistung bei GPU-intensiven Workloads. Mit dieser Einführung können Sie G6e-Instances für GPU-intensive Offline-Inferenz-Workloads verwenden, einschließlich großer Sprachmodelle und Diffusionsmodelle, die Bilder, Video und Audio generieren. Wählen Sie zunächst einen unterstützten ml.g6e-Instanztyp aus, wenn Sie einen Batch-Transform-Job über AWS-SDKs, AWS-CLI oder die CreateTransformJob-API erstellen.
Die G6e-Unterstützung für Batch Transform ist in den Regionen USA Ost (Nord-Virginia), USA Ost (Ohio), USA West (Oregon), Asien-Pazifik (Mumbai) und Asien-Pazifik (Hyderabad) verfügbar. Weitere Informationen finden Sie auf der Produktseite zu Amazon SageMaker AI und in der Dokumentation zu Batch Transform. Preisinformationen zu diesen Instances finden Sie auf unserer Preisseite.