Amazon SageMaker AI Batch Transform prend désormais en charge les instances G6e
Amazon SageMaker AI prend désormais en charge les instances Amazon EC2 G6e pour la transformation par lots. Batch Transform vous permet d’exécuter des prédictions sur des jeux de données stockés dans Amazon S3 et convient aux grands jeux de données qui ne nécessitent pas de point de terminaison d’inférence persistant.
Les instances Amazon EC2 G6e sont alimentées par jusqu’à huit GPU NVIDIA L40S Tensor Core avec 48 Go de mémoire par GPU et des processeurs AMD EPYC de 3e génération. Les instances G6e offrent des performances améliorées pour les charges de travail gourmandes en ressources GPU. Avec ce lancement, vous pouvez utiliser des instances G6e pour des charges de travail d’inférence hors ligne gourmandes en ressources GPU, notamment des modèles de langage volumineux et des modèles de diffusion qui génèrent des images, des vidéos et du son. Pour commencer, sélectionnez un type d’instance ml.g6e pris en charge lors de la création d’une tâche de transformation par lots via les kits AWS SDK, l’AWS CLI ou l’API CreateTransformJob.
Le support G6e pour Batch Transform est disponible dans les Régions USA Est (Virginie du Nord), USA Est (Ohio), USA Ouest (Oregon), Asie-Pacifique (Mumbai) et Asie-Pacifique (Hyderabad). Pour en savoir plus, rendez-vous sur la page produit Amazon SageMaker AI et consultez la documentation sur Batch Transform. Pour en savoir plus sur la tarification de ces instances, consultez notre page de tarification.