Annonce d’une extension régionale des instances G6 sur SageMaker AI Inference
Nous avons le plaisir d’annoncer la disponibilité des instances Amazon EC2 G6 dans la Région AWS GovCloud (US, côte est) sur Amazon SageMaker AI Inference. Les instances G6 sont alimentées par un maximum de huit GPU NVIDIA L4 Tensor Core, chacun doté de 24 Go de mémoire, et de processeurs AMD EPYC de troisième génération, offrant des performances d’inférence de deep learning jusqu’à deux fois supérieures à celles des instances G4dn.
Grâce à cette expansion régionale, les agences gouvernementales et les organisations opérant dans les régions GovCloud peuvent déployer des points de terminaison d’inférence sur des instances G6 pour répondre à des charges de travail d’IA générative, notamment des modèles linguistiques de petite à moyenne taille, la génération d’images et des tâches de vision par ordinateur, tout en respectant des exigences strictes de conformité et de résidence des données. Les instances G6 offrent un excellent rapport prix/performances pour les charges de travail d’inférence de production pouvant contenir 24 Go de mémoire GPU.
Les instances G6 pour l’inférence SageMaker AI sont désormais disponibles dans la Région AWS GovCloud (US, côte est), en plus des régions précédemment prises en charge. Pour en savoir plus sur la tarification de ces instances, consultez notre page de tarification.