Anunciamos la expansión regional de las instancias G6 en SageMaker AI Inference

Publicado en: 23 de jul de 2026

Nos complace anunciar la disponibilidad de las instancias G6 de Amazon EC2 en la región AWS GovCloud (este de EE. UU.) en la inferencia de Amazon SageMaker AI. Las instancias G6 funcionan con hasta 8 GPU NVIDIA L4 Tensor Core, cada una con 24 GB de memoria, y procesadores EPYC de tercera generación de AMD, que ofrecen hasta el doble de rendimiento de inferencia de aprendizaje profundo en comparación con las instancias G4dn.

Con esta expansión regional, los organismos gubernamentales y las organizaciones que operan en las regiones GovCloud pueden implementar puntos de conexión de inferencia en las instancias G6 para prestar servicios a cargas de trabajo de IA generativa, incluidos modelos de lenguaje pequeños y medianos, la generación de imágenes y las tareas de visión artificial, al tiempo que cumplen con los estrictos requisitos de conformidad y residencia de los datos. Las instancias G6 ofrecen una excelente relación entre precio y rendimiento para las cargas de trabajo de inferencia de producción que caben en 24 GB de memoria de GPU.

Las instancias G6 para la inferencia de SageMaker AI ya están disponibles en AWS GovCloud (este de EE. UU.), además de en las regiones compatibles anteriormente. Para obtener información sobre estas instancias, consulte nuestra página de precios.