SageMaker AI Inference에서 G6 인스턴스의 리전 확장 발표

게시된 날짜: 2026년 7월 23일

Amazon SageMaker AI Inference를 통해 Amazon EC2 G6 인스턴스를 AWS GovCloud(미국 동부) 리전에서 사용할 수 있다는 소식을 발표하게 되어 기쁩니다. G6 인스턴스는 각각 24GB의 메모리를 갖춘 최대 8개의 NVIDIA L4 Tensor Core GPU와 3세대 AMD EPYC 프로세서로 구동되어 G4dn 인스턴스에 비해 최대 2배의 딥 러닝 추론 성능을 제공합니다.

이번 리전 확장을 통해 GovCloud에서 운영하는 정부 기관 및 조직은 G6 인스턴스에 추론 엔드포인트를 배포하여 엄격한 규정 준수 및 데이터 레지던시 요구 사항을 준수하는 동시에 중소 언어 모델, 이미지 생성, 컴퓨터 비전 작업을 비롯한 생성형 AI 워크로드를 지원할 수 있습니다. G6 인스턴스는 24GB의 GPU 메모리에 맞는 프로덕션 추론 워크로드를 위한 강력한 가격 대비 성능을 제공합니다.

SageMaker AI Inference를 위한 G6 인스턴스는 이제 이전에 지원되던 리전 외에도 AWS GovCloud(미국 동부)에서 사용할 수 있습니다. 인스턴스에 대한 요금 정보는 요금 페이지를 참조하세요.