Gemma-4-31B-it-assistant 및 Gemma-4-31B-IT-NVFP4 모델, 이제 Amazon SageMaker JumpStart에서 사용 가능
이제 Google DeepMind의 Gemma-4-31B-it-assistant 모델과 NVIDIA의 Gemma-4-31B-IT-NVFP4 모델을 Amazon SageMaker JumpStart에서 사용할 수 있게 됨에 따라 AWS 고객에게 제공되는 파운데이션 모델 포트폴리오를 확장할 수 있게 되었습니다. 이 두 모델은 플래그십 Gemma 4 31B 고밀도 아키텍처를 완전 정밀도 및 최적화된 양자화 변형으로 엔터프라이즈 워크로드에 제공하여 고객이 AWS 인프라에 고성능의 확장 가능한 AI 솔루션을 배포할 수 있도록 합니다.
이러한 모델은 특수 기능을 통해 다양한 엔터프라이즈 AI 문제를 해결합니다.
Gemma-4-31B-it-assistant는 Google의 플래그십 31B 밀도 모델의 어시스턴트 튜닝 변형으로서 멀티모달 추론, 코딩 및 에이전틱 워크플로를 위해 구축되었습니다. 텍스트 및 이미지 입력(비디오를 프레임 시퀀스로 포함)을 처리하고 256K 토큰 컨텍스트 창을 사용하여 140개 이상의 언어를 지원하는 텍스트 출력을 생성합니다. Arena AI 텍스트 순위표에서 오픈 모델 부문에서 3위에 랭크되어 20배 더 큰 경쟁 모델들을 제치고 있는 이 모델은 로컬 슬라이딩 윈도우와 완전한 글로벌 어텐션을 인터리빙하는 하이브리드 어텐션 메커니즘과 자율 에이전트 구축을 위한 네이티브 함수 호출을 특징으로 합니다.
Gemma-4-31B-IT-NVFP4는 일부 메모리 풋프린트만으로 동일한 Gemma 4 31B 기능을 제공합니다. NVIDIA의 ModelOpt 프레임워크를 사용하여 4비트 FP4 정밀도로 양자화된 이 모델은 메모리 사용량을 최대 18.5GB(기본 모델보다 68% 작음)로 줄이고 약 2.5배 빠른 추론을 달성하면서 원래 모델 품질의 97~99%를 유지합니다. NVIDIA RTX, DGX Spark 및 데이터 센터 GPU를 활용한 비용 효율적인 고처리량 프로덕션 배포에 적합합니다.
SageMaker JumpStart를 사용하면 고객은 몇 번의 클릭만으로 이러한 모델을 배포하여 특정 AI 사용 사례를 해결할 수 있습니다.
이 모델을 시작하려면 SageMaker 콘솔의 SageMaker JumpStart 모델 카탈로그로 이동하거나 SageMaker Python SDK를 사용하여 모델을 AWS 계정에 배포하세요. SageMaker JumpStart에서 파운데이션 모델을 배포하고 사용하는 방법에 대한 자세한 내용은 Amazon SageMaker JumpStart 설명서를 참조하세요.