Qwen3.6-35B-A3B-NVFP4 및 Wan2.1-T2V-1.3B-Diffusers 모델, 이제 Amazon SageMaker JumpStart에서 사용 가능

게시된 날짜: 2026년 9월 14일

이제 NVIDIA의 Qwen3.6-35B-A3B-NVFP4 모델과 Alibaba의 Wan2.1-T2V-1.3B-Diffusers을 Amazon SageMaker JumpStart에서 사용할 수 있게 됨에 따라 AWS 고객에게 제공되는 파운데이션 모델 포트폴리오를 확장할 수 있게 되었습니다. 이 두 모델은 에이전틱 코딩과 긴 컨텍스트 추론, 가벼운 텍스트-비디오 생성을 아우르는 특수 기능을 제공하므로 고객은 AWS 인프라에 확장 가능한 고성능 AI 솔루션을 배포할 수 있습니다.

이러한 모델은 특수 기능을 통해 다양한 엔터프라이즈 AI 문제를 해결합니다.

Qwen3.6-35B-A3B-NVFP4는 Alibaba의 Qwen3.6-35B-A3B의 NVIDIA 양자화 변형으로, 에이전틱 코딩, 멀티모달 추론, 긴 컨텍스트 이해에 최적화되어 있습니다. 이 전문가 혼합 모델에는 총 350억 개의 파라미터가 포함되어 있지만 토큰당 30억 개(256개 전문가 중 8개)만 활성화되며, YarN 스케일링을 통해 최대 100만 개까지 확장 가능한 262K 토큰 컨텍스트 창을 지원합니다. NVIDIA의 ModelOpt 프레임워크를 사용하여 NVFP4 양자화된 이 모델은 대화 전환, 다중 토큰 예측, 다단계 에이전트 파이프라인을 위한 도구 호출 기능을 모두 보존하면서도 메모리 사용량을 획기적으로 줄였습니다.

Wan2.1-T2V-1.3B-Diffusers는 소비자용 하드웨어에서 텍스트를 비디오로 생성하는 데 탁월합니다. 새로운 변분 오토인코더(VAE)를 사용한 확산 트랜스포머 패러다임을 기반으로 구축된 이 13억 파라미터 모델은 8.19GB의 VRAM만 요구하면서도 텍스트 프롬프트에서 물리 법칙을 준수하는 고품질 비디오 클립을 생성합니다. RTX 4090에서 약 4분 만에 5초짜리 480p 비디오를 제작할 수 있어 가장 접근성이 뛰어난 오픈 소스 비디오 생성 모델 중 하나입니다.

SageMaker JumpStart를 사용하면 고객은 몇 번의 클릭만으로 이러한 모델을 배포하여 특정 AI 사용 사례를 해결할 수 있습니다.

이 모델을 시작하려면 SageMaker 콘솔의 SageMaker JumpStart 모델 카탈로그로 이동하거나 SageMaker Python SDK를 사용하여 모델을 AWS 계정에 배포하세요. SageMaker JumpStart에서 파운데이션 모델을 배포하고 사용하는 방법에 대한 자세한 내용은 Amazon SageMaker JumpStart 설명서를 참조하세요.