Доступны модели Qwen3.6-35B-A3B-NVFP4 и Wan2.1-T2V-1.3B-Diffusers в Amazon SageMaker JumpStart

Проведено: 14 сент. 2026 г.

В компоненте Amazon SageMaker JumpStart теперь доступны модели Qwen3.6-35B-A3B-NVFP4 от NVIDIA и Wan2.1-T2V-1.3B-Diffusers от Alibaba, что расширяет портфель базовых моделей, предлагаемых клиентам AWS. Эти две модели предоставляют такие специализированные возможности, как агентное написание кода с длинным контекстом логических рассуждений, а также экономичная генерация видео из текста, что позволяет клиентам развертывать высокопроизводительные и масштабируемые ИИ-решения на базе инфраструктуры AWS.

Специализированные возможности этих моделей предназначены для решения различных задач корпоративного ИИ.

Qwen3.6-35B-A3B-NVFP4 оптимизирована для агентного написания кода, мультимодальных логических рассуждений и анализа длинного контекста и представляет собой квантованный NVIDIA вариант Qwen3.6-35B-A3B от Alibaba. Эта модель на основе архитектуры «Смесь экспертов» (Mixture-of-Experts) содержит 35 млрд совокупных параметров с активацией только 3 млрд на каждый токен (8 экспертов из 256). Она поддерживает контекстное окно размером 262 тыс. токенов с возможностью расширения примерно до 1 млн методом масштабирования YaRN. Модель была квантована в формат NVFP4 посредством платформы ModelOpt от NVIDIA и способна учитывать течение беседы, выдавать прогнозы с применением множества токенов и вызывать инструменты из многоэтапных агентных конвейеров – и все это с использованием значительно меньшего объема памяти.

Модель Wan2.1-T2V-1.3B-Diffusers лучше всего подходит для генерации видео из текста на оборудовании потребительского класса. Она построена на основе парадигмы диффузионного трансформера и использует новый вариационный автокодировщик (VAE) для видео, содержит 1,3 млрд параметров и генерирует высококачественные видеоклипы, в которых не нарушаются законы физики, на основе текстовых промптов, при этом требуя всего 8,19 ГБ видеопамяти. Она способна создать 5-секундный видеоролик с разрешением 480p на RTX 4090 примерно за 4 минуты, что делает ее одной из самых доступных моделей генерации видео с открытым исходным кодом.

Используя SageMaker JumpStart, клиенты могут развернуть любую из этих моделей всего несколькими щелчками мыши для своих примеров использования искусственного интеллекта.

Чтобы начать работу с этими моделями, откройте каталог моделей SageMaker JumpStart в консоли SageMaker или воспользуйтесь пакетом средств разработки ПО (SDK) SageMaker для Python, чтобы развернуть модели в своем аккаунте AWS. Подробные инструкции о развертывании и использовании базовых моделей в SageMaker JumpStart см. в документации Amazon SageMaker JumpStart.