Les modèles de diffuseurs Qwen3.6-35B-A3B-NVFP4 et Wan2.1-T2V-1.3B sont désormais disponibles sur Amazon SageMaker JumpStart

Publié le: 14 sept. 2026

Les modèles de diffuseurs Qwen3.6-35B-A3B-NVFP4 de NVIDIA et Wan2.1-T2V-1.3B d'Alibaba sont désormais disponibles sur Amazon SageMaker JumpStart, élargissant ainsi le portefeuille de modèles de fondation proposés aux clients AWS. Ces deux modèles offrent des fonctionnalités spécialisées allant du codage agentique à un raisonnement contextuel long et à la génération légère de texte en vidéo, permettant aux clients de déployer des solutions d'IA mises à l’échelle et performantes sur l'infrastructure AWS.

Ces modèles répondent aux différents défis de l’IA d’entreprise grâce à des fonctionnalités spécialisées :

Le Qwen3.6-35B-A3B-NVFP4 est optimisé pour le codage agentique, le raisonnement multimodal et la compréhension du contexte à long terme en tant que variante quantifiée par NVIDIA du Qwen3.6-35B-A3B d'Alibaba. Ce modèle mixte d'experts contient 35 milliards de paramètres au total, dont seulement 3 sont activés par jeton (8 experts sur 256), prenant en charge une fenêtre de contexte de 262 000 jetons extensible à environ 1 million via la mise à l'échelle YaRN. Quantifié selon la norme NVFP4 à l'aide du framework ModelOpt de NVIDIA, il permet de réfléchir tout au long des conversations, de prédire plusieurs jetons et d'utiliser des outils faisant appel à des pipelines d'agents en plusieurs étapes, le tout avec une empreinte mémoire considérablement réduite.

Les diffuseurs Wan2.1-T2V-1.3B excellent dans la génération de texte-vidéo sur du matériel grand public. Construit sur le paradigme du transformateur de diffusion avec un nouvel auto-encodeur variationnel (VAE) vidéo, ce modèle à 1,3 milliards de paramètres génère des clips vidéo de haute qualité et cohérents sur le plan physique à partir d'invites textuelles, tout en ne nécessitant que 8,19 Go de VRAM. Il peut produire une vidéo 480p de 5 secondes sur un RTX 4090 en 4 minutes environ, ce qui en fait l'un des modèles de génération vidéo open source les plus accessibles disponibles.

Avec SageMaker JumpStart, les clients peuvent déployer n’importe lequel de ces modèles en quelques clics pour répondre à leurs cas d’utilisation spécifiques de l’IA.

Pour commencer à utiliser ces modèles, accédez au catalogue de modèles SageMaker JumpStart dans la console SageMaker ou utilisez le kit SDK Python de SageMaker pour déployer les modèles sur votre compte AWS. Pour en savoir plus sur le déploiement et l’utilisation de modèles de base dans SageMaker JumpStart, consultez la documentation relative à Amazon SageMaker JumpStart.