Qwen3.6-35B-A3B-NVFP4 と Wan2.1-T2V-1.3B-Diffusers モデルが Amazon SageMaker JumpStart で利用可能に

投稿日: 2026年9月14日

NVIDIA の Qwen3.6-35B-A3B-NVFP4 および Alibaba の Wan2.1-T2V-1.3B-Diffusers の各モデルが Amazon SageMaker JumpStart で利用可能になり、AWS のお客様が利用できる基盤モデルの選択肢が拡充されました。これら 2 つのモデルは、長文推論を伴うエージェンティックコーディングから軽量なテキスト動画生成まで多岐にわたる専門機能を提供するもので、高品質かつスケーラブルな AI ソリューションを AWS のインフラストラクチャにデプロイすることを可能にします。

これらのモデルは、専門的な機能によって、さまざまなエンタープライズ AI の課題に対処します。

Qwen3.6-35B-A3B-NVFP4 は、Alibaba の Qwen3.6-35B-A3B を NVIDIA が量子化したモデルであり、エージェンティックコーディング、マルチモーダル推論、および長文コンテキストの理解に最適化されています。この Mixture-of-Experts モデルは全体で 350 億パラメータを備えていますが、1 トークンあたりに実行されるのは 30 億パラメータ (256 個のエキスパートのうち 8 個) のみです。また、YaRN スケーリング技術によって約 100 万トークンまで拡張可能な、262K トークンのコンテキストウィンドウをサポートしています。NVIDIA の ModelOpt フレームワークを用いて NVFP4 形式に量子化されているため、メモリ消費量を大幅に削減しつつも、対話をまたぐ思考プロセスの維持に加え、マルチトークン予測や複数ステップのエージェント処理におけるツール呼び出しの機能が保持されます。

Wan2.1-T2V-1.3B-Diffusers は、コンシューマーグレードのハードウェアでのテキスト動画生成において優れた性能を発揮します。新開発の変分オートエンコーダー (VAE) を備えたディフュージョントランスフォーマーアーキテクチャをベースとするこの 13 億パラメータモデルは、わずか 8.19 GB の VRAM で動作し、テキストプロンプトから高品質で物理的に一貫した動画クリップを生成します。RTX 4090 グラフィックボードを使用した場合、480p 解像度の 5 秒の動画を約 4 分で出力でき、現在利用可能なオープンソース動画生成モデルの中で最も導入しやすいモデルの 1 つとなっています。

SageMaker JumpStart を使用すると、お客様は数回クリックするだけでこれらのモデルをデプロイし、特定の AI ユースケースに対応できます。

これらのモデルの使用を開始するには、SageMaker コンソールの SageMaker JumpStart モデルカタログにアクセスするか、SageMaker Python SDK を使用して AWS アカウントにモデルをデプロイしてください。SageMaker JumpStart での基盤モデルのデプロイと使用方法の詳細については、Amazon SageMaker JumpStart のドキュメントをご覧ください。