Qwen3.6-35B-A3B-NVFP4 和 Wan2.1-T2V-1.3B-Diffusers 模型現在已在 Amazon SageMaker JumpStart 上推出
NVIDIA 的 Qwen3.6-35B-A3B-NVFP4 和 Alibaba 的 Wan2.1-T2V-1.3B-Diffusers 模型現在已在 Amazon SageMaker JumpStart 上推出,擴展了 AWS 客戶可使用的基礎模型組合。這兩款模型帶來專精能力,涵蓋具備長上下文推理的代理程式編碼,以及輕量級文字轉影片生成,讓客戶能在 AWS 基礎設施上部署高效能、可擴展的 AI 解決方案。
這些模型以其專精能力解決不同的企業 AI 挑戰:
Qwen3.6-35B-A3B-NVFP4 專為代理程式編碼、多模態推理和長上下文理解進行最佳化,是阿里巴巴 Qwen3.6-35B-A3B 的 NVIDIA 量化版本。這個混合專家模型包含 35B 總參數,每個字符僅啟用 3B (256 個專家中的 8 個),支援 262K 字符的上下文視窗,並可透過 YaRN 擴展延伸至約 1M。使用 NVIDIA 的 ModelOpt 架構量化為 NVFP4,可在對話輪次之間保留思考、多字符預測,以及多步驟代理管道的工具呼叫能力,同時大幅降低記憶體占用。
Wan2.1-T2V-1.3B 擴散器在消費級硬體上的文字轉影片生成表現優異。此模型建構於擴散變壓器範例之上,搭載創新的視訊變分自動編碼器 (VAE),為 1.3B 參數模型,可依據文字提示生成高品質且符合物理規律的視訊短片,且僅需 8.19 GB 的 VRAM。它能在 RTX 4090 上以約 4 分鐘的時間產生 5 秒的 480p 影片,堪稱市面上最容易取得的開源影片生成模型之一。
透過 SageMaker JumpStart,客戶只需點擊幾下,即可部署任何一種模型來滿足其特定 AI 使用案例。
若要開始使用這些模型,請前往 SageMaker 主控台中的 SageMaker JumpStart 模型目錄,或使用 SageMaker Python SDK 將模型部署至您的 AWS 帳戶。如需在 SageMaker JumpStart 中部署與使用基礎模型的詳細資訊,請參閱 Amazon SageMaker JumpStart 文件。