Amazon SageMaker AI теперь поддерживает бессерверную настройку модели NVIDIA Nemotron 3.5 Lightning
Amazon SageMaker AI теперь поддерживает бессерверную настройку модели NVIDIA Nemotron 3.5 Lightning с помощью контролируемой точной настройки (SFT), прямой оптимизации с предпочтением (DPO) и точной настройки подкреплением (RFT). Это одна из последних открытых моделей от NVIDIA, использующая гибридную архитектуру типа «смесь экспертов» (Mixture-of-Experts) с 3 млрд активных параметров и 30 млрд параметров в сумме. Помимо развертывания этой модели в SageMaker AI, теперь ее можно адаптировать к конкретным предметным областям и рабочим процессам.
Настройка модели позволяет адаптировать базовые модели к собственным данным, чтобы модель меньшего размера достигала уровня качества продвинутой модели при выполнении ваших задач, сокращая затраты и задержки. Вы можете использовать маркированные данные с SFT для повышения точности выполнения задач в конкретной предметной области, данные о предпочтениях с DPO для согласования результатов с коммуникативным стилем вашей организации или сигналы вознаграждения с RFT для повышения производительности при выполнении новых задач. Благодаря бессерверной настройке SageMaker AI берет на себя все задачи по предоставлению инфраструктуры и оркестрации обучения, поэтому вы можете сосредоточиться на данных и оценке, а не на управлении кластером, и платить только за то, что используете.
Бессерверная настройка модели NVIDIA Nemotron 3.5 Lightning в SageMaker AI доступна в следующих регионах: Восток США (Северная Вирджиния), Запад США (Орегон), Азиатско-Тихоокеанский регион (Токио) и Европа (Ирландия). Чтобы начать работу, перейдите на страницу «Модели» в Студии Amazon SageMaker, чтобы запустить задачу настройки, или используйте SageMaker Python SDK для программного доступа. Дополнительные сведения см. в документации по настройке моделей в Amazon SageMaker AI.