Amazon SageMaker AI kini mendukung kustomisasi model nirserver untuk NVIDIA Nemotron 3.5 Lightning
Amazon SageMaker AI kini mendukung kustomisasi model nirserver untuk model NVIDIA Nemotron 3.5 Lightning menggunakan penyempurnaan terawasi (SFT), Optimasi Preferensi Langsung (DPO), dan penyempurnaan penguatan (RFT). Ini adalah salah satu model open-weight terbaru dari NVIDIA dan menggunakan arsitektur hibrida Mixture-of-Experts dengan 3B parameter aktif dan total 30B parameter. Selain menerapkan model ini pada SageMaker AI, Anda sekarang dapat mengadaptasinya ke domain dan alur kerja spesifik Anda.
Kustomisasi model memungkinkan Anda untuk menyesuaikan model dasar dengan data kepemilikan Anda sendiri sehingga model yang lebih kecil dan tepat dapat menyamai kualitas model terdepan pada tugas Anda, mengurangi biaya dan latensi. Anda dapat menggunakan data berlabel dengan SFT untuk meningkatkan akurasi pada tugas-tugas spesifik domain, data preferensi dengan DPO untuk menyelaraskan output dengan karakter organisasi Anda, atau sinyal penghargaan dengan RFT untuk meningkatkan kinerja pada tugas-tugas baru. Dengan kustomisasi nirserver, SageMaker AI menangani semua penyediaan infrastruktur dan orkestrasi pelatihan, sehingga Anda dapat fokus pada data dan evaluasi alih-alih manajemen klaster, dan hanya membayar sesuai dengan penggunaan.
Kustomisasi model nirserver untuk NVIDIA Nemotron 3.5 Lightning di SageMaker AI tersedia di AS Timur (Virginia Utara), AS Barat (Oregon), Asia Pasifik (Tokyo), dan Eropa (Irlandia). Untuk memulai, buka halaman Models di Amazon SageMaker Studio guna meluncurkan tugas kustomisasi, atau gunakan SageMaker Python SDK untuk akses secara terprogram. Untuk mempelajari lebih lanjut, lihat dokumentasi kustomisasi model Amazon SageMaker AI.